# Modelle & Anbieter ## Ueberblick Neotask unterstuetzt eine breite Palette von KI-Modellanbietern. Sie koennen cloud-gehostete Modelle von Anthropic, OpenAI und Google verwenden, lokale Modelle ueber Ollama oder vLLM ausfuehren oder sich mit jedem OpenAI-kompatiblen API-Endpunkt verbinden. ## Unterstuetzte Anbieter ### Cloud-Anbieter | Anbieter | Modelle | Auth | |----------|--------|------| | **Anthropic** | Claude Opus 4.6, Claude Sonnet 4.1, Claude Haiku 4.5 | API-Schluessel oder Setup-Token | | **OpenAI** | GPT-5.2, GPT-5.1, GPT-4 Turbo, GPT-4 | API-Schluessel | | **Google (Gemini)** | Gemini 3 Pro, Gemini 2 Flash, Gemini 1 Pro | API-Schluessel oder OAuth | | **Together AI** | Verschiedene Open-Weight-Modelle (Llama, Mixtral usw.) | API-Schluessel | | **Moonshot (Kimi)** | Moonshot v1 (32K, 128K Kontext) | API-Schluessel | | **OpenRouter** | 100+ Modelle von mehreren Anbietern | API-Schluessel | | **DeepSeek** | DeepSeek Chat, DeepSeek Coder | API-Schluessel | | **OpenCode Zen** | Claude-Varianten, speziell angepasste Modelle | API-Schluessel | ### Lokale Modellanbieter | Anbieter | Beschreibung | |----------|-------------| | **Ollama** | Open-Weight-Modelle lokal ausfuehren (Llama, Mistral usw.) | | **vLLM** | Hochdurchsatz-lokaler Inferenz-Server | | **LiteLLM** | Einheitlicher Proxy fuer 100+ Anbieter | ### Benutzerdefinierte Anbieter Verbinden Sie jede OpenAI-kompatible oder Anthropic-kompatible API durch Angabe einer Basis-URL und eines API-Schluessels. Dies funktioniert mit selbstgehosteten Inferenz-Servern, Enterprise-Proxy-Endpunkten und Drittanbieter-Modell-APIs. ## Modellkonfiguration ### Primaeres Modell Legen Sie ein Standardmodell fuer alle Agenten fest. Jeder Agent kann dies mit seinem eigenen primaeren Modell uebersteuern. ### Fallback-Ketten Konfigurieren Sie eine priorisierte Liste von Fallback-Modellen. Wenn das primaere Modell fehlschlaegt (Rate Limit, Ausfall, Auth-Fehler), versucht Neotask automatisch das naechste Modell in der Kette. ### Bildmodelle Separate Modellkonfiguration fuer Bildanalyse und -generierung. Unterstuetzt Claude Vision, GPT-4 Vision und DALL-E 3. ### Modell-Aliase Erstellen Sie Abkuerzungen fuer lange Modellnamen. Zum Beispiel den Alias `fast` fuer `anthropic/claude-haiku-4-5` zur schnellen Referenzierung. ### Pro-Agent-Uebersteuerungen Jeder Agent kann seine eigene Modellkonfiguration haben, unabhaengig vom globalen Standard. ### Modell-Allowlists Beschraenken Sie, welche Modelle Agenten verwenden koennen. Nuetzlich fuer Kostenkontrolle oder Compliance. ## API-Schluessel-Verwaltung ### Schluesselquellen (Prioritaetsreihenfolge) 1. Live-Override-Schluessel (hoechste Prioritaet) 2. Kommagetrennte Schluesselliste (Rotation) 3. Primaerschluessel 4. Nummerierte Schluessel (key_1, key_2 usw.) ### Automatische Schluesselrotation Wenn ein Rate Limit erreicht wird, rotiert Neotask automatisch zum naechsten verfuegbaren Schluessel. Nicht-Rate-Limit-Fehler geben sofort Fehler zurueck ohne Rotation. ### Pro-Anbieter-Konfiguration Jeder Anbieter kann eigene API-Schluessel, Auth-Profile und modellspezifische Einstellungen haben. ## Anbieter-Auth-Methoden | Methode | Beschreibung | |--------|-------------| | **API Key** | Standard-Bearer-Token-Authentifizierung | | **Setup Token** | Interaktiver Auth-Flow (Anthropic) | | **OAuth** | Delegierte Auth mit Refresh-Tokens (Google, GitHub Copilot) | | **Token Paste** | Manuelle Token-Eingabe fuer spezialisierte Anbieter | ## Modellauswahlprioritaet Wenn ein Agent einen LLM-Aufruf machen muss, werden Modelle in dieser Reihenfolge ausgewaehlt: 1. Pro-Agent-Uebersteuerung (falls gesetzt) 2. Globales Standardmodell 3. Modell-Allowlist (falls konfiguriert, begrenzt Optionen) 4. Erstes verfuegbares Modell (Fallback) ## Anbieterspezifische Tool-Beschraenkungen Sie koennen einschraenken, welche Tools fuer bestimmte Modelle oder Anbieter verfuegbar sind. Zum Beispiel ein weniger vertrauenswuerdiges Modell auf Dateioperationen beschraenken, waehrend Claude vollen Tool-Zugriff erhaelt.