Zum Hauptinhalt springen

LLM-Anbieter

IaC Code unterstuetzt mehrere Modellanbieter-Backends. Die Anbieterauswahl kann ueber CLI-Optionen, Umgebungsvariablen oder Konfigurationsdateien erfolgen. Die Rangfolge ist:

CLI-Argumente > Umgebungsvariablen > Konfigurationsdateien

Cloud-Anbieter​

AnbieterwertZweck
DashScopeAlibaba Cloud DashScope (Bailian) kompatibler Endpunkt
DashScope Token PlanAlibaba Cloud DashScope Token Plan Endpunkt
OpenAIOpenAI-Modelle
AnthropicAnthropic-Modelle
DeepSeekDeepSeek-Modelle
GeminiGoogle Gemini-Modelle
Azure OpenAIAzure OpenAI-Dienst
ModelScopeModelScope-Inferenz-Endpunkt

Anbieter in China​

AnbieterwertZweck
Kimi CNKimi (Moonshot AI) China-Endpunkt
MiniMax CNMiniMax China-Endpunkt
ZhiPu CNZhiPu AI (GLM) China-Endpunkt
Volcengine CNVolcengine (ByteDance) China-Endpunkt
SiliconFlow CNSiliconFlow China-Endpunkt

Internationale Anbieter​

AnbieterwertZweck
Kimi IntlKimi (Moonshot AI) internationaler Endpunkt
MiniMax IntlMiniMax internationaler Endpunkt
ZhiPu IntlZhiPu AI (GLM) internationaler Endpunkt
SiliconFlow IntlSiliconFlow internationaler Endpunkt

CodingPlan-Anbieter​

AnbieterwertZweck
Aliyun CodingPlanAlibaba Cloud CodingPlan-Endpunkt
Aliyun CodingPlan IntlAlibaba Cloud CodingPlan internationaler Endpunkt
ZhiPu CN CodingPlanZhiPu AI CodingPlan China-Endpunkt
ZhiPu Intl CodingPlanZhiPu AI CodingPlan internationaler Endpunkt
Volcengine CodingPlanVolcengine CodingPlan-Endpunkt

Kompatibel / Benutzerdefinierte Endpunkte​

AnbieterwertZweck
OpenAPI CompatibleBeliebiger OpenAI-kompatibler API-Endpunkt
Anthropic CompatibleBeliebiger Anthropic-kompatibler API-Endpunkt
OpenRouterOpenRouter-Aggregations-Gateway

Lokale Anbieter​

AnbieterwertZweck
OllamaOllama lokaler Modellserver
LM StudioLM Studio lokaler Modellserver

LLM-Umgebungsvariablen​

VariableBeschreibung
IAC_CODE_PROVIDERName des Modellanbieters (Gross-/Kleinschreibung wird nicht beachtet). Gueltige Werte siehe obige Tabellen
IAC_CODE_MODELModellname
IAC_CODE_BASE_URLÜberschreibt den API-Endpunkt des aktiven Anbieters; hat Vorrang vor dem gespeicherten apiBase und der integrierten Standard-URL
IAC_CODE_API_KEYAPI-Schluessel des Anbieters

Responses API​

Anbieter mit OpenAI-Protokoll verwenden standardmäßig Chat Completions. Bei Modellen, deren Werkzeugaufrufe dies erfordern, kann Responses als Standardprotokoll hinterlegt sein. Das Standardprotokoll und die Einschränkungen für Chat-Werkzeugaufrufe werden im integrierten Modellkatalog gepflegt; eine separate Modellliste wird hier nicht geführt. Anthropic-Anbieter verwenden weiterhin ihr bisheriges Messages-Protokoll.

Anbieter mit OpenAI-Protokoll können Responses ausdrücklich für einzelne Modelle auswählen, darunter Azure OpenAI, openai_compatible und DashScope Token Plan. Tragen Sie in apiBase eine Basis-URL ein, deren Dienst Responses unterstützt. Für Azure OpenAI verwenden Sie die Basis-URL mit /openai/v1/ und geben unter model den Bereitstellungsnamen an.

Azure OpenAI und DashScope Token Plan dokumentieren Responses-Unterstützung für entsprechende Endpunkte und Modelle. Bei benutzerdefinierten kompatiblen Endpunkten und Coding-Tarifen hängt die Unterstützung vom jeweiligen Dienst ab. Alibaba Cloud Coding Plan unterstützt Responses ausdrücklich nicht. Wird Responses für einen nicht unterstützten Dienst oder ein solches Modell gewählt, führt die Anfrage zu einem Fehler; IaC Code wechselt nicht automatisch zu Chat.

Um ein unterstütztes Qwen-Modell mit Responses zu verwenden, ergänzen Sie diese Modelleinstellung in settings.yml und ersetzen Sie <model-id> durch die tatsächliche Modell-ID:

activeProvider: dashscope
providers:
dashscope:
model: <model-id>
models:
<model-id>:
apiMode: responses

Setzen Sie apiMode auf chat_completions, um zurückzuwechseln. Ohne diesen Eintrag gilt das integrierte Standardprotokoll des Modells; für Modelle von Standard-DashScope bleibt dies Chat Completions. Die Einstellung gilt nur für das angegebene Modell beim angegebenen Anbieter.

Wenn Sie Chat ausdrücklich wählen, muss das Modell Werkzeugaufrufe mit der gewählten Reasoning-Stufe unterstützen. Verwenden Sie Responses, wenn die Chat-API des Modells diese Kombination nicht unterstützt.

Anfrageeinstellungen und Ausgabelimits finden Sie unter Laufzeitkonfiguration.