Proveedores de LLM
IaC Code admite multiples backends de proveedores de modelos. La seleccion del proveedor puede provenir de las opciones del CLI, variables de entorno o archivos de configuracion. La precedencia es:
CLI arguments > environment variables > configuration files
Proveedores en la Nube
| Valor del proveedor | Proposito |
|---|---|
DashScope | Endpoint compatible con Alibaba Cloud DashScope (Bailian) |
DashScope Token Plan | Endpoint Alibaba Cloud DashScope Token Plan |
OpenAI | Modelos de OpenAI |
Anthropic | Modelos de Anthropic |
DeepSeek | Modelos de DeepSeek |
Gemini | Modelos de Google Gemini |
Azure OpenAI | Servicio Azure OpenAI |
ModelScope | Endpoint de inferencia ModelScope |
Proveedores en China
| Valor del proveedor | Proposito |
|---|---|
Kimi CN | Endpoint Kimi (Moonshot AI) en China |
MiniMax CN | Endpoint MiniMax en China |
ZhiPu CN | Endpoint ZhiPu AI (GLM) en China |
Volcengine CN | Endpoint Volcengine (ByteDance) en China |
SiliconFlow CN | Endpoint SiliconFlow en China |
Proveedores Internacionales
| Valor del proveedor | Proposito |
|---|---|
Kimi Intl | Endpoint internacional Kimi (Moonshot AI) |
MiniMax Intl | Endpoint internacional MiniMax |
ZhiPu Intl | Endpoint internacional ZhiPu AI (GLM) |
SiliconFlow Intl | Endpoint internacional SiliconFlow |
Proveedores CodingPlan
| Valor del proveedor | Proposito |
|---|---|
Aliyun CodingPlan | Endpoint Alibaba Cloud CodingPlan |
Aliyun CodingPlan Intl | Endpoint internacional Alibaba Cloud CodingPlan |
ZhiPu CN CodingPlan | Endpoint ZhiPu AI CodingPlan en China |
ZhiPu Intl CodingPlan | Endpoint internacional ZhiPu AI CodingPlan |
Volcengine CodingPlan | Endpoint Volcengine CodingPlan |
Compatible / Endpoints Personalizados
| Valor del proveedor | Proposito |
|---|---|
OpenAPI Compatible | Cualquier endpoint de API compatible con OpenAI |
Anthropic Compatible | Cualquier endpoint de API compatible con Anthropic |
OpenRouter | Gateway de agregacion OpenRouter |
Proveedores Locales
| Valor del proveedor | Proposito |
|---|---|
Ollama | Servidor de modelos local Ollama |
LM Studio | Servidor de modelos local LM Studio |
Variables de Entorno de LLM
| Variable | Descripcion |
|---|---|
IAC_CODE_PROVIDER | Nombre del proveedor de modelos (sin distincion de mayusculas/minusculas). Consulta las tablas anteriores para valores validos |
IAC_CODE_MODEL | Nombre del modelo |
IAC_CODE_BASE_URL | Sobrescribe el endpoint de API del proveedor activo; tiene prioridad sobre el apiBase guardado y la URL predeterminada integrada |
IAC_CODE_API_KEY | Clave API del proveedor |
Responses API
Los proveedores que usan el protocolo de OpenAI utilizan Chat Completions de forma predeterminada. El protocolo integrado de un modelo puede ser Responses si sus llamadas a herramientas lo requieren. Los protocolos predeterminados y las restricciones de herramientas de Chat se mantienen en el catálogo integrado de modelos; no se incluye aquí una lista separada. Los proveedores Anthropic conservan su protocolo Messages actual.
Los proveedores que utilizan el protocolo OpenAI pueden seleccionar Responses de forma explícita para cada modelo, incluidos Azure OpenAI, openai_compatible y DashScope Token Plan. Configure apiBase con la URL base de un servicio que admita Responses. Para Azure OpenAI, utilice la URL base con /openai/v1/ y establezca model en el nombre del despliegue.
Azure OpenAI y DashScope Token Plan documentan la compatibilidad con Responses para determinados endpoints y modelos. En los endpoints compatibles personalizados y los planes de programación, la compatibilidad depende del servicio. Alibaba Cloud Coding Plan indica expresamente que no admite Responses. Si se selecciona Responses para un servicio o modelo que no lo admite, la solicitud devuelve un error; IaC Code no cambia automáticamente a Chat.
Para usar Responses con un modelo Qwen compatible, añada esta configuración a nivel de modelo en settings.yml y sustituya <model-id> por el ID real del modelo:
activeProvider: dashscope
providers:
dashscope:
model: <model-id>
models:
<model-id>:
apiMode: responses
Cambie apiMode a chat_completions para volver al protocolo anterior. Si lo omite, se utiliza el protocolo predeterminado del modelo; para los modelos de DashScope estándar sigue siendo Chat Completions. La configuración solo se aplica al modelo indicado dentro del proveedor indicado.
Si selecciona Chat de forma explícita, el modelo debe admitir llamadas a herramientas con el nivel de razonamiento elegido. Utilice Responses cuando la API Chat del modelo no admita esa combinación.
Consulte la configuración de ejecución para conocer los parámetros de solicitud y los límites de salida.