Lista de modelos compatibles
Lista de modelos compatibles
Descripción general
El espacio de trabajo admite múltiples proveedores de LLM mediante un adaptador provider-agnostic. A continuación se enumeran todos los modelos preconfigurados y sus capacidades.
Matriz de capacidades de los modelos
| Modelo | Proveedor | Ventana de contexto | Vision | Document | Audio | Tool Use | Escenario recomendado |
|---|---|---|---|---|---|---|---|
| Claude Sonnet 4 | Anthropic | 200K | ✅ | ✅ | — | ✅ | Opción equilibrada preferida, ideal para uso diario y código |
| Claude Opus 4 | Anthropic | 200K | ✅ | ✅ | — | ✅ | El razonamiento más potente, tareas de análisis complejo |
| Claude 4 | Anthropic | 200K | ✅ | ✅ | — | ✅ | Todoterreno, excelente relación calidad-precio |
| Claude 3.5 Sonnet | Anthropic | 200K | ✅ | ✅ | — | ✅ | Estable y fiable, buena compatibilidad |
| Claude 3.5 Haiku | Anthropic | 200K | ✅ | — | — | ✅ | La respuesta más rápida, tareas sencillas |
| GPT-4o | OpenAI | 128K | ✅ | — | ✅ | ✅ | Compatibilidad con audio, multimodalidad rica |
| GPT-4o-mini | OpenAI | 128K | ✅ | — | ✅ | ✅ | Conversación diaria de menor costo |
| GPT-4-turbo | OpenAI | 128K | ✅ | — | — | ✅ | Modelo general clásico |
| GPT-4.1 | OpenAI | 1M | ✅ | — | — | ✅ | Contexto ultralargo, análisis de repositorios completos |
| o3 | OpenAI | 200K | ✅ | — | — | ✅ | Razonamiento profundo en matemáticas/lógica |
| o4-mini | OpenAI | 200K | ✅ | — | — | ✅ | Tareas de razonamiento ligero |
| DeepSeek-V4-Flash | DeepSeek | 1M | — | — | — | ✅ | Generación de código, costo extremadamente bajo |
| DeepSeek-V4-Pro | DeepSeek | 1M | — | — | — | ✅ | Razonamiento puro (sin llamada a herramientas) |
| Qwen-plus | Qwen | 128K | ✅ | — | — | ✅ | Optimizado para chino, bajo costo |
| Qwen-max | Qwen | 128K | ✅ | — | — | ✅ | El más potente en chino, tareas complejas en chino |
Descripción de las capacidades
Vision (comprensión de imágenes)
Permite adjuntar imágenes en los mensajes; el Agent puede comprender y analizar el contenido de las imágenes.
- Anthropic: bloque de contenido base64 image nativo
- OpenAI: image_url (formato data URI)
- Modelos no compatibles: la entrada de imágenes se filtra o se indica que no es compatible
Document (comprensión de documentos)
Permite pasar directamente documentos como PDF; el Agent puede leer y analizar el contenido del documento.
- Anthropic: bloque de contenido base64 document nativo
- Otros proveedores: se degrada a una descripción de texto o se indica que no es compatible
Audio (comprensión de audio)
Permite pasar contenido de audio.
- OpenAI: bloque de contenido audio nativo
- Otros proveedores: aún no compatible
Tool Use (llamada a herramientas)
Admite function calling / tool use; el Agent puede llamar a herramientas para ejecutar operaciones.
Formato de API
| Proveedor | Formato de API | Descripción |
|---|---|---|
| Anthropic | anthropic |
Anthropic Messages API |
| OpenAI | openai |
OpenAI Chat Completions / Responses API |
| DeepSeek | openai |
Compatible con el formato de OpenAI |
| Qwen | openai |
Compatible con el formato de OpenAI |
| Personalizado | openai / anthropic |
Se elige según el proveedor |
Modelos personalizados
Los usuarios pueden añadir modelos no preconfigurados en Configuración de modelos, lo que requiere una configuración manual:
| Elemento de configuración | Descripción |
|---|---|
| Nombre del modelo | Identificador del modelo LLM |
| Base URL | Dirección del endpoint de la API |
| API Key | Clave de acceso |
| Formato de API | anthropic u openai |
| Ventana de contexto | Cantidad de tokens |
| Marcadores de capacidad | vision / document / audio / tool_use |
Documentos relacionados
- Configuración de modelos — Selección de modelos y configuración de la API
- Compresión de contexto en 5 capas — Gestión de la ventana de contexto
