Modelos de IA

Los modelos frontera más relevantes del mercado, comparados.

⭐ Modelo de la semana
Anthropic

Claude Opus 5

El nuevo flagship de Opus: mismo precio que Opus 4.8 pero con capacidades de código agentic y uso de ordenador que se acercan a Fable 5.

Código agenticUso de ordenadorRazonamiento largo
97
€€€
Anthropic

Claude Fable 5.1

€€€

El modelo insignia de Anthropic desde septiembre de 2026, sucesor de Fable 5. Mantiene pensamiento adaptativo siempre activo y 1M de contexto, con caché de lectura hasta un 75% más barata y mejoras en agentes.

RazonamientoCódigoAgentes
1000k
$10/M
Anthropic

Claude Opus 5

€€€

El nuevo flagship de Opus: mismo precio que Opus 4.8 pero con capacidades de código agentic y uso de ordenador que se acercan a Fable 5.

Código agenticUso de ordenadorRazonamiento largo
1000k
$5/M
OpenAI

GPT-6 Astra

€€€

Modelo insignia de OpenAI, sucesor de GPT-5.6 Sol, centrado en uso de ordenador (navegador, IDE, hojas de cálculo), programación, ciencia, ciberseguridad y trabajo autónomo de largo horizonte.

uso de ordenador (computer use)programación avanzadatareas agénticas de largo horizonteinvestigación y ciencia
1000k
$10/M
OpenAI

GPT-5.6 Sol

€€€

El flagship de la nueva familia GPT-5.6. Orientado a trabajo empresarial, código e investigación científica.

Código agenticTrabajo empresarialInvestigación
1000k
$4/M
xAI

Grok 4.6

€€

Evolución de Grok 4.5 sobre la misma base de 1.5T parámetros, con mejoras de fine-tuning y RL. Coexiste con Grok 4.5 en la API de xAI, no lo sustituye.

Agentes de larga duraciónProgramaciónInvestigaciónTareas visuales interactivas
500k
$2/M
Anthropic

Claude Sonnet 5

€€

El nuevo Sonnet de Anthropic: rendimiento cercano a Opus 4.8 a un precio mucho menor. Modelo por defecto en Claude gratis y Pro.

AgentesCódigoEquilibrio
200k
$2/M
Google

Gemini 3.1 Pro

€€

El más potente de Google. Lidera en matemáticas y razonamiento científico (94.3% GPQA).

RazonamientoMultimodalCiencia
1000k
$2/M
Google

Gemini 3.8 Flash

€€

El "caballo de batalla" de Google desde septiembre de 2026: mantiene 1M de contexto y entrada multimodal, con mejoras en todos los benchmarks publicados frente a 3.7 Flash, sobre todo en código y tareas de agente.

CódigoTrabajo multimodalAgentes
1000k
$0.75/M
OpenAI

o3

€€€

El modelo de razonamiento más profundo de OpenAI. Piensa antes de responder.

RazonamientoCienciaMatemáticas
200k
$10/M
Moonshot AI

Kimi K3

€€

Modelo open-weight de 2.8 billones de parámetros de la china Moonshot AI. El modelo de pesos abiertos más grande hasta la fecha, competitivo con los modelos punteros occidentales.

Código webRazonamientoAgentes de navegación
1000k
$3/M
OpenAI

GPT-5.6 Terra

€€

Punto intermedio de la familia GPT-5.6: calidad cercana a GPT-5.5 a la mitad de coste.

Uso diarioAgentesEquilibrio calidad-precio
1000k
$2/M
Anthropic

Claude Sonnet 4.6

€€

El modelo de producción de Anthropic. Supera a Opus 4 en código a menor precio.

CódigoEscrituraAnálisis
200k
$3/M
Alibaba

Qwen3.8 Max

€€

Modelo MoE de 2.4 billones de parámetros de Alibaba (equipo Qwen), con entrada nativa de texto, imagen y vídeo.

RazonamientoCódigoMultimodal
1000k
$2/M
xAI

Grok 4.5

€€

Nuevo modelo de xAI orientado a negocio y código, a una fracción del coste de los modelos punteros equivalentes.

CódigoNegocioUso de herramientas agentic
500k
$2/M
DeepSeek

DeepSeek V4 Pro

€€

El modelo general más competitivo de DeepSeek. Calidad cercana a GPT-5.5 a fracción del precio.

CódigoAnálisisCoste
128k
$1.98-3.96/M
OpenAI

o4-mini

Razonamiento avanzado a precio asequible. El punto dulce de la familia o-series.

RazonamientoCódigo
200k
$1.1/M
Mistral

Mistral Large 3

€€

El modelo europeo de referencia. Datos en la UE y cumplimiento GDPR garantizado.

GDPRAnálisisCódigo
256k
$0.50/M
OpenAI

GPT-5.6 Luna

La opción más económica de la familia GPT-5.6, pensada para tareas rápidas y de alto volumen.

VelocidadCosteAlto volumen
1000k
$0.20/M
Google

Gemini 3.1 Flash-Lite

La opción más económica del mercado. Rápida y con contexto amplio.

VelocidadCosteUso diario
1000k
$0.10/M
Meta

Llama 4 Maverick

400B parámetros, 10M de contexto. El open source más potente del mercado.

PrivacidadCódigoMultimodal
10000k
Gratis
MiniMax

MiniMax M3

Modelo coder open-weight competitivo a un precio muy bajo.

CódigoOpen sourceCoste
256k
$0.30/M
DeepSeek

DeepSeek V4 Flash

Versión eficiente de DeepSeek V4: 284B de parámetros totales (13B activos), pensada para volumen alto a bajo coste.

Tareas rápidas y de alto volumenCoste ajustadoPrototipado
1000k
$0.22-0.44/M
Mistral

Codestral

Especializado 100% en programación. La alternativa económica a GitHub Copilot.

CódigoDebugAutocompletado
256k
$0.3/M
Anthropic

Claude Haiku 4.5

El más rápido y económico de Anthropic para integraciones de alto volumen.

VelocidadClasificaciónAlto volumen
200k
$1/M