📊 Cronología de modelos
¿Cuándo llegó cada modelo — y cuándo desaparece algo? La crónica de los grandes modelos de IA: lanzamientos, retiradas y cambios de precio, cada uno con su fuente.
Claude Sonnet 5 — fin del precio de lanzamiento
El precio de lanzamiento de 2 $/10 $ por millón de tokens termina; después se aplica el precio regular de 3 $/15 $.
DeepSeek: los nombres de modelo antiguos se migran
A partir de este día, los nombres de API antiguos deepseek-chat y deepseek-reasoner apuntan a V4-Flash — quien use los modelos antiguos debería revisar su integración.
Claude Opus 5
Anthropic lanzó Claude Opus 5: el mismo precio que Opus 4.8 (5 $/25 $ por millón de tokens), contexto de 1M tokens, pensamiento activado de forma predeterminada, un control de esfuerzo en cinco niveles y un modo rápido al doble de precio (10 $/50 $). Desde Claude Code v2.1.219 (24 de julio de 2026), Opus 5 es allí el nuevo Opus estándar; Opus 4.8 sigue en uso como alternativa automática ante rechazos por motivos de seguridad.
Claude Fable 5 — permanente en Max y Team Premium
Desde el 20/07/2026 incluido en todos los planes Max y Team Premium (al 50 % de los límites). Pro y Team Standard mantienen el acceso mediante créditos de uso y reciben 100 $ de saldo único. El cierre anunciado antes no ocurrió.
Kimi K3
MoE de 2,8 billones de parámetros con contexto de 1M — según Moonshot, el modelo abierto más grande del mundo; los pesos llegan el 27 de julio, hasta entonces solo API.
Grok 4.5
Posicionado para programación agéntica, 500K de contexto, 2 $/6 $ por millón de tokens — el modelo más barato en la propia tabla comparativa de xAI.
Inkling (Thinking Machines)
Primer modelo de pesos abiertos del laboratorio de Mira Murati: un MoE con 975 000 millones de parámetros totales / 41 000 millones activos, contexto de 1M, 77,6 % en SWE-bench Verified — considerado el modelo abierto de EE. UU. más potente. La variante de preview más pequeña, Inkling-Small, tiene 12 000 millones de parámetros activos.
Muse Spark 1.1 + Meta Model API
El primer modelo frontier de pesos cerrados de Meta, accesible a través de la nueva Meta Model API compatible con el SDK de OpenAI (vista previa pública).
Familia GPT-5.6 (Sol, Terra, Luna)
Tres niveles: Sol como buque insignia (5 $/30 $), Terra como gama media (2,50 $/15 $) y Luna como la variante más barata (1 $/6 $).
Gemini CLI + Code Assist for GitHub descontinuados
Google descontinúa Gemini CLI para usuarios gratuitos; el sucesor es Antigravity CLI. Code Assist for GitHub: desaprobación desde el 18 de junio, cierre total el 17 de julio.
Qwen3.7-Max
El buque insignia agéntico de Alibaba ("diseñado para la era de los agentes") — por primera vez propietario en lugar de pesos abiertos, con contexto de 1M.
Gemini 3.5 Flash (GA)
Según Google, salida 4 veces más rápida y por delante de su propio 3.1 Pro en benchmarks de programación — Flash ya no es un nivel económico (1,50 $/9 $).
GLM-4.7
MoE de 358B bajo licencia MIT — caballo de batalla de pesos abiertos para programación agéntica, con una variante Flash gratuita.
Mistral Large 3
El buque insignia europeo de pesos abiertos: MoE de 675B bajo Apache 2.0, con visión y opción de alojamiento en la UE.