📊 Chronologie des modèles
Quand chaque modèle est-il arrivé — et quand quelque chose disparaît-il ? La chronique des grands modèles d'IA : sorties, retraits et changements de prix, chacun avec sa source.
Claude Sonnet 5 — fin du prix de lancement
Le prix de lancement de 2 $/10 $ par million de tokens prend fin ; le prix normal de 3 $/15 $ s'applique ensuite.
DeepSeek : les anciens noms de modèles sont migrés
À partir de ce jour, les anciens noms d'API deepseek-chat et deepseek-reasoner pointent vers V4-Flash — les utilisateurs des anciens modèles devraient vérifier leur intégration.
Claude Opus 5
Anthropic a publié Claude Opus 5 : même prix qu'Opus 4.8 (5 $/25 $ par million de tokens), contexte de 1M tokens, raisonnement activé par défaut, un curseur d'effort à cinq niveaux et un mode rapide au double du prix (10 $/50 $). Depuis Claude Code v2.1.219 (24 juillet 2026), Opus 5 y est le nouvel Opus standard ; Opus 4.8 reste utilisé comme solution de repli automatique en cas de refus liés à la sécurité.
Claude Fable 5 — permanent dans Max et Team Premium
À partir du 20/07/2026, inclus dans tous les forfaits Max et Team Premium (à 50 % des limites). Pro et Team Standard conservent l’accès via des crédits d’usage et reçoivent 100 $ de crédit unique. L’arrêt annoncé précédemment n’a pas eu lieu.
Kimi K3
MoE de 2,8 billions de paramètres avec un contexte de 1M — selon Moonshot, le plus grand modèle ouvert au monde ; les poids suivent le 27 juillet, jusque-là API uniquement.
Grok 4.5
Positionné pour le codage agentique, contexte de 500K, 2 $/6 $ par million de tokens — le modèle le moins cher dans le propre tableau comparatif de xAI.
Inkling (Thinking Machines)
Premier modèle à poids ouverts du laboratoire de Mira Murati : un MoE avec 975 milliards de paramètres au total / 41 milliards actifs, contexte de 1M, 77,6 % sur SWE-bench Verified — présenté comme le modèle ouvert américain le plus puissant. Une variante preview plus petite, Inkling-Small, a 12 milliards de paramètres actifs.
Muse Spark 1.1 + Meta Model API
Le premier modèle frontier à poids fermés de Meta, accessible via la nouvelle Meta Model API compatible avec le SDK OpenAI (aperçu public).
Famille GPT-5.6 (Sol, Terra, Luna)
Trois niveaux : Sol en modèle phare (5 $/30 $), Terra en milieu de gamme (2,50 $/15 $) et Luna comme variante la moins chère (1 $/6 $).
Gemini CLI + Code Assist for GitHub arrêtés
Google arrête Gemini CLI pour les utilisateurs gratuits ; le successeur est Antigravity CLI. Code Assist for GitHub : dépréciation à partir du 18 juin, arrêt complet le 17 juillet.
Qwen3.7-Max
Le modèle phare agentique d'Alibaba (« conçu pour l'ère des agents ») — propriétaire pour la première fois au lieu de poids ouverts, avec un contexte de 1M.
Gemini 3.5 Flash (GA)
Selon Google, une sortie 4 fois plus rapide et devant son propre 3.1 Pro sur les benchmarks de codage — Flash n'est plus un niveau économique (1,50 $/9 $).
GLM-4.7
MoE de 358B sous licence MIT — cheval de bataille à poids ouverts pour le codage agentique, avec une variante Flash gratuite.
Mistral Large 3
Le modèle phare européen à poids ouverts : MoE de 675B sous Apache 2.0, avec vision et option d'hébergement dans l'UE.