xAI, Anthropic, OpenAI et Moonshot IA lancent les modèles Frontier Release 4 en juillet

Key Takeaways
  • xAI, Anthropic, OpenAI et Moonshot AI ont chacun publié des modèles d’IA de pointe en juillet 2026, conçus pour l’exécution de tâches durant plusieurs heures.
  • Grok 4.5 coûte 2 dollars en entrée et 6 dollars en sortie par million de tokens, soit plus de 60 % de moins que Claude Opus 4.8 et GPT-5.5.
  • Moonshot AI s’est engagé à publier l’intégralité des poids open source de Kimi K3 d’ici le 27 juillet, après avoir publié le modèle à 2,8 billions de paramètres le 16 juillet.

xAI, Anthropic, OpenAI et Moonshot AI ont libéré quatre modèles IA de niveau « frontier » en trois semaines en juillet 2026. xAI a expédié Grok 4.5 le 8 juillet, Anthropic a publié Claude Opus 5 le 24 juillet, OpenAI a rendu GPT-5.6 disponible en général le 9 juillet, et Moonshot AI a publié Kimi K3 le 16 juillet. Chaque modèle vise l’exécution de tâches durant plusieurs heures — de la recherche au codage, jusqu’à des rapports structurés — sans perdre la trace des plans d’exécution. Les quatre disposent de fenêtres de contexte de 500 000 tokens ou plus, avec trois modèles atteignant 1 million de tokens, permettant à une seule session de traiter des dépôts de code complets ou des collections de documents.

xAI Libère Grok 4.5 Avec des Données d’Entraînement pour Cursor

xAI a libéré Grok 4.5 le 8 juillet. Le modèle s’appuie sur une base de 1,5 trillion de paramètres et a été entraîné en partie sur des données d’usage réelles provenant de Cursor, la plateforme de codage que SpaceXAI a acquise plus tôt cette année. La tarification s’établit à 2 dollars par million de tokens d’entrée et 6 dollars par million de tokens de sortie, avec une fenêtre de contexte de 500 000 tokens. Elon Musk a décrit Grok 4.5 comme un modèle de classe Opus, qui tourne plus vite et à coût inférieur. Des estimateurs indépendants le placent quatrième sur l’Artificial Analysis Intelligence Index, devant tous les modèles open weight, avec une tarification plus de 60 % inférieure à Claude Opus 4.8 et GPT-5.5. Sur Terminal-Bench 2.1, un test qui mesure la qualité avec laquelle un modèle accomplit des tâches d’ingénierie en ligne de commande, Grok 4.5 a obtenu 83,3 %. xAI affirme que le modèle nécessite environ un cinquième des tokens de sortie que Opus 4.8 exigeait pour des tâches comparables.

Elon X post screenshot.

OpenAI Lance GPT-5.6 dans une Structure de Tarification en Trois Niveaux

OpenAI a rendu GPT-5.6 disponible en général le 9 juillet, après une préversion de deux semaines limitée à environ 20 organisations sélectionnées par le gouvernement américain, en application d’un décret lié à un examen de la sécurité des modèles « frontier ». La famille se décline en trois niveaux : Sol, le fleuron, à 5 dollars en entrée et 30 dollars en sortie par million de tokens ; Terra, un modèle à mi-niveau à 2,50 et 15, que OpenAI dit comparable à GPT-5.5 à moitié prix ; et Luna, un niveau rapide et peu coûteux à 1 et 6. OpenAI indique que Sol mène l’Artificial Analysis Coding Agent Index et atteint 88,8 % sur Terminal-Bench 2.1, montant à 91,9 % lorsque le modèle exécute quatre sous-agents en parallèle dans son nouveau mode ultra. Les trois niveaux portent la note de risque interne la plus élevée de OpenAI pour les risques de mésusage cyber et biologique.

OpenAI X post screenshot.

Anthropic Lance Claude Opus 5 en Modèle Max Par Défaut

Anthropic a libéré Claude Opus 5 le 24 juillet, le positionnant comme un modèle dont les performances atteignent presque celles de Claude Fable 5, pour la moitié du prix de Fable : 10 dollars en entrée et 50 dollars en sortie. Opus 5 affiche le même prix de 5 dollars en entrée et 25 dollars en sortie que son prédécesseur Opus 4.8. Le modèle est livré avec une fenêtre de contexte de 1 million de tokens, 128 000 tokens de sortie maximum, et un paramètre d’effort de raisonnement réglable allant de faible jusqu’à un nouveau mode xhigh. Anthropic affirme qu’Opus 5 établit de nouveaux records sur Frontier-Bench et GDPval-AA, deux évaluations orientées codage et travail de connaissance, même s’il reste en retrait sur le modèle restreint Claude Mythos 5 pour les tâches de cybersécurité. Opus 5 est désormais le modèle par défaut sur Claude Max et l’option la plus solide sur Claude Pro.

Claude X post screenshot.

Moonshot AI Publie Kimi K3 comme le Plus Grand Modèle Open-Weight

Moonshot AI a libéré Kimi K3 le 16 juillet, un modèle « mixure of experts » à 2,8 trillion de paramètres avec 896 experts au total et 16 experts actifs par tâche. Le modèle propose une fenêtre de contexte de 1 million de tokens et une entrée native multimodale, avec une tarification API à 3 dollars en entrée et 15 dollars en sortie par million de tokens. Moonshot s’est engagé à publier l’ensemble des poids open complets d’ici le 27 juillet. K3 est le plus grand modèle Open-Weight publié à ce jour, environ 75 % plus volumineux que le précédent plus grand modèle open largement utilisé. Des estimateurs indépendants placent K3 quatrième parmi les systèmes « frontier » actuels, derrière Claude Fable 5 et GPT-5.6 Sol, mais devant Claude Opus 4.8.

Kimi Moonshot X post screenshot.

Des Fenêtres de Contexte Étendues Permettent le Traitement de Dossiers Complets

Les fenêtres de contexte inférieures à 200 000 tokens forçaient autrefois les développeurs à découper de grandes bases de code ou des paquets de recherche en fragments. Désormais, chaque modèle de ce groupe fonctionne à 500 000 tokens ou plus, avec trois des quatre à 1 million, permettant à une seule session de contenir un dépôt complet ou une pile de documents sources primaires. Les systèmes de la période 2023-2024 perdaient souvent leur plan après quelques appels d’outils. Les modèles libérés ce mois-ci sont conçus pour soutenir des dizaines d’étapes coordonnées et se rétablir quand un appel d’outil renvoie de mauvaises données au lieu de rester bloqué. Les contrôles d’effort d’Opus 5, la tarification en niveaux dans GPT-5.6, et les affirmations d’efficacité derrière Grok 4.5 pointent vers le même objectif : permettre aux équipes de choisir la quantité de calcul qu’une tâche mérite, plutôt que de payer les prix des modèles phares pour chaque requête. Le déploiement de GPT-5.6, conditionné par le gouvernement, signale que la supervision est désormais intégrée aux calendriers de sortie des plus grands modèles. La suspension brève d’accès à Fable et Mythos, imposée par le gouvernement, menée par Anthropic en juin, était une version antérieure du même schéma.

FAQ

Qu’ont en commun les quatre modèles IA libérés en juillet 2026 ?

Grok 4.5, Claude Opus 5, GPT-5.6 et Kimi K3 ciblent tous l’accomplissement de tâches sur plusieurs heures — de la recherche au codage, jusqu’aux rapports structurés — sans perdre la trace des plans d’exécution. Chaque modèle dispose d’une fenêtre de contexte d’au moins 500 000 tokens, avec trois modèles atteignant 1 million de tokens, permettant à des sessions uniques de traiter des dépôts de code complets ou des collections de documents sans fragmentation.

Pourquoi OpenAI a-t-il libéré GPT-5.6 via une préversion conditionnée par le gouvernement ?

OpenAI a rendu GPT-5.6 disponible en général le 9 juillet après une préversion de deux semaines limitée à environ 20 organisations sélectionnées par le gouvernement américain, suite à un décret lié à un examen de sécurité des modèles « frontier ». Les trois niveaux de GPT-5.6 portent la note de risque interne la plus élevée de OpenAI pour les risques de mésusage cyber et biologique, ce qui a déclenché l’examen supplémentaire.

Comment le prix de Grok 4.5 se compare-t-il à celui de Claude Opus 4.8 ?

Grok 4.5 est tarifé à 2 dollars par million de tokens d’entrée et 6 dollars par million de tokens de sortie, plus de 60 % en dessous de Claude Opus 4.8 et GPT-5.5. xAI affirme que le modèle nécessite environ un cinquième des tokens de sortie que Opus 4.8 demandait pour des tâches comparables, ce qui réduit le coût pour exécuter des sessions longues d’agents.

Avertissement : Les informations figurant sur cette page peuvent provenir de sources tierces et sont fournies à titre indicatif uniquement. Elles ne reflètent pas les points de vue ou opinions de Gate et ne constituent pas un conseil financier, d’investissement ou juridique. Le trading des actifs virtuels comporte des risques élevés. Veuillez ne pas vous fonder uniquement sur les informations de cette page pour prendre vos décisions. Pour en savoir plus, consultez l’avertissement.
Commentaire
0/400
Aucun commentaire