Accueil / Tech News / Google annonce Gemini 4 Argon et revendique des meilleurs résultats qu’OpenAI et Anthropic

Google annonce Gemini 4 Argon et revendique des meilleurs résultats qu’OpenAI et Anthropic

Recevez tous les soirs un résumé de l’actu importante avec Le Récap’

Surprise : Google revient dans la course aux meilleurs modèles IA. Au lendemain du sommet IA à la Maison-Blanche et de la conférence OpenAI DevDay, le géant du web a annoncé Gemini 4 Argon, présenté comme « son prochain modèle de frontière ».

En tête des modèles pendant de longs mois avec Gemini 3 Pro, Google a vu OpenAI et Anthropic lui passer devant tout au long de l’année 2026. L’annonce de Gemini 3.5 Pro en mai 2026 était censé relancer Google… mais le modèle n’est jamais sorti, sur fond de rumeurs de résultats décevants et de mauvaise ambiance interne. Google ne dit pas quand Gemini 4 Argon arrivera mais promet des résultats supérieurs à GPT-6 Astra, Claude Fable 5.1 et Claude Opus 5.5, les actuels meilleurs modèles du marché selon les benchmarks.

Lots of discussion out there about our next model(!), so I wanted to give an early look as soon as possible. Introducing Gemini 4 Argon!It shows frontier performance in complex workflows, cyber defense and software engineering. Teams are using it extensively at Google, from… pic.twitter.com/sv4VNmQ0YT

Google n’en dit pas énormément sur Gemini 4 Argon, mais l’entreprise met en avant un record sur DeepSWE v1.1, un test qui mesure la capacité d’un modèle à mener des tâches d’ingénierie logicielle longues. Argon atteint 77,9 % de bons résultats, quand GPT-6 Astra obtient 74,1 %, Claude Opus 5.5 74,2 % et Claude Fable 5.1 67,4 %. L’écart est faible, mais Google suggère qu’il est devant.

Sur d’autres tests, l’écart est annoncé comme beaucoup plus net. Argon obtient 51,3 % sur AutomationBench, contre 41,4 % pour GPT-6 Astra, 40 % pour Claude Opus 5.5 et 31,4 % pour Claude Fable 5.1. Google revendique aussi la première place sur le Vals Index ou sur CWE-bench v1. Il atteint aussi 91,7 % sur LVBench, un test de compréhension de vidéos longues, contre 87,5 % pour GPT-6-Astra.

Reste une réalité : Google a souvent dominé les benchmarks par le passé, notamment avec Gemini 2.5 Pro puis Gemini 3 Pro, mais n’a pas toujours convaincu les utilisateurs les plus exigeants comme les développeurs. Les écosystèmes construits par OpenAI et Anthropic sont pensés pour le code et des environnements agentiques, quand Google tend à développer de bons modèles sans les interfaces qui vont avec. Depuis l’âge d’or de Gemini, les applications ChatGPT et Claude ont totalement changé. Google, lui, doit encore réinventer Gemini.

Pour montrer qu’il reprend de l’avance, Google met en avant plusieurs caractéristiques de Gemini 4 Argon. Le modèle peut générer jusqu’à 1 million de tokens en une seule fois, contre 64 000 auparavant chez Google. À titre de comparaison, Claude Opus 5.5 est limité à 128 000 tokens (300 000 via l’API). Cette marge permet au modèle de réfléchir beaucoup plus longtemps et de produire des volumes de code massifs sans découper la tâche.

À contre-courant des rumeurs sur ses problèmes internes, Google affirme que « des milliers » de ses employés utilisent déjà Argon et donne plusieurs exemples d’exploits. Argon aurait par exemple optimisé des sous-routines en informatique quantique « en quelques minutes » ou permis de libérer entre 500 Tio et 1 Pio de mémoire sur des datacenters Google. Gemini 4 Argon règlerait des problèmes impossibles pour les humains et serait un as du code, un point forcément important face à Anthropic et OpenAI.

Pour l’instant, Gemini 4 Argon n’est accessible qu’à un petit groupe de « cyberdéfenseurs de confiance », via un programme baptisé Fairwind. Google dit aussi participer au processus volontaire du gouvernement américain, qui permet de tester les modèles avant leur sortie. Les clients payants de l’API et les abonnés Google AI Ultra seront les premiers servis, mais Google n’avance aucune date. À l’image d’Anthropic, Google estime son modèle trop puissant en cybersécurité pour le lâcher sans sécurité. Google promet des garde-fous renforcés pour repérer les usages malveillants.

Reste un problème : la date de sortie. L’épisode Gemini 3.5 Pro aurait pu vacciner Google : la marque a présenté le modèle le 19 mai lors de la Google I/O, mais 3.5 Pro n’est jamais sorti. Entre-temps, Google s’est contenté de modèles Flash jusqu’à Gemini 3.8 Flash.

Google semble jouer la carte du all-in : Gemini veut rattraper tout le monde et sauter plusieurs générations d’un seul coup. C’est l’inverse de la stratégie de ses concurrents : Anthropic a sorti Claude Opus 5 le 24 juillet, puis Claude Opus 5.5 le 22 septembre. OpenAI a de son côté présenté GPT-6.1-Sol seulement 7 jours après GPT-6-Sol. Si Argon met plusieurs semaines/mois à arriver, un nouveau modèle comme Claude Fable 5.1 ou GPT-6.1 Astra pourrait le faire tomber de son trône avant même qu’on puisse l’utiliser.

Autre inconnue : que devient Gemini 4 Pro ? Google ne dit pas si un modèle Pro plus classique est prévu pour l’application Gemini et les abonnés Google AI Pro, puisque Argon semble un équivalent de Fable ou Astra réservé aux abonnements Ultra. Google a néanmoins l’avantage du tarif : l’entreprise revendique un Argon à 2 dollars le million de tokens en entrée et 10 dollars en sortie, soit cinq fois moins cher que Claude Fable 5.1 (10 et 50 dollars) et deux fois moins que Claude Opus 5.5 (4 et 20 dollars). Argon pourrait donc totalement remplacer Gemini Pro chez tout le monde. Reste à savoir quand.

Découvrez les nombreux avantages de Numerama+.

Vous avez lu 0 articles sur Numerama ce mois-ci

Tout le monde n'a pas les moyens de payer pour l'information. C'est pourquoi nous maintenons notre journalisme ouvert à tous.

Mais si vous le pouvez, voici trois bonnes raisons de soutenir notre travail :

Si vous croyez en un web gratuit et à une information de qualité accessible au plus grand nombre, rejoignez Numerama+.

Ajoutez Numerama à votre écran d'accueil et restez connectés au futur !

Tous nos articles sont aussi sur notre profil Google : suivez-nous pour ne rien manquer !

Origine de l’article : lire l’article original

Traduction