Google dévoile Gemini 4 Argon pour des partenaires ciblés

Google a dévoilé mercredi Gemini 4 Argon, son modèle d’intelligence artificielle de nouvelle génération, conçu pour les flux de travail complexes en programmation, finance, droit et cybersécurité. Le système est mis à disposition de partenaires ciblés avant un déploiement plus large, entraînant une hausse de l’action Alphabet en séance après-bourse.

L’annonce est intervenue à l’issue de plusieurs semaines d’attente, marquée par des signaux de lancement imminents. Le PDG de Google, Sundar Pichai, a confirmé le projet dans une publication sur le réseau social X, en précisant qu’il souhaitait offrir un aperçu du modèle au plus tôt. Cette démarche fait écho aux indications livrées par Koray Kavukcuoglu, directeur de Google DeepMind, qui avait signalé que le système achevait sa phase de post-entraînement tout en envisageant une sortie bien avant la fin de l’année.

Sur les marchés financiers, l’action Alphabet a progressé d’environ environ 2% en séance après-bourse à la suite de l’officialisation. Pour l’heure, l’entreprise ne fournit aucun calendrier précis quant à une disponibilité générale pour le grand public ou les développeurs.

Gemini 4 Argon est le modèle d'IA le plus puissant de Google + premiers tests !

Performances et positionnement face aux modèles concurrents

Dans les benchmarks diffusés par Google, Gemini 4 Argon devance ses rivaux sur de nombreux indicateurs de pointe. Le modèle s’est adjugé un score de 68,9% sur le Vals Index, qui mesure l’impact économique sectoriel pondéré par la contribution au produit intérieur brut des États-Unis, surpassant ainsi GPT-6 Astra et Claude Opus 5.5. Les évaluations comparent les performances du système dans des domaines exigeants tels que l’ingénierie logicielle, la recherche financière multietapes et la rédaction juridique.

Le modèle a atteint un score de 77,9% sur DeepSWE v1.1, un test mesurant la résolution de tâches logicielles complexes en conditions réelles, ainsi que 91,9% sur Vibe Code Bench. Les tests de contexte long révèlent également des avantages marqués, avec 99,7% obtenus sur GraphWalks pour des séquences atteignant 128.000 tokens, et 84,2% sur les segments allant de 256.000 à 1 million de tokens.

Malgré ces scores de premier plan, les résultats ne dessinent pas une domination absolue. Les concurrents conservent l’avantage sur des critères spécifiques, les modèles d’OpenAI et d’Anthropic s’illustrant respectivement sur des benchmarks comme FrontierSWE v2 et Terminal-bench 4.0.

Disponibilité ciblée et précautions en matière de cybersécurité

Dans un premier temps, l’accès au modèle est strictement encadré. Google a choisi de le réserver à une sélection de partenaires spécialisés dans la cybersécurité afin d’évaluer et d’atténuer les risques d’utilisation malveillante. Cette approche prudente s’inscrit dans la lignée des pratiques adoptées par la concurrence pour les systèmes les plus avancés.

Des nuances entourent par ailleurs l’évaluation réelle des capacités du système. Des informations de presse ont fait état de performances plus nuancées lorsque le modèle a été testé par des collaborateurs dans le cadre d’activités professionnelles quotidiennes, bien que l’entreprise ait contesté cette lecture en insistant sur son utilisation interne pour la recherche en informatique quantique et l’optimisation des infrastructures.

Sur le même sujet