Aller au contenu principal
Live
Intelligence artificielleUSUS

Google dévoile Gemini 4 Argon, un modèle IA encore réservé à l'interne

Google a annoncé Gemini 4 Argon, un nouveau modèle d'IA qu'il présente comme le plus performant pour le codage, le travail de connaissance et la cybersécurité. Le grand public devra toutefois attendre avant de pouvoir le tester, les équipes internes de l'entreprise l'utilisant déjà à grande échelle.

4 min de lectureMis à jour il y a 56 minutes
Illustration de l’article
Dans cet article
  1. Un modèle annoncé mais pas encore accessible
  2. Des gains opérationnels revendiqués en interne

Un modèle annoncé mais pas encore accessible

Google a levé le voile sur Gemini 4 Argon, la nouvelle génération de son modèle d'intelligence artificielle, selon Ars Technica. L'entreprise affirme que ce modèle affiche des performances de premier plan dans le codage, le travail de connaissance et la cybersécurité. Il n'est cependant pas encore ouvert au public : seuls les ingénieurs de Google l'exploitent pour l'instant, à grande échelle.

Cette annonce intervient après une période estivale marquée par la mise en avant de modèles Flash plus légers, alors que la firme avait promis Gemini 3.5 Pro en juin.

Des gains opérationnels revendiqués en interne

D'après les éléments avancés par Google, Argon s'est appuyé sur des données de télémétrie à l'échelle de l'infrastructure pour permettre à l'entreprise d'économiser 300 TiB de mémoire dans ses centres de données.

Les agents du modèle ont par ailleurs été mobilisés pour migrer des bases de code C/C++ vers Rust en interne. Ces travaux ont porté sur des milliers de lignes au sein des bibliothèques centrales re2 et libgav1, ainsi que sur plus de 800 000 lignes du noyau Zircon du système d'exploitation Fuchsia.

Des benchmarks à l'appui des promesses

Pour étayer ses affirmations, Google met en avant une série de benchmarks. Sur DeepSWE v1.1, un test dédié à l'ingénierie logicielle, Gemini 4 Argon atteint 77,9 %, un score supérieur à ceux de GPT-6 Astra, Fable 5.1 et Opus 5.5.

L'entreprise évoque des capacités comparables sur des tâches à long horizon, en s'appuyant sur le score du modèle à l'indice Vals, un test d'analyse économique.

Maillage