Voici une annonce qui mérite l’attention des observateurs du secteur.
Google dévoilement Gemini 3.6 Flash et une IA dédiée à la cybersécurité, et donne un avant-goût de Gemini 3.5 Pro et Gemini 4
Il existe aujourd’hui de nouveaux modèles 3.6 et 3.5, mais Google est déjà en train d’entraîner Gemini 4.
En parallèle, google a annoncé une évolution majeure de ses modèles d’IA lors de la conférence I/O en mai, avec le introduction de Gemini 3.5 Flash, et la société ne compte pas ralentir le rythme. La société a dévoilé aujourd’hui trois nouveaux modèles d’IA, dont la première version de Gemini dédiée à la cybersécurité. Toutefois, aucun de ces nouveaux modèles n’est le Gemini 3.5 Pro, dont le mise en service, initialement prévu en juin, a été reporté.
Dans la foulée, gemini 3.5 Flash, qui était la vedette de la conférence I/O, est déjà obsolète. À sa place, les développeuses et développeurs et les utilisateurs trouveront Gemini 3.6 Flash. Google avance les arguments habituels concernant ce modèle : il est légèrement plus performant, plus doué pour le codage et dispose d’excellentes fonctionnalités multimodales.
Selon Google, les modifications apportées à la version 3.6 de Flash ont été réalisées en réponse aux commentaires des usagers concernant la version 3.5. De manière générale, Gemini 3.5 Flash ne semblait pas tenir les promesses de Google en matière de génération de code. C’est peut-être simplement la conséquence de l’importance considérable que Google accorde à l’efficacité, alors que les entreprises commencent à s’inquiéter du coût des jetons d’IA.
Crédit :
GoogleCrédit :
Dans le test DeepSWE consacré au codage, la version 3.6 de Flash passe à 49 %, contre 37 % pour la version 3.5. Le nouveau système prend désormais en charge l’utilisation d’un ordinateur en tant que fonctionnalité standard de l’API Gemini. Le test OSWorld portant sur l’utilisation de l’ordinateur montre une légère amélioration, passant de 78,4 % pour la version 3.5 à 83 %. L’efficacité était une priorité majeure pour Gemini 3.5 Flash, et Google affirme que ces efforts ont été intensifiés avec la version 3.6. Même avec de légers gains aux benchmarks, Gemini 3.6 Flash utilise environ 17 % de tokens en moins.
Dans les workflows de type « agentic » (comme celui ci-dessous), Gemini 3.6 Flash devrait accomplir les tâches avec plus de précision, en moins d’étapes et en utilisant moins de jetons. Cela pourrait permettre aux développeurs (et à Google) de réaliser d’importantes économies. Le nouveau modèle présente un coût d’API réduit, à 1,50 $ pour 1 million de tokens d’entrée et 7,50 $ pour 1 million de tokens de sortie. Le prix était respectivement de 1,50 $ et 9 $ pour 3,5 Flash.
À retenir de cette annonce :
- Le test OSWorld portant sur l’utilisation de l’ordinateur montre une légère amélioration, passant de 78,4 % pour la version 3.5 à 83 %.
- Le nouveau modèle présente un coût d’API réduit, à 1,50 $ pour 1 million de tokens d’entrée et 7,50 $ pour 1 million de tokens de sortie.
Difficile à ce stade de prédire tous les impacts de cette annonce.
À découvrir aussi :
Reportage initial : Ars Technica AI : Ars Technica AI