Alphabet libère trois nouveaux modèles Gemini mardi, dont Gemini 3.5 Flash Cyber conçu pour la cybersécurité. Ces lancements visent à mettre en avant une évolution sur une chaîne de produits qui a subi des retards et fait face à une concurrence croissante. Gemini 3.5 Flash Cyber sera d’abord uniquement disponible pour les gouvernements et des partenaires de confiance via un pilote à accès limité, afin de combler le manque de Google en cybersécurité face à Anthropic, qui a pris une avance précoce en défense automatisée du code.
Google lance Gemini 3.5 Flash Cyber pour la cybersécurité
Gemini 3.5 Flash Cyber est conçu pour détecter et corriger les vulnérabilités logicielles. Google indique que ce modèle spécialisé fonctionne à un prix par token inférieur à celui des modèles plus importants. Le modèle sera initialement disponible uniquement pour les gouvernements et des partenaires de confiance via un pilote à accès limité.
Gemini 3.6 Flash et 3.5 Flash-Lite réduisent les coûts en tokens
Google lance Gemini 3.6 Flash, qui améliore les performances en programmation, multimodalité et tâches de knowledge work tout en utilisant jusqu’à 17% de tokens en moins et en coûtant moins par token que le modèle précédent. Gemini 3.5 Flash-Lite est le modèle le plus rapide et le moins cher de la gamme 3.5 chez Google, conçu pour des charges à fort volume et des tâches plus petites au sein de systèmes d’agents IA plus vastes. Des données d’Artificial Analysis montrent que Gemini Flash rogne déjà sur les coûts des modèles comparables d’Anthropic, d’OpenAI et d’autres acteurs. D’après la société, Gemini 3.6 Flash coûte moins par tâche que GPT-5.6 Terra Max, Kimi K3 et Qwen 3.7 Max, tandis que 3.5 Flash-Lite coûte une fraction de ce niveau.
Google positionne Gemini face aux rivaux chinois de l’IA
Le déploiement intervient à la veille des résultats d’Alphabet, alors que des rivaux chinois gagnent en momentum. Le Kimi K3 de Moonshot AI a suscité une demande suffisante pour que l’entreprise limite les nouvelles souscriptions et l’accès à l’API en raison de contraintes de capacité. Alibaba tease Qwen 3.8 Max, qu’elle a indiqué être en retard uniquement sur Fable 5 d’Anthropic en termes de performance globale.
Google développe une puce sur mesure pour l’efficacité de Gemini
Google serait en train de développer une puce spécialisée conçue pour faire tourner Gemini jusqu’à 10 fois plus efficacement, dans le cadre d’une initiative plus large visant à réduire le coût de service de l’IA. Un porte-parole de Google Cloud a déclaré à CNBC, dans un communiqué, que ses équipes « recherchent et expérimentent constamment de nouvelles innovations pour offrir des performances et une efficacité maximales à nos utilisateurs et clients ». Le porte-parole a ajouté que « même si tous les projets n’entrent pas en production, cette exploration rigoureuse est au cœur de notre approche full stack ». La société indique que, en co-concevant le matériel et les logiciels dès le départ, elle s’assure que les systèmes sont intégrés et fortement optimisés pour des charges de travail réelles.
Google teste Gemini 3.5 Pro et lance la pré-entraînement de Gemini 4
Google offre davantage de visibilité sur sa Feuille de route après des questions concernant des retards. Gemini 3.5 Pro est désormais testé avec des partenaires avant une disponibilité plus large. La société a commencé son plus vaste lancement de pré-entraînement pour Gemini 4.
FAQ
Quels nouveaux modèles Gemini Google a-t-il libérés mardi ?
Google a libéré trois nouveaux modèles Gemini mardi : Gemini 3.5 Flash Cyber pour la cybersécurité, Gemini 3.6 Flash avec des performances améliorées et des coûts de tokens plus bas, et Gemini 3.5 Flash-Lite comme modèle le plus rapide et le moins cher de la gamme 3.5.
Comment Gemini 3.6 Flash s’améliore-t-il par rapport au modèle précédent ?
Gemini 3.6 Flash améliore les performances en programmation, multimodalité et tâches de knowledge work tout en utilisant jusqu’à 17% de tokens en moins et en coûtant moins par token que le modèle précédent.
Que fait Google pour améliorer l’efficacité de Gemini ?
Google serait en train de développer une puce spécialisée conçue pour faire tourner Gemini jusqu’à 10 fois plus efficacement, dans le cadre d’une initiative plus large visant à réduire le coût de service de l’IA.