D’après The Information, Google développe une puce IA expérimentale codée Frozen v2, visant un déploiement d’ici 2028. Des projets sont en cours pour intégrer directement l’architecture de Gemini dans le processeur afin de réduire la surcharge de calcul et le transfert de données. Le gain d’efficacité pourrait atteindre 6 à 10 fois par rapport à la dernière puce IA actuelle, développée en interne par Google, en termes de jetons d’IA traités par unité de puissance.
Le projet intervient alors que Google fait face à de fortes contraintes de ressources de calcul pour l’IA, ce qui pousse Google Cloud à refuser certaines demandes de clients. La société a dépensé environ 1 milliard de dollars par mois en achetant des ressources de calcul IA à SpaceX le mois dernier pour répondre aux besoins des clients professionnels. Contrairement aux unités Tensor Processing Units existantes, Frozen v2 est conçue pour compléter plutôt que remplacer les TPU, offrant à Google une plus grande flexibilité de calcul IA tout en réduisant sa dépendance à des fournisseurs de puces externes.