De acordo com o The Information, a Google está desenvolvendo o Frozen v2, um novo chip de servidor de IA que integra diretamente a arquitetura subjacente do Gemini ao silício para aumentar a eficiência de inferência em até 10 vezes. Diferentemente de chips de uso geral como GPUs e das próprias TPUs da Google, o Frozen v2 abre mão de versatilidade em favor de maior eficiência de inferência e menor consumo de energia ao “fixar” a arquitetura do modelo no próprio hardware.
O projeto surge em meio à escassez aguda de capacidade computacional para IA da Google, que pressionou os recursos internos de GPUs e TPUs e afetou alguns clientes do Google Cloud. A Google já concordou em pagar à SpaceX aproximadamente US$ 1 bilhão por mês pela capacidade de computação de IA fornecida pela xAI para suprir essa lacuna de infraestrutura.