De acordo com o The Information, a Google está a desenvolver o Frozen v2, um novo chip de servidor de IA que incorpora a arquitetura subjacente do Gemini diretamente no silício para aumentar a eficiência da inferência em até 10 vezes. Ao contrário de chips de propósito geral, como as GPUs e os próprios TPUs da Google, o Frozen v2 sacrifica versatilidade por uma maior eficiência na inferência e um menor consumo de energia, ao fixar a arquitetura do modelo no próprio hardware.
O projeto surge na sequência da escassez aguda de capacidade de computação para IA da Google, que tem pressionado os recursos internos de GPU e TPU e afetado alguns clientes do Google Cloud. A Google terá já acordado pagar à SpaceX aproximadamente 1 mil milhões de dólares por mês pela capacidade de computação de IA fornecida pela xAI, de forma a colmatar a falha de infraestruturas.