Theo Beating, Google đang phát triển chip suy luận AI Frozen v2, trong đó tích hợp một phần kiến trúc của Gemini trực tiếp vào phần cứng để giảm chi phí tính toán và việc truyền dữ liệu trong quá trình mô hình vận hành. Chip này được kỳ vọng có thể xử lý lượng token nhiều hơn từ 6 đến 10 lần mỗi watt so với TPU mới nhất của Google, với kế hoạch triển khai sớm nhất có thể vào năm 2028.
Sáng kiến này nhằm giải quyết tình trạng thiếu chip ngày càng trầm trọng của Google, vốn đã buộc Google Cloud phải từ chối các đơn đặt hàng từ khách hàng bên ngoài. Frozen v2 sẽ hoạt động song song với TPU; trong khi TPU hỗ trợ nhiều loại mô hình, Frozen v2 ưu tiên hiệu suất hơn là tính linh hoạt.