De acordo com a B.AI, os Gemini 3.6 Flash e Gemini 3.5 Flash-Lite já estão disponíveis na API da B.AI desde 22 de julho. O Gemini 3.6 Flash, uma versão melhorada do Gemini 3.5 Flash, reduz o consumo de tokens em cerca de 17% em média, mantendo o mesmo preço, com reduções que chegam a atingir até 65% em cenários complexos como o DeepSWE.
O Gemini 3.5 Flash-Lite oferece uma capacidade de processamento de 350 tokens por segundo e proporciona uma eficiência de custos extrema para tarefas com elevada concorrência, incluindo o processamento em lote de documentos e a recuperação agentic. Ambos os modelos estão agora disponíveis através de endpoints oficiais de API.