B.AI ra mắt Gemini 3.6 Flash và 3.5 Flash-Lite; mức tiêu thụ token giảm 17%

Theo B.AI, Gemini 3.6 Flash và Gemini 3.5 Flash-Lite hiện đã khả dụng trên B.AI API kể từ ngày 22 tháng 7. Gemini 3.6 Flash, phiên bản được nâng cấp từ Gemini 3.5 Flash, giúp giảm mức tiêu thụ token trung bình khoảng 17% trong khi vẫn giữ nguyên mức giá; mức giảm có thể lên tới 65% trong các tình huống phức tạp như DeepSWE.

Gemini 3.5 Flash-Lite cung cấp thông lượng 350 token mỗi giây và mang lại hiệu quả chi phí cực cao cho các tác vụ yêu cầu mức đồng thời cao, bao gồm xử lý theo lô tài liệu và truy xuất mang tính tác nhân. Cả hai mô hình hiện đều có sẵn thông qua các endpoint API chính thức.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể đến từ các nguồn bên thứ ba và chỉ mang tính chất tham khảo. Thông tin này không phản ánh quan điểm hoặc ý kiến của Gate và không cấu thành bất kỳ lời khuyên tài chính, đầu tư hoặc pháp lý nào. Giao dịch tài sản ảo tiềm ẩn rủi ro cao. Vui lòng không chỉ dựa vào thông tin trên trang này khi đưa ra quyết định. Để biết thêm chi tiết, vui lòng xem Tuyên bố miễn trừ trách nhiệm.
Bình luận
0/400
Không có bình luận