根据 B.AI,Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 已在 B.AI API 上上线供使用,时间为 7 月 22 日。Gemini 3.6 Flash 是 Gemini 3.5 Flash 的升级版本,在保持相同定价的同时,平均可将代币消耗降低约 17%;在如 DeepSWE 这类复杂场景中,最高可降低 65%。
Gemini 3.5 Flash-Lite 的吞吐量为每秒 350 个代币,并为高并发任务(包括文档批处理和代理化检索)提供极致的成本效率。目前,两种模型均可通过官方 API 端点调用。