7月22日消息,Google正式发布三款全新Gemini模型,包括Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber,进一步完善Gemini模型矩阵。与此前围绕模型能力上限展开竞争不同,此次发布更加聚焦AI Agent时代开发者最关注的三个指标——效率、延迟和成本,希望帮助企业以更低成本构建和部署AI Agent。
此次更新中,Gemini 3.6 Flash成为新的主力模型。Google称,该模型基于开发者对Gemini 3.5 Flash的反馈进行了优化,不仅提升了编程、知识处理和多模态能力,还进一步提高了Token利用效率。
官方数据显示,在Artificial Analysis Index测试中,Gemini 3.6 Flash相比Gemini 3.5 Flash平均减少17%的输出Token,同时完成复杂多步骤任务时需要更少的推理步骤和工具调用,从而降低整体Agent运行成本。模型价格也同步下调至每百万输入Token 1.5美元、每百万输出Token 7.5美元。

除了主力模型,Google还推出了Gemini 3.5 Flash-Lite。该模型定位于低延迟、高吞吐量场景,主要面向Agent搜索、文档处理等需要大规模调用的企业应用。Google表示,Gemini 3.5 Flash-Lite是目前3.5系列中速度最快的模型,根据Artificial Analysis测算,其输出速度可达到每秒350个Token。
价格方面,该模型进一步降低至每百万输入Token 0.3美元、每百万输出Token 2.5美元。官方称,相较Gemini 3.1 Flash-Lite,新模型在编程、长上下文理解、Agent任务执行等多个基准测试中均有明显提升,在部分Agent和编程评测中甚至超过Gemini 3 Flash。
第三款产品则瞄准网络安全领域,Google推出了专门针对网络安全优化的Gemini 3.5 Flash Cyber。该模型基于Gemini 3.5 Flash训练,并针对漏洞发现、验证和自动修复进行了专项微调,旨在以较低成本完成软件漏洞检测和修复工作。
值得关注的是,Google在官方博客中还透露,Gemini 3.5 Pro目前仍在合作伙伴测试阶段,将在准备就绪后正式发布。同时,公司已启动Gemini 4迄今规模最大的预训练工作。