谷歌DeepMind今晨悄悄上线了三款新模型——Gemini 3.6 Flash、3.5 Flash-Lite以及3.5 Flash Cyber。这次更新没有旗舰机型的宏大叙事,反而聚焦在轻量级模型的效率与实用能力上,折射出谷歌在AI Agent落地战场上的新思路。
作为本次更新的核心,Gemini 3.6 Flash在代码生成、知识理解与多模态处理上均有明显提升,同时token消耗最多降低17%。这意味着调用成本进一步压缩,对于需要高频调用Agent的企业来说,这笔账算得很清楚。Gemini 3.5 Flash-Lite则主打极致性价比,适合对延迟敏感、预算有限的场景。而3.5 Flash Cyber是一款专门面向网络安全的模型,目前仅以有限访问试点形式向政府机构和可信合作伙伴开放,专攻漏洞识别与修复。

谷歌方面表示,这次发布的目标是为大规模构建AI Agent的企业客户提供高可靠性、低延迟的基础设施支撑。从动作节奏看,谷歌显然在押注轻量模型在Agent场景中的渗透率,而非一味追求大模型的参数竞赛。
值得注意的是,备受期待的旗舰模型Gemini 3.5 Pro并未出现在本次更新中。自2月更新后,该模型内部性能一直存在挑战,导致发布一再推迟。目前它仍处于合作伙伴测试阶段,官方团队表态正在争取尽快上线。在OpenAI GPT-5.5/5.6和Anthropic Claude Opus 4.8、Sonnet 5的夹击下,谷歌的旗舰进度确实显得慢了半拍。
为了应对算力与效率的双重挑战,谷歌正在通过软硬件协同的方式突围。据悉,内部正在开发代号“Frozen v2”的高效服务器芯片,同时已经启动了迄今为止规模最大的Gemini 4前端预训练。这些动作表明,谷歌在AI基础设施和下一代大模型上的投入并未减速,只是选择了一条更务实的“轻量先行、旗舰蓄力”路线。
在竞争胶着的当下,谷歌用三款轻量模型打出了一张务实牌。能否在Agent生态中抢占先机,还要看后续旗舰Gemini 3.5 Pro能否顺利落地,以及“Frozen v2”芯片能否真正压住成本与效率的天平。