谷歌发布三款新模型:Gemini 3.6 Flash,旗舰3.5 Pro延迟

谷歌DeepMind今晨悄悄上线了三款新模型——Gemini 3.6 Flash、3.5 Flash-Lite以及3.5 Flash Cyber。这次更新没有旗舰机型的宏大叙事,反而聚焦在轻量级模型的效率与实用能力上,折射出谷歌在AI Agent落地战场上的新思路。

作为本次更新的核心,Gemini 3.6 Flash在代码生成、知识理解与多模态处理上均有明显提升,同时token消耗最多降低17%。这意味着调用成本进一步压缩,对于需要高频调用Agent的企业来说,这笔账算得很清楚。Gemini 3.5 Flash-Lite则主打极致性价比,适合对延迟敏感、预算有限的场景。而3.5 Flash Cyber是一款专门面向网络安全的模型,目前仅以有限访问试点形式向政府机构和可信合作伙伴开放,专攻漏洞识别与修复。

Google's large model Gemini

谷歌方面表示,这次发布的目标是为大规模构建AI Agent的企业客户提供高可靠性、低延迟的基础设施支撑。从动作节奏看,谷歌显然在押注轻量模型在Agent场景中的渗透率,而非一味追求大模型的参数竞赛。

值得注意的是,备受期待的旗舰模型Gemini 3.5 Pro并未出现在本次更新中。自2月更新后,该模型内部性能一直存在挑战,导致发布一再推迟。目前它仍处于合作伙伴测试阶段,官方团队表态正在争取尽快上线。在OpenAI GPT-5.5/5.6和Anthropic Claude Opus 4.8、Sonnet 5的夹击下,谷歌的旗舰进度确实显得慢了半拍。

为了应对算力与效率的双重挑战,谷歌正在通过软硬件协同的方式突围。据悉,内部正在开发代号“Frozen v2”的高效服务器芯片,同时已经启动了迄今为止规模最大的Gemini 4前端预训练。这些动作表明,谷歌在AI基础设施和下一代大模型上的投入并未减速,只是选择了一条更务实的“轻量先行、旗舰蓄力”路线。

在竞争胶着的当下,谷歌用三款轻量模型打出了一张务实牌。能否在Agent生态中抢占先机,还要看后续旗舰Gemini 3.5 Pro能否顺利落地,以及“Frozen v2”芯片能否真正压住成本与效率的天平。

免责声明:本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时,可联系本站进行审核删除。
(0)
AI快讯网编辑-青青AI快讯网编辑-青青
北京越野泰钽700预售29.98万起 前后差速锁+华为激光雷达
上一篇 20小时前
Anthropic因盗版书籍被罚15亿美元
下一篇 18小时前

相关推荐

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注