AI怪盗图9月20日消息,中秋及国庆双节临近,大家都要准备休假了吧,佳节前后AI行业还有一波大的要来,国内外至少有10多款大模型蓄势待发。
先说国外的几款。美国公司虽然没有在节前集中发布的习惯,但这次时机也凑巧了。OpenAI月底有开发者大会,此前曾预告本周有重磅产品,但跳票到下周,正好落在国内假期附近。OpenAI计划推出的产品包括GPT-6 Sol、GPT-6 Terra和GPT-6 Luna,与之前发布的GPT-6 Astra形成全系列升级。Astra的定价偏高,难以满足日常高频使用,这次价格下探能覆盖更广泛的应用场景。
Anthropic虽然嘴上呼吁大家放缓AI研究,自己却丝毫没有停下来的意思。它跳过5.1版本,直接推出Opus 5.2、Fbale 5.2等产品,甚至可能私下测试Mythos 5.2。从行业视角看,Anthropic的激进策略意在抢占大模型头部生态位,但跳过中间版本也可能带来稳定性风险。
谷歌作为御三家之一,Gemini 4.0 Pro和4.0 Flash的发布将决定其能否保留席位。此前泄露的评测成绩非常亮眼,不过可信度一般——被不少分析师认为是“定向优化”的结果。这场反击站若失利,谷歌在AI领域的地位将面临更大挑战。
马斯克旗下的xAI计划推出Grok 4.7。原本定于9月12日前后发布,却又跳票了。马斯克此前把期待值拉得很高,但种种迹象显示Grok 4.7的性能可能不会带来太大惊喜,搞不好又是4.5、4.6那样高开低走的结局。从xAI近期的资源投入来看,后训练环节的优化仍是短板。
微软、Meta、亚马逊等巨头近期没有重大产品的发布迹象,唯一可能有动作的是Meta。考虑到Meta在开源大模型上的持续投入,不排除它会推出Llama 4系列的升级版本,值得观望。
国外的说完,该到国内了。今天率先发力的是阶跃星辰的Step 5 Preview,已经上线并附带了大力度的优惠活动。相比国外产品,国内厂商更倾向于在节日前集中发布,以抢占假期流量。
接下来是比较明确的Kimi K3.1。前两天官方就开始造势,发了一串神秘数字被网友解读出来是暗示K3.1了,不过他们后来又删了帖子。这种“先撩后删”的宣传手法,本质上是在测试市场热度。考虑到K3已经发布几个月,K3.1确实需要尽快亮相,否则榜单地位难保。
另一个确定性较大的是阿里旗下的千问Qwen4系列。此前在Qwen 3.8 Flash上展示了全新架构,Qwen4系列的期待值很高,尤其是新一代可本地部署的小模型,如Qwen4 27B等。阿里这一策略瞄准了企业私有化部署的痛点,有望在B端市场打开缺口。
小米之前已经公开了Mimo新模型及客户端的抢先体验,名字应该是Mimo V2.6系列。这几天搞了RL后训练的直播,刚看了还在继续,成本都烧到了240万美元,不知道能不能赶在国庆后发布。这背后反映出小米在AI投入上的决心,但成本控制与模型效果之间的平衡仍需验证。
智谱的GLM-5.3系列已有两三款产品,GLM-5.5却一直没有后续。传闻中会升级到万亿参数量以上,但考虑到命名不变的话,智谱不一定升级参数量,搞不好还是继续发力RL后训练,坐实“后训练仙人”的称号。从技术路线看,智谱更注重工程优化而非参数量比拼,这种务实风格在资本寒冬中可能更可持续。
稀宇科技的MiniMax M3.1也传了很久。此前的3.0版本不尽如人意,3.1据说升级到万亿参数量,性能理应有大幅提升,还为后续的3.1 Pro升级到3万亿参数量奠定基础。如果传闻属实,稀宇科技将跨入头部参数量的竞争行列,但参数量翻倍带来的推理成本问题同样需要解决。
腾讯在HY3、HY4系列之后口碑和实力肉眼可见地提升,也急需一款大规模参数量的HY4 Pro大模型作为旗舰。不过时间点不好期待——腾讯内部对发布节奏一向谨慎,更倾向于打磨成熟后再亮相。
国产里面最值得期待的当然还得是DeepSeek。10日发布的V4.1 Flash好评不断,甚至采用了全新架构,但命名都没大改。Pro系列应该也会是V4.1 Pro,如果也是CED架构,搞不好参数量也会从V4 Pro的1.6万亿翻倍到3万亿级别。
V4.1 Pro的性能是否能一雪V4 Pro-0813的前耻是最大的看点。DeepSeek内部压力想必也很大,所以这里不拉高预期。能像V4.1 Flash那样顺利提升就足够了。至于赶超OA两家的旗舰,目前来看还不现实,毕竟如果V4.1 Pro价格再次大涨,用户无法放心使用,自然达不到预期。

