人工智能
-
xAI Imagine 2.0 正式发布,支持5图融合与智能扩展
AI生图赛道又掀起新一轮军备竞赛。就在大家还在纠结“画手”和“文字乱码”的时候,xAI直接放出了大招——Imagine Image 2.0。这次不是小修小补,而是直接把矛头指向了A…
-
火山引擎发布Seedance 2.5 API,视频生成升级
AI视频模型的迭代速度正在超出预期。就在Seedance 2.0落地商用不到半年,火山引擎便推出了全新2.5版本。这一代产品把重点放在“指令遵循”和“长叙事”上,意味着行业关注点已…
-
终结无保护产品时代:OpenAI开源Codex安全插件分析
Vibe Coding 模式正在把“写代码”这件事从专业程序员手中交到更多普通用户手里——只要用自然语言描述需求,借助 Codex、Claude Code 这类 Agent,就能快…
-
通义千问发布Qwen-Image-3.0-Pro:国内首个10px级文本渲染,每图4分起
文生图赛道又迎来了一个标志性节点。在Chatbot Arena的文本到图像排行中,中国模型首次冲进了全球前二——阿里通义千问刚刚上新的Qwen-Image-3.0系列,Pro版和S…
-
Insta360携手阿里通义,口袋相机首搭语音助手Kira
AI语音助手正在加速渗透进每一个日常设备,这次轮到运动相机了。业内消息显示,Insta360正在将AI能力深度植入硬件产品线,核心动作是为其产品阵容新增一位AI语音助手。根据媒体报…
-
腾讯混元ASR 3.0预览版:语音识别理解语境
语音识别这个赛道,过去两年卷的是“谁的字错误率更低”,但当大模型的理解能力开始向音频模态渗透,游戏规则正在被重写。腾讯混元刚刚放出的Hy ASR3.0 preview,就直接把竞争…
-
商汤发布8B轻量炮U1.5-Lite-Preview:参数不大,闭源抓狂
商汤把自家轻量级原生统一多模态模型,直接端到了开源舞台中央——SenseNova U1.5-Lite-Preview,一个早期预览版。它基于原生NEO-Unify架构,天生就能理解…
-
DeepSeek V4正式版暂定8月3日,硅流涨价曝光,API可答新题
自7月中旬开始渐进式测试以来,DeepSeek V4的正式版发布一再延迟,官方至今未公布确切日期。不过,多个新线索指向了8月3日这个关键节点——率先曝出消息的是硅基流动平台。 该平…
-
MiniMax发布H3多模态视频模型,承诺开源
大模型赛道的军备竞赛,正在从单纯的文本对话,迅速蔓延到多模态内容生成。当Sora掀起的视频生成热潮还未完全退散,国内AI公司MiniMax已经悄悄亮出了自己的底牌——一个名为Min…
-
Feyn团队发布新开源背景去除模型FeyNoBg
近期的图像分割领域迎来了一项新的技术突破。Feyn 团队正式发布了全新的 SOTA (state-of-the-art) 背景去除模型 FeyNoBg,同时也在开源社区同步推出了对…