阿里通义Qwen衍生模型数量超Llama，创造历史

进入大模型盲测全球前十

9月29日消息，基准测试平台Chatbot Arena日前公布最新大模型盲测榜单，10天前发布的阿里通义千问开源模型Qwen2.5再次闯入全球十强，其大语言模型Qwen2.5-72B-Instruct排名LLM榜单第十，是前十唯一的中国大模型；Qwen系列视觉语言模型Qwen2-VL-72B-Instruct排名Vision榜单第九，是得分最高的开源大模型。

同一时间，全球开源社区基于Qwen系列二次开发的衍生模型数量突破7.43万，超越Llama系列衍生模型的7.28万。通义千问Qwen成长为世界最大的生成式语言模型族群，在Hugging Face社区的开源模型权威榜单Open LLM Leaderboard上，Qwen系列及其衍生模型包揽了前十全部座次。

不论是模型性能还是生态影响力，Qwen都创造了中国开源大模型的历史。

Qwen2.5-72B-Instruct排名Chatbot Arena大语言模型榜单第十

Chatbot Arena是由开放研究机构LMSYS Org推出的大模型性能测试平台，自2023年5月推出以来一直是世界顶级大模型的最重要竞技场。平台目前集成了全球70多个大模型，采用匿名方式将大模型两两组队，交给用户进行盲测，用户根据真实对话体验对模型能力进行投票。

9月19日发布的Qwen2.5迅速进榜，旗舰模型Qwen2.5-72B-Instruct得分位列LLM榜单第十，居于OpenAI的o1、GPT-4o等模型之后，是得分最高的中国大模型；同天开源的视觉语言模型Qwen2-VL-72B-Instruct闯入Vision榜单第九，略逊于GPT-4o、Gemini-1.5-Pro等闭源模型，是成绩最好的开源模型。此前Qwen系列已有多款开源模型闯入Chatbot Arena榜单。

Chatbot Arena官方发文，Qwen2-VL-72B-Instruct是排名最高的开源视觉语言模型

Qwen2.5的发布在海内外开源社区引发一场狂欢，这套开源模型涵盖多个尺寸的大语言模型、多模态模型、数学模型和代码模型，几乎所有尺寸的模型都实现了同等规模业界最佳性能，发布10天下载量超过150万。有国外开发者称赞通义千问称得上是真正的“开放AI”；有用户测评发现Qwen2.5从0.5B到72B都是SOTA水平，于是发起话题：“大家都用Qwen2.5替换了那些常用模型？”

进入大模型盲测全球前十

海外开源社区盛赞Qwen2.5

免责声明：本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿，凡在本网站出现的信息，均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性，但不保证有关资料的准确性及可靠性，读者在使用前请进一步核实，并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏，概不负任何法律责任。任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时，可联系本站进行审核删除。

一	二	三	四	五	六	日
						1
2	3	4	5	6	7	8
9	10	11	12	13	14	15
16	17	18	19	20	21	22
23	24	25	26	27	28	29
30

阿里通义Qwen衍生模型数量超Llama，创造历史

相关推荐

发表回复