阿里巴巴的Qwen 3.5-Max惊艳亮相,跻身全球前五
中国的大语言模型再次在国际舞台上创下破纪录的成绩。3月20日,阿里巴巴Qwen家族推出了其新款旗舰模型Qwen3.5-Max-Preview。该模型在环球大语言模型基准平台LM Arena首次亮相,便以1464分的惊人总分立即吸引了业界关注。
这一卓越表现使阿里巴巴通一千文 在LM Arena企业 排行榜中跃居全球第五位,进一步巩固了其作为中国领先大语言模型提供商的地位。这一里程碑标志着中国的大语言模型已跻身全球前沿竞争的核心行列。

由国际开源研究组织LMSYS主办的LM Arena, 因其“匿名对决与盲评”的评估机制,被业界广泛视为最具价值的基准测试之一。在本次评估中,Qwen3.5-Max-Preview展现了强大且全面的能力:
数学推理:全球排名第五,展现出先进的逻辑推理能力。
综合表现:在未进行风格调整的情况下,绝对胜率全球排名第六。
专家级任务:在处理复杂文本处理方面同样跻身全球前十。

据阿里云介绍 ,自春节以来,Qwen3.5系列 已发布八款不同规模的模型,参数规模从0.8B到397B不等。旗舰模型Qwen3.5-Max-Preview代表了该系列的巅峰之作。它基于“小激活,大性能”的架构理念,在保持运行效率的同时,其能力可媲美甚至超越某些更大规模的模型。
该模型目前处于预览阶段。阿里云 表示,将根据开发者社区的反馈持续进行迭代和优化,以完善Tongyi Qianwen
相关文章
前OpenAI首席科学家Ilya的SSI首次发布模型
AI 取得了另一项重大里程碑。在从 OpenAI 离职后,前首席科学家伊利亚·苏茨克弗(Ilya Sutskever)创立了 Safe Superintelligence Inc.(SSI),该公司最近公布了其首个模型的详细信息。海外社交媒体上的报道指出,该团队正在利用 TTT(测试时训练)开发一个紧凑的推理引擎,这是他们在追求安全超级智能过程中的关键进展。这种新颖的架构专注于使模型能够“学习如何学习”。与在推理过程中保持参数静态的传统大型语言模型不同,该引擎在处理现实世界任务时会动态更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI应用开发平台Lovable宣布参与丹麦硬件初创公司Atech的80万美元种子轮融资。该轮由Lovable领投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在内的顶级风险投资机构。此次投资标志着Lovable将“Vibe Coding”概念从纯软件开发战略扩展至硬件工程领域。Atech旨在通过AI驱动的交互式平台简化复杂的硬件原型制作。用户购买基础硬件套件,并通过AI聊天机器人以自然语言描述其设计概念;系统
Anthropic 将 Claude AI 编码工具扩展至日本,以推动海外增长
Anthropic,一家美国知名的人工智能公司,正加强其全球推广力度。周三,该公司在东京举办了一场大型开发者活动“Code with Claude”,吸引了近500名软件工程师参加。该举措旨在积极将Claude AI工具及相关产品引入日本市场,强调其自主编码能力在提升企业生产力方面的核心优势。强调自动化代码生成在活动中,Anthropic展示了其先进的自主编码系统,该系统能够独立处理复杂的编程任务并优化现有代码结构。随着全球对高效开发工具的需求不断增长,Anthropic希望通过此类活动加强
相关专题推荐
评论 (2)
0/500
Wait, another Chinese model breaking into top 5? 🚀 Qwen 3.5-Max sounds impressive, but I'm always skeptical about benchmark rankings—different test sets can flip results overnight. Still, props to Alibaba for pushing the frontier. Hope they release a detailed technical report soon so we can see the real sauce behind it. 🤔
中国的大语言模型再次在国际舞台上创下破纪录的成绩。3月20日,阿里巴巴Qwen家族推出了其新款旗舰模型Qwen3.5-Max-Preview。该模型在环球大语言模型基准平台LM Arena首次亮相,便以1464分的惊人总分立即吸引了业界关注。
这一卓越表现

由国际开源研究组织LMSYS主办
数学推理:全球排名第五,展现出先进的逻辑推理能力。
综合表现:在未进行风格调整的情况下,绝对胜率全球排名第六。
专家级任务:在处理复杂文本处理方面同样跻身全球前十。

该模型目前处于预览阶段。
前OpenAI首席科学家Ilya的SSI首次发布模型
AI 取得了另一项重大里程碑。在从 OpenAI 离职后,前首席科学家伊利亚·苏茨克弗(Ilya Sutskever)创立了 Safe Superintelligence Inc.(SSI),该公司最近公布了其首个模型的详细信息。海外社交媒体上的报道指出,该团队正在利用 TTT(测试时训练)开发一个紧凑的推理引擎,这是他们在追求安全超级智能过程中的关键进展。这种新颖的架构专注于使模型能够“学习如何学习”。与在推理过程中保持参数静态的传统大型语言模型不同,该引擎在处理现实世界任务时会动态更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI应用开发平台Lovable宣布参与丹麦硬件初创公司Atech的80万美元种子轮融资。该轮由Lovable领投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在内的顶级风险投资机构。此次投资标志着Lovable将“Vibe Coding”概念从纯软件开发战略扩展至硬件工程领域。Atech旨在通过AI驱动的交互式平台简化复杂的硬件原型制作。用户购买基础硬件套件,并通过AI聊天机器人以自然语言描述其设计概念;系统
Anthropic 将 Claude AI 编码工具扩展至日本,以推动海外增长
Anthropic,一家美国知名的人工智能公司,正加强其全球推广力度。周三,该公司在东京举办了一场大型开发者活动“Code with Claude”,吸引了近500名软件工程师参加。该举措旨在积极将Claude AI工具及相关产品引入日本市场,强调其自主编码能力在提升企业生产力方面的核心优势。强调自动化代码生成在活动中,Anthropic展示了其先进的自主编码系统,该系统能够独立处理复杂的编程任务并优化现有代码结构。随着全球对高效开发工具的需求不断增长,Anthropic希望通过此类活动加强
Wait, another Chinese model breaking into top 5? 🚀 Qwen 3.5-Max sounds impressive, but I'm always skeptical about benchmark rankings—different test sets can flip results overnight. Still, props to Alibaba for pushing the frontier. Hope they release a detailed technical report soon so we can see the real sauce behind it. 🤔





首页






