阿里巴巴Tuhao M890上市,凭借三重性能优势开启芯片-云-模型-推理的全栈代理时代

2026年5月20日,在阿里云峰会上,阿里云宣布完成了专为“智能体时代”设计的全栈技术系统升级。这一变革重塑了整个技术体系——从底层芯片和云平台到模型与推理方案。此次升级使阿里云成为一家能够让大量智能体实现24/7连续运行的“AI工厂”,从而超越了单纯为人类用户提供服务的范畴。
1. 核心基础:腾迅振武M890芯片与超级节点服务器
此次升级的核心是腾迅推出的新一代AI芯片——振武M890,该芯片集训练与推理功能于一体。
性能提升:M890拥有144GB的内存,其性能是前代产品振武810E的三倍。它原生支持从FP32到FP4等多种数据精度级别,因此非常适合用于高精度的训练任务,以及智能体场景中需要超低精度的并行推理操作。
集群互联技术的突破:通过与自主研发的ICN Switch 1.0互连芯片相结合,阿里云推出了基于振武M890构建的盘九AL128超级节点服务器。这款服务器能够在系统层面协调128颗AI芯片之间的存储、计算和网络通信工作,实现了纳秒级的通信延迟,极大提升了大规模智能计算集群的效率和稳定性。
未来规划:腾迅首次公开了振武系列芯片的发展路线图,宣布将在未来两年内推出振武V900和振武J900两款芯片,进一步巩固其在数据中心计算领域的长期竞争力。
2. 核心接入点:重新设计的“群云”与以智能体为中心的交互方式
阿里云彻底改变了云计算的交互逻辑。传统的云平台是为人类设计的,配备了控制面板和仪表盘;而“智能体时代”的云系统必须为智能体量身打造。
面向AI的“群云”网站:这个专为AI设计的网站用标准化的技能安装代码取代了传统复杂的产品目录。智能体可以直接解析这些代码指令,自主调用计算、存储和模型功能,从而无需再进行手动配置。
功能的标准化:阿里云将150多种主流模型和云服务功能打包成了标准化的技能和命令行工具。只需一条指令,像Claude Code这样的工具就能快速安装并使用阿里云提供的所有基础设施功能。
3. 技术策略:芯片、云平台、模型与推理的全栈集成
这套新系统旨在应对智能体工作负载所面临的独特挑战——这些工作负载具有不规则的弹性、较短的生命周期以及极高的瞬时并发需求。
深度优化:阿里云不仅提供了像旗舰产品Qwen3.7-Max这样的模型,还通过底层振武系列芯片与推理框架之间的深度集成,实现了计算资源的最佳调度。
目标方向的转变:正如阿里云CTO李飞飞等专家所指出的,大型模型的发展重点已经从追求语言表达的流畅性转变为注重任务目标的实现效率。整个系统的进化使得智能体能够在几毫秒内高效完成复杂的工程任务,从而大大降低了各行业采用AI技术的门槛。
总结:通过将腾迅芯片矩阵与“群云”接入点以及全栈模型推理技术相结合,阿里云成为了业内首家从计算能力出租商转型为“AI工厂”的企业。这套系统不仅为智能体的快速发展提供了基础设施支持,也体现了中国科技领导者们希望通过硬件与软件的协同合作,在“智能体时代”重塑全球生产力发展格局的雄心壮志。
相关文章
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic
相关专题推荐
评论 (0)
0/500

2026年5月20日,在阿里云峰会上,阿里云宣布完成了专为“智能体时代”设计的全栈技术系统升级。这一变革重塑了整个技术体系——从底层芯片和云平台到模型与推理方案。此次升级使阿里云成为一家能够让大量智能体实现24/7连续运行的“AI工厂”,从而超越了单纯为人类用户提供服务的范畴。
1. 核心基础:腾迅振武M890芯片与超级节点服务器
此次升级的核心是腾迅推出的新一代AI芯片——振武M890,该芯片集训练与推理功能于一体。
性能提升:M890拥有144GB的内存,其性能是前代产品振武810E的三倍。它原生支持从FP32到FP4等多种数据精度级别,因此非常适合用于高精度的训练任务,以及智能体场景中需要超低精度的并行推理操作。
集群互联技术的突破:通过与自主研发的ICN Switch 1.0互连芯片相结合,阿里云推出了基于振武M890构建的盘九AL128超级节点服务器。这款服务器能够在系统层面协调128颗AI芯片之间的存储、计算和网络通信工作,实现了纳秒级的通信延迟,极大提升了大规模智能计算集群的效率和稳定性。
未来规划:腾迅首次公开了振武系列芯片的发展路线图,宣布将在未来两年内推出振武V900和振武J900两款芯片,进一步巩固其在数据中心计算领域的长期竞争力。
2. 核心接入点:重新设计的“群云”与以智能体为中心的交互方式
阿里云彻底改变了云计算的交互逻辑。传统的云平台是为人类设计的,配备了控制面板和仪表盘;而“智能体时代”的云系统必须为智能体量身打造。
面向AI的“群云”网站:这个专为AI设计的网站用标准化的技能安装代码取代了传统复杂的产品目录。智能体可以直接解析这些代码指令,自主调用计算、存储和模型功能,从而无需再进行手动配置。
功能的标准化:阿里云将150多种主流模型和云服务功能打包成了标准化的技能和命令行工具。只需一条指令,像Claude Code这样的工具就能快速安装并使用阿里云提供的所有基础设施功能。
3. 技术策略:芯片、云平台、模型与推理的全栈集成
这套新系统旨在应对智能体工作负载所面临的独特挑战——这些工作负载具有不规则的弹性、较短的生命周期以及极高的瞬时并发需求。
深度优化:阿里云不仅提供了像旗舰产品Qwen3.7-Max这样的模型,还通过底层振武系列芯片与推理框架之间的深度集成,实现了计算资源的最佳调度。
目标方向的转变:正如阿里云CTO李飞飞等专家所指出的,大型模型的发展重点已经从追求语言表达的流畅性转变为注重任务目标的实现效率。整个系统的进化使得智能体能够在几毫秒内高效完成复杂的工程任务,从而大大降低了各行业采用AI技术的门槛。
总结:通过将腾迅芯片矩阵与“群云”接入点以及全栈模型推理技术相结合,阿里云成为了业内首家从计算能力出租商转型为“AI工厂”的企业。这套系统不仅为智能体的快速发展提供了基础设施支持,也体现了中国科技领导者们希望通过硬件与软件的协同合作,在“智能体时代”重塑全球生产力发展格局的雄心壮志。
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic





首页






