微软Build大会发布拥有350亿参数的自主研发MAI模型

在近期举行的Build2026开发者大会上,微软公布了多款自主研发的人工智能模型。其首个高级推理模型MAI-Thinking-1 的亮相,标志着微软在自主开发大型模型以及构建覆盖所有应用场景的全面人工智能生态系统方面迈出了重要一步。
MAI-Thinking-1 拥有 350 亿个活跃参数,虽被视为“中型模型”,但在关键的软件工程基准测试中已取得业界领先的成绩。 微软强调,该模型完全基于干净数据从零开始训练,并明确表示未使用任何来自第三方模型的蒸馏数据。在数据蒸馏已成常态的行业中,这彰显了微软对技术独立性和数据完整性的坚定承诺。
除了这款旗舰推理模型外,微软还通过多模态和专业垂直应用模型扩展了 MAI 产品家族。在图像和语音领域,支持文本转图像生成和图像编辑的 MAI-Image2.5 及其 Flash 版本同步发布; MAI-Transcribe-1.5 提供超高速转录功能,速度是竞争对手的五倍;而 MAI-Voice-2 现已新增支持 15 种语言(Flash 版本即将推出),极大地扩展了语音多模态生态系统。
在开发者领域,专为优化推理效率而设计的编码模型 MAI-Code-1 已成功集成至 GitHub Copilot 和 Visual Studio Code。 多款自研模型的成功发布,不仅完善了微软从底层推理到高级应用的闭环生态系统,更彰显了这家科技巨头致力于实现人工智能全面自给自足、减少对外部技术依赖的战略承诺。
相关文章
Suno 发布重大更新,推出高级音轨分离与车载支持功能
Suno 已对其 AI 音乐生成平台推出重大更新,优化了网页和移动端的体验,以简化创作流程并提升可用性。该平台正朝着更加便捷高效的 AI 音乐制作阶段迈进,将专业音频工具与驾驶等日常场景相结合。增强的音轨分离功能此次更新的一个主要亮点是高级音轨分离功能,该功能可将人声、鼓点、贝斯和乐器分离到独立的音轨中。这一能力使音乐人能够轻松获取高质量的分轨素材,用于混音或二次创作,显著降低了专业后期制作的门槛。分轨导出为 MIDI 文件用户现在可以直接将分离后的音轨导出为 MIDI 文件。这一功能对于需要在
科大讯飞星火发布0.65B编码器语音模型,搭载30B混合专家架构,基于完全国产算力构建
科大讯飞推出了基于纯国产算力基础设施构建的语音基础大模型 Spark-Audio-1.0-Preview。此前,基于大模型的音频处理主要依赖级联方式:先将语音转换为文本,再将其传递给模型进行分析。这种方法存在两大主要缺陷:一是信息丢失,因为文本无法捕捉语调、情感和背景声音,导致上下文不完整;二是工作流碎片化,转录、说话人识别和翻译等独立模块串行运行,导致误差累积、延迟增加以及用户体验不佳。超越转录:直接语音理解该语音基础大模型超越了简单的转录功能,能够直接解读音频。它可以区分人声、环境噪音和音乐
Cohere公司的乔埃尔·皮诺谈主权人工智能与企业安全
由Cohere委托IDC开展的一项研究探讨了主权人工智能,首席人工智能官乔埃尔·皮诺(Joëlle Pineau)在报告中概述了企业云安全和数据治理的核心策略。根据IDC受人工智能公司Cohere委托发布的报告《2026年主权人工智能采用现状》,三分之一的商业领袖难以用自己的话定义“主权人工智能”。加拿大人工智能公司Cohere致力于开发专为企业应用设计的大型语言模型(LLMs)和自然语言处理工具
相关专题推荐
评论 (0)
0/500

在近期举行的Build2026开发者大会上,微软公布了多款自主研发的人工智能模型。其首个高级推理模型
除了这款旗舰推理模型外,微软还通过多模态和专业垂直应用模型扩展了 MAI 产品家族。在图像和语音领域,支持文本转图像生成和图像编辑的 MAI-Image2.5 及其 Flash 版本同步发布; MAI-Transcribe-1.5 提供超高速转录功能,速度是竞争对手的五倍;而 MAI-Voice-2 现已新增支持 15 种语言(Flash 版本即将推出),极大地扩展了语音多模态生态系统。
在开发者领域,专为优化推理效率而设计的编码模型 MAI-Code-1 已成功集成至 GitHub Copilot 和 Visual Studio Code。 多款自研模型的成功发布,不仅完善了微软从底层推理到高级应用的闭环生态系统,更彰显了这家科技巨头致力于实现人工智能全面自给自足、减少对外部技术依赖的战略承诺。
Suno 发布重大更新,推出高级音轨分离与车载支持功能
Suno 已对其 AI 音乐生成平台推出重大更新,优化了网页和移动端的体验,以简化创作流程并提升可用性。该平台正朝着更加便捷高效的 AI 音乐制作阶段迈进,将专业音频工具与驾驶等日常场景相结合。增强的音轨分离功能此次更新的一个主要亮点是高级音轨分离功能,该功能可将人声、鼓点、贝斯和乐器分离到独立的音轨中。这一能力使音乐人能够轻松获取高质量的分轨素材,用于混音或二次创作,显著降低了专业后期制作的门槛。分轨导出为 MIDI 文件用户现在可以直接将分离后的音轨导出为 MIDI 文件。这一功能对于需要在
科大讯飞星火发布0.65B编码器语音模型,搭载30B混合专家架构,基于完全国产算力构建
科大讯飞推出了基于纯国产算力基础设施构建的语音基础大模型 Spark-Audio-1.0-Preview。此前,基于大模型的音频处理主要依赖级联方式:先将语音转换为文本,再将其传递给模型进行分析。这种方法存在两大主要缺陷:一是信息丢失,因为文本无法捕捉语调、情感和背景声音,导致上下文不完整;二是工作流碎片化,转录、说话人识别和翻译等独立模块串行运行,导致误差累积、延迟增加以及用户体验不佳。超越转录:直接语音理解该语音基础大模型超越了简单的转录功能,能够直接解读音频。它可以区分人声、环境噪音和音乐
Cohere公司的乔埃尔·皮诺谈主权人工智能与企业安全
由Cohere委托IDC开展的一项研究探讨了主权人工智能,首席人工智能官乔埃尔·皮诺(Joëlle Pineau)在报告中概述了企业云安全和数据治理的核心策略。根据IDC受人工智能公司Cohere委托发布的报告《2026年主权人工智能采用现状》,三分之一的商业领袖难以用自己的话定义“主权人工智能”。加拿大人工智能公司Cohere致力于开发专为企业应用设计的大型语言模型(LLMs)和自然语言处理工具





首页






