苹果公司与LM工作室携手,通过四座Mac工作室部署大规模本地大型语言模型

在近期举办的 WWDC2026 活动上,LM Studio 与苹果公司共同展示了一项具有突破性的技术演示。在本次演示中,他们仅通过将四台 Mac Studio 连接成集群,便成功运行了 Moonshot 公司拥有 1 万亿参数的大型模型 Kimi K2.6。这一成就打破了长期以来“拥有万亿级参数的模型必然需要基于云端的 GPU 集群”的固有观念,证明了消费级硬件同样能够实现先进的 AI 计算能力。
Kimi K2.6 的总参数量为 1 万亿,采用了 MoE 架构,可在任意时刻激活 320 亿个参数。该模型支持长上下文处理、多模态输入处理以及基于智能体的任务执行功能。在演示中,四台 Mac Studio 通过苹果公司的内存共享与互连技术连接在一起,形成了一个拥有约 1.5TB 统一内存的集群,足以满足该大型模型的推理需求。此前的开发者测试显示,在类似的配置条件下,Kimi K2.6 的文本生成速度约为每秒 28 个标记,且其能耗远低于传统的基于 GPU 的解决方案。
当通过 iPhone 直接连接到本地集群时,所有数据均完全保留在用户的设备内部
此次演示的另一个亮点是 LM Studio 开发的 LM Link 远程访问功能。用户可以通过自己的 MacBook Neo 或 iPhone 安全地远程连接至 Mac Studio 集群,实时与正在运行的模型进行交互,所有的数据处理与通信都在本地完成,无需通过云端传输数据。
LM Link 已被集成到 LM Studio 的 Mac 应用程序以及 Locally AI 的 iOS 应用程序中,能够提供端到端加密的连接方式。这样的设置使得用户即便在性能较低的设备上,也能随时调用集群级的 AI 计算能力,同时无需担心隐私泄露问题。结合苹果公司的 Thunderbolt 5 RDMA 技术以及其他多设备内存共享方案,整个生态系统正在快速构建一个用于本地部署人工智能的无缝框架。
此次合作传递了一个明确的信号:在本地部署万亿参数级的大型模型已不再是仅限于实验室的理论概念,而是一种开发者可以在自身工作环境中实现的可行方案。随着苹果公司不断推进其硬件互连功能,消费级设备处理大规模 AI 推理的能力预计还将进一步提升。
相关文章
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有
加利福尼亚州自动驾驶合规:罚单、地理围栏和100万英里的新时代
Guident公司在南佛罗里达州运营一辆AuveTech自动驾驶班车,利用其远程监控技术管理西棕榈滩的一条4英里路线和博卡拉顿的一条1英里路线。| 图片来源:Guident加利福尼亚州正在重新定义无人驾驶车辆的监管格局,正逐渐摆脱科技行业“快速行动,打破常规”的思维模式,转向严格的问责制和严苛的行驶里程要求。Guident执行董事长兼首席执行官哈罗德·布劳恩(Harold Braun)在《机器人报
相关专题推荐
评论 (1)
0/500

在近期举办的 WWDC2026 活动上,LM Studio 与苹果公司共同展示了一项具有突破性的技术演示。在本次演示中,他们仅通过将四台 Mac Studio 连接成集群,便成功运行了 Moonshot 公司拥有 1 万亿参数的大型模型 Kimi K2.6。这一成就打破了长期以来“拥有万亿级参数的模型必然需要基于云端的 GPU 集群”的固有观念,证明了消费级硬件同样能够实现先进的 AI 计算能力。
Kimi K2.6 的总参数量为 1 万亿,采用了 MoE 架构,可在任意时刻激活 320 亿个参数。该模型支持长上下文处理、多模态输入处理以及基于智能体的任务执行功能。在演示中,四台 Mac Studio 通过苹果公司的内存共享与互连技术连接在一起,形成了一个拥有约 1.5TB 统一内存的集群,足以满足该大型模型的推理需求。此前的开发者测试显示,在类似的配置条件下,Kimi K2.6 的文本生成速度约为每秒 28 个标记,且其能耗远低于传统的基于 GPU 的解决方案。
当通过 iPhone 直接连接到本地集群时,所有数据均完全保留在用户的设备内部
此次演示的另一个亮点是 LM Studio 开发的 LM Link 远程访问功能。用户可以通过自己的 MacBook Neo 或 iPhone 安全地远程连接至 Mac Studio 集群,实时与正在运行的模型进行交互,所有的数据处理与通信都在本地完成,无需通过云端传输数据。
LM Link 已被集成到 LM Studio 的 Mac 应用程序以及 Locally AI 的 iOS 应用程序中,能够提供端到端加密的连接方式。这样的设置使得用户即便在性能较低的设备上,也能随时调用集群级的 AI 计算能力,同时无需担心隐私泄露问题。结合苹果公司的 Thunderbolt 5 RDMA 技术以及其他多设备内存共享方案,整个生态系统正在快速构建一个用于本地部署人工智能的无缝框架。
此次合作传递了一个明确的信号:在本地部署万亿参数级的大型模型已不再是仅限于实验室的理论概念,而是一种开发者可以在自身工作环境中实现的可行方案。随着苹果公司不断推进其硬件互连功能,消费级设备处理大规模 AI 推理的能力预计还将进一步提升。
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有





首页






