Meta签署协议,采购数百万颗亚马逊AI处理器

亚马逊已与Meta达成一项重要合作,再次依托其自主设计的芯片。亚马逊周五证实,Meta已同意部署数百万颗AWS Graviton芯片,以满足其不断增长的人工智能需求。
需注意,AWS Graviton是一款基于ARM架构的CPU(中央处理器,用于通用计算),而非GPU(图形处理器)。
虽然GPU仍是训练大型模型的首选芯片,但一旦模型训练完成,基于这些模型构建的AI代理正推动着所需芯片类型的转变。这些代理会产生计算密集型工作负载,例如实时推理、代码编写、搜索以及协调多步骤任务。 AWS表示,其最新版本的Graviton专为处理AI相关计算需求而设计。
该协议将使 Meta 更多支出转向 AWS,而非 Google Cloud 等竞争对手。去年 8 月,Meta 曾与 Google Cloud 签署了一份为期六年、价值 100 亿美元的协议,尽管此前 Meta 主要使用 AWS 服务,同时也使用 Microsoft Azure。
我们注意到,AWS特意将该协议的发布时间安排在Google Cloud Next大会结束之际,这几乎像是在对这位云计算竞争对手暗中发难。当然,Google也在开发自己的定制AI芯片,并在此次活动中发布了新版本。
诚然,亚马逊也生产自己的AI GPU:Trainium。尽管名字叫Trainium,但它既用于训练,也用于推理——即模型训练完成后,主动处理提示词的阶段。
然而,Anthropic本月早些时候已达成协议,预留了未来数年的大量此类芯片。 这家开发了Claude的公司同意在未来十年内投入1000亿美元,将其工作负载运行在AWS上,并特别侧重于Trainium;作为回报,亚马逊同意向Anthropic额外投资50亿美元(使总投资额达到130亿美元)。
最终,与Meta达成的协议使亚马逊得以将这家重要AI客户作为其自有CPU的实力证明。这些芯片与英伟达(Nvidia)的新款Vera CPU形成竞争,后者同样基于ARM架构,专为AI代理工作负载设计。 关键区别在于,英伟达将其芯片和AI系统销售给企业及云服务提供商(包括AWS),而AWS仅通过其云服务提供芯片使用权限。
本月早些时候,亚马逊CEO安迪·贾西在其年度致股东信中批评了英伟达和英特尔,指出企业对AI产品要求更高的性价比,并表示他计划以此为优势赢得更多订单。这也意味着亚马逊内部芯片研发团队面临的交付压力前所未有。上个月,我们在独家参观该团队实验室时曾与他们进行了交流。
相关文章
亚马逊推出“Alexa for Shopping”,同时将Rufus边缘化
亚马逊推出了“Alexa for Shopping”,将 Rufus 购物聊天机器人 Alexa+ 整合到应用程序、网站和 Echo Show 设备中。该助手回答产品查询、比较商品、跟踪价格,并支持购物提醒。它还处理计划中的购物操作和符合条件的自动购买。据该公司称,“Alexa for Shopping”将 Rufus 的产品专业知识与 Alexa+ 的个性化助手上下文相结合。亚马逊表示,Rufus 在 2025 年协助了超过 3 亿客户进行产品研究、比较和购买。GeekWire 报道称,
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
OneRail 利用英伟达人工智能优化实时“最后一公里”配送
OneRail推出了一款基于Nvidia技术的人工智能驱动配送平台,旨在协助零售商、批发商和分销商为单个订单确定最高效的配送方式。据 OneRail 介绍,该系统名为 OmniSTAR,可评估各种配送渠道——包括自有车队、快递员、包裹服务及其他物流模式——以确定既能满足服务水平协议(SLA),又最具成本效益的解决方案。该平台将英伟达的 cuOpt 决策优化引擎和 cuDF 数据处理软件与 OneR
相关专题推荐
评论 (0)
0/500

亚马逊已与Meta达成一项重要合作,再次依托其自主设计的芯片。亚马逊周五证实,Meta已同意部署数百万颗AWS Graviton芯片,以满足其不断增长的人工智能需求。
需注意,AWS Graviton是一款基于ARM架构的CPU(中央处理器,用于通用计算),而非GPU(图形处理器)。
虽然GPU仍是训练大型模型的首选芯片,但一旦模型训练完成,基于这些模型构建的AI代理正推动着所需芯片类型的转变。这些代理会产生计算密集型工作负载,例如实时推理、代码编写、搜索以及协调多步骤任务。 AWS表示,其最新版本的Graviton专为处理AI相关计算需求而设计。
该协议将使 Meta 更多支出转向 AWS,而非 Google Cloud 等竞争对手。去年 8 月,Meta 曾与 Google Cloud 签署了一份为期六年、价值 100 亿美元的协议,尽管此前 Meta 主要使用 AWS 服务,同时也使用 Microsoft Azure。
我们注意到,AWS特意将该协议的发布时间安排在Google Cloud Next大会结束之际,这几乎像是在对这位云计算竞争对手暗中发难。当然,Google也在开发自己的定制AI芯片,并在此次活动中发布了新版本。
诚然,亚马逊也生产自己的AI GPU:Trainium。尽管名字叫Trainium,但它既用于训练,也用于推理——即模型训练完成后,主动处理提示词的阶段。
然而,Anthropic本月早些时候已达成协议,预留了未来数年的大量此类芯片。 这家开发了Claude的公司同意在未来十年内投入1000亿美元,将其工作负载运行在AWS上,并特别侧重于Trainium;作为回报,亚马逊同意向Anthropic额外投资50亿美元(使总投资额达到130亿美元)。
最终,与Meta达成的协议使亚马逊得以将这家重要AI客户作为其自有CPU的实力证明。这些芯片与英伟达(Nvidia)的新款Vera CPU形成竞争,后者同样基于ARM架构,专为AI代理工作负载设计。 关键区别在于,英伟达将其芯片和AI系统销售给企业及云服务提供商(包括AWS),而AWS仅通过其云服务提供芯片使用权限。
本月早些时候,亚马逊CEO安迪·贾西在其年度致股东信中批评了英伟达和英特尔,指出企业对AI产品要求更高的性价比,并表示他计划以此为优势赢得更多订单。这也意味着亚马逊内部芯片研发团队面临的交付压力前所未有。上个月,我们在独家参观该团队实验室时曾与他们进行了交流。
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
OneRail 利用英伟达人工智能优化实时“最后一公里”配送
OneRail推出了一款基于Nvidia技术的人工智能驱动配送平台,旨在协助零售商、批发商和分销商为单个订单确定最高效的配送方式。据 OneRail 介绍,该系统名为 OmniSTAR,可评估各种配送渠道——包括自有车队、快递员、包裹服务及其他物流模式——以确定既能满足服务水平协议(SLA),又最具成本效益的解决方案。该平台将英伟达的 cuOpt 决策优化引擎和 cuDF 数据处理软件与 OneR





首页






