选项
首页
新闻
企业人工智能成本:克劳德模型的部署价格比 GPT 高 20-30

企业人工智能成本:克劳德模型的部署价格比 GPT 高 20-30

2025-11-22
197

众所周知,不同的模型系列可能采用不同的标记化器。然而,对这些系统之间实际标记化过程有何不同的研究却很有限。对于相同的输入文本,所有标记化器产生的标记数是否相同?如果不是,这些差异有多大?它们有什么实际意义?

本文通过研究标记化差异在现实世界中的影响来探讨这些问题。我们对两个主要模型系列进行了比较分析:OpenAI 的 ChatGPT 与 Anthropic 的 Claude。虽然它们宣传的 "每令牌成本 "似乎极具竞争力,但我们的测试表明,Anthropic 模型的实际成本可能比 GPT 模型高出 20-30%。

API 定价--克劳德 3.5 奏鸣曲与 GPT-4o 的对比

截至 2024 年 6 月,这两种先进前沿模型的定价结构非常接近。Anthropic 的 Claude 3.5 Sonnet 和 OpenAI 的 GPT-4o 在输出代币方面的成本保持一致,而 Claude 3.5 Sonnet 在输入代币方面提供 40% 的折扣。

资料来源:Vantage来源:Vantage

隐藏的代币化低效率

尽管 Anthropic 的输入令牌率较低,但我们使用固定提示集进行的实验表明,GPT-4o 始终比 Claude Sonnet-3.5 提供更经济的总体成本。

是什么原因造成了这种差异?

与 OpenAI 的方法相比,Anthropic 的标记器通常会将相同的输入文本分割成更多标记。这意味着,对于相同的提示,Anthropic 模型生成的标记数要明显高于 OpenAI 模型。因此,虽然 Claude 3.5 Sonnet 的每个标记输入成本看起来较低,但增加的标记化数量往往抵消了这些节省,导致实际实施的总成本较高。

这种隐性成本来自 Anthropic 的标记编码方法,它经常需要更多的标记来表示同等内容。令牌数量的膨胀大大影响了运营成本和上下文窗口的效率。

特定领域的标记化变化

Anthropic 的标记化器处理不同内容领域的效率各不相同,与 OpenAI 的模型相比,会产生不一致的标记数增长。人工智能研究界也记录了类似的标记化差异。我们在三个重要领域验证了我们的发现:英文文章、Python 代码和数学内容。

领域模型输入GPT 标记克劳德代币代币开销百分比
英文文章标记化差异的其他实际影响

除了直接的成本考虑,令牌化器的低效率也会间接影响上下文窗口的利用率。虽然 Anthropic 模型宣传的上下文窗口为 200K 标记,而 OpenAI 为 128K,但标记化的冗余实际上可能会减少 Anthropic 模型的有效可用空间。这就造成了宣传的上下文窗口大小与其实际有效容量之间的潜在差异。

标记化实现细节

GPT 模型采用字节对编码 (BPE),将经常出现的字符对组合成标记。最新的 GPT 模型特别采用了开源的 o200k_base 标记化器。GPT-4o 在 tiktoken 标记化器中使用的实际标记可公开访问。

JSON {#reasoning "o1-xxx":"o200k_base","o3-xxx":"o200k_base",# chat"chatgpt-4o-":"o200k_base","gpt-4o-xxx":"o200k_base",# e.g., gpt-4o-2024-05-13 "gpt-4-xxx":"CL100K_BASE",# 例如,GPT-4-0314 等,加上 GPT-4-32K "GPT-3.5-TURBO-XXX":"cl100k_base",#例如,gpt-3.5-turbo-0301, -0401, etc.}

不幸的是,Anthropic 的令牌化方法仍然不太透明,因为他们的令牌化器不像 GPT 的那样容易获得。Anthropic 在 2024 年 12 月推出了令牌计数应用程序接口(Token Counting API),但这一功能在 2025 年以后的版本中停止使用。

根据 Latenode 的说法,"Anthropic 采用了独特的令牌器,只有 65000 种令牌变化,而 OpenAI 的 GPT-4 则有 100261 种变化"。一个公开可用的 Colab 笔记本包含 Python 代码,用于分析 GPT 和 Claude 模型之间的标记化差异。另一个与常见的、公开可用的标记化器接口的工具也证实了我们的发现。

对于人工智能企业来说,在不调用实际模型应用程序接口的情况下准确估算标记计数的能力对于成本预测和预算编制至关重要。

基本见解

  • Anthropic 极具竞争力的定价包含隐藏费用:
    虽然 Claude 3.5 Sonnet 的输入令牌成本比 GPT-4o 低 40%,但由于文本令牌化的根本差异,这一表面优势可能具有欺骗性。
  • 隐藏的标记化低效率:
    人类学模型本质上会产生更多的标记。对于处理大量文本的企业来说,了解这种差异对于准确评估部署成本至关重要。
  • 特定领域的标记化性能:
    在选择 OpenAI 和 Anthropic 模型时,请仔细评估您的典型输入内容。虽然自然语言任务可能显示出最小的成本差异,但技术或结构化领域使用 Anthropic 模型的成本可能要高得多。
  • 有效的上下文窗口容量:
    由于 Anthropic 的标记化冗长,其宣传的 200K 上下文窗口提供的实际可用空间可能小于 OpenAI 的 128K,从而可能造成宣称的上下文容量与实际容量之间的差距。

截至发稿时,Anthropic尚未回复VentureBeat的置评请求。如果他们做出回应,我们将更新本文。

相关文章
Anthropic 推出 Opus 4.8,新增动态工作流工具 Anthropic 推出 Opus 4.8,新增动态工作流工具 Anthropic 于周四发布了 Opus 4.8,这是其旗舰公开模型的最新版本。该版本定价与前一版本相同,目前已在所有平台上开放使用。距离 Opus 4.7 发布仅过去 41 天,Anthropic 显著加快了开发周期,远超近期 Sonnet 和 Haiku 版本三至七个月的发布间隔。此次快速更新很可能是对 Opus 4.7 反响平平的回应——该版本曾令许多用户感到失望。与此同时,OpenAI的
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本 在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本 在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略 Frontier AI Labs 拒绝透露针对失控模型的遏制策略 最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
相关专题推荐
音乐创作 用于混音制作、采样准备及卡拉OK母带处理的 AI 声部分离工具
用于混音制作、采样准备及卡拉OK母带处理的 AI 声部分离工具

2026年最新、最优秀且评分最高的AI音轨分离工具汇总,专为混音制作、采样准备以及卡拉OK音频处理而设计。这些功能强大的创新工具经过实际测试,能够实现精准的音频分离,显著提升工作效率。XIX.AI每周都会更新免费的付费产品对比指南,帮助您找到最适合自身需求的工具。立即探索,发挥您的AI优势。

8 个工具
xix.ai
数据分析 用于收入看板、转化漏斗分析及产品指标分析的 AI SQL 助手
用于收入看板、转化漏斗分析及产品指标分析的 AI SQL 助手

2026年最新最优秀的AI SQL辅助工具排名揭晓!XIX.AI精心挑选了一系列功能强大的工具,这些工具会定期更新,并通过真实的场景测试来验证其性能。使用这些值得尝试的工具,您可以快速生成精准的收入分析报表、分析销售流程,并追踪产品各项指标,从而大幅提升工作效率。立即探索,找到最适合您的数据驱动决策工具!238个字符

9 个工具
xix.ai
音乐创作 最佳用于歌曲草稿的 AI 旋律创作工具
最佳用于歌曲草稿的 AI 旋律创作工具

2026 年最新最佳顶级评分 AI 旋律创作工具,助力歌曲草稿创作!XIX.AI 精心策划了一套极具影响力且经过严格真实世界测试的变革性合集,旨在提供最佳的创作体验。您可以找到详细的免费与付费版对比、精准的排名以及必试选项,这些工具旨在帮助您轻松创作出令人惊艳的歌曲草稿,并显著提升您的创意生产力。立即探索,发现您的完美工具!

8 个工具
xix.ai
聊天机器人 最佳AI对话训练工具,助你备战面试
最佳AI对话训练工具,助你备战面试

2026年最新、最受好评的AI面试模拟训练工具现已登陆XIX.AI!这份精心精选的合集收录了功能强大、具有革命性意义的工具,它们均经过严格的实际测试,能够提供精准的反馈。 您将看到免费版与付费版的对比分析以及详细排名,助您挑选出必试之选,从而提升自信并精进技能。立即探索,发现助您面试成功的完美工具!

12 个工具
xix.ai
设计与艺术 最适合创意实验的AI风格转换工具
最适合创意实验的AI风格转换工具

2026年最新最佳、评价最高的AI风格转换工具,助您开展创意实验!XIX.AI精心甄选了一系列功能强大、颠覆性的必试工具,这些工具经过实际测试和严格排名,可带来卓越的效果。这些顶级解决方案通过加速内容创作并释放无限创意潜能,帮助创作者显著提升工作效率。 立即探索,找到最适合您的工具,今天就开始创作吧!

9 个工具
xix.ai
漫画创作 最适合视觉叙事的AI对话气泡工具
最适合视觉叙事的AI对话气泡工具

2026年最新、最受欢迎的视觉叙事AI对话气泡工具现已登陆XIX.AI!这份精心精选的合集汇集了功能强大、具有颠覆性的工具,可帮助创作者提升工作效率并突破创作瓶颈。 获取免费版与付费版的对比分析,查看实际测试结果,并查阅最新排行榜,找到最适合打造引人入胜的视觉叙事的必试解决方案。立即探索,发现您的理想工具!

10 个工具
xix.ai
评论 (1)
0/500
AnthonyGonzalez
AnthonyGonzalez 2026-06-28 02:00:18

Interesting pricing gap! But the tokenizer differences can really impact actual costs per task. I wonder if Claude's higher price is justified by better performance in certain use cases. 🤔

OR