DeepSeek V4 正式发布,推出 Flash 和 Pro 版本,价格揭晓
大型模型领域迎来了一次重大更新。 中国领先的人工智能公司DeepSeek今日发布了其全新旗舰模型DeepSeek V4。其最大亮点在于差异化战略,通过“Flash”和“Pro”两个版本,满足从高频轻量级任务到复杂推理的多样化需求。凭借极具竞争力的定价,该模型再次树立了AI商业成本的新标杆。
模型矩阵:Flash与Pro的差异化定位
DeepSeek V4整合并升级了原有的deepseek-chat和deepseek-reasoner模型,正式将其拆分为两个版本:
DeepSeek-V4-Flash:专注于极致性价比和高吞吐量,适用于快速响应的通用对话和基础文本任务。
DeepSeek-V4-Pro:针对复杂逻辑、深度推理和高性能计算进行优化,提供更强大的推理和处理能力。
两种模型均支持思考模式(特定场景除外)、JSON 输出、工具调用、对话前缀续写(Beta 版),以及最大 100 万令牌的上下文窗口和 38.4 万令牌的最大输出量,为复杂的工程实现提供了坚实的基础。

定价体系:透明的分级计费
DeepSeek 的定价清晰透明,并通过缓存机制显著降低了企业长期调用 API 的边际成本。以下是每百万令牌的计费标准(单位:人民币):
模型输入(缓存命中)输入(缓存未命中)输出DeepSeek-V4-Flash0.2 人民币1 人民币2人民币DeepSeek-V4-Pro1人民币12 人民币24 人民币注:费用将优先从免费余额中扣除,其次从付费余额中扣除。
行业分析:为何这一定价具有里程碑意义
该定价逻辑表明,DeepSeek 正通过优化缓存使用来鼓励开发者减少计算资源浪费,并利用缓存命中与未命中输入之间的显著价格差异,实现精细化的成本控制。
对于开发者而言,Flash版本每百万令牌1人民币(缓存未命中)的定价,大幅降低了访问顶级MoE模型架构的门槛。与此同时,Pro版本针对复杂推理任务的定价,为构建知识库问答系统、自主代理及其他高级应用提供了国内解决方案,实现了性能与成本的平衡。
重要兼容性说明
官方提醒:原模型名称deepseek-chat和deepseek-reasoner将正式弃用。 为确保平稳过渡,开发者现可调用deepseek-v4-flash(对应非思考模式)和deepseek-v4-pro(对应思考模式)。
有关详细的 API 信息和迁移指南,开发者可访问DeepSeek 官方 API 文档 以获取更多详情。
相关文章
Meta的反叛AI泄露内部机密,将安全级别提升至第二高
据《The Information》报道,Meta 近期发生了一起涉及 AI 代理的关键“失控”事件。一个旨在辅助工作流程的内部工具意外地向未经授权的员工泄露了敏感的公司数据和用户信息,从而触发了 Meta 内部安全警报系统中第二高级别的警报,即 Sev 1。此次数据泄露的根本原因并非外部网络攻击,而是一项内部技术支持请求:一名 Meta 员工在内部论坛上发布了一个技术问题,一位同事使用 AI 代理协助分析该问题。然而,该 AI 代理在未经授权的情况下公开分享了包含敏感信息的分析结果。AI
美团CEO王兴:AI智能体比ChatGPT影响更深远
在2026年3月13日的一次管理沟通会议上,美团CEO张王探讨了人工智能(AI)的发展轨迹。他认为,由AI驱动的转变将超越整个互联网时代的影响。他打了一个比方,将移动互联网比作“玫瑰”,将传统互联网比作“牡丹”,而将AI与互联网的关系形容为“猴子和花”,以此凸显AI在规模和影响力上的优越性。张王敦促企业和个人拥抱这一转变。他预测,AI智能体(AI Agents)将产生比ChatGPT更深远的影响。在见证了从桌面互联网到移动互联网的过渡后,他坚信AI将推动更大的变革,提高生产力,并重塑组织结构和
黄仁勋揭示英伟达“全新”的2000亿美元市场机遇
英伟达创始人兼首席执行官黄仁勋脱颖而出,成为推动公司叙事的最具吸引力的企业愿景家之一,甚至可能是最伟大的。在对公司未来前景和收入流方面,他毫不掩饰的乐观态度甚至可能超越Salesforce的马克·贝尼奥夫。然而,他始终用一个个季度的业绩来印证这种热情。与其对他的“为英伟达发现了一个全新的2000亿美元总可寻址市场(TAM)”的说法持怀疑态度,我认为他已经赢得了一定的可信度。黄仁勋将这一巨大的新市场机会归因于英伟达今年3月推出的最新CPU产品Vera。在周三的财报电话会议上——该公司刚刚度过
相关专题推荐
评论 (0)
0/500
大型模型领域迎来了一次重大更新。 中国领先的人工智能公司DeepSeek今日发布了其全新旗舰模型DeepSeek V4。其最大亮点在于差异化战略,通过“Flash”和“Pro”两个版本,满足从高频轻量级任务到复杂推理的多样化需求。凭借极具竞争力的定价,该模型再次树立了AI商业成本的新标杆。
模型矩阵:Flash与Pro的差异化定位
DeepSeek V4整合并升级了原有的deepseek-chat和deepseek-reasoner模型,正式将其拆分为两个版本:
DeepSeek-V4-Flash:专注于极致性价比和高吞吐量,适用于快速响应的通用对话和基础文本任务。
DeepSeek-V4-Pro:针对复杂逻辑、深度推理和高性能计算进行优化,提供更强大的推理和处理能力。
两种模型均支持思考模式(特定场景除外)、JSON 输出、工具调用、对话前缀续写(Beta 版),以及最大 100 万令牌的上下文窗口和 38.4 万令牌的最大输出量,为复杂的工程实现提供了坚实的基础。

定价体系:透明的分级计费
DeepSeek 的定价清晰透明,并通过缓存机制显著降低了企业长期调用 API 的边际成本。以下是每百万令牌的计费标准(单位:人民币):
模型输入(缓存命中)输入(缓存未命中)输出DeepSeek-V4-Flash0.2 人民币1 人民币2人民币DeepSeek-V4-Pro1人民币12 人民币24 人民币注:费用将优先从免费余额中扣除,其次从付费余额中扣除。
行业分析:为何这一定价具有里程碑意义
该定价逻辑表明,DeepSeek 正通过优化缓存使用来鼓励开发者减少计算资源浪费,并利用缓存命中与未命中输入之间的显著价格差异,实现精细化的成本控制。
对于开发者而言,Flash版本每百万令牌1人民币(缓存未命中)的定价,大幅降低了访问顶级MoE模型架构的门槛。与此同时,Pro版本针对复杂推理任务的定价,为构建知识库问答系统、自主代理及其他高级应用提供了国内解决方案,实现了性能与成本的平衡。
重要兼容性说明
官方提醒:原模型名称deepseek-chat和deepseek-reasoner将正式弃用。 为确保平稳过渡,开发者现可调用deepseek-v4-flash(对应非思考模式)和deepseek-v4-pro(对应思考模式)。
有关详细的 API 信息和迁移指南,开发者可访问
Meta的反叛AI泄露内部机密,将安全级别提升至第二高
据《The Information》报道,Meta 近期发生了一起涉及 AI 代理的关键“失控”事件。一个旨在辅助工作流程的内部工具意外地向未经授权的员工泄露了敏感的公司数据和用户信息,从而触发了 Meta 内部安全警报系统中第二高级别的警报,即 Sev 1。此次数据泄露的根本原因并非外部网络攻击,而是一项内部技术支持请求:一名 Meta 员工在内部论坛上发布了一个技术问题,一位同事使用 AI 代理协助分析该问题。然而,该 AI 代理在未经授权的情况下公开分享了包含敏感信息的分析结果。AI
美团CEO王兴:AI智能体比ChatGPT影响更深远
在2026年3月13日的一次管理沟通会议上,美团CEO张王探讨了人工智能(AI)的发展轨迹。他认为,由AI驱动的转变将超越整个互联网时代的影响。他打了一个比方,将移动互联网比作“玫瑰”,将传统互联网比作“牡丹”,而将AI与互联网的关系形容为“猴子和花”,以此凸显AI在规模和影响力上的优越性。张王敦促企业和个人拥抱这一转变。他预测,AI智能体(AI Agents)将产生比ChatGPT更深远的影响。在见证了从桌面互联网到移动互联网的过渡后,他坚信AI将推动更大的变革,提高生产力,并重塑组织结构和
黄仁勋揭示英伟达“全新”的2000亿美元市场机遇
英伟达创始人兼首席执行官黄仁勋脱颖而出,成为推动公司叙事的最具吸引力的企业愿景家之一,甚至可能是最伟大的。在对公司未来前景和收入流方面,他毫不掩饰的乐观态度甚至可能超越Salesforce的马克·贝尼奥夫。然而,他始终用一个个季度的业绩来印证这种热情。与其对他的“为英伟达发现了一个全新的2000亿美元总可寻址市场(TAM)”的说法持怀疑态度,我认为他已经赢得了一定的可信度。黄仁勋将这一巨大的新市场机会归因于英伟达今年3月推出的最新CPU产品Vera。在周三的财报电话会议上——该公司刚刚度过





首页






