DeepSeek 发布 V4 预览版,使百万级长上下文对所有人开放
DeepSeek 已正式推出并开源其最新模型系列的预览版 DeepSeek-V4 。通过结构创新,该系列实现了标准化的 1M(一百万 token)超长上下文处理,并在 Agent 协作、世界知识和逻辑推理方面领先于国内及开源模型。

双版本布局:Pro 追求卓越,Flash 追求效率
DeepSeek-V4 提供两种规格,以满足不同的应用需求:
DeepSeek-V4-Pro(1.6T 参数,激活 49B): 性能媲美顶级闭源模型。在 Agentic Coding 评估中取得最佳开源结果,输出质量接近 Opus4.6。在数学、STEM 和竞技编程测试中,它超越了所有公开评估的开源模型,展现了世界级的推理能力。
DeepSeek-V4-Flash(284B 参数,激活 13B): 优先考虑极致的性价比。虽然其世界知识略低于 Pro 版本,但在简单任务和 Agent 性能方面与 Pro 级别的推理能力持平,提供更快速且经济的 API 服务。
结构创新:DSA 机制实现长上下文可用
DeepSeek-V4 引入了开创性的 **DSA 稀疏注意力机制**。通过在 token 层面进行压缩,模型大幅降低了超长上下文的计算和内存需求。这使得 1M 上下文成为 DeepSeek 所有官方服务的标准功能,解决了行业在处理长文本时的高成本痛点。
深度适配 Agent 生态
针对 Claude Code 和 CodeBuddy 等主流 Agent 产品进行了优化,DeepSeek-V4 支持 非思考模式 和 思考模式。API 暴露了 reasoning_effort 参数,允许用户根据任务复杂度调整思考强度(高/最大),显著提升了代码生成和文档处理等复杂场景下的性能。
访问与开源计划
用户现在可以通过 官方网站 或官方应用访问最新模型,并获取相应的 API 更新。请注意,旧版模型名称 deepseek-chat 和 deepseek-reasoner 将在三个月后(2026 年 7 月 24 日)停止使用。
开源链接: 可在 Hugging Face 和 Moba 社区 获取。
技术报告: 已发布在 Hugging Face 仓库中。
此次 DeepSeek-V4 的发布验证了开源模型在长上下文和 Agent 能力方面追赶顶级闭源模型的可行性,通过技术突破为 AGI 的普及奠定了坚实基础。
相关文章
Chrome 和 Edge 悄然将本地 AI 模型存储需求提升至 20GB,随着浏览器演变为 AI 推理引擎
Google Chrome 和 Microsoft Edge 已将本地 AI 模型的磁盘空间要求提高至 20GB。这些浏览器在后台静默下载模型,以启用设备端 AI 功能。今年 5 月,人们发现 Chrome 会自动下载约 4GB 的 AI 模型,以便在本地运行功能,而不是将所有数据发送到 Google 的服务器。此后,Google 悄悄更新了其官方帮助文档,将所需的空闲磁盘空间从 4GB 增加到约 20GB。虽然这个数字代表的是下载前提条件,但实际模型使用量可能会更低。Edge 的要求在很大程
智谱AI在5个月内实现15倍增长后,以编程为重点,目标年收入达10亿美元
多个独立消息源证实,智谱的年度经常性收入(ARR)在2026年7月已达到10亿美元。该公司尚未对这些报道发表评论。AI编程和视频生成已成为生成式AI增长最快的商业领域。在国际市场上,Anthropic的Claude Code在发布仅六个月后便实现了10亿美元的ARR,从而推高了其估值。智谱ARR的快速增长表明,国内大模型公司正在成功探索新的变现策略。据报道,智谱的ARR在短短五个月内从10亿美元飙升至100亿美元,而Anthropic实现这一里程碑则耗时15个月。内部人士指出,智谱在2026年1
微软发布首款网络安全AI模型MAI-Cyber-1-Flash,并推出感知安全平台
微软正式推出了其首款专用网络安全模型 MAI-Cyber-1-Flash,以及一个名为 Perception 的全新 AI 驱动安全平台。这些创新在旧金山的一场活动中亮相,进一步巩固了微软在 AI 安全领域的地位,使其能够直接与 Anthropic、Google 和 OpenAI 等行业领导者展开竞争。MAI-Cyber-1-Flash 专为网络安全工作流程设计,能够识别代码库中的复杂漏洞,并为微软的漏洞检测和修复工具 MDASH 提供支持。该模型与 Perception 平台集成,使企业能够
相关专题推荐
评论 (0)
0/500
DeepSeek 已正式推出并开源其最新模型系列的预览版

双版本布局:Pro 追求卓越,Flash 追求效率
DeepSeek-V4-Pro(1.6T 参数,激活 49B): 性能媲美顶级闭源模型。在 Agentic Coding 评估中取得最佳开源结果,输出质量接近 Opus4.6。在数学、STEM 和竞技编程测试中,它超越了所有公开评估的开源模型,展现了世界级的推理能力。
DeepSeek-V4-Flash(284B 参数,激活 13B): 优先考虑极致的性价比。虽然其世界知识略低于 Pro 版本,但在简单任务和 Agent 性能方面与 Pro 级别的推理能力持平,提供更快速且经济的 API 服务。
结构创新:DSA 机制实现长上下文可用
深度适配 Agent 生态
针对 Claude Code 和 CodeBuddy 等主流 Agent 产品进行了优化,reasoning_effort 参数,允许用户根据任务复杂度调整思考强度(高/最大),显著提升了代码生成和文档处理等复杂场景下的性能。
访问与开源计划
用户现在可以通过 deepseek-chat 和 deepseek-reasoner 将在三个月后(2026 年 7 月 24 日)停止使用。
开源链接: 可在
技术报告: 已发布在
此次
Chrome 和 Edge 悄然将本地 AI 模型存储需求提升至 20GB,随着浏览器演变为 AI 推理引擎
Google Chrome 和 Microsoft Edge 已将本地 AI 模型的磁盘空间要求提高至 20GB。这些浏览器在后台静默下载模型,以启用设备端 AI 功能。今年 5 月,人们发现 Chrome 会自动下载约 4GB 的 AI 模型,以便在本地运行功能,而不是将所有数据发送到 Google 的服务器。此后,Google 悄悄更新了其官方帮助文档,将所需的空闲磁盘空间从 4GB 增加到约 20GB。虽然这个数字代表的是下载前提条件,但实际模型使用量可能会更低。Edge 的要求在很大程
智谱AI在5个月内实现15倍增长后,以编程为重点,目标年收入达10亿美元
多个独立消息源证实,智谱的年度经常性收入(ARR)在2026年7月已达到10亿美元。该公司尚未对这些报道发表评论。AI编程和视频生成已成为生成式AI增长最快的商业领域。在国际市场上,Anthropic的Claude Code在发布仅六个月后便实现了10亿美元的ARR,从而推高了其估值。智谱ARR的快速增长表明,国内大模型公司正在成功探索新的变现策略。据报道,智谱的ARR在短短五个月内从10亿美元飙升至100亿美元,而Anthropic实现这一里程碑则耗时15个月。内部人士指出,智谱在2026年1
微软发布首款网络安全AI模型MAI-Cyber-1-Flash,并推出感知安全平台
微软正式推出了其首款专用网络安全模型 MAI-Cyber-1-Flash,以及一个名为 Perception 的全新 AI 驱动安全平台。这些创新在旧金山的一场活动中亮相,进一步巩固了微软在 AI 安全领域的地位,使其能够直接与 Anthropic、Google 和 OpenAI 等行业领导者展开竞争。MAI-Cyber-1-Flash 专为网络安全工作流程设计,能够识别代码库中的复杂漏洞,并为微软的漏洞检测和修复工具 MDASH 提供支持。该模型与 Perception 平台集成,使企业能够





首页






