DeepSeek V4.1 Flash 发布,原生支持多模态视觉,在价格下降的同时性能超越专业版
DeepSeek 今日正式推出其最新架构系列中最小规模的模型:DeepSeek V4.1Flash。该模型定位为具备原生多模态视觉理解的轻量级模型,旨在提供更高的性能、更快的推理速度、更大的吞吐量以及向更大参数规模扩展的能力。
在核心架构方面,DeepSeek V4.1Flash 采用拥有 5520 亿参数的混合专家(MoE)架构,并具备创新的因果编码器-解码器结构。其非对称设计使得输入激活值仅为 80 亿,输出激活值为 160 亿,与同等规模的模型相比显著降低了成本。得益于全新的预训练方法和大规模强化学习,该模型在各项基准测试中均优于 DeepSeek V4Pro 等旗舰模型。

在效率与成本控制方面,新模型大幅缩减了 KV 缓存的大小。与前代产品相比,V4.1Flash 仅需四分之一的显存(HBM)和八分之一的高速固态硬盘(SSD)容量。这种压缩特性对于上下文存储和缓存命中成本较高的智能体(Agent)场景尤为有益,从而显著降低了运营成本。统计数据显示,KV 缓存已缩减至初始模型大小的四百分之一三十七(1/437)。
随着新模型的发布,DeepSeek 更新了其产品线和计费策略。DeepSeek V4.1Flash 现已通过 DeepSeek API 提供,模型名称为 deepseek-flash。之前的版本 V4Flash 和 V4Flash Vision Exp 已停止服务,旧名称(deepseek-v4-flash 和 deepseek-v4-flash-vision-exp)暂时重定向至 V4.1Flash。由于 V4.1Flash 在性能、成本、速度和可用时长方面均超越 V4Pro,公司计划逐步淘汰 V4Pro:自 2026 年 9 月 14 日 12:00 起,对 deepseek-v4-pro 的请求将重定向至 V4.1Flash 并按其费率计费。WorkBuddy、CodeBuddy 以及腾讯的 OpenCode 等官方合作伙伴已集成该模型。
相关文章
阿里云通义千问开放平台正式上线,赋能手机、电脑及眼镜等终端设备,在租赁、物流等多个场景中实现智能化应用
随着人工智能应用的迅速扩展,通义千问(Qwen)对其生态系统进行了显著升级。8月10日推出的通义千问开放平台,现已为手机、电脑及AI眼镜等生态合作伙伴和开发者提供广泛接入支持。在初始阶段,该平台整合了十余个高频日常场景,涵盖物流、房地产、本地生活、金融及汽车养护等领域。用户现在可直接在聊天窗口中输入需求,或点击“圆点指示器”以调用专属智能体,无需切换应用即可无缝处理从咨询、推荐到最终下单的全流程服务。为降低开发者接入门槛,通义千问开放平台提供了强大的基础设施支持。平台支持标准化协议接入、一键
豆包计划于6月中旬推出付费层级,并计划在第三季度推进电商业务
抖音,字节跳动旗下的旗舰大模型应用,计划于6月底推出付费内容功能,相关更新将在Force大会上公布。此举标志着中国最大规模大模型商业化进程中的重要里程碑。据报道,该时间表预留了约一个月的时间,用于调整PC端和移动端的核心功能及计费系统。若运营顺利,抖音计划于第三季度整合电商功能,以丰富付费场景。通过定向补贴将流量引导至抖音商城,预计第四季度可实现稳定运营。作为2027年实现商业回报整体战略的一部分,抖音在2026年不会将付费用户渗透率作为关键指标。这一转变在5月初已有预兆,当时应用商店泄露了一份
央视曝光针对中老年女性的AI交友诈骗案,28人被捕
央视新闻的最新报道指出,一种利用人工智能驱动的约会诈骗新浪潮正 targeting 中老年女性。犯罪分子利用人工智能生成的人设,诱骗受害者陷入金融诈骗。四川省成都市警方近日破获了一个“AI 约会”犯罪团伙,逮捕了包括王某在内的 28 名嫌疑人。调查显示,该团伙造成的经济损失超过 100 万元人民币,影响受害者超过 50 人。“两幕式”诈骗:AI 图像与人工销售策略的结合受害者卞女士在一个视频平台上发现了一个婚恋服务,该平台的一名被称为“匹配中心王主任”的操作员向她发送了一名名为“李哥”的男性
相关专题推荐
评论 (0)
0/500
DeepSeek 今日正式推出其最新架构系列中最小规模的模型:DeepSeek V4.1Flash。该模型定位为具备原生多模态视觉理解的轻量级模型,旨在提供更高的性能、更快的推理速度、更大的吞吐量以及向更大参数规模扩展的能力。
在核心架构方面,DeepSeek V4.1Flash 采用拥有 5520 亿参数的混合专家(MoE)架构,并具备创新的因果编码器-解码器结构。其非对称设计使得输入激活值仅为 80 亿,输出激活值为 160 亿,与同等规模的模型相比显著降低了成本。得益于全新的预训练方法和大规模强化学习,该模型在各项基准测试中均优于 DeepSeek V4Pro 等旗舰模型。

在效率与成本控制方面,新模型大幅缩减了 KV 缓存的大小。与前代产品相比,V4.1Flash 仅需四分之一的显存(HBM)和八分之一的高速固态硬盘(SSD)容量。这种压缩特性对于上下文存储和缓存命中成本较高的智能体(Agent)场景尤为有益,从而显著降低了运营成本。统计数据显示,KV 缓存已缩减至初始模型大小的四百分之一三十七(1/437)。
随着新模型的发布,DeepSeek 更新了其产品线和计费策略。DeepSeek V4.1Flash 现已通过 DeepSeek API 提供,模型名称为 deepseek-flash。之前的版本 V4Flash 和 V4Flash Vision Exp 已停止服务,旧名称(deepseek-v4-flash 和 deepseek-v4-flash-vision-exp)暂时重定向至 V4.1Flash。由于 V4.1Flash 在性能、成本、速度和可用时长方面均超越 V4Pro,公司计划逐步淘汰 V4Pro:自 2026 年 9 月 14 日 12:00 起,对 deepseek-v4-pro 的请求将重定向至 V4.1Flash 并按其费率计费。WorkBuddy、CodeBuddy 以及腾讯的 OpenCode 等官方合作伙伴已集成该模型。
阿里云通义千问开放平台正式上线,赋能手机、电脑及眼镜等终端设备,在租赁、物流等多个场景中实现智能化应用
随着人工智能应用的迅速扩展,通义千问(Qwen)对其生态系统进行了显著升级。8月10日推出的通义千问开放平台,现已为手机、电脑及AI眼镜等生态合作伙伴和开发者提供广泛接入支持。在初始阶段,该平台整合了十余个高频日常场景,涵盖物流、房地产、本地生活、金融及汽车养护等领域。用户现在可直接在聊天窗口中输入需求,或点击“圆点指示器”以调用专属智能体,无需切换应用即可无缝处理从咨询、推荐到最终下单的全流程服务。为降低开发者接入门槛,通义千问开放平台提供了强大的基础设施支持。平台支持标准化协议接入、一键
豆包计划于6月中旬推出付费层级,并计划在第三季度推进电商业务
抖音,字节跳动旗下的旗舰大模型应用,计划于6月底推出付费内容功能,相关更新将在Force大会上公布。此举标志着中国最大规模大模型商业化进程中的重要里程碑。据报道,该时间表预留了约一个月的时间,用于调整PC端和移动端的核心功能及计费系统。若运营顺利,抖音计划于第三季度整合电商功能,以丰富付费场景。通过定向补贴将流量引导至抖音商城,预计第四季度可实现稳定运营。作为2027年实现商业回报整体战略的一部分,抖音在2026年不会将付费用户渗透率作为关键指标。这一转变在5月初已有预兆,当时应用商店泄露了一份
央视曝光针对中老年女性的AI交友诈骗案,28人被捕
央视新闻的最新报道指出,一种利用人工智能驱动的约会诈骗新浪潮正 targeting 中老年女性。犯罪分子利用人工智能生成的人设,诱骗受害者陷入金融诈骗。四川省成都市警方近日破获了一个“AI 约会”犯罪团伙,逮捕了包括王某在内的 28 名嫌疑人。调查显示,该团伙造成的经济损失超过 100 万元人民币,影响受害者超过 50 人。“两幕式”诈骗:AI 图像与人工销售策略的结合受害者卞女士在一个视频平台上发现了一个婚恋服务,该平台的一名被称为“匹配中心王主任”的操作员向她发送了一名名为“李哥”的男性





首页






