DeepSeek V4.1 Flash 釋出,原生支援多模態視覺,在價格下降的同時效能超越專業版
DeepSeek 今日正式推出其最新架構系列中最小規模的模型:DeepSeek V4.1Flash。該模型定位為具備原生多模態視覺理解的輕量級模型,旨在提供更高的效能、更快的推理速度、更大的吞吐量以及向更大引數規模擴充套件的能力。
在核心架構方面,DeepSeek V4.1Flash 採用擁有 5520 億引數的混合專家(MoE)架構,並具備創新的因果編碼器-解碼器結構。其非對稱設計使得輸入啟用值僅為 80 億,輸出啟用值為 160 億,與同等規模的模型相比顯著降低了成本。得益於全新的預訓練方法和大規模強化學習,該模型在各項基準測試中均優於 DeepSeek V4Pro 等旗艦模型。

在效率與成本控制方面,新模型大幅縮減了 KV 快取的大小。與前代產品相比,V4.1Flash 僅需四分之一的視訊記憶體(HBM)和八分之一的高速固態硬碟(SSD)容量。這種壓縮特性對於上下文儲存和快取命中成本較高的智慧體(Agent)場景尤為有益,從而顯著降低了運營成本。統計資料顯示,KV 快取已縮減至初始模型大小的四百分之一三十七(1/437)。
隨著新模型的釋出,DeepSeek 更新了其產品線和計費策略。DeepSeek V4.1Flash 現已透過 DeepSeek API 提供,模型名稱為 deepseek-flash。之前的版本 V4Flash 和 V4Flash Vision Exp 已停止服務,舊名稱(deepseek-v4-flash 和 deepseek-v4-flash-vision-exp)暫時重定向至 V4.1Flash。由於 V4.1Flash 在效能、成本、速度和可用時長方面均超越 V4Pro,公司計劃逐步淘汰 V4Pro:自 2026 年 9 月 14 日 12:00 起,對 deepseek-v4-pro 的請求將重定向至 V4.1Flash 並按其費率計費。WorkBuddy、CodeBuddy 以及騰訊的 OpenCode 等官方合作伙伴已整合該模型。
相關文章
阿里雲通義千問開放平臺正式上線,賦能手機、電腦及眼鏡等終端裝置,在租賃、物流等多個場景中實現智慧化應用
隨著人工智慧應用的迅速擴充套件,通義千問(Qwen)對其生態系統進行了顯著升級。8月10日推出的通義千問開放平臺,現已為手機、電腦及AI眼鏡等生態合作伙伴和開發者提供廣泛接入支援。在初始階段,該平臺整合了十餘個高頻日常場景,涵蓋物流、房地產、本地生活、金融及汽車養護等領域。使用者現在可直接在聊天視窗中輸入需求,或點選“圓點指示器”以呼叫專屬智慧體,無需切換應用即可無縫處理從諮詢、推薦到最終下單的全流程服務。為降低開發者接入門檻,通義千問開放平臺提供了強大的基礎設施支援。平臺支援標準化協議接入、一鍵
豆包計劃於6月中旬推出付費層級,並計劃在第三季度推進電商業務
抖音,位元組跳動旗下的旗艦大模型應用,計劃於6月底推出付費內容功能,相關更新將在Force大會上公佈。此舉標誌著中國最大規模大模型商業化程序中的重要里程碑。據報道,該時間表預留了約一個月的時間,用於調整PC端和移動端的核心功能及計費系統。若運營順利,抖音計劃於第三季度整合電商功能,以豐富付費場景。透過定向補貼將流量引導至抖音商城,預計第四季度可實現穩定運營。作為2027年實現商業回報整體戰略的一部分,抖音在2026年不會將付費使用者滲透率作為關鍵指標。這一轉變在5月初已有預兆,當時應用商店洩露了一份
央視曝光針對中老年女性的AI交友詐騙案,28人被捕
央視新聞的最新報道指出,一種利用人工智慧驅動的約會詐騙新浪潮正 targeting 中老年女性。犯罪分子利用人工智慧生成的人設,誘騙受害者陷入金融詐騙。四川省成都市警方近日破獲了一個“AI 約會”犯罪團伙,逮捕了包括王某在內的 28 名嫌疑人。調查顯示,該團伙造成的經濟損失超過 100 萬元人民幣,影響受害者超過 50 人。“兩幕式”詐騙:AI 影象與人工銷售策略的結合受害者卞女士在一個影片平臺上發現了一個婚戀服務,該平臺的一名被稱為“匹配中心王主任”的操作員向她傳送了一名名為“李哥”的男性
相關專題推薦
評論 (0)
0/500
DeepSeek 今日正式推出其最新架構系列中最小規模的模型:DeepSeek V4.1Flash。該模型定位為具備原生多模態視覺理解的輕量級模型,旨在提供更高的效能、更快的推理速度、更大的吞吐量以及向更大引數規模擴充套件的能力。
在核心架構方面,DeepSeek V4.1Flash 採用擁有 5520 億引數的混合專家(MoE)架構,並具備創新的因果編碼器-解碼器結構。其非對稱設計使得輸入啟用值僅為 80 億,輸出啟用值為 160 億,與同等規模的模型相比顯著降低了成本。得益於全新的預訓練方法和大規模強化學習,該模型在各項基準測試中均優於 DeepSeek V4Pro 等旗艦模型。

在效率與成本控制方面,新模型大幅縮減了 KV 快取的大小。與前代產品相比,V4.1Flash 僅需四分之一的視訊記憶體(HBM)和八分之一的高速固態硬碟(SSD)容量。這種壓縮特性對於上下文儲存和快取命中成本較高的智慧體(Agent)場景尤為有益,從而顯著降低了運營成本。統計資料顯示,KV 快取已縮減至初始模型大小的四百分之一三十七(1/437)。
隨著新模型的釋出,DeepSeek 更新了其產品線和計費策略。DeepSeek V4.1Flash 現已透過 DeepSeek API 提供,模型名稱為 deepseek-flash。之前的版本 V4Flash 和 V4Flash Vision Exp 已停止服務,舊名稱(deepseek-v4-flash 和 deepseek-v4-flash-vision-exp)暫時重定向至 V4.1Flash。由於 V4.1Flash 在效能、成本、速度和可用時長方面均超越 V4Pro,公司計劃逐步淘汰 V4Pro:自 2026 年 9 月 14 日 12:00 起,對 deepseek-v4-pro 的請求將重定向至 V4.1Flash 並按其費率計費。WorkBuddy、CodeBuddy 以及騰訊的 OpenCode 等官方合作伙伴已整合該模型。
阿里雲通義千問開放平臺正式上線,賦能手機、電腦及眼鏡等終端裝置,在租賃、物流等多個場景中實現智慧化應用
隨著人工智慧應用的迅速擴充套件,通義千問(Qwen)對其生態系統進行了顯著升級。8月10日推出的通義千問開放平臺,現已為手機、電腦及AI眼鏡等生態合作伙伴和開發者提供廣泛接入支援。在初始階段,該平臺整合了十餘個高頻日常場景,涵蓋物流、房地產、本地生活、金融及汽車養護等領域。使用者現在可直接在聊天視窗中輸入需求,或點選“圓點指示器”以呼叫專屬智慧體,無需切換應用即可無縫處理從諮詢、推薦到最終下單的全流程服務。為降低開發者接入門檻,通義千問開放平臺提供了強大的基礎設施支援。平臺支援標準化協議接入、一鍵
豆包計劃於6月中旬推出付費層級,並計劃在第三季度推進電商業務
抖音,位元組跳動旗下的旗艦大模型應用,計劃於6月底推出付費內容功能,相關更新將在Force大會上公佈。此舉標誌著中國最大規模大模型商業化程序中的重要里程碑。據報道,該時間表預留了約一個月的時間,用於調整PC端和移動端的核心功能及計費系統。若運營順利,抖音計劃於第三季度整合電商功能,以豐富付費場景。透過定向補貼將流量引導至抖音商城,預計第四季度可實現穩定運營。作為2027年實現商業回報整體戰略的一部分,抖音在2026年不會將付費使用者滲透率作為關鍵指標。這一轉變在5月初已有預兆,當時應用商店洩露了一份
央視曝光針對中老年女性的AI交友詐騙案,28人被捕
央視新聞的最新報道指出,一種利用人工智慧驅動的約會詐騙新浪潮正 targeting 中老年女性。犯罪分子利用人工智慧生成的人設,誘騙受害者陷入金融詐騙。四川省成都市警方近日破獲了一個“AI 約會”犯罪團伙,逮捕了包括王某在內的 28 名嫌疑人。調查顯示,該團伙造成的經濟損失超過 100 萬元人民幣,影響受害者超過 50 人。“兩幕式”詐騙:AI 影象與人工銷售策略的結合受害者卞女士在一個影片平臺上發現了一個婚戀服務,該平臺的一名被稱為“匹配中心王主任”的操作員向她傳送了一名名為“李哥”的男性





首頁






