DeepSeek-V4.1-Flash 首度登陸 Qwen AI 平台,API 與代幣計畫同步上線
DeepSeek-V4.1-Flash 現已於 Qwen AI 平台正式上線,提供 API 存取功能及彈性的代幣方案。 開發者可透過標準 API 將此模型無縫整合至其工作流程中,或直接在 Qoder、Qwen APP 及 Codex 等工具內運用代幣方案,以進行程式編寫、文件編寫、視覺分析及代理驅動任務。

這款被譽為 DeepSeek 新型輕量級旗艦模型,採用 MoE 架構,總參數達 5520 億。其採用「因果編碼器-解碼器」非對稱結構,輸入階段僅激活約 80 億參數,輸出階段則激活約 160 億參數。 該模型原生支援文字與圖像理解,可處理長達 100 萬個標記的上下文視窗,並產生約 39.3 萬個標記的輸出。官方基準測試顯示,其在代理程式與程式碼執行效能方面均有顯著提升,儘管激活成本降低,仍能提供高吞吐量與低延遲。
成本效益是其一大亮點。先進的快取壓縮技術將 KV 快取 HBM 需求降低至前代產品的 25%,SSD 儲存需求則降至 12.5%,從而針對長上下文與多輪互動優化資源配置。 Qwen 平台採分級定價:非尖峰時段輸入費用為每百萬個標記 1 人民幣(尖峰時段為 2 人民幣),輸出費用則為每百萬個標記 4 人民幣(尖峰時段為 8 人民幣)。 速率限制分別為每分鐘 15,000 次請求(RPM)和每分鐘 100 萬次操作(TPM),支援前綴補全、函式呼叫、快取、結構化輸出、批次處理及線上搜尋。
阿里雲白蓮已與 vLLM 開源社群合作,確保在中國及國際地區(包括北京、新加坡、美國、德國、日本和香港)廣泛部署。 該模型支援多輪對話、函式呼叫、線上搜尋、上下文快取及結構化輸出,max_tokens 上限約為 393,216。這使其成為企業將長文解析、客服知識庫、程式碼儲存庫問答以及多模態訂單評論遷移至統一介面的理想選擇。
產業分析師指出,將「大參數、小激發函數及強健快取」整合至 Qwen 生態系統中,能降低長上下文對話代理的試錯成本。對於小型團隊而言,低谷時段的優惠定價搭配靈活的 Token Plan 訂閱方案,可實現更敏捷的批次推論與快速原型驗證。
相關文章
GitHub Copilot 在數小時內整合 GPT-5.4
GitHub Copilot 再次證明了其快速響應能力。在 OpenAI 釋出最新旗艦模型 GPT-5.4 僅僅數小時後,GitHub 宣佈實現全面整合,為全球開發者提供由這項先進技術驅動的智慧編碼輔助。根據 GitHub 的說法,內部測試表明,GPT-5.4 在“代理式”軟體開發任務中表現出色,與上一代模型相比,任務成功率顯著提高。除了 Codex 系列在程式碼生成方面的專長外,該模型在複雜的多步邏輯推理中表現出更高的穩定性。GPT-5.4 在 Copilot 中的關鍵增強功能包括:多步任
Anthropic 在 IPO 中領先,AI 行業進入萬億美元收入新時代
全球人工智慧領域再迎重大里程碑。最新市場資料顯示,AI初創公司Anthropic已於6月1日提交了保密IPO申請。若獲批准,Anthropic有望成為AI實驗室領域規模最大的上市公司。行業估算表明,Anthropic預計在今年第三季度實現超過10億美元利潤。Anthropic與OpenAI的年度經常性收入(ARR)合計已接近1000億美元。隨著OpenAI將IPO推遲至2027年,Anthropic憑藉Claude Code在軟體開發方面的卓越表現,已確立了早期的B2B優勢,推動了顯著的貨幣化進
如何最佳化針對日本谷歌和日本雅虎的SEO?
城市互聯時代已然到來,但其面貌卻顯得平平無奇最有用的物聯網基礎設施往往並不具備未來感。它看起來就像一個知道何時裝滿的垃圾桶,一輛在故障發生前報告引擎問題的貨車,一個告訴駕駛員哪裡有空位的停車位,或者一個無需技術人員上門即可記錄用電量的電錶。變化並非在於每個物體都變得智慧,而在於物理資產現在可以被量化、互聯,並且能夠大規模地更易於管理。這一區別對企業、市政當局、公用事業公司和交通運營商至關重要。感測器本身只是一個微小的元件。價值來自於裝置、網路、平臺以及運營團隊的協同工作。垃圾桶檢測填充水平,
相關專題推薦
評論 (0)
0/500
DeepSeek-V4.1-Flash 現已於 Qwen AI 平台正式上線,提供 API 存取功能及彈性的代幣方案。 開發者可透過標準 API 將此模型無縫整合至其工作流程中,或直接在 Qoder、Qwen APP 及 Codex 等工具內運用代幣方案,以進行程式編寫、文件編寫、視覺分析及代理驅動任務。

這款被譽為 DeepSeek 新型輕量級旗艦模型,採用 MoE 架構,總參數達 5520 億。其採用「因果編碼器-解碼器」非對稱結構,輸入階段僅激活約 80 億參數,輸出階段則激活約 160 億參數。 該模型原生支援文字與圖像理解,可處理長達 100 萬個標記的上下文視窗,並產生約 39.3 萬個標記的輸出。官方基準測試顯示,其在代理程式與程式碼執行效能方面均有顯著提升,儘管激活成本降低,仍能提供高吞吐量與低延遲。
成本效益是其一大亮點。先進的快取壓縮技術將 KV 快取 HBM 需求降低至前代產品的 25%,SSD 儲存需求則降至 12.5%,從而針對長上下文與多輪互動優化資源配置。 Qwen 平台採分級定價:非尖峰時段輸入費用為每百萬個標記 1 人民幣(尖峰時段為 2 人民幣),輸出費用則為每百萬個標記 4 人民幣(尖峰時段為 8 人民幣)。 速率限制分別為每分鐘 15,000 次請求(RPM)和每分鐘 100 萬次操作(TPM),支援前綴補全、函式呼叫、快取、結構化輸出、批次處理及線上搜尋。
阿里雲白蓮已與 vLLM 開源社群合作,確保在中國及國際地區(包括北京、新加坡、美國、德國、日本和香港)廣泛部署。 該模型支援多輪對話、函式呼叫、線上搜尋、上下文快取及結構化輸出,max_tokens 上限約為 393,216。這使其成為企業將長文解析、客服知識庫、程式碼儲存庫問答以及多模態訂單評論遷移至統一介面的理想選擇。
產業分析師指出,將「大參數、小激發函數及強健快取」整合至 Qwen 生態系統中,能降低長上下文對話代理的試錯成本。對於小型團隊而言,低谷時段的優惠定價搭配靈活的 Token Plan 訂閱方案,可實現更敏捷的批次推論與快速原型驗證。
GitHub Copilot 在數小時內整合 GPT-5.4
GitHub Copilot 再次證明了其快速響應能力。在 OpenAI 釋出最新旗艦模型 GPT-5.4 僅僅數小時後,GitHub 宣佈實現全面整合,為全球開發者提供由這項先進技術驅動的智慧編碼輔助。根據 GitHub 的說法,內部測試表明,GPT-5.4 在“代理式”軟體開發任務中表現出色,與上一代模型相比,任務成功率顯著提高。除了 Codex 系列在程式碼生成方面的專長外,該模型在複雜的多步邏輯推理中表現出更高的穩定性。GPT-5.4 在 Copilot 中的關鍵增強功能包括:多步任
Anthropic 在 IPO 中領先,AI 行業進入萬億美元收入新時代
全球人工智慧領域再迎重大里程碑。最新市場資料顯示,AI初創公司Anthropic已於6月1日提交了保密IPO申請。若獲批准,Anthropic有望成為AI實驗室領域規模最大的上市公司。行業估算表明,Anthropic預計在今年第三季度實現超過10億美元利潤。Anthropic與OpenAI的年度經常性收入(ARR)合計已接近1000億美元。隨著OpenAI將IPO推遲至2027年,Anthropic憑藉Claude Code在軟體開發方面的卓越表現,已確立了早期的B2B優勢,推動了顯著的貨幣化進





首頁






