選項
首頁
AL模型列表
DeepSeek-V3
模型參數數量
671B
模型參數數量
附屬組織
DeepSeek
附屬組織
開源
許可證類型
發佈時間
2024-12-26
發佈時間

模型簡介
DeepSeek-V3 的評估分數高於其他開源模型,例如 Qwen2.5-72B 和 Llama-3.1-405B,其表現與世界上頂尖的閉源模型如 GPT-4o 和 Claude-3.5-Sonnet 不相上下。
向左向右滑動以查看更多
語言理解能力 語言理解能力
語言理解能力
通常會做出語義錯誤的判斷,從而導致響應中明顯的邏輯斷開連接。
6.8
知識覆蓋範圍 知識覆蓋範圍
知識覆蓋範圍
擁有主流學科的核心知識,但對尖端跨學科領域的覆蓋範圍有限。
8.8
推理能力 推理能力
推理能力
無法維持連貫的推理鏈,通常會導致因果關係或錯誤估計。
6.7
相關模型
DeepSeek-V4-Flash DeepSeek-V4-Flash 是 DeepSeek 專為低延遲互動、高並發使用及日常智慧應用所設計的、以效率為導向的輕量級模型。
DeepSeek-V4-Pro DeepSeek-V4-Pro 是 DeepSeek 的旗艦級高效能模型,它在推理能力、程式設計能力、長文字處理能力以及整體任務處理效能方面都得到了進一步提升。
DeepSeek-V3.2 Deepseek V3系列模型的最新版本。
DeepSeek-V3.2-Exp Deepseek V3 系列機型的最新實驗版本。
DeepSeek-R1-0528 最新版本的 Deepseek R1。
相關文件
DeepSeek-V3揭曉:硬體感知AI設計如何降低成本並提升效能 DeepSeek-V3:AI發展的成本效益飛躍AI產業正處於十字路口。雖然大型語言模型(LLMs)日益強大,其運算需求卻急劇上升,使尖端AI開發對大多數組織而言成本過高。DeepSeek-V3透過證明智慧硬體-軟體協同設計—而非僅靠暴力擴展—能在成本僅為一小部分的情況下實現頂尖效能,挑戰此趨勢。僅在2,048 NVIDIA H800 GPUs上訓練,DeepSeek-V3利用多頭潛在注意力(MLA
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長 Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強
印度軟體巨頭縮減招聘,承諾隨著 AI 代理規模擴大不裁員 隨著人工智慧重塑傳統的勞動密集型商業模式,印度領先的軟體外包公司塔塔諮詢服務公司(TCS)公佈了其戰略應對措施。在週二的年度股東大會上,董事長概述了人機協作的願景,並澄清了公司在人工智慧時代的人力資源戰略。不裁員,但招聘將放緩TCS董事長明確表示,公司沒有因採用人工智慧而裁員的計劃,儘管整體招聘速度將放緩。雖然TCS此前減少了超過10,000名員工,但官員們強調,公司現在更傾向於透過自然流失來最佳化其人員結構,而非突然裁員。高層管理人員指出,以前由人類處理的重複性、機械性任務正不可避免地轉向
中國在全國高考期間鎖定人工智慧模型,以阻止即時作業輔導 隨著2026年高考臨近,關於考試期間暫停使用AI工具的謠言引發了激烈的網路爭論。針對公眾關切,各大AI平臺和教育應用澄清了立場:並非全面禁止,而是對考試相關功能實施有針對性的“限時鎖定”。這些平臺採用了精確的基於時間的控制機制。在官方考試時間內,如拍照解題和題目分析等功能將被暫時禁用。然而,日常對話功能和一般生活類查詢對使用者完全開放。這種有針對性的做法並非沒有先例。去年,幾個AI平臺在高考期間引入了類似的限制措施。業內人士指出,這些措施旨在符合監管標準,即禁止使用深度合成服務從事損害公共利益
調查顯示,一款經美國食品藥物管理局(FDA)核准的乳癌人工智慧診斷工具,其表現未達放射科醫師的預期 加州大學聖地牙哥分校健康中心的研究人員近期在《臨床影像》(Clinical Imaging)期刊上發表了一項研究,該研究針對美國乳房影像學會的 215 名會員進行了問卷調查。 研究結果顯示,用於乳癌檢測的人工智慧工具在臨床環境中的表現未達放射科醫師的預期。儘管近半數受訪者已每日使用經美國食品藥物管理局(FDA)核准的人工智慧診斷工具,且有 11% 計畫採用此類工具,但多數醫師僅將這些工具視為「第二
模型比較
開始比較
OR