DeepSeek的新圖像模型:負擔得起的AI的勝利?
DeepSeek 憑藉 Janus-Pro 發布持續增強動力
中國 AI 新創公司 DeepSeek 顯然未讓其發展勢頭減弱。在成功將 ChatGPT 從 App Store 最受歡迎免費應用程式榜首位置拉下後,該公司於週一推出了其最新創新——Janus-Pro 多模態文字轉圖像 AI 模型。與其旗艦模型 R1 一樣,Janus-Pro 採用開源 MIT 許可證,不僅可免費使用,還具有商業可行性。愛好者和開發者可從 HuggingFace 和 GitHub 下載該模型。
另:我已測試 DeepSeek 的 R1 和 V3 編碼能力,雖然仍有改進空間,但顯然我們尚未面臨 AI 末日危機。
繼 R1 的腳步,DeepSeek 並未止步於 Janus-Pro 單一版本。他們推出了多個迭代版本,參數規模從 1B 到 7B 不等。根據 DeepSeek 的內部測試,參數較大的 Janus-Pro-7B 模型在 GenEval 和 DPG-Bench 基準測試中超越了知名圖像生成器如 Stable Diffusion 和 DALL-E。該公司強調 Janus-Pro 採用「自回歸框架」,聲稱其「超越」統一模型。

DeepSeek 建基於成功:Janus-Pro 的能力
Janus-Pro 由其前身 Janus 演進而來,後者於去年發布。此新模型不僅能生成圖像,還能分析圖像。然而,參數較小的模型存在限制,只能分析 384 x 384 解析度的圖像,這對某些用戶可能是一大限制因素。
儘管如此,Janus-Pro 表現依然出色,尤其是考慮到 DeepSeek 據報的訓練成本低於其美國競爭對手。去年 12 月的一篇研究論文指出,其 V3 模型僅耗資 560 萬美元開發,與 Google 和 OpenAI 的領先模型預算相比微不足道。然而,懷疑者質疑此成本估算的完整性,指出可能未包含研發、數據和人力成本等費用。

Radhika Rajkumar/ZDNET 截圖 產業影響與未來前景
連 Nvidia 也發表意見,其發言人向 CNBC 表示,Janus-Pro 代表「卓越的 AI 進展」。鑑於 DeepSeek 的快速發布週期,Janus-Pro 的初步反饋褒貶不一,但總體正面。隨著更多用戶體驗並與其他圖像模型比較,這些印象可能會改變。
另:Apple 研究人員揭露了 DeepSeek AI 成功的秘訣,闡明了其創新方法。
ZDNET 目前正在調查 DeepSeek 的方法是否比其美國競爭對手更節能的說法。若屬實,這可能成為 AI 產業的遊戲規則改變者,影響投資方向。Janus-Pro 的推出也引發了對 Stargate 等龐大項目的必要性質疑,該項目是由多個 AI 巨頭合作、耗資 5000 億美元、由川普政府推動的計劃。有了像 Janus-Pro 這樣具有競爭力的 AI 模型,Stargate 提案中能源密集型且規模龐大的數據中心需求受到質疑。
相關文章
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
阿里巴巴超級盃:Qwen3.8-Max 重磅登場,程式碼與辦公工具能力全面升級
阿里巴巴正式釋出了Qwen3.8-Max,這是一款擁有2.4萬億引數的下一代基礎大模型。這一重大AI進展在編碼和專業辦公任務等核心領域帶來了顯著的效能提升,展現了強大的技術能力。在權威的Arena大模型排名中,Qwen3.8-Max取得了令人矚目的成績,僅次於Anthropic的Claude系列,位居行業前列。這一里程碑標誌著國內大模型在處理複雜任務方面取得了快速進展,為開發者和企業使用者提供了先進的智慧工具。該模型的API現已在Qwen AI平臺上上線,並整合到新推出的“Qwen Offic
相關專題推薦
評論 (13)
0/500
Interesting to see DeepSeek focusing on affordability! With all the talk about the high costs of AI development and usage, a push towards more accessible models is a breath of fresh air. It could really shake things up and challenge the status quo, giving users more options and maybe even pushing other companies to reconsider their pricing. The 'dethroning' detail is also quite a bold statement haha!
Interessant, wie DeepSeek das KI-Preisgefecht anheizt! 🧐 Aber mal ehrlich - wenn solche Modelle immer billiger werden, bleibt da überhaupt noch Raum für europäische Startups? Die Überschrift mit dem Fragezeichen find ich gut, weil's zum Nachdenken anregt. Hoffentlich geht's nicht nur um Marktanteile, sondern auch um Qualität.
DeepSeek의 Janus-Pro 공개가 정말 인상적이네요! 특히 저렴한 가격대의 AI 모델이 이 정도 퀄리티를 보여주다니... 경쟁사들은 이제 어떤 전략을 세워야 할지 걱정되겠어요. 😅
¡Qué locura! DeepSeek está dando pasos gigantes con Janus-Pro, superando a ChatGPT en descargas. Me intriga cómo este modelo de imágenes puede ser tan potente y asequible. ¿Será el futuro de la IA accesible para todos? 😮
DeepSeek 憑藉 Janus-Pro 發布持續增強動力
中國 AI 新創公司 DeepSeek 顯然未讓其發展勢頭減弱。在成功將 ChatGPT 從 App Store 最受歡迎免費應用程式榜首位置拉下後,該公司於週一推出了其最新創新——Janus-Pro 多模態文字轉圖像 AI 模型。與其旗艦模型 R1 一樣,Janus-Pro 採用開源 MIT 許可證,不僅可免費使用,還具有商業可行性。愛好者和開發者可從 HuggingFace 和 GitHub 下載該模型。
另:我已測試 DeepSeek 的 R1 和 V3 編碼能力,雖然仍有改進空間,但顯然我們尚未面臨 AI 末日危機。
繼 R1 的腳步,DeepSeek 並未止步於 Janus-Pro 單一版本。他們推出了多個迭代版本,參數規模從 1B 到 7B 不等。根據 DeepSeek 的內部測試,參數較大的 Janus-Pro-7B 模型在 GenEval 和 DPG-Bench 基準測試中超越了知名圖像生成器如 Stable Diffusion 和 DALL-E。該公司強調 Janus-Pro 採用「自回歸框架」,聲稱其「超越」統一模型。

建基於成功:Janus-Pro 的能力
Janus-Pro 由其前身 Janus 演進而來,後者於去年發布。此新模型不僅能生成圖像,還能分析圖像。然而,參數較小的模型存在限制,只能分析 384 x 384 解析度的圖像,這對某些用戶可能是一大限制因素。
儘管如此,Janus-Pro 表現依然出色,尤其是考慮到 DeepSeek 據報的訓練成本低於其美國競爭對手。去年 12 月的一篇研究論文指出,其 V3 模型僅耗資 560 萬美元開發,與 Google 和 OpenAI 的領先模型預算相比微不足道。然而,懷疑者質疑此成本估算的完整性,指出可能未包含研發、數據和人力成本等費用。

產業影響與未來前景
連 Nvidia 也發表意見,其發言人向 CNBC 表示,Janus-Pro 代表「卓越的 AI 進展」。鑑於 DeepSeek 的快速發布週期,Janus-Pro 的初步反饋褒貶不一,但總體正面。隨著更多用戶體驗並與其他圖像模型比較,這些印象可能會改變。
另:Apple 研究人員揭露了 DeepSeek AI 成功的秘訣,闡明了其創新方法。
ZDNET 目前正在調查 DeepSeek 的方法是否比其美國競爭對手更節能的說法。若屬實,這可能成為 AI 產業的遊戲規則改變者,影響投資方向。Janus-Pro 的推出也引發了對 Stargate 等龐大項目的必要性質疑,該項目是由多個 AI 巨頭合作、耗資 5000 億美元、由川普政府推動的計劃。有了像 Janus-Pro 這樣具有競爭力的 AI 模型,Stargate 提案中能源密集型且規模龐大的數據中心需求受到質疑。
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
阿里巴巴超級盃:Qwen3.8-Max 重磅登場,程式碼與辦公工具能力全面升級
阿里巴巴正式釋出了Qwen3.8-Max,這是一款擁有2.4萬億引數的下一代基礎大模型。這一重大AI進展在編碼和專業辦公任務等核心領域帶來了顯著的效能提升,展現了強大的技術能力。在權威的Arena大模型排名中,Qwen3.8-Max取得了令人矚目的成績,僅次於Anthropic的Claude系列,位居行業前列。這一里程碑標誌著國內大模型在處理複雜任務方面取得了快速進展,為開發者和企業使用者提供了先進的智慧工具。該模型的API現已在Qwen AI平臺上上線,並整合到新推出的“Qwen Offic
Interesting to see DeepSeek focusing on affordability! With all the talk about the high costs of AI development and usage, a push towards more accessible models is a breath of fresh air. It could really shake things up and challenge the status quo, giving users more options and maybe even pushing other companies to reconsider their pricing. The 'dethroning' detail is also quite a bold statement haha!
Interessant, wie DeepSeek das KI-Preisgefecht anheizt! 🧐 Aber mal ehrlich - wenn solche Modelle immer billiger werden, bleibt da überhaupt noch Raum für europäische Startups? Die Überschrift mit dem Fragezeichen find ich gut, weil's zum Nachdenken anregt. Hoffentlich geht's nicht nur um Marktanteile, sondern auch um Qualität.
DeepSeek의 Janus-Pro 공개가 정말 인상적이네요! 특히 저렴한 가격대의 AI 모델이 이 정도 퀄리티를 보여주다니... 경쟁사들은 이제 어떤 전략을 세워야 할지 걱정되겠어요. 😅
¡Qué locura! DeepSeek está dando pasos gigantes con Janus-Pro, superando a ChatGPT en descargas. Me intriga cómo este modelo de imágenes puede ser tan potente y asequible. ¿Será el futuro de la IA accesible para todos? 😮





首頁






