阿里巴巴的 Qwen 3.5 推出適用於消費級 GPU 的精簡版模型
同益實驗室(Tongyi Lab)正式推出 Qwen3.5 系列的最新小型模型,這代表著新一代的大型語言模型。本次發布包含四種版本,參數規模分別為 0.8B、2B、4B 和 9B。這些模型旨在透過卓越的效能優化,降低人工智慧應用的門檻,使其能夠以經濟實惠且高效的方式,部署於從邊緣裝置到專業應用等各類場景。

整個系列均基於統一的 Qwen3.5 架構打造。與側重龐大參數規模的大型模型不同,這些精簡版本強調「輕量級」與「高度適應性」。 0.8B 和 2B 模型專為邊緣裝置量身打造,能在智慧型手機和嵌入式硬體等平台上實現極致效能與毫秒級響應時間。4B 版本則以其多模態能力脫穎而出,是開發輕量級 AI 代理程式的絕佳選擇。儘管體積精巧,9B 模型仍能提供媲美大型模型的效能,並具備處理複雜邏輯推理的能力。

為進一步支持開發者社群,Tongyi Lab 已將此系列模型以 Apache 2.0 授權釋出,使其成為開源且可免費用於商業用途。這讓開發者能自由對模型進行 LoRA 或完整微調,並能利用常見的消費級 GPU 開始進行特定任務的調整。此方法顯著縮短了個人開發者及中小型企業進行概念驗證與建構專用應用程式的時間與成本。

相關文章
蘋果智慧眼鏡或將在WWDC27上首次亮相,重點突出隱私保護
彭博社的馬克·古爾曼報道,蘋果智慧眼鏡(內部代號 N50)計劃於 2027 年 6 月的全球開發者大會(WWDC27)上首次亮相,零售版預計將於 2027 年秋季上市。該裝置原定於今年晚些時候及 2027 年初發布,但現已推遲,以便進行進一步的產品完善並加強隱私保護協議。隱私仍是蘋果智慧眼鏡戰略的核心支柱。從 Meta 等競爭對手的隱私爭議中吸取教訓,蘋果正在實施強有力的功能與政策。目前考慮的方案包括:完全移除攝像頭,專注於人工智慧互動、音訊播放和通話;或保留攝像頭但禁用照片和影片錄製功能,僅
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
相關專題推薦
評論 (1)
0/500
Wait, so Qwen3.5 is coming with tiny models that fit on consumer GPUs? That's actually huge for people like me who don't have a server farm in their basement. 0.8B to 9B parameters – I'm curious how much performance they sacrifice for size. Is it going to run smoothly on a 3060? 🤔 Also, Tongyi Lab is really pushing the trend of small but capable models, kinda like the iPhone of LLMs – compact but powerful. Let's see if they can beat the open-source competition.
同益實驗室(Tongyi Lab)正式推出 Qwen3.5 系列的最新小型模型,這代表著新一代的大型語言模型。本次發布包含四種版本,參數規模分別為 0.8B、2B、4B 和 9B。這些模型旨在透過卓越的效能優化,降低人工智慧應用的門檻,使其能夠以經濟實惠且高效的方式,部署於從邊緣裝置到專業應用等各類場景。

整個系列均基於統一的 Qwen3.5 架構打造。與側重龐大參數規模的大型模型不同,這些精簡版本強調「輕量級」與「高度適應性」。 0.8B 和 2B 模型專為邊緣裝置量身打造,能在智慧型手機和嵌入式硬體等平台上實現極致效能與毫秒級響應時間。4B 版本則以其多模態能力脫穎而出,是開發輕量級 AI 代理程式的絕佳選擇。儘管體積精巧,9B 模型仍能提供媲美大型模型的效能,並具備處理複雜邏輯推理的能力。

為進一步支持開發者社群,Tongyi Lab 已將此系列模型以 Apache 2.0 授權釋出,使其成為開源且可免費用於商業用途。這讓開發者能自由對模型進行 LoRA 或完整微調,並能利用常見的消費級 GPU 開始進行特定任務的調整。此方法顯著縮短了個人開發者及中小型企業進行概念驗證與建構專用應用程式的時間與成本。

蘋果智慧眼鏡或將在WWDC27上首次亮相,重點突出隱私保護
彭博社的馬克·古爾曼報道,蘋果智慧眼鏡(內部代號 N50)計劃於 2027 年 6 月的全球開發者大會(WWDC27)上首次亮相,零售版預計將於 2027 年秋季上市。該裝置原定於今年晚些時候及 2027 年初發布,但現已推遲,以便進行進一步的產品完善並加強隱私保護協議。隱私仍是蘋果智慧眼鏡戰略的核心支柱。從 Meta 等競爭對手的隱私爭議中吸取教訓,蘋果正在實施強有力的功能與政策。目前考慮的方案包括:完全移除攝像頭,專注於人工智慧互動、音訊播放和通話;或保留攝像頭但禁用照片和影片錄製功能,僅
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
Wait, so Qwen3.5 is coming with tiny models that fit on consumer GPUs? That's actually huge for people like me who don't have a server farm in their basement. 0.8B to 9B parameters – I'm curious how much performance they sacrifice for size. Is it going to run smoothly on a 3060? 🤔 Also, Tongyi Lab is really pushing the trend of small but capable models, kinda like the iPhone of LLMs – compact but powerful. Let's see if they can beat the open-source competition.





首頁






