螞蟻集團推出 F2LLM-v2:一款多語言全規模嵌入式模型
克服語義表徵中的「英語中心」限制,已成為大型語言模型演進過程中的關鍵前沿。
3月26日,螞蟻集團與 上海交通大學 組成的CodeFuse團隊正式發布了F2LLM-v2系列嵌入式模型。該系列不僅在權威評測中取得領先表現,更透過完全開源的方式,為全球開發者提供了一套高效能且高效率的語義表示解決方案。

卓越表現:在 MTEB 取得 11 項 SOTA 成績
在評估嵌入模型的權威性 MTEB 基準測試中,F2LLM-v2展現了全面優勢:
11項榜首:在包括德語、法語、日語及程式碼檢索在內的11個語言與領域專用排行榜中均奪得第一名。
強勁的挑戰者:即使是其輕量級變體,也始終優於同等規模的知名業界模型。
廣泛涵蓋:評估涵蓋 430 項多元子任務,例如醫療問答與程式碼檢索,實現全場景覆蓋。

全面理解能力:精通 282 種自然語言及 40 多種程式語言
F2LLM-v2的強大實力源自其高度包容的訓練基礎:
多語言強化:針對中、低資源語言(如北歐及東南亞語系)提供更強大的支援,實現真正的全球語言覆蓋。
程式設計專長:對 Python、Java 和 Go 等 40 多種程式語言具備深度理解,是開發者建構 RAG(檢索增強生成)系統與程式碼助理的理想選擇。
高品質數據:建基於 6,000 萬筆經細緻清理的公開樣本,確保模型知識庫的純度與廣度。

極致效能:涵蓋 8,000 萬至 140 億參數的完整模型系列
為滿足從行動裝置到雲端運算的多元需求,CodeFuse 團隊開發了一套全面的模型矩陣:
行動裝置優化:參數介於 8000 萬至 3.3 億的緊湊型模型,運用「模型修剪」與「知識蒸餾」技術,確保在行動平台上流暢運作。
「嵌套式」創新:支援動態維度調整,讓使用者能靈活切換 8 維度與全維度模式,優化推論速度與儲存成本之間的權衡。
完全開源:透明度樹立新的社群標準
有別於許多「黑箱」模型,F2LLM-v2秉持完全開源的理念:
完整釋出:所有尺寸變體的模型權重均可下載。
詳盡透明度:發布了全面技術報告,公開完整的訓練方法論。
完全可重現性:所有程式碼與訓練檢查點均已釋出,賦予全球研究人員基於此成果進行進一步開發的能力。
結論:突破界限,探索 AI 的無限潛能
作為CodeFuse 開源系列的又一重要里程碑,F2LLM-v2的發布
相關文章
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
加州自動駕駛合規:罰單、地理圍欄與 100 萬英里的新時代
Guident 在南佛羅里達州營運一輛 AuveTech 接駁車,並運用其遠端監控技術,管理西棕櫚灘的一條四英里路線以及博卡拉頓的一條一英里路線。| 圖片來源:Guident加州正重新定義無人駕駛車輛的監管格局,從科技產業的「快速行動、打破常規」心態,轉向嚴格的問責制與嚴謹的行駛里程要求。Guident 執行董事長兼執行長哈羅德·布勞恩(Harold Braun)在《機器人報告》(The Robo
相關專題推薦
評論 (0)
0/500
克服語義表徵中的「英語中心」限制,已成為大型語言模型演進過程中的關鍵前沿。
3月26日,螞蟻集團與 上海交通大學 組成的CodeFuse團隊正式發布了F2LLM-v2系列嵌入式模型。該系列不僅在權威評測中取得領先表現,更透過完全開源的方式,為全球開發者提供了一套高效能且高效率的語義表示解決方案。

卓越表現:在 MTEB 取得 11 項 SOTA 成績
在評估嵌入模型的權威性 MTEB 基準測試中,F2LLM-v2展現了全面優勢:
11項榜首:在包括德語、法語、日語及程式碼檢索在內的11個語言與領域專用排行榜中均奪得第一名。
強勁的挑戰者:即使是其輕量級變體,也始終優於同等規模的知名業界模型。
廣泛涵蓋:評估涵蓋 430 項多元子任務,例如醫療問答與程式碼檢索,實現全場景覆蓋。

全面理解能力:精通 282 種自然語言及 40 多種程式語言
F2LLM-v2的強大實力源自其高度包容的訓練基礎:
多語言強化:針對中、低資源語言(如北歐及東南亞語系)提供更強大的支援,實現真正的全球語言覆蓋。
程式設計專長:對 Python、Java 和 Go 等 40 多種程式語言具備深度理解,是開發者建構 RAG(檢索增強生成)系統與程式碼助理的理想選擇。
高品質數據:建基於 6,000 萬筆經細緻清理的公開樣本,確保模型知識庫的純度與廣度。

極致效能:涵蓋 8,000 萬至 140 億參數的完整模型系列
為滿足從行動裝置到雲端運算的多元需求,CodeFuse 團隊開發了一套全面的模型矩陣:
行動裝置優化:參數介於 8000 萬至 3.3 億的緊湊型模型,運用「模型修剪」與「知識蒸餾」技術,確保在行動平台上流暢運作。
「嵌套式」創新:支援動態維度調整,讓使用者能靈活切換 8 維度與全維度模式,優化推論速度與儲存成本之間的權衡。
完全開源:透明度樹立新的社群標準
有別於許多「黑箱」模型,F2LLM-v2秉持完全開源的理念:
完整釋出:所有尺寸變體的模型權重均可下載。
詳盡透明度:發布了全面技術報告,公開完整的訓練方法論。
完全可重現性:所有程式碼與訓練檢查點均已釋出,賦予全球研究人員基於此成果進行進一步開發的能力。
結論:突破界限,探索 AI 的無限潛能
作為CodeFuse 開源系列的又一重要里程碑,F2LLM-v2的發布
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了





首頁






