xAI 推出 Grok 4.20,具備強化推理能力與創紀錄的幻覺控制能力
2026年3月12日,xAI 正式發布其新一代大型語言模型Grok 4.20 Beta, 該模型在保持具競爭力的定價的同時,為卓越的事實可靠性樹立了新的產業標準。
根據Artificial Analysis 的最新評估,Grok 4.20 在推理任務中獲得了 48 分的智慧指數,較前一代產品提升了 6 分。 儘管在整體基準測試表現上仍落後於Gemini 3.1 Pro Preview 和GPT-5.4 (兩者均獲得 57 分),但其在 AA Omniscient 測試中的表現卻十分出色,非幻覺率高達 78%。這有效解決了 AI 模型產生虛假資訊的常見問題。

在產品陣容與技術規格方面,xAI 同步推出了三種 API 版本:分別具備推理能力、不具備推理能力,以及專為多代理運作設計的版本。 該模型支援長達 200 萬個標記的上下文視窗,並採用極具競爭力的定價策略,每百萬個標記的費用介於 2 至 6 美元之間——遠低於之前的 Grok 4。技術上,Grok 4.20 在面對陌生領域時展現出強烈的克制力,顯著增加了其承認「我不知道」的傾向,錯誤率約為五分之一。

大型 AI 模型的全球競爭,現已從純粹聚焦於規模,演變為推理深度與事實精準度的雙重角逐。 Grok 4.20 的推出,彰顯了 xAI 在追求通用人工智慧(AGI)的過程中,透過優先考量「誠實」與「低幻覺率」來建立獨特競爭優勢的策略。這種對事實可靠性的極致堅持,不僅提升了 AI 在嚴謹產業中的實用價值,更為未來多代理系統中的資訊完整性奠定了更值得信賴的基礎。
相關文章
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長
Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強
相關專題推薦
評論 (1)
0/500
2026年3月12日,xAI 正式發布其新一代大型語言模型
根據

在產品陣容與技術規格方面,xAI 同步推出了三種 API 版本:分別具備推理能力、不具備推理能力,以及專為多代理運作設計的版本。 該模型支援長達 200 萬個標記的上下文視窗,並採用極具競爭力的定價策略,每百萬個標記的費用介於 2 至 6 美元之間——遠低於之前的 Grok 4。技術上,Grok 4.20 在面對陌生領域時展現出強烈的克制力,顯著增加了其承認「我不知道」的傾向,錯誤率約為五分之一。

大型 AI 模型的全球競爭,現已從純粹聚焦於規模,演變為推理深度與事實精準度的雙重角逐。 Grok 4.20 的推出,彰顯了 xAI 在追求通用人工智慧(AGI)的過程中,透過優先考量「誠實」與「低幻覺率」來建立獨特競爭優勢的策略。這種對事實可靠性的極致堅持,不僅提升了 AI 在嚴謹產業中的實用價值,更為未來多代理系統中的資訊完整性奠定了更值得信賴的基礎。
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長
Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強





首頁






