GitHub意外洩露GPT-5.4,揭露OpenAI對抗「金魚記憶」的秘密武器
大型語言模型領域即將迎來「核級」更新。2026年3月2日,一次意外的程式碼提交令全球開發者社群陷入瘋狂。OpenAI工程師不慎將未發布的「GPT-5.4」模型納入公開Codex儲存庫的版本邏輯中,瞬間在科技界掀起「數位考古」熱潮。
儘管OpenAI隨即強制推送覆寫相關程式碼並更名為「gpt-5.3-codex」,但多方情報來源指出這絕非單純失誤。此舉實為一場戰略性的「世代躍遷」,旨在重塑產業競爭格局。

核心突破:200萬語境與「狀態化AI」
社交平台X流傳的alpha模型端點截圖與程式碼分析顯示,GPT-5.4的野心遠超以往任何增量更新:
突破「金魚記憶」限制:據稱新版將具備高達200萬個詞元的上下文窗口,更關鍵的是引入真正的狀態化AI能力。
認知連續性:不同於現行每次對話皆重置的會話模式,狀態化人工智慧能跨會話維持工作流程狀態、開發環境及工具調用歷史。此功能使其能如現實同事般記憶專案脈絡與編碼習慣。
視覺突破:原生位元組全解析度處理
外流的拉取請求明確提及針對「GPT-5.4或更高版本」的view_image優化功能:
像素級精準分析:此新能力使模型能繞過傳統影像壓縮機制,直接讀取原始位元組資料。
設計師的夢想:前端工程師可餵入精細的UI原型或複雜工程圖,實現真正的像素級辨識,徹底消除壓縮瑕疵造成的「嚴重失真」解讀。
產業觀點:從「聊天助理」邁向「數位員工」
產業分析師指出,OpenAI跳過(或淡化)5.3版本直接推出5.4的策略,實為針對Claude 4. 6與Gemini 3.1 Pro等競爭對手的戰略反擊:
代理優先架構:GPT-5.4的核心邏輯從追求基準測試分數轉向可靠執行**自主代理**工作流程。
硬體瓶頸:維持此類功能所需的龐大鍵值快取,對高頻寬記憶體(HBM)與運算互連技術構成極大挑戰,近期NVIDIA的波動現象即為明證。
相關文章
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長
Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強
相關專題推薦
評論 (2)
0/500
笑死,標題看到‘核級更新’還以為是什麼末日梗,結果是工程師手滑上傳程式碼😂 這種內部文件外洩事件也太多,OpenAI的資安真的沒問題嗎?不過這個’金魚記憶‘改進聽起來很實用啦,之前用GPT回答到一半突然忘記上下文真的有夠惱人,期待正式版釋出!
Sério? Tá difícil acreditar que um engenheiro cometeu um erro assim básico... Vazamentos sempre acontecem na indústria de tech, mas isso pareceu meio teatral demais. Será que foi realmente acidental? 🤔 Não sei, só espero que isso realmente ajude com a memória curta dos modelos, porque às vezes parece que o GPT-4 esquece o que eu disse três mensagens atrás! 😂
大型語言模型領域即將迎來「核級」更新。2026年3月2日,一次意外的程式碼提交令全球開發者社群陷入瘋狂。OpenAI工程師不慎將未發布的「GPT-5.4」模型納入公開Codex儲存庫的版本邏輯中,瞬間在科技界掀起「數位考古」熱潮。
儘管OpenAI隨即強制推送覆寫相關程式碼並更名為「gpt-5.3-codex」,但多方情報來源指出這絕非單純失誤。此舉實為一場戰略性的「世代躍遷」,旨在重塑產業競爭格局。

核心突破:200萬語境與「狀態化AI」
社交平台X流傳的alpha模型端點截圖與程式碼分析顯示,GPT-5.4的野心遠超以往任何增量更新:
突破「金魚記憶」限制:據稱新版將具備高達200萬個詞元的上下文窗口,更關鍵的是引入真正的狀態化AI能力。
認知連續性:不同於現行每次對話皆重置的會話模式,狀態化人工智慧能跨會話維持工作流程狀態、開發環境及工具調用歷史。此功能使其能如現實同事般記憶專案脈絡與編碼習慣。
視覺突破:原生位元組全解析度處理
外流的拉取請求明確提及針對「GPT-5.4或更高版本」的view_image優化功能:
像素級精準分析:此新能力使模型能繞過傳統影像壓縮機制,直接讀取原始位元組資料。
設計師的夢想:前端工程師可餵入精細的UI原型或複雜工程圖,實現真正的像素級辨識,徹底消除壓縮瑕疵造成的「嚴重失真」解讀。
產業觀點:從「聊天助理」邁向「數位員工」
產業分析師指出,OpenAI跳過(或淡化)5.3版本直接推出5.4的策略,實為針對Claude 4. 6與Gemini 3.1 Pro等競爭對手的戰略反擊:
代理優先架構:GPT-5.4的核心邏輯從追求基準測試分數轉向可靠執行**自主代理**工作流程。
硬體瓶頸:維持此類功能所需的龐大鍵值快取,對高頻寬記憶體(HBM)與運算互連技術構成極大挑戰,近期NVIDIA的波動現象即為明證。
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長
Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強
笑死,標題看到‘核級更新’還以為是什麼末日梗,結果是工程師手滑上傳程式碼😂 這種內部文件外洩事件也太多,OpenAI的資安真的沒問題嗎?不過這個’金魚記憶‘改進聽起來很實用啦,之前用GPT回答到一半突然忘記上下文真的有夠惱人,期待正式版釋出!
Sério? Tá difícil acreditar que um engenheiro cometeu um erro assim básico... Vazamentos sempre acontecem na indústria de tech, mas isso pareceu meio teatral demais. Será que foi realmente acidental? 🤔 Não sei, só espero que isso realmente ajude com a memória curta dos modelos, porque às vezes parece que o GPT-4 esquece o que eu disse três mensagens atrás! 😂





首頁






