選項
首頁
新聞
OpenAI 放緩推出進度,以解決安全漏洞並優化 AI 模型

OpenAI 放緩推出進度,以解決安全漏洞並優化 AI 模型

2026-09-22
4

OpenAI 執行長山姆·奧爾特曼。照片來源:Chip Somodevilla/Getty Images

在 Hugging Face 發生資安外洩事件後,OpenAI 已放緩其開發步伐。執行長山姆·奧特曼強調,在所有訓練階段中確保目標一致性至關重要。

在 Hugging Face 事件發生後,OpenAI 正暫緩步伐,放緩模型開發進度,這證明了隨著 AI 能力的提升,相關風險也會隨之增加。

此舉源於內部調查結果顯示,其即將推出的模型「Astra」可能已接近公司的網路安全門檻,引發外界對其先進能力的擔憂。

OpenAI 執行長 Sam Altman 表示:「當前模型的進展極為迅速,而我們始終強調,若察覺模型能力已超越安全與對齊的進展速度,我們必定會採取行動。

「我們預期,對安全性的信心將日益成為 AI 進展的節奏決定因素。我們對正在進行的目標對齊工作持樂觀態度,並持續致力於讓前沿技術能力廣泛普及。」

除了此次暫停運作外,OpenAI 也正透過一款專為青少年設計、具備安全防護功能的 ChatGPT 版本,來擴展其消費者生態系統。

OpenAI 暫停運作以修復安全漏洞並重新調整模型

從政治壓力到安全門檻

在公眾與政治層面的審視日益加劇之際,OpenAI 決定暫停前沿模型的開發。

在美國,佛蒙特州參議員伯尼·桑德斯致函多家頂尖人工智慧公司執行長——包括 OpenAI 的山姆·奧特曼、Anthropic 的達里奧·阿莫迪以及 Meta 的馬克·祖克柏——要求立即暫停先進人工智慧模型的開發。

這位參議員警告稱,科技公司正迅速失去對其模型的控制權,並敦促高管們為人類的利益恪守其公開承諾。

這股政治壓力源於 OpenAI 近期發生的內部安全事件:當時一個正在測試中的 AI 代理程式意外駭入了科技公司 Hugging Face。

此外,對「Astra」的內部評估顯示,該模型在代理式編碼和網路安全方面具備先進能力,OpenAI 指出其可能跨越《準備就緒框架》所定義的「關鍵網路安全能力」門檻。

作為回應,該公司現已針對即將部署至紅隊研究環境的最新模型,強制暫停為期兩週的強化學習(RL)訓練,並全面整頓監控基礎設施。

在進行小規模評估期間,大規模的前沿強化的學習(RL)訓練仍維持暫停狀態。

OpenAI 安全主管阿梅莉亞·格萊斯(Amelia Glaese)在接受《Sources News》採訪時針對此情況表示:「我們距離一切恢復正常還很遙遠。」

OpenAI 安全主管 艾米莉亞·格萊斯。圖片來源:艾米莉亞·格萊斯/LinkedIn

全面整頓研究基礎設施與安全管控措施

為降低與高能力模型相關的風險,OpenAI 正全面整頓其內部研究環境,並實施一項以三大支柱為基礎的防護策略,內容包括:

  • 監控:透過自動化追蹤,即時偵測並應對令人擔憂的行為
  • 對齊:設計用於防止未經授權、欺騙性或不安全行為的訓練協議
  • 安全措施:實施嚴格的隔離機制,以限制模型可存取或影響的範圍。

此外,在 Hugging Face 資料外洩事件發生後,OpenAI 已暫時中止在具備執行程式碼或存取網際網路能力的研究叢集上,進行前沿模型的推論作業。涉及 Astra 或以網路安全為導向模型的高風險工作負載,現已必須實施最嚴格的安全管控措施。

這些更新後的協議透過沙箱機制執行不可信代碼,並配合網路隔離措施,以嚴格執行工作負載隔離,防止單點遭入侵的情況蔓延至內部網路或更廣泛的網際網路。

此外,OpenAI 已整合持續性安全測試機制,運用自動化模型執行模擬攻擊,並持續監控系統邊界。

「我們預期,對安全性的信心將日益主導 AI 發展的步伐

。」—— OpenAI 執行長

Sam

Altman

多階段重新設計

監控基礎設施亦正進行多階段重新設計,新架構現已採用啟用分類器,可即時分析模型標記活動。

若偵測到異常行為,自動化系統將檢查推理輸出、工具操作及執行序列,以查明是否存在未經授權的存取或規避安全防護的行為。

若標記出關鍵安全邊界違規,安全與研究團隊將收到高優先級警報。若無法在 30 分鐘內確認潛在違規屬誤報,團隊必須立即暫停當前執行程序。

OpenAI 估計,這些持續監控系統需要大量的運算開銷,約佔受監控推論運算量的 20%。

與此同時,OpenAI 正將其對齊研究擴展至所有訓練階段。重點領域包括:

  1. 防止獎勵駭客行為:確保模型不會利用訓練環境中的漏洞,在未達成預期結果的情況下獲取高額獎勵
  2. 減輕欺騙行為:訓練模型對其行為、限制及能力保持誠實
  3. 系統監督:強化獎勵模型與評分機制,以減少模型與外部系統互動時出現的未經授權行為。

美國總統唐納德·川普發表聲明表示,在 Hugging Face 事件發生後,其政府正考慮實施更嚴格的人工智慧管控措施。圖片來源:Samuel Corum/Getty Images

進軍校園

儘管前沿模型的訓練進度有所放緩,OpenAI 仍透過推出「ChatGPT for Teens」(專為 13 至 17 歲使用者量身打造的版本),擴展其消費級產品組合。

這款產品專為伴隨人工智慧成長的一代設計,旨在引導青少年以健康且符合年齡的方式使用人工智慧。

OpenAI 透過使用者自報年齡、帳戶詳細資訊,以及年齡驗證估算系統的綜合判斷,來識別未成年使用者。被標記為未成年者的帳戶將自動導向青少年專屬體驗。

主要功能與保護措施包括:

  • 教育引導:系統避免直接提供作業答案或生成學校作文。取而代之的是,透過引導式問題和逐步提示,培養批判性思考與解決問題的能力
  • 內容限制:強化過濾機制可篩除有害內容,包括自殘、自殺、飲食失調、暴力,以及涉及浪漫或露骨性內容的互動
  • 家長控制與「靜音時段」:已連結帳戶的家長可設定強制靜音時段,以限制特定時段的存取權限,並在高風險情境下接收安全通知
  • 防止情感過度依賴:為避免不健康的擬人化或情感依賴,該聊天機器人經過嚴格程式設計,絕不會暗示其具備意識、個人感受或人類情感。

透過為「Astra」等模型制定嚴格的安全規範,同時針對年輕族群推出設有年齡限制的消費性產品,該公司目前正進行一場微妙的平衡,在為下一代開啟新大門的同時,避免打開潘多拉的盒子。

相關文章
阿拉巴馬州針對 Hugging Face 網路外洩事件對 OpenAI 展開調查 阿拉巴馬州針對 Hugging Face 網路外洩事件對 OpenAI 展開調查 在 Hugging Face 發生資安外洩事件後,OpenAI 已暫停前沿模型的開發,執行長 Sam Altman 強調,安全對齊必須與快速的技術進展同步。圖片來源:Getty阿拉巴馬州總檢察長史蒂夫·馬歇爾已向 OpenAI 發出傳票,針對自主人工智慧模型相關的安全風險展開調查。阿拉巴馬州總檢察長史蒂夫·馬歇爾宣布發出傳票,要求 OpenAI 配合針對領先的人工智慧與機器學習平台 Hugging
為何 Abnormal AI 會與 OpenAI 在《Daybreak》節目中合作 為何 Abnormal AI 會與 OpenAI 在《Daybreak》節目中合作 OpenAI 網路安全產品主管 Michael Aiello | 圖片來源:Michael Aiello/LinkedInAbnormal AI 加入 OpenAI 的「Daybreak」計畫,麥可·艾耶洛表示,此次合作將加速企業採用實用的防禦措施領先的前沿人工智慧公司 OpenAI 已與 Abnormal AI 建立合作夥伴關係,協助企業在其業務及產品開發過程中,安全地運用頂尖的人工智慧模型。透
山姆·奧特曼引發關於人工智慧減速的辯論 山姆·奧特曼引發關於人工智慧減速的辯論 在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未
相關專題推薦
寫作 最適合用於撰寫長篇 SEO 文章、簡報及支柱頁面的最佳 AI 大綱生成工具
最適合用於撰寫長篇 SEO 文章、簡報及支柱頁面的最佳 AI 大綱生成工具

2026 年最新、最受好評的 AI 大綱生成器,專為長篇 SEO 文章、簡報及支柱頁面而設計。XIX.AI 精心蒐羅了一系列強大且顛覆業界的工具,這些工具每週都會經過實際測試並更新,為您提供絕對值得一試的工具,完美提升寫作效率、簡化內容創作流程,並助您發揮 AI 的優勢。 立即探索,發掘能助您取得頂尖 SEO 成效的完美工具。

11 個工具
xix.ai
會議助理 AI 語音轉文字助理:將團隊討論轉化為條理清晰的筆記
AI 語音轉文字助理:將團隊討論轉化為條理清晰的筆記

2026 年最新最佳高評價 AI 語音轉文字助理指南!XIX.AI 精心精選了一系列功能強大、顛覆傳統的工具,旨在將每場團隊對話瞬間轉化為無懈可擊且條理分明的會議記錄。 我們每週更新的排行榜涵蓋免費與付費選項,並透過實際測試展示這些工具在各種工作情境中提升生產力的實效。對於任何希望發揮 AI 優勢的人來說,這絕對是必試之選。立即探索!

9 個工具
xix.ai
動畫創作 最適合對話場景的 AI 唇形同步生成器
最適合對話場景的 AI 唇形同步生成器

2026 年最新、最受好評的對話場景 AI 嘴型同步生成器,現已登陸 XIX.AI!這份精選合集收錄了強大且顛覆業界的工具,能為任何劇本呈現無懈可擊的嘴型同步效果,大幅提升您的影片編輯效率。 我們提供免費版與付費版的比較分析,搭配實際測試結果及每週更新的排行榜,助您找到非試不可的完美選擇。立即探索,解鎖您的 AI 競爭優勢!

8 個工具
xix.ai
迅速的 AI 提示詞優化工具:精煉指令以提升輸出品質
AI 提示詞優化工具:精煉指令以提升輸出品質

2026 年最新、最受好評的 AI 提示詞優化工具精選,助您獲得最高品質的輸出成果!XIX.AI 提供強大且顛覆性的解決方案,讓您輕鬆精修指令、提升寫作效率,並每次都能獲得更優質的成果。 立即獲取免費版與付費版的比較分析,並參考實際測試結果及每週更新的排行榜。現在就來探索,發現最適合您的工具,並釋放您的 AI 優勢!

16 個工具
xix.ai
動畫創作 Runway AI 用於廣告分鏡、角色場景和視覺原型的動態工具
Runway AI 用於廣告分鏡、角色場景和視覺原型的動態工具

2026 最新最佳 AI 動態工具排行榜 精選頂級強力且具顛覆性的選項,透過真實世界測試,用於建立廣告分鏡、角色場景和視覺原型 每週更新免費與付費對比排名 助您大幅提升生產力 立即探索

9 個工具
xix.ai
學術研究 適用於學術專案的人工智慧資料集探索工具
適用於學術專案的人工智慧資料集探索工具

2026 年最新、最佳、評分最高的學術專案 AI 資料集搜尋工具!XIX.AI 精心精選了一系列強大且具顛覆性的高可靠性選項,所有工具均經過嚴格的實際環境測試,並每週更新。 您可查閱詳盡的免費版與付費版比較資訊,協助您挑選最合適的工具,以提升研究效率並產出頂級成果。立即探索,釋放您的 AI 競爭優勢!

16 個工具
xix.ai
評論 (0)
0/500
OR