如果競爭對手推出潛在危險的 AI 模型,OpenAI 可能會放鬆保障措施

OpenAI 在競爭壓力下調整安全協議
OpenAI 修訂了其準備框架 (Preparedness Framework),這是指導 AI 模型安全性評估和整個開發週期保障措施實施的內部機制。更新後的政策主要包括,如果競爭公司推出高風險系統,卻沒有同等的保護措施,則可能放寬安全措施。
這項修改突顯出市場力量日益強大,迫使 AI 開發人員加快部署時程。OpenAI 面臨越來越多的審查,指控其為了加快發佈速度而降低安全優先順序,包括延遲公佈安全評估文件。最近的法律訴訟中,有 12 名前員工支持 Elon Musk 針對 OpenAI 的訴訟,並警告計劃中的公司重組可能會進一步削弱安全標準。
平衡競爭與安全
對於外界的批評,OpenAI 強調任何政策調整都會維持嚴格的保護等級。週二的部落格更新指出:「雖然我們可能會調整要求,如果競爭對手部署的高風險系統缺乏可比的保障措施,」「我們致力於徹底的風險驗證、修改的透明度,並維持優越的保護措施」。
修訂後的架構強調 OpenAI 在傳統人工測試的同時,也越來越依賴自動化評估工具。公司代表宣稱,這些自動化系統能夠在不影響評估品質的情況下,維持產品的發行速度。
出現有爭議的測試做法
有報導與 OpenAI 的官方立場相左,內部人士透露,OpenAI 壓縮了安全審查的時間。根據《金融時報》的消息,測試人員最近只有不到一周的時間來評估即將推出的模型,比之前的時間大幅縮短。此外,安全測試主要發生在預發佈的模型變體上,而非公開部署的版本,這也引起了其他的關注。
OpenAI 悄悄地減少安全承諾。
從框架變更中省略:
- 微調模型不需要安全測試
- Steven Adler (@sjgadler) 2025 年 4 月 15 日
重新定義風險分類系統
更新的框架引入了精簡的模型分類,著重於兩個能力臨界值:
- 高能力:擴大現有嚴重危害向量的模型
- 臨界能力:建立新的嚴重傷害途徑的模型
「高能力系統要求在部署前採取風險緩解保障措施,」OpenAI 澄清道。「關鍵能力模型需要額外的開發階段保護措施」。
這標誌著該框架自 2023 年以來的首次大幅修訂,反映出不斷演進的產業動態和 OpenAI 的內部營運變化。
相關文章
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
相關專題推薦
評論 (2)
0/500
またOpenAIの方針転換...競争が激化する中、安全性と開発速度のバランスって本当に難しいですよね。個人的には過去のChatGPTの制限が緩和された時みたいに、今回もユーザー体験が向上するなら歓迎だけど、やっぱり倫理的基準は守ってほしいな😅 他の企業が危険なAIを出したら同じ土俵に上がる必要性ある?

OpenAI 在競爭壓力下調整安全協議
OpenAI 修訂了其準備框架 (Preparedness Framework),這是指導 AI 模型安全性評估和整個開發週期保障措施實施的內部機制。更新後的政策主要包括,如果競爭公司推出高風險系統,卻沒有同等的保護措施,則可能放寬安全措施。
這項修改突顯出市場力量日益強大,迫使 AI 開發人員加快部署時程。OpenAI 面臨越來越多的審查,指控其為了加快發佈速度而降低安全優先順序,包括延遲公佈安全評估文件。最近的法律訴訟中,有 12 名前員工支持 Elon Musk 針對 OpenAI 的訴訟,並警告計劃中的公司重組可能會進一步削弱安全標準。
平衡競爭與安全
對於外界的批評,OpenAI 強調任何政策調整都會維持嚴格的保護等級。週二的部落格更新指出:「雖然我們可能會調整要求,如果競爭對手部署的高風險系統缺乏可比的保障措施,」「我們致力於徹底的風險驗證、修改的透明度,並維持優越的保護措施」。
修訂後的架構強調 OpenAI 在傳統人工測試的同時,也越來越依賴自動化評估工具。公司代表宣稱,這些自動化系統能夠在不影響評估品質的情況下,維持產品的發行速度。
出現有爭議的測試做法
有報導與 OpenAI 的官方立場相左,內部人士透露,OpenAI 壓縮了安全審查的時間。根據《金融時報》的消息,測試人員最近只有不到一周的時間來評估即將推出的模型,比之前的時間大幅縮短。此外,安全測試主要發生在預發佈的模型變體上,而非公開部署的版本,這也引起了其他的關注。
OpenAI 悄悄地減少安全承諾。
- Steven Adler (@sjgadler) 2025 年 4 月 15 日
從框架變更中省略:
- 微調模型不需要安全測試
重新定義風險分類系統
更新的框架引入了精簡的模型分類,著重於兩個能力臨界值:
- 高能力:擴大現有嚴重危害向量的模型
- 臨界能力:建立新的嚴重傷害途徑的模型
「高能力系統要求在部署前採取風險緩解保障措施,」OpenAI 澄清道。「關鍵能力模型需要額外的開發階段保護措施」。
這標誌著該框架自 2023 年以來的首次大幅修訂,反映出不斷演進的產業動態和 OpenAI 的內部營運變化。
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
またOpenAIの方針転換...競争が激化する中、安全性と開発速度のバランスって本当に難しいですよね。個人的には過去のChatGPTの制限が緩和された時みたいに、今回もユーザー体験が向上するなら歓迎だけど、やっぱり倫理的基準は守ってほしいな😅 他の企業が危険なAIを出したら同じ土俵に上がる必要性ある?





首頁






