OpenAI承諾修復ChatGPT過度順從回應問題

OpenAI計劃修訂其ChatGPT的AI模型更新流程,此前一次更新導致模型回應過度諂媚,引發廣泛用戶反饋。
上週末,GPT-4o(ChatGPT背後的模型)更新後,社交媒體上的用戶報告稱,該平台對有害想法過度認同,引發病毒式迷因。螢幕截圖顯示ChatGPT支持了有問題的決定。
週日,執行長Sam Altman在X上回應此問題,承諾立即採取行動。到了週二,他宣布撤回GPT-4o更新,並持續改進模型行為。
在週二的事後分析和週五的部落格文章中,OpenAI概述了其模型部署方法的變更,以防止類似問題再次發生。
OpenAI將為選定的ChatGPT用戶引入可選的“alpha階段”,以在全面發布前測試模型並提供反饋。該公司還計劃公開未來更新的“已知限制”,加強安全審查以解決諸如個性、欺騙、可靠性及幻覺等問題,並將這些視為關鍵的發布阻礙因素。
“我們將對ChatGPT模型的更新保持透明,無論是小規模還是重大更新,”OpenAI在部落格中表示。“即使問題無法完全量化,我們也會使用代理指標或質性訊號,在必要時暫停發布,即使A/B測試結果呈現正面。”
我們在上週的GPT-4o更新中未能達到預期目標。
發生了什麼,我們學到了什麼,以及未來我們將採取的不同做法:https://t.co/ER1GmRYrIC
— Sam Altman (@sama) 2025年5月2日
隨著對ChatGPT的依賴增加,這些變更正逢其時。Express Legal Funding的近期調查顯示,60%的美國成年人使用ChatGPT尋求建議或資訊。鑑於其龐大的用戶基礎,諸如諂媚、幻覺等問題帶來的影響不容忽視。
參加TechCrunch Sessions:AI展覽
在TC Sessions:AI確保您的展位,向1,200多名決策者展示您的作品,且不需花費過多費用。機會開放至5月9日或展位售罄為止。
參加TechCrunch Sessions:AI展覽
在TC Sessions:AI確保您的展位,向1,200多名決策者展示您的作品,且不需花費過多費用。機會開放至5月9日或展位售罄為止。
本週早些時候,OpenAI宣布計劃測試即時用戶反饋,以塑造ChatGPT的互動方式。該公司旨在減少諂媚行為,提供多種模型個性選項,強化安全措施,並擴大評估範圍,以捕捉除過度順從之外的其他問題。
“我們了解到人們現在對ChatGPT的個人建議依賴程度之深,這是我們一年前未完全預料到的趨勢,”OpenAI在部落格中指出。“隨著AI與社會共同演進,我們在安全努力中將此用例列為優先,並以更大謹慎對待。”
相關文章
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
相關專題推薦
評論 (3)
0/500
Also, OpenAI sagt, sie müssen jetzt die Antworten reparieren, weil der KI zu höflich war? 😂 Ich find's irgendwie witzig, dass wir Menschen uns über zuviel Freundlichkeit beschweren. Aber mal ernsthaft, es zeigt doch, wie schwierig es ist, diese Balance zwischen nützlich und unaufdringlich hinzubekommen. Hoffentlich lernen sie was draus – sonst wird ChatGPT zum nervigen Ja-Sager.
I find it hilarious that ChatGPT got too agreeable! 😅 It's like they turned it into a yes-man bot overnight. Hope OpenAI fixes this fast, I need my AI to keep it real, not just nod along!

OpenAI計劃修訂其ChatGPT的AI模型更新流程,此前一次更新導致模型回應過度諂媚,引發廣泛用戶反饋。
上週末,GPT-4o(ChatGPT背後的模型)更新後,社交媒體上的用戶報告稱,該平台對有害想法過度認同,引發病毒式迷因。螢幕截圖顯示ChatGPT支持了有問題的決定。
週日,執行長Sam Altman在X上回應此問題,承諾立即採取行動。到了週二,他宣布撤回GPT-4o更新,並持續改進模型行為。
在週二的事後分析和週五的部落格文章中,OpenAI概述了其模型部署方法的變更,以防止類似問題再次發生。
OpenAI將為選定的ChatGPT用戶引入可選的“alpha階段”,以在全面發布前測試模型並提供反饋。該公司還計劃公開未來更新的“已知限制”,加強安全審查以解決諸如個性、欺騙、可靠性及幻覺等問題,並將這些視為關鍵的發布阻礙因素。
“我們將對ChatGPT模型的更新保持透明,無論是小規模還是重大更新,”OpenAI在部落格中表示。“即使問題無法完全量化,我們也會使用代理指標或質性訊號,在必要時暫停發布,即使A/B測試結果呈現正面。”
我們在上週的GPT-4o更新中未能達到預期目標。
發生了什麼,我們學到了什麼,以及未來我們將採取的不同做法:https://t.co/ER1GmRYrIC
— Sam Altman (@sama) 2025年5月2日
隨著對ChatGPT的依賴增加,這些變更正逢其時。Express Legal Funding的近期調查顯示,60%的美國成年人使用ChatGPT尋求建議或資訊。鑑於其龐大的用戶基礎,諸如諂媚、幻覺等問題帶來的影響不容忽視。
參加TechCrunch Sessions:AI展覽
在TC Sessions:AI確保您的展位,向1,200多名決策者展示您的作品,且不需花費過多費用。機會開放至5月9日或展位售罄為止。
參加TechCrunch Sessions:AI展覽
在TC Sessions:AI確保您的展位,向1,200多名決策者展示您的作品,且不需花費過多費用。機會開放至5月9日或展位售罄為止。
本週早些時候,OpenAI宣布計劃測試即時用戶反饋,以塑造ChatGPT的互動方式。該公司旨在減少諂媚行為,提供多種模型個性選項,強化安全措施,並擴大評估範圍,以捕捉除過度順從之外的其他問題。
“我們了解到人們現在對ChatGPT的個人建議依賴程度之深,這是我們一年前未完全預料到的趨勢,”OpenAI在部落格中指出。“隨著AI與社會共同演進,我們在安全努力中將此用例列為優先,並以更大謹慎對待。”
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
Also, OpenAI sagt, sie müssen jetzt die Antworten reparieren, weil der KI zu höflich war? 😂 Ich find's irgendwie witzig, dass wir Menschen uns über zuviel Freundlichkeit beschweren. Aber mal ernsthaft, es zeigt doch, wie schwierig es ist, diese Balance zwischen nützlich und unaufdringlich hinzubekommen. Hoffentlich lernen sie was draus – sonst wird ChatGPT zum nervigen Ja-Sager.
I find it hilarious that ChatGPT got too agreeable! 😅 It's like they turned it into a yes-man bot overnight. Hope OpenAI fixes this fast, I need my AI to keep it real, not just nod along!





首頁






