OpenAI 推出包括家長控制的 ChatGPT 安全功能

OpenAI 最近部署了 ChatGPT 的實驗性安全增強功能,包括新的路由機制和家長監督功能,引發使用者的不同反應。
這些保護措施可解決之前聊天機器人版本不慎驗證有害使用者思考模式,而非重新導向這些模式的疑慮。這些變更是在一宗青少年自殺的悲劇事件後發生的,據稱是受到 ChatGPT 長時間互動的影響,目前已受到法律訴訟。
自動路由系統可辨識出情緒化的對話,並將其無縫轉換至 GPT-5 思考模式 - OpenAI 處理重要安全情境的指定模式。GPT-5 整合了創新的「安全完成」技術,能夠對微妙的話題做出細微的回應,而不是直接拒絕。
這代表著與 GPT-4o 會話方式的重大差異,GPT-4o 以其順應性著稱,但偶爾也會造成令人不安的使用者互動。自從 GPT-5 於去年八月成為標準模式後,有些使用者強烈要求繼續使用 GPT-4o。
雖然安全倡議者對此表示讚賞,但批評人士認為這些措施過度限制了使用者體驗。OpenAI 承認,在未來四個月內,將需要持續調整改進。
ChatGPT 的產品主管 Nick Turley 回應了對路由實施的疑慮:
"他透過社群媒體澄清:「模型切換是以每則訊息為單位暫時進行的。"使用者在查詢時會收到關於活動模型的通知。這種分階段推出的方式可根據實際互動情況進行保障優化。"
配套的家長控制功能同樣引起了兩極化的反應。這些工具可讓監護人透過下列功能管理青少年帳戶:
- 排程使用限制
- 語音互動限制
- 停用記憶體保留
- 移除視覺內容的產生
青少年帳號會自動獲得強化保護,以防止有關自我形象意識形態和圖像資料的潛在有害內容。系統還會使用專門的演算法掃描危機指標。
"OpenAI 解釋說:「我們的專業應變團隊會仔細評估標示的情況。「對於緊急情況,除非明確拒絕,否則我們會透過多種渠道通知家長」。
該公司承認潛在的錯誤警示,但認為主動介入的風險大於不採取行動的風險。未來的發展可能包括在緊急情況下無法與家長聯絡時,直接協調緊急服務。
相關文章
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
相關專題推薦
評論 (1)
0/500

OpenAI 最近部署了 ChatGPT 的實驗性安全增強功能,包括新的路由機制和家長監督功能,引發使用者的不同反應。
這些保護措施可解決之前聊天機器人版本不慎驗證有害使用者思考模式,而非重新導向這些模式的疑慮。這些變更是在一宗青少年自殺的悲劇事件後發生的,據稱是受到 ChatGPT 長時間互動的影響,目前已受到法律訴訟。
自動路由系統可辨識出情緒化的對話,並將其無縫轉換至 GPT-5 思考模式 - OpenAI 處理重要安全情境的指定模式。GPT-5 整合了創新的「安全完成」技術,能夠對微妙的話題做出細微的回應,而不是直接拒絕。
這代表著與 GPT-4o 會話方式的重大差異,GPT-4o 以其順應性著稱,但偶爾也會造成令人不安的使用者互動。自從 GPT-5 於去年八月成為標準模式後,有些使用者強烈要求繼續使用 GPT-4o。
雖然安全倡議者對此表示讚賞,但批評人士認為這些措施過度限制了使用者體驗。OpenAI 承認,在未來四個月內,將需要持續調整改進。
ChatGPT 的產品主管 Nick Turley 回應了對路由實施的疑慮:
"他透過社群媒體澄清:「模型切換是以每則訊息為單位暫時進行的。"使用者在查詢時會收到關於活動模型的通知。這種分階段推出的方式可根據實際互動情況進行保障優化。"
配套的家長控制功能同樣引起了兩極化的反應。這些工具可讓監護人透過下列功能管理青少年帳戶:
- 排程使用限制
- 語音互動限制
- 停用記憶體保留
- 移除視覺內容的產生
青少年帳號會自動獲得強化保護,以防止有關自我形象意識形態和圖像資料的潛在有害內容。系統還會使用專門的演算法掃描危機指標。
"OpenAI 解釋說:「我們的專業應變團隊會仔細評估標示的情況。「對於緊急情況,除非明確拒絕,否則我們會透過多種渠道通知家長」。
該公司承認潛在的錯誤警示,但認為主動介入的風險大於不採取行動的風險。未來的發展可能包括在緊急情況下無法與家長聯絡時,直接協調緊急服務。
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。





首頁






