選項
首頁
新聞
GPT-5 發布遇阻:OpenAI 積極應對推出挑戰

GPT-5 發布遇阻:OpenAI 積極應對推出挑戰

2025-11-26
124

GPT-5 發布遇阻:OpenAI 積極應對推出挑戰

更新時間:2025年8月8日星期五下午5點21分(美國東部時間):本文發表後不久,OpenAI聯合創始人兼執行長 Sam Altman 確認公司將為特定用戶恢復 GPT-4o 及其他舊版模型的存取權限,並承認 GPT-5 的推出「比我們預期的更為坎坷」。

說得委婉些,萬眾期待的 OpenAI 新模型 GPT-5 的發布起步頗為艱難。

即使忽略昨日直播發布會上的圖表錯誤和語音演示故障(該發布會介紹了四款不同模型以及其中三款可使用的「思考」模式),發布以來的多份用戶報告顯示,GPT-5 在處理相對簡單的問題時表現掙扎,而這些問題早前的 OpenAI 模型——以及競爭對手的 AI 實驗室系統——都能正確解決。

例如,資料科學家 Colin Fraser 分享了 GPT-5 錯誤處理數學證明的截圖——具體來說,是 8.888 無限循環是否等於 9(答案是不等於)。

它在一個簡單的算術方程式 5.9 = x + 5.11 上也失敗了,這是許多小學生都能解決的問題。

使用 GPT-5 來評估 OpenAI 自身有缺陷的簡報圖表,也未能產生有用或準確的回應。

此外,它在這個較為棘手的文字題上也栽了跟頭(必須承認,連我起初都覺得頗具挑戰性——儘管伊隆·馬斯克的 Grok 4 AI 正確解答了它。提示:請記住石板不能切割;所有 80 塊必須保持完整)。

在我的測試中,較舊的 GPT-4o 模型至少能更可靠地處理其中一道數學問題。不幸的是,OpenAI 正逐步為 ChatGPT 用戶淘汰那些舊模型——包括先前預設的 GPT-4o 和進階推理模型 o3——儘管開發者在近期內仍能透過 API 存取它們。

編程表現未達基準測試水準

儘管 OpenAI 的內部基準測試和某些第三方測試顯示 GPT-5 是編程效能最佳的模型,但實際使用情況表明,Anthropic 最近升級的 Claude Opus 4.1 在處理「一次性」任務時往往更有效——能根據要求交付用戶預期的應用程式或軟體建置。請看開發者 Justin Sun 在 X 平台上發布的這個例子:

此外,安全公司 SPLX 的一份報告揭露,OpenAI 的內部安全措施在業務一致性、對提示注入攻擊和混淆邏輯攻擊的易感性等領域存在重大漏洞。

儘管是軼事證據,但來自 AI 資深用戶的早期回饋表明總體反應冷淡。

AI 網紅暨前谷歌員工 Bilawal Sidhu 在 X 上進行了一項投票,詢問追隨者的「感覺檢查」。截至目前有 172 票,最主要的回應是「有點普通」。

正如化名帳號 AI Leaks and News 所指出的:「來自 X 和 Reddit AMA 的壓倒性共識是對 GPT-5 極度負面。」

AIPRM 首席工程師、X 平台上知名的 AI 評論家 Tibor Blaho 彙整了一份關於 ChatGPT-5 推出問題的全面總結。他指出,其中一項旗艦功能——根據查詢複雜度自動選擇思考或非思考模式的「路由器」——已成為主要抱怨點,因為該模型對許多用戶經常預設使用非思考模式。

競爭者蓄勢待發

因此,圍繞 ChatGPT-5 的輿論遠非一片叫好——這對 OpenAI 構成嚴峻挑戰,因為來自美國巨頭如 Google 和 Anthropic 的競爭加劇,同時來自越來越多的免費、開源且能力強大的中國大型語言模型的競爭也在升溫,這些模型提供了許多美國模型所缺乏的功能。

以阿里巴巴千問研究團隊為例,他們今天將其高效能 Qwen 3 模型升級至支援 100 萬個 token 的上下文長度。這使得用戶每次互動可交換的資訊量幾乎是 GPT-5 目前提供量的四倍。

隨著 OpenAI 本週另一項重大發布——新的開源 gpt-oss 模型系列——也獲得褒貶不一的早期評價,這家用戶領先的專注 AI 公司(ChatGPT 目前擁有 7 億週活躍用戶)前景變得不明朗。

這種情緒在預測市場 Polymarket 上得到呼應,用戶壓倒性地押注 Google 很可能在 2025 年 8 月底前擁有領先的 AI 模型。

其他資深用戶,例如 Otherside AI 的聯合創始人兼執行長 Matt Shumer——他早期取得了 GPT-5 存取權並發布了正面評價——建議,隨著更多人針對新模型優化其工作流程,意見可能會發生變化:

雖然現在評價 GPT-5 還為時過早——並且隨著更多人在各種任務中測試它,意見可能會顯著改變——但初步跡象表明,這並非像之前 GPT-4、GPT-4o 或 o3 等發布那樣是支「全壘打」。對於這家最近剛完成新一輪融資,但由於高昂的研發支出仍處於虧損狀態的公司來說,這是一個令人擔憂的信號。

相關文章
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本 OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本 在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略 Frontier AI Labs 拒絕透露針對失控模型的管控策略 近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率 NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率 正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
相關專題推薦
聊天機器人 最適合面試練習的 AI 對話訓練工具
最適合面試練習的 AI 對話訓練工具

2026 年最新、最受好評的 AI 面試對話訓練工具,盡在 XIX.AI!這份精心精選的清單收錄了多款功能強大、顛覆傳統的工具,這些工具均經過嚴格的實戰測試,能提供精準的回饋。 您將在此找到免費版與付費版的比較分析,以及詳細的排名榜單,助您挑選必試的選項,從而提升自信與技能。立即探索,發掘助您在面試中脫穎而出的完美工具!

12 個工具
xix.ai
設計與藝術 最適合進行創意實驗的 AI 風格轉移工具
最適合進行創意實驗的 AI 風格轉移工具

2026 年最新、最佳且評價最高的 AI 風格轉移工具,助您進行創意實驗!XIX.AI 精心精選了一系列強大且具革命性的必試工具,這些工具經實際測試與嚴格評比,能帶來卓越成果。這些頂尖解決方案能加速內容創作並開啟無盡的創意可能性,協助創作者顯著提升生產力。 立即探索,找出最適合您的工具,並從今天開始創作吧!

9 個工具
xix.ai
漫畫創作 最適合視覺敘事的 AI 對話氣泡工具
最適合視覺敘事的 AI 對話氣泡工具

2026 年最新、最受好評的視覺敘事 AI 對話氣泡工具,現已登陸 XIX.AI!這份精心挑選的合集收錄了強大且具顛覆性的工具,能協助創作者提升生產力並突破創作瓶頸。 查看免費版與付費版的比較、參考實際測試結果,並查閱最新排行榜,找出最適合打造引人入勝視覺敘事的必試解決方案。立即探索,發掘您的理想工具!

10 個工具
xix.ai
會議助理 頂尖 AI 會議摘要工具:清晰追蹤決策與後續行動
頂尖 AI 會議摘要工具:清晰追蹤決策與後續行動

2026 年最新高評價最佳 AI 會議摘要工具,助您清晰追蹤決策並輕鬆進行後續跟進。這份精選清單展示了一系列強大且具顛覆性的解決方案,透過自動化會議記錄、識別關鍵行動項目,以及簡化所有專案的團隊協作,大幅提升生產力。 獲取免費版與付費版的比較分析,搭配實際測試報告及每週更新的排行榜,助您找到最合適的工具。立即探索,釋放您的 AI 優勢!

9 個工具
xix.ai
數據分析 最佳人工智慧資料清洗工具:快速處理缺失值與重複資料
最佳人工智慧資料清洗工具:快速處理缺失值與重複資料

2026年最新、最優秀且評分最高的AI資料清洗工具,可快速處理缺失值與重複資料問題。這份精心挑選的清單展示了那些功能強大、能帶來顛覆性變革的解決方案,可顯著提升工作效率。所有候選工具都經過了嚴格的實際應用測試,以確保其穩定性。您可以獲取免費版與付費版的對比資訊,找出最符合您需求的必備工具。即刻訪問XIX.AI,開啟您的AI優勢之旅。

11 個工具
xix.ai
設計與藝術 最佳AI創意構思工具,助力藝術家突破視覺瓶頸
最佳AI創意構思工具,助力藝術家突破視覺瓶頸

2026 年最新最佳頂級評分 AI 創意構思工具由 XIX.AI 精心策劃,旨在幫助創作者突破視覺瓶頸並即時提升創造力。這些強大的變革性工具提供真實世界測試、詳細的免費與付費對比以及每週更新的排名。發現您的完美工具,加速內容創作,並立即釋放您的 AI 優勢。立即探索!

14 個工具
xix.ai
評論 (1)
0/500
DanielAllen
DanielAllen 2026-06-01 18:00:19

Honestly, I'm not surprised. OpenAI rushed GPT-4o and now they're backtracking? Classic move 😅. Hope they get it right eventually, but I'm sticking with Claude for now.

OR