OpenAI 推出 ChatGPT Images 2.0,每次生成可產出 8 張連貫的圖片
OpenAI 剛推出一款基於其全新 GPT Image2 模型所開發的 AI 圖像生成器——ChatGPT Images 2.0。此版本最突出的特點在於賦予 AI 更強大的「推理能力」,使其在處理複雜視覺任務時,能表現得更像一位邏輯嚴謹的創作者。

透過「推理規劃」,影像生成不再是「猜謎遊戲」
有別於先前直接生成圖像的做法,Images 2.0 新增了一套深度邏輯規劃系統。 當推理功能被啟用時,AI 會先搜尋網路資訊並分析使用者上傳的檔案。透過預先推導圖像結構並規劃版面配置,產出的結果更能符合邏輯直覺,而非僅是將素材拼湊在一起。這項進階功能目前僅限 ChatGPT Plus、Pro、Business 及 Enterprise 訂閱用戶使用。

連貫性突破:一次生成多達 8 張圖片,適用於漫畫與設計
在多圖生成領域,最新版本標誌著一個里程碑。 Images 2.0 現可根據單一提示生成多達 8 張連貫的圖片。最令人印象深刻的是,系統在不同場景轉換間,能嚴格維持角色外觀、物件細節及整體視覺風格的一致性。這項能力大幅降低了創作長篇漫畫、社群媒體系列插圖或完整室內設計方案的門檻。
畫質升級與多語言微調
在技術層面,新版本將最高解析度提升至 2K,並提供 3:1 至 1:3 的長寬比,非常適合用於電影劇照、像素藝術及其他特定風格。 為了服務全球用戶,開發團隊還針對中文、日文、韓文、印地文和孟加拉文的文字生成準確性進行了微調,解決了早期 AI 生成圖像中常見的文字編碼錯誤和誤解等問題。
此次更新標誌著 AI 繪圖正從單純的「像素生成」轉向「理解與創作」,為專業設計師和一般使用者皆提供了更高效的視覺工具。
相關文章
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
相關專題推薦
評論 (0)
0/500
OpenAI 剛推出一款基於其全新 GPT Image2 模型所開發的 AI 圖像生成器——ChatGPT Images 2.0。此版本最突出的特點在於賦予 AI 更強大的「推理能力」,使其在處理複雜視覺任務時,能表現得更像一位邏輯嚴謹的創作者。

透過「推理規劃」,影像生成不再是「猜謎遊戲」
有別於先前直接生成圖像的做法,Images 2.0 新增了一套深度邏輯規劃系統。 當推理功能被啟用時,AI 會先搜尋網路資訊並分析使用者上傳的檔案。透過預先推導圖像結構並規劃版面配置,產出的結果更能符合邏輯直覺,而非僅是將素材拼湊在一起。這項進階功能目前僅限 ChatGPT Plus、Pro、Business 及 Enterprise 訂閱用戶使用。

連貫性突破:一次生成多達 8 張圖片,適用於漫畫與設計
在多圖生成領域,最新版本標誌著一個里程碑。 Images 2.0 現可根據單一提示生成多達 8 張連貫的圖片。最令人印象深刻的是,系統在不同場景轉換間,能嚴格維持角色外觀、物件細節及整體視覺風格的一致性。這項能力大幅降低了創作長篇漫畫、社群媒體系列插圖或完整室內設計方案的門檻。
畫質升級與多語言微調
在技術層面,新版本將最高解析度提升至 2K,並提供 3:1 至 1:3 的長寬比,非常適合用於電影劇照、像素藝術及其他特定風格。 為了服務全球用戶,開發團隊還針對中文、日文、韓文、印地文和孟加拉文的文字生成準確性進行了微調,解決了早期 AI 生成圖像中常見的文字編碼錯誤和誤解等問題。
此次更新標誌著 AI 繪圖正從單純的「像素生成」轉向「理解與創作」,為專業設計師和一般使用者皆提供了更高效的視覺工具。
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了





首頁






