OpenAIが高度なAI推論モデル、o3およびo4-miniを発表

OpenAIは水曜日に、質問を一時停止して分析してから回答するように設計された新しいAIモデル、o3とo4-miniを導入しました。
OpenAIは、o3をこれまでで最も高度な推論モデルとして宣伝しており、数学、コーディング、推論、科学、視覚理解のテストで従来のモデルを上回っています。一方、o4-miniはコスト、速度、性能のバランスを取り、AI駆動のアプリケーションを構築する開発者にとって強力な選択肢です。
これまでのモデルとは異なり、o3とo4-miniは、ウェブブラウジング、Pythonコード実行、画像処理、画像生成などのChatGPTツールを活用します。今日から、これらのモデルおよび回答精度を高めるために追加の時間を要するo4-mini-highは、OpenAIのPro、Plus、Teamプランの加入者に提供されます。
これらのモデルは、Google、Meta、xAI、Anthropic、DeepSeekなどのライバルをグローバルなAI競争で上回るためのOpenAIの取り組みの一環です。OpenAIはo1でAI推論を開拓しましたが、競合他社はその後、同等または優れたモデルをリリースしており、推論モデルはAIラボの主要な焦点となっています。
当初、o3はChatGPTでのリリースが予定されていませんでした。OpenAIのCEOであるSam Altmanは2月に、o3の技術を使用したより高度な代替案に焦点を当てることを示唆していました。しかし、競争圧力によりOpenAIはこれを発売した可能性があります。
OpenAIは、o3がSWE-bench verified(カスタム足場なし)でトップレベルのパフォーマンスを達成し、コーディングタスクで69.1%を記録したと報告しています。o4-miniは68.1%、o3-miniは49.3%を記録し、Claude 3.7 Sonnetの62.3%と比較されます。
OpenAIは、o3とo4-miniが画像を効果的に処理する初のモデルであると主張しています。ユーザーはホワイトボードのスケッチやPDF図表などの画像をアップロードでき、モデルは推論プロセス中にそれらを分析し、ぼやけた低品質の画像を処理したり、ズームや回転などのタスクを実行したりします。
画像以外にも、o3とo4-miniはChatGPTのCanvas機能を介してブラウザ内でPythonコードを実行し、リアルタイムのイベントクエリのためにウェブを検索します。
3つのモデル—o3、o4-mini、o4-mini-high—はすべて、OpenAIのChat Completions APIおよびResponses APIを通じてアクセス可能で、開発者は使用量ベースの価格設定でこれらをアプリケーションに統合できます。
OpenAIは、o3を入力トークン100万あたり10ドル(約75万語)、出力トークン100万あたり40ドルで価格設定しています。o4-miniはo3-miniと同じ価格で、入力トークン100万あたり1.10ドル、出力トークン100万あたり4.40ドルです。
今後数週間で、OpenAIはChatGPT Pro加入者向けに、計算負荷の高いo3のバージョンであるo3-proを発売する予定です。
CEOのSam Altmanは、o3とo4-miniが、従来のモデルと推論モデルの機能を統合するGPT-5の前に、ChatGPTにおけるOpenAIの最後の独立した推論モデルになる可能性があると示唆しました。
関連記事
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした
AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
NEAのティファニー・ラック:企業はまだAIのROIに苦戦している
プレイヤーを読み込み中…今年初頭、シリコンバレーでは「トークン最大化」が話題を独占し、CEOたちは社員にAIの使用を最大化するよう促した。しかし、その熱狂はすぐに現実とぶつかった。ウーバーは報告によると、数ヶ月で年間AI予算を超過し、一部の企業は部門全体でClaudeのライセンスを削減し、メタは社内パフォーマンスランキングを廃止した。NEAパートナーのティファニー・ラックは、この興奮と実際のリターンのギャップを日々乗り越えている。以前はECが未来であると企業を説得した経験を持つ彼女は、現在、
関連特集おすすめ
コメント (3)
0/500
Wow, OpenAI's o3 sounds like a game-changer! Pausing to think before answering? That's some next-level AI. Can't wait to see how it stacks up against other models in real-world tasks! 🤯

OpenAIは水曜日に、質問を一時停止して分析してから回答するように設計された新しいAIモデル、o3とo4-miniを導入しました。
OpenAIは、o3をこれまでで最も高度な推論モデルとして宣伝しており、数学、コーディング、推論、科学、視覚理解のテストで従来のモデルを上回っています。一方、o4-miniはコスト、速度、性能のバランスを取り、AI駆動のアプリケーションを構築する開発者にとって強力な選択肢です。
これまでのモデルとは異なり、o3とo4-miniは、ウェブブラウジング、Pythonコード実行、画像処理、画像生成などのChatGPTツールを活用します。今日から、これらのモデルおよび回答精度を高めるために追加の時間を要するo4-mini-highは、OpenAIのPro、Plus、Teamプランの加入者に提供されます。
これらのモデルは、Google、Meta、xAI、Anthropic、DeepSeekなどのライバルをグローバルなAI競争で上回るためのOpenAIの取り組みの一環です。OpenAIはo1でAI推論を開拓しましたが、競合他社はその後、同等または優れたモデルをリリースしており、推論モデルはAIラボの主要な焦点となっています。
当初、o3はChatGPTでのリリースが予定されていませんでした。OpenAIのCEOであるSam Altmanは2月に、o3の技術を使用したより高度な代替案に焦点を当てることを示唆していました。しかし、競争圧力によりOpenAIはこれを発売した可能性があります。
OpenAIは、o3がSWE-bench verified(カスタム足場なし)でトップレベルのパフォーマンスを達成し、コーディングタスクで69.1%を記録したと報告しています。o4-miniは68.1%、o3-miniは49.3%を記録し、Claude 3.7 Sonnetの62.3%と比較されます。
OpenAIは、o3とo4-miniが画像を効果的に処理する初のモデルであると主張しています。ユーザーはホワイトボードのスケッチやPDF図表などの画像をアップロードでき、モデルは推論プロセス中にそれらを分析し、ぼやけた低品質の画像を処理したり、ズームや回転などのタスクを実行したりします。
画像以外にも、o3とo4-miniはChatGPTのCanvas機能を介してブラウザ内でPythonコードを実行し、リアルタイムのイベントクエリのためにウェブを検索します。
3つのモデル—o3、o4-mini、o4-mini-high—はすべて、OpenAIのChat Completions APIおよびResponses APIを通じてアクセス可能で、開発者は使用量ベースの価格設定でこれらをアプリケーションに統合できます。
OpenAIは、o3を入力トークン100万あたり10ドル(約75万語)、出力トークン100万あたり40ドルで価格設定しています。o4-miniはo3-miniと同じ価格で、入力トークン100万あたり1.10ドル、出力トークン100万あたり4.40ドルです。
今後数週間で、OpenAIはChatGPT Pro加入者向けに、計算負荷の高いo3のバージョンであるo3-proを発売する予定です。
CEOのSam Altmanは、o3とo4-miniが、従来のモデルと推論モデルの機能を統合するGPT-5の前に、ChatGPTにおけるOpenAIの最後の独立した推論モデルになる可能性があると示唆しました。
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした
AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
NEAのティファニー・ラック:企業はまだAIのROIに苦戦している
プレイヤーを読み込み中…今年初頭、シリコンバレーでは「トークン最大化」が話題を独占し、CEOたちは社員にAIの使用を最大化するよう促した。しかし、その熱狂はすぐに現実とぶつかった。ウーバーは報告によると、数ヶ月で年間AI予算を超過し、一部の企業は部門全体でClaudeのライセンスを削減し、メタは社内パフォーマンスランキングを廃止した。NEAパートナーのティファニー・ラックは、この興奮と実際のリターンのギャップを日々乗り越えている。以前はECが未来であると企業を説得した経験を持つ彼女は、現在、
Wow, OpenAI's o3 sounds like a game-changer! Pausing to think before answering? That's some next-level AI. Can't wait to see how it stacks up against other models in real-world tasks! 🤯





家






