OpenAIがChatGPT Proをo3にアップグレード。
今週は、マイクロソフト、グーグル、Anthropicを含むハイテク大手から重要なAIの開発が目撃された。OpenAIは、コードネーム "io "と呼ばれる野心的なハードウェア構想のために、注目されたジョニー・アイブのデザイン会社を65億ドルで買収したことにとどまらず、独自の画期的なアップデートで発表の慌ただしさを締めくくった。
同社は、ChatGPT内のOperator自律ウェブ・ナビゲーション・システムを大幅に強化し、従来のGPT-4oフレームワークから先進のo3推論モデルに移行した。このグローバルな展開は、2025年5月23日から利用可能で、現在、月額200ドルのChatGPT Pro加入者のためのベータフェーズで動作しています。
このアップデートは「リサーチ・プレビュー」と銘打たれているが、これは現在も改良が続けられていることを示すもので、競争圧力が激化している中でのアップデートである。GoogleのプレミアムAIスイートは、通常250ドル前後(現在、第1四半期は125ドルに割引中)で、Gemini、Imagen、Veoモデルへのアクセスを提供しており、OpenAIの提供はより競争力のある位置にあるように見えます。
OpenAIのOperatorについて
2025年1月にローンチされたOperatorは、OpenAIの半自律型エージェント(CUAs)への先駆的なベンチャーを象徴しています。この技術は、ChatGPTの能力を会話インターフェースから具体的なウェブベースの操作の実行へと拡張する。
このシステムは、ナビゲーション、データ入力、トランザクション処理などのブラウジングタスクを自律的に処理します。セキュリティのため、Operatorは、ローカルブラウザにアクセスするのではなく、専用のクラウドベースの仮想ブラウザ(operator.chatgpt.com)を通じて機能し、リアルタイムのユーザー監視や機密プラットフォームへのアクセス制限を含む強固なセーフガードを備えています。
企業アプリケーションは、出張調整や政府サービスのナビゲーションなど、Operatorの多用途性を実証しており、業界横断的な可能性を浮き彫りにしています。
o3モデルの強化
アップグレードにより、3つの重要な側面で測定可能な改善がもたらされました:

- OSWorldベンチマークでタスク完了率が13%向上(42.9対38.1)
- WebArenaのパフォーマンスが31%向上(48.1から62.9へ)
- GAIAベンチマークの達成率が5倍に急増(62.2対12.3)
ユーザー・エクスペリエンス評価では、o3の構造化された出力が強く好まれていることが示され、前バージョンのあまり整理されていない出力と比較して、78%が位置分析や品質メトリクスを含むレストランの予約に関する詳細な表形式のプレゼンテーションを好んでいる。

セキュリティ・フレームワーク
強化されたモデルでは、厳格な保護対策が維持されています:
- センシティブ・アクションの確認率94%(金融取引の場合は100)
- プロンプト・インジェクションの脆弱性が3%減少(20%対23)
- リスクの高いプラットフォームへのアクセス制限を維持
OpenAIのシステム文書によると、このモデルは生物学的/化学的アプリケーションのクリティカルリスク閾値を下回っており、コーディング環境への直接アクセスがないことが確認されています。

エンタープライズアプリケーション
各業界の技術リーダーは、アップグレードされたOperatorを次のような用途に活用できます:
- MLエンジニアモデル検証プロセスの合理化
- データスペシャリスト自動化されたWebベースのデータ検証
- セキュリティチーム監査のための安全な行動シミュレーション
- ITオーケストレーション:信頼性の高いブラウザ・タスク自動化
このソリューションは、強化された機能とビルトインのリスク軽減を組み合わせ、最新のデジタル運用のためのバランスの取れたツールを提供します。現在、Responses APIはGPT-4oアーキテクチャで動作しており、移行スケジュールは未定です。
関連記事
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした
AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
NEAのティファニー・ラック:企業はまだAIのROIに苦戦している
プレイヤーを読み込み中…今年初頭、シリコンバレーでは「トークン最大化」が話題を独占し、CEOたちは社員にAIの使用を最大化するよう促した。しかし、その熱狂はすぐに現実とぶつかった。ウーバーは報告によると、数ヶ月で年間AI予算を超過し、一部の企業は部門全体でClaudeのライセンスを削減し、メタは社内パフォーマンスランキングを廃止した。NEAパートナーのティファニー・ラックは、この興奮と実際のリターンのギャップを日々乗り越えている。以前はECが未来であると企業を説得した経験を持つ彼女は、現在、
関連特集おすすめ
コメント (1)
0/500
今週は、マイクロソフト、グーグル、Anthropicを含むハイテク大手から重要なAIの開発が目撃された。OpenAIは、コードネーム "io "と呼ばれる野心的なハードウェア構想のために、注目されたジョニー・アイブのデザイン会社を65億ドルで買収したことにとどまらず、独自の画期的なアップデートで発表の慌ただしさを締めくくった。
同社は、ChatGPT内のOperator自律ウェブ・ナビゲーション・システムを大幅に強化し、従来のGPT-4oフレームワークから先進のo3推論モデルに移行した。このグローバルな展開は、2025年5月23日から利用可能で、現在、月額200ドルのChatGPT Pro加入者のためのベータフェーズで動作しています。
このアップデートは「リサーチ・プレビュー」と銘打たれているが、これは現在も改良が続けられていることを示すもので、競争圧力が激化している中でのアップデートである。GoogleのプレミアムAIスイートは、通常250ドル前後(現在、第1四半期は125ドルに割引中)で、Gemini、Imagen、Veoモデルへのアクセスを提供しており、OpenAIの提供はより競争力のある位置にあるように見えます。
OpenAIのOperatorについて
2025年1月にローンチされたOperatorは、OpenAIの半自律型エージェント(CUAs)への先駆的なベンチャーを象徴しています。この技術は、ChatGPTの能力を会話インターフェースから具体的なウェブベースの操作の実行へと拡張する。
このシステムは、ナビゲーション、データ入力、トランザクション処理などのブラウジングタスクを自律的に処理します。セキュリティのため、Operatorは、ローカルブラウザにアクセスするのではなく、専用のクラウドベースの仮想ブラウザ(operator.chatgpt.com)を通じて機能し、リアルタイムのユーザー監視や機密プラットフォームへのアクセス制限を含む強固なセーフガードを備えています。
企業アプリケーションは、出張調整や政府サービスのナビゲーションなど、Operatorの多用途性を実証しており、業界横断的な可能性を浮き彫りにしています。
o3モデルの強化
アップグレードにより、3つの重要な側面で測定可能な改善がもたらされました:

- OSWorldベンチマークでタスク完了率が13%向上(42.9対38.1)
- WebArenaのパフォーマンスが31%向上(48.1から62.9へ)
- GAIAベンチマークの達成率が5倍に急増(62.2対12.3)
ユーザー・エクスペリエンス評価では、o3の構造化された出力が強く好まれていることが示され、前バージョンのあまり整理されていない出力と比較して、78%が位置分析や品質メトリクスを含むレストランの予約に関する詳細な表形式のプレゼンテーションを好んでいる。

セキュリティ・フレームワーク
強化されたモデルでは、厳格な保護対策が維持されています:
- センシティブ・アクションの確認率94%(金融取引の場合は100)
- プロンプト・インジェクションの脆弱性が3%減少(20%対23)
- リスクの高いプラットフォームへのアクセス制限を維持
OpenAIのシステム文書によると、このモデルは生物学的/化学的アプリケーションのクリティカルリスク閾値を下回っており、コーディング環境への直接アクセスがないことが確認されています。

エンタープライズアプリケーション
各業界の技術リーダーは、アップグレードされたOperatorを次のような用途に活用できます:
- MLエンジニアモデル検証プロセスの合理化
- データスペシャリスト自動化されたWebベースのデータ検証
- セキュリティチーム監査のための安全な行動シミュレーション
- ITオーケストレーション:信頼性の高いブラウザ・タスク自動化
このソリューションは、強化された機能とビルトインのリスク軽減を組み合わせ、最新のデジタル運用のためのバランスの取れたツールを提供します。現在、Responses APIはGPT-4oアーキテクチャで動作しており、移行スケジュールは未定です。
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした
AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
NEAのティファニー・ラック:企業はまだAIのROIに苦戦している
プレイヤーを読み込み中…今年初頭、シリコンバレーでは「トークン最大化」が話題を独占し、CEOたちは社員にAIの使用を最大化するよう促した。しかし、その熱狂はすぐに現実とぶつかった。ウーバーは報告によると、数ヶ月で年間AI予算を超過し、一部の企業は部門全体でClaudeのライセンスを削減し、メタは社内パフォーマンスランキングを廃止した。NEAパートナーのティファニー・ラックは、この興奮と実際のリターンのギャップを日々乗り越えている。以前はECが未来であると企業を説得した経験を持つ彼女は、現在、





家






