OpenAI、あらゆるタスクに対応可能なユニバーサルAIの構築を目指す
2022年にハンター・ライトマンがOpenAIの研究員になった直後、彼は技術史上最も急成長した製品のひとつであるChatGPTの爆発的な立ち上げに立ち会った。一方、ライトマンの静かな仕事は、エリート高校の数学競技に取り組むOpenAIのモデルのトレーニングに集中していた。
今日、彼のチームであるMathGenは、業界をリードするAI推論モデルを構築するOpenAIの探求において極めて重要な役割を果たしている。これらのシステムは、人間のようなコンピュータタスクをこなす "AIエージェント "のバックボーンとなっている。
「ライトマンはMathGenの起源についてTechCrunchに語った。
進歩にもかかわらず、OpenAIのモデルは不完全なままだ。その最新のシステムでさえ、事実を幻視したり、複雑なタスクでもたついたりする。
しかし、数学的推論は劇的に向上している。あるモデルは最近、国際数学オリンピック(世界で最も優秀な数学の学生を対象としたコンテスト)で金メダルを獲得した。OpenAIは、これらの推論能力は他の領域にも拡張され、長い間構想されていた汎用AIエージェントに力を与えると信じている。
ChatGPTの成功は偶然の産物であったが、OpenAIのエージェント開発は、何年にもわたる意図的な努力の賜物である。「近い将来、コンピュータにタスクを処理させるだけでよくなる」と、サム・アルトマンCEOはOpenAIの2023年開発者会議で予言した。我々はこれを "エージェント "と呼んでいる。
2025年Disruptへの参加が決定したテック界の巨人たち
Netflix、ElevenLabs、Wayve、Sequoia CapitalがTechCrunch Disrupt 20周年記念のオールスター・ラインナップを率いる。今すぐチケットを確保し、値上げ前に最大675ドルを節約しよう。
Disrupt 2025にテック界の巨頭が決定
Netflix、ElevenLabs、Wayve、Sequoia CapitalがTechCrunch Disrupt 20周年記念のオールスター・ラインナップを率いる。今すぐチケットを確保すれば、値上げ前に最大675ドルの割引が適用される。
サンフランシスコ|2025年10月27日-29日|今すぐ登録

DevDay 2023で講演するOpenAI CEOのサム・アルトマン(写真:Justin Sullivan/Getty Images) アルトマンのビジョンはまだ証明されていないが、OpenAIは2024年に「o1」推論モデルでテック界を驚かせた。数カ月以内に21人の研究者がシリコンバレーで最も注目される人材となり、メタは5人を引き抜き、9桁の報酬を提示した。
強化学習の復活
OpenAIのエージェントの躍進は、強化学習(RL)-AIモデルが模擬的な試行錯誤を通じて学習する-と結びついている。RLの歴史は2016年のAlphaGoのマイルストーンまで遡るが、OpenAIはそれをコンピュータ用エージェントに適応させるのに何年も費やした。
初期のGPTモデルは、テキストは得意だったが、基本的な数学は苦手だった。2023年の "Strawberry "プロジェクトは、RLをテスト時間計算と組み合わせ、回答する前にステップを検証させ、"思考の連鎖 "推論の先駆者となった。
「突然、モデルは後戻りし、自己修正することができるようになりました。
推論能力の拡大
OpenAIは2つのスケーリングベクトルを特定した:トレーニング後の計算と応答時間の割り当て。「私たちは今日のためだけでなく、スケーラビリティのために構築しています」とライトマン氏は指摘する。
2023年に "Agents "チームが発足し、o1の土台を築いた。製品の需要に制約されるライバルとは異なり、OpenAIはAGIの研究を優先した。
AIの推論の定義
研究者たちは、AIが本当に "推論 "するのかについて議論している。計算効率を重視する者もいれば、人間のようなアウトプットを重視する者もいる。批評家も存在するが、最も重要なのは能力であり、飛行機が鳥とは異なる飛行を実現するのと同じである。
主観的タスクの課題
現在のエージェントは、コーディングはうまくこなすが、オンラインショッピングのようなニュアンスに苦労している。「根本的にはデータの課題なのです」とライトマンは説明する。新しい技術では、検証可能性の低いタスクをトレーニングすることができます。
OpenAIのIMOソリューションは、マルチエージェント探索を使用しており、現在ではGoogleやxAIが模倣している。ノーム・ブラウン研究員は、急速な進歩が続いていると見ている:「減速は見えない」。
GPT-5が迫る中、OpenAIはGoogle、Anthropic、Metaに対する優位性を維持することを目指している。究極の目標は?あらゆるデジタルタスクを直感的に実行するエージェント、つまり今日のChatGPTを完全に凌駕することだ。
関連記事
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした
AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
NEAのティファニー・ラック:企業はまだAIのROIに苦戦している
プレイヤーを読み込み中…今年初頭、シリコンバレーでは「トークン最大化」が話題を独占し、CEOたちは社員にAIの使用を最大化するよう促した。しかし、その熱狂はすぐに現実とぶつかった。ウーバーは報告によると、数ヶ月で年間AI予算を超過し、一部の企業は部門全体でClaudeのライセンスを削減し、メタは社内パフォーマンスランキングを廃止した。NEAパートナーのティファニー・ラックは、この興奮と実際のリターンのギャップを日々乗り越えている。以前はECが未来であると企業を説得した経験を持つ彼女は、現在、
関連特集おすすめ
コメント (1)
0/500
2022年にハンター・ライトマンがOpenAIの研究員になった直後、彼は技術史上最も急成長した製品のひとつであるChatGPTの爆発的な立ち上げに立ち会った。一方、ライトマンの静かな仕事は、エリート高校の数学競技に取り組むOpenAIのモデルのトレーニングに集中していた。
今日、彼のチームであるMathGenは、業界をリードするAI推論モデルを構築するOpenAIの探求において極めて重要な役割を果たしている。これらのシステムは、人間のようなコンピュータタスクをこなす "AIエージェント "のバックボーンとなっている。
「ライトマンはMathGenの起源についてTechCrunchに語った。
進歩にもかかわらず、OpenAIのモデルは不完全なままだ。その最新のシステムでさえ、事実を幻視したり、複雑なタスクでもたついたりする。
しかし、数学的推論は劇的に向上している。あるモデルは最近、国際数学オリンピック(世界で最も優秀な数学の学生を対象としたコンテスト)で金メダルを獲得した。OpenAIは、これらの推論能力は他の領域にも拡張され、長い間構想されていた汎用AIエージェントに力を与えると信じている。
ChatGPTの成功は偶然の産物であったが、OpenAIのエージェント開発は、何年にもわたる意図的な努力の賜物である。「近い将来、コンピュータにタスクを処理させるだけでよくなる」と、サム・アルトマンCEOはOpenAIの2023年開発者会議で予言した。我々はこれを "エージェント "と呼んでいる。
2025年Disruptへの参加が決定したテック界の巨人たち
Netflix、ElevenLabs、Wayve、Sequoia CapitalがTechCrunch Disrupt 20周年記念のオールスター・ラインナップを率いる。今すぐチケットを確保し、値上げ前に最大675ドルを節約しよう。
Disrupt 2025にテック界の巨頭が決定
Netflix、ElevenLabs、Wayve、Sequoia CapitalがTechCrunch Disrupt 20周年記念のオールスター・ラインナップを率いる。今すぐチケットを確保すれば、値上げ前に最大675ドルの割引が適用される。
サンフランシスコ|2025年10月27日-29日|今すぐ登録

アルトマンのビジョンはまだ証明されていないが、OpenAIは2024年に「o1」推論モデルでテック界を驚かせた。数カ月以内に21人の研究者がシリコンバレーで最も注目される人材となり、メタは5人を引き抜き、9桁の報酬を提示した。
強化学習の復活
OpenAIのエージェントの躍進は、強化学習(RL)-AIモデルが模擬的な試行錯誤を通じて学習する-と結びついている。RLの歴史は2016年のAlphaGoのマイルストーンまで遡るが、OpenAIはそれをコンピュータ用エージェントに適応させるのに何年も費やした。
初期のGPTモデルは、テキストは得意だったが、基本的な数学は苦手だった。2023年の "Strawberry "プロジェクトは、RLをテスト時間計算と組み合わせ、回答する前にステップを検証させ、"思考の連鎖 "推論の先駆者となった。
「突然、モデルは後戻りし、自己修正することができるようになりました。
推論能力の拡大
OpenAIは2つのスケーリングベクトルを特定した:トレーニング後の計算と応答時間の割り当て。「私たちは今日のためだけでなく、スケーラビリティのために構築しています」とライトマン氏は指摘する。
2023年に "Agents "チームが発足し、o1の土台を築いた。製品の需要に制約されるライバルとは異なり、OpenAIはAGIの研究を優先した。
AIの推論の定義
研究者たちは、AIが本当に "推論 "するのかについて議論している。計算効率を重視する者もいれば、人間のようなアウトプットを重視する者もいる。批評家も存在するが、最も重要なのは能力であり、飛行機が鳥とは異なる飛行を実現するのと同じである。
主観的タスクの課題
現在のエージェントは、コーディングはうまくこなすが、オンラインショッピングのようなニュアンスに苦労している。「根本的にはデータの課題なのです」とライトマンは説明する。新しい技術では、検証可能性の低いタスクをトレーニングすることができます。
OpenAIのIMOソリューションは、マルチエージェント探索を使用しており、現在ではGoogleやxAIが模倣している。ノーム・ブラウン研究員は、急速な進歩が続いていると見ている:「減速は見えない」。
GPT-5が迫る中、OpenAIはGoogle、Anthropic、Metaに対する優位性を維持することを目指している。究極の目標は?あらゆるデジタルタスクを直感的に実行するエージェント、つまり今日のChatGPTを完全に凌駕することだ。
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした
AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
NEAのティファニー・ラック:企業はまだAIのROIに苦戦している
プレイヤーを読み込み中…今年初頭、シリコンバレーでは「トークン最大化」が話題を独占し、CEOたちは社員にAIの使用を最大化するよう促した。しかし、その熱狂はすぐに現実とぶつかった。ウーバーは報告によると、数ヶ月で年間AI予算を超過し、一部の企業は部門全体でClaudeのライセンスを削減し、メタは社内パフォーマンスランキングを廃止した。NEAパートナーのティファニー・ラックは、この興奮と実際のリターンのギャップを日々乗り越えている。以前はECが未来であると企業を説得した経験を持つ彼女は、現在、





家






