OpenAIが2つの先進的なオープンウェイトAIモデルを公開
OpenAIは火曜日に、oシリーズに匹敵する能力を持つ2つのオープンウェイトAI推論モデルを公開した。両モデルはHugging Faceで無料ダウンロード可能で、OpenAIはオープンモデルの複数のベンチマークで「トップパフォーマンス」と称している。
モデルは2つのバリエーションで提供される:単一のNvidia GPUで動作する堅牢なgpt-oss-120bと、16GBのメモリを搭載した標準的なラップトップで動作する軽量なgpt-oss-20b。
このリリースは、5年以上前に導入されたGPT-2以来、OpenAI初のオープン言語モデルである。
ブリーフィングで、OpenAIはオープンモデルが複雑なクエリを処理するために、より先進的なクラウドベースのAIシステムに接続可能であると述べ、TechCrunchが以前報じた。この機能により、開発者は必要に応じて画像処理などのタスクのためにOpenAIの独自モデルにオープンモデルをリンクできる。
OpenAIは当初オープンソースAIモデルを採用していたが、主に独自開発モデルに移行し、企業や開発者にAPIアクセスを提供することで繁栄するビジネスを築いた。
1月、CEOのSam Altmanは、OpenAIがオープンソース技術の優先順位を誤った可能性があると認めた。同社は現在、DeepSeek、AlibabaのQwen、Moonshot AIなどの中国のAIラボからの激しい競争に直面しており、これらは高性能なオープンモデルで注目を集めている。(MetaのLlamaモデルは、かつてオープンAI分野のリーダーだったが、過去1年間で遅れをとっている。)
7月、トランプ政権は、米国の価値観に沿ったAIを世界的に推進するために、米国のAI開発者にオープンソース技術を増やすよう奨励した。
テックとVCリーダーがDisrupt 2025を牽引
Netflix、ElevenLabs、Wayve、Sequoia CapitalがDisrupt 2025のアジェンダに名を連ね、スタートアップの成功とイノベーションを推進する洞察を共有する。TechCrunch Disruptの20周年記念を見逃すな。テック界のトップボイスから学ぶチャンス—今すぐチケットを確保して、8月7日に価格が上がる前に最大675ドル節約しよう。
テックとVCリーダーがDisrupt 2025を牽引
Netflix、ElevenLabs、Wayve、Sequoia CapitalがDisrupt 2025のアジェンダに名を連ね、スタートアップの成功とイノベーションを推進する洞察を共有する。TechCrunch Disruptの20周年記念を見逃すな。テック界のトップボイスから学ぶチャンス—今すぐチケットを確保して、最大675ドル節約しよう。
サンフランシスコ | 2025年10月27-29日 登録は今すぐgpt-ossで、OpenAIは開発者を引きつけ、トランプ政権の推進に沿い、両者がオープンソース分野での中国AIラボの台頭を指摘している。
「2015年の設立以来、OpenAIの使命は全人類の利益のためにAGIを進めることだった」とCEOのSam AltmanはTechCrunchへの声明で述べた。「米国の民主的価値観に根ざしたオープンAIフレームワークが、世界中で自由にアクセスでき、広く有益であることに興奮している。」

(写真: 大隅智洋/Getty Images)画像クレジット: 大隅智洋 / Getty Images モデルパフォーマンスの概要
OpenAIは、オープンウェイトAIシステムの中でリードするようにオープンモデルを設計し、その目標を達成したと主張している。
Codeforcesの競技プログラミングテスト(ツール使用)では、gpt-oss-120bが2622、gpt-oss-20bが2516を記録し、DeepSeekのR1を上回ったが、o3とo4-miniには及ばなかった。

OpenAIのオープンモデルのCodeforcesでのパフォーマンス(クレジット: OpenAI)。 Humanity’s Last Exam、複数の科目をカバーする厳格なクラウドソーシングテスト(ツール使用)では、gpt-oss-120bとgpt-oss-20bがそれぞれ19%と17.3%を達成し、DeepSeekやQwenの主要なオープンモデルを上回ったが、o3には及ばなかった。

OpenAIのオープンモデルのHLEでのパフォーマンス(クレジット: OpenAI)。 注目すべきは、OpenAIのオープンモデルは、最新の推論モデルo3やo4-miniよりも幻覚率が有意に高いことである。
幻覚はOpenAIの最近のAI推論モデルでより顕著になり、同社は原因を調査中であると認めた。ホワイトペーパーで、OpenAIは「世界知識が少ない小型モデルは、大規模なフロンティアモデルよりも多く幻覚することが予想される」と述べた。
PersonQA、個人の正確性を評価するOpenAIの内部ベンチマークでは、gpt-oss-120bとgpt-oss-20bはそれぞれ49%と53%で幻覚し、o1モデル(16%)の3倍以上、o4-mini(36%)よりも高かった。
新モデルのトレーニング
OpenAIは、オープンモデルが独自モデルと同様の技術を使用して開発されたと述べている。それぞれはエキスパートの混合(MoE)アプローチを活用し、クエリごとに少ないパラメータを活性化することで効率を高めている。gpt-oss-120bは、1170億の総パラメータのうち、トークンごとに51億のみを使用する。
オープンモデルは、高計算強化学習(RL)でトレーニングされ、Nvidia GPUクラスタを使用してシミュレーション環境でAIの意思決定を洗練させるポストトレーニング手法である。これはOpenAIのoシリーズのトレーニングを反映し、応答を推論するために追加の時間とリソースを必要とする思考の連鎖プロセスを含む。
このトレーニングにより、オープンモデルはウェブ検索やPythonコード実行などのツールをサポートし、推論プロセス内でAIエージェントを強化することに優れている。ただし、テキストのみのタスクに限定され、OpenAIの他のモデルとは異なり、画像や音声の処理や生成はできない。
gpt-oss-120bとgpt-oss-20bモデルはApache 2.0ライセンスの下でリリースされ、企業はOpenAIからの料金や許可なしで収益化できる。
AI2のようなラボの完全オープンソースモデルとは異なり、OpenAIはオープンモデルのトレーニングデータを公開しない。これは、AIトレーニングでの著作権素材の不適切な使用を主張する進行中の訴訟の影響を受けた可能性がある。
OpenAIは、安全性の懸念に対処するためにオープンモデルのリリースを複数回延期した。標準的な安全プロトコルを超えて、同社は悪意のある行為者がgpt-ossをサイバー攻撃や生物・化学兵器の作成など有害な目的に微調整できるかどうかを評価した。
OpenAIおよび外部の評価者によるテストでは、gpt-ossは生物学的能力をわずかに強化する可能性があるが、微調整後でも同社の「高能力」危険閾値には達しないことがわかった。
OpenAIのモデルがオープンモデルの中でリードしている一方で、開発者はDeepSeekのR2やMetaの超知能ラボからの新しいオープンモデルのリリースを期待している。
関連記事
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした
AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
NEAのティファニー・ラック:企業はまだAIのROIに苦戦している
プレイヤーを読み込み中…今年初頭、シリコンバレーでは「トークン最大化」が話題を独占し、CEOたちは社員にAIの使用を最大化するよう促した。しかし、その熱狂はすぐに現実とぶつかった。ウーバーは報告によると、数ヶ月で年間AI予算を超過し、一部の企業は部門全体でClaudeのライセンスを削減し、メタは社内パフォーマンスランキングを廃止した。NEAパートナーのティファニー・ラックは、この興奮と実際のリターンのギャップを日々乗り越えている。以前はECが未来であると企業を説得した経験を持つ彼女は、現在、
関連特集おすすめ
コメント (2)
0/500
OpenAI qui met ses modèles en libre accès sur Hugging Face, c'est assez inattendu venant d'eux... À la fois je suis impressionné par la performance revendiquée, et légèrement inquiet de la concurrence déloyale que ça pourrait créer pour les petits joueurs. Mais bon, en tant que développeur, je vais certainement télécharger et tester ça tout de suite ! 😄
OpenAIは火曜日に、oシリーズに匹敵する能力を持つ2つのオープンウェイトAI推論モデルを公開した。両モデルはHugging Faceで無料ダウンロード可能で、OpenAIはオープンモデルの複数のベンチマークで「トップパフォーマンス」と称している。
モデルは2つのバリエーションで提供される:単一のNvidia GPUで動作する堅牢なgpt-oss-120bと、16GBのメモリを搭載した標準的なラップトップで動作する軽量なgpt-oss-20b。
このリリースは、5年以上前に導入されたGPT-2以来、OpenAI初のオープン言語モデルである。
ブリーフィングで、OpenAIはオープンモデルが複雑なクエリを処理するために、より先進的なクラウドベースのAIシステムに接続可能であると述べ、TechCrunchが以前報じた。この機能により、開発者は必要に応じて画像処理などのタスクのためにOpenAIの独自モデルにオープンモデルをリンクできる。
OpenAIは当初オープンソースAIモデルを採用していたが、主に独自開発モデルに移行し、企業や開発者にAPIアクセスを提供することで繁栄するビジネスを築いた。
1月、CEOのSam Altmanは、OpenAIがオープンソース技術の優先順位を誤った可能性があると認めた。同社は現在、DeepSeek、AlibabaのQwen、Moonshot AIなどの中国のAIラボからの激しい競争に直面しており、これらは高性能なオープンモデルで注目を集めている。(MetaのLlamaモデルは、かつてオープンAI分野のリーダーだったが、過去1年間で遅れをとっている。)
7月、トランプ政権は、米国の価値観に沿ったAIを世界的に推進するために、米国のAI開発者にオープンソース技術を増やすよう奨励した。
テックとVCリーダーがDisrupt 2025を牽引
Netflix、ElevenLabs、Wayve、Sequoia CapitalがDisrupt 2025のアジェンダに名を連ね、スタートアップの成功とイノベーションを推進する洞察を共有する。TechCrunch Disruptの20周年記念を見逃すな。テック界のトップボイスから学ぶチャンス—今すぐチケットを確保して、8月7日に価格が上がる前に最大675ドル節約しよう。
テックとVCリーダーがDisrupt 2025を牽引
Netflix、ElevenLabs、Wayve、Sequoia CapitalがDisrupt 2025のアジェンダに名を連ね、スタートアップの成功とイノベーションを推進する洞察を共有する。TechCrunch Disruptの20周年記念を見逃すな。テック界のトップボイスから学ぶチャンス—今すぐチケットを確保して、最大675ドル節約しよう。
サンフランシスコ | 2025年10月27-29日 登録は今すぐgpt-ossで、OpenAIは開発者を引きつけ、トランプ政権の推進に沿い、両者がオープンソース分野での中国AIラボの台頭を指摘している。
「2015年の設立以来、OpenAIの使命は全人類の利益のためにAGIを進めることだった」とCEOのSam AltmanはTechCrunchへの声明で述べた。「米国の民主的価値観に根ざしたオープンAIフレームワークが、世界中で自由にアクセスでき、広く有益であることに興奮している。」

モデルパフォーマンスの概要
OpenAIは、オープンウェイトAIシステムの中でリードするようにオープンモデルを設計し、その目標を達成したと主張している。
Codeforcesの競技プログラミングテスト(ツール使用)では、gpt-oss-120bが2622、gpt-oss-20bが2516を記録し、DeepSeekのR1を上回ったが、o3とo4-miniには及ばなかった。

Humanity’s Last Exam、複数の科目をカバーする厳格なクラウドソーシングテスト(ツール使用)では、gpt-oss-120bとgpt-oss-20bがそれぞれ19%と17.3%を達成し、DeepSeekやQwenの主要なオープンモデルを上回ったが、o3には及ばなかった。

注目すべきは、OpenAIのオープンモデルは、最新の推論モデルo3やo4-miniよりも幻覚率が有意に高いことである。
幻覚はOpenAIの最近のAI推論モデルでより顕著になり、同社は原因を調査中であると認めた。ホワイトペーパーで、OpenAIは「世界知識が少ない小型モデルは、大規模なフロンティアモデルよりも多く幻覚することが予想される」と述べた。
PersonQA、個人の正確性を評価するOpenAIの内部ベンチマークでは、gpt-oss-120bとgpt-oss-20bはそれぞれ49%と53%で幻覚し、o1モデル(16%)の3倍以上、o4-mini(36%)よりも高かった。
新モデルのトレーニング
OpenAIは、オープンモデルが独自モデルと同様の技術を使用して開発されたと述べている。それぞれはエキスパートの混合(MoE)アプローチを活用し、クエリごとに少ないパラメータを活性化することで効率を高めている。gpt-oss-120bは、1170億の総パラメータのうち、トークンごとに51億のみを使用する。
オープンモデルは、高計算強化学習(RL)でトレーニングされ、Nvidia GPUクラスタを使用してシミュレーション環境でAIの意思決定を洗練させるポストトレーニング手法である。これはOpenAIのoシリーズのトレーニングを反映し、応答を推論するために追加の時間とリソースを必要とする思考の連鎖プロセスを含む。
このトレーニングにより、オープンモデルはウェブ検索やPythonコード実行などのツールをサポートし、推論プロセス内でAIエージェントを強化することに優れている。ただし、テキストのみのタスクに限定され、OpenAIの他のモデルとは異なり、画像や音声の処理や生成はできない。
gpt-oss-120bとgpt-oss-20bモデルはApache 2.0ライセンスの下でリリースされ、企業はOpenAIからの料金や許可なしで収益化できる。
AI2のようなラボの完全オープンソースモデルとは異なり、OpenAIはオープンモデルのトレーニングデータを公開しない。これは、AIトレーニングでの著作権素材の不適切な使用を主張する進行中の訴訟の影響を受けた可能性がある。
OpenAIは、安全性の懸念に対処するためにオープンモデルのリリースを複数回延期した。標準的な安全プロトコルを超えて、同社は悪意のある行為者がgpt-ossをサイバー攻撃や生物・化学兵器の作成など有害な目的に微調整できるかどうかを評価した。
OpenAIおよび外部の評価者によるテストでは、gpt-ossは生物学的能力をわずかに強化する可能性があるが、微調整後でも同社の「高能力」危険閾値には達しないことがわかった。
OpenAIのモデルがオープンモデルの中でリードしている一方で、開発者はDeepSeekのR2やMetaの超知能ラボからの新しいオープンモデルのリリースを期待している。
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした
AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
NEAのティファニー・ラック:企業はまだAIのROIに苦戦している
プレイヤーを読み込み中…今年初頭、シリコンバレーでは「トークン最大化」が話題を独占し、CEOたちは社員にAIの使用を最大化するよう促した。しかし、その熱狂はすぐに現実とぶつかった。ウーバーは報告によると、数ヶ月で年間AI予算を超過し、一部の企業は部門全体でClaudeのライセンスを削減し、メタは社内パフォーマンスランキングを廃止した。NEAパートナーのティファニー・ラックは、この興奮と実際のリターンのギャップを日々乗り越えている。以前はECが未来であると企業を説得した経験を持つ彼女は、現在、
OpenAI qui met ses modèles en libre accès sur Hugging Face, c'est assez inattendu venant d'eux... À la fois je suis impressionné par la performance revendiquée, et légèrement inquiet de la concurrence déloyale que ça pourrait créer pour les petits joueurs. Mais bon, en tant que développeur, je vais certainement télécharger et tester ça tout de suite ! 😄





家






