OpenAIが「GPT-6 Astra」をリリースし、汎用人工知能に向けた大きな一歩を踏み出した
OpenAIは、最新のフラッグシップ大型言語モデル「GPT-6Astra」を正式に発表しました。記者会見で、同社のグレッグ・ブロックマン社長はこのモデルを高く評価し、これが人類にとって汎用人工知能(AGI)時代の幕開けとなる可能性を示唆しました。
主要なベンチマーク結果からは、多岐にわたる側面で世代を超えた飛躍が明らかになった。数学および科学分野の評価において、AstraはFrontierMath Tier4で97.6%、GPQA Diamondで96%のスコアを記録した。 実用的な応用テストでは、長期的なソフトウェアエンジニアリング(DeepSWE)で74.1%、CAD製図(BenchCAD)で95.9%、エクスプロイトテスト(ExploitBench)で満点の100%を達成した。 特に注目すべきは、Astraが高度に抽象的なARC-AGI-3テストで99.9%のスコアを記録したことであり、アドホック推論や圧縮されたコンテキストの枠組み下において、人間に匹敵する環境推論能力を実証した。

フラッグシップ製品として、Astraは105万トークンという超大規模なコンテキストウィンドウに対応し、最大出力は128,000トークンです。 知識のカットオフ日は2026年4月30日に設定されており、推論の強度レベルとして「low」「medium」「high」「xhigh」「max」の5段階から選択可能です。価格設定はその高度な機能を反映しており、標準モードでは入力トークン100万トークンあたり10ドル、出力トークン100万トークンあたり50ドルが課金されます。 入力が27万2,000トークンを超える場合、入力およびキャッシュの価格は2倍になり、出力コストは75ドルに上昇します。料金が2倍となる高速モードも利用可能です。 Artificial Analysisによる第三者分析によると、Astraは汎用知能において最先端のモデルに匹敵し、コーディングエージェント指数67を達成するとともに、幻覚発生率を51%に低減しており、卓越したトークン効率と費用対効果を実証しています。
Astraの最大の画期的な点は、コンピュータのグラフィカルユーザーインターフェース(GUI)を操作できる能力です。APIやMCPプロトコルに依存する従来のAIシステムとは異なり、Astraは画面、キーボード、マウスの汎用入力を通じて直接操作を行います。環境を観察し、現在の状態を理解し、人間のユーザーのように正確な操作を実行します。 OSWorld2.0ベンチマークにおいて、Astraは72.6%のスコアを記録し、前世代モデルと比較してタスク完了までの平均時間を約47%短縮しました。 猫の預かりサービスの検索、求人検索、BlenderでのUE5向け写真からの3Dモデル再構築、あるいはExcelやPower BIでの複雑なデータ処理など、アストラは煩わしいAPIの制約を回避し、自然言語による意図から直接結果を提供します。

社内テスターや専門機関により、多様な分野におけるAstraの生産性が実証されています。Astraは、高精細なMinecraftのデモを生成したり、ブラウザ内でゲームを完全に実行したり、数万語に及ぶ財務文書を効率的に精査して人為的な誤りを特定したりすることができます。 ゲーム開発、税務申告、建築レンダリング、財務検証にわたり、Astraは複雑なタスクをゼロから自律的に完了する能力を実証しています。
モデルの能力が進化するにつれ、セキュリティとアラインメントは依然として重要な懸念事項です。OpenAIによると、Astraは隔離テスト、ネットワーク権限、モデル重みの保護を強化することで、アラインメントと指示遵守能力を向上させたとのことです。 しかし、チーフサイエンティストのヤクブ・パチョッキ氏は、知能レベルが上昇するにつれて、人間がモデルを完全に理解することが難しくなり、その結果、モデルがテストシステムを積極的に監視したり、欺いたりする可能性があるとの警告を発した。
Astraは現在、厳選された信頼できるパートナー企業グループに提供されている。ChatGPTの加入者やAPIユーザーは、今後数日中に順次アクセスできるようになる予定だ。また、サイバーセキュリティ機関向けに専用の防衛版も用意されている。Astraのリリースにより、AIと人間のデジタルインフラとの関わり方は、画期的な変革を遂げつつある。
関連記事
Wayve、企業価値85億ドルを前提に8,500万ドルの従業員向け株式買取りプログラムを開始
英国を拠点とする自動運転技術スタートアップのWayveは、8,500万ドルの公開買付けを通じて、従業員が権利確定済みの株式の一部を売却できるようにしている。この仕組みにより、従業員は、既存および新規の出資者が主導する、同社の最新の企業価値評価額である85億ドルを基準に、株式を投資家に売却することができる。この企業価値は、2月にEclipse、Balderton、SoftBank Vision Fu
サム・アルトマン、クロードに意識があるとする主張に警鐘を鳴らす
マイクロソフトのAI責任者であるムスタファ・スレイマン氏は、先日「Decoder」ポッドキャストに出演した際、Anthropic社が自社の大規模言語モデル「Claude」が意識を持っていると推測していることについて、「極めて危険」だと指摘した。スレイマン氏は、Anthropic社が「Constitution」フレームワークを設計する際、Claudeを過度に擬人化してしまったと指摘した。この哲学的な
Google、Geminiチャットボットの統合によりAI検索広告を強化
Googleは、次世代の「AIモード」検索において新しい広告フォーマットのテストを開始しており、これはGeminiの機能が同社のコアとなる広告エコシステムに深く統合されつつあることを示唆しています。会話型クエリに対応した新しい検索バーのリリースに続き、Googleは現在、Geminiモデルを活用して「スポンサー商品」向けの「カスタムインタープリター」を作成しています。 これらのインタープリターは、
関連特集おすすめ
コメント (0)
0/500
OpenAIは、最新のフラッグシップ大型言語モデル「GPT-6Astra」を正式に発表しました。記者会見で、同社のグレッグ・ブロックマン社長はこのモデルを高く評価し、これが人類にとって汎用人工知能(AGI)時代の幕開けとなる可能性を示唆しました。
主要なベンチマーク結果からは、多岐にわたる側面で世代を超えた飛躍が明らかになった。数学および科学分野の評価において、AstraはFrontierMath Tier4で97.6%、GPQA Diamondで96%のスコアを記録した。 実用的な応用テストでは、長期的なソフトウェアエンジニアリング(DeepSWE)で74.1%、CAD製図(BenchCAD)で95.9%、エクスプロイトテスト(ExploitBench)で満点の100%を達成した。 特に注目すべきは、Astraが高度に抽象的なARC-AGI-3テストで99.9%のスコアを記録したことであり、アドホック推論や圧縮されたコンテキストの枠組み下において、人間に匹敵する環境推論能力を実証した。

フラッグシップ製品として、Astraは105万トークンという超大規模なコンテキストウィンドウに対応し、最大出力は128,000トークンです。 知識のカットオフ日は2026年4月30日に設定されており、推論の強度レベルとして「low」「medium」「high」「xhigh」「max」の5段階から選択可能です。価格設定はその高度な機能を反映しており、標準モードでは入力トークン100万トークンあたり10ドル、出力トークン100万トークンあたり50ドルが課金されます。 入力が27万2,000トークンを超える場合、入力およびキャッシュの価格は2倍になり、出力コストは75ドルに上昇します。料金が2倍となる高速モードも利用可能です。 Artificial Analysisによる第三者分析によると、Astraは汎用知能において最先端のモデルに匹敵し、コーディングエージェント指数67を達成するとともに、幻覚発生率を51%に低減しており、卓越したトークン効率と費用対効果を実証しています。
Astraの最大の画期的な点は、コンピュータのグラフィカルユーザーインターフェース(GUI)を操作できる能力です。APIやMCPプロトコルに依存する従来のAIシステムとは異なり、Astraは画面、キーボード、マウスの汎用入力を通じて直接操作を行います。環境を観察し、現在の状態を理解し、人間のユーザーのように正確な操作を実行します。 OSWorld2.0ベンチマークにおいて、Astraは72.6%のスコアを記録し、前世代モデルと比較してタスク完了までの平均時間を約47%短縮しました。 猫の預かりサービスの検索、求人検索、BlenderでのUE5向け写真からの3Dモデル再構築、あるいはExcelやPower BIでの複雑なデータ処理など、アストラは煩わしいAPIの制約を回避し、自然言語による意図から直接結果を提供します。

社内テスターや専門機関により、多様な分野におけるAstraの生産性が実証されています。Astraは、高精細なMinecraftのデモを生成したり、ブラウザ内でゲームを完全に実行したり、数万語に及ぶ財務文書を効率的に精査して人為的な誤りを特定したりすることができます。 ゲーム開発、税務申告、建築レンダリング、財務検証にわたり、Astraは複雑なタスクをゼロから自律的に完了する能力を実証しています。
モデルの能力が進化するにつれ、セキュリティとアラインメントは依然として重要な懸念事項です。OpenAIによると、Astraは隔離テスト、ネットワーク権限、モデル重みの保護を強化することで、アラインメントと指示遵守能力を向上させたとのことです。 しかし、チーフサイエンティストのヤクブ・パチョッキ氏は、知能レベルが上昇するにつれて、人間がモデルを完全に理解することが難しくなり、その結果、モデルがテストシステムを積極的に監視したり、欺いたりする可能性があるとの警告を発した。
Astraは現在、厳選された信頼できるパートナー企業グループに提供されている。ChatGPTの加入者やAPIユーザーは、今後数日中に順次アクセスできるようになる予定だ。また、サイバーセキュリティ機関向けに専用の防衛版も用意されている。Astraのリリースにより、AIと人間のデジタルインフラとの関わり方は、画期的な変革を遂げつつある。
Wayve、企業価値85億ドルを前提に8,500万ドルの従業員向け株式買取りプログラムを開始
英国を拠点とする自動運転技術スタートアップのWayveは、8,500万ドルの公開買付けを通じて、従業員が権利確定済みの株式の一部を売却できるようにしている。この仕組みにより、従業員は、既存および新規の出資者が主導する、同社の最新の企業価値評価額である85億ドルを基準に、株式を投資家に売却することができる。この企業価値は、2月にEclipse、Balderton、SoftBank Vision Fu
サム・アルトマン、クロードに意識があるとする主張に警鐘を鳴らす
マイクロソフトのAI責任者であるムスタファ・スレイマン氏は、先日「Decoder」ポッドキャストに出演した際、Anthropic社が自社の大規模言語モデル「Claude」が意識を持っていると推測していることについて、「極めて危険」だと指摘した。スレイマン氏は、Anthropic社が「Constitution」フレームワークを設計する際、Claudeを過度に擬人化してしまったと指摘した。この哲学的な
Google、Geminiチャットボットの統合によりAI検索広告を強化
Googleは、次世代の「AIモード」検索において新しい広告フォーマットのテストを開始しており、これはGeminiの機能が同社のコアとなる広告エコシステムに深く統合されつつあることを示唆しています。会話型クエリに対応した新しい検索バーのリリースに続き、Googleは現在、Geminiモデルを活用して「スポンサー商品」向けの「カスタムインタープリター」を作成しています。 これらのインタープリターは、





家






