オプション
家
ニュース
新型「Gemini 3 Deep Think」がリリース、プログラミングおよび研究ランキングで首位を獲得 — これを上回るのはわずか7つだけ

新型「Gemini 3 Deep Think」がリリース、プログラミングおよび研究ランキングで首位を獲得 — これを上回るのはわずか7つだけ

2026年6月25日
143

Googleの「Gemini3Deep Think」が本日、大幅なアップデートを受けました。深層推論を目的として設計されたこのモデルは、プログラミングにおいてトップクラスの性能を発揮するだけでなく、科学研究や高度なエンジニアリングの分野でも新記録を樹立し、AIの推論能力において飛躍的な進歩を遂げました。

image.png

Gemini3Deep Thinkの主な成果:

プログラミングの卓越性:アルゴリズム競技プラットフォーム「Codeforces」において、3455という驚異的なEloスコアを記録しました。これはトップクラスの人間競合者と同等の水準であり、これを上回れるのは世界中でわずか7名のみです。参考までに、1年前の最強モデル「o3」のスコアは2727でした。

科学研究における強力な頭脳:このモデルは厳密な論理的推論能力を発揮し、人間の査読者でさえ見落としていた、高度な物理学および数学の論文に含まれる微妙な誤りを指摘した。また、「エルデシュ予想」に関連するいくつかの難問の証明にも成功した。

スケッチから実物製品へ:エンジニアリング分野では、手描きのスケッチを直接分析し、高精細な3Dモデルファイル(ノートパソコンスタンドなど)としてレンダリングすることができ、物理的な部品のモデリング効率を10倍に高めています。

ベンチマークテストにおける包括的な飛躍:「Last Human Exam(HLE)」で48.4%のスコアを記録し、ARC-AGI-2ベンチマークでは84.6%という驚異的な精度を達成し、ランキング首位に立った。

現在、Googleはこの新バージョンをAI Ultraの加入者に提供するとともに、初めて一部の研究者や企業に対してAPIへのアクセス権を付与しました。Geminiのこの大幅なアップグレードは、競合他社の推論モデルに対する強力な対抗策と見られています。

関連記事
Apple iOS 27 のリーク情報: Siri がローカル AI として Google Gemini を統合し、一部のリクエストは Google Cloud にルーティングされる Apple iOS 27 のリーク情報: Siri がローカル AI として Google Gemini を統合し、一部のリクエストは Google Cloud にルーティングされる 最近の報告により、人工知能におけるAppleとGoogleのパートナーシップの深さが明らかになった。次期iOS 27は、ローカルのエッジAI処理に焦点を当てることで、プライバシーを最優先する。ユーザーデータを損なうことなくパフォーマンスを向上させるため、Appleはナレッジディストリビューションを採用し、Googleの堅牢なGemini大規模言語モデルを活用して独自の軽量エッジAIを訓練している。このディストリビューション手法は、大規模モデルから小規模モデルへ洞察を転送し、デバイス上のAIが大
Anthropicは、2026年のIPOを見据え、マースクの市場総額に迫る6倍の収益成長を記録している。 Anthropicは、2026年のIPOを見据え、マースクの市場総額に迫る6倍の収益成長を記録している。 まだ上場していないにもかかわらず、AIスタートアップのAnthropicは予測市場で活発な取引を活発化させています。最新のPolymarketのデータによると、投資家はAnthropicがElon MuskのSpaceXを抜き、2026年に世界最大のIPOとなるタイトルを獲得すると予想しています。この確率は44%まで上昇し、SpaceXの55%に次ぐ数字となっています。先週に至るまで、SpaceXはこの競争で圧倒的なリードを維持していました。この急速な収束と市場関心の高まりは、Anthropi
米国の軍事請負業者、制限の強化と紛争を背景にClaudeモデルの段階的廃止へ 米国の軍事請負業者、制限の強化と紛争を背景にClaudeモデルの段階的廃止へ 米国の防衛技術企業が、矛盾する規制政策によりサプライチェーンの混乱に直面していることが、TechCrunch の報道で明らかになった。米軍が運用支援のために Anthropic の Claude を引き続き利用している一方で、トランプ政権による重複する禁令により、多くの防衛契約企業が同システムからの移行を加速させている。新たな指針により、民間機関は直ちに Anthropic の製品の使用を停止するよう求められており、国防総省には 6 か月の移行期間が与えられている。しかし、米国とイラン間の緊張関
関連特集おすすめ
健康とウェルネス おすすめのAI食事計画アプリ:よりスマートな栄養管理習慣を築こう
おすすめのAI食事計画アプリ:よりスマートな栄養管理習慣を築こう

2026年最新版:よりスマートな栄養管理習慣を築くための、高評価のAI食事プランニングアプリトップ選。この厳選リストには、実地テストを経て毎週更新されるランキングを掲載した強力なツールが揃っています。無料版と有料版の比較も掲載されており、生産性を高め、手間なくバランスの取れた食事を作れる「必見のソリューション」選びに役立ちます。 今すぐ XIX.AI をチェックして、AI の力を活用しましょう。

12 ツール
xix.ai
SEO 小規模チーム向けトップクラスのAI SEO監査ツール:ランキングが低下する前に問題を解決しよう
小規模チーム向けトップクラスのAI SEO監査ツール:ランキングが低下する前に問題を解決しよう

2026年、小規模チーム向けに最も高評価を得ている最新のAI SEO監査ツールがXIX.AIで登場しました!こちらに掲載されている厳選されたツール群は、隠れた問題を迅速に解決し、検索順位を向上させ、作業時間を節約するのに役立ちます。無料版と有料版の比較情報や実際のテスト結果もご用意しているので、ご自身のニーズに最適なオプションを選ぶことができます。今すぐご覧いただき、理想的なツールを見つけて、AIによる競争優位性を手に入れましょう。

11 ツール
xix.ai
テキスト読み上げ 長時間のナレーション用 AI ポッドキャスト音声クローンツール
長時間のナレーション用 AI ポッドキャスト音声クローンツール

2026年最新版・最高評価のAIポッドキャスト音声クローンツール【長編ナレーション向け】がXIX.AIにて公開!本セレクションは、プロ品質のオーディオをゼロの労力で提供し、業界を変える強力なソリューションを特集しています。私たちは実際のテストを実施し、無料版と有料版の比較、さらに週替わりで更新されるランキングを提供することで、あなたの生産性を大幅に向上させる「ぜひ試すべき」ツールを見つけるお手伝いをします。今すぐ探索して、AIによる優位性を解き放ちましょう!

10 ツール
xix.ai
SEO 最高のAI内部リンクツール:手作業を減らしてコンテンツハブを成長させる
最高のAI内部リンクツール:手作業を減らしてコンテンツハブを成長させる

2026年最新版・最高評価のAI内部リンク作成ツールトップ10:コンテンツハブ向け厳選リスト。このリストは、手作業を大幅に削減する革新的なソリューションを紹介しています。XIX.AIは実際のテストを実施し、無料版と有料版の詳細比較および毎週更新されるランキングを提供しており、生産性を高めコンテンツ戦略を加速させるべきツールを見つけるお手伝いをします。今すぐチェックして、AIによる優位性を手に入れましょう!

10 ツール
xix.ai
デザイン ウェブおよびモバイルプロジェクト向けのAI UIデザインツール
ウェブおよびモバイルプロジェクト向けのAI UIデザインツール

2026年現在、ウェブおよびモバイルプロジェクト向けの最も優れたAI UIデザインツールがXIX.AIでご紹介されています!こちらの厳選リストには、創造性と生産性を高めるための画期的な成果をもたらすよう、厳格な実際の環境でのテストを経た高評価の強力なツールが掲載されています。また、無料版と有料版の比較情報、毎週更新されるランキング、そして詳細な分析もご覧いただけます。ぜひ試してみるべきツールたちは、デザイン上の課題を克服し、より迅速に高品質なインターフェースを作成するのに役立ちます。今すぐチェックして、あなたに最適なツールを見つけてみましょう!

8 ツール
xix.ai
プロンプト トップクラスのプロンプトエンジニアリングツール:チーム用プロンプトのテスト、バージョン管理、改善
トップクラスのプロンプトエンジニアリングツール:チーム用プロンプトのテスト、バージョン管理、改善

XIX.AIでは、2026年最新のチーム向け高評価プロンプトエンジニアリングツールを厳選して紹介しています。この厳選コレクションには、厳格な実地テストを経て、業界に革新をもたらす強力なツールが揃っています。 無料版と有料版の比較、詳細なランキングに加え、チームのプロンプトを簡単にテスト・バージョン管理・改良し、生産性を大幅に向上させるツールも掲載されています。今すぐチェックして、あなたにぴったりのツールを見つけましょう!

9 ツール
xix.ai
コメント (1)
0/500
WillPerez
WillPerez 2026年7月8日 3:00:15 JST

I've been testing Gemini 3 Deep Think for a few days, and honestly, it's mind-blowing how it handles complex code refactoring. But I wonder if this level of compute is sustainable for everyday developers? 🤔

OR