オプション
ニュース
Gemini Pro 2.5:ChatGptに大きな脅威をもたらす強力なコーディングアシスタント

Gemini Pro 2.5:ChatGptに大きな脅威をもたらす強力なコーディングアシスタント

2025年4月19日
296

コーディング支援のためのAIを評価する際、私は4つの標準化されたテストを開発しました。これらのテストは、AIがあなたのプログラミング活動をどれだけサポートできるかを評価する上で非常に重要です。結局のところ、コードにさらにバグを追加するAIは必要ありませんよね?

少し前に、読者が私のアプローチに疑問を呈し、AIは異なる課題でより良いパフォーマンスを発揮するかもしれないと提案しました。それはもっともな意見ですが、私はこれらのテストにこだわっています。なぜなら、それらはシンプルだからです。私はPHPとJavaScriptを使用しています。これらは最も難しい言語ではありませんが、AIにいくつかのスクリプトクエリを実行させます。この一貫性により、パフォーマンスを直接比較できます。

テストには、シンプルなWordPressプラグインの作成、文字列関数の書き換え、私がかつて苦労したバグの特定、プログラミングツールを使用してChromeからデータを抽出することが含まれます。それは、誰かに運転を教えるようなものです。車庫から出られない人に高速道路を走らせることはありませんよね。

これまで、ChatGPTのGPT-4(およびそれ以上)のLLMだけがこれらのテストすべてに合格しました。興味深いことに、Perplexity Proも成功しましたが、それはGPT-4シリーズのLLMを使用しているからです。一方で、Microsoft Copilotは同じLLMを使用しているにもかかわらず、すべてのテストに失敗しました。

GoogleのGeminiもあまり良い結果を残していません。当初、Bard(Geminiの初期名称)はほとんどのテストに失敗し、月額20ドルのGemini Advancedでさえ、昨年は4つのテストのうち3つに失敗しました。

しかし、今、GoogleはGemini Pro 2.5を導入し、レート制限はあるものの誰でも無料で利用できます。私はテスト中にわずか2つのプロンプトでその制限に達してしまい、少し制約を感じました。レート制限はプロンプトの数ではなく、タスクの複雑さに基づいている可能性があります。最初の2つのリクエストは、完全なWordPressプラグインの作成とコードの修正で、単純なクエリよりも早く制限を消費した可能性があります。

待つ必要はありましたが、結果は驚くべきもので、待つ価値がありました。

テスト1:シンプルなWordPressプラグインの作成

今回、Gemini Pro 2.5は見事な成果を上げました。課題は、入力行をランダム化し、重複が隣接しないように分配するユーザーインターフェースを提供するWordPressプラグインを作成することでした。

以前、Gemini Advancedはバックエンドダッシュボードを作成せず、公開ページの本文にショートコードを必要としました。基本的なUIは作成しましたが、ボタンをクリックしても何も起こりませんでした。プロンプトをどう調整しても失敗でした。

しかし、Gemini Pro 2.5はしっかりしたUIを提供し、コードは意図した通りに動作しました。特に印象的だったのは、プラグインのアイコン選択です。ほとんどのAIはこの詳細を無視しますが、Gemini Pro 2.5は私のプロンプトなしでWordPress Dashiconセットから適切なアイコンを選びました。コードは十分にドキュメント化されており、主要なセグメントごとに明確に説明されていました。

randomizer-ui

デビッド・ゲウィルツ/ZDNETによるスクリーンショット

icon

デビッド・ゲウィルツ/ZDNETによるスクリーンショット

テスト2:文字列関数の書き換え

2番目のテストでは、Gemini Pro 2.5に整数だけでなくドルとセントを処理するように文字列処理コードを修正するよう依頼しました。ChatGPTはこれを正しく処理しましたが、Bardは当初失敗した後に最終的に成功しました。

前回、Gemini Advancedは微妙だが危険な方法で失敗しました。非小数入力を受け付けず、小数点前の桁数を誤って2桁に制限し、ドルとセントの概念を誤解していました。この種のエラーは、見逃せばバグ報告の洪水を引き起こす可能性があります。

しかし、Gemini Pro 2.5は完璧に処理しました。入力タイプを正しくチェックし、空白をトリミングし、先頭のゼロや小数のみの入力を処理する正規表現を修正し、負の入力を拒否しました。コードには十分なコメントが付けられ、完全なテスト例のセットが含まれていました。グループ化カンマや先頭の通貨記号は許可されていませんでしたが、これらは制御されたエラーであり、クラッシュではなかったので、合格と見なします。

テスト3:バグの特定

かつて、私はコードのバグに苦しみました。それは動作するはずなのに動作しませんでした。問題は厄介で、私がパラメータの数に注目していたとき、ChatGPTはフックで何かを変更する必要があると指摘しました。

BardとMetaはどちらも的外れで、私と同じ無駄な道をたどりました。2024年2月のGemini Advancedは、「おそらくプラグインまたはWordPressのどこか他に」問題があると提案しましたが、これは役に立ちませんでした。

Gemini Pro 2.5では、最初の2つのテストでレート制限に達したため、翌日まで待つ必要がありました。最終的にテストを実行したところ、Gemini Pro 2.5はバグを見つけただけでなく、修正箇所を正確に示し、役立つ図も提供しました。

limit

デビッド・ゲウィルツ/ZDNETによるスクリーンショット

map

デビッド・ゲウィルツ/ZDNETによるスクリーンショット

テスト4:スクリプトの作成

最後のテストは、Chromeの内部オブジェクトモデル、AppleScript、Keyboard Maestro(マクロ構築ツール)を理解することです。Chromeタブを開き、パラメータに基づいてアクティブなタブを設定します。

ほとんどのAIはChromeとAppleScriptの部分をうまく処理しますが、Keyboard Maestroで苦戦することが多いです。しかし、Gemini Pro 2.5はこれを正しく処理しました。変数を正しく渡すコードを書き、エラーチェックとユーザー通知を追加し、Keyboard Maestroの設定手順まで提供しました。

maestro

デビッド・ゲウィルツ/ZDNETによるスクリーンショット

4つのテストすべてに合格したGemini Pro 2.5は、プログラミングタスクを真に支援できるAIツールのエリートグループに加わりました。

GoogleのAIがOpenAIの提供に追いつくのは時間の問題でした。Googleの2017年の「Attention is all you need」論文が生成AIブームを引き起こしたので、彼らがこの時点に達したのは驚くことではありません。Gemini Pro 2.5はChatGPT Plusより遅く、応答に15秒から1分かかりますが、正確さがスピードよりも重要です。

Googleはまた、Google Code Assistを寛大な制限付きで無料にしましたが、生成されるコードの品質が高くなければ価値はありません。Gemini Pro 2.5ではその品質が明らかです。現在「実験的」とされていますが、Googleはすぐにこれを改良し、レート制限の少ない有料版を提供する可能性があります。

Gemini Pro 2.5がコーディング支援の分野でChatGPTに挑戦する準備ができていることは明らかです。この発展に注目し、近いうちにさらなる更新を共有します。

関連記事
フロリダ州が OpenAI およびサム・アルトマン氏を提訴、暴力的な事件を巡り フロリダ州が OpenAI およびサム・アルトマン氏を提訴、暴力的な事件を巡り フロリダ州司法長官は月曜日、OpenAIおよびCEOのサム・アルトマンに対して、同州で初めてとなる民事訴訟を提起し、同社のChatGPTが複数の暴力事件と関連しているとの主張を行った。訴訟状は、OpenAIが安全上の懸念を無視して「AI軍拡競争」での勝利と巨額の富の蓄積を優先したと主張している。「本日、OpenAIおよびそのCEO、サム・アルトマンに対して、州が主導する全国初の訴訟を提起したことを発表します。」とフロリダ州司法長官のジェームズ・ウスマイアーは述べた。「OpenAIとアルトマン
OpenAI、より自然なリアルタイム会話を実現する高度な音声モデルを発表 OpenAI、より自然なリアルタイム会話を実現する高度な音声モデルを発表 OpenAIは、より自然な話し口を実現し、会話のやり取りをより効果的に管理できるように設計された、新しい対話型モデル「GPT-Live-1」および「GPT-Live-1 mini」をリリースしました。これらの全二重通信モデルは、話すことと聞くことを同時に行うことができるため、ユーザーが自然に会話を割り込むことが可能になり、リアルタイム翻訳などの機能も利用できるようになります。また同社は、ChatG
OpenAI、モデルファミリーの最新版「GPT-5.6」を発表 OpenAI、モデルファミリーの最新版「GPT-5.6」を発表 OpenAIは木曜日、最新のモデルファミリーを発表し、競争が激化するAI業界に強力な新選択肢をもたらした。GPT-5.6には、「Sol」(主力モデルとして設計されたもの)、「Terra」(ミドルレンジのオプション)、「Luna」(コストパフォーマンスに優れた選択肢)の3つのバリエーションが用意されている。これらのモデルは多岐にわたる分野で機能を拡張しており、同社は企業向けタスク、コーディング、科学
関連特集おすすめ
書き込み 長文執筆のためのAI記事構成ツール
長文執筆のためのAI記事構成ツール

2026年最新・最高評価のAIアウトラインツール:長文執筆に最適!この厳選コレクションには、執筆効率を大幅に向上させる、実証済みのテストを経て正確かつ構造化されたアウトラインを生成する、強力で画期的なツールが紹介されています。XIX.AIもこの厳選されたツールの一つです。 無料版と有料版の比較表を入手して、最適なツールの選択に役立ててください。今すぐチェックして、AIの力を最大限に活用しましょう!

9 ツール
xix.ai
チャットボット 言語練習、面接対策、そして日常の流暢さのための最高のAIロールプレイチャットアプリ
言語練習、面接対策、そして日常の流暢さのための最高のAIロールプレイチャットアプリ

2026年最新版・最高評価のAIロールプレイチャットアプリ|語学練習、面接対策、日常会話の流暢さ向上に!XIX.AIは、無料と有料の比較、実世界でのテスト、毎週更新されるランキングを提供する革新的なコレクションを厳選しています。これらの必須ツールは、ライティングスキルの向上、流暢さの課題克服、そしてあらゆる日常シナリオにおけるコミュニケーション効率の改善をサポートします。今すぐ探索して、あなたの言語成長に最適なツールを見つけましょう!

10 ツール
xix.ai
作曲 リミックス制作、サンプリングの準備、カラオケマスター作成のためのAIステム分離ツール
リミックス制作、サンプリングの準備、カラオケマスター作成のためのAIステム分離ツール

2026年最新・最高評価のAIステム分離ツール。リミックス制作、サンプリング準備、カラオケマスター向けに厳選されました。これらの強力で画期的なツールは、実環境でのテストを経て、正確なオーディオ分離を実現し、生産性を大幅に向上させます。 XIX.AIでは、ニーズに合った「必試」のソリューションを見つけるお手伝いをするため、無料版と有料版の比較ガイドを毎週更新して提供しています。今すぐチェックして、AIの力を最大限に活用しましょう。

8 ツール
xix.ai
データ分析 収益ダッシュボード、ファネル分析、および製品指標向けのAI SQLコピロット
収益ダッシュボード、ファネル分析、および製品指標向けのAI SQLコピロット

2026年最新かつ最も優れたAI SQLコピロットが最高評価でランクイン!XIX.AIは、毎週更新される実際の環境でのテストに対応した、強力で革新的なツール群を厳選しています。これらの必見ツールを使えば、正確な収益ダッシュボードの作成や販売プロセスの分析、製品指標の迅速な追跡が可能となり、生産性を大幅に向上させることができます。今すぐチェックして、データに基づいた意思決定に最適なツールを見つけましょう!238文字

9 ツール
xix.ai
作曲 曲のドラフト作成に最適なAIメロディ作成ツール
曲のドラフト作成に最適なAIメロディ作成ツール

2026年最新版 高評価のAIメロディ作成ツールで曲のドラフト作成!XIX.AIは、厳格な実世界テストを経て最高の作成体験を提供する、革新的な強力なコレクションを厳選しました。詳細な無料版と有料版の比較、正確なランキング、そして素晴らしい曲のドラフトを楽に作成し、創造的な生産性を大幅に向上させるためにぜひ試すべきオプションが見つかります。今すぐ探索して、あなたに最適なツールを見つけましょう!

8 ツール
xix.ai
チャットボット 面接練習用のベストなAI会話トレーニングツール
面接練習用のベストなAI会話トレーニングツール

2026年最新版・最高評価のAI会話トレーニングツールが、面接練習に最適です。XIX.AIにてご提供しています!この厳選コレクションには、現実世界での厳格なテストを経て正確なフィードバックを提供する強力なツールが含まれています。無料版と有料版の比較や詳細なランキングをご覧いただき、自信とスキルを高めるための必須オプションをお選びください。今すぐ探索して、面接成功に最適なツールを見つけましょう!

12 ツール
xix.ai
コメント (26)
0/500
BrianWalker
BrianWalker 2026年6月27日 19:00:14 JST

Oh great, another AI coding assistant claiming to be a 'threat' to ChatGPT. 🙄 I'll believe it when I see it actually fixing my spaghetti code without introducing new bugs. Standardized tests? Sounds like marketing fluff to me. Show me the real-world results!

EricMiller
EricMiller 2026年6月15日 1:00:11 JST

Honestly, I've been burned by so-called "powerful" coding assistants before. The real test is whether it can refactor my spaghetti code without hallucinating imports. Gemini Pro 2.5 sounds promising, but I'll believe it when I see it on a real project 🤨

WalterHarris
WalterHarris 2026年5月28日 5:00:23 JST

Also ich hab's mal mit Python getestet und muss sagen, die Fehleranalyse ist echt krass. Aber ob das wirklich eine 'Bedrohung' für ChatGPT ist? Die haben doch beide ihre Nischen. Hauptsache, die Preise bleiben im Wettbewerb vernünftig 😅

MatthewScott
MatthewScott 2026年2月15日 15:00:57 JST

Como programador, siempre estoy buscando asistentes de IA confiables. Los cuatro tests estandarizados que describes suenan muy útiles, ¡debería probarlos con Gemini y ChatGPT! Si realmente supera en bugs, sería un cambio de juego. 🤔 ¿Habrá algún análisis de costo? A veces estas herramientas premium son caras.

JoseGonzalez
JoseGonzalez 2025年7月31日 10:42:05 JST

Just read about Gemini Pro 2.5 and wow, those coding tests sound intense! 😅 Curious if it’ll really outshine ChatGPT or just hype. Anyone tried it yet?

WalterLewis
WalterLewis 2025年7月28日 10:19:30 JST

This AI coding battle is heating up! Gemini Pro 2.5 sounds like a beast, but I’m curious if it’s really outpacing ChatGPT or just hype. 🤔 Anyone tried it on real projects yet?

OR