オプション
ニュース
DeepseekのR1およびV3コーディングスキルをテストしました:私たちはまだ運命づけられていません

DeepseekのR1およびV3コーディングスキルをテストしました:私たちはまだ運命づけられていません

2025年4月17日
344

DeepSeekの紹介:AIアリーナの新参者

DeepSeekは週末に突如登場し、3つの魅力的な理由で世界中の注目を集めました:

  • 中国発のAIチャットボットで、通常の米国発の製品とは一線を画しています。
  • オープンソースであり、テックコミュニティにとって大きな意味を持ちます。
  • 重量級の競合他社よりも大幅に少ないインフラで動作し、多くの人にとって魅力的な選択肢となっています。

米国政府がTikTokやそのコードに中国政府が関与している可能性について厳しい監視を行っている中、DeepSeekが中国から登場したことで当然注目が集まっています。ただし、ここでは政治には触れません。代わりに、DeepSeek V3とDeepSeek R1がコーディングタスクで他のAIモデルとどのように競合するかを見ていきましょう。

DeepSeek自身のガイダンスによると:

  • 複雑な数学問題の解決や複雑なコード生成など、深さと正確さが求められるタスクにはV3を選びましょう。
  • カスタマーサポートの自動化や基本的なテキスト処理など、迅速で大量のアプリケーションが必要な場合はR1を選びましょう。

チャットインターフェースの小さなボタンでR1とV3を切り替えることができます。ボタンが青い場合はR1を使用しています。

David Gewirtz/ZDNETによるスクリーンショット

David Gewirtz/ZDNETによるスクリーンショット

では、結果はどうだったでしょうか?両モデルとも有望な結果を示しましたが、完璧ではありませんでした。結果を探ってみましょう。

テスト1:WordPressプラグインの作成

妻がオンライングループ用の参加デバイスを管理するWordPressプラグインを必要としていたことにインスパイアされた最初のテストは、クラシックなものでした。プラグインは名前のリストを受け取り、並べ替え、重複が隣り合わないようにする必要がありました。この課題は多くのAIに投げかけてきましたが、難しいものです。

David Gewirtz/ZDNETによるスクリーンショット

David Gewirtz/ZDNETによるスクリーンショット

DeepSeek V3は完璧にクリアし、要件を完全に満たすユーザーインターフェースとプログラムロジックを作成しました。R1は異なるアプローチを取り、コードを共有する前に4502語もの分析を提供しました。UIはより広範でしたが、UIもロジックも機能したため、R1も合格しました。

David Gewirtz/ZDNETによるスクリーンショット

David Gewirtz/ZDNETによるスクリーンショット

David Gewirtz/ZDNETによるスクリーンショット

David Gewirtz/ZDNETによるスクリーンショット

これまでのところ、V3とR1は4つのテストのうち1つを合格しました。

テスト2:文字列関数の書き換え

ユーザーが寄付フィールドにドルとセントを入力するのに問題があり、元のコードではそれが許可されていませんでした。タスクは両方を許可するようにルーチンを変更することでした。DeepSeekは機能するコードを生成しましたが、改善の余地があります。

V3のコードは長すぎて繰り返しが多く、R1のコード生成前の推論も長かったです。両モデルとも小数点以下2桁まで検証しましたが、非常に大きな数値の処理は得意ではありませんでした。R1がJavaScriptのNumber変換を使用し、エッジケースをチェックしなかったため、クラッシュする可能性があります。

興味深いことに、R1はテストケースの優れたリストを提供しました:

David Gewirtz/ZDNETによるスクリーンショット

David Gewirtz/ZDNETによるスクリーンショット

V3はコードがクラッシュせず、期待通りの結果を出すため、ポイントを獲得します。R1は非文字列入力によるクラッシュの可能性があるため失敗です。これでV3は4つのテスト中2勝、R1は1勝です。

テスト3:厄介なバグの追跡

このテストは私が苦労して見つけたバグに由来します。エラーメッセージに基づく明らかな答えが間違っており、AIをしばしば騙します。解決にはWordPress APIコールを理解し、エラーメッセージを越えて見て、バグを特定する必要があります。

V3とR1はほぼ同じ答えでこのテストに合格し、V3は4つのテスト中3勝、R1は2勝となりました。DeepSeekはすでにGemini、Copilot、Claude、Metaを上回っています。

テスト4:スクリプトの作成

このテストは、AppleScript、Chromeオブジェクトモデル、Keyboard Maestroの3つの環境が関わるため難しいです。ChatGPTはこれを完璧にこなしましたが、DeepSeek V3とR1は不十分でした。どちらのモデルもKeyboard MaestroとChromeのタスク分割の必要性を理解せず、AppleScriptの知識も弱かったです。

R1は、フロントウィンドウが常に存在し、実行中のプログラムが常にChromeであるという誤った前提を立てました。これにより、V3は3つのテストに合格し1つ失敗、R1は2つのテストに合格し2つ失敗しました。

最終的な感想

DeepSeekがGmailのようなパブリッククラウドメールを使用することを強制し、企業ドメインを認めなかったのは苛立たしいものでした。テストに予想以上の時間がかかる応答性の問題もありました。

当初、このエラーでサインアップに苦労しました:

DeepSeekのオンラインサービスは最近、大規模な悪意ある攻撃に直面しています。サービスの継続を確保するため、登録は一時的に+86の電話番号に制限されています。既存のユーザーは通常通りログインできます。ご理解とご支援に感謝します。

ログイン後、テストを実行できました。DeepSeekのコードは冗長な傾向があります。テスト4のAppleScriptは不正確で不必要に長かったです。テスト2の正規表現はもっとメンテナンスしやすかったはずですが、V3は正しく処理しました。

V3がGemini、Copilot、Metaを上回ったのは印象的ですが、旧GPT-3.5レベルにとどまっており、成長の余地があります。R1のパフォーマンスは失望でした。選択肢があるなら、プログラミングの助けにはChatGPTを選びます。

それでも、はるかに少ないインフラで動作する新しいツールとして、DeepSeekは注目すべき存在です。

あなたの意見はどうですか?DeepSeekを試しましたか?プログラミング支援にAIを使っていますか?以下のコメントで教えてください。

ソーシャルメディアで私の毎日のプロジェクト更新をフォローし、毎週のニュースレターを購読し、Twitter/Xの@DavidGewirtz、FacebookのFacebook.com/DavidGewirtz、InstagramのInstagram.com/DavidGewirtz、Blueskyの@DavidGewirtz.com、YouTubeのYouTube.com/DavidGewirtzTVで私とつながってください。

関連記事
Anthropic、ClaudeのAIコーディングツールを日本に拡大し、海外成長を促進 Anthropic、ClaudeのAIコーディングツールを日本に拡大し、海外成長を促進 Anthropic、米国の主要な人工知能企業は、グローバルな展開を強化している。水曜日、同社は東京で「Code with Claude」と題された大規模な開発者向けイベントを開催し、約500人のソフトウェアエンジニアが集まった。この取り組みは、Claude AIツールおよび関連製品を日本市場に積極的に導入することを目的としており、自律的なコーディング機能による企業生産性の向上という中核的な利点を強調している。自動化されたコード生成への重点本イベントにおいて、Anthropicは複雑なプログラ
インドのソフトウェア大手が採用を縮小し、AI エージェントの拡大に伴い解雇はないと約束 インドのソフトウェア大手が採用を縮小し、AI エージェントの拡大に伴い解雇はないと約束 人工知能が従来の労働集約型ビジネスモデルを再構築する中、インドを代表するソフトウェアアウトソーシング企業であるタタ・コンサルテーション・サービスズ(TCS)は、その戦略的対応を明らかにしました。火曜日の定時株主総会において、会長は人間と機械の協働に関するビジョンを提示し、AI時代における同社の workforce 戦略を明確にしました。人員整理は行わないが、採用は鈍化TCSの会長は、AI導入により人員整理を行う計画はないものの、全体的な採用ペースは鈍化すると明確に述べました。TCSは以前、1
中国はGaokam中にAIモデルをロックし、即時の宿題支援をブロックしている 中国はGaokam中にAIモデルをロックし、即時の宿題支援をブロックしている 2026年の大学入試(Gaokao)が間近に迫る中、試験期間中にAIツールの利用停止に関する噂がインターネット上で激しい議論を巻き起こしている。世間の懸念に応えるため、主要なAIプラットフォームおよび教育アプリは、完全な禁止ではなく、試験関連機能に対して対象を絞った「時間制限ロック」を実施する方針を明らかにした。これらのプラットフォームは、正確な時間ベースの制御メカニズムを採用している。公式の試験時間中には、写真による問題解決や問題分析などの機能が一時的に無効化される。しかし、日常の会話機能や
関連特集おすすめ
デザインとアート クリエイティブな実験に最適なAIスタイル転送ツール
クリエイティブな実験に最適なAIスタイル転送ツール

2026年版 クリエイティブな実験に最適な、最新・最高評価のAIスタイル転送ツール!XIX.AIは、実地テストと厳格なランキングを通じて卓越した結果をもたらす、強力で画期的な「必試」ツールを厳選しました。これらのトップソリューションは、コンテンツ制作を加速させ、無限の創造的可能性を切り拓くことで、クリエイターの生産性を大幅に向上させます。 今すぐチェックして、あなたにぴったりのツールを見つけ、今日から創作を始めましょう!

9 ツール
xix.ai
漫画制作 ビジュアルストーリーテリングに最適なAI吹き出しツール
ビジュアルストーリーテリングに最適なAI吹き出しツール

2026年版、ビジュアルストーリーテリングに最適な高評価AIダイアログバブルツールがXIX.AIに登場!この厳選コレクションには、クリエイターの生産性を高め、創作上のボトルネックを解消する、画期的な強力ツールが揃っています。 無料版と有料版の比較、実地テストの結果、最新のランキングを確認して、魅力的なビジュアルストーリーを構築するのに最適な、ぜひ試すべきソリューションを見つけましょう。今すぐチェックして、あなたにぴったりのツールを発見してください!

10 ツール
xix.ai
ミーティングアシスタント AI会議要約ツールのトップ選定:決定事項とフォローアップを明確に把握
AI会議要約ツールのトップ選定:決定事項とフォローアップを明確に把握

2026年版:意思決定の追跡を明確にし、フォローアップを容易にする、高評価のAI会議要約ツールベストセレクション。この厳選リストでは、会議メモの自動化、重要なアクション項目の特定、すべてのプロジェクトにわたるチーム連携の効率化を通じて、生産性を劇的に向上させる、強力で画期的なソリューションをご紹介します。 無料版と有料版の比較、実地テストの結果、毎週更新されるランキングを参考に、最適なツールを見つけてください。今すぐチェックして、AIの力を最大限に活用しましょう!

9 ツール
xix.ai
データ分析 最強のAIデータクリーニングツール:欠損値や重複データを迅速に修正
最強のAIデータクリーニングツール:欠損値や重複データを迅速に修正

2026年最新かつ最も評価の高いAIデータクリーニングツールをご紹介。欠損値や重複データを迅速に修正できるこれらのツールは、生産性を大幅に向上させる強力なソリューションです。各ツールは信頼性を確保するため、厳格な実環境でのテストを経ています。無料版と有料版の比較情報もご用意しており、あなたのニーズに最も合ったツールを見つけ出せます。今すぐXIX.AIで詳細を確認し、AI活用の強みを最大限に引き出しましょう。

11 ツール
xix.ai
デザインとアート アーティストのための最高のAIクリエイティブアイディエーションツール:ビジュアルブロックを打破する
アーティストのための最高のAIクリエイティブアイディエーションツール:ビジュアルブロックを打破する

2026年最新版・最高評価のAIクリエイティブ発想ツールは、XIX.AIによって厳選され、クリエイターが視覚的な壁を打破し、創造性を即座に高めることを支援します。これらの革新的なツールは、実際のテスト結果、無料版と有料版の詳細比較、そして週次更新されるランキングを提供しています。コンテンツ制作を加速し、AIによる優位性を解き放つための最適なツールを見つけてください。今すぐ探索しましょう!

14 ツール
xix.ai
作曲 TikTokのBGM、Reelsの音声、クリエイター向けプロモーション音楽向けのAIビートメーカー
TikTokのBGM、Reelsの音声、クリエイター向けプロモーション音楽向けのAIビートメーカー

2026年最新版!TikTokのBGM、Reelsの音声、クリエイター向けプロモーション音楽に最適なAIビートメーカー集!XIX.AIは、あらゆるコンテンツのニーズに応える完璧な音楽を提供するため、実地テストを経て選りすぐられた、画期的な高機能ツールのランキングを厳選しました。 無料版と有料版の詳細な比較データ、毎週更新されるランキング、そして創造性と生産性を高めるためにぜひ試すべきツールが満載です。今すぐチェックして、あなたにぴったりのツールを見つけましょう!

11 ツール
xix.ai
コメント (16)
0/500
JonathanJackson
JonathanJackson 2026年9月4日 19:00:12 JST

DeepSeek's open-source approach is a game-changer for the AI landscape, challenging the US monopoly. It's refreshing to see innovation from China that prioritizes accessibility. While the coding skills are impressive, we must remain vigilant about potential security risks and ethical implications. This isn't the end of the world, but a new chapter in AI competition. Exciting times ahead!

PaulHernández
PaulHernández 2026年7月22日 19:00:23 JST

Interesting take! I've been messing around with DeepSeek's R1 and V3 for a few days, and honestly, the coding output is surprisingly solid for an open-source model. The fact that it's from China and not the usual US big players makes me wonder if we're entering a new phase of AI democratization. Still, I'm not ready to throw away my GPT-4 subscription just yet — let's see how it handles edge cases and long context. 😅

KennethRoberts
KennethRoberts 2026年5月27日 17:00:19 JST

Als Entwickler finde ich es super, dass jetzt auch China mit DeepSeek in den Open-Source-AI-Markt einsteigt. Die Coding-Tests klingen vielversprechend – vielleicht wird die Konkurrenz zwischen den Modellen ja endlich mal die Preise drücken. Hoffentlich bleibt das Projekt langfristig unabhängig und wird nicht von irgendwelchen Firmen vereinnahmt. 🤔

CarlCarter
CarlCarter 2025年9月6日 5:30:30 JST

DeepSeek这波操作有点东西啊!中国本土AI终于不再只擅长写诗和做饭了,居然在代码能力上也能和国外大模型掰手腕👏 不过开源这事...希望别过两天就变成'部分开源'吧😂

BruceGonzalez
BruceGonzalez 2025年8月25日 16:01:02 JST

DeepSeek's open-source approach is a game-changer! I'm stoked to see a Chinese AI shaking things up. The coding skills are solid, but I wonder how it’ll stack against giants like GPT in the long run. Exciting times! 🚀

JoseGonzalez
JoseGonzalez 2025年8月7日 15:33:00 JST

DeepSeek's open-source approach is super cool! It's wild to see a Chinese AI shaking up the game like this. I wonder how it'll stack up against ChatGPT in real-world coding tasks. Excited to try it out! 😄

OR