人類は、カスタマイズ可能な思考期間でAIモデルを発表します
Anthropicの最新AIモデル、Claude 3.7 Sonnetは、AIの世界に大きな変化をもたらしています。業界初の「ハイブリッドAI推論モデル」と呼ばれ、迅速な回答とより深い思考に基づく応答の両方を提供するように設計されています。質問に対してClaudeが「考える」時間を自分で選べるなんて、かなりクールですよね?
Claude 3.7 Sonnetのコンセプトは、AIの利用をとてもシンプルにすることです。さまざまなモデルから選ぶ必要をなくし、Anthropicは1つのモデルですべてを処理できるようにしたいと考えています。月曜日から、誰でもClaude 3.7 Sonnetを利用できますが、その高度な推論機能を使いたい場合は、Anthropicのプレミアムプランのいずれかに登録する必要があります。無料ユーザーでも、Anthropicによると前モデルClaude 3.5 Sonnetよりも優れた、しっかりしたバージョンのモデルを利用できます。
さて、コストについてですが、Claude 3.7 Sonnetは入力トークン100万あたり3ドル、出力トークン100万あたり15ドルかかります。これはOpenAIのo3-miniやDeepSeekのR1といった他のモデルより少し高価ですが、それらは推論モデルだけで、Claudeのようなハイブリッドモデルではないことを覚えておいてください。

Anthropicの新しい思考モード 画像提供:Anthropic Claude 3.7 Sonnetは、Anthropic初の「推論」モデルであり、AIの世界では大きな話題です。推論モデルは、質問に答えるのに少し時間と計算能力を要し、より正確な回答のために問題を小さなステップに分解します。人間の推論と全く同じではありませんが、それに倣ったものです。AnthropicはClaudeに大きな計画を持っています。最終的には、ユーザーが設定しなくても、Claudeが質問に対してどのくらい「考える」べきかを自分で判断できるようにしたいと考えています。Anthropicの製品および研究リーダーであるDianne Pennは、TechCrunchに対し、推論はフロンティアモデルが持つべき多くの機能の1つに過ぎないと語りました。
Claude 3.7 Sonnetでは、「見えるスクラッチパッド」を通じて、どのように回答を計画しているかを見ることができます。ほとんどの場合、その全プロセスが見えますが、Anthropicは安全上の理由で一部を編集する場合があります。

ClaudeアプリでのClaudeの思考プロセス 画像提供:Anthropic Anthropicによると、Claudeの思考モードは、難しいコーディング問題やある程度の自律性が必要なタスクなど、現実世界のタスク向けに微調整されています。AnthropicのAPIを利用する開発者は、Claudeがどのくらい「考える」かを制御でき、速度とコスト、回答の質のバランスを取ることができます。いくつかのテストでは、Claude 3.7 Sonnetはかなり良い成績を収めました。現実世界のコーディングタスクを評価するSWE-Benchでは62.3%を記録し、OpenAIのo3-mini(49.3%)を上回りました。また、小売環境でシミュレートされたユーザーや外部APIとの対話を測定するTAU-Benchでは、Claude 3.7 Sonnetは81.2%を記録し、OpenAIのo1モデル(73.5%)を上回りました。
Anthropicは、Claude 3.7 Sonnetは質問への回答拒否が少なくなり、有害と無害なプロンプトをより細かく区別するようになると述べています。Claude 3.5 Sonnetと比較して、不必要な拒否が45%減少しました。
Claude 3.7 Sonnetと同時に、AnthropicはClaude Codeという新しいツールも展開しています。これは、開発者がターミナルから直接Claudeを通じて特定のタスクを実行できる研究プレビューです。デモでは、Claude Codeが「このプロジェクト構造を説明して」といった簡単なコマンドでコーディングプロジェクトを分析できる様子が示されました。平易な英語を使ってコードベースを変更でき、Claude Codeは編集内容を説明し、エラーをテストし、プロジェクトをGitHubリポジトリにプッシュします。
Claude Codeは「先着順」で限られたユーザーに提供されます。
Anthropicは、AIラボが次々と新モデルをリリースする中でClaude 3.7 Sonnetをリリースします。Anthropicは通常、より慎重で安全性を重視したアプローチを取ってきましたが、今回はリードすることを目指しています。しかし、どれだけリードを維持できるかは誰にも分かりません。特に、OpenAIのCEO、Sam Altmanが「数か月後」に自社のハイブリッドAIモデルをリリースすると述べているからです。
関連記事
Anthropic、新しいダイナミックワークフローツールを搭載した「Opus 4.8」をリリース
Anthropicは木曜日、同社の主力パブリックモデルである「Opus 4.8」を発表しました。価格は前バージョンと同額で、このアップデートは現在、すべてのプラットフォームで利用可能です。「Opus 4.7」のリリースからわずか41日後に公開された今回のアップデートにより、Anthropicは開発サイクルを大幅に加速させ、最近の「Sonnet」や「Haiku」のリリースで見られた3ヶ月や7ヶ月とい
Anthropicは、『Mythos』の一般公開版である『Claude Fable 5』をリリースした
Anthropicは、同社で最も高性能なAIモデルを初めて一般に公開した――ただし、安全対策が講じられている。火曜日、同社はMythosモデルの初の一般公開版となる「Claude Fable 5」をリリースした。 Anthropicによると、「Fable 5」はソフトウェアエンジニアリング、ナレッジワーク、画像処理タスクにおいて優れた性能を発揮するが、厳格な安全制限が設けられている。サイバーセキ
SandboxAQは、コンピューティング分野の博士号がなくても、Claudeに薬物探索用AIを導入できるようにします。
薬物探索は、現代産業において最もコストのかかる課題の一つであり続けている。実用可能な単一分子を見出すだけでも10年の歳月と数十億ドルの費用が必要で、候補となる物質のほとんどは結局失敗に終わる。AIスタートアップの波がこの状況を変えることを約束しているが、その多くは既に高度な技術力を持つ研究者たちにとって、研究プロセスをわずかに容易にしたに過ぎない。しかしSandboxAQは、ボトルネックがモデル自体ではなくインターフェースにあると考えている。同社はAnthropicと提携し、自身の科学系AIモ
関連特集おすすめ
コメント (54)
0/500
This hybrid AI model sounds like a game-changer! Being able to tweak how long Claude thinks is super cool, like choosing between a quick coffee chat or a deep dive convo. Excited to see how this stacks up against other AI out there! 😎
Claude 3.7 Sonnet a l'air incroyable ! Pouvoir choisir la durée de réflexion, c'est comme demander à un chef de cuisiner vite ou de prendre son temps pour un plat parfait. J'ai hâte de voir comment ça marche en pratique ! 😄
Claude's customizable thinking duration sounds like a game-changer! I wonder how it balances speed and depth in real-world tasks. Excited to try it out! 😄
Wow, Claude 3.7 sounds like a game-changer! Being able to tweak how long it thinks is such a cool feature. I’m curious how this will stack up against other AI models in real-world tasks. Anyone tried it yet? 😄
O Claude 3.7 Sonnet é incrível! Adoro poder escolher a duração do pensamento. Às vezes preciso de respostas rápidas, outras vezes quero respostas mais pensadas. É como ter um amigo AI personalizável! Só desejo que fosse um pouco mais rápido às vezes. 😎
Anthropicの最新AIモデル、Claude 3.7 Sonnetは、AIの世界に大きな変化をもたらしています。業界初の「ハイブリッドAI推論モデル」と呼ばれ、迅速な回答とより深い思考に基づく応答の両方を提供するように設計されています。質問に対してClaudeが「考える」時間を自分で選べるなんて、かなりクールですよね?
Claude 3.7 Sonnetのコンセプトは、AIの利用をとてもシンプルにすることです。さまざまなモデルから選ぶ必要をなくし、Anthropicは1つのモデルですべてを処理できるようにしたいと考えています。月曜日から、誰でもClaude 3.7 Sonnetを利用できますが、その高度な推論機能を使いたい場合は、Anthropicのプレミアムプランのいずれかに登録する必要があります。無料ユーザーでも、Anthropicによると前モデルClaude 3.5 Sonnetよりも優れた、しっかりしたバージョンのモデルを利用できます。
さて、コストについてですが、Claude 3.7 Sonnetは入力トークン100万あたり3ドル、出力トークン100万あたり15ドルかかります。これはOpenAIのo3-miniやDeepSeekのR1といった他のモデルより少し高価ですが、それらは推論モデルだけで、Claudeのようなハイブリッドモデルではないことを覚えておいてください。

AnthropicはClaudeに大きな計画を持っています。最終的には、ユーザーが設定しなくても、Claudeが質問に対してどのくらい「考える」べきかを自分で判断できるようにしたいと考えています。Anthropicの製品および研究リーダーであるDianne Pennは、TechCrunchに対し、推論はフロンティアモデルが持つべき多くの機能の1つに過ぎないと語りました。
Claude 3.7 Sonnetでは、「見えるスクラッチパッド」を通じて、どのように回答を計画しているかを見ることができます。ほとんどの場合、その全プロセスが見えますが、Anthropicは安全上の理由で一部を編集する場合があります。

いくつかのテストでは、Claude 3.7 Sonnetはかなり良い成績を収めました。現実世界のコーディングタスクを評価するSWE-Benchでは62.3%を記録し、OpenAIのo3-mini(49.3%)を上回りました。また、小売環境でシミュレートされたユーザーや外部APIとの対話を測定するTAU-Benchでは、Claude 3.7 Sonnetは81.2%を記録し、OpenAIのo1モデル(73.5%)を上回りました。
Anthropicは、Claude 3.7 Sonnetは質問への回答拒否が少なくなり、有害と無害なプロンプトをより細かく区別するようになると述べています。Claude 3.5 Sonnetと比較して、不必要な拒否が45%減少しました。
Claude 3.7 Sonnetと同時に、AnthropicはClaude Codeという新しいツールも展開しています。これは、開発者がターミナルから直接Claudeを通じて特定のタスクを実行できる研究プレビューです。デモでは、Claude Codeが「このプロジェクト構造を説明して」といった簡単なコマンドでコーディングプロジェクトを分析できる様子が示されました。平易な英語を使ってコードベースを変更でき、Claude Codeは編集内容を説明し、エラーをテストし、プロジェクトをGitHubリポジトリにプッシュします。
Claude Codeは「先着順」で限られたユーザーに提供されます。
Anthropicは、AIラボが次々と新モデルをリリースする中でClaude 3.7 Sonnetをリリースします。Anthropicは通常、より慎重で安全性を重視したアプローチを取ってきましたが、今回はリードすることを目指しています。しかし、どれだけリードを維持できるかは誰にも分かりません。特に、OpenAIのCEO、Sam Altmanが「数か月後」に自社のハイブリッドAIモデルをリリースすると述べているからです。
Anthropic、新しいダイナミックワークフローツールを搭載した「Opus 4.8」をリリース
Anthropicは木曜日、同社の主力パブリックモデルである「Opus 4.8」を発表しました。価格は前バージョンと同額で、このアップデートは現在、すべてのプラットフォームで利用可能です。「Opus 4.7」のリリースからわずか41日後に公開された今回のアップデートにより、Anthropicは開発サイクルを大幅に加速させ、最近の「Sonnet」や「Haiku」のリリースで見られた3ヶ月や7ヶ月とい
Anthropicは、『Mythos』の一般公開版である『Claude Fable 5』をリリースした
Anthropicは、同社で最も高性能なAIモデルを初めて一般に公開した――ただし、安全対策が講じられている。火曜日、同社はMythosモデルの初の一般公開版となる「Claude Fable 5」をリリースした。 Anthropicによると、「Fable 5」はソフトウェアエンジニアリング、ナレッジワーク、画像処理タスクにおいて優れた性能を発揮するが、厳格な安全制限が設けられている。サイバーセキ
SandboxAQは、コンピューティング分野の博士号がなくても、Claudeに薬物探索用AIを導入できるようにします。
薬物探索は、現代産業において最もコストのかかる課題の一つであり続けている。実用可能な単一分子を見出すだけでも10年の歳月と数十億ドルの費用が必要で、候補となる物質のほとんどは結局失敗に終わる。AIスタートアップの波がこの状況を変えることを約束しているが、その多くは既に高度な技術力を持つ研究者たちにとって、研究プロセスをわずかに容易にしたに過ぎない。しかしSandboxAQは、ボトルネックがモデル自体ではなくインターフェースにあると考えている。同社はAnthropicと提携し、自身の科学系AIモ
This hybrid AI model sounds like a game-changer! Being able to tweak how long Claude thinks is super cool, like choosing between a quick coffee chat or a deep dive convo. Excited to see how this stacks up against other AI out there! 😎
Claude 3.7 Sonnet a l'air incroyable ! Pouvoir choisir la durée de réflexion, c'est comme demander à un chef de cuisiner vite ou de prendre son temps pour un plat parfait. J'ai hâte de voir comment ça marche en pratique ! 😄
Claude's customizable thinking duration sounds like a game-changer! I wonder how it balances speed and depth in real-world tasks. Excited to try it out! 😄
Wow, Claude 3.7 sounds like a game-changer! Being able to tweak how long it thinks is such a cool feature. I’m curious how this will stack up against other AI models in real-world tasks. Anyone tried it yet? 😄
O Claude 3.7 Sonnet é incrível! Adoro poder escolher a duração do pensamento. Às vezes preciso de respostas rápidas, outras vezes quero respostas mais pensadas. É como ter um amigo AI personalizável! Só desejo que fosse um pouco mais rápido às vezes. 😎





家






