Anthropic、Claudeコードの制御範囲を拡大しつつ、一定の制限を維持

AIに依存する開発者にとって、現在の「直感的なコーディング」のアプローチでは、多くの場合、すべてのアクションを綿密に監視するか、モデルに完全な自由を与えるかのいずれかとなっています。Anthropic社は、Claudeの最新アップデートにより、AIが一定の範囲内で、どのアクションを実行するのが安全かを自律的に判断できるようになり、このジレンマが解消されたと主張しています。
この動きは、AIツールが各ステップで人間の承認を必要とせずに動作するように構築されるという、業界全体の広範なトレンドを反映している。重要な課題は、スピードと監視のバランスを取ることだ。過度な安全対策は進捗を遅らせ、一方で対策が不十分だと、予測不能で危険な行動につながる恐れがある。 Anthropicの新しい「オートモード」は、現在リサーチプレビュー段階(テストは可能だが、まだ完成品ではない)にあり、このバランスを模索するための同社の最新の取り組みである。
オートモードでは、AIによる安全対策を用いて実行前に各アクションを精査し、要求されていない危険な行動や「プロンプトインジェクション」の兆候を探します。プロンプトインジェクションとは、処理中のコンテンツに悪意のある指示を埋め込み、AIを騙して意図しない行動をとらせる攻撃手法のことです。安全と判断されたアクションは自動的に実行され、危険なアクションはブロックされます。
これは本質的に、Claude Codeの既存の「dangerously-skip-permissions」コマンドの拡張版であり、すべての意思決定をAIに委ねつつ、その上に追加の安全層を構築したものです。
この機能は、GitHubやOpenAIといった企業が提供する、開発者に代わってタスクを実行できる自律型コーディングツールの最近の急増を基盤としています。しかし、ユーザーに許可を求めるタイミングの決定をAI自体に移すことで、さらに一歩進んだものとなっています。
Anthropic社は、安全層が「安全なアクション」と「リスクの高いアクション」を区別するために用いる具体的な基準については明らかにしていない。開発者がこの機能を広く採用する前に、こうした詳細をより明確に理解したいと考えるだろう。(TechCrunchはこの件に関する詳細情報を得るため、同社に問い合わせを行っている。)
「Autoモード」は、コードベースに反映される前にバグを検出する自動コードレビューツール「Claude Code Review」や、ユーザーがAIエージェントにタスクを割り当てて代わりに作業を行わせることができる「Dispatch for Cowork」に続く、Anthropicの新たな機能です。
「Autoモード」は、今後数日中にエンタープライズおよびAPIユーザー向けに提供開始される予定だ。同社によると、現時点では「Claude Sonnet 4.6」および「Opus 4.6」でのみ動作しており、この新機能は「隔離された環境」——本番システムとは切り離されたサンドボックス環境——での使用を推奨している。これにより、万が一問題が発生した場合の被害を最小限に抑えることができる。
関連記事
Anthropic、新しいダイナミックワークフローツールを搭載した「Opus 4.8」をリリース
Anthropicは木曜日、同社の主力パブリックモデルである「Opus 4.8」を発表しました。価格は前バージョンと同額で、このアップデートは現在、すべてのプラットフォームで利用可能です。「Opus 4.7」のリリースからわずか41日後に公開された今回のアップデートにより、Anthropicは開発サイクルを大幅に加速させ、最近の「Sonnet」や「Haiku」のリリースで見られた3ヶ月や7ヶ月とい
Oculusの創業者らが立ち上げたAIスタートアップ「Sesame」、iOS版をリリース
木曜日、Oculusの創業者やMetaの元VRチームメンバーらが設立したAIスタートアップ「Sesame」は、1年以上かけて開発を進めてきた対話型AIエージェントのパブリックプレビューを公開した。 Sesameは、新しいiOSアプリを通じて、ChatGPTなどのツールによって普及した従来のAIチャットボットの体験を再定義し、AIが複雑な質問を処理するために追加の時間を必要とする場合でも、自然な会話
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
関連特集おすすめ
コメント (0)
0/500

AIに依存する開発者にとって、現在の「直感的なコーディング」のアプローチでは、多くの場合、すべてのアクションを綿密に監視するか、モデルに完全な自由を与えるかのいずれかとなっています。Anthropic社は、Claudeの最新アップデートにより、AIが一定の範囲内で、どのアクションを実行するのが安全かを自律的に判断できるようになり、このジレンマが解消されたと主張しています。
この動きは、AIツールが各ステップで人間の承認を必要とせずに動作するように構築されるという、業界全体の広範なトレンドを反映している。重要な課題は、スピードと監視のバランスを取ることだ。過度な安全対策は進捗を遅らせ、一方で対策が不十分だと、予測不能で危険な行動につながる恐れがある。 Anthropicの新しい「オートモード」は、現在リサーチプレビュー段階(テストは可能だが、まだ完成品ではない)にあり、このバランスを模索するための同社の最新の取り組みである。
オートモードでは、AIによる安全対策を用いて実行前に各アクションを精査し、要求されていない危険な行動や「プロンプトインジェクション」の兆候を探します。プロンプトインジェクションとは、処理中のコンテンツに悪意のある指示を埋め込み、AIを騙して意図しない行動をとらせる攻撃手法のことです。安全と判断されたアクションは自動的に実行され、危険なアクションはブロックされます。
これは本質的に、Claude Codeの既存の「dangerously-skip-permissions」コマンドの拡張版であり、すべての意思決定をAIに委ねつつ、その上に追加の安全層を構築したものです。
この機能は、GitHubやOpenAIといった企業が提供する、開発者に代わってタスクを実行できる自律型コーディングツールの最近の急増を基盤としています。しかし、ユーザーに許可を求めるタイミングの決定をAI自体に移すことで、さらに一歩進んだものとなっています。
Anthropic社は、安全層が「安全なアクション」と「リスクの高いアクション」を区別するために用いる具体的な基準については明らかにしていない。開発者がこの機能を広く採用する前に、こうした詳細をより明確に理解したいと考えるだろう。(TechCrunchはこの件に関する詳細情報を得るため、同社に問い合わせを行っている。)
「Autoモード」は、コードベースに反映される前にバグを検出する自動コードレビューツール「Claude Code Review」や、ユーザーがAIエージェントにタスクを割り当てて代わりに作業を行わせることができる「Dispatch for Cowork」に続く、Anthropicの新たな機能です。
「Autoモード」は、今後数日中にエンタープライズおよびAPIユーザー向けに提供開始される予定だ。同社によると、現時点では「Claude Sonnet 4.6」および「Opus 4.6」でのみ動作しており、この新機能は「隔離された環境」——本番システムとは切り離されたサンドボックス環境——での使用を推奨している。これにより、万が一問題が発生した場合の被害を最小限に抑えることができる。
Anthropic、新しいダイナミックワークフローツールを搭載した「Opus 4.8」をリリース
Anthropicは木曜日、同社の主力パブリックモデルである「Opus 4.8」を発表しました。価格は前バージョンと同額で、このアップデートは現在、すべてのプラットフォームで利用可能です。「Opus 4.7」のリリースからわずか41日後に公開された今回のアップデートにより、Anthropicは開発サイクルを大幅に加速させ、最近の「Sonnet」や「Haiku」のリリースで見られた3ヶ月や7ヶ月とい
Oculusの創業者らが立ち上げたAIスタートアップ「Sesame」、iOS版をリリース
木曜日、Oculusの創業者やMetaの元VRチームメンバーらが設立したAIスタートアップ「Sesame」は、1年以上かけて開発を進めてきた対話型AIエージェントのパブリックプレビューを公開した。 Sesameは、新しいiOSアプリを通じて、ChatGPTなどのツールによって普及した従来のAIチャットボットの体験を再定義し、AIが複雑な質問を処理するために追加の時間を必要とする場合でも、自然な会話
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli





家






