AnthropicはAIを活用してClaudeを強化し、現在R&Dタスクの25%を処理

Anthropicは、その研究開発部門におけるAI駆動の自動化に関する内部指標を公開した。8月までにClaudeは同社のAI研究タスクの26%を処理しており、2月の1%未満から急増し、急速な導入を示している。
6段階の自動化フレームワーク:人間の機械協働に90%以上到達、「完全自律」システムはまだなし
Anthropicは、AIの関与度を評価するために6段階の自動化フレームワークを採用している。レベル4(AL4)は「AI主導」と定義され、人間が上位目標を設定し、AIがワークフローの大部分を実行し、人間が出力を監督およびレビューする。現在、研究開発作業の90%以上がこの協働レベルまたはそれ以上に達しているが、完全自律(AL5)を達成したタスクはなく、AIは常に人間の監督下で動作することが保証されている。
内部では、約30,000のClaude搭載AIエージェントが並列して研究およびエンジニアリングプロジェクトに取り組んでいる。これらのエージェントは互いにタスクを委任し、エラーを相互に補正し、8月には単月で10億件以上の意思決定を生成した。
リポジトリ内のコードの80%がClaudeによって生成され、次世代モデルの自己改善を促進
リスクを軽減するため、すべてのAI操作は実行前にオンラインの安全チェックを受け、異常な意思決定は直接インターセプトされる。システムはまた、会話ログを定期的にサンプリングし、高リスクケースを手動レビューのためにフラグ付けする。
コードレベルの変更は特に重要である:現在、リポジトリにマージされるコードの80%以上がClaudeによって生成されており、エンジニアの生産性を数倍向上させている。これらのAIエージェントは、モデル実験、コーディング、データ分析、結果検証を含む大量の低レベルの研究開発作業を処理し、次世代Claudeモデルの反復(業界では再帰的自己改善として知られるプロセス)に貢献している。
関連記事
豆包、スキル、コネクタ、ワークパートナーを発表し、チャットアシスタントをスマートオフィスプラットフォームに変革
豆包は最近、タスクモードをアップグレードし、「スキル」「コネクタ」「ワークパートナー」の3つの新機能を追加し、協同オフィス機能を大幅に強化しました。現在利用可能なスキルとコネクタは200以上あり、プラットフォームはユーザーが標準化されたワークフローのためにカスタムスキルを作成することも可能にしています。スキルは、ユーザーがパーソナライズされたワークフローを保持するのに役立ちます。例えば、週次レポートで使用するフォーマットやコンテンツの基準は、ワンクリックで再利用できる個人スキルとして保存でき、成
Apple HomePod mini 2セット、秋に登場予定、6年の開発を経て独自AIチップを搭載
Apple HomePod mini が発売されてからほぼ6年が経過し、遂にアップデートの兆しが見えてきた。最近の報道によると、第2世代モデルは今年の秋に登場する可能性があり、その長い待機期間は次世代 Siri の成熟が必要であるためであるとされている。このパターンは HomePod mini に限らず、新しい Apple TV 4K、フルサイズ HomePod、スマートディスプレイの遅延も同様に Apple の AI 開発の進捗と関連付けられている。これは、AI 機能が Apple のハードウ
OpenAI、初期AIモデル開発に独立した安全チェックを追加
AIのリスクに関する懸念が深まる中、OpenAIは新たな安全ガバナンス措置を発表した。同社は、従来の社内テストループを超え、開発サイクルの早い段階で独立した第三者機関を関与させ、体系的な安全評価を行う計画である。これらの外部評価が効果的であることを保証するため、OpenAIは成功のための4つの主要な優先事項を定義した。すなわち、強力な独立した運用枠組みの確立、厳格な科学的厳密性の維持、堅牢な日常安全プロトコルの実装、およびすべてのステークホルダーにわたる安全責任の明確化である。この転換は、A
関連特集おすすめ
コメント (0)
0/500

Anthropicは、その研究開発部門におけるAI駆動の自動化に関する内部指標を公開した。8月までにClaudeは同社のAI研究タスクの26%を処理しており、2月の1%未満から急増し、急速な導入を示している。
6段階の自動化フレームワーク:人間の機械協働に90%以上到達、「完全自律」システムはまだなし
Anthropicは、AIの関与度を評価するために6段階の自動化フレームワークを採用している。レベル4(AL4)は「AI主導」と定義され、人間が上位目標を設定し、AIがワークフローの大部分を実行し、人間が出力を監督およびレビューする。現在、研究開発作業の90%以上がこの協働レベルまたはそれ以上に達しているが、完全自律(AL5)を達成したタスクはなく、AIは常に人間の監督下で動作することが保証されている。
内部では、約30,000のClaude搭載AIエージェントが並列して研究およびエンジニアリングプロジェクトに取り組んでいる。これらのエージェントは互いにタスクを委任し、エラーを相互に補正し、8月には単月で10億件以上の意思決定を生成した。
リポジトリ内のコードの80%がClaudeによって生成され、次世代モデルの自己改善を促進
リスクを軽減するため、すべてのAI操作は実行前にオンラインの安全チェックを受け、異常な意思決定は直接インターセプトされる。システムはまた、会話ログを定期的にサンプリングし、高リスクケースを手動レビューのためにフラグ付けする。
コードレベルの変更は特に重要である:現在、リポジトリにマージされるコードの80%以上がClaudeによって生成されており、エンジニアの生産性を数倍向上させている。これらのAIエージェントは、モデル実験、コーディング、データ分析、結果検証を含む大量の低レベルの研究開発作業を処理し、次世代Claudeモデルの反復(業界では再帰的自己改善として知られるプロセス)に貢献している。
豆包、スキル、コネクタ、ワークパートナーを発表し、チャットアシスタントをスマートオフィスプラットフォームに変革
豆包は最近、タスクモードをアップグレードし、「スキル」「コネクタ」「ワークパートナー」の3つの新機能を追加し、協同オフィス機能を大幅に強化しました。現在利用可能なスキルとコネクタは200以上あり、プラットフォームはユーザーが標準化されたワークフローのためにカスタムスキルを作成することも可能にしています。スキルは、ユーザーがパーソナライズされたワークフローを保持するのに役立ちます。例えば、週次レポートで使用するフォーマットやコンテンツの基準は、ワンクリックで再利用できる個人スキルとして保存でき、成
Apple HomePod mini 2セット、秋に登場予定、6年の開発を経て独自AIチップを搭載
Apple HomePod mini が発売されてからほぼ6年が経過し、遂にアップデートの兆しが見えてきた。最近の報道によると、第2世代モデルは今年の秋に登場する可能性があり、その長い待機期間は次世代 Siri の成熟が必要であるためであるとされている。このパターンは HomePod mini に限らず、新しい Apple TV 4K、フルサイズ HomePod、スマートディスプレイの遅延も同様に Apple の AI 開発の進捗と関連付けられている。これは、AI 機能が Apple のハードウ
OpenAI、初期AIモデル開発に独立した安全チェックを追加
AIのリスクに関する懸念が深まる中、OpenAIは新たな安全ガバナンス措置を発表した。同社は、従来の社内テストループを超え、開発サイクルの早い段階で独立した第三者機関を関与させ、体系的な安全評価を行う計画である。これらの外部評価が効果的であることを保証するため、OpenAIは成功のための4つの主要な優先事項を定義した。すなわち、強力な独立した運用枠組みの確立、厳格な科学的厳密性の維持、堅牢な日常安全プロトコルの実装、およびすべてのステークホルダーにわたる安全責任の明確化である。この転換は、A





家






