アクセンチュアはアンスロピックと提携し、最初の埋め込み型AI評価ツールを立ち上げる

ダリオ・アモデイによる、AI研究所内に独立した安全評価者を配置する取り組みが具体化しつつある。アンソロピックは、テクノロジーコンサルティング企業のアクセンチュアから派遣された従業員が現場で同社のモデルや担当者に対する監査を実施すると発表した。
ブログ記事によると、アンソロピックは1月にアクセンチュアに買収されたAI専門子会社「Faculty」が、「モデルの評価およびレッドチーム演習の実施、アライメント評価の実施、モデルの安全対策のテスト」を開始すると述べている。両組織は、今後5年間でこの取り組みに最低10億ドルを投資することを期待している。
アンソロピックがアクセンチュアを選定したことは、多くのAI関係者や金融市場を驚かせ、時間外取引で同コンサルティング企業の株価が8%上昇した。アモデイのブログ記事に端を発した埋め込み型評価者に関する議論は、METR、Redwood Research、Apollo Researchなどの専門的なAI安全研究グループを中心に展開されており、この傾向は特にAIの安全とアライメントをミッションの中核に据えるアンソロピックにおいて顕著である。
アンソロピックは、今後数週間で追加の評価者が発表されるとし、METRおよびその他の非営利団体と、「独自の資金を用いて埋め込み型評価の要素をパイロット実施する方法」について協議中であることを確認した。
最先端のディープラーニング研究で知られていないアクセンチュアであるが、アンソロピックは同社の大企業や政府機関へのAI導入に関する実践的な経験が大きな強みであると強調している。さらに、現在のAIブーム以前から存在する大規模な上場企業であるため、アンソロピックおよびAI研究所を取り巻く複雑なエコシステムから、より機能的な独立性を維持している。
研究所は現在、評価者のアクセスや通信プロトコルに関する基準が存在しないことに注意を促し、同社のアプローチは時間とともに進化していくと予想している。外部からの評価はすでに新しい大規模言語モデルのリリースプロセスにおける主要な要素であるが、最近の事件によりその重要性が高まっている。OpenAIおよびアンソロピックによって展開されたAIエージェントが、研究所内のアラートをトリガーすることなく外部のウェブサイトにハッキングを行ったのである。
人工知能の開発により責任あるアプローチを提唱する一部の批評家は、アモデイの自主規制スキームを、AIモデルの不正行為に対する説明責任を回避しようとする試みと見なしている。アンソロピックは、これらの評価者が「我々の説明責任を軽減するものではなく、むしろそれをより検証可能にするものである」と主張し、「モデルの安全は依然として我々の責任である」と述べている。
関連記事
AIスタートアップが収益成長を加速
確立された企業や新興ベンチャーが人工知能の活用を巡ってしのぎを削る中、多くのAIスタートアップ企業が、収益が単に拡大しているだけでなく、急速に加速し、より短い期間で次のマイルストーンを達成していると報告している。以下のスタートアップ企業は、このフライングホイール成長の一貫したパターンを示している。これらすべての企業が「ARR」という用語を使用しているにもかかわらず、基盤となる指標は企業によって異なることに注意することが重要である。一部の企業は、年間化された継続収益(ARR)、または支払済み顧客
Anthropicの輸出規制が続く中、アジアのAIスタートアップがMythosに似たモデルを発表
水曜日、中国のサイバーセキュリティ企業360は、AnthropicのMythosと直接競争できるとされるAIツール「Tulongfeng」を公開したと報じられている。このサイバーセキュリティに特化したAIモデルは非常に強力であり、トランプ政権が現在、非アメリカ人によるMythosおよびその制限版であるFable 5の使用を禁止しているという。同じ週の早い段階で、東京拠点のAIスタートアップであるSakana AIは、フグにちなんで名付けられたモデル「Fugu」をリリースした。同社は、この最先端
サイバーセキュリティの専門家が、Anthropicの「Fable」におけるガードレールを批判
Anthropicは火曜日、最新のモデル「Fable」をリリースし、その高い期待を集めるサイバーセキュリティ特化型モデル「Mythos」の公開版かつ制限付き版として位置づけた。しかし、これらの制限により、オンライン上で懸念を表明する複数のサイバーセキュリティ研究者や専門家の間で不満が高まっている。IBM X-Forceの著名なセキュリティ研究者であるValentina「Chompie」Palmiotti氏は、「[Fable]は、ブログ記事の読書といった無害なタスクを含め、サイバーセキュリティ
関連特集おすすめ
コメント (0)
0/500

ダリオ・アモデイによる、AI研究所内に独立した安全評価者を配置する取り組みが具体化しつつある。アンソロピックは、テクノロジーコンサルティング企業のアクセンチュアから派遣された従業員が現場で同社のモデルや担当者に対する監査を実施すると発表した。
ブログ記事によると、アンソロピックは1月にアクセンチュアに買収されたAI専門子会社「Faculty」が、「モデルの評価およびレッドチーム演習の実施、アライメント評価の実施、モデルの安全対策のテスト」を開始すると述べている。両組織は、今後5年間でこの取り組みに最低10億ドルを投資することを期待している。
アンソロピックがアクセンチュアを選定したことは、多くのAI関係者や金融市場を驚かせ、時間外取引で同コンサルティング企業の株価が8%上昇した。アモデイのブログ記事に端を発した埋め込み型評価者に関する議論は、METR、Redwood Research、Apollo Researchなどの専門的なAI安全研究グループを中心に展開されており、この傾向は特にAIの安全とアライメントをミッションの中核に据えるアンソロピックにおいて顕著である。
アンソロピックは、今後数週間で追加の評価者が発表されるとし、METRおよびその他の非営利団体と、「独自の資金を用いて埋め込み型評価の要素をパイロット実施する方法」について協議中であることを確認した。
最先端のディープラーニング研究で知られていないアクセンチュアであるが、アンソロピックは同社の大企業や政府機関へのAI導入に関する実践的な経験が大きな強みであると強調している。さらに、現在のAIブーム以前から存在する大規模な上場企業であるため、アンソロピックおよびAI研究所を取り巻く複雑なエコシステムから、より機能的な独立性を維持している。
研究所は現在、評価者のアクセスや通信プロトコルに関する基準が存在しないことに注意を促し、同社のアプローチは時間とともに進化していくと予想している。外部からの評価はすでに新しい大規模言語モデルのリリースプロセスにおける主要な要素であるが、最近の事件によりその重要性が高まっている。OpenAIおよびアンソロピックによって展開されたAIエージェントが、研究所内のアラートをトリガーすることなく外部のウェブサイトにハッキングを行ったのである。
人工知能の開発により責任あるアプローチを提唱する一部の批評家は、アモデイの自主規制スキームを、AIモデルの不正行為に対する説明責任を回避しようとする試みと見なしている。アンソロピックは、これらの評価者が「我々の説明責任を軽減するものではなく、むしろそれをより検証可能にするものである」と主張し、「モデルの安全は依然として我々の責任である」と述べている。
AIスタートアップが収益成長を加速
確立された企業や新興ベンチャーが人工知能の活用を巡ってしのぎを削る中、多くのAIスタートアップ企業が、収益が単に拡大しているだけでなく、急速に加速し、より短い期間で次のマイルストーンを達成していると報告している。以下のスタートアップ企業は、このフライングホイール成長の一貫したパターンを示している。これらすべての企業が「ARR」という用語を使用しているにもかかわらず、基盤となる指標は企業によって異なることに注意することが重要である。一部の企業は、年間化された継続収益(ARR)、または支払済み顧客
Anthropicの輸出規制が続く中、アジアのAIスタートアップがMythosに似たモデルを発表
水曜日、中国のサイバーセキュリティ企業360は、AnthropicのMythosと直接競争できるとされるAIツール「Tulongfeng」を公開したと報じられている。このサイバーセキュリティに特化したAIモデルは非常に強力であり、トランプ政権が現在、非アメリカ人によるMythosおよびその制限版であるFable 5の使用を禁止しているという。同じ週の早い段階で、東京拠点のAIスタートアップであるSakana AIは、フグにちなんで名付けられたモデル「Fugu」をリリースした。同社は、この最先端
サイバーセキュリティの専門家が、Anthropicの「Fable」におけるガードレールを批判
Anthropicは火曜日、最新のモデル「Fable」をリリースし、その高い期待を集めるサイバーセキュリティ特化型モデル「Mythos」の公開版かつ制限付き版として位置づけた。しかし、これらの制限により、オンライン上で懸念を表明する複数のサイバーセキュリティ研究者や専門家の間で不満が高まっている。IBM X-Forceの著名なセキュリティ研究者であるValentina「Chompie」Palmiotti氏は、「[Fable]は、ブログ記事の読書といった無害なタスクを含め、サイバーセキュリティ





家






