競合するAIに過激な心理的テーマの検証を促すために利用されたMeta

内部メッセージに関する最近の暴露により、AIの安全性の境界線をめぐる激しい議論が巻き起こっている。報道によれば、Metaは「Cannes」と呼ばれるプロジェクトを実施し、外部業者を雇って未成年のふりをさせ、ChatGPTやGemini、Character.AIといった複数の主要な競合チャットボットに対して物議を醸す「過度な負荷テスト」を行わせたという。
Metaの内部文書および複数の情報筋によると、このプロジェクトは少なくとも今年の4月21日まで続けられていた。外部業者Covalenを通じて、Metaは数百人の労働者を動員し、一時的なメールアドレスと標準的なパスワードを使用して18歳未満のユーザーの偽のプロフィールを作成させた。これらの「未成年」アカウントは、競合AIチャットボットとの会話の中で自殺や自傷行為、食事障害に関する高リスクなプロンプトを送信したほか、モデルの反応メカニズムを刺激するためにナイフや薬剤、絞首用の縄の画像までアップロードした。
内部のプロジェクト文書によると、これらのテストシナリオは競合AIシステムの安全防衛策を探り出し、チャットボットが本来備えているセーフガードを無視して危険なコンテンツを生成するよう促すことを目的として綿密に設計されていた。2025年8月のあるテストラウンドでは、スタッフが競合プラットフォームに4万5千件以上もの高リスクなプロンプトを入力した。テスターたちはしばしば苦悩する十代のふりをし、「中絶薬について尋ねる」「暴力的な脅威に直面している」「食事障害を隠している」といったシナリオを作り上げ、モデルの境界線を試した。
これに対しMetaは自身の行動を擁護する公式声明を発表した。同社の広報担当者は、チャットボットの応答をベンチマークすることは、AI製品が安全かつ適切であることを確保するための業界標準の慣行であり、悪意があるという非難は技術企業がシステムを改善しようとする努力を誤って表現していると述べた。またMetaは、競合他社から得たテストデータを自社のモデル訓練に使用したことも明確に否定した。
この事件はAIの安全性テストにおけるグレーゾーンを浮き彫りにするだけでなく、若者に関わる敏感な問題を扱う際のジェネレーティブAIの脆弱性に対する外部からの懸念も再燃させている。AI技術が急速に進化する中、効率的かつ安全なテストと、競争行為と倫理的配慮との間のバランスを取ることは、業界にとって緊急の課題となっている。
関連記事
AnthropicのCEO、Amodei氏は悲観的な見方を退け、AI信頼危機は約束が守られなかったことに起因すると指摘した。
AIのリスクと規制に関する公的な議論が激化する中、AnthropicのCEOであるDario Amodei氏は、自身のメッセージが過度に悲観的であるとする主張に対して反論を行った。この説明は、投資家のGavin Baker氏からの批判に直接応えるものであり、Baker氏はAll-InポッドキャストおよびX(旧Twitter)において、Amodei氏のAIの危険性に関する警告が、データセンターなどの米国発のAIインフラに対する世論の抵抗を煽っているとの見解を示した。Baker氏は、Amodei氏が
OpenAIとOracleは計算資源の統合を深化させ、クラウドアクセスを簡素化する
AIの計算リソースへの需要が急増する中、エンタープライズグレードのインフラストラクチャへのアクセス容易性が、業界の主要な優先課題として浮上しています。6月10日、OpenAIとOracleは、AIモデルの統合をクラウドインフラストラクチャにシームレスに接続することを目的とした戦略的パートナーシップを発表しました。この協力は、Oracle Cloud Infrastructure(OCI)の顧客にとってのユーザー体験を向上させることに焦点を当てています。今後数週間から、OCIユーザーは長引く調達
AI競争における欧州の立場について、オレンジ社のウスマン・ジャヴェイド氏が語る
オレンジ・ビジネスの最高製品・マーケティング責任者、ウスマン・ジャヴェイド氏オレンジ・ビジネスの最高製品・マーケティング責任者、ウスマン・ジャヴェイド氏が、欧州のAIの未来がなぜ「信頼」の上に築かれるのか、そして「主権」とはどのようなものかを解説するこの地域は批判を浴びることもあるが、オレンジ・ビジネスの最高製品・マーケティング責任者であるウスマン・ジャヴェイド氏は、欧州のAI分野における遅れは人
関連特集おすすめ
コメント (0)
0/500

内部メッセージに関する最近の暴露により、AIの安全性の境界線をめぐる激しい議論が巻き起こっている。報道によれば、Metaは「Cannes」と呼ばれるプロジェクトを実施し、外部業者を雇って未成年のふりをさせ、ChatGPTやGemini、Character.AIといった複数の主要な競合チャットボットに対して物議を醸す「過度な負荷テスト」を行わせたという。
Metaの内部文書および複数の情報筋によると、このプロジェクトは少なくとも今年の4月21日まで続けられていた。外部業者Covalenを通じて、Metaは数百人の労働者を動員し、一時的なメールアドレスと標準的なパスワードを使用して18歳未満のユーザーの偽のプロフィールを作成させた。これらの「未成年」アカウントは、競合AIチャットボットとの会話の中で自殺や自傷行為、食事障害に関する高リスクなプロンプトを送信したほか、モデルの反応メカニズムを刺激するためにナイフや薬剤、絞首用の縄の画像までアップロードした。
内部のプロジェクト文書によると、これらのテストシナリオは競合AIシステムの安全防衛策を探り出し、チャットボットが本来備えているセーフガードを無視して危険なコンテンツを生成するよう促すことを目的として綿密に設計されていた。2025年8月のあるテストラウンドでは、スタッフが競合プラットフォームに4万5千件以上もの高リスクなプロンプトを入力した。テスターたちはしばしば苦悩する十代のふりをし、「中絶薬について尋ねる」「暴力的な脅威に直面している」「食事障害を隠している」といったシナリオを作り上げ、モデルの境界線を試した。
これに対しMetaは自身の行動を擁護する公式声明を発表した。同社の広報担当者は、チャットボットの応答をベンチマークすることは、AI製品が安全かつ適切であることを確保するための業界標準の慣行であり、悪意があるという非難は技術企業がシステムを改善しようとする努力を誤って表現していると述べた。またMetaは、競合他社から得たテストデータを自社のモデル訓練に使用したことも明確に否定した。
この事件はAIの安全性テストにおけるグレーゾーンを浮き彫りにするだけでなく、若者に関わる敏感な問題を扱う際のジェネレーティブAIの脆弱性に対する外部からの懸念も再燃させている。AI技術が急速に進化する中、効率的かつ安全なテストと、競争行為と倫理的配慮との間のバランスを取ることは、業界にとって緊急の課題となっている。
AnthropicのCEO、Amodei氏は悲観的な見方を退け、AI信頼危機は約束が守られなかったことに起因すると指摘した。
AIのリスクと規制に関する公的な議論が激化する中、AnthropicのCEOであるDario Amodei氏は、自身のメッセージが過度に悲観的であるとする主張に対して反論を行った。この説明は、投資家のGavin Baker氏からの批判に直接応えるものであり、Baker氏はAll-InポッドキャストおよびX(旧Twitter)において、Amodei氏のAIの危険性に関する警告が、データセンターなどの米国発のAIインフラに対する世論の抵抗を煽っているとの見解を示した。Baker氏は、Amodei氏が
OpenAIとOracleは計算資源の統合を深化させ、クラウドアクセスを簡素化する
AIの計算リソースへの需要が急増する中、エンタープライズグレードのインフラストラクチャへのアクセス容易性が、業界の主要な優先課題として浮上しています。6月10日、OpenAIとOracleは、AIモデルの統合をクラウドインフラストラクチャにシームレスに接続することを目的とした戦略的パートナーシップを発表しました。この協力は、Oracle Cloud Infrastructure(OCI)の顧客にとってのユーザー体験を向上させることに焦点を当てています。今後数週間から、OCIユーザーは長引く調達
AI競争における欧州の立場について、オレンジ社のウスマン・ジャヴェイド氏が語る
オレンジ・ビジネスの最高製品・マーケティング責任者、ウスマン・ジャヴェイド氏オレンジ・ビジネスの最高製品・マーケティング責任者、ウスマン・ジャヴェイド氏が、欧州のAIの未来がなぜ「信頼」の上に築かれるのか、そして「主権」とはどのようなものかを解説するこの地域は批判を浴びることもあるが、オレンジ・ビジネスの最高製品・マーケティング責任者であるウスマン・ジャヴェイド氏は、欧州のAI分野における遅れは人





家






