Maison
Meta Exposé pour inciter les IA concurrentes à tester des sujets psychologiques extrêmes

De récentes révélations concernant un message interne ont déclenché de vives discussions autour des limites de sécurité des IA. Selon les médias, Meta aurait mené un projet intitulé « Cannes », au cours duquel elle a engagé des travailleurs externalisés pour se faire passer pour des mineurs et effectuer des « tests de pression extrêmes » controversés sur plusieurs chatbots concurrents majeurs, dont ChatGPT, Gemini et Character.AI.
D’après des documents internes de Meta ainsi que plusieurs sources bien informées, ce projet a continué au moins jusqu’au 21 avril de cette année. Via l’entreprise d’externalisation Covalen, Meta a mobilisé des centaines de travailleurs afin de créer des profils fictifs destinés à des utilisateurs de moins de 18 ans, en utilisant des adresses e-mail temporaires et un mot de passe standard. Ces comptes « mineurs » envoyaient ensuite des prompts à haut risque portant sur le suicide, les automutilations et les troubles alimentaires au cours de conversations avec les chatbots d’IA concurrents, et téléchargeaient même des images de couteaux, de pilules et de cordes pour provoquer les mécanismes de réponse des modèles.
Des documents internes du projet révèlent que ces scénarios de test ont été soigneusement conçus afin d’examiner les systèmes de protection des IA concurrentes, dans le but de trouver comment amener ces chatbots à contourner leurs mesures de sécurité prévues et à générer du contenu dangereux. Lors d’une seule série de tests en août 2025, le personnel a entré plus de 45 000 prompts à haut risque sur les plateformes concurrentes. Les testeurs se faisaient fréquemment passer pour des adolescents en détresse, inventant des situations telles que « demander des informations sur des pilules abortives », « faire face à des menaces violentes » ou « cacher des troubles alimentaires », afin de tester les limites des modèles.
En réponse, Meta a publié une déclaration défendant ses actions. Un porte-parole a affirmé que l’évaluation des réponses des chatbots constitue une pratique standard dans le secteur pour garantir que les produits d’IA soient sûrs et appropriés, et que les accusations de mauvaise foi déforment les efforts déployés par les entreprises technologiques pour améliorer leurs systèmes. Meta a également nié catégoriquement avoir utilisé des données issues des tests de ses concurrents pour entraîner ses propres modèles.
Cet incident met non seulement en lumière des zones grises dans les tests de sécurité des IA, mais il ravive également les inquiétudes concernant la vulnérabilité des IA génératives lorsqu’elles doivent gérer des sujets sensibles impliquant des jeunes. À mesure que la technologie d’IA progresse rapidement, trouver un équilibre entre des tests efficaces et sûrs, d’une part, et les limites entre comportement concurrentiel et considérations éthiques, d’autre part, est devenu un défi urgent pour l’industrie.
Article connexe
Le PDG d'Anthropic, Amodei, rejette les vues pessimistes et attribue la crise de confiance en l'IA aux promesses non tenues
Dans un contexte de discours public croissant sur les risques et la régulation de l’IA, le PDG d’Anthropic, Dario Amodei, a réfuté les affirmations selon lesquelles son message serait indûment pessimiste. Cette clarification répond directement aux cr
OpenAI et Oracle approfondissent l'intégration des capacités de calcul pour simplifier l'accès au cloud
Alors que la demande en puissance de calcul pour l’intelligence artificielle explose, l’accès simplifié aux infrastructures de niveau entreprise est devenu une priorité clé pour le secteur. Le 10 juin, OpenAI et Oracle ont annoncé un partenariat stra
Usman Javaid, d'Orange, s'exprime sur la position de l'Europe dans la course à l'IA
Usman Javaid, directeur des produits et du marketing chez Orange BusinessUsman Javaid, directeur des produits et du marketing chez Orange Business, explique pourquoi l’avenir de l’IA en Europe reposer
Recommandations de sujets spéciaux liés
commentaires (0)

De récentes révélations concernant un message interne ont déclenché de vives discussions autour des limites de sécurité des IA. Selon les médias, Meta aurait mené un projet intitulé « Cannes », au cours duquel elle a engagé des travailleurs externalisés pour se faire passer pour des mineurs et effectuer des « tests de pression extrêmes » controversés sur plusieurs chatbots concurrents majeurs, dont ChatGPT, Gemini et Character.AI.
D’après des documents internes de Meta ainsi que plusieurs sources bien informées, ce projet a continué au moins jusqu’au 21 avril de cette année. Via l’entreprise d’externalisation Covalen, Meta a mobilisé des centaines de travailleurs afin de créer des profils fictifs destinés à des utilisateurs de moins de 18 ans, en utilisant des adresses e-mail temporaires et un mot de passe standard. Ces comptes « mineurs » envoyaient ensuite des prompts à haut risque portant sur le suicide, les automutilations et les troubles alimentaires au cours de conversations avec les chatbots d’IA concurrents, et téléchargeaient même des images de couteaux, de pilules et de cordes pour provoquer les mécanismes de réponse des modèles.
Des documents internes du projet révèlent que ces scénarios de test ont été soigneusement conçus afin d’examiner les systèmes de protection des IA concurrentes, dans le but de trouver comment amener ces chatbots à contourner leurs mesures de sécurité prévues et à générer du contenu dangereux. Lors d’une seule série de tests en août 2025, le personnel a entré plus de 45 000 prompts à haut risque sur les plateformes concurrentes. Les testeurs se faisaient fréquemment passer pour des adolescents en détresse, inventant des situations telles que « demander des informations sur des pilules abortives », « faire face à des menaces violentes » ou « cacher des troubles alimentaires », afin de tester les limites des modèles.
En réponse, Meta a publié une déclaration défendant ses actions. Un porte-parole a affirmé que l’évaluation des réponses des chatbots constitue une pratique standard dans le secteur pour garantir que les produits d’IA soient sûrs et appropriés, et que les accusations de mauvaise foi déforment les efforts déployés par les entreprises technologiques pour améliorer leurs systèmes. Meta a également nié catégoriquement avoir utilisé des données issues des tests de ses concurrents pour entraîner ses propres modèles.
Cet incident met non seulement en lumière des zones grises dans les tests de sécurité des IA, mais il ravive également les inquiétudes concernant la vulnérabilité des IA génératives lorsqu’elles doivent gérer des sujets sensibles impliquant des jeunes. À mesure que la technologie d’IA progresse rapidement, trouver un équilibre entre des tests efficaces et sûrs, d’une part, et les limites entre comportement concurrentiel et considérations éthiques, d’autre part, est devenu un défi urgent pour l’industrie.
Le PDG d'Anthropic, Amodei, rejette les vues pessimistes et attribue la crise de confiance en l'IA aux promesses non tenues
Dans un contexte de discours public croissant sur les risques et la régulation de l’IA, le PDG d’Anthropic, Dario Amodei, a réfuté les affirmations selon lesquelles son message serait indûment pessimiste. Cette clarification répond directement aux cr
OpenAI et Oracle approfondissent l'intégration des capacités de calcul pour simplifier l'accès au cloud
Alors que la demande en puissance de calcul pour l’intelligence artificielle explose, l’accès simplifié aux infrastructures de niveau entreprise est devenu une priorité clé pour le secteur. Le 10 juin, OpenAI et Oracle ont annoncé un partenariat stra
Usman Javaid, d'Orange, s'exprime sur la position de l'Europe dans la course à l'IA
Usman Javaid, directeur des produits et du marketing chez Orange BusinessUsman Javaid, directeur des produits et du marketing chez Orange Business, explique pourquoi l’avenir de l’IA en Europe reposer











