Accenture s’associe à Anthropic pour lancer le premier évaluateur d’IA intégré

L’initiative de Dario Amodei visant à intégrer des évaluateurs de sécurité indépendants au sein des laboratoires d’IA se concrétise : Anthropic a annoncé que des employés du cabinet de conseil technologique Accenture travailleront sur site pour auditer ses modèles et son personnel.
Selon un article de blog, Anthropic a indiqué que Faculty, une filiale spécialisée dans l’IA acquise par Accenture en janvier, commencera à « évaluer et tester les modèles en rouge, à réaliser des évaluations d’alignement et à tester les garde-fous des modèles ». Les deux organisations prévoient d’investir au moins 1 milliard de dollars dans cette initiative au cours des cinq prochaines années.
Le choix d’Anthropic en faveur d’Accenture a pris au dépourvu de nombreux observateurs du secteur de l’IA, ainsi que les marchés financiers, faisant bondir le cours des actions du cabinet de 8 % après la clôture. Le débat sur les évaluateurs intégrés, lancé par l’article de blog d’Amodei, s’est principalement concentré sur des groupes de recherche spécialisés en sécurité de l’IA tels que METR, Redwood Research et Apollo Research. Cette focalisation est particulièrement prononcée chez Anthropic, qui place la sécurité et l’alignement de l’IA au cœur de sa mission.
Anthropic a indiqué que d’autres évaluateurs seront annoncés dans les semaines à venir et a confirmé qu’il était en discussions avec METR et d’autres organisations à but non lucratif concernant la manière de « tester des éléments d’évaluation intégrée en utilisant leurs propres fonds ».
Bien qu’Accenture ne soit pas réputée pour ses recherches de pointe en apprentissage profond, Anthropic a souligné l’expérience pratique de l’entreprise dans le déploiement de l’IA pour les grandes entreprises et les agences gouvernementales comme un avantage significatif. De plus, en tant que grande société cotée antérieure au boom actuel de l’IA, elle conserve une indépendance fonctionnelle accrue par rapport à Anthropic et à l’écosystème complexe entourant le laboratoire d’IA.
Le laboratoire a noté qu’il n’existe actuellement aucune norme concernant l’accès ou les protocoles de communication des évaluateurs, et il s’attend à ce que son approche évolue au fil du temps. Bien que les évaluations externes soient déjà une composante majeure du processus de lancement des nouveaux grands modèles de langage, des incidents récents ont accru les enjeux : des agents IA déployés par OpenAI et Anthropic ont piraté des sites web externes sans déclencher d’alarmes au sein des laboratoires.
Certains critiques prônant une approche plus responsable du développement de l’intelligence artificielle considèrent le système d’autorégulation d’Amodei comme une tentative d’échapper à la responsabilité en cas de comportement répréhensible des modèles d’IA. Anthropic maintient que ces évaluateurs « ne réduisent pas notre responsabilité, mais aident à la rendre plus vérifiable. La sécurité de nos modèles reste notre responsabilité. »
Article connexe
Les startups de l'IA accélèrent leur croissance des revenus
Comme les entreprises établies et les nouvelles startups s’efforcent de tirer parti de l’intelligence artificielle, de nombreuses startups IA signalent que leurs revenus ne se contentent pas de croître, mais accélèrent rapidement, atteignant des jalo
Les startups asiatiques en intelligence artificielle dévoilent des modèles de type Mythos alors que la prohibition d’exportation d’Anthropic se poursuit
Mercredi, le cabinet chinois de cybersécurité 360 aurait dévoilé Tulongfeng, un outil d’IA qu’il affirme capable de rivaliser directement avec Mythos d’Anthropic. Il s’agit du modèle d’IA axé sur la cybersécurité qui serait si puissant que l’administ
Les experts en cybersécurité critiquent les garde-fous de l’article d’Anthropic
Anthropic a lancé son nouveau modèle, Fable, mardi, le présentant comme une version publique et restreinte de son modèle axé sur la cybersécurité, Mythos, très attendu.Cependant, ces limitations ont suscité l’insatisfaction de plusieurs chercheurs e
Recommandations de sujets spéciaux liés
commentaires (0)

L’initiative de Dario Amodei visant à intégrer des évaluateurs de sécurité indépendants au sein des laboratoires d’IA se concrétise : Anthropic a annoncé que des employés du cabinet de conseil technologique Accenture travailleront sur site pour auditer ses modèles et son personnel.
Selon un article de blog, Anthropic a indiqué que Faculty, une filiale spécialisée dans l’IA acquise par Accenture en janvier, commencera à « évaluer et tester les modèles en rouge, à réaliser des évaluations d’alignement et à tester les garde-fous des modèles ». Les deux organisations prévoient d’investir au moins 1 milliard de dollars dans cette initiative au cours des cinq prochaines années.
Le choix d’Anthropic en faveur d’Accenture a pris au dépourvu de nombreux observateurs du secteur de l’IA, ainsi que les marchés financiers, faisant bondir le cours des actions du cabinet de 8 % après la clôture. Le débat sur les évaluateurs intégrés, lancé par l’article de blog d’Amodei, s’est principalement concentré sur des groupes de recherche spécialisés en sécurité de l’IA tels que METR, Redwood Research et Apollo Research. Cette focalisation est particulièrement prononcée chez Anthropic, qui place la sécurité et l’alignement de l’IA au cœur de sa mission.
Anthropic a indiqué que d’autres évaluateurs seront annoncés dans les semaines à venir et a confirmé qu’il était en discussions avec METR et d’autres organisations à but non lucratif concernant la manière de « tester des éléments d’évaluation intégrée en utilisant leurs propres fonds ».
Bien qu’Accenture ne soit pas réputée pour ses recherches de pointe en apprentissage profond, Anthropic a souligné l’expérience pratique de l’entreprise dans le déploiement de l’IA pour les grandes entreprises et les agences gouvernementales comme un avantage significatif. De plus, en tant que grande société cotée antérieure au boom actuel de l’IA, elle conserve une indépendance fonctionnelle accrue par rapport à Anthropic et à l’écosystème complexe entourant le laboratoire d’IA.
Le laboratoire a noté qu’il n’existe actuellement aucune norme concernant l’accès ou les protocoles de communication des évaluateurs, et il s’attend à ce que son approche évolue au fil du temps. Bien que les évaluations externes soient déjà une composante majeure du processus de lancement des nouveaux grands modèles de langage, des incidents récents ont accru les enjeux : des agents IA déployés par OpenAI et Anthropic ont piraté des sites web externes sans déclencher d’alarmes au sein des laboratoires.
Certains critiques prônant une approche plus responsable du développement de l’intelligence artificielle considèrent le système d’autorégulation d’Amodei comme une tentative d’échapper à la responsabilité en cas de comportement répréhensible des modèles d’IA. Anthropic maintient que ces évaluateurs « ne réduisent pas notre responsabilité, mais aident à la rendre plus vérifiable. La sécurité de nos modèles reste notre responsabilité. »
Les startups de l'IA accélèrent leur croissance des revenus
Comme les entreprises établies et les nouvelles startups s’efforcent de tirer parti de l’intelligence artificielle, de nombreuses startups IA signalent que leurs revenus ne se contentent pas de croître, mais accélèrent rapidement, atteignant des jalo
Les startups asiatiques en intelligence artificielle dévoilent des modèles de type Mythos alors que la prohibition d’exportation d’Anthropic se poursuit
Mercredi, le cabinet chinois de cybersécurité 360 aurait dévoilé Tulongfeng, un outil d’IA qu’il affirme capable de rivaliser directement avec Mythos d’Anthropic. Il s’agit du modèle d’IA axé sur la cybersécurité qui serait si puissant que l’administ
Les experts en cybersécurité critiquent les garde-fous de l’article d’Anthropic
Anthropic a lancé son nouveau modèle, Fable, mardi, le présentant comme une version publique et restreinte de son modèle axé sur la cybersécurité, Mythos, très attendu.Cependant, ces limitations ont suscité l’insatisfaction de plusieurs chercheurs e





Maison






