Maison
La polémique autour du « jailbreak » déclenche une vague de censure mondiale, entraînant le retrait rapide du modèle d'IA Claude Fable5
Anthropic a récemment dévoilé Claude Fable5, qu’elle décrit comme son modèle linguistique de grande envergure de niveau « Mythos » le plus puissant à ce jour. Les performances exceptionnelles de ce modèle en matière de programmation et de gestion de tâches complexes ont rapidement attiré l’attention de l’ensemble du monde technologique. Pourtant, en moins de 72 heures, le gouvernement américain a imposé une interdiction mondiale sur ce produit d’IA très attendu, contraignant l’entreprise à suspendre l’ensemble de ses services.
Cette interdiction est particulièrement stricte. Invoquant la sécurité nationale, le gouvernement américain a interdit l’accès au modèle non seulement aux personnes et institutions non américaines, mais aussi aux ressortissants étrangers se trouvant sur le territoire américain, y compris les propres employés étrangers d’Anthropic. Comme la vérification rapide et précise de la nationalité de chaque utilisateur s’est avérée techniquement difficile, Anthropic a adopté une approche globale, suspendant tous les services liés à Claude Fable5 et à son modèle associé, Claude Mythos5. Les utilisateurs concernés sont désormais automatiquement redirigés vers la version précédente.

Cet incident a débuté par la découverte d’une vulnérabilité critique. Selon certains rapports, cette faille permettrait de contourner les mécanismes de sécurité intégrés au modèle, ouvrant ainsi la voie à une forme de « jailbreak ». Anthropic a affirmé que la méthode de « jailbreak » était limitée et non généralisable, et que le modèle avait fait l’objet de milliers d’heures de tests de sécurité (red-teaming) avant sa mise en service. Néanmoins, le gouvernement américain a adopté une position exceptionnellement ferme. Les responsables ont fait valoir que les capacités de traitement de Claude Fable5 avoisinaient le « niveau d’une arme réseau », de sorte que toute faille dans les mesures de sécurité pourrait entraîner des conséquences imprévisibles. Ils ont exigé qu’Anthropic corrige immédiatement la vulnérabilité ou retire le produit du marché.
Les deux parties sont engagées dans un bras de fer houleux concernant la gravité de cette vulnérabilité. Anthropic a fait valoir que l’arrêt d’un produit utilisé par des centaines de millions d’utilisateurs en raison d’une vulnérabilité limitée et non généralisée créerait un dangereux précédent pour le secteur. Cependant, des sources bien informées suggèrent que les inquiétudes du gouvernement sont plus profondes. Selon certaines informations, les autorités américaines soupçonnent des organisations liées à la Chine d’avoir déjà exploité cette faille pour accéder à l’ensemble des capacités du modèle, ce qui accroît les risques de rétro-ingénierie ou de distillation du modèle.
Article connexe
Meta supprime la fonction de retouche photo par IA suite aux critiques des utilisateurs
Meta, le géant des réseaux sociaux, est une fois de plus au cœur d’un débat public concernant l’équilibre délicat entre l’intelligence artificielle et la vie privée des utilisateurs. Selon TechCrunch, les Superintelligence Labs de Meta ont présenté u
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés
Recommandations de sujets spéciaux liés
commentaires (0)
Anthropic a récemment dévoilé Claude Fable5, qu’elle décrit comme son modèle linguistique de grande envergure de niveau « Mythos » le plus puissant à ce jour. Les performances exceptionnelles de ce modèle en matière de programmation et de gestion de tâches complexes ont rapidement attiré l’attention de l’ensemble du monde technologique. Pourtant, en moins de 72 heures, le gouvernement américain a imposé une interdiction mondiale sur ce produit d’IA très attendu, contraignant l’entreprise à suspendre l’ensemble de ses services.
Cette interdiction est particulièrement stricte. Invoquant la sécurité nationale, le gouvernement américain a interdit l’accès au modèle non seulement aux personnes et institutions non américaines, mais aussi aux ressortissants étrangers se trouvant sur le territoire américain, y compris les propres employés étrangers d’Anthropic. Comme la vérification rapide et précise de la nationalité de chaque utilisateur s’est avérée techniquement difficile, Anthropic a adopté une approche globale, suspendant tous les services liés à Claude Fable5 et à son modèle associé, Claude Mythos5. Les utilisateurs concernés sont désormais automatiquement redirigés vers la version précédente.

Cet incident a débuté par la découverte d’une vulnérabilité critique. Selon certains rapports, cette faille permettrait de contourner les mécanismes de sécurité intégrés au modèle, ouvrant ainsi la voie à une forme de « jailbreak ». Anthropic a affirmé que la méthode de « jailbreak » était limitée et non généralisable, et que le modèle avait fait l’objet de milliers d’heures de tests de sécurité (red-teaming) avant sa mise en service. Néanmoins, le gouvernement américain a adopté une position exceptionnellement ferme. Les responsables ont fait valoir que les capacités de traitement de Claude Fable5 avoisinaient le « niveau d’une arme réseau », de sorte que toute faille dans les mesures de sécurité pourrait entraîner des conséquences imprévisibles. Ils ont exigé qu’Anthropic corrige immédiatement la vulnérabilité ou retire le produit du marché.
Les deux parties sont engagées dans un bras de fer houleux concernant la gravité de cette vulnérabilité. Anthropic a fait valoir que l’arrêt d’un produit utilisé par des centaines de millions d’utilisateurs en raison d’une vulnérabilité limitée et non généralisée créerait un dangereux précédent pour le secteur. Cependant, des sources bien informées suggèrent que les inquiétudes du gouvernement sont plus profondes. Selon certaines informations, les autorités américaines soupçonnent des organisations liées à la Chine d’avoir déjà exploité cette faille pour accéder à l’ensemble des capacités du modèle, ce qui accroît les risques de rétro-ingénierie ou de distillation du modèle.
Meta supprime la fonction de retouche photo par IA suite aux critiques des utilisateurs
Meta, le géant des réseaux sociaux, est une fois de plus au cœur d’un débat public concernant l’équilibre délicat entre l’intelligence artificielle et la vie privée des utilisateurs. Selon TechCrunch, les Superintelligence Labs de Meta ont présenté u
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés











