Maison
Anthropic élargit les capacités de contrôle de Claude Code, tout en gardant une certaine marge de manœuvre

Pour les développeurs qui s'appuient sur l'IA, l'approche actuelle du « vibe coding » consiste souvent soit à surveiller de près chaque action, soit à laisser carte blanche au modèle. Anthropic affirme que sa dernière mise à jour de Claude élimine ce dilemme en permettant à l'IA de décider de manière autonome quelles actions peuvent être exécutées en toute sécurité — dans certaines limites.
Cette initiative s’inscrit dans une tendance plus large du secteur, où les outils d’IA sont conçus pour agir sans nécessiter l’approbation humaine à chaque étape. Le principal défi consiste à trouver un équilibre entre rapidité et contrôle : des mesures de sécurité excessives ralentissent les progrès, tandis qu’un manque de contrôle peut entraîner des comportements imprévisibles et risqués. Le nouveau « mode auto » d’Anthropic, actuellement en préversion de recherche — ce qui signifie qu’il est disponible à des fins de test mais ne constitue pas encore un produit finalisé —, est sa dernière initiative pour trouver ce juste équilibre.
Le mode automatique utilise des mesures de sécurité basées sur l’IA pour examiner chaque action avant son exécution, à la recherche de comportements risqués non sollicités et de signes d’injection de prompt — une technique d’attaque consistant à intégrer des instructions malveillantes dans le contenu traité, afin de piéger l’IA et de lui faire effectuer des actions non souhaitées. Les actions jugées sûres sont exécutées automatiquement, tandis que celles jugées risquées sont bloquées.
Il s’agit essentiellement d’une extension de la commande existante « dangerously-skip-permissions » de Claude Code, qui délègue l’ensemble de la prise de décision à l’IA, mais avec une couche de sécurité supplémentaire.
Cette fonctionnalité s’inscrit dans la vague récente d’outils de codage autonomes proposés par des entreprises telles que GitHub et OpenAI, capables d’effectuer des tâches pour le compte des développeurs. Elle va toutefois plus loin en confiant à l’IA elle-même la décision de savoir quand demander l’autorisation de l’utilisateur.
Anthropic n’a pas divulgué les critères spécifiques utilisés par sa couche de sécurité pour distinguer les actions sûres des actions risquées — des détails que les développeurs souhaiteront sans doute mieux comprendre avant d’adopter largement cette fonctionnalité. (TechCrunch a contacté l’entreprise pour obtenir plus d’informations à ce sujet.)
Le mode « Auto » fait suite au lancement par Anthropic de « Claude Code Review », un outil de révision automatique du code qui détecte les bogues avant qu’ils n’atteignent la base de code, et de « Dispatch for Cowork », qui permet aux utilisateurs d’attribuer des tâches à des agents IA afin qu’ils s’en chargent à leur place.
Le mode Auto sera déployé auprès des utilisateurs Enterprise et API dans les prochains jours. L’entreprise précise qu’il fonctionne actuellement exclusivement avec Claude Sonnet 4.6 et Opus 4.6, et recommande d’utiliser cette nouvelle fonctionnalité dans des « environnements isolés » — des configurations en sandbox distinctes des systèmes de production, afin de minimiser les dommages potentiels en cas de problème.
Article connexe
Anthropic lance Opus 4.8, qui intègre un nouvel outil de flux de travail dynamique
Anthropic a dévoilé jeudi Opus 4.8, la dernière version en date de son modèle public phare. Proposée au même prix que la version précédente, cette mise à jour est désormais accessible sur toutes les p
Sesame, la start-up spécialisée dans l'IA fondée par les créateurs d'Oculus, fait ses débuts sur iOS
Jeudi, Sesame, une start-up spécialisée dans l’IA fondée par les créateurs d’Oculus et d’autres anciens membres de l’équipe VR de Meta, a dévoilé une préversion publique de ses agents IA conversationn
Frontier AI Labs refuse de dévoiler ses stratégies de confinement des modèles indésirables
Des recherches récentes indiquent que très peu de grands laboratoires spécialisés dans l’IA ont publié ou présenté des plans d’intervention en cas de défaillance. Un plan d’intervention définit les pr
Recommandations de sujets spéciaux liés
commentaires (0)

Pour les développeurs qui s'appuient sur l'IA, l'approche actuelle du « vibe coding » consiste souvent soit à surveiller de près chaque action, soit à laisser carte blanche au modèle. Anthropic affirme que sa dernière mise à jour de Claude élimine ce dilemme en permettant à l'IA de décider de manière autonome quelles actions peuvent être exécutées en toute sécurité — dans certaines limites.
Cette initiative s’inscrit dans une tendance plus large du secteur, où les outils d’IA sont conçus pour agir sans nécessiter l’approbation humaine à chaque étape. Le principal défi consiste à trouver un équilibre entre rapidité et contrôle : des mesures de sécurité excessives ralentissent les progrès, tandis qu’un manque de contrôle peut entraîner des comportements imprévisibles et risqués. Le nouveau « mode auto » d’Anthropic, actuellement en préversion de recherche — ce qui signifie qu’il est disponible à des fins de test mais ne constitue pas encore un produit finalisé —, est sa dernière initiative pour trouver ce juste équilibre.
Le mode automatique utilise des mesures de sécurité basées sur l’IA pour examiner chaque action avant son exécution, à la recherche de comportements risqués non sollicités et de signes d’injection de prompt — une technique d’attaque consistant à intégrer des instructions malveillantes dans le contenu traité, afin de piéger l’IA et de lui faire effectuer des actions non souhaitées. Les actions jugées sûres sont exécutées automatiquement, tandis que celles jugées risquées sont bloquées.
Il s’agit essentiellement d’une extension de la commande existante « dangerously-skip-permissions » de Claude Code, qui délègue l’ensemble de la prise de décision à l’IA, mais avec une couche de sécurité supplémentaire.
Cette fonctionnalité s’inscrit dans la vague récente d’outils de codage autonomes proposés par des entreprises telles que GitHub et OpenAI, capables d’effectuer des tâches pour le compte des développeurs. Elle va toutefois plus loin en confiant à l’IA elle-même la décision de savoir quand demander l’autorisation de l’utilisateur.
Anthropic n’a pas divulgué les critères spécifiques utilisés par sa couche de sécurité pour distinguer les actions sûres des actions risquées — des détails que les développeurs souhaiteront sans doute mieux comprendre avant d’adopter largement cette fonctionnalité. (TechCrunch a contacté l’entreprise pour obtenir plus d’informations à ce sujet.)
Le mode « Auto » fait suite au lancement par Anthropic de « Claude Code Review », un outil de révision automatique du code qui détecte les bogues avant qu’ils n’atteignent la base de code, et de « Dispatch for Cowork », qui permet aux utilisateurs d’attribuer des tâches à des agents IA afin qu’ils s’en chargent à leur place.
Le mode Auto sera déployé auprès des utilisateurs Enterprise et API dans les prochains jours. L’entreprise précise qu’il fonctionne actuellement exclusivement avec Claude Sonnet 4.6 et Opus 4.6, et recommande d’utiliser cette nouvelle fonctionnalité dans des « environnements isolés » — des configurations en sandbox distinctes des systèmes de production, afin de minimiser les dommages potentiels en cas de problème.
Anthropic lance Opus 4.8, qui intègre un nouvel outil de flux de travail dynamique
Anthropic a dévoilé jeudi Opus 4.8, la dernière version en date de son modèle public phare. Proposée au même prix que la version précédente, cette mise à jour est désormais accessible sur toutes les p
Sesame, la start-up spécialisée dans l'IA fondée par les créateurs d'Oculus, fait ses débuts sur iOS
Jeudi, Sesame, une start-up spécialisée dans l’IA fondée par les créateurs d’Oculus et d’autres anciens membres de l’équipe VR de Meta, a dévoilé une préversion publique de ses agents IA conversationn
Frontier AI Labs refuse de dévoiler ses stratégies de confinement des modèles indésirables
Des recherches récentes indiquent que très peu de grands laboratoires spécialisés dans l’IA ont publié ou présenté des plans d’intervention en cas de défaillance. Un plan d’intervention définit les pr











