Hogar
Anthropic amplía el control sobre el código de Claude, pero mantiene ciertas restricciones

Para los desarrolladores que recurren a la IA, el enfoque actual de la «programación intuitiva» suele implicar o bien supervisar de cerca cada acción, o bien dar rienda suelta al modelo. Anthropic afirma que su última actualización de Claude elimina ese dilema al permitir que la IA decida de forma autónoma qué acciones son seguras de ejecutar, dentro de ciertos límites.
Esta iniciativa refleja una tendencia más amplia del sector, en la que se están creando herramientas de IA para que actúen sin necesidad de aprobación humana en cada paso. El principal reto es encontrar el equilibrio entre la rapidez y la supervisión: unas medidas de seguridad excesivas ralentizan el progreso, mientras que unas medidas insuficientes pueden dar lugar a comportamientos impredecibles y arriesgados. El nuevo «modo automático» de Anthropic, actualmente en fase de vista previa de investigación —lo que significa que está disponible para pruebas, pero aún no es un producto definitivo—, es su último esfuerzo por alcanzar este equilibrio.
El «modo automático» emplea medidas de seguridad basadas en IA para examinar cada acción antes de su ejecución, buscando comportamientos de riesgo no solicitados y signos de «prompt injection» —una técnica de ataque en la que se incrustan instrucciones maliciosas en el contenido que se está procesando, engañando a la IA para que realice acciones no deseadas—. Las acciones consideradas seguras se llevan a cabo automáticamente, mientras que las de riesgo se bloquean.
Se trata, en esencia, de una ampliación del comando ya existente de Claude Code «dangerously-skip-permissions», que delega toda la toma de decisiones a la IA, pero con una capa de seguridad adicional.
La función se basa en el reciente auge de las herramientas de programación autónoma de empresas como GitHub y OpenAI, que pueden llevar a cabo tareas en nombre de los desarrolladores. Sin embargo, va un paso más allá al trasladar la decisión de cuándo solicitar permiso al usuario a la propia IA.
Anthropic no ha revelado los criterios específicos que utiliza su capa de seguridad para diferenciar las acciones seguras de las arriesgadas —detalles que los desarrolladores probablemente querrán comprender con mayor claridad antes de adoptar ampliamente la función—. (TechCrunch se ha puesto en contacto con la empresa para obtener más información al respecto).
El modo automático llega tras el lanzamiento por parte de Anthropic de «Claude Code Review», un revisor automático de código que detecta errores antes de que lleguen al código base, y de «Dispatch for Cowork», que permite a los usuarios asignar tareas a agentes de IA para que se encarguen del trabajo en su nombre.
El modo automático se pondrá a disposición de los usuarios de Enterprise y API en los próximos días. La empresa afirma que, actualmente, funciona exclusivamente con Claude Sonnet 4.6 y Opus 4.6, y recomienda utilizar la nueva función en «entornos aislados» —configuraciones en entornos de prueba separadas de los sistemas de producción—, lo que minimiza los posibles daños si algo sale mal.
Artículo relacionado
Anthropic lanza Opus 4.8, que incluye una nueva herramienta dinámica para el flujo de trabajo
Anthropic presentó el jueves Opus 4.8, la última versión de su modelo público estrella. Con un precio idéntico al de su predecesor, esta actualización ya está disponible en todas las plataformas.Con s
Sesame, la startup de IA fundada por los creadores de Oculus, se estrena en iOS
El jueves, Sesame, una startup de IA fundada por los creadores de Oculus y otros antiguos miembros del equipo de realidad virtual de Meta, presentó una versión preliminar pública de sus agentes de IA
Frontier AI Labs se niega a revelar las estrategias de contención para los modelos rebeldes
Investigaciones recientes indican que muy pocos laboratorios líderes en IA han publicado o demostrado planes de respuesta de contención. Un plan de contención define los procedimientos a seguir cuando
Recomendaciones de temas especiales relacionados
comentario (0)
0/500

Para los desarrolladores que recurren a la IA, el enfoque actual de la «programación intuitiva» suele implicar o bien supervisar de cerca cada acción, o bien dar rienda suelta al modelo. Anthropic afirma que su última actualización de Claude elimina ese dilema al permitir que la IA decida de forma autónoma qué acciones son seguras de ejecutar, dentro de ciertos límites.
Esta iniciativa refleja una tendencia más amplia del sector, en la que se están creando herramientas de IA para que actúen sin necesidad de aprobación humana en cada paso. El principal reto es encontrar el equilibrio entre la rapidez y la supervisión: unas medidas de seguridad excesivas ralentizan el progreso, mientras que unas medidas insuficientes pueden dar lugar a comportamientos impredecibles y arriesgados. El nuevo «modo automático» de Anthropic, actualmente en fase de vista previa de investigación —lo que significa que está disponible para pruebas, pero aún no es un producto definitivo—, es su último esfuerzo por alcanzar este equilibrio.
El «modo automático» emplea medidas de seguridad basadas en IA para examinar cada acción antes de su ejecución, buscando comportamientos de riesgo no solicitados y signos de «prompt injection» —una técnica de ataque en la que se incrustan instrucciones maliciosas en el contenido que se está procesando, engañando a la IA para que realice acciones no deseadas—. Las acciones consideradas seguras se llevan a cabo automáticamente, mientras que las de riesgo se bloquean.
Se trata, en esencia, de una ampliación del comando ya existente de Claude Code «dangerously-skip-permissions», que delega toda la toma de decisiones a la IA, pero con una capa de seguridad adicional.
La función se basa en el reciente auge de las herramientas de programación autónoma de empresas como GitHub y OpenAI, que pueden llevar a cabo tareas en nombre de los desarrolladores. Sin embargo, va un paso más allá al trasladar la decisión de cuándo solicitar permiso al usuario a la propia IA.
Anthropic no ha revelado los criterios específicos que utiliza su capa de seguridad para diferenciar las acciones seguras de las arriesgadas —detalles que los desarrolladores probablemente querrán comprender con mayor claridad antes de adoptar ampliamente la función—. (TechCrunch se ha puesto en contacto con la empresa para obtener más información al respecto).
El modo automático llega tras el lanzamiento por parte de Anthropic de «Claude Code Review», un revisor automático de código que detecta errores antes de que lleguen al código base, y de «Dispatch for Cowork», que permite a los usuarios asignar tareas a agentes de IA para que se encarguen del trabajo en su nombre.
El modo automático se pondrá a disposición de los usuarios de Enterprise y API en los próximos días. La empresa afirma que, actualmente, funciona exclusivamente con Claude Sonnet 4.6 y Opus 4.6, y recomienda utilizar la nueva función en «entornos aislados» —configuraciones en entornos de prueba separadas de los sistemas de producción—, lo que minimiza los posibles daños si algo sale mal.
Anthropic lanza Opus 4.8, que incluye una nueva herramienta dinámica para el flujo de trabajo
Anthropic presentó el jueves Opus 4.8, la última versión de su modelo público estrella. Con un precio idéntico al de su predecesor, esta actualización ya está disponible en todas las plataformas.Con s
Sesame, la startup de IA fundada por los creadores de Oculus, se estrena en iOS
El jueves, Sesame, una startup de IA fundada por los creadores de Oculus y otros antiguos miembros del equipo de realidad virtual de Meta, presentó una versión preliminar pública de sus agentes de IA
Frontier AI Labs se niega a revelar las estrategias de contención para los modelos rebeldes
Investigaciones recientes indican que muy pocos laboratorios líderes en IA han publicado o demostrado planes de respuesta de contención. Un plan de contención define los procedimientos a seguir cuando











