Hogar
Expertos en ciberseguridad critican las barreras de protección en el relato de Anthropic

Anthropic lanzó su modelo más reciente, Fable, el martes, posicionándolo como una iteración pública y restringida de su muy esperado modelo centrado en la ciberseguridad, Mythos.
Sin embargo, las limitaciones han provocado insatisfacción entre varios investigadores y profesionales de la ciberseguridad que han expresado sus preocupaciones en línea.
“[Fable] bloquea cualquier solicitud que pueda estar remotamente relacionada con la ciberseguridad, incluidas tareas inofensivas como leer una publicación de blog”, declaró Valentina “Chompie” Palmiotti, destacada investigadora de seguridad en IBM X-Force.
Cuando una solicitud del usuario activa estos filtros de seguridad, Fable detiene la conversación y muestra un mensaje que indica que sus “protocolos de seguridad marcaron esta entrada por temas de ciberseguridad o biológicos”.
Estas restricciones tienen como objetivo mitigar el riesgo de que Fable se utilice para crear malware o explotar software, una preocupación persistente para Anthropic. Las restricciones biológicas provienen de preocupaciones similares sobre el desarrollo de armas biológicas.
Al lanzar Mythos en abril, Anthropic limitó el acceso a un grupo selecto de empresas y organizaciones bajo el Proyecto Glasswing, una iniciativa diseñada para implementar el modelo en la protección de software e infraestructura crítica. La semana pasada, Anthropic amplió el acceso a Mythos a cientos de organizaciones en 15 países.
A pesar de estas buenas intenciones, muchos expertos en ciberseguridad siguen frustrados por la naturaleza aparentemente arbitraria de las restricciones. Matt Suiche, un experimentado profesional de la ciberseguridad, dijo a TechCrunch que “si le pides que escriba código seguro, lo interpreta como trabajo relacionado con la ciberseguridad en lugar de mejores prácticas de ingeniería de software, lo que resulta en una reducción”. Fable está configurado para volver a Claude Opus 4.8 cuando se activan las barreras de seguridad. “Parece que depende de palabras clave, por lo que cualquier término dentro del léxico de ‘ciberseguridad’ activa los filtros”, señaló.
Contáctenos
¿Tiene información adicional sobre cómo los hackers están aprovechando la IA, o sobre cómo las empresas de ciberseguridad están integrando la IA? Damos la bienvenida a sus comentarios. Desde un dispositivo y red personales, puede comunicarse de forma segura con Lorenzo Franceschi-Bicchierai en Signal al +1 917 257 1382, a través de Telegram y Keybase @lorenzofb, o por correo electrónico.
“Sin embargo, es comprensible dado que aún estamos en las primeras etapas y están refinando sus barreras de seguridad. Estoy seguro de que evolucionarán a medida que Anthropic y otros desarrolladores de modelos de vanguardia colaboren más estrechamente con la nueva generación de empresas de ciberseguridad”, dijo Suiche, miembro del personal técnico en Tolmo, una startup de ciberseguridad basada en IA. “Es preferible restringir en exceso al principio y relajar las barreras de seguridad con el tiempo”.
Otro investigador se quejó en X de que “incluso solicitar una revisión de código” activa los filtros de seguridad de Fable.
Anthropic no respondió inmediatamente a una solicitud de comentario.
Más allá de las barreras de seguridad a nivel de modelo, Anthropic requiere que los profesionales de la ciberseguridad soliciten su Programa de Verificación de Ciberseguridad. Los solicitantes aprobados enfrentan menos restricciones al usar Claude para tareas de ciberseguridad. OpenAI ofrece un programa comparable conocido como Acceso Confiado para Ciber.
Artículo relacionado
La Casa Blanca abandona la etiqueta de “Inteligencia Superior” para la IA
Cargando el reproductor…Esta semana, la Casa Blanca reunió a casi todos los principales directivos ejecutivos de empresas tecnológicas en una misma sala, incluidos Mark Zuckerberg, Jeff Bezos, Elon Musk y Dario Amodei de Anthropic, para firmar un co
Anthropic presenta Sonnet 5.5 como un socio de trabajo más rápido y económico
En medio de la continua competencia entre modelos de IA, Anthropic ha lanzado la última iteración de Sonnet, su oferta de gama media, prometiendo una velocidad sustancialmente mejorada y costos más bajos en comparación con la versión anterior.Anthro
El último enfrentamiento de Anthropic con la administración Trump podría incluso beneficiarla, según los datos de ventas
Anthropic está experimentando un mes notable.Según Ramp, la empresa de inteligencia artificial superó a OpenAI en la cuota de mercado del gasto empresarial por primera vez, cerrando mayo con una ronda de financiación de 65.000 millones de dólares y
Recomendaciones de temas especiales relacionados
comentario (0)
0/500

Anthropic lanzó su modelo más reciente, Fable, el martes, posicionándolo como una iteración pública y restringida de su muy esperado modelo centrado en la ciberseguridad, Mythos.
Sin embargo, las limitaciones han provocado insatisfacción entre varios investigadores y profesionales de la ciberseguridad que han expresado sus preocupaciones en línea.
“[Fable] bloquea cualquier solicitud que pueda estar remotamente relacionada con la ciberseguridad, incluidas tareas inofensivas como leer una publicación de blog”, declaró Valentina “Chompie” Palmiotti, destacada investigadora de seguridad en IBM X-Force.
Cuando una solicitud del usuario activa estos filtros de seguridad, Fable detiene la conversación y muestra un mensaje que indica que sus “protocolos de seguridad marcaron esta entrada por temas de ciberseguridad o biológicos”.
Estas restricciones tienen como objetivo mitigar el riesgo de que Fable se utilice para crear malware o explotar software, una preocupación persistente para Anthropic. Las restricciones biológicas provienen de preocupaciones similares sobre el desarrollo de armas biológicas.
Al lanzar Mythos en abril, Anthropic limitó el acceso a un grupo selecto de empresas y organizaciones bajo el Proyecto Glasswing, una iniciativa diseñada para implementar el modelo en la protección de software e infraestructura crítica. La semana pasada, Anthropic amplió el acceso a Mythos a cientos de organizaciones en 15 países.
A pesar de estas buenas intenciones, muchos expertos en ciberseguridad siguen frustrados por la naturaleza aparentemente arbitraria de las restricciones. Matt Suiche, un experimentado profesional de la ciberseguridad, dijo a TechCrunch que “si le pides que escriba código seguro, lo interpreta como trabajo relacionado con la ciberseguridad en lugar de mejores prácticas de ingeniería de software, lo que resulta en una reducción”. Fable está configurado para volver a Claude Opus 4.8 cuando se activan las barreras de seguridad. “Parece que depende de palabras clave, por lo que cualquier término dentro del léxico de ‘ciberseguridad’ activa los filtros”, señaló.
Contáctenos
¿Tiene información adicional sobre cómo los hackers están aprovechando la IA, o sobre cómo las empresas de ciberseguridad están integrando la IA? Damos la bienvenida a sus comentarios. Desde un dispositivo y red personales, puede comunicarse de forma segura con Lorenzo Franceschi-Bicchierai en Signal al +1 917 257 1382, a través de Telegram y Keybase @lorenzofb, o por correo electrónico.
“Sin embargo, es comprensible dado que aún estamos en las primeras etapas y están refinando sus barreras de seguridad. Estoy seguro de que evolucionarán a medida que Anthropic y otros desarrolladores de modelos de vanguardia colaboren más estrechamente con la nueva generación de empresas de ciberseguridad”, dijo Suiche, miembro del personal técnico en Tolmo, una startup de ciberseguridad basada en IA. “Es preferible restringir en exceso al principio y relajar las barreras de seguridad con el tiempo”.
Otro investigador se quejó en X de que “incluso solicitar una revisión de código” activa los filtros de seguridad de Fable.
Anthropic no respondió inmediatamente a una solicitud de comentario.
Más allá de las barreras de seguridad a nivel de modelo, Anthropic requiere que los profesionales de la ciberseguridad soliciten su Programa de Verificación de Ciberseguridad. Los solicitantes aprobados enfrentan menos restricciones al usar Claude para tareas de ciberseguridad. OpenAI ofrece un programa comparable conocido como Acceso Confiado para Ciber.
La Casa Blanca abandona la etiqueta de “Inteligencia Superior” para la IA
Cargando el reproductor…Esta semana, la Casa Blanca reunió a casi todos los principales directivos ejecutivos de empresas tecnológicas en una misma sala, incluidos Mark Zuckerberg, Jeff Bezos, Elon Musk y Dario Amodei de Anthropic, para firmar un co
Anthropic presenta Sonnet 5.5 como un socio de trabajo más rápido y económico
En medio de la continua competencia entre modelos de IA, Anthropic ha lanzado la última iteración de Sonnet, su oferta de gama media, prometiendo una velocidad sustancialmente mejorada y costos más bajos en comparación con la versión anterior.Anthro
El último enfrentamiento de Anthropic con la administración Trump podría incluso beneficiarla, según los datos de ventas
Anthropic está experimentando un mes notable.Según Ramp, la empresa de inteligencia artificial superó a OpenAI en la cuota de mercado del gasto empresarial por primera vez, cerrando mayo con una ronda de financiación de 65.000 millones de dólares y











