Fable de Anthropic: restricciones que generan controversia entre expertos en ciberseguridad

Fable de Anthropic: restricciones que generan controversia entre expertos en ciberseguridad

Anthropic lanzó su nuevo modelo de IA, Fable, presentándolo como una versión pública y limitada de su aclamado modelo de ciberseguridad Mythos. Sin embargo, la comunidad de investigadores en seguridad cibernética ha reaccionado con críticas ante las estrictas restricciones impuestas.

¿Qué dice Fable cuando se activan sus barreras de seguridad?

Cuando un prompt activa los guardarraíles, Fable pausa la conversación y muestra el mensaje: “sus medidas de seguridad detectaron este mensaje como relacionado con ciberseguridad o temas de biología”. La reconocida investigadora de seguridad Valentina “Chompie” Palmiotti, de IBM X-Force, señaló que “Fable rechaza cualquier solicitud que pueda estar tangencialmente relacionada con ciberseguridad, incluso tareas inocuas como leer un blog”.

Reacciones de los profesionales: ¿demasiado restrictivo?

Matt Suiche, veterano en ciberseguridad y miembro del personal técnico de Tolmo, una startup de IA en ciberseguridad, explicó que “si le pides que escriba código seguro, asume que es trabajo relacionado con ciberseguridad en lugar de mejores prácticas de ingeniería de software, y obtienes una degradación”. Fable está programado para recurrir a Claude Opus 4.8 si se topa con un guardarraíl. Suiche añadió: “Parece basarse en palabras clave, por lo que cualquier término en el campo léxico de ‘ciberseguridad’ activa las barreras”.

Gráfico de las principales inversiones en ciberseguridad desde la pandemia
Las inversiones en ciberseguridad se han disparado, pero las restricciones de Fable generan fricción.

El contexto: Mythos y el Programa de Verificación Cibernética

Anthropic lanzó Mythos en abril, restringido a un número limitado de empresas en el marco del Proyecto Glasswing, un esfuerzo por asegurar software e infraestructura crítica. La semana pasada, amplió el acceso a Mythos a cientos de organizaciones en 15 países. Además, la empresa exige que los profesionales de ciberseguridad se inscriban en el Cyber Verification Program para tener menos limitaciones. OpenAI tiene un programa similar llamado Trusted Access for Cyber.

Porcentaje de sectores que usan IA para ciberseguridad
Telecomunicaciones (80%), banca (75%) y retail (68%) lideran la adopción de IA contra ciberataques.

Mientras tanto, otro investigador se quejó en X de que “incluso pedir una revisión de código” activa las barreras de Fable. Anthropic no respondió de inmediato a una solicitud de comentarios.

Las restricciones buscan limitar el riesgo de que Fable pueda usarse para desarrollar malware o comprometer software, una preocupación constante en Anthropic, así como el desarrollo de armas biológicas. El equilibrio entre seguridad y usabilidad sigue siendo un desafío para la industria.

Comparte este artículo

Otras notas de tu interés:

Deportes

Miami Heat en la Agencia Libre: DeRozan y Thompson, Las Prioridades Estratégicas

Sociedad y Cultura

El Concepto ‘Null’ en Tres Ámbitos: Videojuegos, Estadística y Cultura Digital

Politica

Correos revelan cómo reguladores de Virginia minimizaron preocupaciones de salud por centros de datos

Negocios

Inspección Cancelada en The Club at Brickell Bay: Vecinos Denuncian Violaciones de Alquiler a Corto Plazo

Economia

Caída de millas recorridas: Tesla Robotaxi enfrenta un revés en el segundo trimestre de 2026

Economia

Peter Lake abandona el Consejo de Dominio Energético de Trump

Economia

Exenciones de aranceles de Trump: más de 1,000 productos sin tarifas tras la letra pequeña

Economia

La ley de privacidad de datos más estricta: un problema político en EE.UU.

Tecnologia

Error 404: La página que buscas no existe

Tecnologia

¿Qué es el error 404 ‘Página no encontrada’ y cómo solucionarlo?