Clicky

Esta dirección de correo electrónico está siendo protegida contra los robots de spam. Necesita tener JavaScript habilitado para poder verlo.

Estados Unidos ordena a Anthropic que suspenda el acceso a Fable 5 y Mythos 5 para ciudadanos extranjeros

EE-UU. suspende el acceso a Anthropic

La inesperada decisión se produce días después del lanzamiento de Claude Fable 5

Anthropic anunció el viernes que "desactivará abruptamente" sus más avanzados modelos de inteligencia artificial (IA), Claude Fable 5 y Mythos 5 , para todos los usuarios, después de que el gobierno estadounidense le ordenara suspender el acceso a dichos modelos para ciudadanos extranjeros, tanto dentro como fuera de Estados Unidos, alegando motivos de seguridad nacional.

La empresa de IA informó haber recibido una orden a las 17:21 (hora del este de EE. UU.) para suspender el acceso de ciudadanos extranjeros a sus modelos. Indicó que creía que se trataba de un malentendido y que está trabajando para restablecer el acceso a los modelos lo antes posible. El acceso a otros modelos no se verá afectado por la directiva de control de exportaciones.

"Según tenemos entendido, el gobierno cree haber descubierto un método para eludir, o 'desbloquear', Fable 5", dijo la compañía.

"Hemos analizado una demostración de esta técnica específica utilizada para identificar un pequeño número de vulnerabilidades menores previamente conocidas. Todas estas vulnerabilidades parecen relativamente sencillas, y hemos comprobado que otros modelos disponibles públicamente también son capaces de descubrirlas sin necesidad de recurrir a técnicas alternativas".

Esta inesperada decisión se produce días después del lanzamiento de Claude Fable 5 y su contraparte Mythos 5, que utiliza el mismo modelo subyacente pero con medidas de seguridad menos estrictas en algunas áreas, como la ciberseguridad. Esta última, descrita como poseedora de las "capacidades de ciberseguridad más sólidas del mundo", sigue estando disponible para un grupo selecto de expertos en ciberseguridad y operadores de infraestructuras críticas.

Anthropic destacó que ha implementado estrictas medidas de seguridad para prevenir el uso indebido de sus modelos en tareas relacionadas con la ciberseguridad. En concreto, esto se basa en un conjunto de clasificadores de seguridad que se utilizan para detectar posibles usos indebidos, incluidos los intentos de jailbreak, e impedir que responda el modelo principal.

El clasificador de ciberseguridad está diseñado para bloquear las solicitudes dañinas de un solo turno relacionadas con la planificación de un ciberataque, el desarrollo de exploits o la evasión de defensas. La empresa señala que los modelos de la clase Mythos son expertos en encontrar y explotar vulnerabilidades de software, lo que otorga a los atacantes una ventaja estratégica.

La semana pasada, Anthropic reveló que su modelo de clase Mythos puede convertir vulnerabilidades de software recién descubiertas en exploits funcionales en cuestión de horas, o incluso minutos en algunos casos, en lugar de semanas, transformando N días en N horas. Los hallazgos sugieren que los modelos de vanguardia podrían ser igual de eficaces para convertir rápidamente en armas las fallas que se han divulgado públicamente.

"Un solo operador puede convertir ahora en vulnerabilidades funcionales, por unos pocos miles de dólares y sin necesidad de conocimientos especializados, el equipo de pruebas rojas de Anthropic, el equivalente a un mes de parches. Esto significa que el método habitual de aplicación de parches que hoy en día utilizan los desarrolladores de software —con ciclos de lanzamiento mensuales, implementaciones escalonadas de varias semanas y un desfase entre las versiones preliminares y las estables— ya no es válido".

Las medidas de protección de Fable 5 implican que las consultas sobre temas de ciberseguridad recibirán una respuesta de Claude Opus 4.8, el próximo modelo avanzado de la compañía.

En su último comunicado, la compañía argumentó que hasta la fecha no se han desarrollado métodos universales para desbloquear los dispositivos de los modelos más recientes, y agregó que los ejercicios de pruebas internas y externas, realizados por equipos rojos, han demostrado que sus medidas de seguridad son "sustancialmente más efectivas que las de cualquier modelo implementado anteriormente".

Además, Anthropic afirmó que "la resistencia perfecta a las vulnerabilidades" no es posible para ningún proveedor de modelos, ya que todas las medidas de seguridad utilizadas por la industria son susceptibles a vulnerabilidades no universales que son "eficaces en contextos muy limitados o requieren un esfuerzo adicional para adaptarse a cada nueva situación".

"Hasta la fecha, el gobierno solo nos ha proporcionado pruebas verbales de un posible jailbreak limitado y no universal, que consiste esencialmente en pedirle al modelo que lea un código fuente específico y corrija cualquier fallo de software", afirmó.

"Tenemos entendido que se compartió con el gobierno una posible vulnerabilidad. Hemos revisado un informe que creemos que constituye la base de la directiva gubernamental y hemos comprobado que el nivel de capacidad que se muestra en él está ampliamente disponible en otros modelos (incluido el GPT-5.5 de OpenAI) y que lo utilizan a diario los defensores que mantienen la seguridad de los sistemas".

Anthropic también señaló que, si bien es competencia del gobierno bloquear las implementaciones de IA inseguras, el descubrimiento de una "vulnerabilidad potencial limitada" no debería ser motivo para retirar un modelo comercial ampliamente implementado. Añadió que el proceso legal debe ser "transparente, justo, claro y basado en hechos técnicos".

A principios de este año, el Departamento de Defensa de Estados Unidos calificó a Anthropic como un "riesgo para la cadena de suministro" después de que el fabricante de Claude intentara establecer límites al uso militar de su tecnología. La empresa ha presentado dos demandas para desbloquear dicha designación.

Jesus_Caceres