Anthropic restringe el uso de su IA avanzada a solo 40 organizaciones por motivos de seguridad

Anthropic ha desarrollado un nuevo modelo de inteligencia artificial llamado Claude Mythos. Este modelo, según la compañía, es tan avanzado que no estará disponible para el público general. Solo 40 organizaciones podrán acceder a él, y su uso estará limitado a tareas de ciberseguridad.

La noticia se produce tras una filtración accidental del modelo. En marzo, un error de configuración en el sistema de gestión de contenidos de Anthropic expuso casi 3.000 archivos internos. Estos documentos incluían un borrador de un blog que describía a Mythos como el modelo de IA más potente que han desarrollado hasta la fecha. A raíz de esto, la empresa confirmó su existencia y describió la situación como un «error humano».

Características y Eficiencia de Mythos

Mythos no es simplemente una versión mejorada de Claude Opus 4.6, el modelo actual más avanzado de Anthropic. La empresa lo categoriza como Capybara, un nivel superior más costoso y cualitativamente diferente.

Uno de los principales problemas es que su eficiencia en detectar fallos y vulnerabilidades de software podría permitir un acceso no autorizado, lo que lo hace potencialmente peligroso. En CyberGym, un banco de pruebas para sistemas de IA, Mythos obtuvo una puntuación del 83,1%. En comparación, Opus 4.6 se quedó en el 66,6%, lo que representa una diferencia significativa en una métrica difícil de mejorar.

Limitaciones del Despliegue

Logan Graham, parte del equipo de red team de Anthropic, describe a Mythos como un investigador de seguridad avanzado. Este modelo puede identificar «decenas de miles de vulnerabilidades» que un experto humano podría pasar por alto y, además, es capaz de escribir el código para explotarlas en minutos.

En pruebas internas, Mythos encontró miles de vulnerabilidades de día cero en software de código abierto, muchas de las cuales habían permanecido sin detección durante más de diez años.

Project Glasswing

Para prevenir que el lanzamiento público de Mythos deje vulnerables aplicaciones críticas, Anthropic ha decidido limitar su uso a 40 empresas. Este esfuerzo se denomina Project Glasswing e incluye a empresas como Amazon Web Services, Apple y Google.

Las organizaciones utilizarán Mythos para evaluar sus sistemas y compartirán hallazgos con la industria. Anthropic también destinará hasta 100 millones de dólares en créditos y 4 millones más para organizaciones de seguridad de código abierto, como OpenSSF.

Dario Amodei, CEO de Anthropic, justificó esta decisión por los problemas que Mythos podría generar. Reconoció que la industria pronto contará con modelos similares, lo que subraya la necesidad de un plan de acción.

No se ha establecido una fecha para el lanzamiento público de Mythos, ya que actualmente es «muy caro de ejecutar». Anthropic se enfocará en mejorar su eficiencia antes de considerar un despliegue general.

Ilustración de un hombre mayor con auriculares y chaqueta