Anthropic abandona su promesa de seguridad en el desarrollo de IA

Anthropic, una destacada empresa de inteligencia artificial, ha decidido eliminar la promesa central de su política de seguridad, según informaron sus representantes a TIME.

En 2023, la compañía se comprometió a no entrenar sistemas de IA a menos que pudiera garantizar que sus medidas de seguridad eran adecuadas. Este compromiso fue considerado el pilar de su Política de Escalado Responsable (RSP), mostrando su intención de ser una empresa responsable frente a la presión del mercado por desarrollar tecnologías potencialmente peligrosas.

Sin embargo, en meses recientes, la empresa optó por una revisión radical de la RSP, incluyendo la eliminación de la promesa de no lanzar modelos de IA si no se garantizaban mitigaciones adecuadas de riesgo.

“Consideramos que no ayudaría a nadie detener el entrenamiento de modelos de IA”, declaró Jared Kaplan, director científico de Anthropic, en una entrevista exclusiva con TIME. “No creímos que tuviera sentido hacer compromisos unilaterales mientras los competidores avanzan rápidamente.”

Cambios en la Política de Seguridad

La nueva versión de la política, revisada por TIME, incluye compromisos para ser más transparente sobre los riesgos de seguridad de la IA. Esto abarca la divulgación adicional sobre cómo se comportan los modelos de Anthropic en las pruebas de seguridad. Además, la empresa se compromete a igualar o superar los esfuerzos de seguridad de sus competidores.

La revisión también promete “retrasar” el desarrollo de IA si se considera que Anthropic es líder en la carrera de la IA y que los riesgos de catástrofe son significativos.

A pesar de estos cambios, la actualización de la RSP deja a Anthropic menos restringido por sus propias políticas de seguridad, que anteriormente prohibían categóricamente el entrenamiento de modelos sin las medidas adecuadas.

Este cambio se da en un contexto donde Anthropic, antes considerada rezagada frente a OpenAI, ha tenido una serie de éxitos tecnológicos y comerciales. Sus modelos Claude, especialmente Claude Code, han ganado numerosos seguidores.

Implicaciones de la Nueva Estrategia

Kaplan negó que la decisión de cambiar de rumbo fuera una capitulación ante las presiones del mercado. En cambio, lo presentó como una respuesta pragmática a las realidades políticas y científicas emergentes. “No creo que estemos dando un giro de 180 grados”, afirmó Kaplan.

Cuando Anthropic introdujo la RSP en 2023, se esperaba que fomentara que sus rivales adoptaran medidas similares. Sin embargo, las regulaciones esperadas nunca se materializaron, y la administración Trump adoptó una actitud de laissez-faire hacia el desarrollo de IA.

En este nuevo panorama, la ciencia de las evaluaciones de IA resultó ser más complicada de lo que Anthropic anticipaba. En 2025, la empresa anunció que no podía descartar la posibilidad de que sus modelos facilitaran un ataque bioterrorista, aunque la falta de evidencia fuerte complicaba el convencimiento de gobiernos y competidores sobre la necesidad de actuar con precaución.

Ilustración de un hombre mayor con auriculares y chaqueta