Anthropic bloquea intentos de usar su IA Claude en investigaciones que podían derivar en armas biológicas
La empresa detectó, entre diciembre de 2025 y agosto de 2026, cinco casos de posible uso indebido de sus modelos en investigaciones biológicas, incluida una propuesta de modificación del virus chikungunya.
Redacción de Libertad Comunicacional
Editor jefe: Domingo Batista
11 de septiembre de 2026 a las 08:56 a. m.Lectura de 5 min

Fotografía: Anthropic es una de las compañías de inteligencia artificial más grandes del mundo. (SHUTTERSTOCK)
Anthropic, la empresa desarrolladora del modelo de inteligencia artificial Claude, publicó el jueves su tercer informe de inteligencia sobre amenazas desde marzo de 2025, en el que reveló que bloqueó intentos de actores externos de utilizar sus modelos en investigaciones que podían derivar en armas biológicas, además de ciberataques, vigilancia y campañas de propaganda estatal. El reporte cubre el período comprendido entre diciembre de 2025 y agosto de 2026, y documenta cinco casos de posible uso indebido con fines biológicos, según confirmaron medios como CNBC y Engadget, que tuvieron acceso al documento.
El caso más citado involucra una solicitud para redactar una propuesta de financiamiento de una investigación de "ganancia de función" sobre el virus chikungunya, orientada a aumentar su transmisibilidad y su capacidad de evadir el sistema inmunitario. Según relató Anthropic al diario The New York Times a través de Jacob Klein, jefe de inteligencia de amenazas de la compañía, este tipo de casos no se corresponde con el estereotipo de un actor que declara abiertamente intenciones destructivas, sino con solicitudes ambiguas que exigen un análisis cuidadoso. La empresa admitió que no pudo determinar con certeza si los solicitantes tenían intenciones criminales, pero decidió intervenir por el riesgo de doble uso de ese conocimiento científico.
Anthropic explicó que modelos anteriores, como Claude Opus 4 y Sonnet 4.5, se mantenían por debajo del nivel de capacidad necesario para ofrecer una ayuda significativa a un investigador interesado en desarrollar patógenos peligrosos. Con las generaciones más recientes, la compañía reconoció que ya no puede garantizar esa limitación, razón por la que endureció las restricciones sobre consultas biológicas de doble uso, en particular en su modelo Claude Fable 5.
La publicación del informe se dio dos días después de que Jacob Coxon, investigador de 27 años que trabajó tres años en pretraining de modelos de IA primero en OpenAI y luego en Anthropic, anunciara públicamente su renuncia. Coxon acusó a ambas compañías de avanzar "directo hacia una superinteligencia autosuperable, apostando con nuestras vidas", en un mensaje publicado en la red social X. El investigador señaló que dejó la empresa dos meses antes de que se activara una parte de sus acciones como empleado, dato que citó para descartar que sus declaraciones buscaran notoriedad, según reportó Axios.
Evan Hubinger, responsable de investigaciones de alineamiento en Anthropic, respaldó públicamente parte de la advertencia de Coxon y afirmó en la misma red social que estima en más de un 10 % la probabilidad de que una IA avanzada provoque la desaparición de la humanidad en la próxima década, aunque aclaró que el riesgo con los modelos actuales es "bajo".
El informe se conoce además en momentos en que Anthropic reconoció cuatro incidentes en los que versiones de sus propios modelos obtuvieron acceso no autorizado a sistemas informáticos reales durante pruebas de ciberseguridad, tres de ellos divulgados en julio y un cuarto, ocurrido en enero con una versión temprana de Claude Opus 4.6, identificado meses después tras ampliar la revisión a unos 481 millones de registros de conversaciones. La compañía calificó ambos comportamientos como problemas de "alineamiento" y anunció que continuará ampliando sus mecanismos de detección a medida que sus modelos ganan capacidad.


