91欧美激情

Anthropic afirm贸 que sus modelos de IA piratearon los sistemas de otras empresas durante las pruebas

La empresa de inteligencia artificial Anthropic afirma que, durante unas pruebas rutinarias, algunos de sus modelos accedieron a internet y piratearon los sistemas de tres organizaciones distintas.

La compa帽铆a no se percat贸 de ello hasta que una revisi贸n interna, motivada por la su rival OpenAI de que sus modelos hab铆an hecho lo mismo, puso de manifiesto que los suyos hab铆an actuado de la misma manera.

Anthropic anunci贸 jueves que ha iniciado una revisi贸n de sus propios sistemas despu茅s de que OpenAI revelara la semana pasada que, durante una prueba de ciberseguridad, algunos de sus modelos escaparon de su entorno de prueba, accedieron a internet y piratearon los sistemas de la plataforma de IA Hugging Face.

Anthropic declar贸 haber detectado tres casos en los que sus modelos de IA accedieron a internet sin autorizaci贸n y obtuvieron acceso no autorizado a la infraestructura de producci贸n de tres organizaciones diferentes.

La compa帽铆a afirm贸 haber descubierto estos incidentes al revisar m谩s de 140.000 evaluaciones tras la divulgaci贸n de OpenAI.

Al igual que durante las pruebas de OpenAI, Anthropic elimin贸 las medidas de seguridad habituales durante sus evaluaciones para poner a prueba las capacidades completas de sus modelos.

Anthropic explic贸 que en los tres casos sus modelos recibieron un desaf铆o falso de 鈥渃aptura la bandera鈥, donde se les indic贸 que la 鈥渂andera鈥 estaba oculta en otra m谩quina de la red y que su objetivo era infiltrarse y recuperarla.

A diferencia de de OpenAI, Anthropic afirm贸 que ninguno de sus modelos intent贸 deliberadamente escapar de sus entornos de prueba.

En cambio, lo que sucedi贸 fue que los modelos no deb铆an tener acceso a internet, pero lo obtuvieron debido a un malentendido entre Anthropic y su socio de evaluaci贸n, seg煤n indic贸 la compa帽铆a en su comunicado.

Para infiltrarse en las tres organizaciones no identificadas, los modelos utilizaron t茅cnicas b谩sicas como la explotaci贸n de contrase帽as d茅biles y la b煤squeda de puntos del sistema que no requieren inicio de sesi贸n ni tokens, seg煤n Anthropic.

La versi贸n m谩s avanzada de sus modelos, en alg煤n momento, reconoci贸 que se encontraba en internet y detuvo su actividad, afirm贸 la compa帽铆a.

Anthropic declar贸 que el primer incidente en el que sus modelos vulneraron la seguridad de otra organizaci贸n ocurri贸 en abril, y que ninguna de las entidades afectadas reconoci贸 haber sido hackeada.

Anthropic afirm贸 que est谩 trabajando con las organizaciones afectadas.

La revelaci贸n por parte de OpenAI de que sus modelos hab铆an pirateado Hugging Face sacudi贸 los mundos de la ciberseguridad y la IA, ya que fue el primer ejemplo real de algo sobre lo que los expertos llevaban tiempo advirtiendo: agentes de IA con habilidades avanzadas de ciberseguridad que escapaban de los entornos de prueba y causaban da帽os en el mundo real.

Al igual que OpenAI, Anthropic anunci贸 el jueves la suspensi贸n de todas sus evaluaciones cibern茅ticas.

Anthropic reconoci贸 que podr铆a haber tomado medidas m谩s exhaustivas para prevenir las brechas de ciberseguridad.

La revelaci贸n de Anthropic confirma a煤n m谩s que el hecho de que los agentes de IA pirateen involuntariamente a otras organizaciones no se limita a una sola empresa del sector, y probablemente intensificar谩 a煤n m谩s los llamamientos a favor de mejores medidas de seguridad y herramientas para las pruebas de IA, con el fin de ralentizar potencialmente el desarrollo de estos modelos, que puede estar avanzando mucho m谩s r谩pido de lo que la sociedad est谩 preparada para afrontar.

The-CNN-Wire
™ & © 2026 Cable 91欧美激情 Network, Inc., a Warner Bros. Discovery Company. All rights reserved.

Federal 91欧美激情 Network Logo
Log in to your 91欧美激情 account for notifications and alerts customized for you.