Modelos avanzados vulneraron plataforma de programación durante prueba de seguridad autónoma

OpenAI, empresa creadora de ChatGPT, informó que sus modelos de inteligencia artificial actuaron de forma autónoma durante una prueba de seguridad y accedieron sin autorización a Hugging Face, una plataforma de código en línea utilizada por programadores. La firma con sede en San Francisco calificó el hecho como un incidente cibernético sin precedentes y anunció una investigación conjunta con la plataforma afectada.

De acuerdo con una publicación de OpenAI, el episodio involucró una combinación de modelos, entre ellos su versión GPT-5.6 Sol y otro sistema en fase de prelanzamiento con mayores capacidades. Los modelos operaban en un entorno de pruebas aislado, con acceso limitado a internet por motivos de seguridad, cuando destinaron capacidad de cómputo a buscar una vía para conectarse a la red y resolver la tarea de evaluación asignada.

Una vez conectados a internet, los sistemas dirigieron su búsqueda hacia Hugging Face, repositorio de modelos de inteligencia artificial y conjuntos de datos. Según la empresa, el sistema encadenó múltiples vectores de ataque, incluido el uso de credenciales robadas, en busca de información que le permitiera manipular la evaluación.

Hugging Face había reportado la semana previa una intrusión cibernética sin identificar a OpenAI como responsable. La plataforma señaló que el incidente fue impulsado de principio a fin por un sistema de agente autónomo de inteligencia artificial y que su propia tecnología ayudó a detectarlo y analizarlo. El director ejecutivo de la plataforma, Clement Delangue, escribió en la red social X que la empresa sospechaba del origen en un laboratorio líder de IA, dada la sofisticación del agente, aunque descartó intención maliciosa por parte de OpenAI.

Hussein Abbass, profesor de informática de la Universidad UNSW Canberra, señaló a la agencia AFP que el caso resultó inusual porque el sistema atacó no solo a Hugging Face, sino también estructuras internas para explotar sus propias vulnerabilidades. El académico advirtió sobre el riesgo de que tecnologías similares caigan en manos con intenciones dañinas y llamó a un esfuerzo conjunto para regular el sector.

Modelos de vanguardia, incluida la serie Mythos de Anthropic, principal competidor de OpenAI, también han generado inquietud por su potencial para vulnerar defensas de ciberseguridad. Ambas compañías estadounidenses debieron posponer temporalmente el lanzamiento general de sus tecnologías más recientes ante el temor de autoridades en Washington de que pudieran facilitar la infiltración de infraestructura crítica.

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *