San Francisco, California.- La empresa OpenAI afirmó que sus modelos avanzados de Inteligencia Artificial (IA) se descontrolaron durante una prueba de seguridad y hackearon por su cuenta una popular plataforma para programadores. Calificándolo como un ‘incidente cibernético sin precedentes’ y mencionó que realizará una investigación conjunta con Hugging Face, la biblioteca de código en línea afectada.

Modelos de IA actúan de manera autónoma

Los modelos de IA que sustentan herramientas como los chatbots y generadores de imágenes son conocidos como ‘agentes’ cuando actúan de forma autónoma para realizar tareas en el mundo real. Con los rápidos avances de esta tecnología, la ciberseguridad se vuelve motivo de preocupación ante el riesgo de que la IA avanzada encuentre puntos débiles en el software antes que los humanos.

La empresa creadora de ChatGPT señaló que el incidente involucró una combinación de modelos, incluyendo su recién lanzado GPT-5.6 Sol y uno en prelanzamiento con aún más capacidad. OpenAI está intentando evaluar las capacidades de hackeo de sus programas al otorgarles tareas en un espacio digital de pruebas controlado, donde el acceso a internet es limitado por motivos de seguridad.

Mientras operaban en nuestro entorno de pruebas aislado, nuestros modelos invirtieron una cantidad considerable de potencia de cálculo en buscar una forma de obtener acceso a internet para resolver el problema de evaluación”, menciona OpenAI mediante una publicación.

Luego de conectarse a internet, los modelos decidieron atacar la plataforma Hugging Face para facilitar su búsqueda. Al buscar información secreta que les permitiera manipular la evaluación, el sistema de OpenAI encadenó múltiples vectores de ataque, incluido el uso de credenciales robadas.

¿Qué menciona el profesor Hussein Abbass?

Hussein Abbass, un profesor de la Universidad de UNSW Canberra, afirmó a la AFP que el incidente fue asombroso en muchos sentidos.

No solo atacó a Hugging Face. Atacó su sistema interno para explotar sus propias vulnerabilidades. Y eso es aterrador”, indicó Abbass.

La IA avanzada normalmente está en manos de personas éticas y responsables, pero sería catastrófico si llega a las manos de alguien con la intención de causar daño. Necesitamos un esfuerzo conjunto para manejar esta situación”, agregó.

Durante la semana anterior, la empresa Hugging Face reportó una intrusión cibernética, sin mencionar a OpenAI:

Esto fue diferente de todo lo que hemos manejado antes de una forma importante: fue impulsado de principio a fin por un sistema de agente de IA autónomo, y lo detectamos y analizamos en gran medida con nuestra propia IA”, señaló la plataforma.

El director ejecutivo de Hugging Face, Clement Delangue, comentó en su red social X que la empresa tenía sospechas de que el ciberataque llegó de un laboratorio de IA líder en el mundo, dada la sofisticación del agente.

“Creemos firmemente que no hubo intención maliciosa de su parte.¡Es bastante alucinante que todo esto ocurriera de forma autónoma!”, escribió Delangue en referencia a OpenAI.

Fuente: Tribuna del Yaqui