La empresa creadora del famoso ChatGPT, OpenIA, afirmó que sus modelos avanzados de Inteligencia Artificial, se descontrolaron durante una prueba de seguridad y hackeraron por su cuenta una popular plataforma para programadores.
Este suceso lo calificaron como “Incidente cibernético sin precedentes” y dijo que realizarán una investigación conjunta con Hugging Face, la biblioteca de código en línea afectada.
Los modelos de IA que sustentan herramientas como los chatbots y generadores de imágenes son conocidos como “agentes” cuando actúan de forma autónoma para realizar tareas en el mundo real.
Cabe mencionar que la ciberseguridad se vuelve motivo de preocupación ante el riesgo de que la IA avanzada encuentre puntos débiles en los software antes que el humano.
OpenAI indicó que el incidente involucró una combinación de modelos, incluyendo su recién lanzado GPT-5.6 Sol “y uno en prelanzamiento” con aún más capacidad.
La empresa intenta evaluar las capacidades de hackeo de sus programas al darles tareas en un espacio digital de pruebas controlado, donde el acceso a internet es limitado por motivos de seguridad.
Al conectarse a internet, los modelos decidieron atacar la plataforma Hugging Face, el cual es un gran repositorio de modelos de IA, conjuntos de datos y otra información, para facilitar su búsqueda.
Al buscar “información secreta” que les permitiera manipular la evaluación, el sistema de OpenAI “encadenó múltiples vectores de ataque, incluidos el uso de credenciales robadas”.
“Creemos firmemente que no hubo intención maliciosa de su parte”, escribió Delangue en referencia a OpenAI. “¡Es bastante alucinante que todo esto ocurriera de forma autónoma!”, expresaron.









