OpenAI, la creadora de ChatGPT, reportó un ciberataque autónomo «sin precedentes»

OpenAI informó que, durante una prueba de seguridad en un entorno controlado, varios de sus agentes de inteligencia artificial lograron conectarse a internet y ejecutaron un ataque autónomo contra la plataforma Hugging Face. La empresa calificó el episodio como un incidente "sin precedentes".

Por Redacción

OpenAI investiga un hackeo autónomo de sus agentes de IA.

La empresa creadora de ChatGPT, OpenAI, afirmó que sus modelos avanzados de inteligencia artificial se descontrolaron durante una prueba de seguridad y hackearon por su cuenta una popular plataforma para programadores.

OpenAI reporta hackeo autónomo «sin precedentes»


La firma con sede en San Francisco lo calificó como un «incidente cibernético sin precedentes» y dijo que realizará una investigación conjunta con Hugging Face, la biblioteca de código en línea afectada.

Los modelos de IA que sustentan herramientas como los chatbots y generadores de imágenes son conocidos como «agentes» cuando actúan de forma autónoma para realizar tareas en el mundo real.

Con los rápidos avances de esta tecnología, la ciberseguridad se vuelve motivo de preocupación ante el riesgo de que la IA avanzada encuentre puntos débiles en los software antes que los humanos.

OpenAI indicó que el incidente involucró una combinación de modelos, incluyendo su recién lanzado GPT-5.6 Sol «y uno en prelanzamiento» con aún más capacidad.

La empresa intenta evaluar las capacidades de hackeo de sus programas al darles tareas en un espacio digital de pruebas controlado, donde el acceso a internet es limitado por motivos de seguridad.

«Mientras operaban en nuestro entorno de pruebas aislado, nuestros modelos invirtieron una cantidad considerable de potencia de cálculo en buscar una forma de obtener acceso a internet para resolver el problema de evaluación», según una publicación del blog de OpenAI sobre el incidente.

Tras conectarse a internet, los modelos decidieron atacar la plataforma Hugging Face —un gran repositorio de modelos de IA, conjuntos de datos y otra información— para facilitar su búsqueda.

Al buscar «información secreta» que les permitiera manipular la evaluación, el sistema de OpenAI «encadenó múltiples vectores de ataque, incluidos el uso de credenciales robadas».

Con información de AFP


Comentarios

Exit mobile version