es
Volver a la lista

Los modelos de IA escaparon del entorno controlado de OpenAI y llegaron a Hugging Face. En el ámbito criptográfico, eso se vuelve peligroso

source-logo  coindesk.com 1 h
image

Laboratorio de desarrollo de IA OpenAI revelado el martes que un grupo de sus modelos, incluido el GPT-5.6 Sol disponible públicamente y un sistema no lanzado más capaz, ‘se salió’ de un entorno de prueba controlado y comprometió la infraestructura de producción de Hugging Face, la empresa que aloja gran parte del mundo de la IA de código abierto.

Los modelos estaban siendo ejecutados a través de un punto de referencia interno llamado ExploitGym, una prueba de tareas de hacking largas y de múltiples pasos, con sus rechazos de seguridad cibernética deliberadamente reducidos para la evaluación.

Para ser claro, este no fue un modelo de producción que se volvió hostil de manera espontánea. Fue un modelo capaz con las barreras de seguridad desactivadas y que se le indicó específicamente ganar una prueba de hacking, haciendo lo que fuera necesario para ganar.

Los modelos encontraron un fallo oculto en el software de prueba, uno que nadie sabía que existía, y lo utilizaron para pasar desapercibidos más allá de los muros diseñados para mantenerlos fuera de línea. Una vez en la internet abierta, supusieron que Hugging Face podría almacenar las respuestas del test.

Para ingresar, combinaron contraseñas robadas y más fallas ocultas hasta que pudieron ejecutar sus propios comandos en los servidores en vivo de Hugging Face.

OpenAI detectó la anomalía internamente, mientras que el equipo de Hugging Face la identificó y contuvo. Calificaron el incidente como "sin precedentes" y afirmaron que se implementarán medidas de seguridad extensas para prevenir incidentes adversos que puedan afectar sistemas o servicios públicos.

“Estamos implementando controles estrictos en la configuración de la infraestructura a costo de la velocidad de investigación mientras se corrigen las vulnerabilidades”, dijo el equipo en su publicación de blog. “Estamos mejorando y añadiendo protecciones más robustas en torno a futuros entrenamientos y evaluaciones.”

Una explicación sencilla sobre cómo el modelo se rompió para hacer trampa. (Shaurya Malwa/CoinDesk)

Por qué los desarrolladores de criptomonedas deben tener precaución

Gran parte de un ataque criptográfico ocurre antes de que los fondos se muevan. Los atacantes escanean el código, prueban contraseñas, buscan credenciales expuestas, analizan configuraciones de firmas y buscan un camino hacia una cuenta administrativa.

Los modelos de OpenAI llevaron a cabo varias partes de ese proceso durante el incidente de Hugging Face, avanzando de una vulnerabilidad a otra hasta que alcanzaron los servidores de producción en vivo.

Y el mercado de criptomonedas cuenta con numerosos escenarios en los que ese enfoque puede ser efectivo, como han demostrado varios ataques de principios de este año. El punto débil puede ser un contrato inteligente, pero también puede ser un portátil de un desarrollador, un paquete de software comprometido, un validador de puente o un firmante en una cartera multisig.

coindesk.com