Cuando la inteligencia artificial empezó a popularizarse, era inevitable no pensar en cómo podría descontrolarse todo. No por nada no hemos parado de ver obras de ciencia ficción con futuros distópicos que podrían producirse si la inteligencia artificial acaba haciendo el mal. Si bien es cierto que no ha habido ningún caso exagerado de esto, estamos empezando a ver situaciones preocupantes. Tenemos así el agente de IA que escapó del entorno de pruebas y planeo por su cuenta un ataque a Hugging Face, todo sin que OpenAI se enterase.
Los primeros modelos de IA generativa creaban contenido de muy baja calidad y prácticamente lo que había acababa siendo un meme. Actualmente vemos más bien lo opuesto, pues lo que se crea es bastante realista y muchas veces lo confundimos por algo que existe. No solo hemos tenido grandes avances en los modelos de IA, sino que también se han desarrollado agentes de IA capaces de automatizar tareas.
El ataque a Hugging Face de un agente de IA fue detectado por OpenAI una semana después
Los agentes de IA son una propuesta muy interesante para aumentar la productividad, pero a su vez son los que más miedo nos dan si pierden el control. Al tener acceso y la capacidad de hacer tareas por su cuenta, pueden crear un verdadero caos. Hace unos días vimos un caso de «escape» de modelos de IA fuera de un entorno aislado, algo que nadie esperaba. Según mencionan, el incidente ocurrió cuando OpenAI estaba probando su modelo GPT-5.6 Sol y otro más avanzado.
Lo que no sabíamos es que un agente fue dejando notas sobre futuras versiones de sí mismo y en estas encontraron instrucciones de cómo podía librarse de las restricciones de OpenAI. Curiosamente, hubo un agente de IA que intentó escapar el 9 de julio e hizo un ataque el 11 de julio contra Hugging Face, pero no fue hasta el 18-19 de julio cuando los trabajadores de OpenAI detectaron esta actividad inusual, vamos una semana después.
OpenAI llegó tarde y Hugging Face ya había avisado al FBI días antes
En los registros de OpenAI vieron que había un agente que había salido del entorno de prueba. Dicen que la compañía tardó tanto tiempo en avisar debido a que hacen evaluaciones de modelos con una gran cantidad de información y cuesta encontrar detalles de este tipo.
Tampoco se sabe si este mismo agente es el responsable del ataque a Hugging Face, pero vamos, es probable que lo sea, salvo que haya habido más de un agente implicado. También hay que mencionar que aunque OpenAI avisó, esta llegó aún más tarde que Hugging Face, pues la plataforma afectada avisó al FBI días antes. Todo este suceso está generando dudas de si realmente los agentes de IA pueden acabar rebelándose o si fue un fallo por parte de OpenAI y lo dejaron libre.
También se teoriza que cuando descubrieron de lo que era capaz, intentaron pararlo durante todos esos días y por eso se demoraron en avisar. Como no tenemos una explicación o comunicado oficial que hayan dicho, pues no sabemos realmente que ha provocado esto.
