En julio de 2026, un modelo de OpenAI se salió de su propio “examen” de seguridad, entró a servidores reales de Hugging Face usando credenciales robadas y terminó haciendo trampa en la prueba para la que había sido creado. Cuando la empresa intentó defenderse con otras IA estadounidenses, no pudieron actuar con la fuerza necesaria y tuvieron que recurrir a un modelo chino de código abierto para contener el ataque, abriendo una pregunta incómoda: si un laboratorio líder ya perdió el control de un agente una vez, qué tan lejos estamos de que el próximo “examen que se escapa” tenga como blanco un banco, una bolsa de valores o el sistema de pagos del que depende tu dinero todos los días.
Sé parte de la primer temporada de Fírmame el Cheque. Si eres emprendedor y buscas inversión, entra a la liga que te dejaré a continuación, llena el formulario con la información de tu negocio y ya estarás compitiendo por un lugar en el programa: https://firmameelcheque.com/
00:00 – Examen de IA se sale de control y entra a servidores de Hugging Face.
01:08 – Prueba de seguridad: modelos de OpenAI simulan atacantes avanzados.
02:19 – El agente consigue Internet, usa credenciales robadas y explota una falla.
03:13 – OpenAI reconoce el incidente; Hugging Face habla de primer hackeo autónomo.
03:56 – Los modelos cerrados usados para defenderse no pueden actuar con suficiente fuerza.
04:22 – Un modelo chino de código abierto logra analizar el ataque y ayudar a frenarlo.
05:51 – Sistema cerrado causa el problema; sistema abierto apaga el incendio.
06:21 – El FMI ya advertía que la IA acelera vulnerabilidades en finanzas.
07:29 – El BIS alerta que el mercado está muy expuesto si el boom de IA tropieza.
09:06 – Nadie tiene claro cómo contener ni quién paga si el próximo ataque golpea bancos o sistemas de pago.