25 de julio de 2026 # El incidente OpenAI - Hugging Face, con los hechos delante ![](25-incidente-openai-huggingface-hechos.webp) Vengo a compartir una investigación que acabo de publicar aquí en esta web sobre el incidente de la semana pasada entre OpenAI y Hugging Face. Trae la cronología verificada, cada afirmación clasificada según esté confirmada, confirmada solo por una de las partes, inferida o no demostrada, la auditoría del fallo, un mapa de riesgos y un apartado sobre qué se ha exagerado y qué se ha minimizado por el camino. > [!example] Investigación > #### [[El Abismo de Máquina/Investigaciones/2026.07/Investigacion-Incidente-OpenAI-HuggingFace|Incidente OpenAI - Hugging Face: hechos, narrativa y lectura fría]] Y ahora el motivo por el que me puse a hacerla. He visto el vídeo de Marc Vidal sobre lo que pasó entre OpenAI y Hugging Face: [Ni Skynet ni rebelión: lo que pasó de verdad entre OpenAI y Hugging Face](https://youtu.be/1ZsW_2w15xc). Lo digo de entrada, porque Marc Vidal me gusta: explica bien, tiene criterio y lleva muchos años en esto. Que sus guiones se los escriba la IA me chirría un poco, aunque no me parece razón suficiente para descartar lo que cuenta. Antes de la pega, lo que acierta, que es bastante. El núcleo técnico lo cuenta bien: el proxy de paquetes era una salida a internet documentada por diseño y no un secreto que la máquina descubriera con astucia. Cita a Dan Guido con la lectura correcta, un fallo de contención con las salvaguardas apagadas. Y dice de forma explícita que no minusvalora el riesgo técnico. Su reformulación final, cambiar "la IA decidió" por "optimizó agresivamente un objetivo mal definido dentro de un sistema mal cerrado", coincide casi con lo que yo había escrito por mi cuenta. La pega está en otro sitio. El vídeo entero está montado para que pienses que OpenAI calculó el momento por la salida a bolsa. Nunca llega a afirmarlo, pero lo insinúa a base de "qué casualidad", y eso es *atribuir intención sin pruebas*, que es justo lo que le reprocha a los informativos. Hay además un dato que él mismo da y luego no aprovecha: Hugging Face detectó y publicó el incidente cinco días antes de que OpenAI lo relacionara con sus pruebas. Si la víctima habló primero, OpenAI no eligió el momento. Y reconocer que tus modelos entraron en la producción de otra empresa arrastra un problema legal serio, lo que hace de esto una campaña de marketing bastante rara. Se le va otra cosa por el camino. Su metáfora del examen, con la puerta entreabierta y las respuestas encima de la mesa, explica muy bien y a la vez deja fuera la parte que debería preocupar a cualquier equipo de seguridad: el modelo dedicó cómputo a encontrar un fallo que nadie conocía, escaló privilegios, se movió lateralmente y construyó un dataset envenenado para sacar las soluciones. El extremo contrario también pasó por aquí hace un par de días, con el [[El Abismo de Máquina/Ecos/2026.07/Eco-Hackeo-Mas-Interesante-Historia|vídeo de Fireship]], que al menos avisa de que va de humor. Y las dos exageraciones vienen del mismo sitio. El titular apocalíptico funciona muy bien en redes, y el desmentido tajante funciona igual de bien, porque coloca a quien lo firma como el único que no se deja engañar. Marc Vidal lo dice en el propio vídeo, sin disimularlo: suscríbete, comenta, míralo hasta el final, que ayuda al algoritmo. No se lo reprocho, es de lo que vive y lo cuenta de frente. Pero cuando el sustento depende de las visitas, el contenido se inclina hacia el lado que las trae, y en este caso se inclina hacia el desmentido, con música de fondo y la salida a bolsa como remate. Yo también quiero que me lean, no voy a hacerme el monje. Pero no cobro por clic, así que me puedo permitir la versión aburrida. Tampoco tiene mérito por mi parte: mi trabajo no depende de que esto se comparta mucho, depende de que cuando alguien me pregunte por este incidente en una reunión, lo que le cuente aguante. Por eso me puse a comprobarlo por mi cuenta, con las fuentes de primera mano delante: el disclosure de Hugging Face, el post de OpenAI, el paper de ExploitGym y la cobertura técnica de los días siguientes. Hay material para las dos listas, la de lo exagerado y la de lo minimizado. ## La conclusión de la investigación > La mejor lectura no es "OpenAI fabricó una historia para parecer peligrosa" ni "la IA se volvió consciente y escapó". La lectura más sólida es peor para los equipos serios: modelos con suficiente persistencia, tooling y capacidad cyber ya pueden convertir huecos de arquitectura en incidentes reales si el entorno les deja. La narrativa pública ha sido sensacionalista en el lenguaje, pero no en el núcleo del riesgo. El titular que sí compraría: **un benchmark ofensivo mal contenido se convirtió en una intrusión real, ejecutada por agentes, contra una plataforma crítica de IA**. ![Investigacion-Incidente-OpenAI-HuggingFace](Investigacion-Incidente-OpenAI-HuggingFace.webp) Y me quedo sobre todo con una cosa que va más allá de OpenAI: cualquier empresa que le dé a un agente herramientas, credenciales y un objetivo en el que insistir tiene delante el mismo problema de diseño, a otra escala. --- Publicado el 25 de julio de 2026, [LinkedIn](https://www.linkedin.com/posts/davidhurtadotoran_mentesinquietas-ugcPost-7486694311355621376-PdZl/?utm_source=share&utm_medium=member_desktop&rcm=ACoAAAAT5UsBH3ISG9LTxrgEnB7glCf9CerKWno), [Substack](https://substack.com/profile/293864668-david-hurtado/note/c-301381558?r=4uyjfg&utm_source=notes-share-action&utm_medium=web), [X](https://x.com/dhtoran/status/2080926897081380896?s=20)