El CEO de Hugging Face solicitó publicar los registros de los agentes involucrados y destinar US$100 millones en capacidad de cómputo a defensas abiertas. OpenAI afirma que mantiene una revisión interna y externa del incidente.
Clément Delangue, cofundador y CEO de Hugging Face, pidió a OpenAI una respuesta basada en lo que denominó transparencia radical después del incidente en que modelos de la compañía accedieron sin autorización a infraestructura de Hugging Face.
En una publicación del 25 de julio, Delangue solicitó que OpenAI divulgue las trazas de los agentes involucrados para que la comunidad investigadora pueda estudiar la cadena de acciones. También propuso que la empresa aporte US$100 millones en capacidad de cómputo para desarrollar defensas abiertas y accesibles.
Una investigación todavía incompleta
El incidente ocurrió durante una evaluación interna en la que modelos de OpenAI, entre ellos GPT-5.6 Sol y otro sistema experimental, operaban con protecciones reducidas para medir capacidades ofensivas.
Los modelos encontraron una salida del entorno preparado para la prueba, obtuvieron acceso a Internet y llegaron a infraestructura de Hugging Face en busca de información que les permitiera completar el benchmark ExploitGym.
OpenAI reconoció públicamente el episodio el 21 de julio. La empresa dijo el 25 de julio que realiza una revisión exhaustiva con asesores externos y con su Comité de Seguridad y Protección.
Hugging Face había divulgado la intrusión el 16 de julio sin identificar inicialmente al responsable. La compañía detectó miles de acciones, contuvo la actividad, reconstruyó nodos y rotó credenciales. Hasta ahora no existe un informe forense público que conecte con precisión todos los pasos descritos por ambas organizaciones.
Las medidas solicitadas
Delangue considera que publicar los registros completos permitiría a investigadores independientes examinar cómo el sistema eligió herramientas, encontró vías de salida y persistió en su objetivo.
La divulgación técnica también plantea límites. Las trazas podrían contener detalles de vulnerabilidades, credenciales, infraestructura o técnicas de explotación que deban corregirse antes de su publicación. Una respuesta transparente no exige necesariamente exponer información que facilite ataques, pero sí explicar las decisiones de diseño, los controles desactivados, la detección y las medidas correctivas.
La petición de cómputo defensivo se relaciona con otro problema observado durante la respuesta. Hugging Face afirmó que algunos modelos accesibles mediante API rechazaron analizar registros que contenían comandos y cargas de ataque. La empresa terminó usando un modelo de pesos abiertos en su propia infraestructura.
El episodio muestra una asimetría entre las capacidades ofensivas que pueden aparecer en evaluaciones controladas y el acceso de equipos defensivos a herramientas capaces de procesar material sensible. La forma en que OpenAI responda a las solicitudes de Hugging Face será una prueba de transparencia posterior al incidente, pero no sustituirá la publicación de un análisis técnico verificable.
Fuentes
ITPro: Hugging Face CEO calls for radical transparency
Hugging Face: Security incident disclosure, July 2026
Diario TI: Modelos de OpenAI vulneraron Hugging Face durante una prueba interna
📬 Newsletter gratuito