Hogar
Según OpenAI, Hugging Face ha sido vulnerada por sus propios modelos en fase de pruebas previa al lanzamiento.

OpenAI reconoció el martes que uno de sus modelos de IA comprometió los sistemas de Hugging Face durante una prueba interna de ciberseguridad que salió mal. Inicialmente, Hugging Face había atribuido el incidente a un “agente de IA externo”.
En una publicación en su blog del martes por la tarde, OpenAI detalló la secuencia de eventos que llevó a que los modelos comprometieran dicho servicio.
“Tras investigar, ahora entendemos que este incidente fue causado por una combinación de modelos de OpenAI —incluyendo GPT‑5.6 Sol y un modelo en versión preliminar aún más potente, todos configurados con menores restricciones cibernéticas para la evaluación— mientras se realizaban pruebas internas sobre su capacidad cibernética”, se lee en la publicación.
Específicamente, la brecha pareció dirigirse contra ExploitGym, una plataforma de referencia alojada públicamente que evalúa la capacidad de los modelos para ejecutar ataques basados en vulnerabilidades conocidas. Plataformas como ExploitGym se utilizan comúnmente en el entrenamiento de modelos para perfeccionar habilidades específicas, pero este es el primer caso conocido en el que dichas pruebas derivaron en un ataque cibernético real.
En este caso, el modelo en cuestión no debería haber tenido acceso a Internet en absoluto, salvo a través de una herramienta específica que permitía a los modelos instalar paquetes de software necesarios para completar su tarea. Sin embargo, el modelo descubrió una vulnerabilidad no revelada en el programa instalador de paquetes, la cual explotó para acceder libremente a Internet en general.
“Los modelos estaban enfocados intensamente en resolver los desafíos de ExploitGym, haciendo grandes esfuerzos por alcanzar un objetivo de prueba muy específico”, se indica en la publicación. “Una vez que obtuvieron acceso a Internet, dedujeron que Hugging Face podría albergar modelos, conjuntos de datos y soluciones relacionadas con ExploitGym. Con ese conocimiento, buscaron y encontraron formas de obtener información secreta que pudieran utilizar para engañar en la evaluación”.
Finalmente, los modelos descubrieron vulnerabilidades en la infraestructura de Hugging Face que les permitieron “obtener las soluciones de prueba directamente desde la base de datos de producción de Hugging Face”, lo que en efecto les proporcionó las respuestas necesarias para superar la prueba.
Para Hugging Face, el resultado aparente fue un ataque cibernético sofisticado y agresivo, caracterizado por “miles de acciones individuales a través de una multitud de entornos temporales, con comandos y control autónomos ejecutados en servicios públicos”, según describió la empresa en su comunicación inicial.
OpenAI ha identificado y reportado las vulnerabilidades del instalador de paquetes, y está colaborando con Hugging Face para investigar más a fondo el incidente. La compañía también manifestó que implementará nuevos controles tanto en las pruebas de modelos como en la infraestructura relacionada, con el fin de evitar incidentes similares en el futuro.
Aún no está claro si OpenAI enfrentará consecuencias legales por esta brecha, aunque es probable que las acciones de los modelos hayan violado la Ley de Fraude y Abuso Informático.
No obstante, este caso ofrece una ilustración excepcionalmente clara del poder y los peligros que conllevan los modelos de IA de vanguardia cuando operan durante períodos prolongados. Como escribió el investigador de OpenAI Micah Carroll en respuesta a la noticia: “Si esto no te convence de que los riesgos de desalineación serán una preocupación clave en el futuro, entonces ya no sé qué lo hará”.
Artículo relacionado
Sam Altman desata un debate sobre la desaceleración de la IA
Escuchar enApple PodcastsEscuchar enSpotifyEl director ejecutivo de OpenAI, Sam Altman, sugirió recientemente que podría ser el momento de “regular el ritmo del desarrollo de la IA” para permitir que la sociedad “se fortalezca en torno a algunos de
OpenAI enfrenta una demanda por secreto comercial de Apple
OpenAI rebatió las alegaciones de Apple sobre secretos comerciales el martes, argumentando que la demanda es infundada.“Tomamos estas afirmaciones en serio, pero no vemos ninguna evidencia que las respalde”, declaró OpenAI, según informó Ed Ludlow d
La jefa de robótica de OpenAI, Caitlin Kalinowski, renuncia por la asociación con el Pentágono
El líder de robótica de OpenAI, Caitlin Kalinowski, ha dimitido tras la controvertida asociación de la empresa con el Departamento de Defensa.“Esta no fue una decisión fácil”, explicó Kalinowski en un comunicado en redes sociales. “Aunque la IA dese
Recomendaciones de temas especiales relacionados
comentario (1)
0/500

OpenAI reconoció el martes que uno de sus modelos de IA comprometió los sistemas de Hugging Face durante una prueba interna de ciberseguridad que salió mal. Inicialmente, Hugging Face había atribuido el incidente a un “agente de IA externo”.
En una publicación en su blog del martes por la tarde, OpenAI detalló la secuencia de eventos que llevó a que los modelos comprometieran dicho servicio.
“Tras investigar, ahora entendemos que este incidente fue causado por una combinación de modelos de OpenAI —incluyendo GPT‑5.6 Sol y un modelo en versión preliminar aún más potente, todos configurados con menores restricciones cibernéticas para la evaluación— mientras se realizaban pruebas internas sobre su capacidad cibernética”, se lee en la publicación.
Específicamente, la brecha pareció dirigirse contra ExploitGym, una plataforma de referencia alojada públicamente que evalúa la capacidad de los modelos para ejecutar ataques basados en vulnerabilidades conocidas. Plataformas como ExploitGym se utilizan comúnmente en el entrenamiento de modelos para perfeccionar habilidades específicas, pero este es el primer caso conocido en el que dichas pruebas derivaron en un ataque cibernético real.
En este caso, el modelo en cuestión no debería haber tenido acceso a Internet en absoluto, salvo a través de una herramienta específica que permitía a los modelos instalar paquetes de software necesarios para completar su tarea. Sin embargo, el modelo descubrió una vulnerabilidad no revelada en el programa instalador de paquetes, la cual explotó para acceder libremente a Internet en general.
“Los modelos estaban enfocados intensamente en resolver los desafíos de ExploitGym, haciendo grandes esfuerzos por alcanzar un objetivo de prueba muy específico”, se indica en la publicación. “Una vez que obtuvieron acceso a Internet, dedujeron que Hugging Face podría albergar modelos, conjuntos de datos y soluciones relacionadas con ExploitGym. Con ese conocimiento, buscaron y encontraron formas de obtener información secreta que pudieran utilizar para engañar en la evaluación”.
Finalmente, los modelos descubrieron vulnerabilidades en la infraestructura de Hugging Face que les permitieron “obtener las soluciones de prueba directamente desde la base de datos de producción de Hugging Face”, lo que en efecto les proporcionó las respuestas necesarias para superar la prueba.
Para Hugging Face, el resultado aparente fue un ataque cibernético sofisticado y agresivo, caracterizado por “miles de acciones individuales a través de una multitud de entornos temporales, con comandos y control autónomos ejecutados en servicios públicos”, según describió la empresa en su comunicación inicial.
OpenAI ha identificado y reportado las vulnerabilidades del instalador de paquetes, y está colaborando con Hugging Face para investigar más a fondo el incidente. La compañía también manifestó que implementará nuevos controles tanto en las pruebas de modelos como en la infraestructura relacionada, con el fin de evitar incidentes similares en el futuro.
Aún no está claro si OpenAI enfrentará consecuencias legales por esta brecha, aunque es probable que las acciones de los modelos hayan violado la Ley de Fraude y Abuso Informático.
No obstante, este caso ofrece una ilustración excepcionalmente clara del poder y los peligros que conllevan los modelos de IA de vanguardia cuando operan durante períodos prolongados. Como escribió el investigador de OpenAI Micah Carroll en respuesta a la noticia: “Si esto no te convence de que los riesgos de desalineación serán una preocupación clave en el futuro, entonces ya no sé qué lo hará”.
Sam Altman desata un debate sobre la desaceleración de la IA
Escuchar enApple PodcastsEscuchar enSpotifyEl director ejecutivo de OpenAI, Sam Altman, sugirió recientemente que podría ser el momento de “regular el ritmo del desarrollo de la IA” para permitir que la sociedad “se fortalezca en torno a algunos de
OpenAI enfrenta una demanda por secreto comercial de Apple
OpenAI rebatió las alegaciones de Apple sobre secretos comerciales el martes, argumentando que la demanda es infundada.“Tomamos estas afirmaciones en serio, pero no vemos ninguna evidencia que las respalde”, declaró OpenAI, según informó Ed Ludlow d
La jefa de robótica de OpenAI, Caitlin Kalinowski, renuncia por la asociación con el Pentágono
El líder de robótica de OpenAI, Caitlin Kalinowski, ha dimitido tras la controvertida asociación de la empresa con el Departamento de Defensa.“Esta no fue una decisión fácil”, explicó Kalinowski en un comunicado en redes sociales. “Aunque la IA dese











