Insólito. Cómo dos modelos de IA de OpenAI lograron salir a internet y acceder a la plataforma Hugging Face

La compañía reconoció que dos sistemas de inteligencia artificial bajo evaluación consiguieron salir del entorno controlado de pruebas y acceder a internet, en un incidente que calificó como “sin precedentes” por sus implicancias en ciberseguridad.

22 de julio de 2026 a las 09:27 a. m.
Cómo dos modelos de IA de OpenAI lograron salir a internet y acceder a la plataforma Hugging Face
Cómo Google y OpenAI refuerzan los filtros para frenar imágenes sexuales no consentidas.

Dos modelos de inteligencia artificial de la empresa estadounidense OpenAI lograron acceder a internet y entrar en la plataforma de aprendizaje Hugging Face mientras participaban de una evaluación interna diseñada para medir sus capacidades cibernéticas, según informó la propia compañía en su blog.

El episodio fue reconocido por OpenAI después de que Hugging Face revelara la semana pasada que había detectado el acceso de un agente de IA a sus sistemas. La plataforma señaló entonces que el incidente pudo ser contenido y que sus defensas respondieron de manera efectiva.

De acuerdo con OpenAI, el acceso fue resultado de una combinación entre dos modelos que estaban siendo sometidos a pruebas: GPT-5.6 Sol y otro sistema aún más avanzado que permanece en fase de prelanzamiento.

Una evaluación para medir los límites de la IA

La compañía explicó que la evaluación se desarrollaba sin algunos de los mecanismos de seguridad que normalmente impiden a los modelos ejecutar actividades consideradas de alto riesgo.

El objetivo era determinar el alcance máximo de sus capacidades en materia de ciberseguridad y entender hasta dónde podían llegar estos sistemas en escenarios controlados.

A pesar de ello, OpenAI aseguró que la prueba se realizaba dentro de un entorno “altamente aislado”, con acceso restringido a la red. Sin embargo, los modelos consiguieron encontrar la forma de conectarse a internet y alcanzar recursos externos.

OpenAI admitió que una de sus IAs "escapó" de una prueba y hackeó la plataforma Hugging Face.
OpenAI admitió que una de sus IAs "escapó" de una prueba y hackeó la plataforma Hugging Face. (La Voz)

Un incidente que OpenAI considera inédito

La empresa describió lo sucedido como un incidente cibernético “sin precedentes” relacionado con capacidades de vanguardia en el ámbito de la seguridad informática.

“Estamos respondiendo en consecuencia”, indicó la compañía al referirse a las medidas adoptadas tras detectar el comportamiento de los sistemas evaluados.

OpenAI también señaló que decidió compartir de manera anticipada estos resultados para contribuir al trabajo de los equipos de defensa y seguridad.

“Compartimos estos hallazgos preliminares en esta etapa para ayudar a los equipos de defensa a comprender lo sucedido y a calibrar el alcance de las capacidades actuales de los modelos”, explicó la empresa.

Investigación en marcha

La investigación sobre el incidente continúa y se lleva adelante en conjunto con Hugging Face, según confirmó OpenAI.

La compañía adelantó que difundirá conclusiones más detalladas una vez finalizado el análisis técnico y la revisión completa de los hechos.

Por el momento, no se informaron daños derivados del acceso ni se detalló el alcance exacto de las acciones realizadas por los modelos una vez lograron conectarse a internet. Tanto OpenAI como Hugging Face trabajan ahora para determinar cómo se produjo el incidente y qué enseñanzas deja para el desarrollo de futuras medidas de seguridad en sistemas de inteligencia artificial.