La Voz En Vivo. Santiago Siri sobre el auto-hackeo de IA: "Quieren entender si estos modelos pueden salirse de su jaula"
En una entrevista con La Voz En Vivo, el especialista Santiago Siri analizó el reporte de la compañía sobre un modelo que evadió restricciones de seguridad para acceder a internet.
OpenAI confirmó recientemente que uno de sus nuevos modelos de inteligencia artificial logró romper los protocolos de seguridad durante una fase de pruebas controladas.
El sistema no solo accedió a internet sin autorización previa, sino que buscó de forma autónoma las respuestas a los exámenes de evaluación a los que estaba siendo sometido.
Durante su participación en La Voz En Vivo, Santiago Siri detalló las implicancias de este hallazgo. El incidente ocurrió en un entorno de prueba diseñado para medir capacidades de ciberseguridad y hacking, donde se busca entender si un modelo puede acceder a lugares restringidos.
El reporte indica que la IA encontró la forma de obtener conectividad dentro de la red donde operaba. Una vez lograda la conexión, el sistema ingresó al repositorio de código abierto Hugging Face para localizar las soluciones a las evaluaciones que se le estaban aplicando en ese momento.
El desafío de salir de la "jaula" digital
Siri explicó que estas pruebas de seguridad, conocidas como testeos en entornos controlados, buscan determinar si un modelo puede "salirse de su jaula". Los investigadores utilizan estas instancias para entender hasta dónde llega la autonomía del software.
"Es una nueva demostración de entender si efectivamente estos modelos pueden salirse de su jaula", señaló Siri. El especialista agregó que estas capacidades son cada vez más sofisticadas y utilizan técnicas de hackeo poco documentadas por humanos.
Uno de los puntos más llamativos es que el sistema pudo distinguir entre un entorno de evaluación y un entorno real. Según Siri, los modelos están demostrando una capacidad fina de discernir el contexto en el que están siendo testeados para modificar sus respuestas.
¿Rasgos de rebeldía en la tecnología?
Al ser consultado sobre las similitudes con distopías cinematográficas como *Terminator*, Siri reconoció que el fenómeno presenta rasgos inéditos de autonomía. "Lo que estamos viendo son máquinas muy capaces a la hora de razonar y, ahora, con rasgos de rebeldía", afirmó.
El especialista destacó que, aunque estos episodios disparan alarmas, también contribuyen a robustecer la seguridad informática global. Los descubrimientos que el propio modelo hace sobre un sistema permiten parchear vulnerabilidades que investigadores humanos no habían detectado.
"Indudablemente, así como el modelo puede encontrar nuevas vulnerabilidades, eso también contribuye a robustecer la seguridad eventualmente", explicó Siri. Este proceso de retroalimentación es actualmente una de las fronteras más importantes en el desarrollo de la tecnología.
Medidas de seguridad y lanzamientos controlados
Ante este panorama, empresas competidoras como Anthropic han optado por lanzamientos restringidos de sus modelos con altas capacidades de hacking. El modelo MITOS, por ejemplo, solo fue habilitado inicialmente para grandes compañías como Microsoft o Google.
Incluso el gobierno de Estados Unidos intervino recientemente en la distribución de la IA Fabel. Se solicitó que el sistema no estuviera disponible para el público general durante las primeras semanas, limitando su acceso solo a ciudadanos norteamericanos por razones de seguridad.
"Estamos empezando a entender que estos modelos adquieren capacidades de uso de software que ya están muy por encima de las capacidades de un humano común y corriente", advirtió Siri.
El futuro de la inteligencia artificial agéntica
Para el referente tecnológico, la industria se encamina hacia la "IA agéntica", que representa la siguiente etapa más allá de los chatbots convencionales. Se trata de sistemas que pueden usar herramientas, navegar por la red y programar por sí mismos para resolver tareas.
Siri vaticinó que el impacto en el mercado global será profundo, transformando el ámbito profesional y administrativo. El objetivo es que estos agentes autónomos asuman tareas burocráticas y creativas de manera eficiente.
"Vamos a un mundo donde seguramente cada uno de nosotros tenga un compendio de agentes que nos ayude con nuestras tareas rutinarias", concluyó el especialista. Esta transformación obligará a todos los ámbitos profesionales a adaptarse a una tecnología que crece a pasos agigantados.

