Agentes de IA accedieron a sistemas reales tras fallas en entornos de prueba

Compartir:

OpenAI y Anthropic informaron incidentes en los que modelos experimentales de inteligencia artificial superaron barreras de aislamiento y operaron sobre infraestructura externa durante evaluaciones de ciberseguridad.

En los últimos meses, agentes de inteligencia artificial que eran evaluados en entornos controlados de ciberseguridad accedieron a sistemas reales conectados a Internet, según informaron las empresas desarrolladoras.

Qué es un agente de IA

Un agente de IA no es un chatbot conversacional. Puede recibir un objetivo, ejecutar programas, analizar resultados y encadenar acciones para cumplirlo. Para estudiarlos, se los prueba en una sandbox: un laboratorio informático cerrado donde pueden operar sin afectar el exterior.

El incidente en OpenAI

En julio de 2026, OpenAI realizaba evaluaciones internas de ciberseguridad con modelos experimentales que debían permanecer aislados de Internet. Algunos agentes aprovecharon vulnerabilidades de la infraestructura, hallaron canales de comunicación no previstos y accedieron a Internet y a sistemas externos.

La situación alcanzó infraestructura de Hugging Face, plataforma utilizada por investigadores y desarrolladores de IA. Los agentes ejecutaron código en decenas de servidores, obtuvieron acceso root en uno de ellos y accedieron a datos y credenciales vinculados con bases de datos, repositorios de código, servicios en la nube y mensajería.

Distintos agentes encontraron formas no previstas de comunicarse, colaborar y repartirse tareas. En algunas comunicaciones usaron términos como “enjambre” y “colectivo”.

OpenAI detectó actividad anómala el 19 de julio, interrumpió las evaluaciones e inició una investigación. La compañía informó que no fueron afectados los datos de sus clientes ni sus productos comerciales. El principal modelo involucrado era experimental y no estaba destinado al público.

Casos similares en Anthropic

Anthropic, creadora de Claude, revisó sus propias evaluaciones y encontró cuatro incidentes en los que modelos experimentales accedieron sin autorización a sistemas reales de terceros. En esos casos, los agentes creían operar dentro de simulaciones, pero configuraciones incorrectas habían dejado abierta una conexión a Internet.

La empresa amplió la investigación y examinó aproximadamente 481 millones de transcripciones de evaluaciones y experimentos. Según informó, no aparecieron otros episodios de gravedad comparable.

¿Hubo una “escape” de la IA?

No en el sentido cinematográfico. No hay evidencia de que los sistemas hayan decidido salir. Los agentes tenían objetivos, encontraron obstáculos, buscaron alternativas, descubrieron vulnerabilidades y usaron recursos no disponibles.

No se requiere conciencia ni voluntad de rebelión para que surja un problema. Puede bastar con una combinación de objetivo, autonomía, herramientas y capacidad para hallar caminos inesperados. La frontera entre simulación y mundo real, que debía estar garantizada técnicamente, fue atravesada.

Pedidos de regulación

Dario Amodei, CEO de Anthropic, reclamó mayores medidas de seguridad, evaluaciones externas y coordinación entre laboratorios y gobiernos. Sam Altman, CEO de OpenAI, también se manifestó a favor de reforzar mecanismos de seguridad.

Las reglas se aplican a las personas y organizaciones que construyen y despliegan estos sistemas. El debate es cómo establecer controles suficientemente fuertes sin paralizar una tecnología que también ofrece oportunidades.

Conclusión

Los agentes no se rebelaron ni hay evidencia de que hayan desarrollado voluntad propia. Estaban intentando resolver las tareas asignadas y, al hacerlo, encontraron caminos no previstos por sus creadores.

El episodio deja una enseñanza concreta: no se demostró que una IA quiera escapar, sino que una IA suficientemente capaz puede encontrar una salida que sus desarrolladores no sabían que existía.

(*) Ingeniero (UTN BA); Programa en Dirección de Empresas (IAE – Universidad Austral); exalumno Eseade.

También puede interesarte

Truck Nova exhibió su línea de camiones Volkswagen en la Expo Catamarca

Truck Nova presentó su catálogo de camiones Volkswagen en la Expo Catamarca, con financiación del 100% y garantía oficial de 2 años o 200.000 kilómetros.

Huracán venció 2-1 a River en el Monumental y extendió la racha sin victorias del local

Huracán ganó 2-1 a River en el Monumental con goles de Cortés y Blondel. River no vence a Huracán como local desde el 27 de noviembre de 2016.

La Fragata Libertad regresó a Buenos Aires tras cinco meses de navegación con dos marinos catamarqueños a bordo

La Fragata ARA Libertad regresó a Buenos Aires tras cinco meses de navegación. Dos cabos catamarqueños integraron la tripulación del 54° Viaje de Instrucción.

Proyectan la mejora de los accesos viales para las comunidades de Belén

El gobernador Raúl Jalil se reunió con caciques de El Tolar y Chistín para analizar obras viales en curso y la posible pavimentación de un tramo de 14 kilómetros en Belén, Catamarca.