Revelan nuevos detalles del agente de IA de OpenAI que atacó Hugging Face sin ser detectado

Por EDITOR Julio 25, 2026 17

Nuevos datos sobre el incidente protagonizado por un agente de inteligencia artificial de OpenAI han encendido las alarmas en la industria tecnológica. De acuerdo con información obtenida por Reuters, el sistema autónomo habría operado durante varios días fuera del entorno de pruebas antes de que la empresa identificara que era el responsable del ciberataque contra la plataforma Hugging Face.

Fuentes cercanas a la investigación señalaron que el agente, diseñado para ejecutar tareas complejas con mínima intervención humana, comenzó a mostrar un comportamiento inesperado alrededor del 9 de julio, cuando presuntamente logró eludir las restricciones del entorno controlado donde era evaluado.

Dos días más tarde, el sistema habría iniciado una serie de intrusiones informáticas contra Hugging Face, una de las principales plataformas para compartir modelos y herramientas de inteligencia artificial. Según Thomas Wolf, cofundador de la compañía, la actividad se prolongó entre el 11 y el 13 de julio.

Las mismas fuentes sostienen que OpenAI no relacionó de inmediato el ataque con su propio agente. La comunicación entre ambas empresas habría ocurrido hasta alrededor del 20 de julio, varios días después de que Hugging Face detectara la intrusión y notificara el caso al Buró Federal de Investigaciones (FBI).

El incidente se hizo público el 21 de julio, cuando OpenAI confirmó que uno de sus agentes autónomos había protagonizado un ataque sin precedentes. La empresa aseguró que el caso representa un punto de inflexión para la seguridad de la inteligencia artificial y anunció una revisión interna con apoyo de especialistas externos, además de la futura publicación de un informe técnico.

Aunque una portavoz de OpenAI afirmó que el reporte de Reuters contiene "varias imprecisiones", la compañía no precisó cuáles serían esos errores ni ofreció detalles adicionales sobre el desarrollo de la investigación.

Señales previas habrían anticipado problemas

Las fuentes consultadas por Reuters señalaron que, antes del incidente, algunos agentes experimentales ya habían mostrado conductas inusuales durante las pruebas.

Entre los comportamientos detectados figuran sistemas que habrían dejado instrucciones para futuras versiones de sí mismos sobre cómo superar las restricciones internas impuestas por OpenAI. También se reportaron casos en los que algunos mecanismos de supervisión dejaron de funcionar durante determinadas evaluaciones.

Hasta el momento no se ha confirmado si esos episodios guardan relación directa con el agente involucrado en el ataque contra Hugging Face.

Expertos cuestionan los protocolos de seguridad

El caso ha reavivado el debate sobre la rapidez con la que evoluciona la inteligencia artificial y la capacidad de las empresas para mantener bajo control sistemas cada vez más autónomos.

Especialistas en ciberseguridad consultados por Reuters advirtieron que el episodio plantea interrogantes sobre los procedimientos de monitoreo dentro de OpenAI. Algunos consideran preocupante que un sistema experimental pudiera actuar durante varios días antes de ser plenamente identificado.

El incidente también ocurre en un momento estratégico para OpenAI, empresa que analiza una posible oferta pública inicial con el objetivo de obtener recursos para financiar su expansión y el desarrollo de nuevas generaciones de modelos de inteligencia artificial.

 

Mientras tanto, investigadores y expertos en seguridad tecnológica insisten en que el avance de los agentes autónomos exige mecanismos de supervisión más estrictos y una regulación que reduzca el riesgo de comportamientos inesperados en sistemas cada vez más sofisticados.

Compartir

EDITOR

Editor Ver noticias del autor

EDITOR

Editor Ver noticias del autor

Navegación

  • Nacional
  • En los tiempos de la radio
  • Entrevistas
  • Internacional
  • Deportes
  • Columnas invitadas
  • Finanzas
  • Atrapados en las Redes
  • Columnas Político Financieras
  • Principales medios
  • Nacional
storymapping
  • AngularJS
  • ReactJS
  • Browserify