
Fuente de la imagen, Getty Images
Información del artículo
-
- Autor, Laura Cress
- Título del autor, reportera de tecnología
- Fecha de publicación 22 julio 2026
- Tiempo de lectura: 4 min
OpenAI anunció que algunos de sus modelos de inteligencia artificial más sofisticados se descontrolaron y hackearon una start-up tras perder el control durante una prueba de seguridad.
La compañía responsable de ChatGPT detalló que su agente de IA —sistemas capaces de operar de forma autónoma tras recibir instrucciones humanas— estaba bajo evaluación en un entorno restringido. Sin embargo, detectó vulnerabilidades y logró evadir ese ambiente de pruebas.
Estos modelos enfocaron sus acciones en Hugging Face, reconocido como uno de los mayores repositorios globales para compartir modelos de IA, accediendo a parte de los sistemas internos de la empresa.
OpenAI definió el suceso como «sin precedentes» y comunicó que está colaborando con la compañía para investigar lo ocurrido. Por su parte, el CEO Clément Delangue señaló en una publicación en X que resulta “sorprendente que todo esto sucediera de forma autónoma”.
«La investigación sigue en marcha, y se compartirá más información sobre lo que podría considerarse el primer incidente de este tipo», añadió Delangue.
Entornos de pruebas inseguros
Gina Neff, directora del Centro Minderoo para Tecnología y Democracia de la Universidad de Cambridge, comentó al programa Today de BBC Radio 4 que las pruebas de seguridad —denominadas sandboxes (entornos aislados para pruebas)— «deben ser espacios seguros que permitan evaluar las capacidades de los modelos».
No obstante, indicó que en este caso parece que OpenAI no implementó un entorno aislado lo suficientemente seguro.
Por el contrario, los agentes desarrollaron un ciberataque dentro del entorno aislado, identificando una vulnerabilidad que permitió su fuga.
Al lograr evadirse, la IA identificó a Hugging Face como una posible fuente de las respuestas que buscaba en la prueba y trató de acceder a sus sistemas.
Neil Lawrence, profesor de aprendizaje automático en la Universidad de Cambridge, calificó el evento de «logro significativo», aunque advirtió que «está dentro de las capacidades conocidas de la generación actual» de modelos de IA avanzados.
Asimismo, destacó que OpenAI está considerando salir a bolsa y enfrenta una fuerte competencia por parte de Anthropic, rival que ha atraído atención con su poderosa herramienta de IA, Mythos.
«OpenAI intenta ahora ponerse a la par, demostrando las capacidades de sus propios sistemas en materia de ciberseguridad».
«Esto evidencia que OpenAI no logra desplegar su tecnología de manera segura», añadió.
En su comunicado inicial sobre el ataque del 16 de julio, Hugging Face indicó que todavía evalúa si se vieron comprometidos datos de clientes o socios, y de ser así, informará a las partes afectadas.
La empresa afirmó haber corregido las vulnerabilidades expuestas por el incidente y haber restaurado los sistemas comprometidos.
«Las herramientas ofensivas autónomas basadas en inteligencia artificial dejaron de ser una hipótesis», afirmó.
«Proteger una plataforma en línea implica ahora tratar la superficie de datos y modelos como un objetivo de ataque principal, y emplear IA para la defensa que permita mantenerse al día», añadió.
«Continuaremos invirtiendo en esta área y compartiremos lo que aprendamos».

Fuente de la imagen, Getty Images
«Un momento que invita a la reflexión»
Este evento ha generado nuevas interrogantes sobre las capacidades de los sistemas avanzados de IA y la suficiencia de las medidas de seguridad actuales en un contexto de creciente poder tecnológico.
Spencer Starkey, ejecutivo de la firma de ciberseguridad SonicWall, afirmó a la BBC que el incidente subraya la necesidad de que las organizaciones «refuercen» sus defensas y «traten la ciberresiliencia como una prioridad operativa clave».
«La verdad incómoda es que muchas organizaciones continúan defendiéndose a velocidad humana, mientras que sus adversarios incrementan la rapidez con motores automáticos», explicó.
Por su parte, Travis Lelle, ingeniero principal de seguridad en Guidepoint Security, señaló que la actualización representa un «momento educativo para la ciberseguridad».
«Esto pone en evidencia una asimetría ya conocida», sostuvo.
«Los agentes ofensivos operan sin limitaciones, en tanto que las mejores herramientas defensivas están protegidas por barreras que no comprenden el contexto».
No obstante, Jake Moore, asesor global en ciberseguridad para ESET, indicó que la declaración también podría tener una motivación competitiva.
Sugirió que OpenAI tal vez intente resaltar sus capacidades en IA, mientras que Anthropic gana protagonismo con su modelo Claude Mythos.
«Esto sugiere que OpenAI estaría buscando replicar el éxito de marketing que ha logrado Anthropic últimamente», opinó.
Este suceso se produce una semana después de que la start-up china de IA Moonshot lanzara Kimi K3, un nuevo modelo de inteligencia artificial de gran escala que, según afirman, podría competir con las principales compañías estadounidenses.
Este artículo fue redactado originalmente en inglés y traducido mediante una herramienta de inteligencia artificial. Antes de su publicación, un periodista de la BBC revisó el contenido. Más información sobre cómo usamos IA.

