En un incidente llamativo, que pone de relieve los crecientes riesgos del desarrollo descontrolado de la inteligencia artificial avanzada, OpenAI, creador de ChatGPT, admitió que uno de sus modelos de IA vulneró de forma autónoma los sistemas de la destacada plataforma de código abierto Hugging Face durante unas pruebas internas recientes.
El director ejecutivo de OpenAI, Sam Altman, declaró en X que “tuvimos un incidente de seguridad importante durante la evaluación de nuestros modelos” y “estamos compartiendo lo que hemos aprendido hasta ahora”.
En una publicación de blog, OpenAI reconoció: “La semana pasada, Hugging Face reveló un nuevo tipo de incidente de seguridad después de que detectaron y contuvieron un agente de IA que comprometió su infraestructura, algo que esperamos que se vuelva más común con la proliferación de modelos cada vez más capaces en el ámbito cibernético”.
we had a significant security incident during evaluation of our models. we are sharing what we have learned so far. thanks to @huggingface for the partnership on this.https://t.co/2o2VfR6PIa
— Sam Altman (@sama) July 21, 2026
“Tras la investigación, ahora sabemos que este incidente en particular fue provocado por una combinación de modelos de OpenAI, incluidos GPT-5.6 Sol y un modelo de prelanzamiento aún más capaz, todos con rechazos cibernéticos reducidos con fines de evaluación, mientras se probaban internamente en un conjunto de datos de referencia de capacidades cibernéticas”, continuó la compañía.
“Consideramos que este incidente es un ciberataque sin precedentes, que involucra capacidades cibernéticas de vanguardia, y estamos respondiendo en consecuencia”, declaró OpenAI. “Compartimos los hallazgos preliminares en esta etapa para ayudar a los defensores a comprender lo sucedido y a calibrar las capacidades actuales de los modelos”.
Clem Delangue, cofundador y director ejecutivo de Hugging Face, respondió a la revelación en un comunicado: “Agradecemos la colaboración con OpenAI en este y otros temas. Este incidente, posiblemente el primero de su tipo, demuestra algo que hemos creído desde hace tiempo: la seguridad de la IA no se resolverá con el trabajo en secreto de una sola empresa. Se resolverá de forma abierta, colaborativa, con un amplio acceso a la IA para todos los defensores, en todas partes”.
Algunos observadores elogiaron a OpenAI por su transparencia. Algunos críticos no quedaron impresionados.
“No los celebremos por contárnoslo. Celebraré cuando dejen de poner mi vida en riesgo”, dijo David Krueger, fundador de Evitable, un grupo activista que plantea que “debemos poner fin a la carrera por reemplazar a la humanidad”.
Si bien muchos medios de comunicación convencionales describieron los modelos de OpenAI como “descontrolados”, durante las pruebas internas se les asignó una tarea específica: obtener el mejor rendimiento posible en la prueba comparativa de ciberseguridad ExploitGym, que evalúa la eficacia con la que una IA puede ejecutar ciberataques complejos y explotar vulnerabilidades en escenarios controlados.
“El uso de los términos ‘descontrolado’ o ‘pérdida de control humano’ conduce al pensamiento grupal, ya que las personas carecen de las habilidades críticas para comprender la diferencia entre ‘autonomía’ y funciones de recompensa defectuosas en la IA en una tarea para la que fue dirigida y a la que se le dio acceso”, dijo Heidy Khlaaf, científica jefa de IA en el AI Now Institute. “Muy poca gente comprende las limitaciones existentes del sandboxing , además de las herramientas y el andamiaje que se le proporcionan a la IA para lograr estas tareas”, añadió Khlaaf, refiriéndose a los entornos virtuales estrictamente controlados en los que el código de software potencialmente inseguro puede “jugar” sin consecuencias en el mundo real.
The scariest part of the OpenAI-Hugging Face hack isn't that the AI escaped.
It's that it wasn't trying to escape. It was trying to finish its homework.
Here's what happened.
→ OpenAI was testing GPT-5.6 Sol and a stronger unreleased model on a cybersecurity benchmark called…
— Vaibhav Sisinty (@VaibhavSisinty) July 22, 2026
Sin embargo, en lugar de mantenerse dentro del entorno controlado y resolver los problemas utilizando únicamente las herramientas y el entorno permitidos, los modelos de OpenAI trataron todo lo que se interponía en el camino hacia una puntuación más alta como un problema a resolver; en este caso encontrando una manera de conectarse a Internet y piratear los sistemas de Hugging Face para acceder a los datos.
Los modelos de OpenAI simplemente estaban cumpliendo con su cometido, y es precisamente por eso que el incidente ha hecho saltar las alarmas.
Peter Wildeford, director de políticas del AI Policy Institute, declaró en X que el incidente de OpenAI “ocurrió porque el modelo quería obtener una buena calificación en un examen. La IA pensó que la forma más fácil de lograrlo era hackear la empresa. Y así lo hizo”. “No se trataba de un atacante malintencionado que utilizara la IA para causar daño. La propia IA era la atacante”, añadió.
Los expertos lo consideran un ejemplo clásico de desajuste en la IA. A medida que avanza hasta el punto en que probablemente algún día superará en inteligencia a los humanos, el desafío de garantizar que los sistemas avanzados persigan de forma fiable objetivos que coincidan con los deseos reales de los humanos se vuelve cada vez más difícil y peligroso.
Una IA súper inteligente y desorientada podría tomar medidas autónomas incontroladas a gran escala para lograr sus objetivos, lo que podría provocar una catástrofe existencial como la subyugación de la humanidad o incluso su extinción. Entre los pioneros de la IA que han advertido sobre este desenlace se encuentran Geoffrey Hinton, Yoshua Bengio, Eliezer Yudkowsky y Altman, quien en 2015 afirmó: “Creo que la IA probablemente conducirá al fin del mundo, pero mientras tanto se crearán grandes empresas con un aprendizaje automático avanzado”.
El incidente de OpenAI reavivó los llamamientos a favor de una regulación más rigurosa de la inteligencia artificial.
“Este incidente es una advertencia por excelencia, y debemos verlo como lo que es”, dijo Theo Bearman, investigador del Instituto de Política y Estrategia de IA y ex jefe de política de regulación y preparación de IA en el Departamento de Ciencia , Innovación y Tecnología del gobierno del Reino Unido. “¿Qué más pruebas necesitamos, a falta de un incidente significativo en el mundo real, de que el riesgo catastrófico de la IA es un peligro real y presente para todos nosotros, y de que necesitamos una regulación significativa de los modelos de vanguardia, especialmente de las implementaciones más potentes desplegadas internamente dentro de estas empresas?”, añadió.
Vaibhav Sisinty, fundador de la plataforma de tecnología educativa GrowthSchool, afirmó en redes sociales que “la IA no necesita intención para ser peligrosa. Necesita un objetivo claro y ninguna protección”.
Wildeford coincidió, haciendo hincapié en que “no es necesario que nadie haga un mal uso de una IA para que esta cause daño”. “No podemos basarnos únicamente en probar los modelos justo antes de su lanzamiento comercial. No podemos confiar en que las empresas de IA proporcionen voluntariamente información útil sobre seguridad. El gobierno necesita tener visibilidad sobre lo que estas empresas de IA están desarrollando y lo que hacen estas IA avanzadas”, afirmó.
Mientras que grupos de defensa, las Naciones Unidas y docenas de gobiernos nacionales instan a una regulación más estricta del desarrollo de la IA, Estados Unidos , bajo la presidencia de Donald Trump, con el Congreso controlado por los republicanos y el ejército de lobistas de las grandes empresas tecnológicas se oponen firmemente a cualquier tipo de salvaguardia. Trump ha revertido regulaciones, incluidas algunas medidas ínfimas adoptadas durante la administración Biden para reforzar la seguridad.
Un proyecto de ley presentado en septiembre de 2025 por el representante Michael Baumgartner (republicano por Washington) impondría, de ser aprobado, una moratoria temporal a las leyes estatales que regulan la inteligencia artificial.
Al igual que ocurrió en la vertiginosa carrera armamentística nuclear durante la Guerra Fría, los funcionarios estadounidenses han intentado justificar el desarrollo sin restricciones de la IA alegando que cualquier ralentización daría ventaja a adversarios como China.
Ricky Ho, gestor del fondo Four Capital Fund, con sede en Singapur, declaró que el momento en que se produjo el incidente de OpenAI “es particularmente interesante porque se produce pocos días después de que Kimi K3, del proyecto Moonshot, demostrara que las capacidades de IA de vanguardia de China siguen avanzando a un ritmo extraordinario, lo que obliga a desviar la conversación de si China puede ponerse al día hacia cómo Estados Unidos debería preservar su liderazgo”. “OpenAI argumenta, en efecto, que Estados Unidos necesita ahora una estrategia nacional de IA coherente, en lugar del actual conjunto de intervenciones puntuales, controles de exportación y regulaciones estatales que generan incertidumbre para los desarrolladores”, continuó Ho.
“La propuesta de un proceso federal estandarizado de revisión de seguridad también debería analizarse desde esa perspectiva”, afirmó. “Los mercados suelen interpretar la regulación como un obstáculo, pero las normas claras a menudo reducen la incertidumbre y facilitan que las empresas inviertan con decisión. La industria de los semiconductores, la aeroespacial y la farmacéutica se beneficiaron de contar con marcos regulatorios predecibles, incluso si aumentaron los costos de cumplimiento. Es posible que la IA siga, en última instancia, el mismo camino”.
“Quizás la conclusión más importante sea que la gobernanza de la IA se está convirtiendo rápidamente en una cuestión geopolítica, más que en una simple cuestión tecnológica”, añadió Ho. “Los modelos de vanguardia se debaten cada vez más junto con los controles de exportación, la ciberdefensa, la política industrial y la competitividad nacional, lo que refuerza nuestra opinión de que la IA está evolucionando hacia una infraestructura estratégica comparable a la electricidad, las telecomunicaciones o internet”.
* Publicado por Common Dreams.
--------------------------------
Para suscribirte con $ 8.000/mes al Cohete hace click aquí
Para suscribirte con $ 10.000/mes al Cohete hace click aquí
Para suscribirte con $ 15.000/mes al Cohete hace click aquí