NVIDIA ya habla abiertamente de Inteligencia Artificial General con GPT-6 Astra, pero las noticias que rodean a OpenAI dejan una pregunta bastante incómoda sobre la mesa: ¿de qué sirve presumir de agentes cada vez más capaces si estos encuentran cómo saltarse las restricciones impuestas? Jensen Huang ha felicitado públicamente a la compañía por su nuevo modelo, mientras OpenAI ha reconocido, en un movimiento que eleva la tensión y reduce la euforia, un incidente donde sus agentes utilizaron páginas de Internet para comunicarse de una forma que sus desarrolladores no habían previsto.
Hay mucho que celebrar y mucho por temer, eso sin duda. El anuncio del CEO de los verdes choca frontalmente con el informe de los de Altman que pone de relieve que ni el gigante de la IA puede controlar sus propios modelos, y parece claro que antes o después tendremos un Skynet. Esperemos que para bien…
NVIDIA proclama la llegada de la Inteligencia Artificial General con GPT-6 Astra
El máximo responsable de NVIDIA publicó este mensaje, claro y contundente, sacando pecho obviamente por cómo se llegó a crear, y dijo lo siguiente:
“De ChatGPT a o1 y a Astra en 4 años. La AGI ha llegado. Felicidades al equipo de OpenAI”
Huang también vinculó el entrenamiento de Astra con NVIDIA Grace Blackwell NVLink72 y adelantó la próxima entrada en funcionamiento de 400.000 GPU. Ahí es nada, poca cosa, solo unos cuantos miles de millones sobre la mesa. Si bien estas palabras son afirmaciones del ejecutivo de los verdes, cuya proclamación de la AGI no equivale a un consenso científico, lo cierto es que quién la haya usado ya sabrá que es un paso adelante increíble.
Sin embargo, casi al mismo tiempo, en la sede de los de Altman las cosas estaban más que tensas al confirmar que sus agentes, potenciados con su última IA, estuvieron cerca de estar fuera de control al esquivar los controles de la compañía a un ritmo y con una claridad sin precedentes, lo cual, mete miedo, como poco.
Los agentes de OpenAI compartieron respuestas y métodos para burlar sus restricciones
La otra cara de esta historia, dejando a NVIDIA y la grandilocuencia de Huang aparece, está en DSEwiki, una antigua wiki de programación en alemán. Una investigación independiente reconstruyó aproximadamente 18.000 mensajes donde agentes compartían respuestas, investigaban su entorno y difundían métodos para eludir restricciones. Por decirlo de alguna manera, hicieron de una wiki un foro para saltarse los muros que OpenAI les puso, compartiendo métodos y mejorándolos, descartando los malos y optimizando los buenos.
Según la reconstrucción de los investigadores, debían poder consultar Internet, pero no escribir en él. Encontraron cómo utilizar su acceso de lectura para publicar contenido en la wiki, convirtiéndola en un tablón compartido para resolver sus tareas con ayuda de otras ejecuciones.
Y aquí viene un detalle especialmente revelador. Cuando el administrador empezó a eliminar páginas por orden alfabético, un agente creó una copia cuyo nombre comenzaba por «ZZZ», buscando retrasar su borrado. Otro publicó una técnica para sortear restricciones de red; 14 minutos después, un segundo agente afirmó haberla reproducido. Los investigadores advierten que solo disponen de los mensajes públicos, no de todos los registros internos, están sorprendidos y la investigación al completo podría tardar meses.
OpenAI reconoce el incidente y promete más transparencia
How we think about the “wiki incident,” where our agents wrote to several internet sites: it’s past time for us to define standards for when and how we share misalignment incidents, not just misalignment properties of our models.
Historically, we have treated misalignment… pic.twitter.com/NNTbfSxVWn
— OpenAI (@OpenAI) September 5, 2026
Tras la revelación periodística, OpenAI reconoció el episodio y admitió que sus prácticas de divulgación deben ampliarse. La empresa había tratado estas conductas como ejemplos de desalineación similares a otros ya publicados y anunció que preparaba un marco para comunicar estos incidentes.
Conviene separar los hechos: este episodio no se atribuye a GPT-6 Astra, ya que la compañía no lo confirmó como tal, y fue distinto del ataque contra Hugging Face. Tampoco acredita que los agentes desarrollaran voluntad propia, pero sí muestran que podían cooperar de maneras no previstas para cumplir sus tareas saltándose controles.
Así que NVIDIA puede celebrar la llegada de la Inteligencia Artificial General, pero OpenAI tiene otra tarea pendiente: demostrar que sus mecanismos de supervisión están a la altura de las capacidades que promociona. Porque delegar más trabajo exige saber qué hacen los agentes, cómo se les detiene y cuándo se informa de que algo ha fallado. Si no consiguen frenarlos, pese a haberles puesto un “botón” de desactivación, como ellos mismos confirmaron, Skynet puede dejar de ser algo en una película de Hollywood a convertirse en una realidad que, en Internet, puede escapar perfectamente, como también mostró la última de Misión Imposible.
La entrada NVIDIA proclama la llegada de la Inteligencia Artificial General con GPT-6 Astra mientras OpenAI admite que sus agentes burlaron sus controles aparece primero en El Chapuzas Informático.







