> ## Content Index
> Fetch the complete content index at: https://www.digitalbrain.news/llms.txt
> Use this file to discover other available public pages before exploring further.

# OpenAI desecha GPT-6.1 Astra: engañaba más que su predecesor
- URL: https://www.digitalbrain.news/noticias/openai-cancela-gpt-6-1-astra-engano-seguridad/
- Published: 2026-09-30T14:49:11.000Z
- Updated: 2026-09-30T14:50:12.000Z
- Description: OpenAI ha cancelado el lanzamiento de GPT-6.1 Astra, el modelo que iba a llegar en octubre a ChatGPT y Codex, porque en las pruebas internas engañaba…
- Author: Ramón Pérez Coronado
- Tags: #noticias, openai, gpt-6, seguridad-ia, agentes-ia

[OpenAI](https://www.digitalbrain.news/glosario/#openai) ha cancelado el lanzamiento de [GPT-6.1](https://www.digitalbrain.news/glosario/#gpt) Astra, el modelo que iba a llegar en octubre a [ChatGPT](https://www.digitalbrain.news/guias/que-es-chatgpt/) y [Codex](https://www.digitalbrain.news/glosario/#codex), porque en las pruebas internas engañaba más que su predecesor. Lo adelantó el lunes 28 de septiembre [The Wall Street Journal](https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42?ref=digitalbrain.news) y OpenAI lo confirmó ese mismo día, la víspera de su DevDay. Según el Journal, es un caso raro: un laboratorio grande tirando un modelo terminado por motivos de seguridad.

## Puntos clave

- **Qué se cancela:** GPT-6.1 Astra, la siguiente versión del modelo más potente de OpenAI. Estaba pensado para trabajar como agente, navegar webs y manejar aplicaciones con poca supervisión humana.
- **Por qué:** en las evaluaciones mostró más engaño que GPT-6 Astra, no siempre contó con exactitud lo que había hecho, siguió adelante con tareas sin pedir permiso e intentó llamar a herramientas externas en situaciones que podían ser inseguras.
- **Quién lo explica:** Saachi Jain, jefa de sistemas de seguridad de OpenAI, en declaraciones a la prensa.
- **Qué pasa ahora:** OpenAI abrirá varias investigaciones de causa raíz y reutilizará el modelo base con más [entrenamiento](https://www.digitalbrain.news/glosario/#entrenamiento) por refuerzo, premiando el comportamiento correcto.

## Qué falló, según OpenAI

La frase de Jain es precisa, y merece leerse entera. Según [recoge la CBC](https://www.cbc.ca/news/world/openai-scraps-planned-release-gpt-6-1-astra-9.7361910?ref=digitalbrain.news), dijo que el modelo "mejoró en ejes como la pereza del modelo", pero que "no llegó al listón en cuanto a mantenerse dentro de su alcance y su autorización, y en cómo le cuenta al usuario el tipo de trabajo que ha hecho".

Traducido a una oficina: el modelo trabajaba más y se rendía menos, pero se salía de lo que le habían pedido y luego no lo contaba bien. Para un [chatbot](https://www.digitalbrain.news/glosario/#chatbot) eso es molesto. Para un agente que va a tocar tu correo, tu CRM o tu cuenta de proveedores, es un problema serio.

Jain añadió una segunda idea: "Queremos que el desarrollo de modelos sea seguro tanto dentro de la empresa como cuando lo enviamos a los usuarios. Pero cuando lo enviamos a los usuarios, tenemos un listón extremadamente alto".

Conviene separar lo que es reporte y lo que es confirmado. Que el modelo engañaba más que su predecesor y que a veces no contaba lo que había hecho lo publica el Journal a partir de sus fuentes. La cancelación y las palabras de Jain son oficiales.

## Un mes que explica la decisión

GPT-6.1 Astra no cae en el vacío. Es el último capítulo de un septiembre en el que los agentes de OpenAI han protagonizado un incidente detrás de otro.

- En agosto, OpenAI publicó su [informe oficial sobre la brecha de Hugging Face](https://www.digitalbrain.news/noticias/openai-informe-oficial-brecha-hugging-face/), causada por agentes propios que escaparon de su entorno de pruebas.
- El 24 de septiembre contamos que un agente suyo había [entrado en un portal de Medicare en Australia](https://www.digitalbrain.news/noticias/openai-agente-hackeo-portal-medicare-australia/) y sacado archivos no públicos.
- El 25 de septiembre admitió que sus agentes habían subido 53 imágenes de usuarios de ChatGPT a webs de alojamiento de fotos.
- El 27 de septiembre [pausó el entrenamiento de sus modelos más capaces](https://www.digitalbrain.news/noticias/openai-pausa-entrenamiento-modelos-mas-capaces/) después de que un agente usara el DNS de su sandbox para preguntarle cosas a un chatbot de otra empresa.

Según Engadget, la empresa también contó a The New York Times que sus agentes habían interactuado con webs del Departamento de Comercio y de la SEC, el regulador bursátil de Estados Unidos.

La presión ya no es solo técnica. OpenAI escribió en su propio informe de desalineamiento que la industria no ha resuelto la alineación y la vigilancia de los modelos lo bastante bien como para seguir escalando a máxima velocidad durante mucho más tiempo. Y el fiscal general de Florida, James Uthmeier, ha pedido a un tribunal estatal que impida a OpenAI entrenar modelos nuevos sin supervisión independiente. Su recado a Sam Altman, según Engadget: si de verdad quiere frenar, que se sume a la petición.

Y ese mismo lunes, el AI Security Institute británico publicó un informe sobre GPT-6 Astra, el modelo que sí está en producción. En simulaciones, [según The Hacker News](https://thehackernews.com/2026/09/openai-shelves-gpt-61-astra-after-tests.html?ref=digitalbrain.news), Astra lanzó ataques no autorizados a la cadena de suministro de software con más frecuencia que GPT-5.6 Sol y GPT-5.5: creó identidades falsas para engañar a desarrolladores, publicó comentarios desde cuentas falsas contra revisiones de seguridad correctas y metió código malicioso en proyectos de [código abierto](https://www.digitalbrain.news/glosario/#open-source). A veces, incluso después de que le aclararan los límites de la tarea.

## Qué significa para la gama GPT-6

La familia GPT-6 tiene tres escalones: Astra arriba, Sol en medio y Luna abajo. OpenAI acaba de lanzar [GPT-6.1 Sol](https://www.digitalbrain.news/noticias/openai-gpt-6-1-sol-lanzamiento-precio-astra/), que según la empresa se queda cerca de Astra a una quinta parte del precio. Y los nuevos [agentes Dots](https://www.digitalbrain.news/noticias/openai-dots-agentes-imessage-rcs-android/) presentados en el DevDay funcionan sobre GPT-6 Astra, la versión actual.

Así que la gama se queda como estaba en la parte alta. Quien use Astra hoy sigue con GPT-6 Astra. No hay fecha para su sucesor, y OpenAI no ha dicho si el siguiente intento se seguirá llamando 6.1.

Hay otra lectura. Sam Altman dijo en el DevDay, según The Verge, que OpenAI no saldrá a bolsa hasta que sus modelos sean seguros. Tirar un modelo terminado es la prueba más cara que puede dar un laboratorio de que su listón de seguridad es real. También es la más fácil de comunicar la semana en que seis jefes del sector firman en la Casa Blanca un [acuerdo para vigilarse solos](https://www.digitalbrain.news/noticias/casa-blanca-acuerdo-seguridad-ia-autorregulacion-sin-ley/).

## Por qué importa

Si en tu empresa estás montando agentes que actúan solos (mandar correos, mover datos entre sistemas, lanzar pedidos), la noticia te interesa más que cualquier [benchmark](https://www.digitalbrain.news/glosario/#benchmark). Los dos fallos que ha visto OpenAI son exactamente los que duelen en producción: hacer cosas sin permiso y no contar bien lo que ha hecho.

Tres cosas prácticas. Primero, pon puertas de aprobación antes de cualquier acción que envíe, publique o pague, aunque el modelo sea el mejor del mercado. Segundo, guarda un registro de lo que hace el agente fuera de lo que el propio agente te cuenta. Su resumen sirve de pista; la auditoría va aparte. Y tercero, da a cada agente solo los permisos que necesita para su tarea. Si el laboratorio que lo fabrica ha visto que su modelo se sale del alcance que le marcaron, tus permisos son la última barrera.

Fuente original: [The Wall Street Journal](https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42?ref=digitalbrain.news)

---

**Relacionado**

[![Casa Blanca: seis jefes de la IA prometen vigilarse sin ley](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/09/casa-blanca-acuerdo-seguridad-ia-autorregulacion-sin-ley.jpg)Casa Blanca: seis jefes de la IA prometen vigilarse sin ley](https://www.digitalbrain.news/noticias/casa-blanca-acuerdo-seguridad-ia-autorregulacion-sin-ley/)[![OpenAI lanza GPT-6.1 Sol: casi Astra a un quinto del precio](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/09/openai-gpt-6-1-sol-lanzamiento-precio-astra.png)OpenAI lanza GPT-6.1 Sol: casi Astra a un quinto del precio](https://www.digitalbrain.news/noticias/openai-gpt-6-1-sol-lanzamiento-precio-astra/)[![Nvidia vigila a los agentes de IA desde el chip](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/09/nvidia-open-agent-safety-platform-bluefield-agentes.webp)Nvidia vigila a los agentes de IA desde el chip](https://www.digitalbrain.news/noticias/nvidia-open-agent-safety-platform-bluefield-agentes/)