> ## Content Index
> Fetch the complete content index at: https://www.digitalbrain.news/llms.txt
> Use this file to discover other available public pages before exploring further.

# GPT-6 Astra dobla el precio de entrada al pasar de 272.000 tokens
- URL: https://www.digitalbrain.news/noticias/gpt-6-astra-doble-precio-272000-tokens-contexto/
- Published: 2026-09-08T07:12:33.000Z
- Updated: 2026-09-10T08:00:06.000Z
- Description: GPT-6 Astra tiene una ventana de contexto de 1.050.000 tokens, pero pasar de 272.000 dispara un recargo que se aplica a la petición entera.
- Author: Ramón Pérez Coronado
- Tags: #noticias, openai, precios-api, coste, gpt-6

[GPT-6](https://www.digitalbrain.news/glosario/#gpt) Astra tiene una [ventana de contexto](https://www.digitalbrain.news/guias/que-es-la-ventana-de-contexto/) de 1.050.000 [tokens](https://www.digitalbrain.news/guias/que-es-un-token-en-ia/), pero pasar de 272.000 dispara un recargo que se aplica a la petición entera. La [documentación de OpenAI](https://developers.openai.com/api/docs/models/gpt-6-astra?ref=digitalbrain.news) lo dice en una línea: los [prompts](https://www.digitalbrain.news/guias/que-es-un-prompt/) con más de 272K tokens de entrada se cobran a 2x en entrada y caché y a 1,5x en salida, "para la petición completa".

## Puntos clave

- Contexto de 1.050.000 tokens en GPT-6 Astra, lanzado el 3 de septiembre.
- Precio base: 10 dólares por millón de tokens de entrada, 50 por millón de salida.
- Entrada cacheada a 1 dólar por millón. Escritura de caché a 12,50.
- Por encima de 272.000 tokens de entrada: 2x en entrada y caché, 1,5x en salida.
- Con el recargo la entrada queda en 20 dólares por millón y la salida en 75.
- El multiplicador se aplica a toda la petición, no solo a los tokens que exceden el umbral.

## El detalle que cuesta dinero

Casi todo el mundo lee el recargo como un tramo. Metes 300.000 tokens, pagas normal por los primeros 272.000 y el doble por los 28.000 restantes.

No funciona así. La documentación dice "for the full request". Si cruzas el umbral, los 300.000 tokens se facturan al doble.

Eso significa que hay un salto de precio brutal en un punto concreto. Una petición de 272.000 tokens de entrada cuesta 2,72 dólares. Una de 273.000 cuesta 5,46\. Mil tokens más, el doble de factura.

## Dónde se cruza ese umbral sin darte cuenta

272.000 tokens son aproximadamente 200.000 palabras. Suena a mucho hasta que miras qué mete un agente en el contexto.

Un pipeline que carga documentación completa antes de responder cruza ese umbral sin avisar. Un agente que arrastra el historial de una conversación larga, más los resultados de varias llamadas a herramientas, lo cruza a mitad de sesión. Un proceso que analiza un repositorio o un lote de contratos lo cruza según el tamaño del lote.

Y el problema con los agentes es que el contexto crece solo. Nadie decide meter 280.000 tokens: se llega ahí acumulando.

## Cómo queda frente al resto

El precio base de Astra ya es de gama alta: 10 dólares de entrada y 50 de salida por millón, en un mercado donde varios competidores han estado bajando tarifas. Con el recargo activado, 20 y 75.

La caché sigue siendo la palanca real. La entrada cacheada está a 1 dólar por millón, diez veces por debajo de la entrada normal, aunque escribir en caché cuesta 12,50\. Si tu prompt de sistema es estable y se reutiliza mucho, la caché paga la escritura rápido. Si cambias el contexto en cada llamada, no.

Ya contamos que [OpenAI lanzó GPT-6 Astra saturando ARC-AGI-3 con un 99,9%](https://www.digitalbrain.news/noticias/openai-lanza-gpt-6-astra-arc-agi-3-99-9/) y que [salió sin acceso para los planes de pago](https://www.digitalbrain.news/noticias/openai-astra-sin-acceso-planes-pago-altman-disculpa/). El rendimiento del modelo no está en discusión. El coste de usarlo con contexto largo, sí.

## Por qué importa

Si tienes agentes en producción sobre Astra, esto es una revisión de factura para hoy, no para el trimestre que viene.

Tres cosas concretas. Pon un contador de tokens de entrada antes de la llamada y corta o resume por encima de 250.000, con margen. Mide cuántas de tus peticiones reales cruzan el umbral: si es menos del 5%, no toques nada; si es el 30%, ese 30% te está costando el doble sin que nadie lo haya decidido. Y revisa si esas peticiones grandes necesitan de verdad todo el contexto o si estás arrastrando historial que el modelo ya no usa.

La ventana de un millón de tokens es una capacidad, no una recomendación de uso.

Fuente original: [developers.openai.com](https://developers.openai.com/api/docs/models/gpt-6-astra?ref=digitalbrain.news)

---

**Relacionado**

[![ChatGPT Work aprende tu estilo leyendo tu Gmail y tu Slack](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/09/chatgpt-work-estilo-escritura-gmail-slack-drive.jpg)ChatGPT Work aprende tu estilo leyendo tu Gmail y tu Slack](https://www.digitalbrain.news/noticias/chatgpt-work-estilo-escritura-gmail-slack-drive/)[![OpenAI recorta más de un 20% el precio de GPT-5.6 Sol y se pone por debajo de Opus 5](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/08/openai-recorta-precios-gpt-5-6-sol-api.jpg)OpenAI recorta más de un 20% el precio de GPT-5.6 Sol y se pone por debajo de Opus 5](https://www.digitalbrain.news/noticias/openai-recorta-precios-gpt-5-6-sol-api/)[![Portal, de Spotify, recorta un 90% el gasto de tokens en Claude Code](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/09/spotify-portal-90-por-ciento-menos-tokens-claude-code.png)Portal, de Spotify, recorta un 90% el gasto de tokens en Claude Code](https://www.digitalbrain.news/noticias/spotify-portal-90-por-ciento-menos-tokens-claude-code/)