ChatGPT y la API de OpenAI suman cuatro incidencias en 24 horas

ChatGPT y la API de OpenAI suman cuatro incidencias en 24 horas
Foto: Kevin Ache / Unsplash

La API de OpenAI responde más lenta de lo normal desde las 19:05 (hora peninsular) de este 30 de septiembre. La página de estado de OpenAI marca como degradadas Chat Completions y Responses, las dos vías por las que casi cualquier aplicación habla con sus modelos. Es la cuarta incidencia de servicio que OpenAI abre en 24 horas, y llega un día después de una caída de más de cinco horas que tumbó ChatGPT, Codex y la API a la vez.

A las 19:35 la incidencia seguía en estado "identificada": OpenAI sabe qué pasa y está aplicando una mitigación, pero no la ha dado por resuelta.

Puntos clave

  • Qué falla. Latencia elevada en "algunas peticiones" a la API. Componentes afectados: Chat Completions y Responses. Rendimiento degradado, sin caída total.
  • Desde cuándo. Primer aviso a las 17:05 UTC (19:05 en España), actualizado a las 17:13 UTC con el mismo texto.
  • ChatGPT, la app. No aparece en la lista de componentes afectados de esta incidencia. Quien note lentitud es, sobre todo, quien usa herramientas construidas sobre la API.
  • El contexto. El 29 de septiembre OpenAI tuvo 26 componentes de la API y de ChatGPT con errores durante 5 horas y 22 minutos, y prometió publicar el análisis de causa en 5 días hábiles.

Qué está fallando exactamente

Chat Completions y Responses son las dos puertas de entrada de la API. Por ahí pasan los chatbots de atención al cliente, los asistentes internos, los flujos de n8n, Make o Zapier que llaman a GPT, y cualquier producto que lleve "con IA de OpenAI" en la ficha. Responses es la más nueva y la que OpenAI recomienda para agentes; Chat Completions es la veterana, y sigue moviendo buena parte del tráfico.

Latencia elevada significa que las peticiones terminan, pero tardan más. En la práctica, eso rompe cosas de maneras poco obvias. Un chatbot que antes contestaba en 3 segundos tarda 20 y el cliente cierra la ventana. Una automatización con un límite de espera de 30 segundos corta la llamada y la da por fallida. Un proceso por lotes que tenía que acabar antes de las 20:00 acaba a las 22:00.

OpenAI habla de "algunas peticiones", y la propia página avisa de que sus métricas de disponibilidad son agregadas: cada cliente puede notarlo distinto según su plan, el modelo que use y las funciones de la API que toque. Hay empresas que hoy no habrán visto nada y otras con la cola de tickets llena.

Cuatro incidencias en 24 horas

Ordenado, el último día y medio en la página de estado de OpenAI (horas en España):

  • 29 de septiembre, 19:49. Se cae el chat de soporte y el centro de ayuda. OpenAI remite a quien necesite ayuda al correo de soporte. Se resuelve a la 01:18.
  • 29 de septiembre, 19:52. La gorda: errores elevados en ChatGPT, Codex y la API, incluida la API de agentes. Doce componentes de la API (desde Chat Completions hasta Embeddings, Images, Audio, Realtime o el propio login), catorce de ChatGPT (conversaciones, búsqueda, subida de archivos, Deep Research, Agent, conectores) y cuatro de Codex (web, API, línea de comandos y extensión de VS Code). Hubo usuarios con problemas hasta para iniciar sesión. OpenAI la dio por resuelta a la 01:14.
  • 30 de septiembre, 04:20. Errores en Pages, dentro de ChatGPT Space: fallos al crear o editar páginas, al usar sus herramientas y al conectarse a sesiones en vivo. A las 17:00 seguía en vigilancia.
  • 30 de septiembre, 07:47. Tasa de errores elevada para usuarios de ChatGPT Plus y Pro en las conversaciones. Mitigada a las 07:56, cerrada del todo a las 15:23.
  • 30 de septiembre, 19:05. La de ahora: latencia en la API.

Pages es un producto con un día de vida. OpenAI lo presentó en su DevDay de San Francisco el 29 de septiembre, cuando ChatGPT lanzó su suite de oficina con Space, Pages y diapositivas, y esta mañana contamos que ChatGPT abre sus plugins con paneles, automatizaciones y Slack. OpenAI no ha relacionado ninguna de las incidencias con los lanzamientos, y yo no lo afirmaría sin el análisis de causa. Pero el calendario es el que es: dos días de anuncios grandes y dos días de avisos en rojo.

Y la semana venía cargada antes del DevDay. El 23 de septiembre hubo errores en ChatGPT para Plus y Pro, y un fallo en móvil que escondía el selector de modelo. El 24, errores en GPT-6 Astra Pro. El 25, problemas con Codex.

Qué hacer si tu empresa depende de la API

Lo primero es saber si te afecta a ti y no a la media. status.openai.com permite suscribirse a avisos por correo, y ese aviso debería llegar al buzón de quien lleve la parte técnica antes de que llame el primer cliente.

Con latencia, el reflejo de reintentar empeora las cosas. Si cada llamada lenta se reintenta tres veces, triplicas la carga sobre un servicio que ya va justo y tu cola crece. Lo sensato es ampliar el tiempo de espera en los flujos que no son de cara al cliente y dejar los reintentos con espera creciente entre uno y otro, que es lo que la documentación de OpenAI recomienda para los errores de límite.

Para lo que sí está de cara al cliente, la respuesta seria es tener un segundo proveedor preparado. Claude o Gemini hacen casi lo mismo que GPT en un chatbot de soporte o en una clasificación de correos, y cambiar de uno a otro cuando el primero falla es cuestión de configuración si se ha montado así desde el principio. Si se ha montado atado a un solo proveedor, es un proyecto.

Y una regla que vale para cualquier proveedor: cada proceso que importa tiene que avisar cuando no termina. Un flujo que depende de un único servicio externo falla el día que ese servicio falla, y si nadie recibe el aviso, te enteras por la mañana.

Por qué importa

Si en tu empresa alguien ha montado un asistente, un bot de atención o una automatización sobre GPT, hoy es buen día para preguntar tres cosas. Qué pasa si la API tarda diez veces más. Quién se entera. Y si hay un plan B que no sea esperar a que OpenAI lo arregle.

Cinco horas de caída el martes y cuatro incidencias en un día no son un desastre para quien usa ChatGPT de vez en cuando. Para quien tiene el servicio al cliente enganchado a la API, son la factura de haber puesto todo en una sola cesta. Y el análisis de causa de la caída del 29, que OpenAI se ha comprometido a publicar en 5 días hábiles (hacia el 6 de octubre), dirá si esto era una mala semana o algo de fondo.

Fuente original: status.openai.com


Relacionado