Caída de ChatGPT: siete incidencias en 20 horas

Caída de ChatGPT: siete incidencias en 20 horas
Foto: Tyler / Unsplash

ChatGPT ha encadenado siete incidencias en unas 20 horas, entre la mañana del lunes 5 y la madrugada del martes 6 de octubre, según la página de estado de OpenAI. La última fue la más amplia: de 04:41 a 05:17 (hora peninsular) dio errores a la vez en las conversaciones, la generación de imágenes, ChatGPT Work, Space y Dots.

OpenAI la clasifica como "rendimiento degradado", no como caída total. Para quien estaba usando ChatGPT a esa hora, la diferencia es teórica: el chat devolvía errores.

¿Está caído ChatGPT ahora?

El chat sí. A las 19:35 del martes 6 de octubre las dos incidencias abiertas en la página de estado son de la API, no de la app: una con Computer Use y la Agents API, abierta a las 19:15, y otra con los PDF grandes en la Responses API, desde las 17:45. Si usas ChatGPT en el navegador o en el móvil, no deberías notarlas. Si tu empresa tiene agentes montados sobre la API de OpenAI, sí.

Las dos que quedaban abiertas del lunes, la de Codex Cloud y la del modo Work, se cerraron de madrugada. Si a ti te sigue fallando, OpenAI avisa en la propia página de que sus métricas de disponibilidad son agregadas y que cada usuario puede notarlo distinto según su plan, el modelo que use y las funciones que toque.

Actualización, 19:35: fallos en Computer Use y la Agents API

A las 19:15 (hora peninsular) OpenAI abrió un aviso nuevo: "Computer Use Is Experiencing Issues". El texto es corto, están investigando problemas en la Agents API y en Computer Use, y el único componente marcado es Agents, dentro de la API, con "rendimiento degradado". Veinte minutos después seguía en fase de investigación, sin causa ni hora de arreglo.

Computer Use es la función que deja a un modelo manejar un ordenador como lo haría una persona: mira la pantalla, mueve el ratón, hace clic y escribe. Es la pieza con la que se montan agentes que rellenan formularios, navegan por webs o sacan datos de un programa que no tiene API. La Agents API es la capa que usan los desarrolladores para orquestar esos agentes encima de los modelos de OpenAI.

Lo que esto significa en la práctica: el ChatGPT de siempre no aparece afectado en la página de estado. Lo que puede fallar ahora mismo son los agentes que tu empresa, o una herramienta que pagas, tenga montados sobre la API de OpenAI. Si una automatización de ese tipo se ha quedado a medias esta tarde, revisa qué hizo antes de relanzarla: un agente que se corta a mitad de un formulario puede haber dejado la mitad guardada.

El aviso de los PDF en la Responses API seguía abierto a la misma hora, ya en "implementando la mitigación". Con este, la página de estado suma diecisiete incidencias entre el 29 de septiembre y el 6 de octubre.

Actualización, 18:40: ChatGPT Go falla por la tarde

La racha no acabó con la madrugada. De 15:35 a 16:40 (hora peninsular), OpenAI tuvo abierta una incidencia de "tasas de error elevadas en las conversaciones de ChatGPT Go", según su página de estado. Aplicó la mitigación a las 15:53, 18 minutos después de abrir el aviso, y la dio por resuelta 47 minutos más tarde. En total, 65 minutos con el chat dando errores a usuarios de ese plan.

ChatGPT Go es la suscripción de bajo coste de OpenAI: todo lo del plan gratuito más límites más altos en imágenes, subida de archivos y análisis de datos. Según su centro de ayuda, ya se vende en todos los países donde funciona ChatGPT, España incluida.

A las 17:45 se abrió el aviso de los PDF en la Responses API, que es la que usan las empresas para montar sus propias herramientas encima de los modelos de OpenAI. Con estos dos, la página de estado suma dieciséis incidencias entre el 29 de septiembre y el 6 de octubre.

Puntos clave

  • Siete incidencias abiertas entre las 09:03 del lunes y las 04:41 del martes.
  • La más amplia: 36 minutos con errores en cinco componentes de ChatGPT y en lo que OpenAI llama "API rehydration". La mitigación llegó 3 minutos después de abrir el aviso; la recuperación completa, 33 minutos más tarde.
  • La más larga: errores en las conversaciones de ChatGPT desde las 18:58 del lunes, mitigados a las 19:55 y cerrados a las 02:01. Tocó también a FedRAMP, el entorno de OpenAI con la certificación de seguridad que exige la administración federal de Estados Unidos.
  • Catorce incidencias en ocho días, del 29 de septiembre a la madrugada del 6 de octubre. Por la tarde llegaron tres más: 65 minutos de errores en ChatGPT Go, un fallo con los PDF grandes en la API y, a las 19:15, problemas en Computer Use y la Agents API.

Las siete incidencias, una a una

Horas en España, pasadas desde las de la página de estado:

1. Lunes, 09:03. Errores en el modo Work de ChatGPT y en Codex dentro de la app de escritorio. OpenAI avisó de que las tareas programadas también podían fallar. Mitigado a las 11:50, sigue en vigilancia. 2. Lunes, 14:44. Fallos al guardar y al editar en directo en Pages: algunos usuarios no podían guardar cambios ni volver a conectarse a la sesión de edición. Resuelto a las 15:04. 3. Lunes, 17:50. La consola de administración (Admin Console) va y viene. Mitigado a las 21:33, resuelto a las 23:07. 4. Lunes, 18:58. Tasa de errores elevada en "algunas conversaciones" de ChatGPT. Siete horas abierta de principio a fin. 5. Lunes, 19:58. Errores en Codex Cloud, el agente de programación de OpenAI que trabaja en la nube. Mitigación aplicada a las 20:07, sigue en vigilancia. 6. Martes, 02:40. Errores en el inicio de sesión de la plataforma de la API y en sus APIs de administración. Resuelto a las 03:35. 7. Martes, 04:41. La de los cinco componentes. Mitigada a las 04:44, resuelta a las 05:17.

Lo que más se repite es lo nuevo. Space y Pages, la suite de documentos que OpenAI estrenó en su DevDay del 29 de septiembre (la contamos aquí), sale en dos de las siete. ChatGPT Work o Codex, en tres.

Catorce incidencias en ocho días

La semana pasada ya fue mala. El 29 de septiembre, día del DevDay, OpenAI tuvo 26 componentes de ChatGPT y de la API con errores durante 5 horas y 22 minutos, y el 30 sumó otras dos, una de ellas con la API lenta durante horas (el recuento está en esta pieza).

Después vinieron dos más el 1 de octubre: una con el inicio de sesión, el registro de cuentas y los anuncios, y otra con Pages que se arrastraba desde la madrugada del 30 y no se cerró hasta la 01:44 del día 2, casi 45 horas después. El 2 de octubre, 48 minutos de fallos en el análisis de datos y la creación de archivos dentro de ChatGPT.

Sumado con lo de esta noche: catorce avisos en la página de estado entre el 29 de septiembre y el 6 de octubre.

Hay un detalle de calendario. Tras la caída del 29, OpenAI escribió que publicaría el análisis detallado de la causa "en los próximos 5 días hábiles". Contando desde el martes 29, el quinto día hábil es hoy. A las 10:26 OpenAI volvió a marcar esa incidencia como resuelta, con un mensaje nuevo, pero sin el informe. A las 18:40 seguía sin publicarse.

Qué dicen los análisis de causa anteriores

OpenAI sí publica la causa de buena parte de sus incidencias, y el historial de julio a octubre deja un patrón bastante claro. Casi siempre es un cambio suyo:

  • Una actualización de configuración que el sistema de enrutado interpretó mal.
  • Un cambio de código que metió una incompatibilidad en un servicio de ChatGPT.
  • Dos configuraciones incompatibles aplicadas a la vez durante un despliegue.
  • Un proceso de limpieza automática que quitó un acceso que otro servicio todavía necesitaba.
  • Y alguna de capacidad: no había máquinas suficientes para lo que se pedía, o una actualización de la generación de imágenes disparó el consumo de memoria.

Esto cuadra con una semana de lanzamientos. Cuanto más se despliega, más configuraciones cambian y más cosas pueden romperse. OpenAI no ha relacionado ninguna de las incidencias de estos días con el DevDay, y yo no lo afirmaría sin su informe. Pero el orden de los hechos es ese: primero los anuncios, luego catorce avisos.

Cómo comprobar si ChatGPT está caído

Antes de reiniciar el router o borrar la caché del navegador, mira la fuente oficial:

1. Entra en status.openai.com. Si hay una incidencia abierta aparece arriba, con su estado: investigando, identificado, en vigilancia o resuelto. 2. Mira qué componente marca. No es lo mismo un fallo en Conversations (el chat) que en Login (entrar en la cuenta) o en Image Generation (las imágenes). Si lo tuyo no aparece, el problema puede no ser de OpenAI. 3. Pulsa "Subscribe to updates" para recibir los avisos por correo. Es lo más útil si en tu empresa hay procesos que dependen de ChatGPT o de la API. 4. Para ver qué pasó otros días, status.openai.com/history lista todas las incidencias de los últimos meses, con la hora de apertura y de cierre de cada una.

Por qué importa

Si en tu empresa ChatGPT es ya una herramienta de trabajo diaria, una noche como esta te toca aunque no estuvieras despierto. El aviso del lunes por la mañana decía que las tareas programadas del modo Work podían fallar. Si tienes informes o resúmenes que ChatGPT lanza solo cada mañana, hoy toca comprobar que salieron el lunes.

Lo segundo es tener un plan B montado antes de que haga falta. Ningún proveedor se libra: Claude tuvo su propia caída el 22 de septiembre. Lo que funciona es tener los prompts y las instrucciones importantes guardados fuera de la herramienta, en un documento vuestro, para poder pegarlos en Claude o Gemini en cinco minutos si ChatGPT no responde.

Y si el día del informe de OpenAI llega con algo útil, lo contaremos.

Fuente original: status.openai.com


Relacionado