OpenAI ha convertit ChatGPT, Codex i la seva API en una infraestructura de la qual depenen, segons la mateixa companyia, 900 milions d'usuaris setmanals i uns 10 milions d'usuaris que ja fan servir agents autònoms per executar tasques. Aquesta escala converteix qualsevol interrupció del servei en un fet amb ressò immediat, tant per a usuaris particulars com per a les empreses que hi han integrat processos de negoci.
El dissabte 25 de juliol, ChatGPT, Codex i l'API d'OpenAI van registrar errors elevats de manera simultània arreu del món, amb missatges d'error 503 etiquetats internament com «biscuit_baker_service_me_circuit_open» que impedien que les peticions arribessin als servidors. La companyia va passar d'«investigant» a «monitorant» la incidència en poc més d'una hora, després d'aplicar una mesura pal·liativa. Segons l'historial d'estat de la mateixa OpenAI, va ser el quart incident en quatre dies, després d'episodis similars el 19, el 23 -dues vegades- i el 24 de juliol.
La notícia és rellevant perquè el patró de fallades repetides en una sola setmana posa a prova la fiabilitat d'una infraestructura que cada cop més empreses fan servir per a tasques crítiques a través d'agents autònoms, just en un moment en què OpenAI competeix per demostrar que els seus productes són prou robustos per a un ús empresarial intensiu.
OpenAI no ha explicat públicament la causa arrel comuna -si n'hi ha una- dels quatre incidents, ni ha xifrat l'impacte econòmic o el nombre d'usuaris afectats en cadascun, i no està clar si el patró respon a un problema estructural o a una coincidència d'incidents no relacionats.