Wie zaterdagnacht nog even met Codex aan het werk was, zag de programmeerassistent van OpenAI rond 00.44 uur opeens stoppen. De desktop-app van ChatGPT, de terminalversie Codex CLI, de VS Code-extensie en de webversie gaven ruim een uur dezelfde foutmelding: 'unexpected status 401 Unauthorized: Incorrect API key provided'. OpenAI bevestigde om 00.58 uur een storing in Codex en gaf die de hoogste ernst: een volledige uitval van alle vier de onderdelen. Om 01.45 uur meldde het bedrijf dat een oplossing was doorgevoerd, en om 01.54 uur dat alle getroffen diensten volledig hersteld waren.
De foutmelding was extra verwarrend omdat de meeste getroffen gebruikers helemaal geen API-sleutel gebruiken. Codex zit bij de abonnementen ChatGPT Plus, Pro en de zakelijke varianten, en je logt gewoon in met je ChatGPT-account. Toch klaagde de software over een verkeerde sleutel die begint met 'sk-svcacct', een type sleutel voor serviceaccounts dat op de computer van gebruikers nergens is ingesteld. Melders op GitHub concludeerden daarom binnen enkele minuten dat het probleem bij de servers van OpenAI zat en niet bij hun eigen installatie. Op Reddit dachten sommigen eerst dat ze verbannen of gehackt waren, of dat hun gebruikslimiet op was.
De omvang werd snel duidelijk. De eerste melding op het Reddit-forum r/codex, van een gebruiker met de macOS-app, kreeg binnen één minuut tientallen reacties met 'same' en telde na twintig minuten ruim honderd reacties. Uitloggen en opnieuw inloggen, een nieuwe sessie starten of de app bijwerken hielp niemand; meerdere accounts op verschillende netwerken vielen tegelijk uit. Op GitHub verschenen tussen 00.48 en 00.55 uur minstens vijf losse bugmeldingen over dezelfde fout, van gebruikers op macOS, Windows en Linux. Een medewerker van OpenAI reageerde daar om 00.59 uur: het bedrijf is op de hoogte en onderzoekt het probleem.
Storingspagina liep een kwartier achter
Opvallend is hoe lang de officiële storingspagina status.openai.com achterliep. Terwijl de meldingen binnenstroomden, stond daar nog een groen vinkje met de tekst 'We're fully operational'. Reddit-gebruikers deelden die pagina om 00.48 uur hoofdschuddend, en een ander schreef dat je niet kunt opscheppen over klantenservice en tegelijk je statuspagina leeg laten bij een grote storing. Pas om 00.58 uur, een kwartier na de eerste massale meldingen, verscheen het incident 'Issues with Codex' met de status 'Identified'. De gewone chatfunctie van ChatGPT en de API voor ontwikkelaars werkten volgens diezelfde pagina en volgens gebruikers gewoon door; alleen Codex lag eruit.
Wat het voor gebruikers betekende
Voor wie Codex serieus gebruikt, was dit meer dan een hikje. Op Reddit en GitHub beschrijven mensen hoe ze midden in een grote herstructurering van hun code zaten, of in een bewerking over vier databases, en niet wisten in welke staat hun project was achtergebleven. Codex werkt met gebruikslimieten die na een vaste periode opnieuw beginnen, en veel gebruikers hadden hun tegoed net aangesproken toen de storing begon. Zij vragen OpenAI om een extra reset als compensatie voor de verloren tijd. Sommigen grapten dat ze intussen bij concurrent Claude van Anthropic gingen kijken; anderen merkten droog op dat OpenAI zelf ook Codex nodig heeft om Codex te repareren.
Wat er precies mis was, zegt OpenAI niet. Het bedrijf meldde om 01.34 uur dat het de oorzaak had gevonden, zonder die te noemen. Een kwartier eerder had het als tijdelijke omweg genoemd dat inloggen met een API-sleutel de toegang weer vrijgaf, een route die de meeste abonnees niet klaar hebben staan. De GitHub-melding met de meeste technische details wijst naar het moment waarop Codex een lang gesprek automatisch samenvat om ruimte te maken, in het Engels 'remote compaction'. Dat proces draait op de servers van OpenAI en gebruikte daar blijkbaar een serviceaccountsleutel die werd geweigerd. Andere gebruikers zagen de fout echter ook bij gloednieuwe sessies, dus het probleem lijkt breder dan alleen dat samenvatten. Nxt kan de oorzaak niet onafhankelijk vaststellen.
Sinds 01.54 uur werkt Codex volgens OpenAI weer normaal, na een storing van ruim een uur gerekend vanaf de eerste meldingen. Wie vannacht vastliep, kan zijn sessie hervatten; opnieuw inloggen of zelf een sleutel aanmaken was volgens de getroffen gebruikers al die tijd zinloos, want de sleutel in de foutmelding was niet van hen. Over de oorzaak en over compensatie in de vorm van een extra reset van de gebruikslimiet heeft OpenAI nog niets gezegd. Het incident staat met alle tussentijdse updates op de storingspagina van OpenAI.
Verder bij de bron
Lees zelf de onderzoeken, uitleg en aankondigingen achter dit verhaal.
