Niemand legt uit waarom OpenAI en Anthropic vandaag uitval hadden

Frontier-modellen van Anthropic, OpenAI en xAI ondervonden donderdagochtend zeldzame storingen, wat leidde tot downtime voor de bijbehorende AI-chatbots. SpaceX, het moederbedrijf van xAI, liet donderdagmiddag weten dat de problemen met Grok het gevolg waren van "een storing in ons rekencentrum in Memphis vanochtend".

De problemen leken aanvankelijk aan elkaar gekoppeld omdat ze gelijktijdig plaatsvonden — mogelijk het resultaat van een gedeelde externe dienstverlener — maar noch OpenAI, noch Anthropic verwees naar een externe bron in reacties aan WIRED op donderdag. SpaceX reageerde niet op een verzoek om commentaar van WIRED, maar verklaarde in publieke berichten: "We willen ook onze getroffen compute-partners onze excuses aanbieden." Anthropic en xAI kondigden in mei een "compute-partnerschap" aan met SpaceX.

Details van de storingen

OpenAI Woordvoerder Kathleen Chaykowski verklaart aan WIRED: "Een routeringsfout die begon rond 7:43 am PT op donderdag 3 september, zorgde ervoor dat ChatGPT en Codex voor sommige gebruikers op verschillende platforms onbeschikbaar waren. Rond 8:17 am PT op donderdag is een oplossing succesvol geïmplementeerd en wordt deze continu gemonitord."

Anthropic Anthropic weigerde commentaar te geven op het incident. Het bedrijf begon donderdag om 6:23 am PT te waarschuwen voor een "gedeeltelijke uitval" waarbij sprake was van "verhoogde fouten bij verzoeken aan Claude Mythos 5.1, Claude Fable 5.1 en Claude Opus 5". Kort daarna meldde het bedrijf dat de oorzaak was geïdentificeerd en dat er een oplossing was uitgerold. Het probleem werd om 9:16 am PT als opgelost gemarkeerd. Claude Sonnet 5 leek kort na 9 am PT soortgelijke problemen te hebben.

xAI xAI rapporteerde Grok-storingen op al haar platforms en diensten beginnend om 6:30 am PT, toen het bedrijf "investigating outage" (storing wordt onderzocht) plaatste op de statuspagina. "Grok ervaart problemen. We werken eraan om de service zo snel mogelijk te herstellen," luidde de melding. Om 10:05 am PT werd het incident als voltooid gemarkeerd: "We hebben de situatie opgelost en het verkeer is weer gezond."

Andere observaties en infrastructuur

Er waren donderdagochtend ook verspreide meldingen van een mogelijke storing bij Google Gemini, maar het bedrijf heeft dit niet bevestigd en er zijn geen incidenten geregistreerd op het statusdashboard. Google reageerde niet op een verzoek om commentaar voorafgaand aan publicatie.

Normaal gesproken zouden meerdere gelijktijdige storingen in dezelfde sector wijzen op problemen bij een cloudprovider, een content delivery network (CDN) of een andere externe leverancier die meerdere klanten beïnvloedt. Echter, OpenAI en Anthropic wezen niet op een mogelijke gedeelde oorzaak, en grote spelers in de internetinfrastructuur — waaronder Cloudflare, Amazon Web Services en Microsoft Azure — rapporteerden donderdag geen storingen.