ChatGPT, Claude und Grok gleichzeitig down: Was am 3. September geschah

Avatar
Lisa Ernst · 05.09.2026 · KI-Nachrichten · 10 Min.

Am 3. September 2026 meldeten ausgerechnet drei der bekanntesten KI-Dienste nahezu gleichzeitig Probleme: ChatGPT von OpenAI, Claude von Anthropic und Grok von SpaceXAI. Für Nutzer sah das wie ein gemeinsamer ChatGPT-Claude-Grok-Ausfall aus. International wurde das Ereignis entsprechend häufig mit Suchanfragen wie „chatgpt claude grok outage“ beschrieben.

Die zeitliche Überschneidung ist bestätigt. Eine einzige gemeinsame Ursache ist es dagegen nicht. OpenAI nannte einen eigenen Routing-Fehler, SpaceXAI verwies bei Grok auf einen Ausfall seines Rechenzentrums in Memphis, und Anthropic sprach von einem Infrastrukturproblem, ohne öffentlich denselben konkreten Auslöser zu benennen. Genau diese Trennung ist wichtig, wenn man verstehen will, was an diesem Donnerstag tatsächlich passiert ist.

Kurz & knapp

ChatGPT-Claude-Grok-Ausfall: Die bestätigte Timeline

Die Statusmeldungen zeigen, wie eng die Ereignisse zeitlich beieinanderlagen. Die folgende Übersicht verwendet UTC und rechnet zusätzlich in Mitteleuropäische Sommerzeit (MESZ, UTC+2) um. Bei OpenAI stimmen die von einem Sprecher genannten Start- und Mitigationszeiten mit den Einträgen der Statusseite überein.

Zeit Dienst Bestätigtes Ereignis
12:37 UTC / 14:37 MESZ Claude Anthropic untersucht zunächst separat erhöhte Fehlerraten bei Claude Sonnet 5.
12:56 UTC / 14:56 MESZ Claude Der separate Sonnet-5-Vorfall wird als gelöst markiert.
13:26 UTC / 15:26 MESZ Claude Eine neue, breitere Störung mehrerer Claude-Modelle wird untersucht.
13:30 UTC / 15:30 MESZ Grok xAI meldet einen Modellausfall bei Grok Web und beginnt mit der Untersuchung.
14:43 UTC / 16:43 MESZ ChatGPT Laut OpenAI beginnt ein Routing-Fehler, der ChatGPT und Codex für einige Nutzer beeinträchtigt.
15:17 UTC / 17:17 MESZ ChatGPT OpenAI hat eine Gegenmaßnahme eingespielt und überwacht die Erholung.
16:06 UTC / 18:06 MESZ Claude Anthropic meldet, dass ein Fix ausgerollt wurde und die Erholung überwacht wird.
16:16 UTC / 18:16 MESZ Claude Anthropic setzt das Ende der Auswirkungen auf 16:16 UTC.
16:55 UTC / 18:55 MESZ ChatGPT Die OpenAI-Statusseite markiert den Vorfall als gelöst.
17:07 UTC / 19:07 MESZ Grok xAI meldet wieder gesunden Traffic. Die offizielle Dauer beträgt 3 Stunden und 37 Minuten.

Damit überschnitten sich die offiziell gemeldeten Incident-Fenster von ChatGPT, Claude und Grok rund 93 Minuten lang, von 14:43 bis 16:16 UTC. Das bedeutet jedoch nicht, dass jeder Nutzer während dieses gesamten Zeitraums bei allen drei Diensten gleichzeitig einen Totalausfall sah. OpenAI hatte seine Mitigation bereits um 15:17 UTC aktiviert, und Statusseiten bilden aggregierte Verfügbarkeit ab.

Was bei ChatGPT passierte

OpenAI bezeichnete den Vorfall auf seiner Statusseite als „Elevated errors across ChatGPT and Codex“. Betroffen waren dort 15 ChatGPT-Komponenten und vier Codex-Komponenten. Gegenüber Medien erklärte OpenAI, ein Routing-Fehler habe ab etwa 7:43 Uhr Pacific Time, also 14:43 UTC, dafür gesorgt, dass ChatGPT und Codex für manche Nutzer über mehrere Plattformen hinweg nicht verfügbar waren.

Ab ungefähr 15:17 UTC war eine Gegenmaßnahme aktiv. OpenAI wechselte anschließend in die Monitoring-Phase und markierte den Incident später als gelöst. Für einzelne Codex-Remote-Control-Nutzer gab es noch eine konkrete Nachwirkung: Sie mussten ihr mobiles Gerät nach dem Incident möglicherweise erneut koppeln.

Ein Routing-Fehler muss dabei nicht bedeuten, dass die eigentlichen KI-Modelle ausgefallen sind. Vereinfacht gesagt kann die Infrastruktur, die eingehende Anfragen zum richtigen Dienst, Cluster oder Backend weiterleitet, fehlerhaft arbeiten. Für den Anwender ist das Ergebnis trotzdem dasselbe: Anfragen scheitern, hängen oder der Dienst wirkt komplett offline.

Was bei Claude passierte

Claude-Logo auf weißem Hintergrund

Quelle: thesvg.org

Anthropic meldete am 3. September zunächst einen kurzen Sonnet-5-Vorfall und anschließend eine breitere Störung mehrerer Claude-Modelle.

Bei Anthropic war die Lage etwas komplexer. Ein erster Incident mit erhöhten Fehlern bei Claude Sonnet 5 begann um 12:37 UTC und war um 12:56 UTC bereits wieder gelöst. Nur eine halbe Stunde später eröffnete Anthropic einen neuen Incident wegen erhöhter Fehlerraten bei Claude Mythos 5.1, Claude Fable 5.1 und Claude Opus 5.

Später veröffentlichte Anthropic eine breitere Liste betroffener Modelle, darunter Mythos/Fable 5.1, Mythos/Fable 5, Opus 5, Opus 4.8 und Opus 4.6. Um 13:41 UTC meldete die Statusseite, die Ursache sei identifiziert; um 16:06 UTC war ein Fix ausgerollt. Die Auswirkungen endeten laut Anthropic um 16:16 UTC.

Gegenüber The Register bezeichnete Anthropic den Vorgang als Infrastrukturproblem, das zeitweise Claude.ai, Claude Code, Claude Cowork und die Claude API beeinträchtigte. Eine detaillierte technische Post-Mortem-Erklärung, die den Ausfall eindeutig einem bestimmten externen Rechenzentrum oder Cloud-Anbieter zuordnet, veröffentlichte Anthropic zu diesem Zeitpunkt nicht.

Was bei Grok passierte

Grok-Logo auf weißem Hintergrund

Quelle: thesvg.org

Die offizielle Grok-Statusseite dokumentiert den Ausfall von 13:30 bis 17:07 UTC und damit eine Dauer von 3 Stunden und 37 Minuten.

xAI dokumentiert den Grok-Vorfall am klarsten: Um 13:30 UTC begann die Untersuchung eines „Models outage“ für Grok Web. Um 17:07 UTC meldete die Statusseite, der Traffic sei wieder gesund. Die dort ausgewiesene Dauer beträgt exakt drei Stunden und 37 Minuten.

Die Statusseite selbst nennt keinen Root Cause. SpaceXAI erklärte später öffentlich, die Grok-Probleme seien nach einem Ausfall im Memphis Compute Center aufgetreten. Gleichzeitig entschuldigte sich das Unternehmen auch bei betroffenen Compute-Partnern. Diese zweite Formulierung ist für die Frage nach Claude besonders interessant, weil Anthropic seit Mai 2026 tatsächlich Compute-Kapazität von SpaceX bezieht.

Hingen Claude und Grok über SpaceX zusammen?

xAI-Logo auf weißem Hintergrund

Quelle: models.dev

Anthropic und SpaceXAI bestätigten im Mai 2026 eine große Compute-Partnerschaft rund um Colossus 1. Das macht eine technische Verbindung plausibel, beweist aber nicht die Ursache des Claude-Ausfalls vom 3. September.

Hier liegt der spannendste, aber auch am leichtesten falsch darzustellende Teil der Geschichte. Anthropic gab am 6. Mai 2026 offiziell bekannt, die gesamte Compute-Kapazität des SpaceX-Rechenzentrums Colossus 1 nutzen zu wollen. Nach Angaben beider Unternehmen umfasst die Anlage mehr als 220.000 Nvidia-GPUs; Anthropic sprach von mehr als 300 Megawatt zusätzlicher Kapazität.

Anthropic betreibt Claude allerdings nicht ausschließlich auf dieser Infrastruktur. Das Unternehmen nennt auch AWS Trainium, Google TPUs und Nvidia-GPUs aus weiteren Partnerschaften. Aus der Compute-Vereinbarung folgt daher nicht automatisch, dass jede Claude-Anfrage über Colossus 1 läuft oder dass ein dortiger Ausfall zwingend Claude treffen muss.

Dass SpaceXAI sich nach dem Memphis-Ausfall ausdrücklich bei „Compute-Partnern“ entschuldigte und Anthropic ein öffentlich bestätigter Compute-Partner ist, macht einen Zusammenhang plausibel. Er ist aber bislang nicht bestätigt. Anthropic selbst hat den Ausfall vom 3. September nicht öffentlich auf SpaceX, Memphis oder Colossus 1 zurückgeführt. Aus einer plausiblen Infrastrukturverbindung darf deshalb keine bestätigte Root-Cause-Aussage werden.

War Cloudflare oder eine große Cloud-Plattform schuld?

Die fast zeitgleichen Probleme ließen zunächst an einen gemeinsamen Drittanbieter denken: Cloudflare, AWS, Google Cloud oder Microsoft Azure wären typische Kandidaten, wenn mehrere große Onlinedienste gleichzeitig ausfallen. Genau dafür gibt es jedoch keine belastbare Bestätigung.

The Register berichtete, Cloudflare habe ausdrücklich erklärt, zu diesem Zeitpunkt keine signifikante Störung zu haben. Auch die öffentlichen Statusseiten von AWS, Google Cloud und Microsoft Azure zeigten laut dem Bericht keine passende großflächige Störung. Das ist kein mathematischer Beweis dafür, dass keinerlei gemeinsame Abhängigkeit existierte: Statusseiten können verzögert reagieren und große Anbieter teilen viele kleinere Netzwerk-, DNS-, Hardware- und Transit-Abhängigkeiten. Aber die verfügbaren Belege stützen keinen einzelnen globalen Cloud-Ausfall als Erklärung für alle drei KI-Dienste.

Warum wirkte es trotzdem wie ein gemeinsamer Mega-Ausfall?

Aus Sicht eines Nutzers war die Wahrnehmung nachvollziehbar. Wer ChatGPT öffnete, einen Fehler bekam, zu Claude wechselte und dort ebenfalls Probleme sah, bevor auch Grok versagte, hatte praktisch drei unabhängige Fallbacks verloren. Dazu kommt, dass die größten KI-Anbieter auf sehr konzentrierte Infrastruktur angewiesen sind: wenige GPU-Typen, wenige Hyperscaler, große Rechenzentren, globale Netzwerke und zahlreiche gemeinsame Internet-Bausteine.

Genau hier muss man zwischen Korrelation und Kausalität unterscheiden. Das gleiche Zeitfenster ist ein starkes Signal, nach gemeinsamen Abhängigkeiten zu suchen. Es ist aber kein Beweis dafür, dass alle Störungen denselben technischen Ursprung hatten. Stand 5. September 2026 sprechen die öffentlichen Informationen eher für mindestens zwei klar unterscheidbare Ursachen: OpenAIs Routing-Fehler und den Memphis-Ausfall bei SpaceXAI. Bei Anthropic bleibt die konkrete Ursache oberhalb der Beschreibung „Infrastrukturproblem“ öffentlich offen.

Was Unternehmen aus dem Dreifach-Ausfall lernen sollten

Für Unternehmen, die KI in produktive Abläufe eingebaut haben, ist der Vorfall wichtiger als die Frage, welcher Chatbot an diesem Tag am längsten offline war. Er zeigt, dass ein vermeintliches Multi-Provider-Setup nicht automatisch echte Ausfallsicherheit bedeutet.

Das gilt besonders für persistente KI-Agenten, die selbstständig über längere Zeit arbeiten. Unser Überblick zum Grok Bot und seinen Always-on-Workflows zeigt, warum bei solchen Systemen nicht nur Modellqualität, sondern auch Wiederanlauf, Berechtigungen und kontrollierte Ausführung wichtig werden.

Was tun, wenn ChatGPT, Claude und Grok erneut gleichzeitig ausfallen?

  1. Offizielle Statusseiten prüfen. Für OpenAI ist das status.openai.com, für Claude status.claude.com und für Grok status.x.ai.
  2. Nicht sofort lokale Einstellungen ändern. Wenn der Anbieter selbst einen Incident bestätigt, helfen Browser-Neuinstallation, Passwortwechsel oder Router-Reset normalerweise nicht.
  3. Bei API-Workloads Fehler sauber abfangen. 5xx-Fehler und Timeouts sollten protokolliert, begrenzt wiederholt und bei Bedarf in eine Queue verschoben werden.
  4. Fallback-Anbieter separat testen. Ein Health-Check sollte vor dem Umschalten bestätigen, dass der Ersatzdienst wirklich erreichbar ist.
  5. Zwischenstände lokal sichern. Lange Eingaben, Analysen oder generierte Resultate sollten außerhalb des Chats gespeichert werden, bevor weitere Versuche gestartet werden.
  6. Nur bei unauffälligen Statusseiten lokal suchen. Erst wenn kein Anbieterproblem sichtbar ist, sind Firmen-Firewall, DNS, VPN, Browser-Erweiterungen oder das eigene Netzwerk die wahrscheinlichere Fehlerquelle.

FAQ

Waren ChatGPT, Claude und Grok am 3. September 2026 wirklich gleichzeitig down?

Ja, ihre offiziell gemeldeten Incident-Zeiträume überschnitten sich. Claude meldete die breitere Störung ab 13:26 UTC, Grok ab 13:30 UTC und OpenAI datierte seinen Routing-Fehler auf etwa 14:43 UTC. Bis mindestens 16:16 UTC waren alle drei Vorfälle noch innerhalb ihrer dokumentierten Incident-Fenster. Das bedeutet aber nicht, dass jeder Nutzer während der gesamten Überschneidung einen vollständigen Ausfall erlebte.

Gab es eine gemeinsame Ursache für den ChatGPT-, Claude- und Grok-Ausfall?

Eine gemeinsame Ursache ist nicht bestätigt. OpenAI nannte einen Routing-Fehler. SpaceXAI führte Groks Probleme auf einen Ausfall im Memphis Compute Center zurück. Anthropic sprach von einem Infrastrukturproblem, veröffentlichte aber keine eindeutige Zuordnung zu derselben Ursache.

War Cloudflare am 3. September schuld?

Dafür gibt es keine belastbare Bestätigung. Cloudflare erklärte gegenüber The Register, seine Dienste hätten normal funktioniert und es gebe keine signifikante Störung. Auch bei AWS, Google Cloud und Microsoft Azure war auf den öffentlichen Statusseiten kein passender Großausfall erkennbar.

Hat der SpaceX-Ausfall Claude betroffen?

Das ist möglich, aber nicht bestätigt. Anthropic nutzt seit Mai 2026 Compute-Kapazität von SpaceXAI und hat Zugriff auf Colossus 1. SpaceXAI entschuldigte sich nach dem Memphis-Vorfall auch bei betroffenen Compute-Partnern. Anthropic selbst hat den Claude-Ausfall vom 3. September jedoch nicht öffentlich auf SpaceX oder Colossus 1 zurückgeführt.

Wie lange dauerte der Grok-Ausfall?

Die offizielle Grok-Statusseite nennt für den Incident vom 3. September 2026 eine Dauer von drei Stunden und 37 Minuten. Die Untersuchung begann um 13:30 UTC und der Traffic wurde um 17:07 UTC wieder als gesund gemeldet.

Was bedeutet ein Routing-Fehler bei ChatGPT?

Routing entscheidet vereinfacht gesagt, wohin eine eingehende Anfrage innerhalb einer verteilten Plattform weitergeleitet wird. Wenn diese Schicht fehlerhaft arbeitet, können Anfragen das richtige Backend nicht zuverlässig erreichen. Nutzer sehen dann Timeouts, Fehler oder Nichterreichbarkeit, obwohl nicht zwingend das KI-Modell selbst defekt ist.

Fazit

Der ungewöhnliche Teil des 3. September 2026 ist nicht erfunden: ChatGPT, Claude und Grok hatten tatsächlich überlappende Ausfälle. Die Schlagzeile „alle drei gleichzeitig down“ beschreibt die Nutzererfahrung also grundsätzlich korrekt. Sie sollte aber nicht zu der Schlussfolgerung verleiten, es habe einen einzigen bestätigten Mega-Ausfall im Hintergrund gegeben.

OpenAI hat einen Routing-Fehler als Ursache seines Problems benannt. SpaceXAI verwies für Grok auf das Memphis Compute Center. Anthropic bestätigte ein Infrastrukturproblem, ließ die konkrete zugrunde liegende Abhängigkeit aber öffentlich offen. Die bestehende Anthropic-SpaceX-Compute-Partnerschaft macht eine Verbindung zwischen Claude und Grok technisch denkbar; ohne Bestätigung von Anthropic bleibt sie eine begründete Hypothese und keine feststehende Tatsache.

Teilen Sie doch unseren Beitrag!
Quellen