Ein großflächiger Ausfall infolge von Problemen bei Cloudflare am 18. Nov. 2025 führte zu weitreichenden Störungen im gesamten Internet und unterstrich die Bedeutung von Cyberresilienz für Unternehmen, die auf zentralisierte Infrastruktur angewiesen sind.
Bei Cloudflare kam es zu einer internen Beeinträchtigung des Dienstes, die im gesamten Netzwerk HTTP-500-Fehler auslöste.
Der Ausfall führte weltweit bei Millionen von Nutzern zu teilweisen oder vollständigen Ausfällen und beeinträchtigte ein breites Ökosystem von Plattformen, die auf Cloudflare angewiesen sind, um online zu bleiben.
Cloudflare bestätigte das Problem um 11:48 UTC und meldete zeitweise Dienstprobleme, die Dashboard, API und zentrale Netzwerkfunktionen betrafen.
Um 12:21 UTC vermeldete das Unternehmen erste Anzeichen einer Erholung, obwohl viele Kunden weiterhin erhöhte Fehlerraten verzeichneten.
Erschwerend kam hinzu, dass die Statusseite von Cloudflare während Teilen des Vorfalls nicht erreichbar war, sodass Nutzer keine zeitnahen Updates erhalten konnten.
Schwere Auswirkungen des Ausfalls auf große Plattformen
Der Ausfall breitete sich im globalen Internet aus und beeinträchtigte stark frequentierte Plattformen und aufstrebende Technologien.
Die Social-Media-Plattform X (ehemals Twitter) war erheblich gestört; Tausende Nutzer meldeten Ausfälle sowohl in den mobilen Anwendungen als auch in den Webanwendungen.
KI-gestützte Dienste wie ChatGPT und Perplexity AI zeigten von Cloudflare generierte Fehlerseiten und waren dadurch vorübergehend unbrauchbar.
Auch beliebte digitale Tools — darunter Canva, Spotify, Discord, League of Legends, Shopify, Medium und mehrere Kryptowährungsbörsen — fielen aus, sodass Nutzer auf Alternativen ausweichen oder auf die Wiederherstellung warten mussten.
Die Reichweite des Vorfalls war so groß, dass sogar Downdetector, ein Dienst zur Erfassung von Ausfällen, Probleme meldete und damit die Frustration der Nutzer weiter verstärkte.
Die Situation erinnerte an die jüngsten Ausfälle bei Amazon Web Services und Microsoft Azure im Oktober 2025 und verdeutlichte die mit der Abhängigkeit von einer kleinen Zahl von Cloud-Anbietern verbundenen Schwachstellen.
Diese aufeinanderfolgenden Ausfälle erinnern daran, dass das moderne Internet eng miteinander verflochten ist — und dass Störungen bei einem großen Anbieter weltweit Kaskadeneffekte auslösen können.
Zusätzlich könnten gleichzeitig durchgeführte routinemäßige Wartungsarbeiten in Rechenzentren wie Los Angeles, Atlanta, Santiago und Tahiti die Latenz erhöht haben, da der Datenverkehr umgeleitet wurde.
Cloudflare meldete außerdem ein separates Problem mit seinem Supportportal eines Drittanbieters, das die Möglichkeit einiger Nutzer beeinträchtigte, Supportfälle einzusehen. Die Bearbeitung lief zwar ohne Unterbrechung weiter, doch die Situation erschwerte das Management und die Kommunikation während des Vorfalls zusätzlich.
Lehren für die Cyberresilienz aus dem Ausfall
Obwohl die Störung bei Cloudflare nicht als Cyberangriff gemeldet wird, zeigte der Vorfall, wie schnell Dienstunterbrechungen — ob unerwartet oder nicht — die Geschäftskontinuität beeinträchtigen können.
Unternehmen konzentrieren sich stark auf den Schutz vor böswilligen Bedrohungen, übersehen aber mitunter die Resilienz gegenüber Betriebsausfällen, Fehlkonfigurationen oder Ausfällen von Dienstanbietern.
Der Ausfall bei Cloudflare ist eine wichtige Erinnerung daran, dass Cyberresilienz ebenso sehr die Vorbereitung auf Ausfälle umfasst wie deren Verhinderung.
Ein grundlegendes Prinzip der Cyberresilienz ist Diversifizierung. Viele Unternehmen erlebten Ausfallzeiten, weil ihre Abhängigkeit von Cloudflare absolut war und es keinen Ausweichweg für die DNS-Auflösung, die verteilte Bereitstellung von Inhalten oder Authentifizierungsabläufe gab.
Der Aufbau redundanter DNS-Anbieter, von Multi-CDN-Strategien oder von Ansätzen für eine hybride Cloud kann dazu beitragen, dass einzelne Fehlerquellen nicht zu geschäftskritischen Ausfällen führen.
Ebenso sollten Unternehmen stets aktuelle Pläne zur Reaktion auf Vorfälle (IR-Pläne) vorhalten, die auch Ablaufpläne für Störungen bei Anbietern umfassen, darunter klare Verfahren zur Umleitung und Drosselung des Datenverkehrs oder zur Aktivierung statischer Ausweichseiten, wenn Primärsysteme ausfallen.
Resilienz erfordert zudem Transparenz und Kommunikation. Während des Vorfalls bei Cloudflare ließ die Nichtverfügbarkeit der Statusseite des Anbieters viele Unternehmen über das Ausmaß und die Dauer der Störung im Unklaren.
Unternehmen sollten unabhängige Überwachungs- und Protokollierungssysteme vorhalten, die nicht auf denselben Anbieter angewiesen sind, der für die Bereitstellung ihrer Dienste verantwortlich ist.
Mit diesen Tools können Teams Ausfälle bestätigen, intern kommunizieren und fundierte Entscheidungen treffen, selbst wenn vorgelagerte Dienste nicht verfügbar sind.
Schließlich erfordert Resilienz eine kontinuierliche Überprüfung und Erprobung.
Die regelmäßige Bewertung externer Abhängigkeiten, die Simulation von Ausfallszenarien, die Überprüfung von Failover-Mechanismen und die Sicherstellung der Funktionsfähigkeit von Backup-Systemen können die betrieblichen Auswirkungen von Ausfällen verringern.
Die jüngste Serie von Störungen bei AWS, Azure und Cloudflare zeigt, dass Ausfälle bei großen Anbietern keine hypothetischen Szenarien sind — sie sind unvermeidlich.
Die Fragilität des Internets wird sichtbar
Der weltweite Ausfall bei Cloudflare zeigte sowohl die Verwundbarkeit als auch die Vernetzung des heutigen digitalen Ökosystems.
Obwohl das Unternehmen die Funktionalität schnell wiederherstellte, beeinträchtigte der Vorfall eine Vielzahl von Diensten und erinnerte Unternehmen daran, ihre Strategien für Cyberresilienz zu stärken.
Ein klarer Plan für Notfallwiederherstellung und Geschäftskontinuität ist unerlässlich, um Ausfallzeiten zu minimieren.





