Coinbase hat am Donnerstag einen Postmortem veröffentlicht, der die Störung vom 7. Mai auf den gleichzeitigen Ausfall mehrerer Kühleinheiten innerhalb einer AWS-Verfügbarkeitszone us-east-1 zurückführt. Das thermische Ereignis löste Serverabschaltungen durch Überhitzung aus und legte Handel, Ein- und Auszahlungen sowie weitere Kerndienste für rund acht Stunden lahm, wobei die vollständige Wiederherstellung etwa zwölf Stunden dauerte.
Die Börse erklärte, der Vorfall habe Lücken in ihrem Failover- und Disaster-Recovery-Setup offengelegt. Ihre Matching-Engine war an die ausgefallene Zone gebunden, und ein stiller Fehler im verwalteten Kafka-Service von AWS verzögerte die Wiederherstellung. Coinbase' Antwort: die regionale Redundanz stärken, Kafka von zwei Verfügbarkeitszonen auf drei erweitern und die Resilienztests für die latenzarme Börseninfrastruktur hochfahren.
Warum das wichtig ist
Ausfälle zentralisierter Börsen sind nicht neu, aber der konkrete Fehlermodus ist aufschlussreich. Dass eine einzige AWS-Zone Handel und On-/Off-Ramps des größten US-börsennotierten Handelsplatzes lahmlegt, zeigt, wie konzentriert die Krypto-Marktinfrastruktur weiterhin auf wenigen Hyperscaler-Regionen ist. Die harte Abhängigkeit der Matching-Engine von einer Zone und ein stiller Kafka-Fehler, der verschleierte, was vor sich ging, sind ein klassisches Problem einer Single-Region-Architektur.
Marktauswirkungen
Acht Stunden Ausfall bei Coinbase bewegen Token-Preise nicht direkt, aber sie verstärken den Reputationsdruck auf zentralisierte Handelsplätze, die Rund-um-die-Uhr-Verfügbarkeit als Feature verkaufen. Coinbase' Bekenntnis zu Kafka über drei Zonen und breiterer regionaler Redundanz liest sich aus Sicht institutioneller Desks, die Kontrahentenrisiken beobachten, genau richtig; der Lackmustest ist, ob der nächste AWS-Vorfall in Minuten statt Stunden eingedämmt wird.
Quelle: [A postmortem of our May 7, 2026 outage](https://www.coinbase.com/zh-cn/blog/a-postmortem-of-our-may-7-2026-outage)
Häufig gestellte Fragen
-
Warum ist die Kafka-Änderung die strukturelle Lösung?
Coinbase erklärte, ein stiller Fehler im verwalteten Kafka-Service von AWS habe während des Ausfalls verschleiert, was geschah, und die Wiederherstellung verzögert. Kafka über drei Verfügbarkeitszonen statt zwei zu betreiben, soll das Event-Streaming am Laufen halten, wenn eine einzelne AWS-Zone ausfällt.