A Coinbase publicou na quinta-feira uma análise pós-incidente que aponta a interrupção de 7 de maio como resultado de uma falha simultânea de várias unidades de arrefecimento dentro de uma zona de disponibilidade us-east-1 da AWS. O evento térmico provocou o encerramento de servidores por sobreaquecimento e tirou do ar a negociação, os depósitos, os levantamentos e outros serviços centrais durante cerca de oito horas, com a recuperação completa a demorar aproximadamente doze.
A exchange afirmou que o incidente expôs lacunas na sua configuração de failover e recuperação de desastres. O motor de matching estava confinado à zona afetada, e uma falha silenciosa dentro do serviço Kafka gerido da AWS atrasou a recuperação. A resposta da Coinbase: reforçar a redundância regional, expandir o Kafka de duas zonas de disponibilidade para três e intensificar os testes de resiliência para a infraestrutura de negociação de baixa latência.
Porquê é relevante
As interrupções em exchanges centralizadas não são novidade, mas o modo de falha específico é instrutivo. Uma única zona da AWS a derrubar a negociação e as rampas de entrada e saída na maior plataforma cotada nos EUA evidencia o quão concentrada permanece a infraestrutura do mercado cripto em algumas regiões de hyperscalers. A dependência rígida do motor de matching de uma única zona, e uma falha silenciosa do Kafka que ocultou o que estava a acontecer, é um problema clássico de arquitetura de região única.
Impacto no mercado
Oito horas de indisponibilidade na Coinbase não movem diretamente os preços dos tokens, mas acentuam a pressão reputacional sobre as plataformas centralizadas que apresentam a disponibilidade 24/7 como argumento de venda. O compromisso da Coinbase com Kafka em três zonas e uma redundância regional mais ampla é a leitura correta para as mesas institucionais que acompanham o risco de contraparte; o teste será saber se o próximo incidente da AWS fica contido em minutos e não em horas.
Fonte: [A postmortem of our May 7, 2026 outage](https://www.coinbase.com/zh-cn/blog/a-postmortem-of-our-may-7-2026-outage)
Perguntas frequentes
-
Porque é que a mudança no Kafka é a correção estrutural?
A Coinbase afirmou que uma falha silenciosa no serviço Kafka gerido da AWS ocultou o que estava a acontecer durante a interrupção e atrasou a recuperação. Operar o Kafka em três zonas de disponibilidade em vez de duas visa manter o streaming de eventos ativo quando uma única zona da AWS falha.