Amazon levou 15 horas para corrigir pane da AWS

Falha crítica na infraestrutura da empresa afetou serviços essenciais de bancos a redes sociais, pondo em xeque a dependência exagerada da nuvem

Por Júnior Mendonça-
3 Min

Foto: Kabir Jhangiani/NurPhoto via Getty Images

A internet global experimentou um dia de caos nesta segunda-feira, após uma pane massiva nos serviços da Amazon Web Services (AWS), a maior provedora de computação em nuvem do mundo.

A falha, concentrada na crucial região de data centers US-EAST-1 (Virgínia do Norte), durou cerca de 15 horas e derrubou mais de 500 aplicativos e sites em diversos setores, desde finanças e jogos até plataformas de e-commerce e comunicação.

Entre os gigantes afetados estavam nomes brasileiros como Mercado Livre e PicPay, além de serviços globais amplamente utilizados, incluindo Snapchat, Fortnite, Duolingo, Canva, Zoom e até mesmo os próprios produtos da Amazon, como a assistente virtual Alexa.

 

DNS e DynamoDB na raiz do problema

Segundo a própria AWS, que monitorou a situação em tempo real, a origem da interrupção foi um problema de resolução de DNS (Domain Name System) que afetou o DynamoDB, um serviço essencial de banco de dados. Em termos simples, a pane impediu que os sistemas da AWS localizassem as informações críticas armazenadas neste banco de dados, o que gerou um efeito dominó e levou à inoperabilidade generalizada.

"É como se grandes partes da internet tivessem sofrido uma amnésia temporária," explicou um especialista em cibersegurança, referindo-se à incapacidade dos aplicativos de encontrarem os dados de que precisavam.

Apesar da complexidade técnica, o problema principal foi mitigado e os serviços foram gradualmente restaurados, com a AWS declarando a normalização total apenas no início da noite de segunda-feira. O incidente, no entanto, marca a terceira pane significativa na mesma região de data centers da AWS desde 2020.

 

Alerta de concentração: a fragilidade da nuvem

O apagão serviu como um severo lembrete da fragilidade da "espinha dorsal" da internet e da gigantesca dependência do mundo em relação a poucos provedores de nuvem.

Com a AWS detendo uma fatia de mercado global de cerca de um terço, a falha em um único hub tem o poder de paralisar operações críticas em todo o planeta, afetando desde a capacidade de estudantes acessarem material didático até transações bancárias.

Analistas do setor de tecnologia alertam que as empresas precisam urgentemente revisar suas estratégias de redundância.

"As companhias que dependem da AWS precisam investir em sistemas de tolerância a falhas e considerar a diversificação de suas infraestruturas para não ficarem reféns de um único ponto de falha," comentou um professor de ciência da computação.

O incidente deve gerar um novo debate sobre a regulamentação desses gigantes da nuvem, especialmente em setores críticos como o financeiro, e forçar as empresas a adotarem medidas de proteção mais robustas.

FONTE: Redação North News