Сбой в работе Amazon Web Services парализовал популярные сервисы
20 октября 2025 года Amazon Web Services (AWS), крупнейший облачный провайдер в мире, пережил значительный сбой, который повлиял на работу множества популярных сайтов и приложений по всему миру. Пострадали такие платформы, как Zoom, Signal, Snapchat, WhatsApp, а также игровые сервисы Roblox и Fortnite. Финансовые учреждения, включая Lloyds и Bank of Scotland, также оказались в числе пострадавших. Причиной инцидента стала ошибка в системе управления DNS, которая обслуживает базу данных DynamoDB в регионе US-EAST-1 (Северная Вирджиния). Две автоматические программы, отвечающие за обновление DNS-записей, одновременно изменили адреса серверов без синхронизации своих действий. Это привело к перезаписи обновленных записей старыми данными и удалению последних, что обнуление адресов серверов. Инженерам AWS потребовалось около 15 часов для ручного восстановления системы. К 21 октября основные сервисы были восстановлены, однако отдельные процессы продолжали испытывать нагрузку. Инцидент вновь подчеркнул важность распределения нагрузки и децентрализации сервисов для повышения отказоустойчивости в облачных инфраструктурах.
Вопрос-ответ
Какий инцидент произошёл и какие сервисы пострадали?
AWS вызвал серьёзный сбой в работе DNS-системы региона US-EAST-1, что повлияло на доступность множества сайтов и приложений, включая Zoom, Signal, Snapchat, WhatsApp, Roblox и Fortnite, а также финансовые учреждения Lloyds и Bank of Scotland.
Какова причина сбоя?
Причина — сбой в системе управления DNS из-за одновременного обновления DNS-записей двумя автоматическими программами без координации, что привело к перезаписи обновленных записей старыми данными и удалению последних записей.
Как долго длилась восстановительная работа и каковы результаты?
Инженерам AWS понадобилось около 15 часов на ручное восстановление системы. К 21 октября основные сервисы вернулись к нормальной работе, хотя отдельные процессы продолжали испытывать повышенную нагрузку.