Причина сбоя в работе Amazon Web Services

Компания Amazon раскрыла детали многочасового сбоя в своих облачных сервисах Amazon Web Services. Причиной инцидента стали неполадки с DNS-серверами DynamoDB, вызванные ошибкой в программном обеспечении автоматизации. В результате два процесса одновременно изменили адреса серверов и случайно удалили корректные данные без возможности автоматического восстановления.

Сбой затронул более 110 сервисов AWS и десятки тысяч клиентов по всему миру, продлившись около 15 часов. Среди пострадавших оказались такие популярные платформы, как Airtable, Canva, Signal и многие другие.

Инцидент произошёл 20 октября 2025 года в центре обработки данных AWS в Северной Вирджинии. В Amazon объяснили, что проблема возникла из-за конфликта между двумя автоматическими системами, которые обновляли адреса DNS. В результате одна из систем перезаписала новые данные старыми, что привело к удалению ключевых DNS-записей и временной недоступности DynamoDB.

Инженеры компании временно отключили автоматизацию DNS для локализации проблемы и пообещали улучшить контроль и алгоритмы, чтобы предотвратить подобные инциденты в будущем. Amazon принесла извинения клиентам за причинённые неудобства и подтвердила свою приверженность высокому уровню доступности своих услуг.