


Ранее в сети Solana произошел 17-часовой простой. Средства пользователей не пострадали, сеть полностью восстановилась менее чем за сутки. Solana спроектирована для работы в сложных условиях, и сообщество за годы создало надежные инструменты и протоколы восстановления. Регулярные учения позволили подготовиться к подобным ситуациям.
Сеть была остановлена из-за атаки типа «отказ в обслуживании» (DoS). Во время запуска IDO боты обрушили на сеть огромный поток транзакций. Это привело к переполнению памяти и сбоям у многих валидаторов, что вызвало резкое замедление и в итоге — полную остановку сети.
Непосредственная причина отключения заключалась в том, что сеть валидаторов не смогла достичь консенсуса по текущему состоянию блокчейна и не могла подтверждать новые блоки. Несмотря на скачок транзакций и падение скорости, первые попытки восстановления оказались неэффективными.
Транзакции переполнили forwarder queue, что вызвало неконтролируемый рост памяти. Транзакции внутри блоков требовали значительных ресурсов для обработки. Совокупность этих факторов привела к автоматическому созданию нескольких форков, после чего процессы валидаторов завершались сбоем из-за нехватки памяти. После перезапуска они не успевали обработать все форки и не могли присоединиться к сети.
После диагностики проблемы сообщество предложило провести хардфорк с последнего подтвержденного слота при консенсусе не менее 80% активного стейка. В течение 14 часов инженеры со всего мира совместно разрабатывали код, координировали обновления и перезапуски более чем 1 000 валидаторов. Весь процесс шел по протоколу перезапуска и проходил под руководством сообщества. Валидаторы локально устанавливали обновления, проверяли реестры и принимали решение о возобновлении работы. Консенсус был достигнут, сеть обновили в течение двух с половиной часов после выпуска патча. Сеть валидаторов полностью восстановила работу менее чем за 18 часов с момента сбоя.
Главное преимущество блокчейна — возможность восстановления после полного сбоя без участия доверенных третьих лиц: валидаторы самостоятельно восстанавливают состояние и продолжают цепочку. В децентрализованных сетях каждый валидатор участвует в восстановлении, а его действия проверяют другие участники. Этот процесс включает совместную работу до достижения 80% консенсуса.
Централизованные сети (например, облачные сервисы) и децентрализованные сети (как Solana) действуют при подобных сбоях совершенно по-разному. При сбое централизованного облака пользователи полагаются на провайдера для восстановления правильного состояния. В блокчейне ответственность и доверие лежат на сообществе. Операторы по всему миру сотрудничают для устранения проблем и восстановления работы сети.
Сбой в сети стал серьезным операционным вызовом, но позволил получить важные знания о надежности и возможностях восстановления децентрализованных блокчейн-сетей. Подобные инциденты редки, но их влияние велико. Решение проблем в децентрализованных сетях — это коллективная работа. Совместные усилия валидаторов, инженеров и всего сообщества Solana в преодолении этой ситуации и полученные уроки помогут сделать сеть еще более устойчивой и надежной.











