La base augmentera les tests après deux pannes de réseau

La base augmentera les tests après deux pannes de réseau

L'équipe de solution de deuxième couche Ethereum Base a publié un rapport sur deux pannes de réseau les 25 et 26 juin. La raison de l'arrêt de la production de blocs s'est avérée être un bug dans la logique du séquenceur.

Après l’échec d’une transaction, le mécanisme enregistrait de manière incorrecte l’état interne du système et finissait par créer un bloc invalide.

Le premier incident a duré 116 minutes, le second 20 minutes. À cette époque, le réseau a cessé d'émettre de nouveaux blocs, les transactions n'étaient pas incluses dans la blockchain et la file d'attente des transactions non confirmées était pleine, ce qui faisait que les utilisateurs recevaient des erreurs lors de l'envoi de nouvelles transactions.

Dans le même temps, l’équipe a souligné que les fonds des utilisateurs n’étaient pas affectés et restaient en sécurité.

Ce qui s'est passé

Selon le rapport, le problème s'est produit après l'échec de l'une des transactions. Le séquenceur n'a pas effacé l'état du journal, ce qui a entraîné un calcul de frais incorrect pour la prochaine transaction valide. Cela a conduit à la formation d'un bloc avec une transition d'état incorrecte, que le reste des nœuds du réseau n'a pas pu accepter. En conséquence, la production de blocs s’est complètement arrêtée.

Après avoir installé le correctif, les développeurs ont rencontré une deuxième erreur : une « condition de concurrence critique » lors du redémarrage d'un cluster de séquenceurs empêchait les nœuds de se synchroniser rapidement. C'est ce problème qui a provoqué une panne répétée et plus courte le lendemain.

Qu’est-ce que Base va changer ?

Après l'incident, l'équipe de la base a promis d'augmenter les tests de résistance et le fuzzing du protocole afin d'identifier de manière proactive les scénarios de traitement des transactions non standard.

En outre, les développeurs ont l'intention d'améliorer la surveillance du réseau et d'introduire un mécanisme de « récupération gracieuse » qui permettra au réseau de reprendre rapidement ses activités après de telles pannes.

Rappelons qu'en février l'équipe Base a annoncé la transition de la pile technologique Optimism vers sa propre architecture réseau unifiée.

Abonnez-vous à ForkLog sur les réseaux sociaux

Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE



Voir l’article original en russe