事件回顾:两天内两次停机
6 月 25 日和 26 日,Base 主网连续发生两次区块生产中断,分别持续约 116 分钟和 20 分钟。官方事后复盘报告称,这两次中断均未影响链上资产安全,用户资金始终可用。然而,在中断期间,网络出现了区块生产完全停止、交易无法上链、mempool 拥堵等问题,用户提交的 eth_sendRawTransaction 请求持续返回错误。
故障根因:序列器状态管理 Bug
Base 团队将故障的核心原因锁定为序列器(sequencer)的区块构建逻辑缺陷。具体来说,在一次交易执行失败后,系统未能正确清理历史 journal 状态,导致后续合法交易在执行时发生 gas 计算异常,从而生成无效的状态转移区块,最终致使整条 L2 网络停止出块。这一 Bug 属于典型的状态管理漏洞,在以太坊 L2 架构中较为罕见,但一旦触发影响巨大。
值得注意的是,序列器集群在重启过程中存在引擎重置的竞态条件(race condition),这导致了恢复同步受阻,也成为次日(26 日)再次出现短暂停机的间接原因。Base 团队随后紧急发布了补丁(PR #3806)修复了该问题,才使区块生产恢复正常。
后续改进:强化测试与优雅恢复机制
Base 在复盘报告中着重强调了后续的改进方向。首先,将重点强化协议级模糊测试(fuzz testing)与压力测试能力,以更早发现异常的交易路径边界情况。其次,升级监控与运维体系,引入更高的可观测性。最后,计划引入更「优雅的恢复机制」(graceful recovery),确保在类似故障发生时,网络能够快速自动恢复,减少用户影响。
此次事件虽然短暂,但暴露了 L2 序列器在状态一致性和错误处理方面的薄弱环节。对于其他采用类似架构的 L2 网络而言,这也是一个重要的警示:状态清理逻辑和重启竞态条件同样需要纳入测试覆盖范围。Base 作为 Coinbase 旗下的主流 L2,其稳定性对生态影响深远,本次快速响应和透明复盘也值得行业借鉴。

