Coinbase 发布 7 月 14 日服务中断事件复盘报告称,此次事故由一次例行配置更新引发的关键网络组件错误配置导致,影响持续约 50 分钟,期间用户资金始终安全。
Coinbase 表示,北京时间 7 月 14 日 12:34(美国东部时间 12:34),公司向承载核心基础设施服务的共享生产 Kubernetes 集群部署了一项例行配置变更。该更新原本用于迁移至新的服务部署模式,以提升系统性能和可靠性。
资源名称冲突未被预生产环境发现
根据复盘报告,由于资源名称冲突未被预生产环境检测机制发现,此次配置修改意外影响了集群中 Istio 入口网关(Ingress Gateway)相关 Kubernetes 资源,导致该网络组件不可用。
约 3 分钟后,集群所有入站流量中断,内部服务因此无法访问多个基础设施组件。Coinbase 指出,大量异步工作流依赖这些基础设施服务,包括交易结算、资金转账和银行卡交易授权,因此多个业务线受到波及。
受影响服务覆盖零售、机构与开发者业务
Coinbase 列出的受影响服务包括:
- 零售用户无法完成链外交易、充值和提现,部分处理中交易显示卡住,并在服务恢复后完成;
- Coinbase Card 借记卡交易暂时失败,信用卡支付未受影响,但部分卡片管理功能不可用;
- Coinbase DEX 在 Base 和 Solana 上的链上兑换服务暂停;
- Coinbase Exchange 和 Prime 机构客户出现转账及结算失败或延迟;
- Coinbase Developer Platform 客户无法完成开户、资金转移及入金服务。
入口网关恢复后开始处理积压任务
Coinbase 表示,入口网关于美国东部时间 13:20 恢复,事件于 13:23 得到缓解。随后系统开始处理积压任务,大部分服务很快恢复正常,剩余队列在之后数小时内完成处理。
恢复过程暴露两项额外问题
在恢复过程中,Coinbase 遇到了两项额外挑战。第一,部署工具本身依赖受影响的入口网关运行,导致常规回滚流程无法执行,形成“故障影响修复工具”的循环依赖。第二,紧急恢复流程(break-glass access)虽然有效,但权限验证和人工审核流程增加了恢复时间。
Coinbase 表示,此次事件未涉及资产安全风险,但也暴露出大型金融基础设施在自动化部署、系统依赖和灾难恢复机制方面仍需持续优化。公司称,后续将继续加强系统韧性建设,以降低类似事件再次发生的概率。

