Coinbase 通过默认开放模型与缓存优化,AI 支出降低近 50% 且 Token 用量持续增长

Coinbase 通过默认开放模型与缓存优化,AI 支出降低近 50% 且 Token 用量持续增长

N
News Editor
2026-06-27 15:01:11
Coinbase CEO Brian Armstrong 详细披露了公司 AI 成本优化的具体策略,涵盖默认模型选择(GLM 5.2、Kimi 2.7 等开放权重模型)、任务路由自动化、缓存感知机制及上下文精简。数据显示,91% 员工从未超过 AI 使用额度,通过上述措施公司 AI 支出降低近 50%,同时 Token 使用量仍保持增长。
CoinbaseAI 成本优化GLM 5.2Kimi 2.7缓存策略模型路由Token 消耗开放权重模型

成本控制核心:从配额限制转向模型与路由优化

Coinbase 首席执行官 Brian Armstrong 近日发文,介绍了公司在 AI 成本优化方面的最新进展。随着 AI 使用量和 Token 消耗持续增长,Armstrong 强调,控制成本的关键并非限制员工使用或频繁发送预算提醒,而是优化默认模型选择、任务路由机制以及缓存策略。他透露,目前公司 91% 的员工从未达到 AI 使用额度上限,因此 Coinbase 并未选择收紧配额,而是通过更低成本的模型方案提升整体效率。

默认模型切换:GLM 5.2 与 Kimi 2.7 成为新主力

Coinbase 正通过内部 LLM 网关尝试将 GLM 5.2、Kimi 2.7 等开放权重模型作为默认选项,同时仍允许工程师根据具体任务需求选择其他模型。在模型路由方面,Coinbase 会对提示词进行预处理,并结合缓存命中率及不同模型的定价情况,将任务自动分配给最合适的模型。Armstrong 认为,规划和推理等复杂任务可能需要前沿模型支持,但执行类任务未必需要调用成本更高的模型。未来,模型选择过程应更多由 AI 自动完成,而非依赖人工决策。

缓存与上下文优化:缓存命中率从 5% 提升至 60%

Armstrong 指出,缓存命中率是影响 AI 成本的重要因素之一。Coinbase 已将缓存感知机制纳入请求流程,以提高历史结果复用率。以 LibreChat 为例,在优化缓存方案后,其缓存命中率已从 5% 提升至 60%。此外,公司要求工程师尽量保持上下文精简,包括切换任务时开启新会话、缩小文件上下文范围以及关闭未使用工具等,以减少不必要的 Token 消耗。据其透露,通过上述措施,Coinbase 已成功将 AI 支出降低近 50%,同时 Token 使用量仍保持增长。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。