人工智能公司Anthropic于7月4日正式发布Claude Opus 4.7,自称是其迄今为止最强大的Opus模型。在SWE-bench Multilingual、OfficeQA Pro等多项基准测试中,Opus 4.7以显著优势超越前代及GPT-5.4等竞争对手,尤其在文档推理任务上得分从57.1%跃升至80.6%。然而,该模型也被发现是“Token吞噬怪兽”——其更新的分词器使相同输入消耗约1.0-1.35倍token,且在高强度代理任务中链式思维完全暴露于输出文本,导致单次会话即耗尽用户配额。
性能飞跃:基准测试全面领先
根据Anthropic官方数据,Opus 4.7在编码基准SWE-bench Multilingual上获得80.5%,高于4.6的77.8%;在经济价值评估GDPVal-AA中以1753 Elo超越GPT-5.4的1674;长期连贯性测试Vending-Bench 2模拟余额达到10,937美元,而4.6仅为8,018美元。实际测试中,模型仅需一轮bug修复即可生成逻辑严密、难度平衡的游戏,其程序化生成关卡的能力令评测者印象深刻。
Token消耗:升级代价与加密开发成本
Opus 4.7的token用量远超预期。测试发现,模型在生成完整初稿后,会自动执行“重写”、“二次修复”等多轮自我迭代,且这些输出均计入token。Anthropic官方迁移指南已提醒开发者注意更高消耗,但实际使用仍令人震惊——一位测试者表示“首次见到单次会话耗尽整个token配额”。对于频繁进行智能合约审计、DApp开发或交易策略优化的加密开发者而言,若继续使用Opus 4.7,可能被迫升级订阅、承担高昂API费用,或等待配额重置。相比之下,小米的MiMo v2 Pro等竞品在成本上更具优势,且同样能生成高质量代码。
安全性与Mythos差距
Anthropic刻意削弱了Opus 4.7的网络安全能力,并引入自动防护措施检测高风险请求。安全专业人员可通过新推出的Cyber Verification Program申请完整能力。这与未公开的“Mythos”模型形成鲜明对比——后者据称能自主完成32步企业网络攻击模拟,但仅对经审查的安全企业开放。对于加密生态中的安全团队,Opus 4.7的受限功能可能不足以应对高级威胁分析,但公共版本的稳定运行将帮助Anthropic积累安全防护经验。
市场影响:AI成本攀升或催生替代方案
Opus 4.7的定价维持不变(输入$5/百万token,输出$25/百万token),但实际使用成本因token暴涨而显著增加。对预算敏感的加密初创公司、独立开发者可能转向更经济的模型,如Xiaomi MiMo v2 Pro或Gemini 3.1 Pro。此外,可见的链式思维虽提升透明度,却也带来隐私与合规风险——智能合约代码的中间推理过程若被暴露,可能泄露商业逻辑。总体而言,Opus 4.7是当下最强的公开AI模型,但其高消耗特性要求开发者在性能与成本间做出权衡,或等待Anthropic优化效率。
目前,Opus 4.7已登陆Claude.ai、API、Amazon Bedrock、Google Cloud Vertex AI及Microsoft Foundry。对于追求极致编码能力的加密开发者,它是一把双刃剑:能实现复杂任务,但需准备好为“思考”买单。

