Claude Opus 4.7正式发布:编码能力飙升10.9分,1M上下文未涨价

Claude Opus 4.7正式发布:编码能力飙升10.9分,1M上下文未涨价

N
News Editor 01
2026-07-23 08:40:15
Anthropic于4月16日推出Claude Opus 4.7,编码性能在SWE-bench Pro上提升至64.3%,视觉分辨率扩大三倍,1M token上下文保持原价。但API移除采样参数、改为自适应思考,引发开发者强烈不满。
ClaudeAnthropicAI大模型编码

Anthropic在4月16日将Claude Opus 4.7推向API、Amazon Bedrock、Google Cloud Vertex AI和Microsoft Foundry四大云平台,GitHub Copilot Pro+、Business、Enterprise用户同步收到更新。这是当前公开可用的最强模型,定位在内部更强大的Mythos之下,后者因零日漏洞发现能力被判定为国家安全风险,仅限联邦机构使用。

三大核心升级:编码、视觉、上下文

编码能力是最显著的提升点。Opus 4.7在SWE-bench Pro上达到64.3%,比前代4.6的53.4%高出10.9个百分点,超越GPT-5.4的57.7%和Gemini 3.1 Pro的54.2%。SWE-bench Verified从80.8%升至87.6%,CursorBench从58%升至70%。多步agent工作流改进约14%,tool使用错误降至原来的约三分之一。视觉方面,Opus 4.7首次支持高分辨率图像,最大2576px/3.75MP,是4.6的三倍,相关基准提升13%。上下文窗口从200K扩至1M tokens,且不收取长上下文溢价,输入/输出定价仍为$5/$25 per million tokens,配合128K max输出,长代码库分析无需分块处理。

API改动:xhigh等级、自适应思考、采样参数消失

API改动是争议焦点。新增xhigh(extra high)effort等级,适用高强度但不需max推理的场景。同时新增/ultrareview指令用于深度代码审查。Extended Thinking被改为adaptive thinking模式,模型自行决定是否思考及思考时长,此前通过budget_tokens固定思考量的设计被移除,报400错误。更关键的是,temperature、top_p、top_k三个采样参数全部移除,这直接破坏了依赖结构化输出和确定性测试的开发流程。此外,模型内置了网络安全检测功能,自动拦截标记为禁止或高风险网安用途的请求。

用户实测体验与社群反应

实际使用中,跨8个文件的重构任务,4.7能一次完成并同步修改测试文件,成功率从60%升至75-85%。多轮agent工作流中tool调用错误显著减少。视觉任务上,截图识别缩进、括号配对、语法高亮颜色均更准确,PDF表格数字识别从75%提至约90%。但文字创作、竞赛级数学推理没有明显进步,对话语气更严格遵循指令,减少了“脑补”倾向。社群主要抱怨三点:新tokenizer导致实际账单高出30-35%;采样参数消失迫使测试套件重写;adaptive thinking变成黑箱,思考链不默认返回且需opt-in。Anthropic内部数据显示adaptive平均胜率更高,但高阶用户更看重可预测性。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
400

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。