Anthropic2026-09-30 11:03:19Anthropic为Claude Code新增调优指令,客服案例成本降至五分之一Anthropic 于 9 月 28 日宣布,在 Claude Code 的 claude-api skill 中加入 build-eval 与 hillclimb 两个新指令,分别用于建立评测集和按评测结果自动调优 AI 应用。在其内部客服案例中,模型配置从 Opus 4.8 高推理强度逐步调整到 Sonnet 5 低推理强度,未见过的测试工单准确率从 78.6% 提升到 90.5%,单张工单成本则从 4.6 美分降至约 1 美分。Anthropic 还披露了评测设计、过拟合防范和评分器校验的具体方法。20