返回编码能力

编码能力

DeepSeek
2026-07-19 05:29:24

DeepSeek V4 正式版或将于近期发布,灰度测试与新定价细节流出

DeepSeek V4 正式版被曝最早可能明日上线,目前已有部分用户获得 GA 灰度测试权限,版本分为 V4 Flash 和 V4 Pro。流出的首轮测试显示,外界对其性能评价不一,有开发者称整体表现接近 Opus 4.8 级别、编码接近 GPT-5.6 Sol。与此同时,DeepSeek 计划在 7 月中旬随 GA 上线调整 API 定价,并首次引入“峰谷计费”。

1340
DeepSeek V4 正式版或将于近期发布,灰度测试与新定价细节流出
OpenAI
2026-07-18 15:21:03

GPT-5.6 三模型对决 Fable 5:价格、基准与实测分出不同胜负

OpenAI 这次没有推出带“思考档位”的单一模型,而是将 GPT-5.6 拆分为 Sol、Terra 和 Luna 三个独立模型。Decrypt 的对比把焦点放在 Sol 与 Anthropic 当前最强公开模型 Claude Fable 5 身上:Sol 在多项编码基准、速度和成本上占优,Fable 5 在创意写作与单次生成浏览器游戏的主观测试中更出色。文章还指出,Fable 5 在 6 月被美国政府禁用、7 月 1 日恢复后,多次临时延长订阅访问期限,最新截止日期为 7 月 19 日。

1280
GPT-5.6 三模型对决 Fable 5:价格、基准与实测分出不同胜负
谷歌
2026-07-17 08:22:09

谷歌推迟 Gemini 3.5 Pro 发布,内部目标未达标

彭博社报道称,原定近期上线的 Gemini 3.5 Pro 已被谷歌推迟数月,核心原因是模型在关键能力上、尤其是 AI 编码表现未达到内部标准。围绕这款代号“Cappuccino”的模型,市场此前曾流传其具备 200 万 token 上下文窗口和“Deep Think”模式。消息传出后,谷歌股价一度下跌 4.43%。报道还提到,谷歌内部存在层级复杂、资源分散、算力受限和人才流失等问题。

1650
谷歌推迟 Gemini 3.5 Pro 发布,内部目标未达标
OpenAI
2026-07-13 22:46:04

OpenAI发布 GPT-5.6 提示指南:少写提示词,先定义结果

OpenAI为新旗舰模型 GPT-5.6 Sol 发布最新提示指南,核心建议是不再堆砌冗长系统提示,而是围绕结果、完成标准、停止条件和硬约束来写。该公司称,在内部编码代理测试中,精简提示可让评测分数提升约 10% 至 15%,同时把总 token 降低 41% 至 66%,成本下降 33% 至 67%。新指南还加入 text.verbosity 参数和 Programmatic Tool Calling,用于控制输出长度并把部分流程交给代码处理。

1080
OpenAI发布 GPT-5.6 提示指南:少写提示词,先定义结果