返回后训练

后训练

智谱AI
2026-08-19 07:28:20

智谱 AI 创始人唐杰:参数规模不再单独决定模型强弱

智谱 AI 创始人、清华大学教授唐杰表示,单独讨论大模型参数量已越来越难判断模型能力。回顾从 GPT-3、Chinchilla 到 MoE 的 Scaling Law 演变后,他提出模型能力还取决于训练数据、训练与推理阶段的算力分配,以及后训练与单次推理的有效深度。智谱最新的 GLM-5.3 被他视为一次控制实验:在不增加参数的前提下,集中扩展长程任务训练与强化学习。

40
智谱 AI 创始人唐杰:参数规模不再单独决定模型强弱
Anthropic
2026-08-16 05:39:00

Anthropic研究员与华尔街投资人公开交锋,AI该集中还是分散

8 月 14 日,Anthropic 研究员 Sholto Douglas 与 Atreides Management 创始人 Gavin Baker 围绕 AI 权力应集中还是分散在 X 上展开争论。导火索是 Baker 转述的一则关于 Anthropic CEO Dario Amodei 的说法,Douglas 予以否认。争论随后转向更核心的问题:AI 安全究竟依赖集中管控,还是依赖市场竞争与开放生态。

100
Anthropic研究员与华尔街投资人公开交锋,AI该集中还是分散
Z.ai
2026-08-14 20:02:10

中国 AI 实验室 Z.ai 发布 GLM-5.3,主打开源权重编程模型

中国 AI 实验室 Z.ai 于周四发布 GLM-5.3,并将其定位为当前市场上最强的开源权重编程模型。该模型已通过 GLM Coding Plan 订阅和 ZCode 上线,API 接入与可下载权重将在安全审查后分阶段开放。Z.ai 称,GLM-5.3 采用 7430 亿参数,在多项编程与网络安全基准上较 GLM-5.2 提升明显,同时以更少输出 token 完成任务,但在部分头部编程榜单上仍落后于美国闭源模型。

120
中国 AI 实验室 Z.ai 发布 GLM-5.3,主打开源权重编程模型
Databricks
2026-08-14 09:45:00

Databricks完成50亿美元融资,DeepSeek Harness v0.1开放测试

PA日报汇总多项加密与科技市场动态。Databricks宣布完成50亿美元战略融资,投后估值达1900亿美元;DeepSeek Harness开发者预览版v0.1面向全球开放测试并以MIT协议开源。当天消息还涉及Tether完成首次全面独立财务审计、摩根大通去年终止与Polymarket银行关系、币安Alpha将上线KiiChain,以及多家加密相关公司财报、ETF资金流向和鲸鱼地址异动。

360
Databricks完成50亿美元融资,DeepSeek Harness v0.1开放测试
Z.ai
2026-08-14 05:52:45

Z.ai发布GLM-5.3:编码基准提升50%,网络安全测试84.5%

Z.ai 发布 GLM-5.3,新模型基于与 GLM-5.2 相同的基础模型,靠扩大后训练实现能力提升。官方称,其内部编码基准 Z.ai Code Bench 得分较 GLM-5.2 提升 50%,在 Terminal Bench 3、Agents' Last Exam 等公开基准中达到开放模型领先水平。网络安全方面,GLM-5.3 在 CyberGym 漏洞发现测试中取得 84.5% 的成绩,并大幅领先前代。

190
Z.ai发布GLM-5.3:编码基准提升50%,网络安全测试84.5%
智谱
2026-08-14 06:02:48

智谱发布GLM-5.3:编码能力提升50%,权重两周后开放

8 月 14 日,Z.ai 发布 GLM-5.3。新模型沿用 GLM-5.2 基础架构,通过扩大后训练提升能力,在内部编码基准 Z.ai Code Bench 上较前代提升 50%,并在 Terminal Bench 3.0、Agents' Last Exam 等公开基准中达到开放模型领先水平。安全评测方面,CyberGym 漏洞发现成绩为 84.5%,利用链相关测试较前代明显改进。模型权重两周后开放,API 不再支持关闭思考模式,提供 low、high、max 三档推理强度。

240
智谱发布GLM-5.3:编码能力提升50%,权重两周后开放
xAI
2026-08-12 17:07:37

xAI 上线 Grok 4.6:对标前沿模型,定价维持不变

xAI 于 8 月 12 日推出旗舰模型 Grok 4.6。马斯克称新模型“更聪明、更快,而且超划算”,xAI 官方则称这是相较 Grok 4.5 的一次重大升级,且价格不变。按 xAI 公布的数据,Grok 4.6 在 AA Intelligence Index 上拿到 61 分,追平 GPT-5.6 Sol,并在 CursorBench、FrontierCode 与 AA-Briefcase 中领先;定价仍为每百万输入 token 约 2 美元、输出 6 美元。

410
xAI 上线 Grok 4.6:对标前沿模型,定价维持不变