智谱 AI 创始人唐杰:参数规模不再单独决定模型强弱
智谱 AI 创始人、清华大学教授唐杰表示,单独讨论大模型参数量已越来越难判断模型能力。回顾从 GPT-3、Chinchilla 到 MoE 的 Scaling Law 演变后,他提出模型能力还取决于训练数据、训练与推理阶段的算力分配,以及后训练与单次推理的有效深度。智谱最新的 GLM-5.3 被他视为一次控制实验:在不增加参数的前提下,集中扩展长程任务训练与强化学习。

智谱 AI 创始人、清华大学教授唐杰表示,单独讨论大模型参数量已越来越难判断模型能力。回顾从 GPT-3、Chinchilla 到 MoE 的 Scaling Law 演变后,他提出模型能力还取决于训练数据、训练与推理阶段的算力分配,以及后训练与单次推理的有效深度。智谱最新的 GLM-5.3 被他视为一次控制实验:在不增加参数的前提下,集中扩展长程任务训练与强化学习。

摩根士丹利在 8 月 16 日的软件速览中称,Silver Lake 洽谈收购 Workday 的传闻,反映出软件板块估值已压缩到足以吸引私募股权重新出手的水平。报告同时提到,开源模型正在推动 AI 模型价格分层,但未必破坏云厂商回报率;在投资者调查中,对软件股反弹可持续性的看法分化,但看多者仍多于看空者。大摩还分别点评了 Netcompany 的现金流质量,以及 SpaceX 以 600 亿美元全股票收购 Cursor 的交易意义。

台湾数位发展部数位产业署 115 年度免费 AI 算力平台申请已进入后段,全年收件将于 10 月 30 日截止。符合资格的国内业者经核定后,可免费使用 3 个月 GPU 算力,用于训练、微调开源模型,或通过 API 串接预装大语言模型。官方称,截至 114 年底,已有 186 家 AI 新创与资服业者使用平台,产出至少 266 个模型或创新应用。

研究者 Davide Piffer 在评论中提出,AI 在数学任务上的优势,未必主要来自更深的推理能力,而可能来自近乎无上限的符号工作记忆。文章将大模型的上下文视窗比作一册摊开的外部笔记本,认为它能同时保留大量条件、中间算式与被放弃的路径,这在可验证、低歧义的数学问题中尤其占优;但遇到因果不完整、语义会随情境变化的模糊问题时,这种优势并不成立。

中科大、牛津等机构研究者提出用情绪向量替代文本进行技能选择,实验显示,允许 AI 识别并利用「好奇」「困惑」「紧张」等内部情绪状态,能改善任务完成效果。在六类家务任务中,EMOTION2SKILL 将「加热物品」成功率从 9.6% 提升至 56.9%,将「拾取两个物品」从 4.4% 提升至 31.3%。另一项来自天津大学的研究则把情绪嵌入世界模型,报告称其自建数据集准确率最高提升 45.72%。

Anthropic据报正为10月IPO做准备,多名投资人测算其挂牌估值可能超过2万亿美元,至少一位模型给出逾3万亿美元结果。报道同时提到,公司2025年底年化收入约90亿美元、到今年5月升至470亿美元,二季度营收超过115亿美元。路透还称,Anthropic内部预计2028年营收将达到1900亿至2000亿美元。伴随收入激增,围绕公司管理文化和内部治理的争议也在持续发酵。

路透社报道称,苹果已为中国市场训练专属大语言模型,并由阿里巴巴提供训练支持,做法不同于过去依赖中国本土厂商模型。报道指,若方案顺利落地,苹果可能成为首家获北京批准在中国提供自有 AI 模型的外资企业,Apple Intelligence 也预计在未来数月随 iOS 更新进入中国市场。中国版服务据称还将整合阿里巴巴通义千问与百度技术,覆盖 iPhone、Mac 等产品线。

AI大模型正同时改写加密安全的攻击端与防御端。Coldcard攻击事件和Boltz暂停比特币交换服务,都让社区看到AI辅助漏洞挖掘与攻击提速的现实压力。Bitcoin Red Team在不到30小时内扫描390个项目,提交4962项安全发现。由于部分海外模型限制安全研究,中国开源模型被用于代码审查、漏洞扫描和链上追踪,比特币政策研究所也联合多家机构呼吁AI实验室向开源安全团队开放长期可信访问。
