Barret Zoph重返谷歌,折射顶级AI实验室人才激烈流动
曾任谷歌大脑高级研究科学家、OpenAI后训练研究副总裁、Thinking Machines Lab联合创始人兼CTO的 Barret Zoph,已回到谷歌DeepMind并担任研究副总裁。文章梳理了他从神经架构搜索、Switch Transformer到后训练工作的履历,也涉及其在 Thinking Machines Lab 与 OpenAI 之间的往返流动,以及 DeepMind 近年的高层变动和人才流失数据。

曾任谷歌大脑高级研究科学家、OpenAI后训练研究副总裁、Thinking Machines Lab联合创始人兼CTO的 Barret Zoph,已回到谷歌DeepMind并担任研究副总裁。文章梳理了他从神经架构搜索、Switch Transformer到后训练工作的履历,也涉及其在 Thinking Machines Lab 与 OpenAI 之间的往返流动,以及 DeepMind 近年的高层变动和人才流失数据。

智谱发布轻量级旗舰模型 GLM-5.3 Flash,称其对标 DeepSeek V4 Flash,并由超过 10 万张国产芯片集群提供推理服务。该模型参数规模约 300B,采用 MoE 架构,实际激活参数约 18B,支持图像与视频输入。智谱表示,其综合评测分数超过上一代旗舰 GLM-5.2,与 Claude Opus 4.8 持平,并高于 DeepSeek V4 Pro 正式版相关分数。

英伟达发布文章称,阿里巴巴最新预览模型 Qwen3.8-Flash-Next 已获得 GB300 NVL72 平台支持。该模型总参数规模为 1760 亿,每 Token 激活约 60 亿参数,原生支持 26.2 万 Token 上下文,并可借助 YaRN 扩展至 100 万 Token。英伟达披露,在 GB300 NVL72 上,该模型单 GPU 吞吐量超过 1.6 万 Token/秒,单用户吞吐超过 200 Token/秒,同时支持 SGLang、vLLM 和 TensorRT-LLM。

多则爆料显示,Anthropic 可能在本周推出 Opus 5.1,升级重点据称放在编程、复杂推理和长时间运行的 AI Agent 能力上。与此同时,Polymarket 预测其未来两周发布下一代旗舰模型的概率为 74%。报道还提到,OpenAI 一个代号为 Bel 的 10 万亿参数模型已完成预训练,AI 大模型发布节奏正在加快。

IBM 发布 Granite 4.2 系列开源推理语言模型,提供 3B、8B 和 30B 三种参数规模,支持原生思维链、思考开关和低功耗模式。8B 与 30B 版本加入智能体强化学习,可在沙盒环境中执行代码编辑、终端操作和网络搜索。该系列采用 Apache 2.0 协议开源,允许下载、微调和商业使用。

由 Ilya Sutskever 创立的 Safe Superintelligence(SSI)被传可能在本周发布首个模型。多名投资人与科技观察者近期在社交平台集中发声,猜测这一模型可能采用测试时训练(TTT)架构。原文还提到,英伟达于 7 月 27 日宣布与 SSI 达成长期战略合作,未来 12 个月将把其算力规模提升 10 倍,并称在获得对其受保护研究成果的罕见访问后决定合作。

一份由 The Kobeissi Letter 在 X 首发披露的匿名调查显示,英伟达约一半受访员工净资产超过 2500 万美元,78% 超过 100 万美元。英伟达截至 2026 财年末拥有 42000 名员工,离职率仅 3.7%,明显低于美国科技行业约 13% 的平均水平。报道还提到,公司通过员工持股计划和限制性股票长期绑定员工收益;同一周,英伟达宣布推理加速芯片 Groq 3 LPX 进入量产。

AI 公司 Fastino 发布信息提取模型 GLiNER2.5,采用边界预测架构,直接预测实体起止位置,替代传统跨度枚举方法。该模型移除了实体最大长度限制,支持最长 4096 个单词上下文,计算复杂度与序列长度线性相关,并支持实体与关系联合解码。Fastino 已在 Hugging Face 发布 7400 万、1.94 亿和 2.87 亿参数的三个检查点,采用 Apache 2.0 开源协议。
