返回参数规模

参数规模

英伟达
2026-08-24 07:20:18

英伟达 AVO 在 ARC-AGI-3 拿下满分,183 关全部通关

英伟达通用编码智能体 AVO 在 ARC-AGI-3 的 25 个游戏环境中通关全部 183 个关卡,以 6624 步拿到 100.00 的 RHAE。报道显示,AVO 未改动底层模型 Claude Opus 5,而是在模型外加入持久记忆和监督器机制。该系统原本用于 GPU 算子优化,曾在 B200 上自主运行 7 天,探索超过 500 个优化方向,并提交 40 个有效内核版本。

430
英伟达 AVO 在 ARC-AGI-3 拿下满分,183 关全部通关
OpenAI
2026-08-24 03:00:10

OpenAI 与 Anthropic 新模型代号接连曝光,奥特曼播客抨击末日式营销

OpenAI 员工在 GitHub 公开 PR 中留下「gpt-nathree」署名,引发外界对下一代 Agent 模型的猜测;此前公开测试还出现过「gpt-mewfour」代号。与此同时,第三方开发者应用和 Discord 社区流出 Anthropic 的「claude-marshmallow-eap」与「claude-melon-eap」。几乎同一时间,OpenAI CEO 萨姆·奥特曼在《Founders》播客中批评 AI 行业借「毁灭世界」叙事做营销,并谈到 OpenAI 早期四年半的探索、对 ChatGPT 增长的内部犹疑,以及他对人类在 AI 时代角色的看法。

780
OpenAI 与 Anthropic 新模型代号接连曝光,奥特曼播客抨击末日式营销
英伟达
2026-08-23 10:58:04

英伟达获 Poolside 技术许可并招募团队,加码开源模型布局

分析师 qinbafrank 表示,英伟达已支付 60 亿美元取得 Poolside「Model Factory」技术的非独家许可,并配套约 10 亿美元股权投资,同时向超过 100 名 Poolside 工程师发出邀约,相关人员将加入 Nemotron 开源权重模型项目。该交易被解读为英伟达从 GPU 硬件延伸至软件和模型层,围绕开源模型强化自身 AI 工厂能力。

410
英伟达获 Poolside 技术许可并招募团队,加码开源模型布局
智谱AI
2026-08-19 07:28:20

智谱 AI 创始人唐杰:参数规模不再单独决定模型强弱

智谱 AI 创始人、清华大学教授唐杰表示,单独讨论大模型参数量已越来越难判断模型能力。回顾从 GPT-3、Chinchilla 到 MoE 的 Scaling Law 演变后,他提出模型能力还取决于训练数据、训练与推理阶段的算力分配,以及后训练与单次推理的有效深度。智谱最新的 GLM-5.3 被他视为一次控制实验:在不增加参数的前提下,集中扩展长程任务训练与强化学习。

710
智谱 AI 创始人唐杰:参数规模不再单独决定模型强弱
开源AI
2026-08-16 13:15:48

Hugging Face:全球开源 AI 扩张,中国模型加速崛起

Hugging Face 最新观察报告称,全球开源人工智能生态仍在快速扩张,中国开源模型正成为重要力量。报告显示,2026年以来多数月份,中国 AI 企业发布的最大开源模型参数规模明显高于美国同行,月度上限在 7540 亿至 2.78 万亿之间。与此同时,参数超过 200 亿的中国模型中,超八成采用较宽松授权协议,Qwen 衍生模型数量也已超过 15 万个。

640
Hugging Face:全球开源 AI 扩张,中国模型加速崛起
阿里巴巴
2026-08-15 01:47:06

阿里巴巴开源 Qwen3.8 系列模型

阿里巴巴于 8 月 15 日宣布正式开源 Qwen3.8 系列模型,面向开发者、科研机构和企业开放下载、部署和使用。其中,新开源的 Qwen3.8-27B 为原生多模态 Dense 模型,参数规模为 270 亿,整体水平据称已超越 Qwen3.7-Plus。

920
阿里巴巴开源 Qwen3.8 系列模型
Z.ai
2026-08-14 20:02:10

中国 AI 实验室 Z.ai 发布 GLM-5.3,主打开源权重编程模型

中国 AI 实验室 Z.ai 于周四发布 GLM-5.3,并将其定位为当前市场上最强的开源权重编程模型。该模型已通过 GLM Coding Plan 订阅和 ZCode 上线,API 接入与可下载权重将在安全审查后分阶段开放。Z.ai 称,GLM-5.3 采用 7430 亿参数,在多项编程与网络安全基准上较 GLM-5.2 提升明显,同时以更少输出 token 完成任务,但在部分头部编程榜单上仍落后于美国闭源模型。

530
中国 AI 实验室 Z.ai 发布 GLM-5.3,主打开源权重编程模型
AMD
2026-08-14 15:36:04

AMD为阿里开源模型 Qwen3.8-27B 提供发布当日支持

AMD宣布为阿里通义千问最新一代模型 Qwen3.8-27B 提供“Day 0”支持,开发者可在模型发布当天通过 AMD 硬件本地运行该开源模型。AMD称,该模型可通过 llama.cpp 运行在搭载 AMD 处理器的 AI PC、工作站及单张 32GB AMD 显卡上,并支持超过 24GB 可变显存或显存容量的平台。初步测试显示,该模型在 Ryzen AI Max+ 395 上最高达 24.5 tokens/秒,在 Radeon AI PRO R9700 上最高达 51.8 tokens/秒。

620
AMD为阿里开源模型 Qwen3.8-27B 提供发布当日支持