PrismML 发布 Ternary Bonsai 2 27B,5.93 GB 保留 Qwen3.8 27B 98.2% 性能

PrismML 发布 Ternary Bonsai 2 27B,5.93 GB 保留 Qwen3.8 27B 98.2% 性能

N
News Editor
2026-09-18 18:15:27
PrismML 发布 Ternary Bonsai 2 27B,这是 Qwen3.8 27B 的三元权重版本,模型体积从 FP16 版本的 53.80 GB 压缩至 5.93 GB,在 20 项基准测试中的平均性能保留率为 98.2%。该模型支持文本和图像输入,提供 262K token 上下文,采用 Apache 2.0 许可并已开源权重,也可在 RTX 5090 等消费级硬件上运行。

Techub News 消息,AI 模型公司 PrismML 发布 Ternary Bonsai 2 27B 模型。该模型是 Qwen3.8 27B 的三元权重版本,体积为 5.93 GB,而 FP16 版本为 53.80 GB,在 20 项基准测试中的平均性能保留率达到 98.2%。

模型支持文本和图像输入,上下文长度达到 262K token,并可在 RTX 5090 等消费级硬件上运行。PrismML 采用 Apache 2.0 许可,已开源模型权重。

参数结构与量化方式

Ternary Bonsai 2 27B 的架构与 Qwen3.8 27B 保持一致,参数总量为 27.36B,其中语言主干为 24.35B,嵌入层与语言模型头为 2.54B,视觉模块为 0.47B。

该模型使用三元量化技术,绝大多数权重仅取 -1、0、+1 三个值,并配合共享的 FP16 缩放因子,以实现更高压缩比。

测试结果

性能评估显示,该模型在数学和代码任务上的性能保留率超过 99%,但在长程智能体任务中的下降更明显,例如 Terminal-Bench 2.1。

实测数据显示,RTX 5090 的解码速度为每秒 142.5 token,RTX 4090 为 96.7 token/s,苹果 M5 Max 笔记本为 46.8 token/s。

上述消息由 MarkTechPost 提及。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
300

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。