Techub News 消息,AI 模型公司 PrismML 发布 Ternary Bonsai 2 27B 模型。该模型是 Qwen3.8 27B 的三元权重版本,体积为 5.93 GB,而 FP16 版本为 53.80 GB,在 20 项基准测试中的平均性能保留率达到 98.2%。
模型支持文本和图像输入,上下文长度达到 262K token,并可在 RTX 5090 等消费级硬件上运行。PrismML 采用 Apache 2.0 许可,已开源模型权重。
参数结构与量化方式
Ternary Bonsai 2 27B 的架构与 Qwen3.8 27B 保持一致,参数总量为 27.36B,其中语言主干为 24.35B,嵌入层与语言模型头为 2.54B,视觉模块为 0.47B。
该模型使用三元量化技术,绝大多数权重仅取 -1、0、+1 三个值,并配合共享的 FP16 缩放因子,以实现更高压缩比。
测试结果
性能评估显示,该模型在数学和代码任务上的性能保留率超过 99%,但在长程智能体任务中的下降更明显,例如 Terminal-Bench 2.1。
实测数据显示,RTX 5090 的解码速度为每秒 142.5 token,RTX 4090 为 96.7 token/s,苹果 M5 Max 笔记本为 46.8 token/s。
上述消息由 MarkTechPost 提及。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

