IBM 发布 Granite 4.2 系列开源推理语言模型,提供 3B、8B 和 30B 三种参数规模。该系列围绕显式推理构建,模型在回答前可生成思维链,并提供思考/非思考开关及低功耗模式。
架构方面,Granite 4.2 采用仅解码器的密集 Transformer 架构,从头预训练约 15 万亿个 token,并通过多阶段强化学习链进行后训练。
8B 与 30B 模型加入智能体强化学习
IBM 表示,8B 和 30B 模型包含智能体强化学习模块,模型可在真实沙盒环境中学习编辑代码、驱动终端和运行网络搜索。
开源方面,所有模型均基于 Apache 2.0 协议发布,允许下载、微调及商业生产使用。IBM 还同步发布了两个 470M 参数的 Granite Speech 5.0 Turbo CTC 语音模型。
基准测试与应用场景
在 SWE-Bench Verified 基准测试中,8B 和 30B 模型得分分别为 47.67 和 57.00。IBM 将该系列模型定位于软件开发、金融、医疗、电信及公共部门等行业,应用场景包括软件工程智能体、终端自动化、深度研究及长文档 RAG。
上述信息由 MarkTechPost 披露。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

