返回AIRA-dojo

AIRA-dojo

Meta FAIR
2026-09-06 20:36:51

Meta FAIR 推出 AI 研究偏好模型 RPM,提前筛选实验方案以节省 GPU 时间

Meta FAIR 与牛津大学、伦敦大学学院研究团队发布 AI 研究偏好模型 RPM,用于在执行耗时 GPU 实验前对候选方案排序。该模型提供仅推理和智能体驱动两种变体,基于冻结的预训练大模型 Qwen3.6-27B,相关框架 AIRA-dojo 和基准 AIRS-Bench 已开源。测试显示,RPM 将平均归一化得分从 0.684 提升至 0.711 和 0.729,并在约 15 小时达到基线模型 24 小时的性能水平。

20
Meta FAIR 推出 AI 研究偏好模型 RPM,提前筛选实验方案以节省 GPU 时间