微软近日为旗下Copilot Researcher推出了两项全新功能——Critique与Council,旨在通过整合OpenAI的GPT与Anthropic的Claude模型,大幅提升研究性能。这一创新标志着AI协作模式的重大突破。
Critique:顺序协作提升事实准确性
Critique功能采用顺序协作模型:GPT负责研究规划与草稿生成,而Claude则专注于事实准确性与引用质量审核。这种分工使得研究流程更加严谨,有效减少了AI生成内容中的错误与误导信息。
Council:并行生成与综合输出
另一项功能Council则允许GPT与Claude独立生成研究报告,随后由第三个模型对两者的输出进行综合与优化。这种并行架构能够捕捉不同模型的优势,生成更全面的分析结果。
DRACO基准测试成绩亮眼
在权威的DRACO基准测试中,搭载Critique模式的Copilot Researcher取得了57.4分的优异成绩,领先第二名模型近14%,并大幅超越此前业界领先的Claude Opus 4.6(得分42.7)。这一结果充分证明了多模型协作在复杂研究任务中的巨大潜力。
微软此次更新不仅提升了Copilot的产品竞争力,也为AI研究工具的未来发展提供了新方向。随着GPT与Claude等模型不断进化,多智能体协作系统有望成为下一代AI应用的核心架构。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

