Hermes Agent登陆macOS:四层压缩将Token消耗骤降95%

Hermes Agent登陆macOS:四层压缩将Token消耗骤降95%

N
News Editor 01
2026-07-10 18:39:13
Nous Research 发布 Hermes Agent 计算机使用功能,集成开源驱动逆向苹果 API,四层上下文压缩将 20 次操作的 Token 消耗从 60 万降至 3 万,挑战 OpenAI Codex。
Hermes AgentNous Research计算机使用Token压缩AI代理

Nous Research 近日正式推出 Hermes AgentComputer Use 功能,该功能现已登陆 macOS 平台,直接挑战 OpenAI 旗下 Codex 的能力边界。作为一款开源智能体,Hermes Agent 通过集成全新的 cua-driver,实现了对苹果底层 API 的逆向工程,从而在用户无感知的情况下完成后台自动化操作。

背景与定位

传统 AI 代理在调用操作系统功能时往往需要用户频繁授权,或占用大量前台资源。Hermes Agent 则通过底层 API 直接驱动,能够在不打断用户当前活动的前提下执行复杂任务,例如文件管理、应用交互、浏览器操作等。这一设计思路与 OpenAI Codex 形成直接竞争,后者同样致力于通过自然语言指令操控计算机。

核心技术创新:四层上下文压缩

本次发布的最大亮点在于 四层上下文压缩机制。该机制针对计算机视觉场景中高分辨率屏幕产生的海量 token 进行了优化。据官方数据,在以 1568×900 分辨率执行 20 次动作时,传统模型通常需要消耗约 60 万个 token,而 Hermes Agent 通过逐层过滤冗余视觉信息、结构化动作编码、跨步骤状态缓存以及语义摘要聚合,将 token 使用量锐减至 3 万个,降幅高达 95%。这不仅大幅降低了 API 调用成本,还提升了响应速度,使得长时间自动化任务的可行性显著增强。

开源生态与兼容性

Hermes Agent 完全开源,并基于 Nous Research 此前发布的 Hermes 系列语言模型构建。cua-driver 作为独立的开源模块,允许开发者自行扩展对其他操作系统的支持。当前版本主要面向 macOS,未来有望覆盖 Windows 和 Linux。此外,该智能体还支持与多种流行框架(如 LangChain、AutoGPT)集成,降低了使用门槛。

市场影响与展望

此次发布正值 AI 代理赛道竞争白热化阶段。OpenAI Codex 虽已展现强大的代码生成能力,但在桌面控制领域 Hermes Agent 凭借极低的 token 消耗和开源的灵活性形成了差异化优势。分析人士认为,智能体成本的大幅下降将推动更多企业级自动化场景落地,例如 RPA(机器人流程自动化)升级、个人助理增强等。未来,Nous Research 计划继续优化多模态输入处理,并探索跨设备协同控制。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
400

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。