缓存

OpenAI
2026-08-24 00:14:10

OpenAI下调 GPT-5.6 Sol API 价格,输出 token 降幅达 33%

OpenAI 下调 GPT-5.6 Sol 的 API 与超额 credits 定价,未来三个月相关价格下调超过 20%,其中输出 token 价格从每百万 30 美元降至 20 美元,降幅达 33%。Pro、Plus、Business 订阅价格与套餐内用量未作调整,缓存输入、缓存写入和长上下文档位也同步下调。同日,Codex 负责人 Tibo 披露 Codex 周活跃用户已突破 2000 万,并称团队已就社区反映的额度消耗问题启动正式调查。

730
OpenAI下调 GPT-5.6 Sol API 价格,输出 token 降幅达 33%
OpenRouter
2026-08-23 10:13:15

OpenRouter:AI 智能体代币使用量自 2 月增至 14 倍

Techub 援引 The Decoder 报道称,自 2025 年 2 月 6 日起,AI 智能体在 OpenRouter 上消耗的代币量已超过人类。此后,智能体使用量增长 14 倍,人类使用量增长 2.8 倍。不过,接近 70% 的智能体代币消耗来自低价缓存提示,实际成本增幅低于原始数据所显示的水平。

140
OpenRouter:AI 智能体代币使用量自 2 月增至 14 倍
Besu
2026-08-22 01:40:09

Besu发布5项已修复漏洞安全公告 感谢CertiK负责任披露

Besu近日发布四份安全公告,披露5项已修复漏洞,相关问题均已在7月27日上线的Besu 26.7.1版本中修复,技术细节于8月14日公开。漏洞涉及区块公告处理、未来区块高度共识提案缓存、WebSocket订阅限制和无上限JSON-RPC过滤器创建。CertiK在Chain Scan研究中发现这些问题,并向Besu提交了可复现测试框架,Besu在版本说明中对CertiK和EF Security表示感谢。

350
Besu发布5项已修复漏洞安全公告 感谢CertiK负责任披露
英特尔
2026-08-20 03:58:48

英特尔下代 PC 处理器扩大采用台积电 2 纳米,供应链布局浮现

ABMedia 引述《工商时报》称,英特尔下一代桌面处理器 Nova Lake 与 Razor Lake 将采用 Intel 18A 搭配台积电 N2P、N2X 的混合制程,合作范围延伸至整个 2 纳米家族。分析师 Jukan 认为,这一布局不只是制程分工,也涉及占用台积电产能、压缩 AMD 服务器 CPU 产能空间。随着 2 纳米放量,颂胜与中砂等台湾供应链厂商也被点名受益。

340
英特尔下代 PC 处理器扩大采用台积电 2 纳米,供应链布局浮现
汽车芯片
2026-08-18 10:28:11

汽车芯片进入新一轮博弈:去库存接近尾声,补库周期启动

2026年下半年,海外头部半导体厂商财报回暖,产业链库存回落,Tier1订单修复,汽车半导体被多家投行判断进入结构性上行通道。英飞凌、恩智浦等库存周转天数降至120—140天,车规功率器件交付周期拉长至30周以上,部分产品已开启第二轮涨价。

840
汽车芯片进入新一轮博弈:去库存接近尾声,补库周期启动
Anthropic
2026-08-16 00:05:10

Anthropic详解Claude Code省钱方法:别让上下文白烧Token

Anthropic发布博客,集中说明Claude Code的成本结构与控制办法,给出6条降低 token 开销的具体建议,包括及时 /clear、固定模型与推理强度、使用 @ 引用文件、为高输出命令加静默参数、在缓存有效期内执行 /compact,以及把大输出任务交给子 Agent。博客还解释了输入与输出 token 的计价差异、提示缓存的工作方式与失效场景,并列出 Opus 5、Sonnet 5、Haiku 4.5 的定价。

580
Anthropic详解Claude Code省钱方法:别让上下文白烧Token
AI推理
2026-08-15 07:30:00

AI 推理抬高 NAND 地位,Sandisk 押注闪存进入 AI 容量层

AI 推理正把存储从配角推向前台。文章指出,随着查询量、多模态数据和 AI agent 带动可访问数据规模上升,NAND 正从传统商品型存储转向 AI 基础设施中的容量层。Sandisk 预计到 2030 年企业数据中心闪存需求将达 1.2 ZB,并推进 HBF、QLC 与长期客户协议,市场关注点也从短期涨价转向更强 bit 需求与更稳的供应纪律。

750
AI 推理抬高 NAND 地位,Sandisk 押注闪存进入 AI 容量层
马斯克
2026-08-14 07:23:01

马斯克认同 Diamandis:AI 代理时代瓶颈是内存而非算力

马斯克公开认可未来学家、XPRIZE 创始人 Peter H. Diamandis 的判断,认为内存而非计算是代理时代的速率限制因素,并回复称很少有人意识到这一点。Diamandis 指出,AI 代理大规模应用后,长期记忆、上下文记忆和持久化记忆将取代算力成为真正瓶颈。该判断与存储赛道基本面形成呼应:HBM 持续供不应求,KV 缓存与上下文存储爆发正推动 NAND 和硬盘需求结构性增长。

1650
马斯克认同 Diamandis:AI 代理时代瓶颈是内存而非算力