AI Agent正在把计算机从「接到问题后完成一次模型调用」,变成持续观察、推理、调用工具、修改环境并保留状态的运行系统。
在这类系统里,一次任务可能连续访问模型、记忆、向量索引、业务数据库、对象存储和网络服务,还会把工具结果、执行轨迹、用户偏好、临时上下文与审计记录不断写回。Agent运行时间越长,系统价值越依赖数据能否被安全保存、正确检索、及时更新和低成本复用。
这让存储不再只是Agent完成工作后的落盘终点,而开始进入Agent的感知、记忆和决策循环。文中提到,AI SSD已经展示出一批早期方向,包括保存模型与Adapter、承接被逐出内存的KV Cache、缩短冷启动时间,以及扩大可部署模型容量。若再往前推进一步,SSD还可能在数据落盘时执行加密、压缩、去重、标记、索引、版本维护与生命周期治理,并为Agent Memory提供长期容量。
这种变化并非凭空出现。文章指出,自加密盘已经能够在控制器内透明完成数据加解密;计算存储标准也已把压缩、加密、正则过滤和纠删码列为可由存储侧执行的功能;Samsung SmartSSD等产品则曾把数据库扫描和视频处理下沉到盘侧。进入Agent时代后,这些能力开始围绕智能体身份、上下文、记忆、工具轨迹和Token成本重新组合。
文中判断,未来市场可能出现「安全SSD」「压缩SSD」「检索SSD」「记忆SSD」或「上下文SSD」等名称,但未必会形成彼此割裂的硬件品类。更可能的路径,是它们汇合为可编程的功能型SSD:底层仍兼容标准存储形态,上层软件再按场景发现和调用设备能力。
NVMe已经形成Computational Programs和Subsystem Local Memory等命令集,为设备侧程序的发现、配置和执行提供标准化路径。文章认为,真正的产业问题不只是能否在盘内放进一颗处理器,而是谁来定义数据语义、功能边界和端到端结果。
Agent不是一次调用,而是一条持续写入的数据链
与传统聊天机器人主要持久化对话记录不同,Agent会生成更复杂的数据图。它需要保存观察结果、工具输出、计划与反思、任务中间状态、用户画像、环境快照、检索证据和执行日志;模型侧还会产生KV Cache、Prefix Cache、Adapter、专家权重和Checkpoint。不同对象的更新时间、复用范围和安全等级并不相同,但都会影响后续推理能否延续。
文章还提到,Agent Memory并不等于把所有历史对话塞进向量数据库。近期从数据管理视角出发的系统研究,将Agent Memory拆分为表示与存储、信息提取、检索与路由、维护四个模块,并指出没有一种架构能够在所有工作负载上占优。Mem0等系统同样强调,应把原始对话转化为更紧凑、可复用的长期记忆,以降低长会话中的输入Token和检索负担。

这意味着,未来的存储层不仅要保存内容,还要保存内容如何被组织、更新和遗忘。文章据此提出,Agent数据落盘需要比「写成功」更丰富的契约。一个记忆对象应当带有用户或Agent身份、租户、来源、时间、版本、权限、可信度、保留期限和可删除性;模型上下文还需要绑定模型版本、Tokenizer、位置编码与Adapter。只有命名空间和生命周期明确下来,后续压缩、索引、缓存与共享才不会破坏语义边界。
在这条数据链中,功能型SSD的合理角色,不是自己判断某段经历是否值得记住,而是在Runtime已经给出对象与策略后,靠近数据执行确定性工作。文章举例称,这类设备可以按租户选择密钥、按生命周期放置数据、压缩与去重可缩减对象、维护索引页与元数据、优先完成即将被推理使用的回载,并把尾延迟、写放大和介质健康反馈给上层。语义决策留在Agent和Runtime,数据执行则尽量靠近介质。
文章给出的核心判断是,Agent时代的SSD升级,不是简单增加盘内算力,而是把标准块设备、可发现的近数据功能、对象语义和生命周期治理组合起来。越靠近介质的功能,越应当保持确定、可审计、可隔离;越靠近模型的决策,则越需要保留在Runtime侧。
自动加密已存在,变化在于策略开始跟随Agent
文章强调,「数据落盘自动加密」并不是未来概念。自加密盘已经可以由控制器中的专用硬件对写入数据进行加密、对读取数据进行解密,并通过密钥管理和策略控制实现透明的静态数据保护。
对Agent系统而言,新要求在于加密粒度正从整盘或单一命名空间,进一步细化到用户、Agent、任务和对象。文章指出,同一台端侧设备上的个人记忆与应用缓存不能互相越权,云侧多租户Agent的共享上下文也必须明确哪些可以复用,哪些只能在单一权限域内读取。
NVMe规范已经引入由主机管理密钥和Key Per I/O等更细粒度能力,为每次I/O携带不同安全上下文提供基础。基于这一方向,未来的安全型SSD还可能把数据来源、时间戳、访问记录、完整性校验与可信删除结合起来,使Agent不仅能回答「我记得什么」,还能回答「这段记忆来自哪里、是否被修改、谁读取过、何时必须删除」。文章认为,对金融、医疗、企业知识库和个人AI这类场景,证据链的重要性可能并不低于检索速度。
加密也会改变其他近数据功能的执行顺序。文中提到,加密后的字节流通常难以有效压缩和去重,因此内容缩减一般应先于加密;索引则需要区分明文特征、受保护元数据与可搜索密文之间的边界。功能型SSD的竞争力,不只取决于功能多少,还取决于能否用可验证的流水线,把压缩、索引、加密、落盘和删除正确组织起来,同时避免任一环节扩大攻击面。

压缩、索引与记忆维护,可能成为下一批SSD能力
文章认为,压缩是最容易形成商业闭环的功能之一。Agent会反复写入文本、JSON、日志、向量、Checkpoint和多媒体中间结果,其中相当一部分存在结构重复。若压缩在数据进入网络或NAND前完成,可以减少传输、物理写入和容量占用,并间接降低能耗与介质磨损。
不过,文中也指出,压缩比、额外时延、CPU节省和写放大必须一起衡量;对于已经量化或高度压缩的模型权重,继续压缩的收益可能有限。
索引功能与Agent的关系更直接,因为记忆只有被正确召回才有价值。文章举例称,KIOXIA AiSAQ把向量与索引结构放在SSD上,以SSD友好的聚类和图搜索降低DRAM占用,并已展示单服务器数十亿规模向量检索。文中同时强调,需要严格区分的是,AiSAQ首先是一套以SSD为主要索引载体的软件技术,这并不意味着普通SSD会自动生成Embedding或理解语义。更可能的产业路径是,GPU、NPU或CPU负责生成表示,SSD与近数据程序负责组织索引、过滤候选并返回更小的结果集。
相比索引,记忆维护更复杂。文章指出,长期Agent Memory会经历新增、合并、冲突、修订、降权、过期与遗忘;同一事实还可能同时以原始记录、摘要、向量和知识图谱等形式存在。未来的「记忆SSD」可以为这些版本提供原子更新、日志、TTL、冷热放置和安全删除,但不能仅凭相似度决定什么是真实记忆。记忆质量仍取决于上层的提取、路由、冲突处理与评估。
从产品角度看,这些功能也未必要求每块盘都运行复杂模型。文章将压缩、加密、哈希、过滤、索引页维护和对象生命周期,归为适合确定性专用电路或轻量程序执行的工作;Embedding、重排序、摘要与记忆合并,则可能更适合由主机或独立加速器完成。功能型SSD的关键,在于通过统一对象ID和可观测接口,把两类工作接起来,减少数据搬运,而不是把所有AI计算都塞进硬盘。
端侧:SSD可能成为个人Agent的长期状态层
在端侧场景,Agent会持续接触个人文档、照片、邮件、日程、应用状态、浏览记录和设备传感数据。文章认为,统一内存只适合保留当前工作集,SSD则可以保存更大的本地模型库、Adapter、向量索引、个人记忆和工具轨迹。只要继续保持标准NVMe形态,功能型SSD首先仍可以作为普通系统盘,被AI PC和工作站直接安装,再通过驱动、Runtime与固件逐步开启安全、索引与上下文能力。
文章指出,它对消费者的价值不在于「硬盘会思考」,而在于本地AI能够记得更久、在弱网环境下继续工作,并减少每次任务向云端上传的原始数据和输入Token。会议Agent可以保留音频、摘要与任务状态,编程Agent可以维护仓库索引和修改历史,家庭Agent可以跨设备共享经过授权的照片、文档与设备状态。SSD把这些状态留在设备附近,再由Router根据质量、隐私、功耗和网络条件决定本地处理还是调用云端。
端侧市场也可能从单块硬盘扩展到小型存储节点。文章称,AI PC、家庭服务器或门店边缘盒子,可以为手机、平板、机器人和摄像头提供本地模型镜像、个人记忆、向量库和加密归档,避免每台设备重复保存同一套数据。商业模式则可能从容量升级,延伸到AI PC溢价、本地Agent订阅、模型与技能包管理,以及面向家庭和小企业的私有AI节点。

不过,本地存储并不自动等于隐私。文章提醒,如果应用可以任意读取记忆、索引无法删除旧版本、密钥与设备身份脱节,那么功能越多,攻击面反而越大。端侧功能型SSD必须把应用隔离、用户同意、保留期限、可验证删除和设备遗失后的密钥吊销,作为产品能力的一部分,而不是停留在营销口号层面。
云侧:SSD会从设备走向Agent存储节点
在云侧,Agent状态规模更大,也更依赖共享。文章称,一个复杂请求会串联多次模型调用、工具执行、记忆访问和网络传输;多Agent协作还会产生共享计划、消息、证据和执行日志。节点本地SSD可以保存模型、Checkpoint和高频索引,机架或POD级Flash层可以承接跨GPU复用的KV、Prefix、Adapter和共享记忆,通用对象存储则继续保存冷态数据和长期事实源。
文中提到,Mooncake已经把CPU、DRAM、SSD与RDMA/NIC组织为分布式KV Cache池,并让调度器根据缓存位置与TTFT、TBT目标决定请求路径;NVIDIA CMX则在HBM、主机内存和通用共享存储之间建立面向KV Cache的POD级Flash上下文层,把共享存储节点放进推理数据路径。文章认为,这些系统的端到端收益不能简单归因于单块SSD,但至少说明「存储节点参与Token生产」正从概念走向基础设施产品。
下一代Agent存储节点,可能同时提供上下文、记忆和治理服务。文章设想,这类节点可以维护共享Prefix与KV目录,为模型和Adapter预热,保存向量与图索引,按租户压缩与加密数据,记录工具调用和证据链,并把命中率、P99、写放大、能耗和介质健康暴露给调度器。客户购买的,也不再只是硬盘容量和带宽,而是GPU利用率、SLO goodput、Token/、Token/W、QPS/和审计响应速度。
这也会带来商业模式变化。文章提出,单盘仍可按容量、耐久和性能销售;存储节点则可能以多盘Appliance、控制面、Runtime授权、长期支持和SLA形成组合收入;更上层还可能出现按上下文有效容量、记忆对象数量、检索吞吐或有效Token计费的服务。功能型SSD一旦开始对端到端结果负责,其价值边界就会从半导体器件扩展到数据基础设施。
HBM、HBF、DRAM与SSD的价值边界正在被重划
文章明确表示,Agent带来的存储重构,不应被理解为SSD取代内存。SK hynix在FMS 2026提出的Tiered Memory思路,是把HBM、DRAM、NAND/HBF与SSD按速度、容量和成本连接起来,重点放在减少数据移动上。这与Agent系统的现实相对应:当前Token必须使用的数据、未来几毫秒将使用的数据、跨会话可能复用的数据和长期归档数据,需要由不同介质承接。
HBM仍是最接近GPU计算的核心层,承担当前权重、激活、热KV和算子中间状态,其核心指标是Token/s、带宽和计算利用率。文章认为,Agent带来的长上下文和多模型协作,只会进一步推高HBM需求,而不是削弱它的价值。HBM的现实约束在于容量成本与供给,因此系统需要把不必立刻访问的数据移向更低成本层,并在使用前准确预热。

HBF,也就是High Bandwidth Flash,是2025年以来快速形成的新层级。根据文中引用的信息,SK hynix与Sandisk在2026年8月公布的首批开放规格覆盖最高512GB容量,带宽分为约0.4TB/s至3.0TB/s三个等级,并采用UCIe连接处理器。文章指出,HBF使用NAND来获得比HBM更大的容量,目标是在HBM与SSD之间承接读密集的大型推理工作集。但它仍处于标准化和产品化早期,官方规格并不等于广泛量产性能,也无法消除NAND在时延、写耐久和可变状态访问上的限制。
H3研究则给出一种更明确的分工思路:把只读数据放在HBF,把其他数据保留在HBM,以二者优势构建混合推理系统。对Agent而言,HBF更适合模型权重、MoE专家和读取占主导的大型工作集;频繁更新的KV、激活和运行状态,仍更适合HBM或DRAM。文章判断,HBF如果成熟,可能减少为了容量而增加GPU/HBM的需求,但更可能是补充而不是替代。
DRAM与CXL处于可变状态和共享容量的中间地带。Host KV、索引热集、预取缓冲和Agent运行状态需要较低时延且频繁修改;CXL扩展、池化与共享则可以减少内存孤岛,并为多个主机提供更灵活的容量。文章还提到,SK hynix在FMS 2026展示了CXL pooled memory和DRAM-SSD混合方案用于KV共享、预测与预取,但这仍属于具体演示结果,需要在更多平台上验证。
相较之下,功能型SSD承担的是更大、更持久、也更需要治理的温冷对象,包括模型、Adapter、KV/Prefix、向量索引、Agent Memory、日志与Checkpoint。与HBF相比,SSD距离计算更远,但拥有标准形态、成熟生态、容量与成本优势,也更适合做节点级共享。文中认为,未来竞争不会只围绕介质带宽展开,而会围绕谁能在正确期限内交付正确对象,并为有效Token、检索吞吐和数据治理负责。
AI SSD已成为功能型SSD的第一批产业样本
文章认为,现有AI SSD大体从两端进入这一趋势。一端是AI负载强化型企业级SSD,通过低时延、高IOPS、持续带宽、耐久和容量密度,为模型缓存、Checkpoint和向量索引提供介质底座,英韧洞庭N3X与华为OceanDisk LC 560被列为代表。文中指出,这类产品首先解决的是AI数据能否被稳定承载、持续写入和及时召回,并不会因为面向AI就自动具备Agent Memory、索引或上下文语义。
另一端则开始主动参与推理数据路径。文章称,SSD不再只接收操作系统发来的通用块请求,而是通过中间件、Runtime或存储侧处理能力,逐步识别模型权重、专家、KV Cache和预取窗口等AI对象。群联、江波龙和寅谱—联芸,被视作这一方向上三种具有代表性的研发组织方式。
其中,群联aiDAPTIV采用「成熟SSD能力+中间件+完整工具链」方案。文章介绍,aiDAPTIVLink负责GPU显存与Flash之间的内存管理,运行时将模型权重切片,在VRAM中优先保留活跃权重,把非活跃权重卸载到aiDAPTIVCache SSD,并可保存被逐出的KV Cache,避免上下文被淘汰后重新计算。这一路线的商业价值,在于把SSD、软件授权、部署工具和系统支持组合成可交付方案,使客户无需重新设计计算芯片,就能在工作站或本地服务器上扩大可使用的模型与上下文容量。其技术重心是兼容既有GPU与AI软件生态,并依靠成熟控制器、固件、耐久设计和平台合作,把Flash稳定变成显存之外的容量层。
江波龙SPU+iSA更接近「存储执行层+软件决策层」组合。文章称,SPU在设备侧承担无损压缩、HLC高级缓存和不同NAND介质之间的数据调度;iSA则围绕MoE专家卸载、KV Cache生命周期和Device Smart Prefetch进行决策,把AI负载特征转化为预取、回填、压缩和冷热迁移动作。按照文中说法,这一路线关注的不只是把更多数据放进SSD,而是减少DRAM占用、提高有效容量,并让存储侧处理与端侧推理节奏相匹配。它显示出,当控制器附近具备更强执行能力后,SSD可以从块设备进一步变成能够承担压缩、缓存和对象调度的近数据处理节点。

寅谱—联芸则采取计算与存储联合定义路线。文章称,寅谱从模型结构、Runtime、操作系统、CPU/GPU/DRAM协同和整机参考设计出发,观察专家激活、KV生命周期、数据精度及计算窗口;联芸再把这些需求映射到SSD控制器、固件、缓存分区、队列、NAND适配和量产体系。这使产品定义可以从Token延迟、模型容量和整机SLO反推出数据何时进入SSD、以什么粒度保存、如何预取,以及哪些操作适合下沉到控制器附近,而不是只在既有块I/O上做局部优化。文章认为,与前两种路线相比,这种跨计算—存储协同需要更深系统配合,但也更有机会在模型架构和推理基础设施持续变化时,提前发现新的数据路径问题并形成新的设备接口。
文章同时指出,这三条路线并不互相排斥。群联的优势在于以成熟控制器、SSD产品和软件工具链,把能力快速封装成可部署方案;江波龙试图用SPU与iSA,把更多处理和调度放到存储侧;寅谱—联芸则从计算语义与存储执行的交界处反向定义设备。它们共同说明,AI SSD的核心创新,已经从「为AI换一块更快的盘」转向「重新划分Runtime、内存层级、控制器和Flash之间的职责」。这也是文章认为AI SSD能够成为功能型SSD先导产品的原因:一旦软件能够向设备表达对象类型、优先级、生命周期和服务期限,SSD就具备了承载更多确定性功能的基础。
沿着这些路线,下一代功能型SSD也可能继续演进。文章称,沿着群联的路径,厂商可以在SSD与中间件组合中加入按Agent或租户管理的加密、压缩、索引和记忆服务模块,以软件兼容性和交付工具降低部署门槛;沿着江波龙的路径,压缩、冷热调度、索引扫描或数据整理可以交由存储处理单元执行,再由上层智能调度器下发策略;沿着寅谱—联芸的路径,则可以先从Agent运行时对长期记忆、权限、TTL、检索SLO和Token成本的需求出发,再共同定义控制器命令、对象元数据、固件队列和介质布局。文章特别提到,前两条路线分别擅长产品化和设备侧执行,后一条路线由于同时理解计算系统如何消费数据、存储系统如何组织数据,在探索尚未形成标准的新功能时,可能拥有更大的设计空间。
这种交叉背景在Agent时代的重要性也被进一步放大。文章指出,未来很多存储功能并不是单纯的盘内算法:加密需要理解Agent、用户与任务的权限边界,压缩需要知道数据何时再次被计算使用,索引需要与Embedding、Retriever和Model Router协作,Agent Memory还涉及写入、归并、遗忘、版本和证据链。若只从介质端出发,容易把问题收敛成带宽、容量或单个算子;若只从模型端出发,又可能忽略FTL、写放大、尾延迟、掉电保护和量产约束。文章据此认为,寅谱—联芸这种横跨计算和存储的联合研发方式,能够在两类约束之间寻找可落地接口,因此在发展新型功能SSD、AI存储节点乃至Agent数据基础设施时,具备形成差异化技术路线的潜力。
从功能型SSD的视角看,这些方案的重要性不只在于能否扩大某个模型,而在于它们建立了软件与介质交换信息的通道。今天传递的是模型层、专家、KV块和预取提示;未来则可以扩展到Agent身份、记忆对象、版本、TTL、访问策略、索引提示和最晚完成期限。文章认为,谁能把功能做成稳定接口,而不是为单一模型定制一次性路径,谁就更有机会跨越模型代际,并把单盘收入扩展为Runtime授权、存储节点、上下文服务和按有效Token计费的数据服务。
与此同时,文章也提醒需要警惕概念扩张。自动压缩不等于所有数据都能节省同样容量,盘上索引不等于SSD理解语义,Agent Memory也不等于把向量库搬进固件。每一种功能都应由端到端指标来证明,包括压缩比与额外时延、召回率与QPS/、P99与SLO、写放大与耐久、密钥隔离与删除验证,以及最终的Token/和Token/W。
三条可能并行展开的产业方向
文章最后提出,未来产业可能沿三条方向同时展开。

第一条是SSD的功能化。通用盘会继续存在,但安全、压缩、检索、记忆和上下文等能力,会以固化功能、可下载程序或软件定义配置的形式进入产品。最终市场未必需要五种彼此独立的SSD,更可能需要一套可发现、可组合、可隔离的功能框架,再由消费级、企业级与云服务产品选择不同能力组合。
第二条是存储的节点化。单盘解决本机容量和近数据处理,AI存储节点则把多盘、网络、对象目录、密钥、索引、上下文服务和可观测性组合起来,对端到端SLO负责。端侧节点服务个人和设备编队,云侧节点服务GPU集群和多Agent系统。竞争单位也会从「每块盘」扩展为「每个站点、机架或POD能够交付多少有效Token和检索请求」。
第三条是内存层级的重新组合。HBM继续追求最高带宽,HBF尝试用NAND在封装附近提供更大读密集容量,DRAM与CXL承担可变状态、扩展与池化,功能型SSD提供持久对象与近数据服务,共享存储保存全局冷态事实源。文章认为,未来最有价值的系统能力,是让Router和Runtime同时看见算力、数据位置、权限、期限和介质状态,在多个层级之间协同,而不是持续堆叠单一介质。
在这一过程中,产业壁垒也会被重划。文章称,介质厂商掌握容量、带宽与能效,控制器和固件厂商决定功能能否稳定落地,Runtime与Agent平台掌握对象语义和调度,OEM、云厂商与系统集成商则决定功能如何进入真实产品。能够跨越这些边界、建立标准接口并用Token经济学证明客户结果的企业,更有机会把SSD从数据容器推向Agent时代的基础数据层。
存储将成为Agent能力的一部分
文章结尾认为,AI Agent让存储的价值从「保存过去」扩展到「支撑下一次行动」。模型需要权重,推理需要上下文,Agent需要长期记忆和可信证据,企业还需要安全、合规、审计与成本控制。加密、压缩、索引、记忆维护和上下文服务越靠近数据,就越有机会减少搬运、重算和DRAM占用,但也越需要明确权限、语义与责任边界。
据此,文中判断,AI SSD只是起点。未来既可能出现更多带有特定功能的SSD,也可能形成统一的可编程功能型SSD和Agent存储节点。与此同时,HBM、HBF、DRAM、CXL与SSD不会沿着一条简单替代链演进,而会围绕热度、可变性、共享范围和访问期限重新分工。真正的产业机会,在于把每种介质的优势转化为更低的Token成本、更高的Agent连续性和更可信的数据生命周期。
本文来自微信公众号「新智元」,作者为ASI启示录,编辑为所罗门,由MarsBit发布。

