显存

AMD
2026-08-14 15:36:04

AMD为阿里开源模型 Qwen3.8-27B 提供发布当日支持

AMD宣布为阿里通义千问最新一代模型 Qwen3.8-27B 提供“Day 0”支持,开发者可在模型发布当天通过 AMD 硬件本地运行该开源模型。AMD称,该模型可通过 llama.cpp 运行在搭载 AMD 处理器的 AI PC、工作站及单张 32GB AMD 显卡上,并支持超过 24GB 可变显存或显存容量的平台。初步测试显示,该模型在 Ryzen AI Max+ 395 上最高达 24.5 tokens/秒,在 Radeon AI PRO R9700 上最高达 51.8 tokens/秒。

810
AMD为阿里开源模型 Qwen3.8-27B 提供发布当日支持
OpenAI
2026-08-13 23:52:09

OpenAI 联合 Cerebras 预览 GPT-5.6 Sol 超高速模式

OpenAI 于 8 月 14 日凌晨联合 AI 芯片厂商 Cerebras 预览 GPT-5.6 Sol 的「超高速模式」。该模式最高输出速度可达 750 tokens/s,较标准模式约 53 tokens/s 提升最高 14 倍。OpenAI 表示,该模式将率先上线 API,并已向部分客户开放有限预览。Cerebras 披露,GPT-5.6 Sol Ultrafast 在 HLE 测试中用 11 小时 11 分钟完成 2500 道题,Claude Fable 5 用时 78 小时 27 分钟。

950
OpenAI 联合 Cerebras 预览 GPT-5.6 Sol 超高速模式
SpaceX
2026-08-13 12:57:31

SemiAnalysis:SpaceX 或在 2027 年逼近 10GW AI 算力

SemiAnalysis 在最新报告中提出,AI 基础设施竞争的核心指标正从 GPU 数量转向每兆瓦电力可转化出的 Token 收入。报告预计 SpaceX 到 2027 年底总算力容量有机会接近 10GW,并认为其真正出售的稀缺资源不是 GPU,而是更早交付算力的时间窗口。报告还将 Microsoft 视为潜在最大承购方,同时指出相关测算建立在需求、定价、利用率、建设速度与供电等一系列高增长假设之上。

1350
SemiAnalysis:SpaceX 或在 2027 年逼近 10GW AI 算力
Meta
2026-08-11 10:33:11

Meta重启开放权重路线,发布Muse Glimmer并预告开放Spark 1.2

Meta发布开放权重模型Muse Glimmer,并表示未来几周将开放更强的Muse Spark 1.2模型权重。Muse Glimmer采用Apache 2.0许可证,支持文本和图像输入,主打本地Agent场景。扎克伯格同步在官网为开放模型和蒸馏辩护,称应把强大且免费的AI交给数十亿人,而不是集中在少数大型机构手中。

1150
Meta重启开放权重路线,发布Muse Glimmer并预告开放Spark 1.2
AI Agent
2026-08-11 00:17:09

AI Agent推高存储地位,功能型SSD与HBM分层重估

MarsBit刊文称,AI Agent正把存储从任务结束后的落盘环节,推向感知、记忆与决策循环。文章认为,未来SSD可能演化为具备加密、压缩、索引、记忆维护和上下文服务能力的功能型产品,并在端侧与云侧形成不同分工。与此同时,HBM、HBF、DRAM/CXL与SSD不会简单替代,而会围绕速度、容量、成本和治理需求重新分层。

1360
AI Agent推高存储地位,功能型SSD与HBM分层重估
Claude Code
2026-08-10 14:03:23

Claude Code 默认自动模式,Upbit 扩容上币名单

TechFlowPost 汇总当日 AI、加密、芯片与科技公司动态。AI 侧,Claude Code 将自动模式设为默认,Gemini 3.5 Pro 被传已内部取消,Meta 据称将开源 30B 模型 Muse Glimmer。加密市场方面,Upbit 一次上线 CYS、ICNT、XAN 等 6 个项目,社区也开始质疑链上 AI 代理的实际价值;在 CPI 数据公布前,市场同时关注美联储 9 月加息预期与比特币表现。

1260
Claude Code 默认自动模式,Upbit 扩容上币名单
MiniMax
2026-08-10 09:52:26

MiniMax H3 开源后在榜单与价格上反超 Seedance 2.0

MiniMax 于 8 月 3 日将全模态视频模型 H3 权重上架 Hugging Face,支持 2K、24fps 视频与立体声音频生成。Artificial Analysis 榜单显示,H3 在视频编辑榜排名第一,文生视频榜反超字节跳动 Seedance 2.0。5 秒片段生成成本约 0.7 美元,社群还实测 12GB 消费级显卡可离线运行。

430
MiniMax H3 开源后在榜单与价格上反超 Seedance 2.0
英伟达
2026-08-08 06:43:09

英伟达下调 Rubin Ultra 显存方案,全球内存股承压,长鑫暂未受同样冲击

英伟达据称将下一代旗舰 GPU Rubin Ultra 的主流 HBM 配置从 12-Hi 约 384GB 下调至 8-Hi 192GB,单卡显存接近减半,带动 SK 海力士等内存股下挫。与此同时,闪迪、三星、海力士近期都出现“业绩创新高、股价却走弱”的相似局面,市场焦点已从利润规模转向增速放缓。文章还提到,长鑫科技在 DRAM 份额、产能扩张和国产替代上持续推进,但在 HBM 量产能力上仍与韩厂存在差距。

1130
英伟达下调 Rubin Ultra 显存方案,全球内存股承压,长鑫暂未受同样冲击