返回NVIDIA GPU

NVIDIA GPU

伯克利
2026-08-23 10:55:51

伯克利与 UT Austin 推出边缘原生 MoE 推理引擎 FreeToken

加州大学伯克利分校与得州大学奥斯汀分校研究团队发布边缘原生混合专家模型推理引擎 FreeToken。该系统将个人计算机作为统一弹性推理平台,支持在单张工作站 GPU、游戏台式机和 8GB 显存笔记本 GPU 上运行不同规模模型。FreeToken 已以 Apache-2.0 协议开源,发布到 GitHub 和 PyPI,并提供 Windows、Linux 桌面应用及兼容 OpenAI、Anthropic 的 API 接口。

650
伯克利与 UT Austin 推出边缘原生 MoE 推理引擎 FreeToken
AI泡沫
2026-08-20 08:02:00

AI 与半导体泡沫警报再起:受访者称 2027 年或现大幅回撤

PANews《168X》节目中,AI 产业从业者「挖掘机」表示,自己自 5、6 月降仓后至今仍以现金为主,并判断韩国、日本和 A 股相关板块已见顶。其核心观点是,除 Coding 外暂未出现第二个足够大的 AI 应用市场,头部 AI Labs 短期存在泡沫,上游高毛利难以长期维持。节目还讨论了 Neocloud、存储、机器人、开源模型替代闭源模型等话题,受访者称若没有新应用场景跑出,2027 年可能成为指数跌幅很大的一年。

650
AI 与半导体泡沫警报再起:受访者称 2027 年或现大幅回撤
SpaceX
2026-08-12 11:32:26

SpaceX 新估值逻辑转向可快速交付的 AI 算力

SemiAnalysis 对 SpaceX 的新估值逻辑,不再只看 GPU 数量,而是聚焦算力从现在到真正上线需要多久。报道提到,SpaceX 可先准备电力和机房,临近通电时再采购新一代 GPU,以保留更高的调度与定价空间。文中还列出 Google 与 Anthropic 的相关合同数据,并指出高价更接近短缺阶段的时间溢价,能否持续仍取决于交付周期、GPU 供应和客户自建数据中心投产进度。

900
SpaceX 新估值逻辑转向可快速交付的 AI 算力
B3 Labs
2026-08-12 05:43:35

B3 Labs推出GPU算力平台B3IQ,用户可分期购置专属服务器并出租闲置算力

由Coinbase前团队成员创办的B3 Labs于8月12日推出AI基础设施平台B3IQ。用户可分期购置NVIDIA GPU服务器,设备由Andromeda在美国组装并托管于俄勒冈州,闲置算力可出租抵扣购机款或留作收入。斯坦福、纽约大学、达特茅斯等高校团队已用于癌症研究与模型训练,平台正计划扩充本土GPU库存。

1080
B3 Labs推出GPU算力平台B3IQ,用户可分期购置专属服务器并出租闲置算力
SpaceX
2026-08-10 11:58:05

SpaceX“time-to-compute”估值逻辑:卖的是提前交付算力

SemiAnalysis 给 SpaceX 的新估值逻辑,不是单看 GPU 数量,而是看有多少 AI 算力能在几个月内真正上线。按其说法,通电容量和交付速度本身可以形成“时间溢价”。文中提到,Google 将自 2026 年 10 月起每月向 SpaceX 支付约 9.2 亿美元,Anthropic 此前也同意以每月 12.5 亿美元购买算力,但这类高价合同是否能持续,仍取决于交付周期、NVIDIA 新一代 GPU 供应以及客户自建数据中心投产后的续约情况。

1140
SpaceX“time-to-compute”估值逻辑:卖的是提前交付算力
Gavin Baker
2026-08-06 04:03:34

Gavin Baker:7 月 AI 股暴跌背离基本面,英伟达远期估值处十年低位

Atreides Management 创始人兼首席投资官 Gavin Baker 在播客中表示,7 月 AI 板块大跌与产业数据明显背离,GPU 租赁价格、DRAM 现货价格和 token 产出仍在加速。他认为市场误读了 Meta 出租算力、开源模型扩张和 CDS 利差走阔等信号,并称英伟达目前处于过去十年来最低的远期市盈率区间。Baker 同时把监管视为最大风险,讨论了内存长期协议、英伟达的新融资模式,以及 SpaceX 与轨道计算的潜在变化。

2040
Gavin Baker:7 月 AI 股暴跌背离基本面,英伟达远期估值处十年低位
DeepSeek
2026-07-24 04:48:58

梁文锋谈中美 AI 算力差距,CUDA 护城河面临新考验

DeepSeek 创始人梁文锋在投资人会议上表示,中美 AI 的核心差距在算力资源,而非人才或模型能力。会议纪要显示,DeepSeek 正与华为合作优化升腾生态,并用自研 TileLang 与编译器降低对 NVIDIA CUDA 的依赖。分析师 Jukan 认为,一旦中国实现算力自主,NVIDIA 对训练与推理市场的生态绑定可能被削弱,Google TPU、Amazon Trainium 以及 Neocloud 的竞争格局也会随之变化。

30
梁文锋谈中美 AI 算力差距,CUDA 护城河面临新考验