返回模型部署

模型部署

AMD
2026-07-22 07:32:58

AMD Helios 机架报价据称较英伟达 Vera Rubin 高出 40%,微软 Azure 率先采购

AMD 推出面向 AI 工作负载的全堆叠机架方案 Helios,Futurum 基于 BOM 成本估算其单架售价约为 500 万至 550 万美元,高于英伟达第二代 Vera Rubin 机架预估的 350 万至 400 万美元。Helios 集成 GPU、CPU、AI NIC、DPU、互连和 ROCm 软件平台,微软 Azure 已确认首发部署,OpenAI、Meta、Oracle 等也出现在客户名单中。规格上,Helios 在 FP8 算力和 HBM4 容量上占优,Rubin 则在 FP4 算力和内存带宽上更高。

690
AMD Helios 机架报价据称较英伟达 Vera Rubin 高出 40%,微软 Azure 率先采购
Prime Intelle
2026-07-21 03:30:53

Prime Intellect 完成 1.3 亿美元 A 轮融资,英伟达与英特尔参投

开放式 AI 实验室 Prime Intellect 宣布完成 1.3 亿美元 A 轮融资,累计融资总额超过 1.5 亿美元。本轮由 Radical Ventures 领投,NVIDIA Ventures、Intel Capital、Dell Technologies Capital 参投。公司称,这笔资金将用于建设开放式超级智能技术栈,推进去中心化 AI 架构,并扩展强化学习、递归语言模型与训练部署一体化基础设施。

670
Prime Intellect 完成 1.3 亿美元 A 轮融资,英伟达与英特尔参投
英特尔
2026-07-10 10:39:13

英特尔发布阿里Wan2.2视频模型INT4量化版,显存需求骤降75%

英特尔在Hugging Face推出三款阿里Wan2.2视频模型INT4量化版本(T2V-A14B、I2V-A14B、TI2V-5B),通过AutoRound工具将权重从BF16压缩至INT4,显存占用降至原四分之一,有望降低视频生成部署门槛,但尚需第三方验证性能。

150
英特尔发布阿里Wan2.2视频模型INT4量化版,显存需求骤降75%