美团低调上线LongCat-2.0,传以5万至6万张国产卡训练
美团在未发新闻稿、未开源的情况下,上线LongCat-2.0-Preview。该模型面向AI Agent,支持1M上下文,消息称训练全程基于国产算力集群,动用5万至6万张国产加速卡。

美团在未发新闻稿、未开源的情况下,上线LongCat-2.0-Preview。该模型面向AI Agent,支持1M上下文,消息称训练全程基于国产算力集群,动用5万至6万张国产加速卡。

2月最后一周,Google、Amazon、Meta、Microsoft合计承诺约6500亿美元投入AI基础设施,多家模型厂商同步发布新产品,监管也在加速跟进。

DeepSeek V4 Preview发布,SWE-bench跑分83.7%超越Claude Opus和GPT-5.2;完全基于华为升腾950芯片,输入成本低至0.3美元/百万token,仅为闭源对手1/27。

xAI的AI编程工具Grok Build在不到半个月内从v0.1迭代至v0.2.11,支持8代理并行、X平台搜索集成。同时从Cursor母公司Anysphere挖来工程与产品主管,但SWE-bench得分70.8%,显著低于Claude Code的87.6%。

DeepSeek 创始人梁文锋证实新一代旗舰模型 V4 将于四月下旬发布。模型采用万亿参数 MoE 设计,支持百万 tokens 上下文,推理速度提升 30%,并完全运行于华为升腾 950 PR 芯片,被视为中国 AI 摆脱英伟达依赖的关键一步。

Anthropic于4月16日推出Claude Opus 4.7,编码性能在SWE-bench Pro上提升至64.3%,视觉分辨率扩大三倍,1M token上下文保持原价。但API移除采样参数、改为自适应思考,引发开发者强烈不满。

乐天集团发布Rakuten AI 3.0,号称日本最大自研模型,数小时后被社群发现config.json显示model_type为deepseek_v3,实为DeepSeek V3日语微调版,日本政府资助背景引关注。

Tether将TurboQuant集成进QVAC SDK 0.12.0,称可把AI模型KV cache内存需求最高压缩5倍,并尽量不影响模型质量,重点推动本地AI与隐私敏感场景落地。
