B.AI 上线小米 MiMo-V2.5 免费调用服务
B.AI 平台宣布,小米开源旗舰全模态模型 MiMo-V2.5 已在平台正式开启全量免费调用。该模型采用 310B 稀疏 MoE 架构,支持文本、图像、视频和音频输入,具备 1M 上下文窗口与快速响应能力。B.AI 表示,开发者可通过平台 API 官方组零成本接入,并将其集成到应用与工作流中。

B.AI 平台宣布,小米开源旗舰全模态模型 MiMo-V2.5 已在平台正式开启全量免费调用。该模型采用 310B 稀疏 MoE 架构,支持文本、图像、视频和音频输入,具备 1M 上下文窗口与快速响应能力。B.AI 表示,开发者可通过平台 API 官方组零成本接入,并将其集成到应用与工作流中。

OpenAI 下调 GPT-5.6 Sol 的 API 与超额 credits 定价,未来三个月相关价格下调超过 20%,其中输出 token 价格从每百万 30 美元降至 20 美元,降幅达 33%。Pro、Plus、Business 订阅价格与套餐内用量未作调整,缓存输入、缓存写入和长上下文档位也同步下调。同日,Codex 负责人 Tibo 披露 Codex 周活跃用户已突破 2000 万,并称团队已就社区反映的额度消耗问题启动正式调查。

ARK Invest最新周度报告聚焦三项主题:Anthropic与OpenAI的年化经常性收入继续增长,并计划借助公开市场融资支撑算力建设;Grok 4.6以更低价格接近头部模型能力,ARK认为成本衡量正从每 token 转向每完成任务;在医疗领域,Natera的MRD检测Signatera维持领先,ARK引用的数据显示其在固体肿瘤MRD市场占据约87%份额。

Generalist AI 发布机器人基础模型 GEN-1.5,称机器人只需观看 3 到 12 秒动作演示、无需训练或微调,即可当场执行任务,在 10 个操作任务中的 one-shot 平均成功率为 59%,few-shot 平均成功率为 83%。该公司两个月前完成 4 亿美元融资,李飞飞、林斌、袁征等以个人或天使投资人身份参与,英伟达也是股东。研究者将这次发布与 2020 年 GPT-3 的节点相提并论,但相关结果目前均由 Generalist AI 自行报告,尚未经过独立验证。

8月19日至20日,市场信息密集释放。币安 Alpha 开启第三波 STABLE 空投,Berachain 将稳定币 HONEY 更名为 Bera USD。美国财政部宣布扩大长期国债回购规模后,比特币一度升至 69,749 美元,CFTC同步披露执法和监管会议安排。链上方面,BTC与ETH多空头寸出现大额清算,HYPE也出现多笔疑似转所卖出。

Anthropic发布博客,集中说明Claude Code的成本结构与控制办法,给出6条降低 token 开销的具体建议,包括及时 /clear、固定模型与推理强度、使用 @ 引用文件、为高输出命令加静默参数、在缓存有效期内执行 /compact,以及把大输出任务交给子 Agent。博客还解释了输入与输出 token 的计价差异、提示缓存的工作方式与失效场景,并列出 Opus 5、Sonnet 5、Haiku 4.5 的定价。

阿里巴巴 Qwen 团队于 8 月 14 日开源 Qwen 3.8-27B,并以 Apache 2.0 授权发布,支持商业使用。该模型约有 278 亿参数,支持文本、图片和视频理解,原生上下文窗口为 262,144 个 token,可扩展到 100 万。按官方模型卡,在部分编程与代理基准测试中,Qwen 3.8-27B 分数高于 Claude Opus 4.6 Max,但相关结果仍属于厂商自报,且测试条件并不完全一致。

小红书 AI 实验室 dots.studio 宣布开源 dots3-note preview。该模型采用 2800 亿参数 MoE 架构,激活参数 160 亿,支持 51.2 万上下文窗口以及文本、视觉、音频多模态理解。模型权重已上线 Hugging Face,API 已接入 OpenRouter。SemiAnalysis 图表显示,该模型在 Terminal-Bench 2.1 中得分 75.1,较图中表现最好的美国开放权重模型高 4.9 分。
