腾讯混元Hy4 Preview上线B.AI API,全量开放接入
9月2日,B.AI宣布腾讯混元Hy4 Preview正式上线API服务,全量开放给开发者。该模型采用770B稀疏MoE架构,每Token激活49B参数,支持1M上下文,覆盖软件工程Agent、办公数据工作流、游戏开发与科学研究等场景。即日起可通过B.AI API调用,亦可登录chat.b.ai/chat体验。B.AI称将继续引入前沿模型。

9月2日,B.AI宣布腾讯混元Hy4 Preview正式上线API服务,全量开放给开发者。该模型采用770B稀疏MoE架构,每Token激活49B参数,支持1M上下文,覆盖软件工程Agent、办公数据工作流、游戏开发与科学研究等场景。即日起可通过B.AI API调用,亦可登录chat.b.ai/chat体验。B.AI称将继续引入前沿模型。

9月1日至2日,多项与加密监管、市场和基础设施相关的进展集中出现。美国SEC拟更新注册过户代理规则以适应区块链和代币化证券,G20财长和央行行长在主席声明中认可数字资产对经济增长的潜力。与此同时,花旗、高盛等21家机构计划设立稳定币合资公司,TRM Labs获得美国土安全部9500万美元合同后遭Chainalysis起诉,比特币ETF 8月净流入约35亿美元,市场、融资、链上产品和安全事件也同步推进。

Anthropic 于 9 月 1 日推出 Claude Fable 5.1 与 Claude Mythos 5.1,两款模型基于同一底层架构,但安全防护等级不同。官方称,新版在程序编写与长时程推理上提升明显,缓存读取价格从约 1 美元降至 0.25 美元,降幅达 75%。其中,Fable 5.1 面向一般开发者,网络安全误拦率减少约 60%;Mythos 5.1 则通过邀请制向受信任的网络安全与生物技术研究机构开放。

Codex在代码库中新增了_context工具,并配合工作注释与历史查询能力,显示Codex CLI可能正在测试新的长任务记忆方案。按现有线索,系统在上下文窗口接近上限时将切换到新窗口,同时保留完整历史记录供查询。OpenAI官方文档截至发稿仍将compaction列为长任务上下文管理机制,文中判断这更像是准备转向或测试阶段,而非已全面上线。

Nvidia在台北国际电脑展发布基于Arm架构的RTX Spark超级芯片,可本地运行1200亿参数大模型,支持100万token上下文。该芯片面向3000至4000美元高端笔记本,借助统一内存与CUDA生态,目标打破苹果M系列在本地AI处理市场的主导地位,推动AI负载向个人设备迁移。

腾讯发布混元Hy4 preview,采用MoE架构:总参数770B、激活49B,上下文1M,规模约为上代两倍多,长上下文约4倍。模型主攻代码、办公、游戏、科研等真实任务,可搭Three.js网站、做Unity游戏Demo、一次处理72份财务文件。Hy4与WorkBuddy、CodeBuddy等产品共同迭代,并参与自身研发;已接入元宝、ima、腾讯云TokenHub、OpenRouter。

Cohere 发布文档解析模型 Parse 5,面向大规模企业文档处理。该模型为 23 亿参数视觉语言模型,支持 PDF、PPT 和 JPEG 页面输入,直接输出包含文本、表格、列表和图像描述的 Markdown 内容,无需单独 OCR 预处理。Parse API 定价为每 1000 页 1.5 美元,已在 Cohere Parse API、Microsoft Foundry、AWS SageMaker 和 Model Vault 提供。

Google 在 2026 年 I/O 大会上发布 Gemini 3.5 Transcribe 语音转文字模型,支持情绪检测、说话人识别、时间戳标记和翻译。该模型提供 96K Token 上下文窗口,可处理长音频文件,适用于会议记录和法律取证等场景。Google 同时表示,实时转录应使用 Cloud Speech-to-Text API,而不是这款模型。
