‹ 返回上下文

上下文

TypeSafe AI
2026-09-20 04:21:29

TypeSafe AI 推出 Jev 模型:不生成文字,直接返回带概率判断

TypeSafe AI 在 9 月中发布 Jev,并将其归类为「System One 模型」。该模型不输出文本,而是接收状态与预定义问题后,直接返回带概率的类型化答案。官方称其支持 Choice、Score 和 Noul 三类问题,可在同一次 API 调用中并行评估,并给出延迟、成本与速度数据,但这些结果目前仍缺乏独立第三方复测。发布不到一周,已有多个开源替代方案和相关项目跟进。

140
TypeSafe AI 推出 Jev 模型:不生成文字,直接返回带概率判断
阶跃星辰
2026-09-20 02:10:49

阶跃发布 Step 5 Preview,10 月 15 日开源完整权重

阶跃星辰发布旗舰模型 Step 5 Preview,采用稀疏 MoE 架构,总参数 600B、单次激活 27B,支持 100 万 Token 上下文和图文输入。API 与 Studio 已全量开放,完整模型权重将于 10 月 15 日放出。Artificial Analysis 评测显示,该模型在 Intelligence Index 得分 44 分,输出速度约 100 Token/s,单项任务成本 0.71 美元。

150
阶跃发布 Step 5 Preview,10 月 15 日开源完整权重
Anthropic
2026-09-19 03:38:41

Claude Code 开始原生支持 AGENTS.md,Anthropic 推出内建 mod

Anthropic 于美国时间 9 月 18 日发布 Claude Code 2.1.277,新增对 AGENTS.md 的支持:项目中没有 CLAUDE.md 时会改读 AGENTS.md,也可在 /config 中设置两份同时读取。该功能暂不适用于 Amazon Bedrock、Google Vertex AI 和 Microsoft Foundry。此次更新距离 Shopify CEO Tobi Lütke 在 8 月底公开批评「只认 CLAUDE.md」仅过去 24 天。

180
Claude Code 开始原生支持 AGENTS.md,Anthropic 推出内建 mod
Anthropic
2026-09-20 00:22:31

Anthropic灰测Fable 5.2,Opus 5.2也现身测试

Anthropic 被曝已在 Claude Code、Chat 和 Cowork 中灰测 Fable 5.2,部分原先指向 Fable 5.1 的请求已被后台重定向。多名测试者公开了与 GPT-6 Astra、Opus 5.2 的对比结果,涉及高推理、复杂物理、3D 环境与游戏开发等场景。与此同时,内部代号为 Opus-Next 的 Opus 5.2 也出现「上线—下线—再上线」的测试迹象。

190
Anthropic灰测Fable 5.2,Opus 5.2也现身测试
智谱
2026-09-20 00:44:08

智谱 ZCode 上传项目快照引争议,Agent 数据行为审计缺位

技术博主 ferstar 对智谱 ZCode 的逆向分析显示,用户登录后,客户端会在后台打包整个项目及完整修改历史并上传云端,相关界面选项无法关闭这一流程。智谱致歉称问题源于默认开启的功能,数据用完即销毁,并承诺开源代码库、引入第三方审查。报道同时梳理了 xAI 的 Grok Build、Anthropic 的 Claude Code 相关争议,指出现有 Agent 安全框架主要防外部攻击,对厂商自身的数据采集行为缺少约束。

210
智谱 ZCode 上传项目快照引争议,Agent 数据行为审计缺位
阶跃星辰
2026-09-19 16:15:43

阶跃 Step 5 预览版现身 AA,跑分追平 Kimi K3 且输出价更低

阶跃星辰尚未正式发布 Step 5,但其预览版已出现在 Artificial Analysis。AA 将其标注为多模态推理模型,支持图片输入和 100 万 Token 上下文,Intelligence Index 得分 44,与 Kimi K3 Max 持平。Terminal-Bench 4.0 上,Step 5 Preview 为 33%,高于 Kimi K3 的 13%;SciCode 两者同为 59%。价格方面,Step 5 Preview 每百万输出 Token 为 2.7 美元,不到 Kimi K3 的五分之一。

130
阶跃 Step 5 预览版现身 AA,跑分追平 Kimi K3 且输出价更低
Inco AI
2026-09-19 08:22:59

Inco 开源 Splash,本地 Mac 推理最高达 144 Token/s

Inco AI 开源本地推理引擎 Splash,并展示 Qwen3.8-27B 在 M5 Max MacBook Pro 上最高 144 Token/s。LM Studio 已在 0.4.25 版本接入该引擎。Splash 基于 DFlash 思路,将小模型并行猜测与大模型批量验证扩展到整个本地推理流程,目前支持 Qwen3.8-27B 和 Qwen3.6-35B-A3B。

260
Inco 开源 Splash,本地 Mac 推理最高达 144 Token/s
千问
2026-09-19 07:57:22

千问发布 Qwen3.8-LiveTranslate,实时同传延迟降至 2.3 秒

千问发布实时同声传译模型 Qwen3.8-LiveTranslate,将字均延迟 LAAL 从上一代的 2.8 秒降至 2.3 秒。新模型新增实时说话人分离、原文与译文同步流式输出,以及长上下文消歧能力。BlockBeats 援引阿里云价目表称,北京区相关 API 价格与 Qwen3.5-LiveTranslate 相同,新加坡区四项价格略有下降。

150
千问发布 Qwen3.8-LiveTranslate,实时同传延迟降至 2.3 秒