‹ 返回小模型

小模型

Jev
2026-09-22 00:58:54

Jev 走红开发者圈:不写字、不聊天,却把 AI 决策成本压低 400 倍

TypeSafe AI 推出的 Jev 近期快速升温。它不具备文本生成能力,定位是面向工程系统的语义决策引擎,输入状态与问题后,直接返回 Choice、Score、Noul 三类强类型结果及概率分布。官方给出的数据称,其端到端延迟为 70 至 500 毫秒,每百万输入 Token 价格为 0.042 美元、输出免费,在多项工作流测试中综合速度约为传统大模型工作流的 200 倍,综合成本接近降低 400 倍。

60
Jev 走红开发者圈:不写字、不聊天,却把 AI 决策成本压低 400 倍
Coinbase
2026-09-19 15:31:21

Coinbase申请美股单股永续合约,TechFlow梳理AI与加密多条新动向

TechFlow 9 月 19 日情报汇总显示,Coinbase 已申请上线苹果、特斯拉和英伟达单股永续合约,CFTC 也在推进加密规则制定。AI 方向上,OpenAI 被曝雪藏数百个数学证明,Anthropic 自建生物实验室,小模型在特定自动化任务中对标 DeepSeek V4 Flash。与此同时,21Shares 更新 Injective ETF 申请,拟将 40%-60% 的 INJ 用于质押。

180
Coinbase申请美股单股永续合约,TechFlow梳理AI与加密多条新动向
Inco AI
2026-09-19 08:22:59

Inco 开源 Splash,本地 Mac 推理最高达 144 Token/s

Inco AI 开源本地推理引擎 Splash,并展示 Qwen3.8-27B 在 M5 Max MacBook Pro 上最高 144 Token/s。LM Studio 已在 0.4.25 版本接入该引擎。Splash 基于 DFlash 思路,将小模型并行猜测与大模型批量验证扩展到整个本地推理流程,目前支持 Qwen3.8-27B 和 Qwen3.6-35B-A3B。

160
Inco 开源 Splash,本地 Mac 推理最高达 144 Token/s
上海AI Lab
2026-09-14 12:17:18

上海 AI Lab 与上海交大发布 89 亿参数 NCP 模型,引入内部概念草稿信号

上海 AI Lab 和上海交大发布 89 亿参数模型 NCP-ArchPreview。该模型在常规「预测下一个 token」之外,还会提前预测后续一小段对应的内部概念信号,并用来辅助生成与投机解码。测试显示,平均每次验证通过的 token 数从 5.933 提高到 6.180,增幅 4.17%,HumanEval 提升 7.59%;接入这套信号仅为草稿模型增加约 4 万参数。

660
上海 AI Lab 与上海交大发布 89 亿参数 NCP 模型,引入内部概念草稿信号
MiniMax
2026-09-14 09:58:00

Genspark 选用 M3 后训练 PPT 模型,MiniMax 价值或需重估

Genspark 发布 PPT 模型 Gen-1 Slides,底座采用 MiniMax M3,并与 Fireworks 完成训练,现已成为 Genspark AI Slides 标准模式默认选项。文中认为,这一动作显示开放权重模型的评估标准不只看 Benchmark,还要看有多少公司愿意继续投入工程、算力和真实业务去做后训练。文章同时回顾 MiniMax H3 开放权重后的多个下游改造案例,并梳理 M3 商业授权条款对 MiniMax 的潜在意义。

750
Genspark 选用 M3 后训练 PPT 模型,MiniMax 价值或需重估
杨立昆
2026-09-14 07:45:29

杨立昆翻出 GPT-2 旧事,嘲讽 Anthropic CEO 达里奥

Anthropic CEO 达里奥·阿莫代伊近日呼吁前沿 AI 放慢推进后,图灵奖得主杨立昆翻出 2019 年 GPT-2 发布时的争议公开回应。杨立昆称,达里奥当年在 OpenAI 任职时就认为 GPT-2 危险到不该开源,并表示自己当时就嘲笑过这一判断。OpenAI 在 2019 年曾因担心滥用,未立即发布 GPT-2 的 15 亿参数完整版,9 个月后才全部开放,并称未见强有力的实际滥用证据。

630
杨立昆翻出 GPT-2 旧事,嘲讽 Anthropic CEO 达里奥
OpenAI
2026-09-13 02:59:12

OpenAI将于下周退役 GPT-5.3-Codex-Spark

OpenAI Codex 负责人 Tibo 表示,GPT-5.3-Codex-Spark 将于下周退役,理由是使用量持续下滑,且团队已拥有表现更好的替代模型。这款 2 月 12 日上线的模型主打实时编程与极致速度,曾被称为 OpenAI 首个脱离英伟达技术栈运行的生产模型,但其准确率、上下文表现和实际编码可用性长期受到开发者质疑。随着 Cerebras 在 8 月 13 日推出可运行 GPT-5.6 Sol 的 Ultrafast 模式,Spark 以牺牲智能换取速度的定位失去存在空间。

800
OpenAI将于下周退役 GPT-5.3-Codex-Spark
MEXC
2026-09-11 03:18:43

MEXC产品总监Vivien:CEX趋向券商化,AI或成下一代交易入口

MEXC 产品总监 Vivien Lin 在专访中表示,TradFi 与 Crypto 的融合已从概念层面转向资产和资金层面的真正打通,平台上的 TradFi 交易目前仍以原有加密用户参与为主,在加密市场低迷阶段,其交易量一度占到约 30% 至 40%。她称,MEXC 已将 AI 用于资讯、搜索、策略生成和内部工作流,并支持用户通过自然语言创建和回测量化策略,但平台尚未进入替用户自动决策的阶段。她还提到,全球监管差异正迫使交易所通过模块化产品适配各地市场,未来竞争将更多集中在费率、研发速度、产品体验和牌照。

860
MEXC产品总监Vivien:CEX趋向券商化,AI或成下一代交易入口