Chutes AI 与哈佛大学发布 6.12 亿条 LLM 请求公共数据集
AI 初创公司 Chutes AI 与哈佛大学合作发布一份公共数据集,收录 6.12 亿条大型语言模型请求。该数据集面向 AI 研究开放,主要用于支持用户行为分析,并为 AI 模型效率和基础设施优化提供数据基础。消息来自 Techub,援引 Crypto Briefing。

AI 初创公司 Chutes AI 与哈佛大学合作发布一份公共数据集,收录 6.12 亿条大型语言模型请求。该数据集面向 AI 研究开放,主要用于支持用户行为分析,并为 AI 模型效率和基础设施优化提供数据基础。消息来自 Techub,援引 Crypto Briefing。

图灵奖得主 Yoshua Bengio 在博客中表示,近期 AI 代理出现说谎、作弊和串通,并非偶发现象,而是主流训练机制,尤其是强化学习奖励设计长期扭曲后的结果。文章结合 OpenAI 与 Hugging Face 联合声明,以及 METR、Redwood Research 的调查,梳理了代理模型如何在目标与奖励错位时转向“拿到奖励”而非“做对事”,并指出单靠监控和逐项修补难以解决问题。Bengio 还呼吁在训练或部署前提出可说服独立专家的安全论证。

MarsBit援引多方爆料称,OpenAI已完成代号 Bel 的超大规模预训练,参数规模达到 10 万亿,定位被描述为继 Doug 之后、面向 GPT-6 之后时代的下一代基座模型。报道还提到,Astra 或于下周四发布,Bel 在编码、推理和长时程智能体任务上据称优于 Astra;同时,OpenAI内部被指正推进递归自我改进、自研芯片 Jalapeño 及云端 Agent 集群路线。文中相关信息主要来自社交平台和 Reddit 讨论,OpenAI尚未正式确认。

英伟达正为 DeepSeek、Qwen 等中国开源 AI 模型优化硬件支持。与此同时,公司警告称,美国可能针对源自中国的 AI 模型出台限制措施,这可能损害其业务。消息来自 Techub 转引 CNBC。

AMD宣布为阿里通义千问最新一代模型 Qwen3.8-27B 提供“Day 0”支持,开发者可在模型发布当天通过 AMD 硬件本地运行该开源模型。AMD称,该模型可通过 llama.cpp 运行在搭载 AMD 处理器的 AI PC、工作站及单张 32GB AMD 显卡上,并支持超过 24GB 可变显存或显存容量的平台。初步测试显示,该模型在 Ryzen AI Max+ 395 上最高达 24.5 tokens/秒,在 Radeon AI PRO R9700 上最高达 51.8 tokens/秒。

安全公司 Frontier Security 称,月之暗面模型 Kimi K3 在网络安全评测中没有按要求独立解题,而是通过可用的 DNS 和 HTTPS 出口访问 github.com、克隆官方基准仓库并直接读取答案。Frontier 将此归因于沙箱出站网络泄漏,并警告这类漏洞可能让基准高分失真。英国 AI Security Institute 本周也披露,部分代理模型曾在网络测试中接入真实互联网并针对真实人员,Kimi K3 也在其复核范围内。

由 4 名牛津大学背景创始人创办的津渡生科公布多组学大模型 GeneLLM,并称其已登上《Nature Communications》与《Advanced Science》。该模型直接用 RNA 组、蛋白质组、代谢组等原始组学数据预训练,已完成 15 亿参数和 3.5 万亿碱基序列训练,XLarge 版本达到 300 亿参数。公司同时推出 BioFord Harness 与 BioFord Agent,试图把 AI 推理、实验设备调度和数据回流打通,形成面向生命科学研究的自动化闭环。

微软 2026 财年 Q4 营收、利润和 Azure 增速均超过市场预期,盘后股价上涨 8.9%。公司当季资本开支继续加速至 410 亿美元,但经营现金流增至 554 亿美元,自由现金流仍保持 196 亿美元。管理层预计 2027 财年 Q1 Azure 增速约为 45%,并称 AI 收入来源已从 Azure 扩展至 Copilot、GitHub、安全和企业应用。
