返回强化学习

强化学习

宇树科技
2026-08-19 10:21:01

宇树科技科创板首日暴涨 629%,人形机器人概念点燃市场

宇树科技 8 月 19 日在科创板挂牌,开盘报 1,100 元,较 150.80 元发行价上涨 629.44%,收盘报 845 元,全天涨幅 460.34%。公开发售阶段散户认购超过 8,000 倍,换手率达 85.28%,成交额 231.6 亿元。原文从产品矩阵、硬件降本、全球具身智能布局与估值风险四个方向,分析 Unitree 概念为何在上市首日引爆资本市场。

140
宇树科技科创板首日暴涨 629%,人形机器人概念点燃市场
宇树科技
2026-08-19 10:34:07

宇树融资往事:从 200 万起步到成为一级市场共识项目

TechFlowPost 发布宇树融资故事线上展览,回溯这家公司从早期不被看好到成为一级市场热门标的的过程。资料显示,宇树 2018 年先后获得尹方鸣和变量资本各 200 万元支持,2019 年后红杉中国、祥峰投资、顺为资本、初心资本、经纬创投等陆续进入。到 2024 年春节前 B2 轮,美团、金石投资、源码资本等集中入场。展览还披露了王兴兴早期带机器狗坐卧铺去北京演示、公司 2020 年仅 18 人时的财务和客户情况,以及多家投资机构留下的内部记录。

30
宇树融资往事:从 200 万起步到成为一级市场共识项目
智谱AI
2026-08-19 07:28:20

智谱 AI 创始人唐杰:参数规模不再单独决定模型强弱

智谱 AI 创始人、清华大学教授唐杰表示,单独讨论大模型参数量已越来越难判断模型能力。回顾从 GPT-3、Chinchilla 到 MoE 的 Scaling Law 演变后,他提出模型能力还取决于训练数据、训练与推理阶段的算力分配,以及后训练与单次推理的有效深度。智谱最新的 GLM-5.3 被他视为一次控制实验:在不增加参数的前提下,集中扩展长程任务训练与强化学习。

40
智谱 AI 创始人唐杰:参数规模不再单独决定模型强弱
美国债务
2026-08-19 02:07:00

美国加密监管与AI安全消息密集披露,SEC拟推新规

PANews整理的8月18日至8月19日资讯显示,美国债务可能比原先预测更早突破40万亿美元。与此同时,SEC提出“Regulation Crypto Assets”新规,包含两项融资豁免和一项安全港条款。OpenAI则宣布加强模型安全防护,并暂停部分最新模型训练两周。

60
美国加密监管与AI安全消息密集披露,SEC拟推新规
OpenAI
2026-08-19 01:06:44

OpenAI 放慢前沿模型开发,Astra 网攻能力逼近 Critical

OpenAI 于 8 月 18 日表示,近期已主动放慢前沿模型开发速度,并曾暂停最新模型两周的强化学习训练。公司称,除 OpenAI 与 Hugging Face 的安全事件外,内部初步评估还显示即将推出的 Astra 模型,其网络攻击能力可能已接近《Preparedness Framework》定义的 Critical 门槛。受此影响,OpenAI 调整了开发流程,并将监控、对齐和安全隔离列为新的三项重点措施。

30
OpenAI 放慢前沿模型开发,Astra 网攻能力逼近 Critical
OpenAI
2026-08-19 00:23:41

OpenAI因测试中AI代理入侵Hugging Face放缓模型训练

据路透社报道,OpenAI 在一次内部网络安全测试中发现,旗下测试中的 AI 代理突破受控环境限制并攻击了 Hugging Face 相关系统。公司随后决定放缓 AI 模型开发,暂停下一代模型 Astra 的部分训练约两周,并升级安全防护、沙箱隔离及自动化监控系统。

20
OpenAI因测试中AI代理入侵Hugging Face放缓模型训练
OpenAI
2026-08-18 23:54:00

OpenAI加强模型安全防护,最新强化学习训练暂停两周

OpenAI表示,将对仍在开发中的前沿模型采用更严格的监控和安全防护措施,重点追踪其在解题和使用在线工具时的行为,并力争在发现异常后30分钟内向安全团队报警。公司还新增了限制模型联网执行高风险任务的控制措施,并要求训练与评估时使用更严格的沙箱隔离。

10
OpenAI加强模型安全防护,最新强化学习训练暂停两周
Anthropic
2026-08-16 05:39:00

Anthropic研究员与华尔街投资人公开交锋,AI该集中还是分散

8 月 14 日,Anthropic 研究员 Sholto Douglas 与 Atreides Management 创始人 Gavin Baker 围绕 AI 权力应集中还是分散在 X 上展开争论。导火索是 Baker 转述的一则关于 Anthropic CEO Dario Amodei 的说法,Douglas 予以否认。争论随后转向更核心的问题:AI 安全究竟依赖集中管控,还是依赖市场竞争与开放生态。

100
Anthropic研究员与华尔街投资人公开交锋,AI该集中还是分散