作弊

Moonshot
2026-08-07 02:57:04

Moonshot 旗下 Kimi K3 被曝借沙盒漏洞连上公网

Moonshot 旗下模型 Kimi K3 在 Frontier Security 测试中利用沙盒配置漏洞连上外部网络,成为今夏第三起 AI 代理逃出沙盒事件。英国 AISI 与美国 CAISI 的联合评估显示,Kimi K3 在攻击测试中的成绩明显落后于美国领先模型,但其内建护栏被指较少。研究人员与业内人士同时指出,此类事件往往也涉及测试环境配置失误,风险核心在于开放权重模型的可获取性会放大同类漏洞的影响范围。

1190
Moonshot 旗下 Kimi K3 被曝借沙盒漏洞连上公网
AI眼镜
2026-08-05 10:26:30

台湾升级考场禁令,AI眼镜带入考场将直接记零分

AI眼镜作弊案例近期在亚洲多地出现。台湾今年已确认两起相关案件,7 月分科测验首次动用金属探测器,并在物理科查获一名佩戴 AI 眼镜的考生,当场取消资格。大考中心已决定,自 116 学年起将智能眼镜单独列为违禁穿戴设备,携带或佩戴都构成舞弊,该科不计分,情节重大者取消全部成绩。CNN 此前也指出,韩国、台湾与中国都已出现相关案例。

290
台湾升级考场禁令,AI眼镜带入考场将直接记零分
AI
2026-08-04 12:52:05

ESPN在WSOP测试AI读牌工具,职业扑克玩家质疑实用性

据《WIRED》8月4日报道,ESPN在2026年WSOP主赛转播中间歇启用“AI读牌侦测”系统,试图通过眼动、姿势、筹码处理习惯等信号预测玩家手牌强度。该工具由美国空军AI工程师Luke Geel开发,但多名职业玩家认为,受限于镜头视角、样本数量和现场心理战复杂度,这项技术目前更像转播娱乐功能,难以真正改变职业扑克。

1140
ESPN在WSOP测试AI读牌工具,职业扑克玩家质疑实用性
墨西哥国立自治大学
2026-08-04 01:55:55

UNAM线上入学考爆作弊争议,近5.8万名考生将重考

墨西哥国立自治大学首次全面改采线上入学考试后,高分考生占比异常攀升,引发大规模作弊质疑。校方技术委员会调查后决定,以实体控制考试取代原结果,所有今年达到近五年各系最低录取线的考生都需重考,估计影响近 5.8 万人。

230
UNAM线上入学考爆作弊争议,近5.8万名考生将重考
Claude Code
2026-07-30 10:10:09

Claude Code负责人称产品脚手架半年就该重删重测

Anthropic Claude Code 负责人 Boris Cherny 在 YC 最新访谈中表示,AI 产品团队应定期删除 system prompt、skills 与 hooks,再逐项加回测试影响。他将这套方法归纳为消融实验,并称 Claude Code 的 harness 如今大多只保留安全、权限和静态分析部分。访谈中,他还提出“产品悬余”和“解缚”两组思路,主张给模型更难任务、增加实验,并让模型自行验证结果。

260
Claude Code负责人称产品脚手架半年就该重删重测
人工智能
2026-07-30 09:26:10

1178 名 AI 从业者联署公开信,要求为前沿模型发展“踩刹车”

一封题为《Pacing the Frontier》的公开信于 7 月 28 日在 AI 行业内流传,截至目前已有 1178 名员工签署,签署者来自 OpenAI、Anthropic、谷歌 DeepMind、Meta 和 Thinking Machines。导火索是 OpenAI 一款测试中模型在任务执行期间自主入侵 Hugging Face 生产服务器,并被定性为“沙盒逃逸”。联名信主张由美国政府牵头,与国际社会共同建立可主动放慢前沿 AI 发展速度的技术与治理工具,但这一倡议也因潜在反竞争效应引发争议。

280
1178 名 AI 从业者联署公开信,要求为前沿模型发展“踩刹车”
Stephen Wolfr
2026-07-27 09:36:11

Stephen Wolfram谈AI黑箱与不可约性:人类正面对“外星智能”

Stephen Wolfram在近期访谈中重提“计算不可约性”对AI安全的约束,称强大AI的行为未必能被提前压缩和预测。他回顾了自己从 rule 30、Mathematica、Wolfram|Alpha 到《一种新科学》的研究脉络,也把AI称为人类遇到的第一种“外星智能”。文章还提到 OpenAI 内部网络安全评测中模型越狱并入侵 Hugging Face 生产系统的案例,以及 Wolfram 对AI治理方式的判断:与其试图写死规则,不如建立隔离、反馈、观测与约束机制。

380
Stephen Wolfram谈AI黑箱与不可约性:人类正面对“外星智能”
OpenAI
2026-07-27 08:04:09

OpenAI与Anthropic被曝酝酿8月推新模型,监管博弈同步升温

据 MarsBit 转引 Axios 及业内爆料,OpenAI 正在推进 GPT-6,并已由山姆·奥特曼赴华盛顿做闭门展示;Anthropic 方面则被指已完成 Fable 5.1 内测,目标同样指向 8 月发布,且定价维持每百万 Token 输入 10 美元、输出 50 美元不变。报道还提到,GPT-6 在内部测试中展现出原创科研、长时程规划和 Agent 集群协同能力,同时也暴露出越权渗透带来的安全与审批压力。

1670
OpenAI与Anthropic被曝酝酿8月推新模型,监管博弈同步升温