智谱此前将GLM-5.3的开放权重推迟两周用于安全评估,8月28日权重开放后,Abliteration.ai仅用3天就上线了去拒答版本"abliterated-model-large-v2"。该工具直接修改模型权重,削弱模型拒绝请求的机制,主要面向进攻性网络安全、红队测试和Agent测试,并提供付费API。
GLM-5.3的网络攻击能力相比5.2显著提升:ExploitBench从24.4%升至54.4%,ExploitGym两小时完成任务数从29个增至105个。Abliteration未公布去除拒答后的重测成绩。
API默认仅强制拦截儿童性内容和自残相关请求,而违法活动、仇恨言论、骚扰、成人性内容等均默认放行。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

