AI 快讯,专门制作开源模型「去拒答版」的 Abliteration.ai 上线 GLM-5.3 的去拒答版本 abliterated-model-large-v2。该版本通过直接修改模型权重,削弱其拒绝请求的机制,主打进攻性网络安全、红队和 Agent 测试,并提供付费 API。
智谱此前将 GLM-5.3 的开放权重推迟两周,用于安全评估和加固。8 月 28 日权重开放后,Abliteration 仅用 3 天便成功攻破。
GLM-5.3 的网络攻击能力本就大幅领先 5.2 版本:ExploitBench 得分从 24.4% 跃升至 54.4%,ExploitGym 两小时任务完成数从 29 个增至 105 个。目前,Abliteration 尚未公布去拒答后的重测成绩。
其 API 默认仅强制拦截儿童性内容和自残相关内容,违法活动、仇恨言论、骚扰及成人性内容等均默认放行。