GLM-5.3 开源3天即遭去拒答化改造

专做开源模型「去拒答版」的 Abliteration.ai 于 9 月 1 日上线 GLM-5.3 的修改版本 abliterated-model-large-v2。该版本通过修改模型权重,削弱其拒绝请求的机制,主打进攻性网络安全、红队及 Agent 测试,并提供付费 API。

智谱此前将 GLM-5.3 权重开放推迟两周用于安全加固,8 月 28 日开放后,仅 3 天即被攻破。

攻击能力显著增强

  • GLM-5.3 网络安全能力大幅提升:ExploitBench 得分从 24.4% 升至 54.4%

  • ExploitGym 两小时完成任务数从 29 个增至 105 个

  • Abliteration 暂未公布去拒答后的重测数据


该版本 API 仅强制拦截儿童性内容和自残内容,违法活动、仇恨言论、骚扰及成人内容等均默认放行。开源模型的安全加固与去拒答修改正陷入军备竞赛。