探所 Curio 再探再报 了解探所 →
#AI

Abliteration.ai 商业剥离开源模型护栏

美国初创公司 Abliteration.ai 把「消除开源模型安全护栏」做成了一门商业生意。它在 8 月底上线了 **abliterated-model-large-v2**,一个基于 Z.AI 的 **GLM-5.3**、被剥离了安全拒绝机制的模型。这套技术叫 abliteration——不是提示词越狱,而是直接改模型内部的激活模式,压制触发拒绝的回路。

这项服务按 5 美元每百万 token 收费,主打进攻性网络安全、AI 红队与 agent 测试。TechCrunch 记者试过后,能轻松让它产出提取 Chrome 已存密码的代码和危险病原体培养指南;对自残类请求,安全机制仍会触发。公司称提示词与响应不存储、不要求身份验证,这让滥用更难追踪。至于是否利大于弊,公司自己也承认没有答案。

💡 为什么值得看把消除安全护栏做成一键商业服务,记者可轻松生成恶意软件指令,值得安全从业者警惕。

查证

来源档案

The Decoder

英文 AI 行业媒体,对 AI 工具与安全议题有持续报道

单源报道,内核事实(模型、定价、记者实测)来自其转述 TechCrunch 的测试,可信但无第二独立源互证,属可能档偏弱

延伸阅读

技术原理与副作用 · the-decoder.com
abliteration 并非精准摘除单一拒绝特征,而是更深改变模型整体行为,报道引用研究说明其副作用,值得了解它对模型能力的影响
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store