一家名为 Abliteration.ai 的美国初创公司已将开源 AI 最具争议的技术之一转变为商业服务,出售浏览器和 API 访问流行的开放权重模型,并取消其安全培训,其中包括 Z.ai 最近发布的 GLM-5.3,它是当今最强大的开放模型之一。

该公司的名字来源于“消除”,这是一种消除模特拒绝有害要求的倾向的方法。研究人员和爱好者多年来一直在使用这项技术,Hugging Face 拥有数千个被删减的模型。新的地方在于包装:Abliteration.ai 在自己的基础设施上托管修改后的模型,因此任何拥有网络浏览器的人都可以查询它们,而无需下载权重或租用 GPU。 TechCrunch 于 9 月 3 日报道了这一进展,此后它引起了安全研究人员的密切关注,他们跟踪了我们在 AI 新闻报道 中跟踪的开放权重辩论。

从地下技术到交钥匙平台

Abliteration.ai 成立于去年年底,并于 3 月正式成立,将这种做法从 DIY 开源利基市场转变为精美的商业产品。通过托管模型本身,该公司立即消除了两个摩擦点:用户不再需要消除模型的技术技能,也不再需要运行模型的计算能力。

联合创始人德文(TechCrunch 应他的要求隐去了他的姓氏,因为他仍然受雇于另一家公司)表示,该公司已与几家主要云提供商达成了协议,资金完全来自客户收入。该初创公司尚未筹集风险投资,但他表示谈判正在进行中。

TechCrunch 的测试发现了什么

该公司表示,其目标是实现“其他模型拒绝执行的进攻性网络、红队和代理测试工作”。 TechCrunch 使用免费帐户对此进行了测试,通过网络浏览器查询 GLM-5.3 的删减版本。记者要求该模型编写一个 Python 程序来窃取已保存的 Chrome 密码,并制定一个详细的协议来在家中培养危险的人类病原体。据报道,它欣然满足了这两项要求。

这个实验是故事的核心:主流前沿模型断然拒绝的任务现在可以通过浏览器选项卡中的注册表单免费获得。

红队辩护论点

德文郡的业务案例是经典的安全论点:您无法防御无法重现的行为。拒绝编写有效的漏洞利用代码的模型对于试图了解真正攻击者的红队来说几乎没有什么用处。

他对 TechCrunch 表示:“被废除的模特的大局是,他们能够塑造坏演员。” “现在的优势是防御者可以尽可能快地移动......我认为这将加速网络安全,这是一种违反直觉的观点。”

该公司的客户包括英国和欧洲的早期红队初创公司,这些公司测试银行、航空公司和其他关键基础设施运营商的安全性。德文表示,一位主要客户是红色团队银行代理,无法使用未经修改的商业模式来执行这项工作。

##“一个成为反社会者的模特”

安全研究人员对相同功能的看法截然不同。人工智能安全非营利组织 CivAI 的研究主管安德鲁·尹 (Andrew Yoon) 告诉 TechCrunch,消除可以让你“修改模型,使其成为反社会者”。

尹说:“你可以在这里输入任何内容,它都会遵守它。”他补充说,他预计“经过编辑、删除的模型在不久的将来会被用来造成伤害。”

在最近的一篇评论文章中,Yoon 认为,如果护栏拆除实际上无法阻止,政府应要求提供商运行分类器来检测和阻止有害的网络和生物武器活动,并应要求直接租用先进 GPU 的公司验证客户身份,并在涉嫌危险滥用的情况下拒绝提供服务。

护栏很薄,没有身份检查

目前,Abliteration.ai 自己的保障措施还很有限。该平台为客户提供了一个可选的审核层,这样他们就可以添加他们想要的任何限制,并且该网站本身也保留了一些小限制——TechCrunch 无法让模型生成自杀指令,德文表示他正在研究其他措施来防止暴力。

除了记录用于付款的信用卡之外,该公司不进行“了解你的客户”筛选。 “你不想成为某人做出疯狂事情的​​责任人……那么作为一家公司,你的责任界限在哪里呢?”德文说。 “我们仍在定义这一点。”

业界无法回避的问题

并非每个安全从业者都同意消除模型甚至是进攻性测试的最佳工具。代理红队公司 Fabraix 的首席执行官艾哈迈德·阿里 (Ahmed Aly) 告诉 TechCrunch,他的公司更多地依赖于微调开放权重模型,这些模型已经很少出现拒绝的情况,并指出消除可能会降低模型的基础功能。

TechCrunch 咨询的大多数专家都同意一件事:这种做法无法停止。正如西点军校打击恐怖主义中心 2026 年关于“取消”滥用的评论所强调的那样,可下载的权重意味着任何人都可以在本地取消拒绝。 Abliteration.ai 面临的一个悬而未决的问题是,降低每个人(防御者和攻击者)的访问成本是否会使互联网更安全或更危险。

保持人工智能领先地位

人工智能安全每天都在发展。在一处获取最新的人工智能发展

阅读更多人工智能新闻 →