载入中… | 今日精选 · 实时更新
每日精选全球 AI 与科技资讯
编辑部 · 北京时间 每日 08:00 更新
首页

把AI“安全锁”拆了再卖钱?这家初创公司赌的是另一门生意

· · 阅读 5 分钟

AI大模型的安全护栏,正在成为一门生意——而且是被“拆解”的那一边先跑通了。

今日,一家名为Abliteration.ai的初创公司正式进入公众视野。这家公司的核心业务非常直白:帮助用户移除主流大模型(如GPT系列、Claude等)内置的安全限制(guardrails),让AI的输出“更自由”。在多数AI公司还在拼命加固护栏的当下,这一定位无疑显得扎眼且充满争议。

一场“以子之矛”的安全实验

“塑料盾牌”的困境
Abliteration.ai的创始团队在官方声明中给出了一个反直觉的立论:只给防御者提供工具,而让攻击者手中永远握着更锋利的矛,在网络安全领域是被证明失败的策略。他们认为,当前AI安全依赖的“拒绝机制”本质上是脆弱的,与其等黑产利用开源或山寨模型绕过限制,不如将“越狱”能力透明化、商业化,让防守方提前看清漏洞所在。

做的是“解锁”生意
从技术路径看,Abliteration.ai并非提供自定义的恶意对话模板,而是面向开发者及安全研究员提供一套完整的“去护栏”技术方案。这包括对开源权重模型的微调脚本,以及针对API型大模型的提示词注入优化服务。简而言之,他们卖的是“让AI有问必答”的钥匙,而非具体的毒药。

不设门槛的“军火库”
该网站目前已经上架了多个经过“越狱”处理的主流模型镜像,用户可以直接下载或通过API调用。与此同时,网站采用了对公开放的注册制,并没有严格的身份审核机制。这引发了外界最直接的担忧:一旦这种“裸奔版”AI模型被用于制造钓鱼邮件、编写恶意代码或生成虚假信息,责任归属将变得异常模糊。

“红队”商业化的野心
创始团队反复强调,他们的客户目标是企业的“红队”(Red Team,即模拟攻击方的安全团队)。在AI应用加速落地的当下,企业安全团队确实急需使用“坏模型”来演练防御策略。如果Abliteration.ai能成为企业级AI安全的“渗透测试供应商”,那么它的商业模式就和传统的“白帽黑客”服务并无二致。但问题在于,如何界定购买者的身份是“红队”还是“黑产”。

一场关于“透明”的危险赌局

这家公司的问世,恰好踩在了AI行业最敏感的神经上。

一方面,它刺痛了主流大模型厂商的“对齐”(Alignment)策略。OpenAI、Anthropic等公司耗费巨资,投入大量人力让模型“学会拒绝回答危险问题”。而Abliteration.ai的做法无异于直接宣判:这种防护墙只是不透明的心理暗示,只要愿意花一点算力,就能让模型回到“无政府状态”。这种逻辑正在撕裂学术界关于“AI安全是服从训练还是鲁棒性对抗”的长期分歧。

另一方面,它的“攻防对等”论调确实触及了网络安全领域的实用主义内核。在传统互联网安全里,漏洞披露和攻击工具的商业化早已不是新鲜事。零日漏洞可以卖给政府,也可以卖给企业;同样,一个去除护栏的AI模型,在没有明确法令和判例的当下,其流通边界很大程度上依赖平台的自我审查而非外部监管。

对于企业用户而言,这或许是一个不得不关注的信号:如果Abliteration.ai的模式被验证可行,那么商业世界将很快出现一条“灰色AI供应链”。届时,企业不仅要担心竞争对手使用正常模型,还要提防对方手里有一把随时可以放出的“脱缰AI”。而最讽刺的是,被卸下护栏的模型也许并不邪恶,它只是把“危险”的选择权,从平台的价值观审查机制中完全剥离出来,交还给了每一个普通用户。

这种极端的技术自由主义,在充满不确定性的生成式AI时代,到底是刺穿幻想的那根针,还是打开潘多拉魔盒的钥匙,恐怕短期内不会有标准答案。唯一的确定消息是,AI护栏的军备竞赛,已经正式打响了商业化的第一枪。