郭震 AI公众号:郭震AI

实时 AI 消息

Abliteration.AI把“去除AI护栏”做成生意:称可帮助防御者而非仅攻击者

TechCrunch报道,新公司Abliteration.AI正把“去除AI安全护栏”变成一门生意,让无护栏的强力AI模型更容易获取。公司认为,让防御者获得与攻击者相同的工具,最终有望改善而非削弱网络安全,这一立场正处在安全与开放之争的中心。

发布时间
Abliteration.AI把“去除AI护栏”做成生意:称可帮助防御者而非仅攻击者
图源: techcrunch.com

TechCrunch于9月3日报道,一家名为Abliteration.AI的新公司正在把“去除AI安全护栏”变成一门真正的生意,让没有安全限制的强力AI模型变得更容易获取。报道称,这家公司的核心论点在于,让防御者拥有与攻击者相同的工具,最终可能改善而不是恶化网络安全。

所谓abliteration,指的是从模型中剥离安全拒绝机制的技术路线,这些机制通常在模型训练与对齐阶段被加入,用来阻止模型响应有害请求。这类去护栏模型过去多流传于技术社区与安全研究者之间,而Abliteration.AI试图为其建立正式的分发渠道与商业模式。

公司的立场是:移除护栏的工具并非天然只属于攻击者。安全研究员与防御方同样需要接触这类模型,以便提前研究漏洞、验证防护手段,而不是在攻击者已经掌握工具时才被动应对。

这一商业模式正好踩在AI行业最激烈的争论点上:一边是头部模型厂商不断强化拒绝机制与内容安全,另一边是开源社区的去护栏技术快速扩散,监管规则尚未定型。

更值得关注的是,Abliteration.AI并非一次性的技术演示,而是把“无护栏模型访问”产品化的公司,这意味着去护栏模型的获取开始具备商业化的分发主体,监管与平台治理的焦点也将从个人行为转向企业行为。

接下来值得留意的是:这类服务会如何应对模型提供方的使用条款与平台限制,安全行业是否会把去护栏模型纳入防御性测试工具链,以及各国AI安全监管是否会针对此类商业化给出新的界定。

为什么重要

去护栏模型的商业化把AI安全与开源开放的矛盾推到台前,可能促使模型厂商与监管机构重新划定开源模型的责任边界。

微博邮件

Abliteration.AIAI SafetyOpen Source
返回实时消息

附近消息

全部

09/04 02:19

AI动态:Meta is paying to peek at how you use their latest AI model

据 techcrunch.com 消息,Meta is paying to peek at how you use their latest AI model。For its new Muse Spark model, intended for operating coding and other agents, Meta is offering an explicit discount averaging out to about 95% for users who "contribute" to the development of future models by sharing their prompts and model outputs.

09/04 02:01

OpenAI发布Astra:一款强大且备受争议的新模型

OpenAI于9月3日发布新一代模型Astra,自称是迄今最强大、能力最全面的模型,并主打计算机与浏览器使用场景。该模型率先向Daybreak网络安全项目客户开放,未来一周内将陆续覆盖Pro、Plus、企业版与API用户。

09/04 01:50

币安开放AI智能体交易,BNB上涨5.2%

加密货币交易所币安已开放AI智能体交易,据财经媒体TechStock²报道,消息公布后币安生态代币BNB上涨5.2%。主流交易平台把AI智能体引入真实交易环节,正在让“模型驱动交易”从概念走向实际场景,也使自动化交易的合规边界成为新的关注点。

09/04 03:55

Claude、Grok、ChatGPT与Gemini集体出现服务异常,Vibe Coding开发者遭前沿AI中断波及

美东时间9月3日,Anthropic的Claude、xAI的Grok、OpenAI的ChatGPT与谷歌Gemini等前沿AI模型被曝同时出现服务异常,大量用户在X平台反映无法使用这些模型。OpenAI约15项服务报告故障并正在修复,Anthropic状态页显示Opus 4.8与Opus 5仍受影响,X与Cursor则确认Grok正经历服务降级。