一个请求被安全系统拦下,Claude 根本没开口回答,账单却照样生成。Anthropic 宣布,从今天起恢复对这类被拦截请求的计费。 这条规则不是全量铺开。官方说明里划定了范围:只针对误报率低的类别,具体是 生物学、蒸馏攻击、前沿大模型开发 三类。换句话说,只有在这三个方向上被拦,才会产生费用。 被拦截还要付钱,听起来像是对普通用户的惩罚。但把这三类放在一起看,指向其实很清楚——它们都不是日常闲聊会撞上的话题。 拦下来的到底是什么请求 生物学方向涉及的是高风险知识门槛,蒸馏攻击指向的是拿模型输出反哺训练,前沿大模型开发则直接关系到能力外溢。三类请求的共同点在于:正常用户极少误触,而一旦被触发,往往带着明确目的。 Anthropic 在说明中提到,近几周观察到了一些针对其系统的 协同攻击 。这句话没有展开攻击的具体形态,但和恢复计费的动作放在一起,逻辑链条是完整的:拦截本身不产生成本压力,攻击者可以反复试探;一旦被拦的请求也要计费,试探就变成了消耗。 这是把安全防线的成本,转移回发起方。 正方:这是必要的经济护栏 支持这个做法的理由很直接。安全系统拦截请求需要算力,拦截次数越多,消耗越大。如果拦截完全免费,攻击者可以用极低成本持续冲击边界,直到找到漏网的那一次。 计费相当于给试探行为加了一道价格门槛。而且 Anthropic 特意强调只覆盖误报率低的类别,等于承认了另一面:误报率高的场景不适用,因为那会误伤正常用户。 从这个角度看,这不是涨价,是把成本对准了真正制造成本的人。 反方:误报的代价由谁承担 质疑同样成立。误报率低不等于零误报。一个做前沿模型研究的开发者,如果提问方式恰好踩中判定边界,被拦下的同时还要付费,体验上的挫败感是双重的。 更现实的问题是,协同攻击者未必在意这点费用。真正被价格挡住的,可能是那些反复调试、不断换措辞想绕过误判的合规研究者。他们才是被拦频率最高的一群人。 安全成本该由谁买单,这个问题没有标准答案。Anthropic 选择了让被拦方承担一部分,代价是把判定边界的压力也一并转移了过去。 判断:这是一次边界定价实验 把这件事看成单纯的收费调整,会漏掉关键信息。它真正在做的,是给安全判定划出一条价格线——线内免费,线外付费。 这条线画得准不准,取决于三个类别的判定精度。Anthropic 敢恢复计费,说明它对这三类的误报率有把握。但把握是动态的,攻击手法在变,判定规则也在变,今天低误报的类别,明天未必还是。 对普通用户来说,这件事几乎没有感知。对做前沿模型开发、或者研究模型蒸馏的人来说,它改变的是试探成本的计算方式。以前被拦只是浪费时间,现在被拦还要花钱。 安全与成本之间的这条线,Anthropic 先画了一笔。后续会不会扩展到更多类别,取决于这三类的实际运行数据。 特别
全国咨询热线
球友会 (中国)官方网站
联系电话:13594780401
联系人:李总
邮箱:illadvised@sina.com
公司地址:东方市眼题道486号
微信扫一扫
手机官网