一个请求被安全系统拦下,Claude 根本没开口回答,账单却照样生成。Anthropic 宣布,从今天起恢复对这类被拦截请求的计费。
这条规则不是全量铺开。官方说明里划定了范围:只针对误报率低的类别,具体是生物学、蒸馏攻击、前沿大模型开发三类。换句话说,只有在这三个方向上被拦,才会产生费用。
![]()
被拦截还要付钱,听起来像是对普通用户的惩罚。但把这三类放在一起看,指向其实很清楚——它们都不是日常闲聊会撞上的话题。
拦下来的到底是什么请求
生物学方向涉及的是高风险知识门槛,蒸馏攻击指向的是拿模型输出反哺训练,前沿大模型开发则直接关系到能力外溢。三类请求的共同点在于:正常用户极少误触,而一旦被触发,往往带着明确目的。
Anthropic 在说明中提到,近几周观察到了一些针对其系统的协同攻击。这句话没有展开攻击的具体形态,但和恢复计费的动作放在一起,逻辑链条是完整的:拦截本身不产生成本压力,攻击者可以反复试探;一旦被拦的请求也要计费,试探就变成了消耗。
这是把安全防线的成本,转移回发起方。
正方:这是必要的经济护栏
支持这个做法的理由很直接。安全系统拦截请求需要算力,拦截次数越多,消耗越大。如果拦截完全免费,攻击者可以用极低成本持续冲击边界,直到找到漏网的那一次。
计费相当于给试探行为加了一道价格门槛。而且 Anthropic 特意强调只覆盖误报率低的类别,等于承认了另一面:误报率高的场景不适用,因为那会误伤正常用户。
从这个角度看,这不是涨价,是把成本对准了真正制造成本的人。
![]()
反方:误报的代价由谁承担
质疑同样成立。误报率低不等于零误报。一个做前沿模型研究的开发者,如果提问方式恰好踩中判定边界,被拦下的同时还要付费,体验上的挫败感是双重的。
更现实的问题是,协同攻击者未必在意这点费用。真正被价格挡住的,可能是那些反复调试、不断换措辞想绕过误判的合规研究者。他们才是被拦频率最高的一群人。
安全成本该由谁买单,这个问题没有标准答案。Anthropic 选择了让被拦方承担一部分,代价是把判定边界的压力也一并转移了过去。
判断:这是一次边界定价实验
把这件事看成单纯的收费调整,会漏掉关键信息。它真正在做的,是给安全判定划出一条价格线——线内免费,线外付费。
这条线画得准不准,取决于三个类别的判定精度。Anthropic 敢恢复计费,说明它对这三类的误报率有把握。但把握是动态的,攻击手法在变,判定规则也在变,今天低误报的类别,明天未必还是。
对普通用户来说,这件事几乎没有感知。对做前沿模型开发、或者研究模型蒸馏的人来说,它改变的是试探成本的计算方式。以前被拦只是浪费时间,现在被拦还要花钱。
安全与成本之间的这条线,Anthropic 先画了一笔。后续会不会扩展到更多类别,取决于这三类的实际运行数据。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.