一条回复,把模型圈的目光又拉回了Anthropic。Nathan Lambert转发了Claude官方账号的一条消息,配了一句"Sir what is going on here"——这句话里没有技术分析,只有一种被结果砸到的错愕感。
让他发出这句感叹的,是官方给出的两组数字:Opus 5.5在默认努力档位下,就能拿到前沿水平的结果,而每个任务的成本只是对手的一小部分;同时它的输出速度比Opus 5快了30%以上。
![]()
默认档位,成了最刺眼的那句话
官方这条回复的原文指向很明确:在默认努力设置下,Opus 5.5 就能交付前沿结果,而且"often beating other models running at their highest settings"——经常打赢那些跑在最高设置上的其他模型。
这句话的分量在于对比的错位。一边是默认档,一边是最高档;一边是"一小部分"的单任务成本,一边是全力开火的对手。官方没有给出具体是哪些模型、也没有给出成本的具体倍数,只用了"a fraction of the cost per task"这个说法。
Nathan Lambert 的转发没有附加任何解读。他只是在问"这里到底发生了什么"。这种反应本身,比任何评测表格都更能说明这条消息在圈内引起的震动。
30%的速度差,落在哪里
官方给出的第二个数字是速度:Opus 5.5 的输出生成速度比 Opus 5 快30%以上。这是一个跨代对比,不是跨厂商对比。
速度这个指标在模型发布里经常被放在最后提,但它直接决定了一件事:同样的任务,用户要等多久。30%的差距放在长输出场景里,是能被人直接感知到的。
官方把速度和成本放在同一段里说,逻辑是连着的——默认档位省成本,更快的输出省时间,两者叠加起来,才是"每个任务"这个单位下的真实体验。
一条转发,两种读法
这条消息的传播路径很短:Claude官方账号发出,Nathan Lambert 转发并附上一句感叹,随后被更多人看到。8,106 次浏览这个数字,记录的是它被围观的那一刻。
对关注模型能力的人来说,值得盯住的是"默认档位打赢最高档位"这个表述。它意味着能力提升不再需要用户手动把参数拉满,默认状态就已经是能打的水平。
对关注成本的人来说,"a fraction of the cost per task"是更实际的那句话。单任务成本降下来,才谈得上把模型放进日常流程里反复调用,而不是只在关键节点上用一次。
官方没有公布默认档位和最高档位之间的具体参数差异,也没有说明"其他模型"具体指谁。这些空白留在了原话之外,Nathan Lambert 的那句"what is going on here",某种程度上也是替所有看到这条消息的人问的。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.