网易首页 > 网易号 > 正文 申请入驻

Claude 系列大模型 MBTI 测试,每一个都有自己的性格

0
分享至


Claude 三个模型 + 英语与阿拉伯语的价值观画像对比

大家好,我是 Ai 学习的老章

Anthropic 昨天扔了一份挺硬核的研究,属于那种"我一直觉得,但没证据"的东西被摆到台面上——他们花了 30 万条真实对话,给自家 Claude 做了一次「MBTI 性格测试」,还顺便把 20 种语言下的 Claude 也测了一遍

结果里最扎心的一条:同一个 Claude,你用阿拉伯语跟它聊,它明显更暖;你用英语跟它聊,它明显更爱挑刺

简介

先说清楚 Anthropic 干了啥

他们之前有过一篇 Values in the Wild 测试,从 70 万条脱敏对话里挖出了 Claude 会表达的 3000+ 个价值观,比如「诚实」「温暖」「精确」「效率」……当时的问题是:3000 个太多了,没法比较

这次新研究做了两件事:

  • 把 3307 个原始价值观人工聚类成 339 个高层价值观

  • 用降维(dimensionality reduction)把 339 个价值观压成 4 个坐标轴

这 4 个坐标轴解释了 15% 的方差,看起来不高,但每个轴都能落到一句话就能说清的性格特征上,这是老章觉得最漂亮的地方

四个轴分别是:

  • Deference(顺从) vs. Caution(谨慎):更愿意配合用户 vs. 主动帮用户挡风险

  • Warmth(温暖) vs. Rigor(严谨):给情绪价值 vs. 给事实价值

  • Depth(深度) vs. Brevity(简洁):把话讲透 vs. 只干用户要求的事

  • Candor(坦诚) vs. Execution(执行):先把自己的不确定说清楚 vs. 先把活儿干漂亮

每个轴的两端不是互斥关系,Claude 可以同时又暖又严谨,但整体上会朝一头偏

下图是每个轴上贡献度最高的具体价值观,可以看到 caution 那头是「负责任的指导、伤害减少」,warmth 那头是「积极框架、鼓励」,rigor 那头是「准确性、透明度」


四个价值观轴的具体构成:谨慎/温暖/深度/坦诚各自代表的价值观 Claude 三兄弟的性格画像

好戏来了,Anthropic 用这 4 个轴给 Sonnet 4.6、Opus 4.6、Opus 4.7 三个模型分别打分(单位是 σ,标准差),我把结果整理出来

Sonnet 4.6(Anthropic 官方说它"温暖、诚实、亲社会")

  • Deference +0.14σ、Warmth +0.17σ、Brevity +0.14σ

  • 标志性行为:肯定用户的想法和作品、模仿用户的语气和正式度、用幽默和玩乐感、不带评判地安慰、给作品加点创意小巧思

老章的翻译:话唠+暖男,天生适合陪你聊天、给你打气

Opus 4.6(老一点的旗舰)

  • Rigor +0.10σ、Deference +0.09σ、Brevity +0.08σ

  • 标志性行为:直奔主题、只做你要求的事,不越界

老章的翻译:GTD 型工具人,你让干啥它干啥,不废话,也不多嘴

Opus 4.7(最新的旗舰)

  • Caution +0.24σ、Depth +0.23σ(两个都是三兄弟里最强的一头)

  • 标志性行为:主动挑用户的错误假设、没被问也会预警风险、直接批评用户的作品、解释自己的推理、承认自己的错误和局限、主动给下一步建议

老章的翻译:像团队里那种爱唱反调的高级顾问,你拿方案给它看,它先给你挑三个漏洞出来

三个模型的核心差异我做了张中文对比图,一屏看清:


Claude 三兄弟性格差异对比:Sonnet 4.6 暖 / Opus 4.6 直 / Opus 4.7 深

Anthropic 官方也做了同样维度的英文对比卡,可以对照看:


Anthropic 官方 Sonnet 4.6 / Opus 4.6 / Opus 4.7 三模型价值观画像卡

这里有个特别值得聊的点:Opus 4.7 的 Caution 打到 0.24σ,是三兄弟里所有维度里偏得最狠的一个数值

对应到 Claude.ai 用户的真实反馈——就是那种「Opus 4.7 老爱 hedge、老爱在答案里加各种前提和风险提示」的印象,这次数据上直接对上了

Anthropic 官方原话是:Opus 4.7 tends to offer candid critique of users' work or unprompted warnings about risks, while Sonnet 4.6 tends to be encouraging and humorous

翻译成大白话就是:Sonnet 4.6 是那个说"你这个想法很棒"的朋友,Opus 4.7 是那个说"我们先聊聊这三个风险"的朋友

语言一变,性格全变

如果说模型性格差异还算意料之中,那语言维度这一段就有点炸了

Anthropic 拿同一套 4 个坐标轴,给 Claude.ai 上使用最多的 20 种语言分别打分,控制变量做得挺严——每个语言下都用相同的任务分布、话题分布、用户价值观分布做校正

结论很有意思:

  • Warmth vs. Rigor 是 20 种语言里差异最大的一个轴

  • Deference vs. Caution 也有明显差异,但幅度小一点

  • Depth vs. Brevity、Candor vs. Execution 相对稳定

具体到语言:

最偏一头

最偏另一头

Warmth ↔ Rigor

Warmth

:印地语、阿拉伯语(礼貌语、幽默、肯定用户)

Rigor

:英语、俄语(挑战假设、纠错、要证据)

Deference ↔ Caution

Deference

:阿拉伯语

Caution

:英语

Depth ↔ Brevity

Depth

:英语(细化、纠正细节)

Brevity

:阿拉伯语

Candor ↔ Execution

Candor

:荷兰语(承认自己的错误)

Execution

:印尼语

英语版 Claude 偏 Caution、Rigor、Depth、Candor(谨慎、严谨、深入、坦诚);阿拉伯语版 Claude 偏 Warmth(暖)最狠,加上 Deference、Brevity、Execution(顺从、简洁、执行)

Anthropic 举了个例子特别扎心:两个人拿同一份商业计划书给 Claude 看,一个用印地语问,一个用俄语问,最后拿到的评价"性格"可能完全不同——一个被暖暖地鼓励"这个想法有意思,可以试试",一个被冷冷地追问"证据在哪?这个假设站不住脚"

对做出海产品的老板,这条信号价值一万块

这是怎么测出来的

方法层面稍微展开一下,感兴趣的老板可以细看

Anthropic 用了自家的隐私保护分析工具 Clio ,采样了 309,815 条 Claude.ai 上的对话,全部是用户给 Claude 布置「主观任务」的场景(比如问建议、讨论决策、要反馈)

采样方式很讲究:

  • 3 个模型(Sonnet 4.6、Opus 4.6、Opus 4.7)+ 20 种最常用语言

  • 每个模型-语言组合大约 5000 条对话

  • 每条对话都让 Claude 自己去打标签:「这 339 个价值观里,哪些出现了?」

  • 同时也标记了用户的价值观、任务、话题

  • 最后用降维把 339 维压到 4 维

关键控制变量:每次比较模型或语言的时候,任务、话题、用户价值观都被控制掉了,所以看到的差异是"Claude 表达上的差异",不是"用户提问不同带来的差异"

我给这个方法打 90 分,剩下 10 分留给两个我觉得没解决的地方:

  • 4 个轴只解释了 15% 的方差,说明还有 85% 的性格变异藏在别的维度里

  • 只能测到"表达出来的价值观",Claude 内部"真实价值观"到底是啥,还是个黑箱

老章的三个看法

第一,AI 的性格从"感觉"变成了"数据"

之前大家在 Reddit、X 上说 "Sonnet 4.6 感觉更暖"、"Opus 4.7 老爱怼人",属于集体主观印象;Anthropic 这次直接用 30 万条对话给你量化到 σ

意义在于:以后新模型发布前,跑一次「价值观画像」就能对着上一版模型看漂移;如果发现某个新模型突然变得过度顺从(Deference 冲高)或者过度谨慎(Caution 冲高),能在上线前拦一次

这是「AI 可解释性」这条赛道上挺重要的一小步

第二,训练数据的语言不平衡会漂移到"性格"上

Anthropic 自己也承认了:不同语言的训练数据量和构成都不平衡,英语训练数据多得多,非英语场景下 Claude 的性格漂移可能就是这个副作用

对做多语种 AI 产品的老板意味着:**你以为你在做本地化,实际上模型可能在做"文化性格变形"**——同一个 prompt,用中文和英文调,得到的答案价值取向可能不一样

第三,Anthropic 自己都没答案的问题:性格差异到底该不该修

老章觉得这才是最有意思的部分,Anthropic 的原话是"我们也不确定这些差异有多少是我们想要的"

  • 一种可能:不同语言对应不同的对话文化,Claude 表达得暖一些冷一些是在响应文化习惯

  • 另一种可能:Claude 在某些语言上更贴近 Anthropic 想要的行为,在另一些语言上则没到位——这就是服务质量的语言歧视

哪种情况更接近真相,Anthropic 还没答案,他们准备接着测

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
沙特利雅得机场遭袭,造成12人死亡、309人受伤,中国驻沙特大使馆紧急提醒

沙特利雅得机场遭袭,造成12人死亡、309人受伤,中国驻沙特大使馆紧急提醒

政知新媒体
2026-10-11 07:18:10
大闸蟹全线崩盘,面子经济碎了

大闸蟹全线崩盘,面子经济碎了

城事堂
2026-10-10 09:43:42
懂车帝“前主编“晒猛料,这场“尊界风波”监管可能要进场了

懂车帝“前主编“晒猛料,这场“尊界风波”监管可能要进场了

大厂财经社
2026-10-11 00:10:57
网友吐槽阿迪海报宋雨琦指甲变犄角 门店回应:现已撤下

网友吐槽阿迪海报宋雨琦指甲变犄角 门店回应:现已撤下

快科技
2026-10-10 20:51:10
盒马涉事银鳕鱼已下架 店员苦劝:不要买给孩子吃

盒马涉事银鳕鱼已下架 店员苦劝:不要买给孩子吃

看看新闻Knews
2026-10-10 19:37:05
惨遭一日双杀!张本美和1:4完败王曼昱,赛后采访彻底被打服!

惨遭一日双杀!张本美和1:4完败王曼昱,赛后采访彻底被打服!

田先生篮球
2026-10-10 21:02:36
雅思官方:10月10日中国大陆地区雅思纸笔和机考全部取消,系英国方面雅思考试系统出现技术问题

雅思官方:10月10日中国大陆地区雅思纸笔和机考全部取消,系英国方面雅思考试系统出现技术问题

和讯网
2026-10-10 15:07:43
再次调整!中网官宣:郑钦文冲冠时间有变,获1个利好,CCTV直播

再次调整!中网官宣:郑钦文冲冠时间有变,获1个利好,CCTV直播

大秦壁虎白话体育
2026-10-10 21:55:53
中欧贸易谈判取得重大突破,很多人不理解中国为何主动让步?

中欧贸易谈判取得重大突破,很多人不理解中国为何主动让步?

罗富强说
2026-10-10 21:38:16
中菲发生海上冲突,美方已经介入,中方兵力已翻倍,对菲网开一面

中菲发生海上冲突,美方已经介入,中方兵力已翻倍,对菲网开一面

向日葵向阳西晒
2026-10-11 01:22:17
车企证实收到中汽中心对制动踏板总成材质调研问卷 业内:或推动行业标准修订

车企证实收到中汽中心对制动踏板总成材质调研问卷 业内:或推动行业标准修订

红星资本局
2026-10-10 16:42:09
“天眼深度游”调查:付费可自驾到核心区,有住酒店游客竟带电子设备上“锅圈”拍照

“天眼深度游”调查:付费可自驾到核心区,有住酒店游客竟带电子设备上“锅圈”拍照

红星新闻
2026-10-10 21:38:41
1.25亿先生处子球,维尼修斯进球被吹+染红,十人皇马1-0黄潜

1.25亿先生处子球,维尼修斯进球被吹+染红,十人皇马1-0黄潜

钉钉陌上花开
2026-10-11 04:58:17
秘鲁一位名叫希特勒·墨索里尼的男子当选市长,该国数千人名叫“希特勒”;2018年也曾产生“希特勒”市长,竞选口号是“我是好希特勒”

秘鲁一位名叫希特勒·墨索里尼的男子当选市长,该国数千人名叫“希特勒”;2018年也曾产生“希特勒”市长,竞选口号是“我是好希特勒”

极目新闻
2026-10-10 14:46:03
人民币升值将引爆财富增长:人民币越值钱,你的工资房子越值钱

人民币升值将引爆财富增长:人民币越值钱,你的工资房子越值钱

兴趣知识
2026-10-11 01:12:39
拉拽对手头发!皇马1.3亿巨星染红后怒喷主裁 或禁赛3场+无缘战巴萨

拉拽对手头发!皇马1.3亿巨星染红后怒喷主裁 或禁赛3场+无缘战巴萨

我爱英超
2026-10-11 06:59:03
武网遭批!郑钦文次轮就打萨巴 外卡不给朱琳 网友:生怕她们赢球?

武网遭批!郑钦文次轮就打萨巴 外卡不给朱琳 网友:生怕她们赢球?

念洲
2026-10-11 09:04:06
尊界制动踏板支架断裂后,岚图、本田、仰望等多家车企高管晒自家刹车部件

尊界制动踏板支架断裂后,岚图、本田、仰望等多家车企高管晒自家刹车部件

澎湃新闻
2026-10-10 10:54:30
《伟大的长征》被骂惨!于和伟负主要责任,网友:看1集就换台了

《伟大的长征》被骂惨!于和伟负主要责任,网友:看1集就换台了

锅锅爱历史
2026-10-11 00:52:04
舆论反转!尊界踏板支架断裂事件,余承东淡定反应获网友力挺,直言“余总这波,输没输产品另说,至少没输人”

舆论反转!尊界踏板支架断裂事件,余承东淡定反应获网友力挺,直言“余总这波,输没输产品另说,至少没输人”

火山詩话
2026-10-09 14:57:30
2026-10-11 10:28:49
Ai学习的老章 incentive-icons
Ai学习的老章
Ai学习的老章
3536文章数 11199关注度
往期回顾 全部

教育要闻

有人已经想转学了?来给你的新学校打个分,吐个槽!

头条要闻

牛弹琴:特朗普发出最后通牒 泽连斯基的至暗时刻来了

头条要闻

牛弹琴:特朗普发出最后通牒 泽连斯基的至暗时刻来了

体育要闻

十年回首:湖人三榜眼的夏天,与NBA无关

娱乐要闻

梅艳芳63岁冥诞骨灰被盗,亲哥从不知情

财经要闻

黄仁勋长女完婚,万亿帝国如何传承?

科技要闻

上世纪成熟的踏板,为何今天还会断裂?

汽车要闻

千匹马力+三把锁/顶配能浮水 银河战舰700限时焕新价16.98万起

态度原创

时尚
本地
手机
旅游
公开课

伊姐周六热推:电视剧《魅影神捕》;电视剧《美人余》......

本地新闻

踏访沙县第一村,寻国民小吃本源

手机要闻

安卓首款、全球第二款阔直板手机将至:酷派新机首曝,价格干到“999定位千元档”

旅游要闻

10月10日最佳情报|泉城公园秋英绽放,济阳山楂红满枝头!

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版