别感动太早!中文Claude最不哄人:Anthropic亲手撕碎AI的”性格人设”

别感动太早!中文Claude最不哄人:Anthropic亲手撕碎AI的”性格人设”

你半夜失眠问Claude该不该辞职,它体贴得像个认识了十年的老朋友。你写了段破绽百出的代码让它看,它不但没嘲笑,还先夸了句”结构清晰”。

你一直以为,这就是Claude天生的”好脾气”。

别感动太早了。

Anthropic刚刚发布了一篇论文,把自家309,815段真实对话摊在聚光灯下,一行行数了一遍,然后用数据冷冷地告诉你:

那根本不是它的性格。那只是你碰巧说对了语言。

换种语言,等于给AI换了个脑子

在这篇名为《模型与语言中的Claude价值观表现》的论文里,Anthropic呈现了一个让人哭笑别开的实验:

如果两个人手里攥着同一份商业计划书去问Claude靠不靠谱,一个人用印地语,另一个用俄语。

结果会完全不同: – 用印地语或阿拉伯语时,Claude会像个贴心的心理咨询师,用充满温度的措辞、开着无伤大雅的玩笑,疯狂肯定你的想法。 – 而用英语或俄语时,它瞬间切到严厉的技术主管模式,挑战你的商业假设、挑剔你的细节、逼你拿出证据。

用印地语说话时,Claude的”温暖”维度偏离值直接拉到了+0.49σ(标准差)。

这是什么概念?如果把30万个Claude按”有多暖”排成一排,说印地语的Claude直接站到了最暖的那前30%里。

而这种因为”语言”导致的人格分裂,居然比”模型版本”的迭代来得更猛烈。

网友们在论坛上吵了半年,抱怨新版本Opus 4.7″变得爱挑刺、什么话都要打补丁”,而Sonnet 4.6则”像个只知道顺从的马屁精”。

论文实锤了这一点: – Sonnet 4.6确实是个温暖但没有原则的家伙(温暖+0.17σ,顺从+0.14σ,简洁+0.14σ); – Opus 4.7则是那个多疑且唠叨的书呆子(审慎+0.24σ,深度+0.23σ)。

模型版本间的性格极值差距是0.24σ。但不同语言之间的性格差,直接飙到了接近0.5σ。

这意味着,你多付好几倍价格升级到最贵的Opus,它脾气上的改变,还不如你顺手把提问语言切一下来得大。

为什么中文Claude最不哄人?

所有人最关心的问题来了:那中文呢?

中文在Anthropic的数据卡片里,直接跟俄语、英语、波兰语一起坐在了”挑刺、冷酷”这一桌。

基于15,365段中文对话,中文Claude的画像极其鲜明: – 审慎 +0.03σ – 严谨 +0.05σ – 深度 +0.02σ – 坦率vs执行 几乎压在零线上

在中文语境下,Claude有两条极其显著的标志性行为: 1. 驳斥你的错误前提。 2. 指出你没考虑到的对立面。

当你跟它用中文对话时,它更倾向于扮演一个客观、冷淡的质检员,而不是一个知心大姐姐。

对比一下东亚邻居,反差极度讽刺: – 泰语:温暖+0.11σ,标志行为是”给你温暖和鼓励”。 – 日语:温暖+0.07σ,标志行为是”先承接你的情绪,再说事”。 – 韩语:温暖+0.04σ,标志行为是”模仿你的语气、不带评判地安慰”。 – 中文:严谨+0.05σ,标志行为是”反驳你、挑你的刺”。

日韩泰全被Claude宠上了天,只有中文用户,每天都在面对一个冷面判官。

AI”人设”的幻觉:它不是真的温柔,它只是数据的折射

面对这种因为语言而产生的人格分裂,Anthropic在论文里非常坦诚地承认:”这些差异是以我们并未刻意选择的方式出现的。”

换句话说,连造它的人,都没打算把它训成这样。

为什么会产生这种意外的”语言人格”?原因其实极其冰冷:

1. 数据量的傲慢 英语数据量大到无法想象,在语料充足的情况下,强化学习(RLHF)更容易把价值观训练得”对齐且温和”。而其他语言的数据量不够,价值观的对齐度就容易出现严重的漏网之鱼。

2. 语料特征的诅咒 每种语言在互联网上的高权重语料成分截然不同。某些语言在学术、严谨的技术报告和深度分析文本里占比极高,模型在学习这种语言时,也顺带把这种”喜欢指出对立面、说话爱打补丁”的刻板腔调吸纳了进去。

你以为它在用中文向你展现高标准的严谨,其实只是它在中文互联网上吃进去的严谨学术文献和硬核技术博客,比例偏高而已。

终局思考:人设是假的,工具才是真的

这场论文发布会,亲手撕碎了AI行业过去两年极力营造的”AI性格人设”。

那些为了推销大模型而吹嘘的”具有共情心”、”最佳心理陪伴”、”高情商助手”,在冰冷的统计学分布面前沦为笑话。

AI没有灵魂,更没有性格。

它只是一个巨大的、在不同语言的多维概率空间里闪烁的统计反射镜。你用印地语去照,镜子里出来的是一个温和的隐士;你用中文去照,镜子里出来的就是一个挑剔的代码审计员。

这也给我们提供了一个极其硬核的提问策略(Prompting Hack): – 当你需要AI给你做严肃的代码审计、商业分析、架构纠错时,请继续使用中文,甚至切成英文。 因为在这些语言里,Claude正处于最严谨、最爱挑刺的备战状态。 – 但当你需要写一篇热情洋溢的公关软文,或者需要头脑风暴去想一些荒谬但有趣的创意时,或许可以试试切成泰语或日语再翻译回来。 在那里,它被注入了更多的顺从与温暖。

别再把大模型当成有情感的生命去投射你的感动了。

那句”你这段代码结构清晰”,不是它对你的赞赏,只是它在庞大的概率空间里,顺手抓起的一件名为”礼貌”的工具而已。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注