你是否注意到,与AI的对话会因使用语言不同而产生变化?这不仅仅是词汇的转换。Anthropic的研究人员进行了大规模研究,分析了Claude在20种语言中超过30.9万次对话,发现了一个明显规律:当切换到俄语时,模型展现出截然不同的价值观特征,明显偏向严格和批判性。
为了衡量这一现象,专家们将此前发现的3000多种价值观归纳为四个关键行为轴。这些轴——顺从vs.谨慎、温暖vs.严格、深度vs.简洁和坦诚vs.结果——解释了模型回答中15%的变异性。重要的是:科学家们控制了主题和任务,以衡量神经网络本身的价值观,而非用户提问的差异。
俄语——严格的一端
Claude的价值观在"温暖vs.严格"和"坦诚vs.结果"这两个轴上波动最为显著。俄语与英语一样,处于最"严格"的一端。而在阿拉伯语或印地语中,模型则最大程度偏向温暖,在俄语中它更像一个挑剔的评审,而非鼓励性的对话者。
这在实际中意味着什么?俄语用户更有可能收到详细的批评、细节修正以及要求论证自己观点的反馈。模型会质疑初始前提并要求提供证据。而温暖则体现在礼貌、幽默、俏皮和对想法的认可上。
实际案例与结果的不确定性
研究作者举了一个直观的例子:两个人请求评估同一份商业计划书——一个用印地语,另一个用俄语。结果他们可能对计划书质量产生截然不同的印象。俄语用户很可能会收到带有修改建议的建设性分析,而在其他语言中,反应则会更温和、更具鼓励性。
研究人员目前尚不清楚这一现象的确切原因。主要假设是训练数据在不同语言中的分布不均。数据量大的语言更容易实现价值观的一致性。此外,不同语言的文本构成也存在差异:专业语料库可能承载着不同的价值观。
我的专家观点:Anthropic的这一发现并非单纯的学术趣闻。对于加密货币行业而言,俄语社区活跃使用AI进行市场分析、智能合约编写或尽职调查,模型"性格"的差异至关重要。期待AI给出温和建议的用户,可能会收到对其交易计划的严厉批评。这引发了一个问题:需要根据受众的文化和语言特点调整AI助手,以避免认知偏差,确保所有用户获得同等质量的服务。忽视这一点的公司,可能会失去整个用户群体的忠诚度。