首頁LBank 新聞中心
Claude 的個性會因模型與你所使用的語言而異
anthropic-claude-personality-changes-model-language
Claude 的個性會因模型與你所使用的語言而異
根據 Anthropic 的最新研究,Claude 始終在不同模型和語言之間表達出不同的價值觀。
2026-07-13 來源:decrypt.co

簡報

  • Anthropic 研究人員分析了超過 309,000 個 Claude 對話,以研究該 AI 如何表達價值觀。
  • 該公司表示,他們將識別出的 3,300 多種價值觀歸納為四個行為維度,包括順從與謹慎、熱情與嚴謹。
  • Anthropic 表示,Claude 的回應在不同模型版本和語言之間存在差異。

Claude 在每次對話中的行為方式都不盡相同。根據週一發布的新研究,AI 巨頭 Anthropic 發現其助手在不同用戶選擇的模型和所使用的語言下,會持續表達不同的價值觀。

在週一發布的一份報告中,Anthropic 研究人員分析了 309,815 個與 Claude 進行的匿名用戶對話,這些對話涉及提供建議或回饋等主觀任務。該公司表示,他們將識別出的 3,300 多種價值觀歸納為四個行為維度——順從與謹慎、熱情與嚴謹、深度與簡潔、坦率與執行力——用以描述 Claude 在每次對話中的回應差異。

研究人員寫道:「為了確保我們衡量的是 Claude 表達的價值觀,而不是用戶提問內容或方式的差異,我們控制了每個對話的任務、主題和用戶表達的價值觀。」

根據 Anthropic 的說法,每個 Claude 模型都展現出獨特的行為模式。

Sonnet 4.6 側重於熱情、順從和簡潔,經常肯定用戶並以幽默或鼓勵的方式回應。同時,Opus 4.7 則強調嚴謹、謹慎、坦率和深度,更頻繁地挑戰假設、解釋其推理、識別風險並承認其局限性。Opus 4.6 通常採取更為簡潔、注重執行力的方法,同時比 Sonnet 更強調嚴謹性。

研究人員寫道:「這些發現與人們在 Anthropic 內部和線上對這些模型的看法一致。Claude.ai 用戶曾評論說,Opus 4.7 比其他模型更常迴避答案。」

根據 Anthropic 的說法,Claude 的行為也因語言而異。

阿拉伯語的回應往往更為順從,而英語回應則更側重於謹慎。Claude 在印地語和阿拉伯語中最熱情,使用的語言更為禮貌、俏皮和鼓勵。同時,英語和俄語的回應則更為嚴謹,經常挑戰假設、糾正細節並要求提供證據。

英語回應也傾向於提供更詳細的解釋,而阿拉伯語回應則普遍更為簡潔。荷蘭語回應最為坦率,更容易承認不確定性和錯誤,而印尼語回應則更側重於完成用戶請求。

Anthropic 表示,這項研究並不意味著 Claude 本身具有價值觀。該公司表示,他們尚不清楚造成這些差異的原因——或者這些差異是否可取——但認為這個框架有助於評估未來的模型並識別意外的行為變化。

這項研究是 Anthropic 一系列探討 Claude 內部行為研究中的最新成果。

去年十月,該公司報告稱其模型顯示出「功能性內省意識」的早期跡象,使其能夠識別和描述自身內部處理的各個方面。今年四月,Anthropic 發布了研究,識別出影響 Claude 行為的內部「情感向量」,同時強調這些並非情緒或意識的證據。