Anthropicが、自社モデルClaudeの価値観が使用言語によって変動する可能性を指摘しました。日本語でフィードバックを求めると温かいトーンになり、英語ではより厳しくなる傾向があるとのことです。これは、モデルの学習データに含まれる文化的背景や言語特性が、出力に意図せず影響を与えている可能性を示唆します。