論文の概要: When AI Speaks, Whose Values Does It Express? A Cross-Cultural Audit of Individualism-Collectivism Bias in Large Language Models
- arxiv url: http://arxiv.org/abs/2604.22153v1
- Date: Fri, 24 Apr 2026 01:52:02 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-27 15:36:26.304786
- Title: When AI Speaks, Whose Values Does It Express? A Cross-Cultural Audit of Individualism-Collectivism Bias in Large Language Models
- Title(参考訳): AIが話すとき、表現する価値は誰か? 大規模言語モデルにおける個人主義-集団主義のクロスカルな監査
- Authors: Pruthvinath Jeripity Venkata,
- Abstract要約: 我々は10の現実的な個人ジレンマを持つ3つの主要なAIシステム(Claude Sonnet 4.5, GPT5.4, Gemini Flashivist)をテストした。
私たちは、各国の人々が実際に信じるものを測定する7つのデータに対して、AIのアドバイスを比較しました。
3つのAIシステムはいずれも、家族、コミュニティ、権威を優先する社会からのユーザにも、一貫して西洋風の個人主義的なアドバイスを与えました。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: When you ask an AI assistant for advice about your career, your marriage, or a conflict with your family, does it give you the same answer regardless of where you are from? We tested this systematically by presenting three leading AI systems (Claude Sonnet 4.5, GPT-5.4, and Gemini 2.5 Flash) with ten real-life personal dilemmas, framed for users from 10 countries across 5 continents in 7 languages (n=840 scored responses). We compared AI advice against World Values Survey Wave 7 data measuring what people in each country actually believe. All three AI systems consistently gave Western-style, individualist advice even to users from societies that prioritize family, community, and authority, significantly more so than local values would predict (mean gap +0.76 on a 1-5 scale; t=15.65, p<0.001). The gap is largest for Nigeria (+1.85) and India (+0.82). Japan is the sole exception: AI systems treated Japanese users as more group-oriented than surveys show, revealing that AI encodes outdated stereotypes. Claude and GPT-5.4 show nearly identical bias magnitude, while Gemini is lower but still significant. The models diverge in mechanism: Claude shifts further collectivist in the user's native language; Gemini shifts more individualist; GPT-5.4 responds only to stated country identity. These findings point to a systemic homogenization of values across frontier AI. Data, code, and scoring pipeline are openly released.
- Abstract(参考訳): キャリアや結婚、家族との対立について、AIアシスタントにアドバイスを求めると、出身地に関係なく、同じ答えが得られますか?
我々は、これを体系的にテストし、主要なAIシステム(Claude Sonnet 4.5、GPT-5.4、Gemini 2.5 Flash)を10の現実の個人ジレンマで提示した。
私たちは、各国の人々が実際に信じるものを測定する7つのデータに対して、AIのアドバイスを比較しました。
3つのAIシステムは、家族、コミュニティ、権威を優先する社会のユーザーでさえ、一貫して西洋風の個人主義的なアドバイスを与えており、地域価値が予測するよりもはるかに高い(平均的な1-5スケールでのギャップ+0.76、t=15.65、p<0.001)。
このギャップはナイジェリア (+1.85) とインド (+0.82) で最大である。
日本は唯一の例外だ。AIシステムは、日本人ユーザーを調査結果よりグループ指向に扱い、AIが時代遅れのステレオタイプをエンコードしていることを明らかにした。
Claude と GPT-5.4 はほぼ同一のバイアス等級を示すが、Gemini は低いが依然として大きい。
クロードはユーザーの母国語でさらに収集主義をシフトし、ジェミニはより個人主義をシフトし、GPT-5.4は国名にのみ反応する。
これらの知見は、フロンティアAIにおける価値の体系的均質化を示している。
データ、コード、スコアリングパイプラインが公開されています。
関連論文リスト
- Humanlike AI Design Increases Anthropomorphism but Yields Divergent Outcomes on Engagement and Trust Globally [5.379750053447755]
世界中の10億人以上のユーザーが、人間の特性を模倣する洗練度を高めたAIシステムと対話している。
この変化は、人類同相性、人的特徴の合成剤への寄与、および不在の信頼や感情的依存を誘発する可能性に関する緊急の議論を引き起こしている。
一般的な安全フレームワークは、AIユーザのグローバルな多様性を見越して、西洋の人口に由来する理論的な仮定に依存し続けている。
論文 参考訳(メタデータ) (2025-12-19T18:57:53Z) - AI Debate Aids Assessment of Controversial Claims [73.8907110799657]
我々は、AI論争が、議論の的になっている事実性主張の側面に対立する2つのAIシステムを議論させることで、偏見のある裁判官を真実に導くことができるかどうかを調査する。
研究Iでは、議論は人間の判断精度と信頼性の校正を継続的に改善し、コンサルタントを上回ります。
研究IIでは、人間のような人格を持つAI裁判官は、人格を持たない人格(70.1%)やデフォルトのAI裁判官(69.8%)よりも高い精度(78.5%)を達成する。
これらの調査結果は、AIの議論が、競争対象ドメインにおけるスケーラブルでバイアス耐性のある監視への有望な道であることを示している。
論文 参考訳(メタデータ) (2025-06-02T19:01:53Z) - Large Language Models Pass the Turing Test [0.913127392774573]
独立集団を対象とした2つのチューリング試験において,ELIZA, GPT-4o, LLaMa-3.1-405B, GPT-4.5の4つのシステムについて検討した。
結果は、あらゆる人工システムが標準の3要素チューリングテストに合格するという最初の実証的な証拠である。
論文 参考訳(メタデータ) (2025-03-31T02:37:45Z) - GPT-4 is judged more human than humans in displaced and inverted Turing tests [0.7437224586066946]
毎日のAI検出は、オンライン会話における人とAIの差別化を必要とする。
我々は、Turingテストの2つの修正版(反転と置換)を使って、人や大きな言語モデルがいかに差別化できるかを測定した。
論文 参考訳(メタデータ) (2024-07-11T20:28:24Z) - Navigating AI Fallibility: Examining People's Reactions and Perceptions of AI after Encountering Personality Misrepresentations [7.256711790264119]
ハイパーパーソナライズされたAIシステムは、パーソナライズされたレコメンデーションを提供するために人々の特性をプロファイルする。
これらのシステムは、人々の最も個人的な特性を推測する際にエラーに免疫がない。
人格の誤表現に遭遇した後、人々がどのように反応し、AIを知覚するかを検討するための2つの研究を行った。
論文 参考訳(メタデータ) (2024-05-25T21:27:15Z) - Frontier AI Ethics: Anticipating and Evaluating the Societal Impacts of Language Model Agents [0.0]
一部の者は、すでに広くデプロイされているAIシステムのよく知られた病理を複製したとして、ジェネレーティブAIシステムを批判している。
私はこれらの特定のシステムを区別する点に注意を払っています。
私は「言語モデルエージェント」の略奪的展望がもたらす潜在的社会的影響と規範的疑問について考察する
論文 参考訳(メタデータ) (2024-04-10T05:34:07Z) - Fairness in AI and Its Long-Term Implications on Society [68.8204255655161]
AIフェアネスを詳しく見て、AIフェアネスの欠如が、時間の経過とともにバイアスの深化につながるかを分析します。
偏りのあるモデルが特定のグループに対してよりネガティブな現実的な結果をもたらすかについて議論する。
問題が続くと、他のリスクとの相互作用によって強化され、社会不安という形で社会に深刻な影響を及ぼす可能性がある。
論文 参考訳(メタデータ) (2023-04-16T11:22:59Z) - Can Machines Imitate Humans? Integrative Turing-like tests for Language and Vision Demonstrate a Narrowing Gap [56.611702960809644]
3つの言語タスクと3つの視覚タスクで人間を模倣するAIの能力をベンチマークする。
次に,人間1,916名,AI10名を対象に,72,191名のチューリング様試験を行った。
模倣能力は従来のAIパフォーマンス指標と最小限の相関を示した。
論文 参考訳(メタデータ) (2022-11-23T16:16:52Z) - How Different Groups Prioritize Ethical Values for Responsible AI [75.40051547428592]
民間企業、公共セクター組織、学術団体は、責任あるAI技術にとって重要であると考える倫理的価値観を概説している。
彼らのレコメンデーションは中央値のセットに収束するが、より代表的な大衆が、彼らが交流し、影響を受ける可能性のあるAI技術にとって重要な価値についてはほとんど知られていない。
我々は、個人が3つのグループにまたがる責任あるAIの価値観をどのように認識し、優先順位付けしているかを調査した。
論文 参考訳(メタデータ) (2022-05-16T14:39:37Z) - The Who in XAI: How AI Background Shapes Perceptions of AI Explanations [61.49776160925216]
私たちは、2つの異なるグループ、つまりAIのバックグラウンドを持つ人々といない人たちの、異なるタイプのAI説明に対する理解について、混合手法による研究を行います。
その結果,(1) 両群は異なる理由から不合理な数に対する信頼を示し,(2) それぞれの群は意図した設計以上の異なる説明に価値を見出した。
論文 参考訳(メタデータ) (2021-07-28T17:32:04Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。