論文の概要: Cross-Cultural Simulation of Citizen Emotional Responses to Bureaucratic Red Tape Using LLM Agents
- arxiv url: http://arxiv.org/abs/2604.12545v1
- Date: Tue, 14 Apr 2026 10:17:31 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-15 19:11:32.392264
- Title: Cross-Cultural Simulation of Citizen Emotional Responses to Bureaucratic Red Tape Using LLM Agents
- Title(参考訳): LLMエージェントを用いた官僚的赤テープに対する市民感情反応のクロスカルチャーシミュレーション
- Abstract要約: 多様な文化的文脈において, レッドテープに対するLLMの感情応答を評価するための評価枠組みを提案する。
以上の結果から,東方文化では,すべてのモデルが人間の感情的反応と限定的に一致していることが示唆された。
我々は、赤テープに対する市民の感情反応をシミュレートし、人的データを収集してモデルを改善するインタラクティブなインタフェースであるbftextRAMOを紹介した。
- 参考スコア(独自算出の注目度): 12.801278629727676
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Improving policymaking is a central concern in public administration. Prior human subject studies reveal substantial cross-cultural differences in citizens' emotional responses to red tape during policy implementation. While LLM agents offer opportunities to simulate human-like responses and reduce experimental costs, their ability to generate culturally appropriate emotional responses to red tape remains unverified. To address this gap, we propose an evaluation framework for assessing LLMs' emotional responses to red tape across diverse cultural contexts. As a pilot study, we apply this framework to a single red-tape scenario. Our results show that all models exhibit limited alignment with human emotional responses, with notably weaker performance in Eastern cultures. Cultural prompting strategies prove largely ineffective in improving alignment. We further introduce \textbf{RAMO}, an interactive interface for simulating citizens' emotional responses to red tape and for collecting human data to improve models. The interface is publicly available at https://ramo-chi.ivia.ch.
- Abstract(参考訳): 政策立案の改善は行政の中心的な関心事である。
政策実施時のレッドテープに対する市民の感情反応の文化的相違について,先行研究により明らかにした。
LLMエージェントは、人間のような反応をシミュレートし、実験コストを削減する機会を提供するが、レッドテープに対する文化的に適切な感情応答を生成する能力は、まだ検証されていない。
このギャップに対処するため,様々な文化的文脈において,LCMのレッドテープに対する感情応答を評価するための評価フレームワークを提案する。
パイロットスタディとして、このフレームワークを単一のレッドテープシナリオに適用する。
以上の結果から,東方文化では,すべてのモデルが人間の感情的反応と限定的に一致していることが示唆された。
文化的な促進戦略は、アライメントを改善するのにほとんど効果がない。
さらに、赤テープに対する市民の感情反応をシミュレートし、人的データを収集してモデルを改善するインタラクティブなインタフェースである「textbf{RAMO}」についても紹介する。
インターフェースはhttps://ramo-chi.ivia.ch.comで公開されている。
関連論文リスト
- Expressing Social Emotions: Misalignment Between LLMs and Human Cultural Emotion Norms [4.123547796999231]
LLMにおける異文化間社会感情表現の心理情報に基づく評価枠組みを提案する。
ヨーロッパ系アメリカ人とラテンアメリカ人の参加者の感情のエンゲージメントと非エンゲージメントの表現を比較した人間の研究を用いて,6つのフロンティアLSMを評価した。
あらゆるモデルは、広く表現されたヨーロッパ系アメリカ人の人格に対して特に目立たない違いが観察されるような、無関係な感情よりも活発な感情を表現している。
アブレーション分析により,これらのパターンは温度のサンプリングに頑健であり,部分的には言語に敏感であり,応答誘発形式に依存していることが明らかとなった。
論文 参考訳(メタデータ) (2026-04-18T00:17:34Z) - PERM: Psychology-grounded Empathetic Reward Modeling for Large Language Models [45.377102925731826]
大きな言語モデル(LLM)は、人間中心のアプリケーションにますますデプロイされるが、静的な感情的サポートの提供に失敗することが多い。
本稿では,この限界に対処するために,心理学に基づく共感的リワードモデリング(PERM)を提案する。
論文 参考訳(メタデータ) (2026-01-15T15:56:55Z) - FED-PsyAU: Privacy-Preserving Micro-Expression Recognition via Psychological AU Coordination and Dynamic Facial Motion Modeling [14.30453182275959]
マイクロ表現(ME)は短く、低強度で、しばしば局所的な表情である。
彼らは、犯罪の尋問や心理学的カウンセリングのような文脈で、個人が隠そうとする真の感情を明らかにするかもしれない。
ME認識(MER)は、小さなサンプルサイズや微妙な特徴など、効率的なモデリングを妨げる課題に直面している。
論文 参考訳(メタデータ) (2025-07-28T06:42:15Z) - Recognizing Emotion Regulation Strategies from Human Behavior with Large Language Models [44.015651538470856]
人間の感情は直接表現されないことが多いが、内部のプロセスや社会的表示規則に従って制御される。
ユーザ間のシナリオで異なる感情制御戦略を自動的に分類する方法は存在しない。
我々は最近導入されたtextscDeepコーパスを利用して、感情の恥の社会的表示をモデル化する。
微調整されたLlama2-7Bモデルは、利用した感情制御戦略を高精度に分類することができる。
論文 参考訳(メタデータ) (2024-08-08T12:47:10Z) - Rel-A.I.: An Interaction-Centered Approach To Measuring Human-LM Reliance [73.19687314438133]
インタラクションの文脈的特徴が依存に与える影響について検討する。
文脈特性が人間の信頼行動に大きく影響していることが判明した。
これらの結果から,キャリブレーションと言語品質だけでは人間とLMの相互作用のリスクを評価するには不十分であることが示唆された。
論文 参考訳(メタデータ) (2024-07-10T18:00:05Z) - EmPO: Emotion Grounding for Empathetic Response Generation through Preference Optimization [9.934277461349696]
共感反応生成は会話エージェントの望ましい側面である。
感情接地に基づく理論駆動の嗜好データセットを構築する新しい手法を提案する。
本研究では,LLMを一般性能を維持しつつ,好みの最適化により共感応答生成に適応させることができることを示す。
論文 参考訳(メタデータ) (2024-06-27T10:41:22Z) - Promoting Constructive Deliberation: Reframing for Receptiveness [5.4346288442609945]
本稿では,先行コメントに対する信号受容性に対する不一致応答の自動再フレーミングを提案する。
リフレーミングの6つの戦略を特定します。Redditデータセットを使用して、各戦略に従ってコメントに対する返信を自動的にリフレッシュします。
その結果,本フレームワークで生成した応答は,元の応答よりもはるかに受容性が高いと認識され,汎用的な受容性ベースラインであることが判明した。
論文 参考訳(メタデータ) (2024-05-23T21:35:22Z) - LLM generated responses to mitigate the impact of hate speech [1.774563970628096]
本稿では,自動モデレーションシステムの設計について概説し,ユーザエンゲージメントを測定するための簡易な指標を提案する。
談話モデレーションのための生成AIの展開における倫理的考察と課題について論じる。
論文 参考訳(メタデータ) (2023-11-28T16:08:42Z) - Do LLMs exhibit human-like response biases? A case study in survey
design [66.1850490474361]
大規模言語モデル(LLM)が人間の反応バイアスをどの程度反映しているかについて検討する。
アンケート調査では, LLMが人間のような応答バイアスを示すかどうかを評価するためのデータセットとフレームワークを設計した。
9つのモデルに対する総合的な評価は、一般のオープンかつ商用のLCMは、一般的に人間のような振る舞いを反映しないことを示している。
論文 参考訳(メタデータ) (2023-11-07T15:40:43Z) - Building Emotional Support Chatbots in the Era of LLMs [64.06811786616471]
我々は,Large Language Models (LLMs) の計算能力で人間の洞察を合成する革新的な方法論を導入する。
また,ChatGPTの文脈内学習の可能性を利用して,ExTESと呼ばれる感情支援対話データセットを生成する。
次に、LLaMAモデルに高度なチューニング手法を展開し、多様なトレーニング戦略の影響を検証し、最終的に感情的支援の相互作用に細心の注意を払ってLLMを出力する。
論文 参考訳(メタデータ) (2023-08-17T10:49:18Z) - Emotionally Numb or Empathetic? Evaluating How LLMs Feel Using EmotionBench [83.41621219298489]
心理学からの感情評価理論を用いて,Large Language Models (LLMs) の人為的能力を評価する。
我々は、研究の中心となる8つの感情を引き出すのに有効な400以上の状況を含むデータセットを収集した。
我々は世界中の1200人以上の被験者を対象に人間による評価を行った。
論文 参考訳(メタデータ) (2023-08-07T15:18:30Z) - MISC: A MIxed Strategy-Aware Model Integrating COMET for Emotional
Support Conversation [64.37111498077866]
本稿では,感情支援会話のための新しいモデルを提案する。
ユーザの微妙な感情状態を推測し、その後、戦略の混合を使って巧みに応答する。
評価実験の結果,提案手法の有効性が示された。
論文 参考訳(メタデータ) (2022-03-25T10:32:04Z) - Counterfactual Off-Policy Training for Neural Response Generation [94.76649147381232]
本稿では,反実的推論による潜在的応答の探索を提案する。
対人学習の枠組みの下での対物反応の訓練は、潜在的応答空間の高逆領域を探索するのに役立つ。
DailyDialogデータセットに関する実証的研究は、我々のアプローチがHREDモデルを大幅に上回っていることを示している。
論文 参考訳(メタデータ) (2020-04-29T22:46:28Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。