論文の概要: The Effect of Perceived Race and Gender on Police Language Use: Experimental Evidence from VR Simulations
- arxiv url: http://arxiv.org/abs/2608.05050v1
- Date: Wed, 05 Aug 2026 16:59:49 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-06 14:48:44.019139
- Title: The Effect of Perceived Race and Gender on Police Language Use: Experimental Evidence from VR Simulations
- Title(参考訳): レースとジェンダーの知覚が警察語使用に及ぼす影響:VRシミュレーションによる実験的証拠
- Authors: Sandra C. Sandoval, Navita Goyal, Rashawn Ray, Long Doan, Rachel Rudinger, Hal Daumé,
- Abstract要約: Vir-Tual Reality (VR) シミュレーションにおいて, 警察官が黒人成人男性として描かれている仮想的キャラクターとどのように話し合うかを検討する。
ほとんどの警察官は白人、二人種、多人種の女性士官を除いて黒人のキャラクターに優劣がある。
- 参考スコア(独自算出の注目度): 20.75989977515299
- License: http://creativecommons.org/licenses/by-nc-sa/4.0/
- Abstract: Against the backdrop of violence in police interactions with the U.S. public, we explore how deferentially police officers speak to virtual characters depicted as Black adult males in vir- tual reality (VR) simulations. We evaluate the effect of seeing and communicating with these characters through a causal in- ference lens, where the assignment of the Black man character to a police officer and simulation is the treatment variable. Our (marginal) average treatment effect AT E measures the social impact of the character on the deference of officer statements with each turn of the conversation. Soberingly, we find that most officers speak less deferentially to Black man characters, except for White, biracial, and multiracial female officers, es- pecially in settings where the VR character was known to be a suspect. Across a full conversation of a typical VR scene, these marginal AT Es can result in notable changes in def- erence of tone (two to several points difference on a scale of 0-10), above and beyond that due to the initial effect of per- ceiving a Black male character. Even more disconcerting is that this can contribute to conversation breakdowns that po- tentially result in violence or danger to both the public and the police. We also explored the capabilities of large language models (LLMs) for ATE estimation. From our methods com- parison analysis, including model validation against synthetic data, we provide unique scientific insights on LLM-assisted methodologies for ATE estimation. As such, for ATE esti- mation with multilevel data with text, we recommend mixed effects models with the inverse propensity treatment weighted (iptw) approach, which utilized an LLM for text feature cre- ation. While we also tested LLMs for finetuning prediction models ultimately for ATE estimation, we conclude they are an area for further development and refinement.
- Abstract(参考訳): 警察と一般市民との相互作用における暴力の背景に対して、我々は、Vir-tual reality (VR)シミュレーションで黒人の成人男性として描写される仮想的なキャラクターと、警察官がいかに軽蔑的に話すかを探る。
我々は、黒人のキャラクターを警察官に割り当て、シミュレーションが治療変数となる因果的推論レンズを用いて、これらのキャラクターの視聴とコミュニケーションの効果を評価する。
ATEの平均的治療効果(marginal mean treatment effect)は、会話の各ターンにおける役員の発言の推論に対するキャラクターの社会的影響を測定する。
残念なことに、ほとんどの警官は白人、二人種、および多人種の女性役員を除いて黒人のキャラクターに優劣がある。
典型的なVRシーンの完全な会話の中で、これらの辺りのAT Esは、黒人男性キャラクター1人当たりの獲得による影響により、トーンのデフ・エレンス(0-10のスケールで2から数ポイントの違い)の顕著な変化をもたらす可能性がある。
さらに不愉快なのは、これが会話の分解に寄与し、市民と警察の両方に暴力や危険をもたらすことだ。
ATE推定のための大規模言語モデル(LLM)の機能についても検討した。
本手法は,合成データに対するモデル検証を含む複合パーソン分析から,TES推定のためのLCM支援手法に関するユニークな科学的知見を提供する。
そこで,テキストを用いた多レベルデータを用いたATEエスティ-メーションでは,テキスト特徴クレ-レーションにLLMを用いた逆相対性処理 (iptw) を用いた混合効果モデルを提案する。
また、最終的にATE推定のための微調整予測モデルとしてLLMを試験したが、さらなる開発と改良のための領域であると結論付けている。
関連論文リスト
- Multimodal Large Language Models as Synthetic Participants in Video-Based Studies: An Evaluation [11.282431394902241]
MLLM(Multimodal large language model)は,映像理解や推論などの目的タスクにおいて高い性能を示す。
本研究は,MLLMを映像による知覚的エンゲージメント(知覚的エンゲージメント)の評価という,新たな課題の参加者として評価する。
MLLMをリードする人たちでさえ、人間の参加者との合意が限られていることがわかりました。
論文 参考訳(メタデータ) (2026-05-01T05:55:45Z) - Modeling Human Subjectivity in LLMs Using Explicit and Implicit Human Factors in Personas [14.650234624251716]
大規模言語モデル (LLMs) は、人間中心の社会科学タスクでますます使われている。
これらのタスクは非常に主観的であり、環境、態度、信念、生きた経験など人間的要因に依存している。
我々は,LLMを人間的なペルソナで促進する役割について検討し,モデルに特定の人間であるかのように答えるよう求めた。
論文 参考訳(メタデータ) (2024-06-20T16:24:07Z) - The Dark Side of Dataset Scaling: Evaluating Racial Classification in Multimodal Models [1.6076959385522371]
LAION400-MおよびLAION-2Bデータセットで学習した視覚言語モデルに対するデータセットスケーリングの下流への影響を評価する。
以上の結果から,トレーニングデータの増加に伴い,事前学習したCLIPモデルの人体画像の誤分類の可能性が高まった。
より小さなベースのViT-Bモデルでは、データセットが400Mから2Bのサンプルにスケールされた場合、黒人とラテン系の男性を犯罪として予測する確率は、それぞれ20%と47%減少する。
論文 参考訳(メタデータ) (2024-05-07T19:11:10Z) - Sociodemographic Prompting is Not Yet an Effective Approach for Simulating Subjective Judgments with LLMs [13.744746481528711]
大規模言語モデル(LLM)は、様々な文脈で人間の反応をシミュレートするために広く使われている。
我々は,2つの主観的判断課題(丁寧さと攻撃性)において,人口差を理解する能力について,9つの人気のLCMを評価した。
ゼロショット設定では、両方のタスクのほとんどのモデルの予測は、アジアやブラックの参加者よりもホワイトの参加者のラベルとより密接に一致している。
論文 参考訳(メタデータ) (2023-11-16T10:02:24Z) - Bias Runs Deep: Implicit Reasoning Biases in Persona-Assigned LLMs [67.51906565969227]
LLMの基本的な推論タスクの実行能力に対するペルソナ代入の意図しない副作用について検討する。
本研究は,5つの社会デコグラフィーグループにまたがる24の推論データセット,4つのLDM,19の多様な個人(アジア人など)について検討した。
論文 参考訳(メタデータ) (2023-11-08T18:52:17Z) - Do LLMs exhibit human-like response biases? A case study in survey
design [66.1850490474361]
大規模言語モデル(LLM)が人間の反応バイアスをどの程度反映しているかについて検討する。
アンケート調査では, LLMが人間のような応答バイアスを示すかどうかを評価するためのデータセットとフレームワークを設計した。
9つのモデルに対する総合的な評価は、一般のオープンかつ商用のLCMは、一般的に人間のような振る舞いを反映しないことを示している。
論文 参考訳(メタデータ) (2023-11-07T15:40:43Z) - Emotionally Numb or Empathetic? Evaluating How LLMs Feel Using EmotionBench [83.41621219298489]
心理学からの感情評価理論を用いて,Large Language Models (LLMs) の人為的能力を評価する。
我々は、研究の中心となる8つの感情を引き出すのに有効な400以上の状況を含むデータセットを収集した。
我々は世界中の1200人以上の被験者を対象に人間による評価を行った。
論文 参考訳(メタデータ) (2023-08-07T15:18:30Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。