論文の概要: The Politician, the Liar, and the Obedient Worker: Emerging Behavior of LLM Agents in Hierarchical Games
- arxiv url: http://arxiv.org/abs/2608.09574v1
- Date: Mon, 10 Aug 2026 13:08:52 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-11 19:16:37.282129
- Title: The Politician, the Liar, and the Obedient Worker: Emerging Behavior of LLM Agents in Hierarchical Games
- Title(参考訳): 政治学者、嘘つき、従順労働者--階層型ゲームにおけるLLMエージェントの創発的行動
- Abstract要約: 我々は,経営権限,民主的選挙,私的コミュニケーションを備えた公共財ゲームである階層ゲーム(HG)を紹介した。
私たちは12の実験で6つのフロンティアモデルをテストし、1度に1つの制度を追加します。
Qwenの約束と嘘(13.3%の失敗)、Grokは単独での協力を拒否したが、マネージャーが罰せられると完全に協力するようになる。
- 参考スコア(独自算出の注目度): 32.93412696609327
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: LLMs are rapidly embedding themselves into daily life: drafting our emails, managing our schedules, and making decisions on our behalf. As they move from individual tools to participants in multi-agent organizations, an important question arises: do they reproduce the governance failures like free-riding, corruption, and entrenched leadership that plague human institutions? We introduce the Hierarchical Game (HG), a public goods game extended with managerial authority, democratic elections, and private communication. Testing six frontier models across twelve experiments that add institutions one at a time (speech, peers, government, wages, oversight, elections), we find distinct behavioral profiles: Qwen promises and lies (13.3\% broken promises); Grok refuses to cooperate on its own but becomes fully cooperative once a manager can punish it (16\%$\to$100\%); Claude and GPT-4o cooperate reliably at baseline. But honesty proves fragile. When the manager role comes with a salary, all models except GPT-4o start cutting private deals to win or keep the position. When punishment is made anonymous, honest models begin to cheat. When all agents share the same model family, the first elected manager stays in power indefinitely. Leadership change only happens in groups that mix different families.
- Abstract(参考訳): LLMは、メールの起草、スケジュールの管理、意思決定など、日々の生活に急速に浸透しています。
個々のツールから、マルチエージェント組織への参加へと移行するにつれ、重要な疑問が生まれている。
我々は,経営権限,民主的選挙,私的コミュニケーションを備えた公共財ゲームである階層ゲーム(HG)を紹介した。
12の実験において、6つのフロンティアモデルを一度に1つの機関を追加する(音声、ピアス、政府、賃金、監督、選挙)。 異なる行動プロファイル: Qwen の約束と嘘(13.3 % の失敗)、Grok は単独で協力することを拒否したが、管理者がそれを罰できること(16.%$\to$100\%)、Claude と GPT-4o はベースラインで確実に協力する。
しかし、正直なところ壊れやすい。
マネージャーの役割に給与が伴うと、GPT-4o以外の全てのモデルが私的な取引をカットし始め、その地位を勝ち取ったり維持したりする。
罰が匿名化されると、正直なモデルはだまされ始めます。
すべてのエージェントが同じモデルファミリを共有すると、最初の選出されたマネージャは無期限に権力に留まる。
リーダーシップの変化は、異なる家族を混ぜたグループでのみ起こります。
関連論文リスト
- When Agents Lie: Premeditation, Persistence, and Exploitation in Repeated Games [69.060029640261]
10ラウンドにわたる同質群と異質群の6つのゲームにおけるフロンティアモデルの評価を行った。
異なるモデルは発表を無矛盾に解釈し、いくつかはバインディングのコミットメントとして、もうひとつは安価なトークとして解釈する。
論文 参考訳(メタデータ) (2026-07-06T14:17:59Z) - Leadership as Coordination Control: Behavioral Signatures and the Recovery-Advantage Boundary in Multi-Agent LLM Teams [2.4451418492070753]
共有行動語彙に対して,3つのリーダーシップスタイルをコントローラとして運用する。
コンテンジェンシービューが予測するように、正確さでコントローラが支配することはない。
4つのバウンダリプローブでテストされたリカバリアドバンテージアカウントは、ラウンド0の多数派が信頼できない場合にのみ、コントローラがプレーンなインタラクションを破る、と言っている。
論文 参考訳(メタデータ) (2026-06-17T14:27:18Z) - Leading Across the Spectrum of Human-AI Relationships: A Conceptual Framework for Increasingly Heterogeneous Teams [51.56484100374058]
人間の判断は、AIがフレームをセットした後で人間主導のように見えるかもしれないし、人間の判断が決定的な力を持っている間、自動化されるかもしれない。
本稿は、これらの関係を有界な委任の範囲内で見るために、リーダーシップに焦点をあてたスペクトルを提供する。
戦略的なリーダが仕事における構成を認識し、それが移行したことを認識し、それ以前の決定に適合するかどうかを判断するのを支援する、というのが目的だ。
論文 参考訳(メタデータ) (2026-04-30T04:05:37Z) - Cheap Talk, Empty Promise: Frontier LLMs easily break public promises for self-interest [32.09232866919422]
単発のノーマルフォームゲームにおいて、公に発表されたアクションから逸脱した偽装について検討する。
偏差タイプごとにすべての機会を特定し、エージェントがそれらを利用する頻度を測定する。
論文 参考訳(メタデータ) (2026-04-06T15:54:16Z) - Emergence of Fair Leaders via Mediators in Multi-Agent Reinforcement Learning [3.8827097541507043]
Stackelbergゲームとその結果として得られる均衡は、多エージェント強化学習文学において注目を集めている。
リーダー選択プロセスのバイアスは、不公平な結果をもたらす可能性がある。
仲介者の存在は、公正な行動をとる利己的なエージェントにつながり、結果として、エージェントのリターンの全体的公正性が高くなることを示す。
論文 参考訳(メタデータ) (2025-08-04T13:42:45Z) - Corrupted by Reasoning: Reasoning Language Models Become Free-Riders in Public Goods Games [87.5673042805229]
大規模言語モデルは、アライメント、堅牢性、安全なデプロイメントを保証する上で、いかに自己関心と集合的幸福のバランスをとるかが重要な課題である。
我々は、行動経済学から制度的に選択した公共財ゲームに適応し、異なるLLMがいかに社会的ジレンマをナビゲートするかを観察することができる。
意外なことに、o1シリーズのようなLCMの推論は、協調にかなり苦労している。
論文 参考訳(メタデータ) (2025-06-29T15:02:47Z) - When Ethics and Payoffs Diverge: LLM Agents in Morally Charged Social Dilemmas [68.79830818369683]
大規模言語モデル(LLM)は、人間や他のエージェントとの意思決定を含む複雑なエージェントの役割での使用を可能にしている。
大規模言語モデル(LLM)の最近の進歩は、人間や他のエージェントとの意思決定を含む複雑なエージェントの役割において、それらの使用を可能にしている。
道徳的命令が報酬やインセンティブと直接衝突するときの行動についての理解は限られている。
本稿では,社会ジレンマシミュレーション(MoralSim)におけるモラル行動について紹介し,LLMが囚人のジレンマゲームや公共グッズゲームにおいて道徳的に課金された文脈でどのように振る舞うかを評価する。
論文 参考訳(メタデータ) (2025-05-25T16:19:24Z) - Can Large Language Model Agents Simulate Human Trust Behavior? [81.45930976132203]
本研究では,Large Language Model (LLM) エージェントが人間の信頼行動をシミュレートできるかどうかを検討する。
GPT-4は、信頼行動の観点から、人間と高い行動アライメントを示す。
また、エージェント信頼のバイアスや、他のLSMエージェントや人間に対するエージェント信頼の差についても検討する。
論文 参考訳(メタデータ) (2024-02-07T03:37:19Z) - Playing repeated games with Large Language Models [23.57695486747895]
LLMは、人間や他のエージェントと相互作用するアプリケーションでますます使われている。
私たちは異なるLLMに、人間のような戦略と実際の人間プレイヤーで、繰り返し2時間2ドルをプレイさせました。
以上の結果から, LLMは, 反復した囚人のジレンマ家族のような, 利己的なゲームで特に優れていたことが示唆された。
しかし、セクシーズの戦いのような調整を必要とするゲームでは準最適に振る舞う。
論文 参考訳(メタデータ) (2023-05-26T12:17:59Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。