論文の概要: Not Yet: Humans Outperform LLMs in a Colonel Blotto Tournament
- arxiv url: http://arxiv.org/abs/2605.22095v1
- Date: Thu, 21 May 2026 07:34:49 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-22 16:35:42.140148
- Title: Not Yet: Humans Outperform LLMs in a Colonel Blotto Tournament
- Title(参考訳): 人間はブルート大佐のトーナメントでLLMを上回ります
- Abstract要約: 我々は,人間と大規模言語モデル(LLM)が戦略的にどのように振る舞うかを考察する。
我々はブロット大佐の試合で一連のラウンドロビントーナメントを組織した。
人間は、よりキャリブレーションされた中間レベルアロケーションを多く採用し、LLMが提出したよりシンプルでステレオタイプな戦略よりも優れています。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: The emergence of large language models (LLMs) has spurred economists to study how humans and LLMs behave in strategic settings. We organized a series of round-robin tournaments in the Colonel Blotto game. This game attracts game theorists' attention due to high-dimensional action space and the absence of pure strategy Nash equilibria. In the first tournament, more than 200 human participants competed against one another. In the second tournament, several popular LLMs were invited to submit strategies. In the third tournament, we matched the number of LLM strategies to the number submitted by humans. We find that humans more often employ better-calibrated intermediate-level allocation heuristics and outperform the simpler, more stereotyped strategies submitted by LLMs. Strategic sophistication is key to success if and only if the necessary level of reasoning depth is reached, while lower and higher levels of reasoning offer no clear advantage over the primitive strategies. Among humans, field of study weakly predicts success: participants with STEM backgrounds perform better in the first tournament. Surprisingly, humans almost do not adjust their strategies across tournaments with different sets of opponents. This result suggests that humans base their choices primarily on the game's rules rather than on the identity of their opponents, treating LLMs much like human competitors.
- Abstract(参考訳): 大規模言語モデル(LLM)の出現は、経済学者たちを刺激し、人間とLLMが戦略的にどのように振る舞うかを研究させた。
我々はブロット大佐の試合で一連のラウンドロビントーナメントを組織した。
このゲームは、高次元のアクション空間と純粋な戦略ナッシュ均衡の欠如により、ゲーム理論者の注意を引き付ける。
最初のトーナメントでは200人以上の参加者が互いに競い合った。
第2回大会では、いくつかの人気のあるLSMが戦略を提出するために招待された。
第3回大会では, LLM 戦略の数と人間が提出した数とを一致させた。
人間は、よりキャリブレーションされた中間レベルアロケーションヒューリスティックを多く採用し、LLMsが提出したよりシンプルでステレオタイプな戦略よりも優れています。
戦略の高度化が成功の鍵となるのは、必要レベルの推論深度に達するのに対して、低レベルの推論は原始的な戦略に対して明確な優位性を与えない場合である。
人間の間では、研究分野は成功を弱く予測している。
意外なことに、人間は対戦相手の異なるトーナメントをまたいだ戦略をほとんど調整しない。
この結果は、人間の選択は、対戦相手のアイデンティティではなく、ゲームのルールに基づいており、LLMを人間の競合相手のように扱うことを示唆している。
関連論文リスト
- Strategies of cooperation and defection in five large language models [1.0249415982296137]
大規模言語モデル(LLM)は、人間の意思決定をサポートするためにますます多くデプロイされている。
本報告では, 受刑者のジレンマにおいて, 5つの先行モデルが有意義な戦略を生み出すかどうかを考察する。
我々の実験は、現在のLLMが相互協力を瞬時に行う方法に光を当てた。
論文 参考訳(メタデータ) (2026-01-14T20:13:23Z) - Outbidding and Outbluffing Elite Humans: Mastering Liar's Poker via Self-Play and Reinforcement Learning [0.5249805590164902]
我々は、リアーズポーカーでエリートな人間のプレーを成し遂げた最初のAIエージェントであるSollyを紹介する。
モデルなし、アクター批判的、深層強化学習アルゴリズムを用いて、Sollyを訓練した。
ソリーは、利率(手の50パーセント以上)と株式(マネー)で測定されたエリートな人間レベルで、ヘッドアップとマルチプレイヤーのリアズポーカーでプレーした。
論文 参考訳(メタデータ) (2025-11-05T18:58:18Z) - Who is a Better Player: LLM against LLM [53.46608216197315]
本稿では,大規模言語モデル (LLM) の総合的な性能を評価するための対戦型ベンチマークフレームワークを提案する。
広範にプレイされている5つのゲームをサポートし,20のLDMを駆使したプレーヤーを対象とする,特別な評価プラットフォームであるQi Townを紹介した。
論文 参考訳(メタデータ) (2025-08-05T06:41:47Z) - Humans expect rationality and cooperation from LLM opponents in strategic games [0.0]
本研究は,人間の行動の差異に着目した最初の金銭的インセンティブを持つ実験室実験の結果である。
この環境下では,LLMと対戦する被験者は人間よりも有意に少ない数を選択する。
この変化は、主に戦略的推論能力の高い被験者によって引き起こされる。
論文 参考訳(メタデータ) (2025-05-16T09:01:09Z) - Large Language Models Playing Mixed Strategy Nash Equilibrium Games [1.060608983034705]
本稿では,混合戦略のナッシュ均衡と純粋戦略のナッシュ均衡が存在しないゲームにおいて,ナッシュ均衡を求めるための大規模言語モデルの能力に焦点を当てる。
この研究は、コード実行の可能性を備えたLLMの性能が大幅に向上していることを明らかにする。
LLMは、よく知られた標準ゲームにおいて顕著な熟練度を示すが、その性能は、同じゲームのわずかな変更に直面した時に低下する。
論文 参考訳(メタデータ) (2024-06-15T09:30:20Z) - GTBench: Uncovering the Strategic Reasoning Limitations of LLMs via Game-Theoretic Evaluations [87.99872683336395]
大規模言語モデル(LLM)は、重要な現実世界のアプリケーションに統合される。
本稿では,LLMの競合環境における推論能力について検討する。
まず,広く認識されている10のタスクを構成する言語駆動型環境であるGTBenchを提案する。
論文 参考訳(メタデータ) (2024-02-19T18:23:36Z) - ALYMPICS: LLM Agents Meet Game Theory -- Exploring Strategic
Decision-Making with AI Agents [77.34720446306419]
Alympicsは、ゲーム理論の研究にLarge Language Model (LLM)エージェントを利用する、体系的なシミュレーションフレームワークである。
Alympicsは、複雑なゲーム理論の問題を研究するための汎用的なプラットフォームを作成する。
論文 参考訳(メタデータ) (2023-11-06T16:03:46Z) - Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game [37.69298376616128]
我々は、柔軟な言語行動を生成し、強力な意思決定能力を有する戦略的言語エージェントを開発する。
言語行動の本質的バイアスを軽減するため,我々のエージェントはLLMを用いて推論を行い,多様な行動候補を生成する。
実験により,我々のエージェントは本態性バイアスを克服し,Werewolfゲームにおいて既存のLSMベースのエージェントより優れていることが示された。
論文 参考訳(メタデータ) (2023-10-29T09:02:57Z) - All by Myself: Learning Individualized Competitive Behaviour with a
Contrastive Reinforcement Learning optimization [57.615269148301515]
競争ゲームのシナリオでは、エージェントのセットは、彼らの目標を最大化し、敵の目標を同時に最小化する決定を学習する必要があります。
本稿では,競争ゲームの表現を学習し,特定の相手の戦略をどうマップするか,それらを破壊するかを学習する3つのニューラルネットワーク層からなる新しいモデルを提案する。
我々の実験は、オフライン、オンライン、競争特化モデル、特に同じ対戦相手と複数回対戦した場合に、我々のモデルがより良いパフォーマンスを達成することを示した。
論文 参考訳(メタデータ) (2023-10-02T08:11:07Z) - Mastering the Game of No-Press Diplomacy via Human-Regularized
Reinforcement Learning and Planning [95.78031053296513]
ノープレス外交(No-press Diplomacy)は、協力と競争の両方を含む複雑な戦略ゲームである。
我々は、人間の模倣学習ポリシーに対する報酬最大化ポリシーを規則化する、DiL-piKLと呼ばれる計画アルゴリズムを導入する。
RL-DiL-piKLと呼ばれる自己再生強化学習アルゴリズムに拡張可能であることを示す。
論文 参考訳(メタデータ) (2022-10-11T14:47:35Z) - L2E: Learning to Exploit Your Opponent [66.66334543946672]
本稿では,暗黙的対向モデリングのための新しい学習フレームワークを提案する。
L2Eは、トレーニング中に異なる相手との対話によって、相手を悪用する能力を取得する。
本稿では, 対戦相手を自動的に生成する新しい対戦相手戦略生成アルゴリズムを提案する。
論文 参考訳(メタデータ) (2021-02-18T14:27:59Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。