論文の概要: Adaptive Command: Real-Time Policy Adjustment via Language Models in StarCraft II
- arxiv url: http://arxiv.org/abs/2508.16580v1
- Date: Tue, 05 Aug 2025 03:26:58 GMT
- ステータス: 翻訳完了
- システム内更新日: 2025-08-31 21:54:20.558949
- Title: Adaptive Command: Real-Time Policy Adjustment via Language Models in StarCraft II
- Title(参考訳): Adaptive Command:StarCraft IIの言語モデルによるリアルタイムポリシー調整
- Authors: Weiyu Ma, Dongyu Xu, Shu Lin, Haifeng Zhang, Jun Wang,
- Abstract要約: 本稿では,大規模言語モデル(LLM)と行動木を統合する新しいフレームワークであるAdaptive Commandを紹介し,StarCraft IIにおける戦略的意思決定をリアルタイムに行う。
本システムは,自然言語インタラクションによる複雑な動的環境における人間とAIの協調性の向上に重点を置いている。
- 参考スコア(独自算出の注目度): 6.7213130339934315
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We present Adaptive Command, a novel framework integrating large language models (LLMs) with behavior trees for real-time strategic decision-making in StarCraft II. Our system focuses on enhancing human-AI collaboration in complex, dynamic environments through natural language interactions. The framework comprises: (1) an LLM-based strategic advisor, (2) a behavior tree for action execution, and (3) a natural language interface with speech capabilities. User studies demonstrate significant improvements in player decision-making and strategic adaptability, particularly benefiting novice players and those with disabilities. This work contributes to the field of real-time human-AI collaborative decision-making, offering insights applicable beyond RTS games to various complex decision-making scenarios.
- Abstract(参考訳): 本稿では,大規模言語モデル(LLM)と行動木を統合する新しいフレームワークであるAdaptive Commandを紹介し,StarCraft IIにおける戦略的意思決定をリアルタイムに行う。
本システムは,自然言語インタラクションによる複雑な動的環境における人間とAIの協調性の向上に重点を置いている。
本フレームワークは,(1)LSMに基づく戦略的アドバイザ,(2)行動実行のための行動木,(3)音声機能を備えた自然言語インタフェースを備える。
ユーザスタディは、プレイヤーの意思決定と戦略的適応性において、特に初心者や障害者にとって大きな改善を示す。
この研究は、リアルタイムな人間とAIの協調的な意思決定の分野に貢献し、RTSゲームを超えて様々な複雑な意思決定シナリオに適用可能な洞察を提供する。
関連論文リスト
- GameTalk: Training LLMs for Strategic Conversation [51.29670609281524]
マルチターンインタラクションによる戦略的意思決定のために,LLMをトレーニングするフレームワークであるtextbfGameTalkを紹介した。
シングルターンの目的や静的アクション予測に焦点を当てた以前の作業とは異なり、私たちはLLMをトレーニングして、全会話にわたってグローバルな目的を最適化します。
本手法は, 推論, コーディネート, 対戦型モデリングの異なる側面を強調するために設計された, ますます複雑なゲーム群に対して評価する。
論文 参考訳(メタデータ) (2026-01-22T19:18:39Z) - UserLM-R1: Modeling Human Reasoning in User Language Models with Multi-Reward Reinforcement Learning [32.51053667574764]
推論機能を備えた新しいユーザ言語モデルであるUserLM-R1を提案する。
まず,静的な役割と,多様なシナリオに適応するための動的シナリオ特異的な目標を兼ね備えた包括的ユーザプロファイルを構築した。
そこで我々は,応答を生成する前に,高品質な合理性を生成するためのゴール駆動意思決定政策を提案する。
論文 参考訳(メタデータ) (2026-01-14T06:42:01Z) - Society of Mind Meets Real-Time Strategy: A Hierarchical Multi-Agent Framework for Strategic Reasoning [16.35236123729838]
我々は,Strategic Planner (SP) と呼ばれるメタコントローラの下で,特殊模倣学習エージェントを利用する階層型マルチエージェントフレームワークを提案する。
専門家によるデモンストレーションによって、各特殊エージェントは、航空支援や防御演習のような独特の戦略を学び、一貫性のある、構造化された多段階のアクションシーケンスを生成する。
SPはこれらの提案を1つの環境適応プランに編成し、局所的な決定が長期的な戦略と整合することを保証する。
論文 参考訳(メタデータ) (2025-08-08T05:57:12Z) - TacticCraft: Natural Language-Driven Tactical Adaptation for StarCraft II [4.059142160949011]
本稿では,StarCraft IIのAIエージェントの戦術的条件付けのためのアダプタベースのアプローチを提案する。
提案手法は,事前学習されたポリシーネットワーク(DI-Star)を凍結し,各アクションヘッドに軽量なアダプタモジュールを付加する。
実験の結果,攻撃性,拡張パターン,技術嗜好など,戦術的側面におけるエージェントの挙動の調整に成功していることがわかった。
論文 参考訳(メタデータ) (2025-07-21T13:42:06Z) - Agents Play Thousands of 3D Video Games [26.290863972751428]
我々は、何千もの3Dビデオゲームをプレイできる人工知能エージェントを開発するための新しいフレームワーク、Portalを提示する。
意思決定問題を言語モデリングタスクに変換することで,大規模言語モデル(LLM)を利用して行動木を生成する。
当社のフレームワークでは,ルールベースのノードとニューラルネットワークコンポーネントを組み合わせたハイブリッドポリシ構造を導入し,高レベルの戦略的推論と高精度な低レベル制御を実現する。
論文 参考訳(メタデータ) (2025-03-17T16:42:34Z) - AVA: Attentive VLM Agent for Mastering StarCraft II [56.07921367623274]
Intentive VLM Agent (AVA) は、人工エージェントの認識と人間のゲームプレイ体験を一致させるマルチモーダルのStarCraft IIエージェントである。
我々のエージェントは、ゲームプレイ中に人間の認知過程をより密にシミュレートするRGB視覚入力と自然言語観察を組み込むことにより、この制限に対処する。
論文 参考訳(メタデータ) (2025-03-07T12:54:25Z) - Efficient Adaptation in Mixed-Motive Environments via Hierarchical Opponent Modeling and Planning [51.52387511006586]
本稿では,HOP(Hierarchical Opponent Modeling and Planning)を提案する。
HOPは階層的に2つのモジュールから構成される: 相手の目標を推論し、対応する目標条件のポリシーを学ぶ、反対モデリングモジュール。
HOPは、さまざまな未確認エージェントと相互作用する際、優れた少数ショット適応能力を示し、セルフプレイのシナリオで優れている。
論文 参考訳(メタデータ) (2024-06-12T08:48:06Z) - Policy Learning with a Language Bottleneck [65.99843627646018]
本稿では,AIエージェントが言語規則を生成可能なフレームワークであるPLLB(Language Bottleneck)について紹介する。
PLLBBは言語モデルによってガイドされる*ルール生成*ステップと、エージェントがルールによってガイドされる新しいポリシーを学ぶ*アップデート*ステップとを代替する。
PLLBエージェントは、より解釈可能で一般化可能な振る舞いを学べるだけでなく、学習したルールを人間のユーザと共有できることを示す。
論文 参考訳(メタデータ) (2024-05-07T08:40:21Z) - Decision-Oriented Dialogue for Human-AI Collaboration [62.367222979251444]
そこでは,大規模言語モデル(LM)のようなAIアシスタントが,自然言語を介して複数の人間と協調して複雑な意思決定を行うための,意思決定指向対話と呼ばれるタスクのクラスについて述べる。
日常的な意思決定に直面する3つの領域を定式化し,(1)レビュアーの会議論文への課題の選択,(2)都市における複数段階の旅程の計画,(3)友人集団の旅行計画の交渉を行う。
各タスクに対して、エージェントが到達した最終決定の質に基づいて報酬を受け取る対話環境を構築する。
論文 参考訳(メタデータ) (2023-05-31T17:50:02Z) - Coach-Player Multi-Agent Reinforcement Learning for Dynamic Team
Composition [88.26752130107259]
現実世界のマルチエージェントシステムでは、異なる能力を持つエージェントがチーム全体の目標を変更することなく参加または離脱する可能性がある。
この問題に取り組むコーチ・プレイヤー・フレームワーク「COPA」を提案します。
1)コーチと選手の両方の注意メカニズムを採用し、2)学習を正規化するための変動目標を提案し、3)コーチが選手とのコミュニケーションのタイミングを決定するための適応的なコミュニケーション方法を設計する。
論文 参考訳(メタデータ) (2021-05-18T17:27:37Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。