論文の概要: GamED.AI: A Hierarchical Multi-Agent Framework for Automated Educational Game Generation
- arxiv url: http://arxiv.org/abs/2604.23947v2
- Date: Tue, 28 Apr 2026 04:06:55 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-29 14:06:43.837388
- Title: GamED.AI: A Hierarchical Multi-Agent Framework for Automated Educational Game Generation
- Title(参考訳): GamED.AI: 教育ゲームの自動生成のための階層型マルチエージェントフレームワーク
- Abstract要約: GamED.AIは,インストラクターが提供する質問を,正式なメカニック契約によって検証された完全プレイ可能な教育ゲームに変換する階層型マルチエージェントフレームワークである。
デモでは,60秒未満でBloomの対応ゲームを生成し,パイプラインの各フェーズで品質ゲートの出力を検査し,15種類のメカニックタイプにまたがる50のゲームからなるキュレートされたライブラリを閲覧する。
- 参考スコア(独自算出の注目度): 7.277181020364616
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We introduce GamED.AI, a hierarchical multi-agent framework that transforms instructor-provided questions into fully playable, pedagogically grounded educational games validated through formal mechanic contracts. Built on phase-based LangGraph sub-graphs, deterministic Quality Gates, and structured Pydantic schemas, GamED.AI supports two template families encompassing 15 interaction mechanics across spatial reasoning, procedural execution, and higher-order Bloom's Taxonomy objectives. Evaluated on 200 questions spanning five subject domains, the system achieves a 90% validation pass rate, 98.3% schema compliance, and 73% token reduction over ReAct agents (${\sim}$73,500 $\rightarrow$ ${\sim}$19,900 tokens/game) at $0.46 per game. Within this model configuration, these results suggest that phase-bounded architectural structure correlates more strongly with alignment quality than prompting strategy alone. Our demonstration lets attendees generate Bloom's-aligned games from natural language in under 60 seconds, inspect Quality Gate outputs at each pipeline phase, and browse a curated library of 50 games spanning all 15 mechanic types.
- Abstract(参考訳): GamED.AIは,インストラクターが提供する質問を,正式なメカニック契約によって検証された,完全にプレイ可能な教育ゲームに変換する階層的なマルチエージェントフレームワークである。
GamED.AIは、位相ベースのLangGraphサブグラフ、決定論的品質ゲート、および構造化ピダンティックスキーマに基づいて構築され、空間推論、手続き実行、高階ブルームの分類目標を含む15の相互作用力学を含む2つのテンプレートファミリーをサポートする。
5つの主題ドメインにまたがる200の質問に対して評価され、システムは90%の検証パスレート、98.3%のスキーマ準拠、73%のReActエージェント($73,500 $\rightarrow$$${\sim}$19,900 tokens/game)をゲーム当たり0.46で還元する。
このモデル構成では, 相境界構造構造は, 戦略のみを推し進めるよりもアライメント品質と強く相関していることが示唆された。
デモでは,60秒未満でBloomの対応ゲームを生成し,パイプラインの各フェーズで品質ゲートの出力を検査し,15種類のメカニックタイプにまたがる50のゲームからなるキュレートされたライブラリを閲覧する。
関連論文リスト
- Investigating Knowledge Transfer Across Interactive Dialogue Games [73.44278078966448]
異なる対話ゲーム間での知識伝達について検討する。
Clembench スイートのゲーム上で LLM モデルを微調整することにより、転送可能性について検討する。
いくつかのゲームは微調整よりも転送の恩恵を受けており、ビジュオパティアル・ファミリー(例えば探索ゲーム)は転送が最善である。
論文 参考訳(メタデータ) (2026-08-25T01:47:31Z) - TeachMateGPT: A Multi-Agent Knowledge-Grounded Framework for Pedagogical Assessment Generation from Science Curriculum Materials [0.47398244756917407]
TeachMateGPTは、カリキュラムによる科学評価のオーサリングに4つの進歩をもたらしたマルチエージェントシステムである。
COPEは、トークンウィンドウチャンキングをマルチレゾリューションインデックスに置き換える階層的な知識ベースである。
SAVERは、証拠回収に対する誠実さ、関連性、幻覚リスクを判定する、ソース属性の検証プロトコルである。
論文 参考訳(メタデータ) (2026-08-13T19:06:37Z) - Tycho: Active Abstraction with Programmatic World Models for ARC-AGI-3 [6.41363581085404]
ARC-AGI-3は抽象化をスキル獲得の対話的な問題に変える。
我々はこれらの環境をパラメータ化レンダリング決定論的ムーアマシンとして定式化する。
我々は,インタラクション中にゲーム固有のモデルを構築し,使用するコーディングエージェントシステムであるTychoを紹介する。
論文 参考訳(メタデータ) (2026-07-30T14:34:41Z) - EduGuard: A Safe RAG-Based LLM Tutor for Programming Education [1.2999518604217852]
ジェネレーティブAI(GenAI)は、プログラミングの説明、デバッグ、代入サポートに学生によってますます利用されている。
本稿では,提案プログラムのための安全な検索強化世代(RAG)学習フレームワークであるEduGuardについて述べる。
EduGuardは、クエリ理解、インストラクターが承認したコース検索、教育戦略選択、ルーリック・アウェア生成、クレームレベルの検証、オーバー信頼制御を統合している。
論文 参考訳(メタデータ) (2026-07-17T08:18:18Z) - Scaling the Horizon, Not the Parameters: Reaching Trillion-Parameter Performance with a 35B Agent [98.33217711280383]
本稿では,エージェント水平線をスケーリングすることで,パラメータレベルの性能を1兆倍に向上する35B混在エージェントモデルであるAgens-A1を紹介する。
我々は、外部の知識、行動、観察、検証結果を接続する長期の知識-行動基盤を構築します。
Agents-A1は、ロングホライゾンエージェントベンチマークに対して強力で幅広いパフォーマンスを達成する。
論文 参考訳(メタデータ) (2026-06-29T17:50:54Z) - GameCraft-Bench: Can Agents Build Playable Games End-to-End in a Real Game Engine? [65.42976417627254]
ゲーム生成はゲームエンジン内で行われ、スクリプト、シーン、アセット、レンダリング、実行時インタラクションは共同でコヒーレントなゲームプレイを生成する必要がある。
我々は、完全なゲームアーティファクトを生成する問題として、エンド・ツー・エンドのゲーム生成を形式化する。
我々は、このフレームワークを15のゲームファミリーで140のGodotタスクからなるベンチマークであるGameCraft-Benchとしてインスタンス化する。
論文 参考訳(メタデータ) (2026-06-16T12:34:39Z) - MINDGAMES: A Live Arena for Evaluating Social and Strategic Reasoning in Multi-Agent LLMs [54.81359054218573]
大規模言語モデル(LLM)のためのマルチゲームアリーナと評価プラットフォームであるMindgamesを紹介する。
Mindgamesは、統合されたインタラクションインターフェース、TrueSkillベースの評価、および4つのゲーム環境にわたる完全な軌跡ログを提供する。
我々は,決定論的オフライントーナメントプロトコルMG-Refとともに,ターンレベルの観察,アクション,報酬を含む29,571個のマルチエージェントゲームを分析した。
論文 参考訳(メタデータ) (2026-05-28T07:33:47Z) - MAIC-UI: Making Interactive Courseware with Generative UI [55.66338307665182]
本研究では,ゼロコードオーサリングシステムであるMAIC-UIを提案する。
MAIC-UIは、多モーダル理解を用いた構造化知識分析を用いて、教育的厳密性を確保する。
論文 参考訳(メタデータ) (2026-04-28T16:15:04Z) - GameWorld: Towards Standardized and Verifiable Evaluation of Multimodal Game Agents [76.60994803070436]
GameWorldは、ブラウザ環境におけるマルチモーダル大言語モデル(MLLM)ゲームエージェントの評価のためのベンチマークである。
2つのゲームエージェントインタフェースが研究され、 (i) キーボードとマウスのコントロールを直接出力するコンピュータ利用エージェント、 (ii) セマンティックアクション空間で作用する汎用マルチモーダルエージェントが研究されている。
18組のモデルとインタフェースのペアによる結果は、最高のパフォーマンスエージェントでさえ、ビデオゲームで人間の能力を達成するには程遠いことを示唆している。
論文 参考訳(メタデータ) (2026-04-08T17:49:03Z) - GameDevBench: Evaluating Agentic Capabilities Through Game Development [49.19956546746812]
ゲーム開発は、エージェントが本質的にマルチモーダル資産を操作しながら大きな密集物をナビゲートしなければならないようなテストベッドを提供する。
本稿では,ゲーム開発タスクにおけるエージェント評価のための最初のベンチマークであるGameDevBenchを紹介する。
エージェントは依然としてゲーム開発に苦戦しており、最高のエージェントは54.5%のタスクしか解決していない。
論文 参考訳(メタデータ) (2026-02-11T18:15:11Z) - Generative Ontology: When Structured Knowledge Learns to Create [0.0]
生成オントロジー(Generative Ontology)は、ドメイン知識をDSPyシグネチャを介してLLM生成を制約する実行可能なピダンティックスキーマとしてエンコードする。
我々はGameGrammarというフレームワークを実演し、完全なテーブルトップゲームデザインを作成し、3つの経験的研究を提示する。
論文 参考訳(メタデータ) (2026-02-05T13:14:20Z) - NitroGen: An Open Foundation Model for Generalist Gaming Agents [101.41866522979548]
NitroGenは、ジェネラリストゲームエージェントのためのビジョンアクション基盤モデルである。
1000以上のゲームで4万時間のゲームプレイビデオでトレーニングされている。
論文 参考訳(メタデータ) (2026-01-04T16:24:50Z) - Synergizing Code Coverage and Gameplay Intent: Coverage-Aware Game Playtesting with LLM-Guided Reinforcement Learning [4.3706127838450035]
ゲーム・アズ・ア・サービス(Games as a Service)モデルは頻繁なコンテンツ更新を必要とする。
コード中心の手法は、ゲームプレイコンテキストを理解せずに構造的カバレッジに焦点を当てる。
ゲーム更新テストのための構造検証と機能検証を相乗化する新しいフレームワークSMARTを提案する。
論文 参考訳(メタデータ) (2025-12-14T14:18:18Z) - Synthetic Visual Genome [88.00433979509218]
本稿では,高品質な高次グラフを大規模に構築できる密接な注釈付き関係を持つ命令設計法であるROBINを紹介する。
我々のデータセットは合計146K画像と2.6Mオブジェクトの5.6M関係を含んでいる。
ROBIN-3Bモデルは300万件未満のインスタンスでトレーニングされているにもかかわらず、関係理解ベンチマークで3億件以上のインスタンスでトレーニングされた類似サイズのモデルを上回っている。
論文 参考訳(メタデータ) (2025-06-09T11:09:10Z) - Game-RL: Synthesizing Multimodal Verifiable Game Data to Boost VLMs' General Reasoning [89.93384726755106]
視覚言語強化学習(RL)は主に狭い領域に焦点を当てている。
ビデオゲームは本質的に、検証が容易なリッチなビジュアル要素とメカニクスを提供します。
ビデオゲームにおけるマルチモーダルかつ検証可能な報酬を完全に活用するために,Game-RLを提案する。
論文 参考訳(メタデータ) (2025-05-20T03:47:44Z) - Generative Agents for Multi-Agent Autoformalization of Interaction Scenarios [3.5083201638203154]
本稿では,GAMA(Generative Agents for Multi-Agent Autoformalization)フレームワークを紹介する。
GAMAは大規模言語モデル(LLM)を付加したエージェントを用いたシミュレーションにおける相互作用シナリオの形式化を自動化する
5つの2x2同時移動ゲームにおける110の自然言語記述の実験では、GAMAは100%構文的、76.5%の意味的正当性を達成している。
論文 参考訳(メタデータ) (2024-12-11T22:37:45Z) - A Survey on Large Language Model-Based Game Agents [35.34074811680046]
ゲームエージェントは、人工知能に関連する能力を探索するための貴重なテストベッドを提供する。
近年、LLM(Large Language Models)の出現は、これらのエージェントに一般化可能な推論を与える新たな機会を提供する。
この調査は、統一された参照アーキテクチャを通して、LLMベースのゲームエージェントの最新のレビューを提供する。
論文 参考訳(メタデータ) (2024-04-02T15:34:18Z) - Learning in Stackelberg Games with Non-myopic Agents [60.927889817803745]
そこで本研究では,主役が非筋力的な長寿命エージェントと繰り返し対話するスタックルバーグゲームについて,エージェントの支払関数を知らずに検討する。
我々は、非ミオピックエージェントの存在下での学習を、ミオピックエージェントの存在下で堅牢な帯域最適化に還元する一般的なフレームワークを提供する。
論文 参考訳(メタデータ) (2022-08-19T15:49:30Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。