論文の概要: Infinite Worlds with Versatile Interactions
- arxiv url: http://arxiv.org/abs/2607.07534v1
- Date: Wed, 08 Jul 2026 15:33:25 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-09 22:50:30.439464
- Title: Infinite Worlds with Versatile Interactions
- Title(参考訳): 可逆相互作用を持つ無限世界
- Abstract要約: LingBot-World 2.0(LingBot-World-Infinity)は、LingBot-Worldの先進的なイテレーションである。
今回のアップデートでは、より広い範囲のアクションを含む、非常に多様なインタラクティブな要素が導入されている。
共有体験を容易にするために,複数のプレイヤーが同時にこの鮮やかな世界シミュレータに没入できるインタフェースを開発した。
- 参考スコア(独自算出の注目度): 72.56254206708059
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: We present LingBot-World 2.0 (also known as LingBot-World-Infinity), an advanced iteration of LingBot-World featuring four distinct upgrades. (1) Our model achieves an unbounded interaction horizon while maintaining consistent output quality, benefiting from a carefully crafted causal pretraining paradigm. (2) Through distilling a real-time variant from the base model, our system guarantees rapid response time, sufficient to drive 720p video streams at 60 fps. (3) Compared to the previous version, this update introduces highly diverse interactive elements, comprising a broader spectrum of actions (e.g., attacking, archery, spell-casting, and shooting) alongside a richer variety of text-driven events. (4) We pioneer the integration of an agentic harness within the domain of world modeling, wherein a pilot agent is tasked with planning and executing character behaviors, while a director agent is responsible for synthesizing novel environmental elements as the scene progresses. Additionally, to facilitate a shared experience, we develop an interface that permits multiple players to simultaneously immerse themselves in this vivid world simulator. We pair our primary 14B model with a lightweight 1.3B counterpart, which supports effortless deployment on a single GPU.
- Abstract(参考訳): 我々は、LingBot-World 2.0(LingBot-World-Infinityとも呼ばれる)を紹介する。
1)本モデルは,厳密な因果前訓練パラダイムの恩恵を受けながら,一貫した出力品質を維持しつつ,非有界相互作用の地平を達成している。
2) ベースモデルからリアルタイムな変種を抽出することにより,60fpsで720pのビデオストリームを駆動するのに十分な応答時間を保証できる。
(3) 前バージョンと比較して、今回のアップデートは多種多様なインタラクティブな要素を導入し、より多様なテキスト駆動イベントとともに幅広いアクション(例えば、アタック、アーチェリー、スペルキャスティング、シューティング)を含む。
(4) パイロットエージェントはキャラクターの動作を計画・実行し、ディレクターエージェントはシーンが進むにつれて新しい環境要素を合成する。
さらに、共有体験を促進するために、複数のプレイヤーが同時にこの鮮やかな世界シミュレータに没入できるインタフェースを開発する。
メインの14Bモデルと軽量の1.3Bモデルとをペアにしています。
関連論文リスト
- ABot-World-0: Infinite Interactive World Rollout on a Single Desktop GPU [41.37131555577374]
ABot-World-0は、リアルタイムで長時間のクローズドループインタラクションのためのアクション条件付きビデオワールドモデルである。
WorldExplorerは、トレーニングフィードバックによってガイドされたエージェント駆動のコレクションを実行する。
統一パイプラインは、14の決定論的品質チェック、VLMベースのアセスメント、同期アクションとテキストアノテーションを適用している。
論文 参考訳(メタデータ) (2026-07-21T15:26:50Z) - AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report [39.20781986625199]
AlayaWorldは、24fpsの動画を540pと720pで生成する、インタラクティブなロングホライゾンビデオワールドモデルである。
AlayaWorldは15Bビデオ拡散トランスフォーマーをベースとして、カメラの軌道下で短時間の潜伏チャンクを自動回帰的に生成する。
iWorld-Benchでは、AlayaWorldは長距離世代よりも最高のパフォーマンスを実現している。
論文 参考訳(メタデータ) (2026-07-20T17:15:41Z) - Multiplayer Interactive World Models with Representation Autoencoders [28.451678067070777]
複雑な物理的相互作用によって制御される高度に動的な環境に対する最初のマルチプレイヤー世界モデルを導入する。
我々は,この問題をRocket Leagueのゲームで研究し,高速で密結合したダイナミックスの下でプレイヤーが競争し,協力する。
論文 参考訳(メタデータ) (2026-07-06T17:31:52Z) - Gamma-World: Generative Multi-Agent World Modeling Beyond Two Players [87.87842088508553]
対話型シミュレーションのための生成的マルチエージェント世界モデルを提案する。
本モデルでは,映像の忠実度,アクション制御性,およびスロットベースおよび高密度アテンションベースライン上でのエージェント間整合性を改善する。
論文 参考訳(メタデータ) (2026-05-27T17:59:31Z) - ActionParty: Multi-Subject Action Binding in Generative Video Games [117.52562594944679]
ActionPartyは、ゲーム生成のための制御可能な多目的世界モデルである。
46の多様な環境において最大7人のプレイヤーを同時に制御できる最初のビデオワールドモデルを実証する。
論文 参考訳(メタデータ) (2026-04-02T17:59:58Z) - MultiGen: Level-Design for Editable Multiplayer Worlds in Diffusion Game Engines [55.641812280108574]
ユーザアクションによって継続的に更新され,世代別ロールアウトを通じてクエリされるシステムに,明示的な外部メモリを導入する。
この設計により、ユーザーは編集可能なメモリ表現を通じて環境構造を直接、編集可能な制御を行うことができる。
コヒーレントな視点と一貫したクロスプレイヤーインタラクションを備えた、リアルタイムマルチプレイヤーロールアウトに自然に拡張する。
論文 参考訳(メタデータ) (2026-03-03T18:58:17Z) - Solaris: Building a Multiplayer Video World Model in Minecraft [25.935990718354176]
既存のアクション条件付きビデオ生成モデル(ビデオワールドモデル)は、単一エージェントの視点に限られる。
我々は,一貫したマルチビュー観測をシミュレートするマルチプレイヤービデオワールドモデルSolarisを紹介する。
我々は1264万のマルチプレイヤーフレームを収集し、マルチプレイヤー運動、メモリ、グラウンド、ビルディング、ビュー整合性の評価フレームワークを提案する。
論文 参考訳(メタデータ) (2026-02-25T18:59:01Z) - Causal World Modeling for Robot Control [56.31803788587547]
ビデオワールドモデルは、アクションと視覚力学の因果関係を理解することによって、近い将来に想像できる能力を提供する。
本稿では,フレーム予測とポリシ実行を同時に学習する自動回帰拡散フレームワークLingBot-VAを紹介する。
シミュレーションベンチマークと実世界のシナリオの両方でモデルを評価したところ、長距離操作、ポストトレーニングにおけるデータ効率、新しい構成への強力な一般化性などに大きな可能性を示唆している。
論文 参考訳(メタデータ) (2026-01-29T17:07:43Z) - Animate Any Character in Any World [61.112404900403284]
我々は,静的世界生成の現実性と構造的基盤を活用するAniXを紹介する。
ユーザは3DGSのシーンとキャラクタを提供し、そのキャラクターを自然言語で指示して、多様な振る舞いを実行できる。
AiXは、提供されたシーンとキャラクタとの視覚的忠実性を保った時間的コヒーレントなビデオクリップを合成する。
論文 参考訳(メタデータ) (2025-12-18T18:59:18Z) - Hunyuan-GameCraft-2: Instruction-following Interactive Game World Model [19.937724706042804]
Hunyuan-GameCraft-2は生成ゲームワールドモデリングのための命令駆動インタラクションの新しいパラダイムである。
我々のモデルでは,自然言語のプロンプトやキーボード,マウスの信号を通じてゲーム映像のコンテンツを制御することができる。
本モデルでは,時間的コヒーレントかつ因果的な対話型ゲームビデオを生成する。
論文 参考訳(メタデータ) (2025-11-28T18:26:39Z) - Matrix-Game 2.0: An Open-Source, Real-Time, and Streaming Interactive World Model [15.16063778402193]
Matrix-Game 2.0はインタラクティブな世界モデルで、数ステップの自己回帰拡散を通じて長時間の動画をオンザフライで生成する。
超高速25FPSで、さまざまなシーンで高品質のミニレベルビデオを生成することができる。
論文 参考訳(メタデータ) (2025-08-18T15:28:53Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。