論文の概要: pixelLOG: Logging of Online Gameplay for Cognitive Research
- arxiv url: http://arxiv.org/abs/2602.08941v1
- Date: Mon, 09 Feb 2026 17:38:55 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-02-10 20:26:25.401727
- Title: pixelLOG: Logging of Online Gameplay for Cognitive Research
- Title(参考訳): pixelLOG:認知研究のためのオンラインゲームプレイのログ
- Abstract要約: pixelLOGは、SpigotベースのMinecraftサーバ用の高性能データ収集フレームワークである。
pixelLOGは、マルチプレイヤー/マルチエージェント環境での人間の行動追跡を可能にする。
システムは、アクティブな状態ポーリングと受動的イベント監視のハイブリッドアプローチを通じて、包括的な行動データをキャプチャする。
- 参考スコア(独自算出の注目度): 6.001264516241015
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Traditional cognitive assessments often rely on isolated, output-focused measurements that may fail to capture the complexity of human cognition in naturalistic settings. We present pixelLOG, a high-performance data collection framework for Spigot-based Minecraft servers designed specifically for process-based cognitive research. Unlike existing frameworks tailored only for artificial intelligence agents, pixelLOG also enables human behavioral tracking in multi-player/multi-agent environments. Operating at configurable frequencies up to and exceeding 20 updates per second, the system captures comprehensive behavioral data through a hybrid approach of active state polling and passive event monitoring. By leveraging Spigot's extensible API, pixelLOG facilitates robust session isolation and produces structured JSON outputs integrable with standard analytical pipelines. This framework bridges the gap between decontextualized laboratory assessments and richer, more ecologically valid tasks, enabling high-resolution analysis of cognitive processes as they unfold in complex, virtual environments.
- Abstract(参考訳): 伝統的な認知評価は、自然主義的な設定において人間の認知の複雑さを捉えるのに失敗する可能性のある、孤立したアウトプットに焦点を当てた測定に依存することが多い。
プロセスベース認知研究に特化した,SpigotベースのMinecraftサーバ用の高性能データ収集フレームワークであるPixelLOGを提案する。
人工知能エージェント専用の既存のフレームワークとは異なり、PixelLOGはマルチプレイヤー/マルチエージェント環境での人間の行動追跡も可能にしている。
設定可能な周波数で毎秒20回以上の更新を処理し、アクティブな状態ポーリングと受動的イベント監視のハイブリッドアプローチを通じて包括的な行動データをキャプチャする。
Spigotの拡張APIを活用することで、PixelLOGは堅牢なセッション分離を促進し、標準的な分析パイプラインと統合可能な構造化JSON出力を生成する。
この枠組みは、非コンテキスト化された実験室の評価とよりリッチで生態学的に有効なタスクのギャップを埋め、複雑な仮想環境に展開する認知過程の高分解能な分析を可能にする。
関連論文リスト
- DuMateBench: Evaluating Autonomous Agents in Complex Real-World Workflows [69.12339622053588]
我々はDuMateBenchを紹介した。DuMateBenchは匿名化およびプライバシスクリーニングによるユーザセッションから再構築されたリアルセッションベンチマークである。
結果として得られたベンチマークは、8つの広いシナリオにまたがる200のタスクと、17のきめ細かい機能カテゴリで構成されている。
これらのタスクは、Isufficient、Unstable、Noisyの3種類の環境複雑性を注入した、分離されたDockerコンテナで実行します。
論文 参考訳(メタデータ) (2026-08-27T02:36:23Z) - Scaling Agentic Capabilities via Grounded Interaction Synthesis [12.796216573698677]
本稿では,多様な環境や複雑なタスクのスケーラブルな構築を自動化するフレームワークであるGarthed Agentic Interaction Synthesis (GAIS)を紹介する。
具体的には、機能的多様性と難易度を確保するために、実世界のモデルコンテキストプロトコル(MCP)サーバから派生したプロトコルアンコール環境を構築する。
BFCL、$2-Bench、ACEBenchの実験では、GAIS合成データが最先端のベースラインを大幅に上回ることを示した。
論文 参考訳(メタデータ) (2026-06-01T09:57:52Z) - Characterization of Multi-Model Agentic AI Systems on General Tasks via Trace-Driven Simulation [16.378414807882603]
本稿では、2つの最先端エージェントシステムのトークンレベルトレースデータセットであるGAIATraceについて述べる。
GAIATraceは、すべての主要なLLMの完全な推論トークン、タスクレベル構造、アクティビティをキャプチャする。
また、GAIATraceを再生して再現可能で低コストなシステム評価を行うトレース駆動シミュレータVidur-Agentを提案する。
論文 参考訳(メタデータ) (2026-06-01T05:43:16Z) - Towards a Virtual Neuroscientist: Autonomous Neuroimaging Analysis via Multi-Agent Collaboration [53.772014300855375]
我々は,自律型エンドツーエンド神経画像解析のためのマルチエージェントシステムであるNIAgentを紹介する。
従来のフラットなツール呼び出しエージェントとは異なり、NIAgentはコード中心の実行パラダイムを採用している。
本稿では,コホートレベルの検定とエージェント視覚検査を組み合わせた,自律的品質管理のための階層的検証フレームワークを提案する。
論文 参考訳(メタデータ) (2026-05-10T06:30:19Z) - CLAIRE: Compressed Latent Autoencoder for Industrial Representation and Evaluation -- A Deep Learning Framework for Smart Manufacturing [51.56484100374058]
CLAIREは、教師なしの深層表現学習と、スマート製造システムにおけるインテリジェントな品質管理のための教師付き分類を統合したハイブリッドエンドツーエンド学習フレームワークである。
最適化されたディープオートエンコーダを使用して、生の入力をコンパクトな潜伏空間に変換し、不適切な特徴やノイズを抑えながら本質的なデータ構造を効果的にキャプチャする。
提案したフレームワークは、堅牢な障害検出のために、説明可能なAIと機能認識の正規化を統合する可能性を強調している。
論文 参考訳(メタデータ) (2026-03-06T15:11:58Z) - Zero-shot HOI Detection with MLLM-based Detector-agnostic Interaction Recognition [71.5328300638085]
Zero-shot Human-Object Interaction (HOI) は、画像中の人間と物体を特定し、その相互作用を認識することを目的としている。
2段階法を含む既存の手法は、特定の検出器との相互作用認識を密に結合する。
本稿では、オブジェクト検出をIRから分離し、マルチモーダル大言語モデル(MLLM)をゼロショットIRに活用する分離フレームワークを提案する。
論文 参考訳(メタデータ) (2026-02-16T19:01:31Z) - AgentSkiller: Scaling Generalist Agent Intelligence through Semantically Integrated Cross-Domain Data Synthesis [30.512393568258105]
大規模言語モデルエージェントは、ツールを介して現実世界の問題を解決する可能性を実証するが、汎用的な知性は、質の低い長期データによってボトルネックとなる。
本稿では,現実的なセマンティックなドメイン間でのマルチターンインタラクションデータを合成する,完全に自動化されたフレームワークであるAgentSkillerを提案する。
論文 参考訳(メタデータ) (2026-02-10T03:21:42Z) - Code-in-the-Loop Forensics: Agentic Tool Use for Image Forgery Detection [59.04089915447622]
ForenAgentはインタラクティブなIFDフレームワークで、MLLMが検出対象に関するPythonベースの低レベルツールを自律的に生成、実行、洗練することができる。
人間の推論にインスパイアされた我々は、グローバルな認識、局所的な焦点、反復的探索、そして全体論的偏見を含む動的推論ループを設計する。
実験の結果,ForenAgent は IFD 課題に対する創発的なツール利用能力と反射的推論を示すことがわかった。
論文 参考訳(メタデータ) (2025-12-18T08:38:44Z) - SelfAI: Building a Self-Training AI System with LLM Agents [79.10991818561907]
SelfAIは、高レベルの研究目的を標準化された実験構成に変換するためのUser Agentを組み合わせた、一般的なマルチエージェントプラットフォームである。
実験マネージャは、連続的なフィードバックのための構造化知識ベースを維持しながら、異種ハードウェアをまたいだ並列かつフォールトトレラントなトレーニングを編成する。
回帰、コンピュータビジョン、科学計算、医用画像、薬物発見ベンチマークなどを通じて、SelfAIは一貫して高いパフォーマンスを達成し、冗長な試行を減らしている。
論文 参考訳(メタデータ) (2025-11-29T09:18:39Z) - Identifying Slug Formation in Oil Well Pipelines: A Use Case from Industrial Analytics [0.0]
本稿では,コンパクトでユーザフレンドリなインターフェースによるエンドツーエンドのデータ駆動スラグ検出を実現する対話型アプリケーションを提案する。
このデモでは、人間同士の対話的なMLシステムが、データサイエンスの方法と、重要なプロセス産業における現実世界の意思決定のギャップを埋める方法を紹介している。
論文 参考訳(メタデータ) (2025-11-02T08:26:32Z) - See, Think, Act: Online Shopper Behavior Simulation with VLM Agents [58.92444959954643]
本稿では,視覚情報,特にWebページスクリーンショットのVLMによる動作シミュレーションへの統合について検討する。
我々は,協調行動予測と合理化生成にSFTを用いて,相互作用の完全な文脈を条件づける。
推論能力をさらに強化するため,RLを階層的な報酬構造と統合し,難易度因子によって拡張する。
論文 参考訳(メタデータ) (2025-10-22T05:07:14Z) - Experience-Driven Exploration for Efficient API-Free AI Agents [34.38668336861503]
KG-Agentは、エージェントの生のピクセルレベルのインタラクションを永続的なState-Action Knowledge Graphに構造化する、経験駆動学習フレームワークである。
KG-Agentは、機能的に類似しているが視覚的に異なるGUI状態をリンクすることで、非効率な探索を克服する。
我々は,最先端手法よりも探索効率と戦略深度が大幅に向上したことを示す。
論文 参考訳(メタデータ) (2025-10-17T02:53:06Z) - On Multi-entity, Multivariate Quickest Change Point Detection [2.0369245689839817]
変更点検出(CPD)は、従来のセンシング手法が実現不可能なクラウドモニタリングのアプリケーションによって動機付けられている。
本稿では,正常度からの個人偏差(IDfN)の概念を紹介し,正常度を訓練した再構成エラーベースのオートエンコーダを用いて計算する。
平均値、分散値、カーネル密度推定値(KDE)を用いてこれらの個々の偏差を集約し、システムワイド異常スコア(SWAS)を生成する。
我々の教師なしアプローチはラベル付きデータや特徴抽出の必要性を排除し、ストリーミング入力のリアルタイム操作を可能にします。
論文 参考訳(メタデータ) (2025-09-22T18:35:24Z) - Agent4FaceForgery: Multi-Agent LLM Framework for Realistic Face Forgery Detection [108.5042835056188]
この作業では,2つの基本的な問題に対処するため,Agent4FaceForgeryを導入している。
人間の偽造の多様な意図と反復的なプロセスを捉える方法。
ソーシャルメディアの偽造に付随する複雑な、しばしば敵対的な、テキストと画像のインタラクションをモデル化する方法。
論文 参考訳(メタデータ) (2025-09-16T01:05:01Z) - Multi-dimensional Autoscaling of Processing Services: A Comparison of Agent-based Methods [5.201504495733271]
この作業では、制約のある環境で要求を満たすのを最大化するエージェントベースのオートスケーリングフレームワークを導入している。
我々は,アクティブ推論,ディープQネットワーク,構造知識の分析,ディープアクティブ推論の4種類のスケーリングエージェントを比較した。
論文 参考訳(メタデータ) (2025-06-12T07:20:26Z) - Entropy-Regularized Token-Level Policy Optimization for Language Agent Reinforcement [67.1393112206885]
大規模言語モデル(LLM)は、対話的な意思決定タスクにおいてインテリジェントなエージェントとして期待されている。
本稿では,トークンレベルでのLLMの最適化に適したエントロピー拡張RL法である,エントロピー正規化トークンレベル最適化(ETPO)を導入する。
我々は,データサイエンスコード生成を多段階対話型タスクのシリーズとしてモデル化したシミュレーション環境におけるETPOの有効性を評価する。
論文 参考訳(メタデータ) (2024-02-09T07:45:26Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。