論文の概要: Peg-in-Bench: A Modular Benchmark for High-Precision Robotic Insertion
- arxiv url: http://arxiv.org/abs/2609.00906v1
- Date: Tue, 01 Sep 2026 08:37:31 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-02 16:31:36.482284
- Title: Peg-in-Bench: A Modular Benchmark for High-Precision Robotic Insertion
- Title(参考訳): Peg-in-Bench: 高精度ロボットインサーションのためのモジュールベンチマーク
- Authors: Yosel Delgado, José G. Buenaventura-Carreón, Floris Erich, Roman Mykhailyshyn, Tomohiro Motoda, Koshi Makihara, Yukiyasu Domae,
- Abstract要約: 本稿では,高精度挿入におけるタスクの一般化を評価するために,再構成可能なペグ・イン・ホールベンチマークを提案する。
ベンチマークは、複数のペグ、許容レベル、ジオメトリのベース構造を含む、完全な3Dプリント可能なモジュラーコンポーネントで構成されている。
また,標準化されたタスク構成と機械可読なタスク記述を生成するシナリオ生成ツールも提供する。
- 参考スコア(独自算出の注目度): 2.1455710907179415
- License: http://creativecommons.org/licenses/by-nc-sa/4.0/
- Abstract: High-precision insertion remains a fundamental challenge in robotic manipulation due to the strict alignment requirements and contact-rich interactions involved. Although peg-in-hole tasks are widely used for evaluation, existing bench- marks often rely on fixed task configurations, limiting their ability to assess robustness and generalization across different insertion scenarios. This paper introduces a reconfigurable peg-in-hole benchmark designed to evaluate task generalization in high-precision insertion. The benchmark consists of a set of fully 3D-printable modular components, including multiple peg geometries, tolerance levels, and configurable base structures that can be combined to generate a large variety of insertion and assembly tasks. By varying object layouts, orientations, and task structures while maintaining controlled physical conditions, the benchmark enables systematic evaluation of adaptation to unseen scenarios. To support reproducibility, we additionally provide a scenario generation tool capable of producing standardized task configurations and machine-readable task descriptions. The scenario generation tool and the STL files of the benchmark pieces are available through the project repository: https://github.com/aistairc/peg-in-bench.
- Abstract(参考訳): 高精度挿入は、厳密なアライメント要求と接触に富んだ相互作用のため、ロボット操作の基本的な課題である。
ペグ・イン・ホールのタスクは評価に広く使われているが、既存のベンチマークは固定されたタスク設定に依存しており、異なる挿入シナリオ間で堅牢性や一般化を評価する能力を制限する。
本稿では,高精度挿入におけるタスクの一般化を評価するために,再構成可能なペグ・イン・ホールベンチマークを提案する。
ベンチマークは完全な3Dプリント可能なモジュラーコンポーネントで構成されており、複数のペグジオメトリ、許容レベル、様々な挿入タスクと組み立てタスクを生成するために組み合わせられる構成可能なベース構造を含んでいる。
制御された物理的条件を維持しながらオブジェクトレイアウト、向き、タスク構造を変化させることで、ベンチマークは目に見えないシナリオへの適応の体系的な評価を可能にする。
再現性を支援するため,標準化されたタスク構成と機械可読なタスク記述を生成するシナリオ生成ツールも提供する。
シナリオ生成ツールとベンチマーク項目のSTLファイルは、プロジェクトのリポジトリから入手できる。
関連論文リスト
- ICAE-Bench: Evaluating Coding Agents as Interactive Project Builders [26.859032352714276]
本稿では,インタラクティブなプロジェクト構築環境下でのコーディングエージェント評価ベンチマークICAE-Benchを紹介する。
基本的な考え方はファジィな製品要件から始め、自動化されたUser Agentで動的パラダイムをシミュレートすることです。
ICAE-Benchは、機能的正当性、セマンティックおよびAPI類似性、構造的忠実性、設計品質、相互作用品質などの多次元診断と共に標準化されたブラックボックステストを使用する。
論文 参考訳(メタデータ) (2026-07-23T11:31:38Z) - ProtoAda: Prototype-Guided Adaptive Adapter Expansion and Geometric Consolidation for Multimodal Continual Instruction Tuning [16.21619173438734]
MLLM(Multimodal Large Language Models)は、命令チューニングによって高いパフォーマンスを達成するが、現実のデプロイメントでは、新たな視覚言語機能を取得する必要がある。
近年の手法では、画像-テキスト類似性ルーティングのMixture of LoRA Expertsのようなスパースアーキテクチャが採用されている。
プロトタイプ誘導適応チューニングフレームワークProtoAdaを提案する。
論文 参考訳(メタデータ) (2026-06-01T17:59:13Z) - 3SGen: Unified Subject, Style, and Structure-Driven Image Generation with Adaptive Task-specific Memory [54.056509629389915]
3SGenはタスク対応の統一フレームワークで、単一のモデル内で3つの条件付けモードすべてを実行する。
その中核となるのは、Adaptive Task-specific Memory (ATM)モジュールで、動的に切り離され、格納され、条件固有の事前情報を検索する。
本稿では3SGen-Benchを提案する。3SGen-Benchは3SGen-Bench,3SGen-Bench,3SGen-Bench,3SGen-Bench,3SGen-Bench,3SGen-Bench,3SGen-Bench。
論文 参考訳(メタデータ) (2025-12-22T11:07:27Z) - ARCANE: A Multi-Agent Framework for Interpretable and Configurable Alignment [11.754819989978785]
ARCANEは、複数エージェントの協調問題としてアライメントをフレーム化して、自然言語のルーリックとして利害関係者の好みを動的に表現するフレームワークである。
実用理論に着想を得て, ルーブリック学習を再構築問題として定式化し, 正規化グループシーケンスポリシー最適化(GSPO)手法を適用した。
以上の結果から,ルーブリックに基づく報酬モデルが,複雑な長軸AIシステムに対して,解釈可能な,テスト時適応アライメントへの有望な経路を提供することが示された。
論文 参考訳(メタデータ) (2025-12-05T22:39:54Z) - Visual Document Understanding and Question Answering: A Multi-Agent Collaboration Framework with Test-Time Scaling [83.78874399606379]
テスト時間スケーリングを備えたマルチエージェント協調フレームワークであるMACTを提案する。
4つの異なる小規模エージェントから構成され、明確に定義された役割と効果的なコラボレーションがある。
一般および数学的タスクの能力を犠牲にすることなく、より小さなパラメータスケールで優れた性能を示す。
論文 参考訳(メタデータ) (2025-08-05T12:52:09Z) - SeqPE: Transformer with Sequential Position Encoding [76.22159277300891]
SeqPEは、各$n$次元位置指数をシンボルシーケンスとして表現し、軽量なシーケンシャル位置エンコーダを用いて埋め込みを学習する。
言語モデリング、長文質問応答、および2次元画像分類による実験により、SeqPEはパープレキシティ、正確なマッチング(EM)、精度の強いベースラインを超えるだけでなく、手作業によるアーキテクチャ再設計を必要とせず、多次元入力へのシームレスな一般化を可能にする。
論文 参考訳(メタデータ) (2025-06-16T09:16:40Z) - CompBench: Benchmarking Complex Instruction-guided Image Editing [63.347846732450364]
CompBenchは複雑な命令誘導画像編集のための大規模なベンチマークである。
本稿では,タスクパイプラインを調整したMLLM-ヒューマン協調フレームワークを提案する。
編集意図を4つの重要な次元に分割する命令分離戦略を提案する。
論文 参考訳(メタデータ) (2025-05-18T02:30:52Z) - REALM-Bench: A Benchmark for Evaluating Multi-Agent Systems on Real-world, Dynamic Planning and Scheduling Tasks [2.1331883629523634]
このスイートは、基本的なものから非常に複雑なものへと進化する14の計画とスケジューリングの問題を含んでいる。
それぞれの問題は、並列計画スレッドの数、依存性間の複雑さ、予期せぬディスラプションの頻度の3つの次元に沿ってスケールすることができる。
このベンチマークは一般公開を目標とし、現実のアプリケーションのためのより適応性があり、堅牢でスケーラブルなAI計画システムの開発を進めることを目指している。
論文 参考訳(メタデータ) (2025-02-26T05:24:22Z) - Systematic Generalization and Emergent Structures in Transformers
Trained on Structured Tasks [6.525090891505941]
我々は、因果変換器が、コピー、ソート、階層的な構成を含む一連のアルゴリズムタスクを実行する方法を示す。
両層変換器は多層問題に対する一般化可能な解法を学習し,系統的タスク分解の兆候を現示する。
これらの結果は、トランスフォーマーモデルが複雑な決定を再利用可能なマルチレベルポリシーに分解する方法について、重要な洞察を与えてくれる。
論文 参考訳(メタデータ) (2022-10-02T00:46:36Z) - CausalWorld: A Robotic Manipulation Benchmark for Causal Structure and
Transfer Learning [138.40338621974954]
CausalWorldは、ロボット操作環境における因果構造と伝達学習のベンチマークである。
タスクは、ブロックのセットから3D形状を構築することで構成される。
論文 参考訳(メタデータ) (2020-10-08T23:01:13Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。