論文の概要: STAGE: Diagnosing Semantic Transfer at Grounded Execution in Embodied Agents
- arxiv url: http://arxiv.org/abs/2609.13458v1
- Date: Fri, 11 Sep 2026 19:24:06 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-16 07:15:05.32919
- Title: STAGE: Diagnosing Semantic Transfer at Grounded Execution in Embodied Agents
- Title(参考訳): 経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮的経皮
- Abstract要約: 言語接頭辞は、命令の参照者を特定すること以上のものを必要とする。
この欠落したリンクを意味-作用ギャップとして研究し、命令のセマンティクスは回復可能であるが、ネイティブな連続的なアクションで弱い表現をする。
本稿では、回復したセマンティクスをALLOW、DEFER、ターゲット一貫性、検証された選択決定に変換する軽量な実行時インタフェースであるVISAを紹介する。
- 参考スコア(独自算出の注目度): 5.276981655456251
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Embodied language grounding requires more than identifying the referent of an instruction: recovered semantics must also control the action an agent exposes. We study this missing link as a semantic-action gap, where instruction semantics are recoverable but weakly expressed in native continuous actions. We introduce SAT-Bench, a fixed-observation counterfactual benchmark that holds the visual scene and agent state fixed while changing only instruction semantics. On LIBERO target-name and pixel-grounded relation swaps, target recovery reaches 100.0% and 95.8%, whereas OpenVLA action sensitivity remains only 6.8% and 7.7%. The gap persists across 1,000 additional compositional and temporal/procedural counterfactuals, with overall action sensitivity of 6.1%. Hidden-state, threshold-free, cross-policy, and rollout diagnostics further support this semantic-action transfer failure. We introduce VISA, a lightweight execution-time interface that converts recovered semantics into ALLOW, DEFER, target-consistency, and verified-selection decisions. VISA reduces invalid-instruction blind execution from 92.7% to 2.8% while preserving 94.0% of normal commands, and verified selection further improves target-consistent action exposure without updating the underlying policy. Overall, embodied language evaluation should measure semantic-action transfer, not semantic parsing alone.
- Abstract(参考訳): 復活したセマンティクスは、エージェントが公開するアクションを制御する必要がある。
この欠落したリンクを意味-作用ギャップとして研究し、命令のセマンティクスは回復可能であるが、ネイティブな連続的なアクションで弱い表現をする。
SAT-Benchは、視覚的なシーンとエージェントの状態を保持し、命令のセマンティクスだけを変更しながら固定する、固定観測カウンターファクトのベンチマークである。
LIBEROのターゲット名とピクセル接地関係のスワップでは、ターゲットリカバリは100.0%と95.8%に達するが、OpenVLAのアクション感度は6.8%と7.7%にとどまる。
このギャップは、1000の合成および時間的/手続き的カウンターファクトアルにまたがって持続し、全体の作用感度は6.1%である。
隠された状態、しきい値なし、クロスポリシー、ロールアウト診断は、このセマンティックアクション転送障害をさらにサポートする。
本稿では、回復したセマンティクスをALLOW、DEFER、ターゲット一貫性、検証された選択決定に変換する軽量な実行時インタフェースであるVISAを紹介する。
VISAは、通常のコマンドの94.0%を保存しながら、不正な命令による盲検の実行を92.7%から2.8%に減らし、検証された選択は、基礎となるポリシーを更新することなく、さらにターゲット一貫性のある行動露光を改善する。
全体として、具体的言語評価は意味論的解析単独ではなく、意味論的行動伝達を測定するべきである。
関連論文リスト
- RefGuard: Identity-Aware Language-Guided Robot Manipulation via Joint Target-Anchor-Frame Grounding [11.774477485982958]
RefGuardは、3変数すべてに対して共同で後続を維持することでコミットメントを遅らせるフレームワークである。
実際のUF850アームでは、RefGuardは曖昧性ストレストライアルではIDスイッチを記録せず、その90.0%で正しく実行される。
3200エピソードの手続きスイートでは、ターゲットの前にアンカーとフレームにコミットするアブレーションにおいて、解決可能な命令の正しい実行を56.6%から80.5%に引き上げている。
論文 参考訳(メタデータ) (2026-09-05T18:39:50Z) - Ontology-Grounded World Models for Failure Diagnosis and Closed-Loop Repair in Physical AI Systems [0.815557531820863]
Onto-EV-WMは、EV-WMの上に重ねられた診断および検証-ゲート補正インタフェースである。
Onto-EV-WMは8,526のタスクで成功し、スイートレベルの成功率はLIBERO-10で65.98%、LIBERO-Goalで91.39%、LIBERO-ObjectとLIBERO-Spatialで91.38%であった。
論文 参考訳(メタデータ) (2026-08-14T03:13:57Z) - ScrambleToolBench: Agents Search Exhaustively Even When Their Own Map Points to the Next Step [74.83535434786145]
ScrambleToolBenchは,行動推論の分離を目的とした対話型端末ベンチマークである。
このベンチマークでは、エージェントがテストとエラーのインタラクションを通じて、隠されたツールの振る舞いを明らかにする必要がある。
現状の言語モデルに対する我々の評価は、初期発見が成功しても頑健な適応にはならないことを示している。
論文 参考訳(メタデータ) (2026-08-03T15:07:46Z) - Beyond Refusal: A Same-Lineage Study of Aligned and Abliterated LLMs for Vulnerability Analysis [31.25049774595995]
本研究は, 拒絶行動が相変わらず (相変わらず) 維持されているか, あるいは同系統モデルで再分類されたかを検討した。
我々は、脆弱性検出、CWE属性、脆弱なラインローカライゼーション、ルート原因ローカライゼーション、実行可能パッチバリデーションについて、アラインド状態とアライテッド状態の評価を行った。
論文 参考訳(メタデータ) (2026-07-07T05:04:48Z) - ACCORD: Action-Conditioned Contextual Grounding for Language Agents [69.73525608707764]
ACCORD(Action-Conditioned Contextual Grounding)は、適応的なグラウンドのためのエージェントフレームワークである。
現状のエージェントは、しばしばそうすることができないことを示す。それらは、観察された特定の情報よりもむしろ仮定から行動し、収集した可能性のある情報を見落とし、既に返された証拠を組み込むことに失敗する。
論文 参考訳(メタデータ) (2026-06-15T09:05:55Z) - Selective Agentic Recovery for UAV Autonomy with a Persistent Mission Runtime [1.189955933770711]
物理的UAVでは、リモート推論は選択的に呼び出されるときに最も有用である。
本稿では,ミッションループと安全クリティカルな実行をローカルに保持する回復フレームワークであるPersistent Mission(PMR)を提案する。
PMRは、遠隔エージェント推論が短期ミッションの進捗を改善する可能性があることを見積もる、コンパクトな入場ゲートである学習された認知的行動価値(Learned-CVI)を導入している。
論文 参考訳(メタデータ) (2026-06-12T07:57:47Z) - ASPI: Seeking Ambiguity Clarification Amplifies Prompt Injection Vulnerability in LLM Agents [2.585367539248893]
我々は,標準実行から明確化検索状態への遷移が,インジェクション攻撃に対するエージェントの感受性を高めるかどうかを検討する。
728のタスクアタックシナリオのベンチマークであるASPIを導入し、明確なエージェント状態として明確化を分離する。
明確化の探究は一貫して、脆弱性を大幅に増幅する。
論文 参考訳(メタデータ) (2026-05-17T08:30:45Z) - Are Benchmark Tests Strong Enough? Mutation-Guided Diagnosis and Augmentation of Regression Suites [49.16055123488827]
十分に強力なテストスイートは、報告された成功率を膨らませながら、妥当だが意味的に正しくないパッチを認めることができる。
STINGは、意味的に変化するプログラムの変種を診断ストレス要因として利用する、ターゲットテスト拡張のためのフレームワークである。
STINGは211インスタンスにまたがる1014の検証テストを生成し、パッチリージョンラインとブランチカバレッジを10.8%、9.5%向上させた。
論文 参考訳(メタデータ) (2026-04-02T01:13:40Z) - When Actions Go Off-Task: Detecting and Correcting Misaligned Actions in Computer-Use Agents [50.5814495434565]
この研究は、コンピュータ利用エージェント(CUA)における不整合検出を定義し、研究する最初の試みである。
実世界のCUAデプロイメントにおける3つの一般的なカテゴリを特定し、人間の注釈付きアクションレベルのアライメントラベルを用いたリアルな軌跡のベンチマークであるMisActBenchを構築した。
本稿では,実行前に不整合を検知し,構造化されたフィードバックによって繰り返し修正する,実用的で普遍的なガードレールであるDeActionを提案する。
論文 参考訳(メタデータ) (2026-02-09T18:41:15Z) - CORE: Context-Robust Remasking for Diffusion Language Models [51.59514489363897]
我々は、推論時リビジョンのためのトレーニング不要フレームワークであるContext-Robust Remasking (CORE)を提案する。
静的トークンの確率を信頼するのではなく、COREは、ターゲットとなるマスク付きコンテキストの摂動に対する感受性を示すことによって、コンテキスト不安定なトークンを識別する。
LLaDA-8B-Baseでは、COREは推論とコードベンチマークの間で一貫した改善を行い、計算に適合したベースラインを上回り、MBPPを最大9.2%改善した。
論文 参考訳(メタデータ) (2026-02-04T00:12:30Z) - VulAgent: Hypothesis-Validation based Multi-Agent Vulnerability Detection [55.957275374847484]
VulAgentは仮説検証に基づくマルチエージェント脆弱性検出フレームワークである。
セマンティクスに敏感なマルチビュー検出パイプラインを実装しており、それぞれが特定の分析の観点から一致している。
平均して、VulAgentは全体的な精度を6.6%改善し、脆弱性のある固定されたコードペアの正確な識別率を最大450%向上させ、偽陽性率を約36%削減する。
論文 参考訳(メタデータ) (2025-09-15T02:25:38Z) - Defending against Indirect Prompt Injection by Instruction Detection [109.30156975159561]
InstructDetectorは、LLMの動作状態を利用して潜在的なIPI攻撃を特定する、新しい検出ベースのアプローチである。
InstructDetectorは、ドメイン内設定で99.60%、ドメイン外設定で96.90%の検出精度を達成し、攻撃成功率をBIPIAベンチマークで0.03%に下げる。
論文 参考訳(メタデータ) (2025-05-08T13:04:45Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。