論文の概要: AquaMend: Minimal Re-probing and Conditional Rollback for Latent-Belief Failures in Embodied Agents
- arxiv url: http://arxiv.org/abs/2609.28973v3
- Date: Tue, 29 Sep 2026 12:05:11 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-30 21:28:46.533376
- Title: AquaMend: Minimal Re-probing and Conditional Rollback for Latent-Belief Failures in Embodied Agents
- Title(参考訳): AquaMend: 人工呼吸器の潜伏障害に対する最小補修と条件付きロールバック
- Abstract要約: AquaMendは、re-probing, rollback, Support continuation on a probe-belief-action graphの比較を行う。
ジョイント後部は条件検出パワースクリーニングによるワンステップポリシーを導出する。
- 参考スコア(独自算出の注目度): 23.337499695293744
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Physical changes or sensing errors can invalidate embodied agents' task-relevant beliefs. AquaMend compares re-probing, rollback, and supported continuation on a probe-belief-action graph under an expected-loss objective covering sensing, physical recovery, and uncorrected failures. A joint posterior guides a one-step policy with conditional detection-power screening. The per-belief three-way optimum requires independence, separability, and fully resolving probes; the general policy has no global optimality guarantee. Across 32 paired scenarios in a self-constructed simulation benchmark, AquaMend recovers in 28/32 cases and reduces mean complete loss by 21.6% versus restart. Its paired loss difference from decision-theoretic troubleshooting (DTT) is not statistically significant after Holm correction. Against the all-candidate ablation, online decision time decreases by 12.3% overall but increases by 3.4% in the uncovered late stage.
- Abstract(参考訳): 物理的変化や検知エラーは、エンボディされたエージェントのタスク関連信念を無効にすることができる。
AquaMendは、センサー、物理的リカバリ、および修正されていない障害をカバーした、期待される余分な目的の下で、プローブ-信頼性-アクショングラフ上での再探索、ロールバック、サポートされた継続を比較する。
ジョイント後部は条件検出パワースクリーニングによるワンステップポリシーを導出する。
一人当たりの3方向最適化には、独立性、分離性、完全解決の探究が必要である。
自己構築型シミュレーションベンチマークの32のシナリオで、AquaMendは28/32のケースで回復し、平均的な完全な損失を21.6%削減する。
決定理論的トラブルシューティング(DTT)による損失差はホルム補正後の統計的に有意ではない。
オール候補のアブレーションに対して、オンライン決定時間は全体の12.3%減少するが、未公表の後半段階では3.4%増加している。
関連論文リスト
- Cross-Fitted Residual Utility for Primary-Preserving Cognitive Decision Correction in Automatic Modulation Classification [1.547549252134621]
本稿では,クロスフィット型残効ユーティリティとプライマリ保存型認知決定ポリシーを用いて,推論後の問題について検討する。
構造化されたkan-Fourier分類器はデフォルトの確率を提供し、ニューラルおよび非ニューラル候補は観測可能な証拠を提供する。
RMLA、RMLB、HISARでは、完全なシステムは全体の精度を63.632%から66.332%、65.161%から66.168%、77.769%から79.867%に改善している。
論文 参考訳(メタデータ) (2026-08-03T11:07:37Z) - DarwinX: Evolving Agent Harnesses Through Natural Selection [48.64258219266629]
ダーウィンXは自己進化を、モデルが凍結されたハーネスの集団の選択として扱う。
一般的なエージェント能力はベンチマーク固有のパッチではなく、タスク、検証、ベースモデルの変更を生き残る。
論文 参考訳(メタデータ) (2026-07-31T05:34:02Z) - Should Missing Modalities Always Be Necessary to Repair for Multi-modal Sentiment Analysis? [44.69722591655738]
既存のモダリティの欠如に基づくマルチモーダル感情分析手法は通常、修復第一パラダイムに従う。
textbfSfficiency-textbfInformed textbfEvidential textbfValtextbfvE (textbfSIEVE) を提案する。
論文 参考訳(メタデータ) (2026-07-19T14:07:43Z) - Interventional Causal Circuits for Safe Robot Action Testing and Failure Recovery [4.492262382019958]
運動パラメータの形式的テストは計算に費用がかかり、コストはアクション空間の次元に悪影響を及ぼす。
本稿では,JPT(Joint Probability Tree)とMarginal-Deterministic Variable Tree(Marginal-Deterministic Variable Tree)から派生した因果回路を結合した閉ループフレームワークを提案する。
このフレームワークは、ロボットが動作を開始する前に全ての介入クエリのトラクタビリティを検証し、サポート外候補を自動的に検出し、修正から除外する。
論文 参考訳(メタデータ) (2026-07-16T10:41:20Z) - When Does Learning to Stop Help? A Cost-Aware Study of Early Exits in Reasoning Models [4.8190992438931035]
LearnStopは、プレフィックスオブザーバブルな機能の上に隠された状態のないロジスティックストッパーである。
学習は、答えが振動し、正しさの証拠が広がる場所を給与する。
コスト計算は、KVキャッシュでトークンを32%節約するのと同じ方針で、ブラックボックスの繰り返しプリフィルで121%余分なコストがかかる。
論文 参考訳(メタデータ) (2026-06-29T19:33:42Z) - Beyond Mode Collapse: Distribution Matching for Diverse Reasoning [69.88237286885065]
GRPOのようなオンライン強化学習手法はモード崩壊に悩まされる。
このことは、逆KL最小化のモード探索行動に由来することを示す。
KL最小化の原理的近似によりモード崩壊を防止するDMPOを提案する。
論文 参考訳(メタデータ) (2026-05-19T07:13:00Z) - BadCLIP++: Stealthy and Persistent Backdoors in Multimodal Contrastive Learning [73.46118996284888]
マルチモーダル・コントラスト学習モデルに対するバックドア攻撃の研究は、ステルスネスと永続性という2つの大きな課題に直面している。
両課題に対処する統合フレームワークであるBadCLIP++を提案する。
ステルスネスのために,タスク関連領域付近に知覚不可能なパターンを埋め込むセマンティックフュージョンQRマイクロトリガーを導入する。
持続性については、半径縮小とセントロイドアライメントによるトリガ埋め込みを安定化する。
論文 参考訳(メタデータ) (2026-02-19T08:31:16Z) - Calibrated Decomposition of Aleatoric and Epistemic Uncertainty in Deep Features for Inference-Time Adaptation [3.018583625592182]
ほとんどの推定器は、全ての不確実性モードを単一の信頼スコアに分解し、いつより多くの計算を割り当てるか、あるいは推論を調整するべきかについての信頼性の高い推論を防ぐ。
非確実性誘導推論時間選択(Uncertainty-Guided Inference-Time Selection)は,データ駆動型(データ駆動型)とモデル駆動型不確実性を,深い特徴空間で直接的に解消する軽量な推論時間フレームワークである。
論文 参考訳(メタデータ) (2025-11-15T23:47:30Z) - Fact or Facsimile? Evaluating the Factual Robustness of Modern Retrievers [34.31192184496381]
デンスレトリバーとリランカーは、検索強化世代(RAG)パイプラインの中心である。
我々は,これらのコンポーネントがベースとする大規模言語モデル(LLM)をどの程度の事実的能力で継承するか,あるいは失うかを評価する。
全ての埋め込みモデルにおいて、クエリと正しい完了の間のコサイン類似度スコアは、間違ったものよりも著しく高い。
論文 参考訳(メタデータ) (2025-08-28T04:13:51Z) - Near-Optimal Non-Parametric Sequential Tests and Confidence Sequences
with Possibly Dependent Observations [44.71254888821376]
我々は、一般的な非データ生成プロセスの下で、最初のタイプIエラーと予測リジェクション時間保証を提供する。
本研究では, 平均処理効果など, 方程式を推定することによって定義されるパラメータの推測に, 結果を適用する方法を示す。
論文 参考訳(メタデータ) (2022-12-29T18:37:08Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。