論文の概要: Making two action heads agree: coordination mechanisms and a runtime collapse certificate for flow-matching policies
- arxiv url: http://arxiv.org/abs/2608.15748v1
- Date: Sun, 16 Aug 2026 13:57:36 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-18 19:59:03.412137
- Title: Making two action heads agree: coordination mechanisms and a runtime collapse certificate for flow-matching policies
- Title(参考訳): 2つのアクションヘッドを一致させる:フローマッチングポリシーのための調整機構と実行時崩壊証明書
- Authors: Jinhui Sun, Wei Zhou, Bowen Yang, Xinliang Xiao, Li Yang,
- Abstract要約: フローマッチングポリシは、予測された各動きをジョイントとエンドエフェクタ空間にデコードする。
マルチモーダルタスクでは、独立してサンプリングされた枝は異なる有効なモードを選択することができ、誤警報を引き起こす。
2つの枝の調整方法とコストについて検討する。
- 参考スコア(独自算出の注目度): 13.05465000489116
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: A dual-representation flow-matching policy decodes each predicted motion into joint and end-effector spaces, and the residual between the two kinematically equivalent decodings provides a physically interpretable runtime signal. On multimodal tasks, however, independently sampled branches may choose different valid modes, causing false alarms. We study how to coordinate the two branches and at what cost. Across two robot environments and a non-robotic testbed, the tested mechanisms fall into four classes. An auxiliary latent shared by both branches but absent from the flow-matching construction is erased at the population optimum, a provable dead end confirmed within a prespecified 2% equivalence band. Sharing source noise can coordinate or anti-coordinate: its effect changes sign with the representation map and tracks the alignment of decoder mode basins. Consistency regularization gives intermediate coordination but reduces the valid-pair rate, while training-supported discrete partitions achieve near-ceiling coordination robustly. We further derive a chance-corrected coordination bound based only on each branch's Gini-Simpson diversity, yielding an attainable region and a label-free certificate that separates coordination from collapse when zero mismatch is ambiguous. On LIBERO-Plus, benign multimodality adds 1.57 percentage points of false alarms to the residual, which remains the strongest evaluated failure signal; the preregistered token intervention does not meet its false-alarm criterion or produce a seed-robust detection change. Code, models, and per-run configurations are available at https://github.com/kimo423/dual-head-coordination.
- Abstract(参考訳): 二重表現フローマッチングポリシは、予測された各動きを結合および端エフェクタ空間にデコードし、2つのキネマティックに等価なデコードの間の残余は、物理的に解釈可能な実行信号を提供する。
しかし、マルチモーダルタスクでは、独立してサンプリングされた枝は異なる有効モードを選択し、誤報を引き起こす可能性がある。
2つの枝の調整方法とコストについて検討する。
2つのロボット環境と非ロボティックなテストベッドにまたがって、テストされたメカニズムは4つのクラスに分類される。
両枝で共有されるが、流動整合構造を欠いた補助潜水剤は、予め特定された2%等価帯域内で確認された証明可能な致死端である個体群最適時に消去される。
ソースノイズの共有はコーディネートまたは反コーディネートが可能で、その効果は表現マップと符号を変え、デコーダモードのバウンダのアライメントを追跡する。
整合正則化は中間調整を与えるが、有効ペア率を低下させる一方、トレーニング支援された離散分割は、ほぼ焼成調整を堅牢に達成する。
さらに、各分岐のジーニ・シンプソンの多様性にのみ基づいて、到達可能な領域と、ゼロミスマッチがあいまいな場合にコーディネーションを崩壊から分離するラベルフリー証明書を導出する。
LIBERO-Plusでは、良性多モード性は残留物に1.57ポイントの誤報を付加するが、これは依然として最も評価の高い故障信号である。
コード、モデル、実行時の設定はhttps://github.com/kimo423/dual-head-coordination.comで確認できる。
関連論文リスト
- Local verification cannot detect non-transportability: a cohomological theory of context preservation in agentic reasoning [0.0]
エージェントAIシステムは、生物学的、臨床的、財務的な文脈で定期的に結論を伝達する。
局所的検証の新たなセーフガードは構造的に不完全であることを示す。
不均一な精度で歪みを定量化し、正確性を復元する精密な白紙形状を提供する。
論文 参考訳(メタデータ) (2026-08-04T21:09:50Z) - TwistedMerge: Certified Higher-Order Diagnostics and Abstention for Model Merging [0.48086260459837454]
我々は、チェックポイントが局所対象、アライメントマップが遷移、サイクル積が残留する有限降下問題としてマージを定式化する。
提案手法は, 定数エッジのNo-go結果, フリーズ・コンプレックスの3方向およびプレファミリーの誤差制御定理, 比較・複雑感度の精査試験である。
訓練された低ランク適応型監査では, 平均化係数は選択したGLr代表に依存するが, 大域的因子同期と高密度デルタSVDは安定である。
論文 参考訳(メタデータ) (2026-07-23T03:24:50Z) - BTI-Net: Bidirectional Decoder-Level Task Interaction via Uncertainty-Aware Gating for Multi-Task Medical Image Analysis [2.8218290601001854]
BTI-Netは、タスクインタラクションモジュールを介して2つの並列経路を介して、デコーダレベルで双方向通信を確立する。
不確実性プロキシアテンションは、クロスタスクアライメント、シーンの複雑さ、予測信頼性をキャプチャする3つの信号を使用して、インスタンス毎とレベル毎のTIM出力をゲートする。
超音波、皮膚内視鏡、脳MRIの3つの医療ベンチマークの実験では、セグメンテーションIoUが一貫した改善を示し、エンコーダ共有とデコーダ相互作用ベースラインの両方に対して分類精度が向上した。
論文 参考訳(メタデータ) (2026-06-27T22:37:26Z) - What Accuracy and Gradient Cosine Miss: Evaluating Feedback Alignment via Scale Stability, Reference Validity, and Depth Utility [48.10132234701036]
本稿では,3つのチェック(スケール安定性,参照妥当性,深度ユーティリティ)に基づく診断評価プロトコルを提案する。
複数のアーキテクチャや手法にまたがって、我々のプロトコルは広い校正マージンを持つ全ての障害を識別する。
論文 参考訳(メタデータ) (2026-06-19T06:04:17Z) - Strategic Non-Shareability of Quantum Correlations [0.0]
有限個のアルファベットに対して、ゲーム最適化された反共役能力はシャドーへの全変分距離と等しいことを証明した。
我々は、量子媒介戦略ネットワークにおいて、絡み合いモノガミーを測定可能な共有性障害として再考する。
論文 参考訳(メタデータ) (2026-05-25T07:19:53Z) - Unsupervised Conformal Inference: Bootstrapping and Alignment to Control LLM Uncertainty [49.19257648205146]
生成のための教師なし共形推論フレームワークを提案する。
我々のゲートは、分断されたUPPよりも厳密で安定した閾値を提供する。
その結果は、ラベルのない、API互換の、テスト時間フィルタリングのゲートになる。
論文 参考訳(メタデータ) (2025-09-26T23:40:47Z) - Unpaired Adversarial Learning for Single Image Deraining with Rain-Space
Contrastive Constraints [61.40893559933964]
我々は,CDR-GAN という名称の GAN フレームワークにおいて,比較学習手法により,経験者の相互特性を探索する有効な非経験的 SID 手法を開発した。
提案手法は, 合成および実世界の両方のデータセットにおいて, 既存の非対効果のデラミニング手法に対して良好に動作し, 完全教師付きモデルや半教師付きモデルよりも優れている。
論文 参考訳(メタデータ) (2021-09-07T10:00:45Z) - Cross-domain Speech Recognition with Unsupervised Character-level
Distribution Matching [60.8427677151492]
2つの領域における各文字間の微粒化適応を行うための文字レベルの分布マッチング手法であるCMatchを提案する。
Libri-Adaptデータセットを用いた実験の結果,提案手法はクロスデバイスとクロス環境の両方で14.39%,16.50%の単語誤り率(WER)を低減できることがわかった。
論文 参考訳(メタデータ) (2021-04-15T14:36:54Z) - Consensus-Guided Correspondence Denoising [67.35345850146393]
本稿では,地域間コンセンサス学習フレームワークと対応関係を異色化し,対応関係をロバストに識別する。
ローカル地域からグローバル地域への動的グラフから推定されるコンセンサススコアに基づいて,信頼度の高い候補を初期マッチングから蒸留する新しい「プルーニング」ブロックを導入した。
本手法は、堅牢なラインフィッティング、ワイドベースライン画像マッチング、画像ローカリゼーションベンチマークを顕著なマージンで上回る。
論文 参考訳(メタデータ) (2021-01-03T09:10:00Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。