論文の概要: Do Not Restart: Residual Completion for Stateful Agent Handoffs
- arxiv url: http://arxiv.org/abs/2609.13800v2
- Date: Wed, 16 Sep 2026 15:56:31 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-20 08:55:53.39697
- Title: Do Not Restart: Residual Completion for Stateful Agent Handoffs
- Title(参考訳): Do Not Restart: ステートフルエージェントハンドオフの残酷な完了
- Abstract要約: Commitment-Frontier Residual Completion (CFRC)は、目標前プロモーサル、全プロモーサル前オーソリティ、ライブエビデンス前オーソリティを強制する。
CFRCは推論コストのわずか22.0%-34.6%で強力なフルタスクエージェントに匹敵するマクロ精度を達成している。
- 参考スコア(独自算出の注目度): 25.03690301477989
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Routing and cascades reduce tool-agent cost by transferring control across models, but stateful handoffs must preserve accepted choices, realized effects, and unfinished obligations. We formulate this as commitment-constrained residual completion and introduce Commitment-Frontier Residual Completion (CFRC). CFRC enforces target-before-proposal, whole-proposal-before-authority, and live-evidence-before-success: it freezes a residual contract from accepted progress, closes the successor continuation into an evidence-linked graph, and admits execution only when the remainder is covered, with live receipts discharging obligations. We establish contract-relative partial correctness, which extends to the original residual request under complete contract construction. Across five environments and two same-provider model pairs, CFRC achieves comparable macro accuracy to strong full-task agents at only 22.0%-34.6% of their inference cost, with additional cross-provider results demonstrating broader transfer.
- Abstract(参考訳): ルーティングとカスケードは、モデル間で制御を移すことでツールエージェントコストを削減しますが、ステートフルなハンドオフは、受け入れられた選択、実現された効果、未完成の義務を保持しなければなりません。
我々は、これをコミットメント制約付き残余完備として定式化し、コミット-Frontier Residual Completion (CFRC)を導入する。
CFRCは、目標-前-前-前-前-前-前-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後--関係グラフに凍結し、実行は、後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後-後--後-
契約関係の部分的正当性を確立し, 完全契約構築時の元の残余要求に拡張する。
5つの環境と2つの同じプロジェクタモデルペアでCFRCは、推論コストのわずか22.0%-34.6%で強力なフルタスクエージェントに匹敵するマクロ精度を達成する。
関連論文リスト
- A Formal Analysis of Agent Payment Protocols [21.91506763477032]
自動商取引における重要なトランザクション層としてエージェント支払いプロトコルが登場している。
我々はタマリンでx402,MPP,ACP,AP2の4つの代表エージェント支払いプロトコルを定式化した。
ソースバックの検証質問と反例トレースを使用して、欠落したバインディング、状態制約、およびステージ横断の対応を公開します。
論文 参考訳(メタデータ) (2026-08-30T14:04:15Z) - From Sequence to Structure: Relational Uncertainty Propagation for LLM Agents [75.69180947909148]
大規模言語モデル(LLM)エージェントのためのトラジェクトリレベルのUQフレームワークを提案する。
RuPAは、推論状態、ツールインタラクション、環境フィードバックが時間的およびセマンティックな依存関係エッジで接続されたノードである、指向的なトラジェクトリグラフとして実行履歴を表現している。
我々は,複数のモデルファミリにまたがる6つのオープンソースLCMを用いて,代用エージェントベンチマーク($2, Terminal-Bench-2, GAIA)でRUPAを評価した。
論文 参考訳(メタデータ) (2026-08-17T01:40:14Z) - Terminal Symmetry as a Decision Resource: Statewise Refinement for Anytime Verified Construction [4.28787537081191]
多くのシーケンシャルな構成タスクは、実行が指示され、履歴に依存している間、完了時に正確な対称性を示す。
本研究は, 指向性, 等価な結果にまたがる構造を有する終端対応輸送を提供する終端対称性の意思決定資源ビューを開発し, 遷移後の現在の決定関連性を解明する。
論文 参考訳(メタデータ) (2026-08-11T18:08:01Z) - CaIRec: Calibrated Modality Imputation for Incomplete Multimodal Recommendation [49.24608818070328]
現実世界のレコメンデータシステムは、画像、テキスト、その他のコンテンツ機能が欠けている、不完全なモダリティの観察に直面していることが多い。
既存のモダリティ計算手法は、利用可能なアイテムコンテンツから不足表現を推定するが、2つの課題が残る。
まず、回収された表現自体を最適化し、同じ項目の他のモダリティとの関係を明示的に考慮しない。
第二に、構造的に一貫性のある復元された情報でさえ、パーソナライズされたランク付けには効果がないかもしれない。
これらの課題に対処するために,不完全なマルチモーダルレコメンデーション(CaIRec)の校正インプットを提案する。
論文 参考訳(メタデータ) (2026-07-29T10:10:20Z) - The SIGReg Objective as Variational Free Energy: A Theoretical Active-Inference Account of JEPA World Models [47.471225029744424]
JEPA(Joint-Embedding Predictive Architectures)は、潜在世界モデルの主要な設計である。
本稿では,JEPAのトレーニング目標である予測損失と重み付き埋め込み正規化の選択肢が,有効能動推論(AIF)変動自由エネルギーであるか否かを判定する。
論文 参考訳(メタデータ) (2026-07-15T08:59:36Z) - Mnemosyne: Agentic Transaction Processing for Validating and Repairing AI-generated Workflows [0.764671395172401]
エージェントトランザクション処理は、宣言された実行可能な制約セットCの下で決定論的入力をパスするまで、生成されたアクションを信頼できない提案として扱う。
MnemosyneのATPは、追加のみのトランジションログ、有効状態のプロジェクション、依存性の安全な補償、アクティブなコミットレコードを備えたランタイムである。
再現可能なアーティファクトは、9つのファルシフィケーションテストを対象とする違反を拒絶し、有効な作業は6%以下のオーバーヘッドで認め、局所的な修復は、グローバルな再計算よりも桁違いに少ない操作を編集する。
論文 参考訳(メタデータ) (2026-06-30T23:33:16Z) - Preregistered Belief Revision Contracts [2.28438857884398]
PBRC(Preregistered Belief Revision Contracts)は,オープン通信と許容可能な変更を分離するプロトコルレベルのメカニズムである。
PBRC契約は、ファーストオーダーのエビデンストリガー、許容可能なリビジョンオペレータ、優先ルール、フォールバックポリシーを公に修正する。
本報告では,信頼軌道と正準化された監査トレースを保存したPBRC正規形式を,監査可能なトリガープロトコルで認めていることを示す。
論文 参考訳(メタデータ) (2026-04-16T22:22:54Z) - ASAS-BridgeAMM: Trust-Minimized Cross-Chain Bridge AMM with Failure Containment [5.151910664667141]
クロスチェーンブリッジは、分散ファイナンス(DeFi)におけるシステムリスクの単一の最大のベクトルである
本稿では,Contained Degradationを導入した橋梁結合型自動市場メーカASAS-BridgeAMMについて紹介する。
論文 参考訳(メタデータ) (2026-01-18T14:40:26Z) - ConMax: Confidence-Maximizing Compression for Efficient Chain-of-Thought Reasoning [46.481679150652205]
大規模推論モデルは、精度を向上することなく計算コストを増大させる冗長な推論経路を生成する。
本稿では,推論トレースを自動的に圧縮する新しい強化学習フレームワークであるConMaxを紹介する。
5つの推論データセットに対する実験は、ConMaxが優れた効率とパフォーマンスのトレードオフを達成することを示した。
論文 参考訳(メタデータ) (2026-01-08T14:22:58Z) - ConCISE: Confidence-guided Compression in Step-by-step Efficient Reasoning [64.93140713419561]
大型推論モデル (LRM) は、Chain-of-Thought (CoT) による複雑な推論タスクで強く機能するが、しばしば冗長な出力に悩まされる。
既存の微調整ベースの圧縮手法は、ポストホックプルーニングを動作させるか、コヒーレンスを推論する破壊を危険にさらすか、サンプリングベースの選択に依存するかのいずれかである。
ConCISEは、簡潔な推論連鎖を生成するために設計されたフレームワークであり、信頼注入を統合して推論の信頼性を高める。
論文 参考訳(メタデータ) (2025-05-08T01:40:40Z) - SaFormer: A Conditional Sequence Modeling Approach to Offline Safe
Reinforcement Learning [64.33956692265419]
オフラインセーフなRLは、現実世界のアプリケーションにエージェントをデプロイする上で、非常に実用的な関連性を持っています。
そこで我々は,SaFormerと呼ばれる新しいオフラインセーフなRLアプローチを提案する。
論文 参考訳(メタデータ) (2023-01-28T13:57:01Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。