論文の概要: CausalCache: Conditional High-Fidelity Restoration for Long-Horizon GUI Agents
- arxiv url: http://arxiv.org/abs/2608.22577v1
- Date: Sun, 23 Aug 2026 20:04:21 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-25 13:29:43.794735
- Title: CausalCache: Conditional High-Fidelity Restoration for Long-Horizon GUI Agents
- Title(参考訳): CausalCache:Long-Horizon GUIエージェントの条件付き高忠実性復元
- Abstract要約: GUIエージェントは、テキストアクションレコードとして安価に完全なインタラクショントレースを保持することができるが、高忠実度ピクセルのポリシーにいくつかの過去のイベントしか公開していない。
各イベントは要約のみの形式で持続し、アーカイブされたスクリーンショットにリンクされる。
代わりにCaulCacheは、完全なトレースに対して同じ$B$のプロモーションを再配置する。
- 参考スコア(独自算出の注目度): 5.585886372044214
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Long-horizon GUI agents can retain a complete interaction trace cheaply as textual action records, but expose only a few past events to the policy in high-fidelity pixels. We formulate this as conditional fidelity restoration: each event persists in summary-only form and is linked to an archived screenshot, while an active visual-context budget $B$ limits how many events may be promoted to summary-plus-image form. Recent-$B$ spends every slot on the latest events. CausalCache instead reallocates the same $B$ promotions over the complete trace, evicting a recent image only when a distant event has higher conditional marginal utility. Its history-gated key/value (HGKV) adapter modifies only restored history-image tokens and is exactly bypassed with no history image. Matched-budget replacement groups and per-arm-anchored difference-in-differences supervision make uniform history amplification worth zero; a budget-aware selector then chooses which summarized events to restore. On desktop, the frozen policy shows no reliable preference for a task-relevant archived screenshot over the recent frame it would displace; HGKV learns exactly that selectivity inside a pre-specified drift envelope. On OSWorld-Verified, restoring history to high fidelity is worth about $13$ success points over summary-only memory, while same-budget allocations remain indistinguishable. Zero-shot on a cross-application mobile benchmark, CausalCache significantly improves overall success over the same-budget recent allocation ($+3.7$ points on the full roster), and the gain concentrates where it should: $+8.6$ points on the memory-critical split fixed by benchmark metadata at construction, no detectable effect on matched controls, and a significant split-by-method interaction.
- Abstract(参考訳): ロングホライゾンGUIエージェントは、テキストアクションレコードとして安価に完全なインタラクショントレースを保持することができるが、高忠実度ピクセルのポリシーにいくつかの過去のイベントしか公開していない。
それぞれのイベントは要約のみの形式で持続し、アーカイブされたスクリーンショットにリンクされているのに対して、アクティブなビジュアルコンテキスト予算である$B$は、要約+イメージ形式に昇格するイベントの数を制限する。
最近の$B$は、すべてのスロットを最新のイベントに費やしている。
CausalCacheは代わりに、完全なトレースに対して同じ$B$のプロモーションを再配置する。
ヒストリーゲートキー/値 (HGKV) アダプタは、復元されたヒストリーイメージトークンのみを修正し、ヒストリーイメージなしで正確にバイパスされる。
一致した予算置換グループとアーム単位の差分差分監督は、均一な歴史を増幅する価値をゼロとし、予算対応のセレクタは、どのイベントをリストアするかを選択する。
デスクトップでは、凍結されたポリシーは、タスク関連アーカイブスクリーンショットが取り外されるであろう最近のフレームに対して、信頼性の高い優先順位を示していない。
OSWorld-Verifiedでは、高忠実性への履歴の復元は、サマリのみのメモリよりも13ドル程度の成功ポイントの価値があるが、同じ予算の割り当ては相変わらず見分けがつかない。
クロスアプリケーションモバイルベンチマークのゼロショットでは、CausalCacheは、最近の同じ予算の割り当て(フルロースターで+3.7$ポイント)に対する全体的な成功を著しく改善し、ゲインは、必要となる場所に集中する: ベンチマークメタデータによって固定されたメモリクリティカルなスプリットに$+8.6$ポイント、一致したコントロールに検出可能な影響がなく、また、大きなスプリットバイメソッドのインタラクション。
関連論文リスト
- Uniform Herding: Exemplar Replay with Representation Refresh [0.0]
我々は、観測されたクラス間で現在のアクティブセットを割り当てるUniform Herdingを提案し、現在の表現で選択した例をリフレッシュするために境界付き候補プールを使用する。
10種類のクラス増分タスクを持つCIFAR-100では、Uniform Herdingが44.00pm0.51%$最終平均精度と17.22pm0.43%$ forgettingを取得し、iCaRLは42.33pm1.20%$と24.87pm1.11%$である。
論文 参考訳(メタデータ) (2026-08-13T10:25:38Z) - Keep the Future, Drop the Rollout: RIFT for World Action Models [46.70481761959841]
将来のキャッシュ値のマスキングや再割り当てによって実行が変化し、成功が減少することを示す。
本稿では,学習した予測トークンを用いて,完全な将来K/Vキャッシュを1つのバックボーンパスで構築するRIFTを提案する。
論文 参考訳(メタデータ) (2026-08-12T00:17:30Z) - Caching for the Future: Scrub Jay Episodic Memory Principles for Agent Memory Systems [5.321970297768025]
既存の記憶アーキテクチャは、全ての記憶を、時代遅れの事実と共に、保存されたコンテキストを均等に永続的で体系的に汚染したものとして扱う。
メモリ当たりの時間減衰は,外部LLMエージェントメモリストアにおいて,自動分類係数$_i$として操作可能であることを示す。
本稿では,時間的一般化テスト(TGT)と,保持間隔を保ったベンチマーク,一般化ギャップ(GenGap)メトリクスを紹介する。
論文 参考訳(メタデータ) (2026-08-05T12:12:44Z) - Maglev: Sliding Recurrent Memory [8.788753986099902]
我々のアーキテクチャは、スライディングウインドウの注意を一般化する固定サイズのメモリを備えたリカレントトランスフォーマーアーキテクチャである。
私たちは、$m_t$と$m'_t$を一致させるメモリ一貫性の損失でトレーニングします。
論文 参考訳(メタデータ) (2026-08-03T20:40:49Z) - Recall Before You Rank: Similarity-Guided Top-$K$ Reuse for Efficient Long-Context Attention [4.6833133124119275]
ReTopKは、歴史的検索決定を再利用することで、動的Top-$Kの注意を加速するトレーニングフリーの手法である。
128Kが$K=512$で、ReTopKはExact Top-K$よりも0.50%のパープレキシティアップしか得られず、注意計算は$3.07times$で加速する。
論文 参考訳(メタデータ) (2026-07-30T05:25:23Z) - Position Rebinding Cache Reuse: Replay-Free Visual Revisiting for Interleaved Multimodal Reasoning [51.563653495547335]
マルチモーダル推論は、マルチステップ生成中に視覚的証拠を再考することによって、視覚的接地を改善する。
再生不要な視覚的再考のためのキャッシュレベルフレームワークであるPlace Rebinding Cache Reuse (PRCR)を提案する。
PRCRはリプレイレベルまたはパフォーマンスの向上を実現し、平均精度を5%向上し、視覚的再考を最大数万倍削減する。
論文 参考訳(メタデータ) (2026-06-25T05:47:52Z) - FadeMem: Distance-Aware Memory Consolidation for Autoregressive Video Diffusion [59.207505503284715]
FadeMemは、歴史的なKVブロックを固定キャッシュ予算の下で時間階層に整理する。
新しい歴史はきめ細かいエントリとして挿入され、古い隣のエントリは徐々にマージされる。
実験では、既存の有界キャッシュ戦略よりも、被験者の一貫性、背景安定性、時間的コヒーレンスが改善された。
論文 参考訳(メタデータ) (2026-06-09T10:22:18Z) - Enhancing Software Engineering Through Closed-Loop Memory Optimization [50.418699819003486]
ソフトウェア工学 (SE) エージェントにおけるメモリ拡張のためのクローズドループフレームワークである ours を紹介する。
タスクに依存しない textbf ベンチマークとアノテーションのない textbf 最適化信号としての有用性を確立する。
その結果、SEエージェントは設定によって常に改善され、成功率で$uparrow5.25%、解決効率で$uparrow4.63%という絶対的なゲインが得られることが示された。
論文 参考訳(メタデータ) (2026-06-04T03:17:21Z) - Echo-Forcing: A Scene Memory Framework for Interactive Long Video Generation [48.476317015122625]
Echo-Forcingは、インタラクティブなロングビデオ生成のためのトレーニング不要のシーンメモリフレームワークである。
キャッシュのバウンダリでスムーズなトランジション、ハードカット、長距離シーンリコールをサポートする。
論文 参考訳(メタデータ) (2026-05-15T14:33:09Z) - ReVision: Scaling Computer-Use Agents via Temporal Visual Redundancy Reduction [46.69118032596015]
ReVisionは、冗長な視覚的パッチを削除するトラジェクトリ上で、マルチモーダル言語モデルをトレーニングするために使用される。
ReVisionはトークン使用率を平均で46%削減し,無ドロップベースラインでの成功率を3%向上することを示した。
このことは、視覚史において一般的に見られる飽和は、過去の情報の有用性の制限によるものではなく、むしろ非効率なトークン表現の結果によるものであることを示唆している。
論文 参考訳(メタデータ) (2026-05-11T20:27:54Z) - Mem-W: Latent Memory-Native GUI Agents [50.87647372904382]
本稿では,メモリをエージェントの連続的コンテキストの一部として扱う,潜在メモリネイティブなGUIエージェントであるMem-Wを紹介する。
4つのWebおよびモバイルナビゲーションベンチマークで、Mem-Wはさまざまなバックボーンとメモリ拡張ベースラインを一貫して改善している。
論文 参考訳(メタデータ) (2026-05-10T04:31:23Z) - Label-Free Cross-Task LoRA Merging with Null-Space Compression [50.63908869296697]
我々は,ラベルフリーで出力に依存しない手法であるNull-Space Compression (NSC) Mergingを紹介した。
NSCは、従来のメソッドがタスクのサブセットに収まるバランスの取れたゲインを持つ20の異種視覚タスクに対して、最先端のパフォーマンスを達成する。
論文 参考訳(メタデータ) (2026-03-27T11:34:41Z) - Near-optimal Regret Using Policy Optimization in Online MDPs with Aggregate Bandit Feedback [49.84060509296641]
オンライン有限水平マルコフ決定過程を逆向きに変化した損失と総括的帯域幅フィードバック(フルバンド幅)を用いて研究する。
この種のフィードバックの下では、エージェントは、軌跡内の各中間段階における個々の損失よりも、軌跡全体に生じる総損失のみを観察する。
この設定のための最初のポリシー最適化アルゴリズムを紹介します。
論文 参考訳(メタデータ) (2025-02-06T12:03:24Z) - Provably Efficient Reinforcement Learning with Multinomial Logit Function Approximation [67.8414514524356]
本稿では,MNL関数近似を用いたMDPの新たなクラスについて検討し,状態空間上の確率分布の正当性を保証する。
その大きな利点にもかかわらず、非線形関数を組み込むことは、統計的および計算効率の両方において重大な課題を提起する。
我々は,$widetildemathcalO(dH2sqrtK + kappa-1d2H2)$を後悔するアルゴリズムを提案する。
論文 参考訳(メタデータ) (2024-05-27T11:31:54Z) - Improved Algorithm for Adversarial Linear Mixture MDPs with Bandit
Feedback and Unknown Transition [71.33787410075577]
線形関数近似,未知遷移,および逆損失を用いた強化学習について検討した。
我々は高い確率で$widetildeO(dsqrtHS3K + sqrtHSAK)$ regretを実現する新しいアルゴリズムを提案する。
論文 参考訳(メタデータ) (2024-03-07T15:03:50Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。