論文の概要: A Control Architecture for Training-Free Memory Use
- arxiv url: http://arxiv.org/abs/2604.18206v1
- Date: Mon, 20 Apr 2026 12:55:27 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-21 21:52:52.878923
- Title: A Control Architecture for Training-Free Memory Use
- Title(参考訳): 学習自由メモリ利用のための制御アーキテクチャ
- Abstract要約: 我々は、メモリアシストされた第2パスをいつトリガーするか、いつそれを信頼するか、また、時間とともにメモリバンクの維持方法を研究する。
提案手法は,不確実性に基づくルーティング,信頼に基づく選択的受け入れ,ルールと模範記憶間の銀行選択,時間とともにメモリバンクのエビデンスに基づくガバナンスを組み合わせる。
- 参考スコア(独自算出の注目度): 4.640757402699249
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Prompt-injected memory can improve reasoning without updating model weights, but it also creates a control problem: retrieved content helps only when it is applied in the right state. We study this problem in a strict training-free setting and formulate it as applicability control: when to trigger a memory-assisted second pass, when to trust it, and how to maintain the memory bank over time. Our method combines uncertainty-based routing, confidence-based selective acceptance, bank selection across rule and exemplar memory, and evidence-based governance of the memory bank over time. Under a locked training-free protocol with compute-matched controls, it improves two core arithmetic benchmarks by +7.0 points on SVAMP and +7.67 points on ASDiv over baseline. The same architecture also transfers to QA and agent benchmarks with smaller positive effects and shows the same positive direction on a second checkpoint for the main arithmetic tasks. On arithmetic, the main empirical pattern is that the control architecture, rather than raw memory exposure, drives the improvements on SVAMP and ASDiv. Mechanistically, confidence separates helpful from harmful rule-bank interventions, and under fixed retrieval the repair-versus-corrupt difference localizes to rows whose retrieved set actually contains the edited entries.
- Abstract(参考訳): プロンプト注入メモリは、モデルウェイトを更新せずに推論を改善することができるが、制御上の問題も生んでいる。
我々は、この問題を厳格なトレーニング不要な設定で研究し、それを適用可能性制御として定式化し、メモリアシスト第2パスをいつトリガーするか、いつそれを信頼するか、そして時間とともにメモリバンクを保守するかを定式化する。
提案手法は,不確実性に基づくルーティング,信頼に基づく選択的受け入れ,ルールと模範記憶間の銀行選択,時間とともにメモリバンクのエビデンスに基づくガバナンスを組み合わせる。
計算整合制御を備えたロックされたトレーニングフリープロトコルの下では、SVAMPでは+7.0点、ベースラインでは+7.67点という2つのコア演算ベンチマークを改善している。
同じアーキテクチャは、QAやエージェントベンチマークにも転送され、より小さな正の効果で、主算術タスクの2番目のチェックポイントで同じ正の方向を示す。
算術において、主要な経験的パターンは、生のメモリ露光ではなく制御アーキテクチャがSVAMPとASDivの改良を推進していることである。
機械的には、信頼は有害なルールバンクの介入と区別され、固定された検索では、修復と破損の差は、検索された集合が実際に編集されたエントリを含む行にローカライズされる。
関連論文リスト
- What Makes Agent Memory Useful for Reliable Unanswerable Question Handling? [51.58639607746329]
メモリはエージェントシステムで広く使われているが、信頼性の高いUAQ処理におけるその役割は未だ不明である。
本稿では,統一エージェントRAGフレームワークによるUAQ処理のためのエージェントメモリの体系的研究を行う。
メモリはいくつかの設定でUAQ性能を改善することができるが、そのような利得は普遍的ではなく選択的であり、データセットシフト時にも脆弱である。
論文 参考訳(メタデータ) (2026-08-28T05:00:28Z) - Dual-Grained Agent Memory and Shapley Context Attribution for Multimodal Agentic Learner [55.80248281761638]
マルチモーダルな大言語モデル (MLLM) は、科学的および数学的推論において、印象的な認識を提供する。
本稿では,DG-Memを提案する。DG-Memは,トレーニングタイムのロールアウトから一度構築した外部記憶メモリと,テスト時に読み取り専用に相談することで,凍結したMLLMを拡張可能なエージェントメモリフレームワークである。
論文 参考訳(メタデータ) (2026-08-24T13:56:01Z) - Verifiable Memory: Learning Unified Memory Management with Local and Global Verifiers for Large Language Model Agents [12.763061404384601]
大規模言語モデル(LLM)エージェントは、再利用可能な情報を保持し、有界な活動コンテキストを制御し、長い水平相互作用の間、以前の証拠を回復しなければならない。
本稿では,LTM,アクティブコンテキスト,エピソード履歴を異なる状態として表現し,一つのメモリ操作ポリシで制御するフレームワークであるVerMemを提案する。
論文 参考訳(メタデータ) (2026-08-04T05:06:24Z) - Memory as a Controlled Process: Learned Adaptive Memory Management for LLM Agents [72.3752981234916]
大きな言語モデル(LLM)エージェントは、タスク間の経験を蓄積するために、外部メモリシステムに依存している。
メモリ操作をマルコフ決定プロセスとしてモデル化するフレームワークである制御プロセス(MemCon)としてメモリを提示する。
MemConは、複数のメモリベースラインのタスク成功率を最大15.2ポイント上回り、トークン消費量を5-20%削減している。
論文 参考訳(メタデータ) (2026-07-15T08:32:40Z) - Neural Subspace Reallocation: Continual Learning as Retrieval-Based Subspace Memory Management [0.0]
パラメータ部分空間上のメモリ管理として連続的な学習を再構成するニューラル部分空間再配置(NSR)を導入する。
NSRはLow-Rank Adaptation (LoRA)モジュールを冷凍バックボーン上で圧縮可能で取り出し可能なメモリユニットとして管理する。
論文 参考訳(メタデータ) (2026-06-29T10:00:29Z) - GateMem: Benchmarking Memory Governance in Multi-Principal Shared-Memory Agents [61.50171793000712]
GateMemはマルチプリンシパル共有メモリエージェントのベンチマークである。
医療、事務、教育、家庭の領域にまたがる。
強力なユーティリティ、堅牢なアクセス制御、信頼性のある忘れを同時に実現する方法は存在しない。
論文 参考訳(メタデータ) (2026-06-17T09:06:15Z) - GoTTA be Diverse: Rethinking Memory Policies for Test-Time Adaptation [54.70334474895361]
テスト時間適応(TTA)は、事前訓練されたモデルが、分散シフトの下でラベルのないテストストリームにオンラインで適応できるようにする。
ほとんどのTTA研究は適応の目的に焦点を当てているが、実用的なストリームはどのサンプルが適応を駆動するかを選択するのに使用されるメモリにも大きく依存している。
本稿では,クラスバランスアロケーションと特徴空間の多様性を組み合わせた多様性を考慮したメモリポリシーであるGOTTAについて紹介する。
論文 参考訳(メタデータ) (2026-05-19T14:18:46Z) - Is One Score Enough? Rethinking the Evaluation of Sequentially Evolving LLM Memory [50.857546269660276]
本稿では,大規模言語モデル(LLM)メモリを逐次進化させる診断評価フレームワークであるSeqMem-Evalを紹介する。
最終的なパフォーマンスのみに焦点を当てるのではなく、SeqMem-Evalは、シーケンシャル推論において、メモリ状態がどのように進化し、一般化し、エクスペリエンスを集約し、有用な情報を保持するかを評価する。
論文 参考訳(メタデータ) (2026-05-14T20:15:22Z) - MemEvoBench: Benchmarking Memory MisEvolution in LLM Agents [78.95081012334116]
永続メモリを持つ大規模言語モデル(LLM)は、相互作用の継続性とパーソナライゼーションを高めるが、新たな安全性リスクをもたらす。
汚染または偏りのある記憶蓄積は、異常な作用を引き起こす可能性がある。
MemeEvoBenchは、LLMエージェントのメモリ安全性を評価する最初のベンチマークである。
論文 参考訳(メタデータ) (2026-04-17T07:29:52Z) - Trust Your Memory: Verifiable Control of Smart Homes through Reinforcement Learning with Multi-dimensional Rewards [10.23809165159082]
大規模言語モデル(LLM)は、パーソナライズされたスマートホームエクスペリエンスを実現するための重要な基盤となっている。
MemHomeLifeは匿名化された現実世界の長期的なユーザーインタラクションログから作られている。
MemHomeは、スマートホームシナリオにおけるメモリ駆動デバイス制御を体系的に評価するために設計された最初のベンチマークである。
論文 参考訳(メタデータ) (2026-04-11T09:08:27Z) - MemMA: Coordinating the Memory Cycle through Multi-Agent Reasoning and In-Situ Self-Evolution [52.29303869050117]
メモリ拡張LDMエージェントは、長期の相互作用をサポートするために外部メモリバンクを保持する。
MemMAはプラグアンドプレイのマルチエージェントフレームワークで、前方と後方の両方の経路に沿ってメモリサイクルを調整する。
論文 参考訳(メタデータ) (2026-03-19T10:15:59Z) - Adaptive Memory Admission Control for LLM Agents [9.04001220868675]
本稿では,メモリ入力を構造化決定問題として扱うフレームワークであるAdaptive Memory Admission Control (A-MAC)を提案する。
A-MACはメモリ値を5つの補完的・解釈可能な因子に分解する。
A-MACは精度のよいリコールトレードオフを実現し、F1を0.583に改善し、最先端のLLMネイティブメモリシステムに比べてレイテンシを31%削減した。
論文 参考訳(メタデータ) (2026-03-04T19:32:02Z) - Learning to Share: Selective Memory for Efficient Parallel Agentic Systems [49.78267008828593]
エージェントシステムは、反復的に推論する複数のエージェントを調整することで複雑なタスクを解決し、ツールを呼び出し、中間結果を交換する。
最近のアプローチでは、さまざまな推論の軌跡を探索するために、複数のエージェントチームが並行して運用されている。
我々は並列エージェントフレームワークのための学習された共有メモリ機構であるLearning to Share (LTS)を提案する。
論文 参考訳(メタデータ) (2026-02-05T18:20:21Z) - Memory Retention Is Not Enough to Master Memory Tasks in Reinforcement Learning [44.94110361062394]
実世界の意思決定は、安定かつ適応性のあるメモリに依存する。
既存の強化学習ベンチマークとメモリ拡張エージェントは、主に保持に焦点を当てている。
部分的な可観測性の下で連続的なメモリ更新を明示的にテストするベンチマークを導入する。
論文 参考訳(メタデータ) (2026-01-21T15:27:23Z) - Fine-Mem: Fine-Grained Feedback Alignment for Long-Horizon Memory Management [63.48041801851891]
Fine-Memは、きめ細かいフィードバックアライメントのために設計された統一されたフレームワークである。
MemalphaとMemoryAgentBenchの実験は、Fin-Memが強いベースラインを一貫して上回ることを示した。
論文 参考訳(メタデータ) (2026-01-13T11:06:17Z) - SafeLoad: Efficient Admission Control Framework for Identifying Memory-Overloading Queries in Cloud Data Warehouses [59.68732483257323]
メモリオーバーロードは、クラウドデータウェアハウスにおけるリソースの枯渇の一般的な形態である。
我々は,メモリオーバロード(MO)クエリの特定に特化して設計された,最初のクエリ入力制御フレームワークであるSafeLoadを提案する。
SafeLoadは、オンラインおよびオフライン時間オーバーヘッドの少ない最先端の予測性能を実現する。
論文 参考訳(メタデータ) (2026-01-05T08:29:51Z) - Source-Free Object Detection with Detection Transformer [59.33653163035064]
Source-Free Object Detection (SFOD) は、ソースデータにアクセスすることなく、ソースドメインから教師なしのターゲットドメインへの知識転送を可能にする。
ほとんどの既存のSFODアプローチは、より高速なR-CNNのような従来のオブジェクト検出(OD)モデルに限られるか、新しいODアーキテクチャ、特に検出変換器(DETR)に適合しない一般的なソリューションとして設計されている。
本稿では,DTRのクエリ中心の機能強化を特化して設計された新しいSFODフレームワークであるFeature Reweighting ANd Contrastive Learning NetworK(FRANCK)を紹介する。
論文 参考訳(メタデータ) (2025-10-13T07:35:04Z) - A-MemGuard: A Proactive Defense Framework for LLM-Based Agent Memory [31.673865459672285]
大規模言語モデル(LLM)エージェントは、過去のインタラクションから学習するためにメモリを使用する。
敵は、エージェントのメモリに一見無害なレコードを注入して、その将来の振る舞いを操作できる。
A-MemGuard は LLM エージェントメモリのための最初のプロアクティブな防御フレームワークである。
論文 参考訳(メタデータ) (2025-09-29T16:04:15Z) - SEDM: Scalable Self-Evolving Distributed Memory for Agents [23.182291416527764]
SEDMは、メモリをパッシブリポジトリからアクティブな自己最適化コンポーネントに変換する検証可能で適応的なフレームワークである。
また,SEDMは,強いメモリベースラインに比べてトークンオーバーヘッドを低減しつつ,推論精度を向上することを示した。
結果は、SEDMをオープンエンドのマルチエージェントコラボレーションのためのスケーラブルで持続可能なメモリメカニズムとして強調する。
論文 参考訳(メタデータ) (2025-09-11T14:37:37Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。