論文の概要: Understanding and Mitigating Inference-Time Overreliance Using Agentic Memory
- arxiv url: http://arxiv.org/abs/2610.07311v1
- Date: Mon, 05 Oct 2026 19:48:54 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-08 02:58:29.622283
- Title: Understanding and Mitigating Inference-Time Overreliance Using Agentic Memory
- Title(参考訳): エージェント記憶を用いた推論時間過度の理解と緩和
- Abstract要約: メモリ過信と呼ばれる障害モードについて検討する。
ベンチマークやメモリアーキテクチャ全体では、過去の経験が現在のタスクに転送されるときにメモリが有用であるが、エビデンスの一部だけが転送されると誤解を招く可能性がある。
この発見に動機づけられたMEMTRIMは,書き込み時にメモリエビデンスをインデックス化し,読み出し時に再利用を制御するための,プラグアンドプレイフレームワークである。
- 参考スコア(独自算出の注目度): 9.116862679142574
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Agentic memory allows LLM agents to reuse past experience, yet retrieved memories can also distort inference even when they are benign, correctly stored, and appropriately retrieved. We study this failure mode, which we call memory over-reliance. Across benchmarks and memory architectures, we find that memory is useful when past experience transfers to the current task, but can become misleading when only part of the evidence transfers. Failures are strongest under partial query-memory overlap, a pattern further confirmed by controlled experiments thatvary the amount of overlapping evidence. Motivated by this finding, we propose MEMTRIM, a plug-and-play framework that indexes memory evidence at write time and controls its reuse at read time. MEMTRIM removes repeated or conflicting evidence while preserving useful memory-specific information, requires no retraining, and applies to both embedding-based and structured memory systems.Experiments show that MEMTRIM reduces memory overreliance while preserving the benefits of useful memory across models and memory settings.
- Abstract(参考訳): エージェントメモリにより、LLMエージェントは過去の経験を再利用できるが、検索されたメモリは、良心的、正しく保存され、適切に検索された場合でも推論を歪めることができる。
メモリ過信と呼ばれるこの障害モードについて検討する。
ベンチマークやメモリアーキテクチャ全体では、過去の経験が現在のタスクに転送されるときにメモリが有用であるが、エビデンスの一部だけが転送されると誤解を招く可能性がある。
このパターンは、重複するエビデンスの数に応じて制御された実験によってさらに確認される。
この発見に動機づけられたMEMTRIMは,書き込み時にメモリエビデンスをインデックス化し,読み出し時に再利用を制御するための,プラグアンドプレイフレームワークである。
MEMTRIMは、有用なメモリ固有の情報を保持しながら、繰り返しまたは矛盾するエビデンスを取り除き、再トレーニングを必要とせず、埋め込みベースのメモリシステムと構造化されたメモリシステムの両方に適用する。
関連論文リスト
- Harness the Memory: A Holistic Evaluation of Memory Substrates in Memory Agents [97.19033877543522]
本稿では,メモリ拡張剤のメモリ基板の制御ハーネス評価について述べる。
統一されたハーネスの下で26のパフォーマンスと効率のメトリクスを計測する。
これらの知見は、アダプティブエージェントメモリシステムに必要なコンポーネントとして、基質ルーティングを動機付けている。
論文 参考訳(メタデータ) (2026-08-15T03:29:48Z) - Mechanistic Attention Guidance for Agent Memory Refinement [32.57216046158823]
検索ヘッドアテンションは,セグメントレベルのメモリ使用量を明らかにするためのメカニスティック信号を提供する。
本稿では,注意による利用パターンを用いてセグメントレベルのメモリ更新を誘導するフレームワークであるAttention-Guided Memory Refinement (AGMR)を提案する。
論文 参考訳(メタデータ) (2026-07-20T07:17:50Z) - MemSyco-Bench: Benchmarking Sycophancy in Agent Memory [32.49512092540906]
MemSyco-Benchは、エージェントシステムにおけるメモリ誘起性を評価するためのベンチマークである。
MemSyco-Benchは、いつメモリが決定に影響を及ぼすか、どのように有効なメモリを使用するかを測定する。
論文 参考訳(メタデータ) (2026-07-01T15:30:33Z) - MEMPROBE: Probing Long-Term Agent Memory via Hidden User-State Recovery [58.64329475683699]
我々は、長期記憶は監査可能な相互作用後のアーティファクトとして評価されるべきであると主張している。
我々は、メモリを備えたエージェントがシミュレーションユーザを支援するベンチマークであるMEMPROBEで、このビューをインスタンス化する。
私たちは、成功したアシストと回復可能なメモリが、異なる機能として振る舞うことに気付きました。
論文 参考訳(メタデータ) (2026-06-23T13:52:46Z) - MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models [56.31411457917676]
本稿では,メモリ構築と検索において,機能的メモリ境界を保存するタイプアウェアメモリフレームワークであるMemGuardを紹介する。
幻覚と長期会話のベンチマーク全体で、MemGuardはメモリの信頼性を最大28.27%向上し、メモリトークンは以前の方法より5.8倍少ない。
論文 参考訳(メタデータ) (2026-05-27T06:04:19Z) - Is One Score Enough? Rethinking the Evaluation of Sequentially Evolving LLM Memory [50.857546269660276]
本稿では,大規模言語モデル(LLM)メモリを逐次進化させる診断評価フレームワークであるSeqMem-Evalを紹介する。
最終的なパフォーマンスのみに焦点を当てるのではなく、SeqMem-Evalは、シーケンシャル推論において、メモリ状態がどのように進化し、一般化し、エクスペリエンスを集約し、有用な情報を保持するかを評価する。
論文 参考訳(メタデータ) (2026-05-14T20:15:22Z) - MemMA: Coordinating the Memory Cycle through Multi-Agent Reasoning and In-Situ Self-Evolution [52.29303869050117]
メモリ拡張LDMエージェントは、長期の相互作用をサポートするために外部メモリバンクを保持する。
MemMAはプラグアンドプレイのマルチエージェントフレームワークで、前方と後方の両方の経路に沿ってメモリサイクルを調整する。
論文 参考訳(メタデータ) (2026-03-19T10:15:59Z) - MemoryArena: Benchmarking Agent Memory in Interdependent Multi-Session Agentic Tasks [55.145729491377374]
メモリを持つエージェントの既存の評価は、通常、単独で記憶と行動を評価する。
マルチセッションメモリ-エージェント環境ループにおけるエージェントメモリのベンチマークのための統合評価ジムであるMemoryArenaを紹介する。
MemoryArenaは、Webナビゲーション、優先制約付き計画、プログレッシブ情報検索、シーケンシャルなフォーマルな推論を含む評価をサポートする。
論文 参考訳(メタデータ) (2026-02-18T09:49:14Z) - Multiple Memory Systems for Enhancing the Long-term Memory of Agent [9.43633399280987]
MemoryBankやA-MEMといった既存の手法は、記憶されているメモリの質が劣っている。
我々は認知心理学理論にインスパイアされた多重記憶システムを設計した。
論文 参考訳(メタデータ) (2025-08-21T06:29:42Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。