論文の概要: The Past Is Prologue: A Plug-in Controller for Selective Updates in Sequentially Evolving LLM Memory
- arxiv url: http://arxiv.org/abs/2606.31121v1
- Date: Tue, 30 Jun 2026 04:33:18 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-01 18:27:19.073361
- Title: The Past Is Prologue: A Plug-in Controller for Selective Updates in Sequentially Evolving LLM Memory
- Title(参考訳): 過去はプロローグ:LCMメモリの逐次進化における選択的更新のためのプラグインコントローラ
- Authors: Zihan Chen, Songwei Dong, Chengshuai Shi, Peng Wang, Song Wang, Cong Shen, Jundong Li,
- Abstract要約: 我々はJanusを提案する。Janusは、候補メモリの更新を受け付けるか、以前のメモリを保持するかを決定するプラグインメモリコントローラである。
Janus は Memory Momentum Trigger を使用して、メモリ更新軌道における不審な偏差を識別する。
Janusは、対応するベース更新器に対して、平均精度を+2.7から+4.6ポイント改善する。
- 参考スコア(独自算出の注目度): 53.50071717647285
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Sequentially evolving LLM memory enables agents to reuse past experience, but existing systems usually deploy each locally generated memory update without checking whether it improves future behavior. As a result, updates that help the current task may overwrite useful knowledge, introduce over-specific rules, or bias the final memory toward recent examples. We propose Janus, a plug-in memory controller that decides whether to accept a candidate memory update or retain the previous memory. To make this decision efficient, Janus uses a Memory Momentum Trigger to identify suspicious deviations in the memory-update trajectory, and compares old and new memories on a compact hybrid evaluation set of coverage, boundary, and fresh tasks instead of replaying the full history. Janus is method-agnostic and wraps existing updaters without changing their update rules. Across six datasets, two backbone LLMs, and two memory updaters, Janus improves average accuracy by +2.7 to +4.6 points over the corresponding base updaters.
- Abstract(参考訳): 逐次進化したLCMメモリは、エージェントが過去の経験を再利用することを可能にするが、既存のシステムは通常、将来の振る舞いを改善するかどうかを確認することなく、ローカルに生成された各メモリ更新をデプロイする。
その結果、現在のタスクを補助する更新は、有用な知識を上書きしたり、過剰なルールを導入したり、最近の例に最終記憶を偏らせる可能性がある。
我々はJanusを提案する。Janusは、候補メモリの更新を受け付けるか、以前のメモリを保持するかを決定するプラグインメモリコントローラである。
この決定を効率的にするために、Janus氏はMemory Momentum Triggerを使用して、メモリ更新軌道における不審な偏差を識別し、完全な履歴を再生する代わりに、カバー、バウンダリ、フレッシュタスクのコンパクトなハイブリッド評価セット上で、古いメモリと新しいメモリを比較した。
Janusはメソッドに依存しず、更新ルールを変更することなく既存の更新をラップする。
6つのデータセット、2つのバックボーンLDM、2つのメモリ更新器で、Janusは対応するベース更新器よりも平均精度を+2.7から+4.6ポイント向上する。
関連論文リスト
- TRUSTMEM: Learning Trustworthy Memory Consolidation for LLM Agents with Long-Term Memory [11.528637007309937]
大規模言語モデル(LLM)エージェントは、拡張されたインタラクションをサポートし、有限コンテキストウィンドウを超えてパーソナライズされたアシストをサポートするために、長期記憶に依存している。
既存のメモリエージェントは、生成された書き込み、修正、削除によって外部メモリを積極的に更新する。
これらの更新は、重要な情報を省略したり、既存の記憶を破損させたり、幻覚コンテンツを導入したりする可能性がある。
本稿では,メモリ統合の信頼性向上を目的としたフレームワークであるTrustMemを提案する。
論文 参考訳(メタデータ) (2026-06-23T20:49:28Z) - AdMem: Advanced Memory for Task-solving Agents [13.611633561917513]
大規模言語モデル(LLM)はツール使用エージェントとしての約束を示すが、知識の記憶、整理、再利用を必要とする長期的タスクには制限がある。
本稿では,短期記憶と長期記憶を組み合わせた2段階設計において,セマンティック,エピソード,手続き記憶を統合した統合的・自動記憶フレームワークを提案する。
論文 参考訳(メタデータ) (2026-06-05T00:11:57Z) - MemPro: Agentic Memory Systems as Evolvable Programs [26.76706603895889]
長期の自律エージェントは、記憶システムに履歴情報を保持し、進化する状態を追跡し、関連する知識を有限のコンテキストウインドウを超えて再利用することを要求する。
既存のエージェントメモリシステムは、通常、メモリ構築検索パイプライン(MCR)に従うが、配置後に周囲のパイプラインを固定しながら、主にメモリバンクに適応することが多い。
本稿では,MCRパイプライン全体をメモリバンクやプロンプトテキストのみに適応させるのではなく,進化可能なプログラムとして扱うシステムレベルの進化フレームワークであるMemProを提案する。
論文 参考訳(メタデータ) (2026-05-30T08:47:33Z) - EvoMemBench: Benchmarking Agent Memory from a Self-Evolving Perspective [21.66000179149483]
EvoMemBenchは、メモリスコープとメモリ内容の2つの軸に沿って編成された統一ベンチマークである。
本稿では,15個の代表記憶法と強い長文ベースラインを標準プロトコルで比較する。
結果は、現在のメモリシステムは、まだ一般的な解決策には程遠いことを示している。
論文 参考訳(メタデータ) (2026-05-18T13:54:38Z) - Is One Score Enough? Rethinking the Evaluation of Sequentially Evolving LLM Memory [50.857546269660276]
本稿では,大規模言語モデル(LLM)メモリを逐次進化させる診断評価フレームワークであるSeqMem-Evalを紹介する。
最終的なパフォーマンスのみに焦点を当てるのではなく、SeqMem-Evalは、シーケンシャル推論において、メモリ状態がどのように進化し、一般化し、エクスペリエンスを集約し、有用な情報を保持するかを評価する。
論文 参考訳(メタデータ) (2026-05-14T20:15:22Z) - Learning How and What to Memorize: Cognition-Inspired Two-Stage Optimization for Evolving Memory [53.8372503928207]
大規模言語モデル(LLM)エージェントは、一貫したパーソナライゼーションのために長期のユーザメモリを必要とする。
既存のメモリシステムは、主に静的で手作りの更新ルールに依存している。
MemCoEは認知にインスパイアされた2段階最適化フレームワークで、どのようにメモリを整理し、どの情報を更新すべきかを学ぶ。
論文 参考訳(メタデータ) (2026-05-01T14:45:20Z) - MemEvoBench: Benchmarking Memory MisEvolution in LLM Agents [78.95081012334116]
永続メモリを持つ大規模言語モデル(LLM)は、相互作用の継続性とパーソナライゼーションを高めるが、新たな安全性リスクをもたらす。
汚染または偏りのある記憶蓄積は、異常な作用を引き起こす可能性がある。
MemeEvoBenchは、LLMエージェントのメモリ安全性を評価する最初のベンチマークである。
論文 参考訳(メタデータ) (2026-04-17T07:29:52Z) - NextMem: Towards Latent Factual Memory for LLM-based Agents [58.35585202907478]
NextMemは、自動回帰型オートエンコーダを使用して、潜時メモリを効率的に構築する、潜時ファクトメモリフレームワークである。
大規模な実験は、NextMemが優れたパフォーマンスを達成することを示す。
論文 参考訳(メタデータ) (2026-02-26T14:35:27Z) - Memp: Exploring Agent Procedural Memory [72.41472703974935]
LLM(Large Language Models)ベースのエージェントは様々なタスクをこなすが、静的パラメータで手動で設計または絡み合うような不安定なプロシージャメモリに悩まされる。
本稿では,過去のエージェントの軌跡をステップバイステップの細粒度と高レベルなスクリプトライクな抽象化の両方に蒸留するMempを提案する。
メモリレポジトリが洗練されるにつれて、エージェントは着実に高い成功率と類似タスクの効率を達成できることを示す。
論文 参考訳(メタデータ) (2025-08-08T16:20:56Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。