論文の概要: ChronoMem: Version Control and Semantic Rollback for Large Language Model Agent Memory
- arxiv url: http://arxiv.org/abs/2607.27773v2
- Date: Wed, 05 Aug 2026 04:27:17 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-06 14:48:42.914905
- Title: ChronoMem: Version Control and Semantic Rollback for Large Language Model Agent Memory
- Title(参考訳): ChronoMem: 大規模言語モデルエージェントメモリのためのバージョン管理とセマンティックロールバック
- Authors: Yongye Su, Wujiang Xu, Chaoji Zuo, Elisa Bertino,
- Abstract要約: ChronoMemはGoogleのAgent Development Kitに統合されたエージェントメモリのセマンティックバージョンコントロール層である。
我々の知る限り、ChronoMemはLLMエージェントの系統的セマンティックグローバルメモリロールバックのための最初のオープンソースシステムであり、ベンチマークである。
- 参考スコア(独自算出の注目度): 13.447555042917884
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: LLM agents increasingly rely on long-term memory to support multi-session interaction and personalization. However, existing agent memory systems are designed around forward-only evolution, continuously accumulating, consolidating, and overwriting knowledge, with no principled mechanism to inspect, version, or revert prior states. This makes agents brittle under corrections, concept drift, and memory corruption, particularly after they have already been exposed to subsequent information. We present ChronoMem, a semantic version-control layer for agentic memory integrated into the production-ready, open-source Agent Development Kit by Google. ChronoMem commits whole-memory snapshots at each memory write, maintains structured version histories, and supports natural-language rollback requests by mapping undo intents to concrete historical versions through hybrid lexical and semantic retrieval, rank fusion, and reranking. We further introduce a post-exposure evaluation protocol that tests whether an agent can behave counterfactually after rollback by answering queries and summarizing history as if future updates had never occurred. On long-horizon conversational benchmarks augmented with evolving memory states and rollback tasks, ChronoMem substantially improves rollback-consistent question answering and history summarization relative to prompt-only and retrieval-only baselines, while achieving strong performance in semantic version selection. To our knowledge, ChronoMem is the first open-source system and benchmark for systematic semantic global memory rollback in LLM agents.
- Abstract(参考訳): LLMエージェントは、多セッションインタラクションとパーソナライゼーションをサポートするために、長期記憶に依存している。
しかし、既存のエージェントメモリシステムはフォワードのみの進化に基づいて設計されており、知識を継続的に蓄積し、統合し、上書きする。
これにより、エージェントは、特に後続の情報に暴露された後に、修正、概念のドリフト、記憶の腐敗の下で脆くなります。
我々はGoogleのAgent Development Kitに統合されたエージェントメモリのセマンティックバージョンコントロール層であるChronoMemを紹介する。
ChronoMemは、各メモリ書き込みで全メモリスナップショットをコミットし、構造化されたバージョン履歴を保持し、ハイブリッド語彙とセマンティック検索、ランク融合、再ランクを通じて、undoインテントを具体的な歴史的バージョンにマッピングすることで、自然言語のロールバックリクエストをサポートする。
さらに,ロールバック後にエージェントが反現実的に振る舞うことができるかどうかを,クエリに応答し,履歴を将来の更新が起こらなかったかのように要約することによって検証する,露光後評価プロトコルを導入する。
進化するメモリ状態とロールバックタスクで強化された長期会話ベンチマークでは、ChronoMemはロールバック一貫性のある質問応答と、プロンプトのみのベースラインと検索のみのベースラインに対する履歴の要約を大幅に改善し、セマンティックバージョン選択において高いパフォーマンスを実現している。
我々の知る限り、ChronoMemはLLMエージェントの系統的セマンティックグローバルメモリロールバックのための最初のオープンソースシステムであり、ベンチマークである。
関連論文リスト
- MRMS: A Multi-Resolution Memory Substrate for Long-Lived AI Agents [2.808851478009314]
長期的なAIエージェントは、相互作用の連続性を必要とする。
プロンプトウィンドウを拡張するだけで連続性を得ることはできない。
2つの軸に沿って構成されたアーキテクチャ記憶基板を提案する。
論文 参考訳(メタデータ) (2026-07-06T02:54:37Z) - AdMem: Advanced Memory for Task-solving Agents [13.611633561917513]
大規模言語モデル(LLM)はツール使用エージェントとしての約束を示すが、知識の記憶、整理、再利用を必要とする長期的タスクには制限がある。
本稿では,短期記憶と長期記憶を組み合わせた2段階設計において,セマンティック,エピソード,手続き記憶を統合した統合的・自動記憶フレームワークを提案する。
論文 参考訳(メタデータ) (2026-06-05T00:11:57Z) - SAM: State-Adaptive Memory for Long-Horizon Reasoning Agent [51.274445160155864]
ロングホライゾンのエージェント推論は、思考、ツールコール、観察、部分的な結論を含む長い相互作用履歴を通して行動するために大きな言語モデルを必要とする。
既存のアプローチでは、インタラクション履歴の切り抜き、短いサロゲートに圧縮、あるいは再利用のために選択した部分を取得することで、この問題に対処している。
我々は、インテント駆動リコールのための生のトラジェクトリページを保持しながら、継続的なインタラクションをコンパクトなメモリキューに統合するスタンドアロンフレームワークであるState-Adaptive Memoryを提案する。
論文 参考訳(メタデータ) (2026-05-23T08:37:16Z) - MemMA: Coordinating the Memory Cycle through Multi-Agent Reasoning and In-Situ Self-Evolution [52.29303869050117]
メモリ拡張LDMエージェントは、長期の相互作用をサポートするために外部メモリバンクを保持する。
MemMAはプラグアンドプレイのマルチエージェントフレームワークで、前方と後方の両方の経路に沿ってメモリサイクルを調整する。
論文 参考訳(メタデータ) (2026-03-19T10:15:59Z) - Memory for Autonomous LLM Agents:Mechanisms, Evaluation, and Emerging Frontiers [0.42061757959666934]
大きな言語モデル(LLM)エージェントは、単一のコンテキストウィンドウが小さすぎて何が起きているのかをキャプチャできないような環境で、ますます運用される。
メモリはステートレステキストジェネレータを真に適応的なエージェントに変える。
この調査は、メモリがどのように設計され、実装され、現代のLCMベースのエージェントで評価されるかという構造化された説明を提供する。
論文 参考訳(メタデータ) (2026-03-08T15:08:01Z) - Learning to Remember: End-to-End Training of Memory Agents for Long-Context Reasoning [18.621823772319154]
本稿では,メモリ操作と質問応答を一つのポリシーで統一するエンドツーエンド強化学習フレームワークを提案する。
UMAは、グローバルコンテキストのためのコンパクトなコアサマリと、明示的なCRUDをサポートする構造化メモリバンクという、二重メモリ表現を維持している。
Ledger-QA、Test-Time Learning、そしてCurcurate Retrievalにまたがる13のデータセットのうち、UMAは動的推論と学習タスクの長いコンテキストとRAGベースラインを大幅に上回っている。
論文 参考訳(メタデータ) (2026-02-13T16:54:23Z) - Graph-based Agent Memory: Taxonomy, Techniques, and Applications [63.70340159016138]
メモリはLarge Language Model(LLM)ベースのエージェントの中核モジュールとして出現する。
さまざまなパラダイムの中でグラフは、関係依存をモデル化する本質的な能力のため、エージェントメモリの強力な構造として際立っている。
本調査では, エージェントメモリの総合的な検討について, グラフベースの観点から述べる。
論文 参考訳(メタデータ) (2026-02-05T13:49:05Z) - AMA: Adaptive Memory via Multi-Agent Collaboration [54.490349689939166]
複数の粒度にまたがるメモリ管理に協調エージェントを活用する新しいフレームワークであるAMA(Adaptive Memory via Multi-Agent Collaboration)を提案する。
AMAは、ステート・オブ・ザ・アートのベースラインを著しく上回り、トークンの消費をフルコンテキストの手法と比べて約80%削減する。
論文 参考訳(メタデータ) (2026-01-28T08:09:49Z) - Hindsight is 20/20: Building Agent Memory that Retains, Recalls, and Reflects [11.300084544174894]
エージェントメモリを推論のための構造化第1級基板として扱うメモリアーキテクチャであるHindsightを提案する。
情報の追加、アクセス、更新の方法を管理する3つのコア操作 – 保持、リコール、リフレクション – をサポートしている。
オープンソースの20Bモデルは、全文ベースラインで全体の精度を39%から83.6%に引き上げる。
論文 参考訳(メタデータ) (2025-12-14T19:47:23Z) - Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory [89.65731902036669]
Evo-Memoryは、大規模言語モデル(LLM)エージェントで自己進化型メモリを評価するための、ストリーミングベンチマークとフレームワークである。
10以上の代表的なメモリモジュールを評価し、10種類の多ターンゴール指向およびシングルターン推論およびQAデータセットで評価した。
論文 参考訳(メタデータ) (2025-11-25T21:08:07Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。