論文の概要: Runtime-Independent Persistent Agents: Preserving Identity, Memory, and Code Across Models, Harnesses, and Servers
- arxiv url: http://arxiv.org/abs/2609.00546v1
- Date: Tue, 01 Sep 2026 01:32:22 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-02 16:31:36.196686
- Title: Runtime-Independent Persistent Agents: Preserving Identity, Memory, and Code Across Models, Harnesses, and Servers
- Title(参考訳): 実行時非依存の永続化エージェント: モデル、ハーネス、サーバー間のアイデンティティ、メモリ、コードを保存する
- Authors: Zhenyu Zhao, Roy Zhao,
- Abstract要約: 永続的なエージェントに対して実行時非依存のアーキテクチャを提案する。
6つの連続不変量とquiesce--checkpoint--validate--bind--rehydrate-resumeプロトコルを定義する。
- 参考スコア(独自算出の注目度): 3.2278218804727334
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Agent systems are commonly described by the model and harness that currently produce their behavior. That boundary is useful for one execution but underspecifies a long-lived agent that may change models, orchestration harnesses, interaction sessions, and host servers while retaining one identity, memory, and executable code lineage. We present a runtime-independent architecture for persistent agents. A continuity-bearing substrate $P_t=(I_t,M_t,B_t)$ contains an architectural identity representation, private durable memory, and a versioned software body. A replaceable deployment binding comprises an execution substrate $E_t=(R_t,H_t,D_t)$, which supplies a reasoner, harness, and host, and a set of interaction surfaces $S_t$, such as chat, API, or user interface bindings. A deployed execution is $A_t=P_t\triangleright(E_t,S_t)$; changing either replaceable layer is migration, not agent creation, when an authorized protocol preserves attributable lineage and transfers continuation authority within a governed deployment boundary. We define six continuity invariants and a quiesce--checkpoint--validate--bind--rehydrate--resume protocol. Enoch realizes the design as a reusable body plus private installed identity, memory, workflow state, and continuation authority, with infrastructure dependencies behind versioned provider contracts. A clean-room run of the frozen public commit passes 833 core tests and 92 provider and library tests executed separately from the core suite; deployments have exercised reasoner-version, interaction-surface, and host-machine substitutions while retaining continuity-bearing state. This evidence supports mechanical substitutability and authorized system continuity, not behavioral invariance or exhaustive pairwise evaluation. The downstream measurement question is whether an authorized continuation still recalls, composes, and enacts its identity.
- Abstract(参考訳): エージェントシステムは一般的に、現在の振る舞いを生成するモデルとハーネスによって記述される。
このバウンダリは1つの実行に役立ちますが、モデル、オーケストレーションハーネス、インタラクションセッション、ホストサーバを変更しながら、1つのID、メモリ、実行可能コードラインを保持しながら、長寿命のエージェントを過小評価します。
永続的なエージェントに対して実行時非依存のアーキテクチャを提案する。
連続性を有する基板$P_t=(I_t,M_t,B_t)$は、アーキテクチャアイデンティティ表現、プライベート耐久性メモリ、およびバージョン付きソフトウェア本体を含む。
置換可能なデプロイメントバインディングは、推論器、ハーネス、ホストを提供する実行基板$E_t=(R_t,H_t,D_t)$と、チャット、API、ユーザインターフェースバインディングなどのインタラクションサーフェスセット$S_t$とを含む。
デプロイされた実行は、$A_t=P_t\triangleright(E_t,S_t)$; 変更可能なレイヤは、エージェント生成ではなく移行である。
6つの連続不変量とquiesce--checkpoint--validate--bind--rehydrate-resumeプロトコルを定義する。
Enochは、再利用可能なボディとしての設計と、プライベートインストールされたID、メモリ、ワークフロー状態、継続権限を実現している。
凍結されたパブリックコミットのクリーンルーム実行は、コアスイートから分離して実行されるコアテスト833とプロバイダとライブラリテスト92をパスする。
この証拠は、挙動不変性や徹底的なペアワイズ評価ではなく、機械的置換性と認証されたシステムの連続性を支持する。
下流の測定問題は、認証された継続が依然としてそのアイデンティティをリコールし、構成し、実行しているかどうかである。
関連論文リスト
- Beyond Memory: A Transactional Continuity Kernel for Long-Lived AI Agents [2.124730017640531]
永続的なAIエージェントは、長期にわたってバージョン管理された状態を蓄積するが、ストレージ保持だけは権限のある状態を識別しない。
エージェント状態ガバナンスはインフラ上のアクティベーションの問題であり、継続性は承認されたブランチヘッドの非破壊的で公認された系統であると定義する。
本稿では、原子状態活性化からオフコミット候補評価を分離するアクティベーション契約であるContinuity Kernel(CK)を提案する。
論文 参考訳(メタデータ) (2026-08-12T04:28:49Z) - Claim Plane: Enforceable Change Intents and Dynamic Scope for Parallel Coding Agents [1.4721615285883427]
本稿では,同時ソフトウェア変更をプリライト入力問題として扱うモデルに依存しない協調アーキテクチャであるClim Planeを提案する。
決定論的制御プレーンは、互換性のある意図をアトミックに認め、宣言された領域に同ファイルの並列性を制約し、未解決の重複をシリアライズし、依存性の無効性を追跡し、曖昧な権限で閉じる。
最初に試みられた突然変異は、現在のアクティブセットに対するアトミックスコープの促進と再許可を引き起こす。
論文 参考訳(メタデータ) (2026-07-24T02:30:50Z) - Tencent WorkBuddy Bench: A Multi-Domain Coding-Agent Benchmark with Contamination-Resistant Task Construction [57.138342889101345]
Tencent WorkBuddy Benchは、コーディングエージェントのためのマルチドメイン評価スイートである。
本報告では, 設計手法, スコアリングプロトコル, クロスモデルリーダーボードについて述べる。
論文 参考訳(メタデータ) (2026-07-23T04:34:06Z) - PhyAgentOS: A Self-Evolving Operating System for Embodied Agents with Decoupled Cognitive Planning and Physical Execution [49.776611937968]
我々は、スケジューリング、検証、メモリ、ベンチマーク、安全性をシステムレベルのサービスとして提供するPhyAgentOSを紹介します。
セッション中心のセッションは、スケジューリング、互換性、監督された実行、エビデンス収集、受け入れの最小単位として、アクションではなくセッションを扱う。
SessionVerifierは、実行終了とセマンティックタスク完了を、成功、失敗、または再計画のエビデンスに基づいて判断する。
ベンチマークはデプロイメントセッションと検証パスを再利用するので、結果は実際の実行に遡る。
論文 参考訳(メタデータ) (2026-07-18T04:46:53Z) - LemonHarness Technical Report [40.68992799867636]
LemonHarnessはロングホライゾンエージェントのための統合実行フレームワークである。
明確に定義されたワークスペース内の状態変更操作を制限します。
モデル呼び出し、ツール実行、ルール知識を単一のコントロールされたバウンダリ内でもたらします。
論文 参考訳(メタデータ) (2026-06-23T08:44:00Z) - GateMem: Benchmarking Memory Governance in Multi-Principal Shared-Memory Agents [61.50171793000712]
GateMemはマルチプリンシパル共有メモリエージェントのベンチマークである。
医療、事務、教育、家庭の領域にまたがる。
強力なユーティリティ、堅牢なアクセス制御、信頼性のある忘れを同時に実現する方法は存在しない。
論文 参考訳(メタデータ) (2026-06-17T09:06:15Z) - Agent libOS: A Library-OS-Inspired Runtime for Long-Running, Capability-Controlled LLM Agents [0.6345523830122165]
大規模言語モデル(LLM)エージェントは、要求応答アシスタントから長期実行中のソフトウェアアクターへと進化している。
本稿では,LLMエージェントのためのライブラリOSをベースとしたランタイム基板であるAgens libOSを提案する。
論文 参考訳(メタデータ) (2026-06-02T16:53:24Z) - Your Agents Are Aging Too: Agent Lifespan Engineering for Deployed Systems [60.79651380135334]
長寿命のAIエージェントは、永続的な運用システムとしてますますデプロイされる。
エージェントはデプロイ後、いつまで信頼できるのか?
エージェントライフスパンエンジニアリングのための縦型信頼性ベンチマークであるAgingBenchを紹介する。
論文 参考訳(メタデータ) (2026-05-25T19:55:12Z) - CodeTracer: Towards Traceable Agent States [40.51936201889185]
異種実行アーティファクトを解析し,抽出器を進化させるトレースアーキテクチャであるCodeTracerを提案する。
CodeTracerは、永続的なメモリを持つ階層的なトレースツリーとして、完全な状態遷移履歴を再構築する。
障害発生元とその下流チェーンを特定するために、障害オンセットのローカライゼーションを実行する。
論文 参考訳(メタデータ) (2026-04-13T15:52:03Z) - Springdrift: An Auditable Persistent Runtime for LLM Agents with Case-Based Memory, Normative Safety, and Ambient Self-Perception [0.20305676256390928]
本稿では、長期LLMエージェントの永続ランタイムであるSpringdriftを紹介する。
我々は,このカテゴリに人工リテーナという用語を導入する。
これは、システム設計とデプロイメントのケーススタディに関する技術的なレポートであり、ベンチマークによる評価ではない。
論文 参考訳(メタデータ) (2026-04-06T13:14:37Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。