論文の概要: AutoPersonas: A Multi-Timescale Loop Engine for Open-Ended Persona Evolution
- arxiv url: http://arxiv.org/abs/2607.08252v1
- Date: Thu, 09 Jul 2026 08:56:30 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-10 14:45:27.475592
- Title: AutoPersonas: A Multi-Timescale Loop Engine for Open-Ended Persona Evolution
- Title(参考訳): AutoPersonas: オープンなペルソナ進化のためのマルチタイムループエンジン
- Abstract要約: 長期的なペルソナエージェントは、新しい出来事、関係性、証拠、社会的条件に適応しながら、識別できなければならない。
我々は、自己ロックを、継続するペルソナライフループにおける実行時障害モードとして認識する。
本稿では,人格レベルの自己進化のための生命環境エンジンであるAutoPersonasを紹介する。
- 参考スコア(独自算出の注目度): 1.607532703630949
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Long-term persona agents must remain identifiable while adapting to new events, relationships, evidence, and social conditions. We identify self-locking as a runtime failure mode in continuing persona-life loops: locally plausible events keep appearing while the generated life collapses toward familiar environments, weak relationships, suspended decisions, and stale life stages. We trace this failure to model-level convergence toward high-probability behavioral channels and system-level context gravity from State, memory, history, and environment summaries. We introduce AutoPersonas, a multi-timescale life-environment engine for bounded persona-level recursive self-evolution. It separates environment-side Occurrences, accumulated Observations, and persona State. Its OSO loop admits divergent future-facing material while requiring evidence-governed absorption before State or reachability changes. A three-year compressed simulation exposed environment watermark shells, occurrence-hardening gaps, slow-change accumulation failures, recursive indecision, and weak relationship persistence. An eight-model 40-day stress test generated 1,600 events and found mean rolling 5-day action-category repetition of 95.2%-97.6%, with all models crossing 90% by day 11. Semantic re-keeping found 79.0%-88.0% macro-theme repetition across all direct-loop runs. In a same-runtime 40-day A/B, context-slice masking plus per-sample divergence targeting reduced macro-theme repetition from 61.8% to 36.3% and roughly doubled cumulative theme count. A juvenile-goblin fictional-world run reproduced the anti-fixation regime without hard real-world intrusions. These results support a bounded claim: separating controlled divergence from evidence-governed absorption can reduce persona-environment self-locking while preserving identity continuity.
- Abstract(参考訳): 長期的なペルソナエージェントは、新しい出来事、関係性、証拠、社会的条件に適応しながら、識別できなければならない。
我々は、自己ロックを、継続するペルソナライフループにおける実行時障害モードとして認識する: 生成した生命が慣れ親しんだ環境に向かって崩壊する間、局所的確固たる事象が出現し続け、関係が弱く、決定が停止し、生活段階が停滞する。
この失敗は、高確率な行動チャネルへのモデルレベルの収束と、状態、記憶、歴史、環境の要約からシステムレベルのコンテキスト重力に遡る。
本稿では,人格レベルの再帰的自己進化のためのマルチタイムライフ環境エンジンであるAutoPersonasを紹介する。
環境サイドのOccurrences、蓄積された観測、ペルソナステートを分離する。
そのOSOループは、状態や到達可能性の変化の前にエビデンスに支配された吸収を必要としながら、先進的な物質を許容する。
3年間の圧縮シミュレーションにより, 環境用透かし貝殻, 発生硬化ギャップ, 緩やかな蓄積障害, 再帰的不確定性, 弱関係持続性が明らかになった。
8日間の40日間のストレステストでは1,600件のイベントが発生し、5日間のアクションカテゴリーの繰り返しは95.2%-97.6%となり、全モデルが11日目までに90%を超えた。
セマンティックは79.0%-88.0%のマクロテーマを全ての直接ループで繰り返した。
同じ40日間のA/Bでは、コンテキストスライスマスキングとサンプルごとのばらつきにより、マクロテーマの反復が61.8%から36.3%に減少し、累積テーマ数が約2倍になった。
少年ゴブリンの架空の世界は、厳格な現実世界の侵入なしに反固定体制を再現した。
これらの結果は、制御された多様性をエビデンスに支配された吸収から分離することで、アイデンティティの連続性を保ちながらペルソナ環境の自己ロックを減らすことができる、という有界な主張を支持する。
関連論文リスト
- ReactiveBFM: Reactive Closed-Loop Motion Planning Towards Universal Humanoid Whole-Body Control [54.267632784131415]
ReactiveBFMは、ヒューマノイドのためのリアルタイムループ計画制御フレームワークである。
定期的なプレフィックスサンプリングカリキュラムを通じて、致命的な累積露光バイアスを軽減する。
これは、テキスト条件付きクローズドループ運動の膨大なレパートリーにおいて、前例のない物理的機敏さを示す。
論文 参考訳(メタデータ) (2026-06-29T14:27:27Z) - Unleashing Infinite Motion: Scaling Expressive Quadrupedal Motion via Generative Video Priors [16.885943699439377]
私たちは、アクロバティックな動作とパフォーマンス的な動作にまたがる7,488個の四足歩行のオープンソースデータセットであるQuad-Imaginariumをリリースした。
生成問題として対応するデータをフレーミングすることで、動物をループから除去する、完全に自動化されたパイプラインであるUni-Moをリリースする。
実Unitree Go2上の392個のランダムサンプリング動作を96.7%の成功率で検証し,97.6%の成功率で補完した。
論文 参考訳(メタデータ) (2026-06-26T16:23:40Z) - FailureScope: Cross-Regime Behavioral Diagnosis of Language Model Weaknesses [0.0]
FailureScopeは、クロスモデルパス/フェイルパターンによる評価プローブをクラスタ化する行動診断手法である。
通常、シングルターン・ベンチマーク、マルチターン・ダイアログ、敵エージェント・アタックの3つのレシスタンスに対して安定かつ解釈可能な障害をもたらすことを示す。
論文 参考訳(メタデータ) (2026-06-03T01:28:00Z) - Agent-BRACE: Decoupling Beliefs from Actions in Long-Horizon Tasks via Verbalized State Uncertainty [70.43119366710778]
本稿では,Agens-BRACE: Agent Belief state Representation by Abstraction and Confidence Estimationを紹介する。
LLMエージェントを信頼状態モデルと政策モデルに分離し、強化学習を通じて協調的に最適化する手法である。
長期にわたる部分的に観察可能な言語環境において、平均して+14.5%の絶対的な改善を実現している。
論文 参考訳(メタデータ) (2026-05-12T02:37:04Z) - Perturbation Dose Responses in Recursive LLM Loops: Raw Switching, Stochastic Floors, and Persistent Escape under Append, Replace, and Dialog Updates [0.0]
我々は、他のどこかで落ち着いたループを動かすのに、注入されたテキストがどれだけ必要か、そしてそれが継続するかどうかを調査する。
12,000文字の尾クリップの下では、目的地とコヒーレントな持続性台地が16%近く、ソースとバスンの脱出は36%近くで400。
4段階のファルシフィケーション・バッテリは、高線量のデスティネーションコヒーレントディップを有限水平、エンドポイント定義感度の特徴として再キャストする。
論文 参考訳(メタデータ) (2026-05-04T05:16:43Z) - RecoverFormer: End-to-End Contact-Aware Recovery for Humanoid Robots [5.584060970507507]
完全エンドツーエンドのヒューマノイド回復ポリシーであるRECOVERFORMERを提案する。
回復行動の中で、いつ、どのように切り替えるかを学ぶ。
このアーキテクチャは、50ステップの観測履歴に2つの新しい頭を持つ因果変換器を組み合わせたものである。
論文 参考訳(メタデータ) (2026-04-24T17:52:06Z) - Towards Real-world Human Behavior Simulation: Benchmarking Large Language Models on Long-horizon, Cross-scenario, Heterogeneous Behavior Traces [81.41397370235102]
我々はOmniBehaviorを紹介した。OmniBehaviorは実世界のデータから構築された最初のユーザシミュレーションベンチマークである。
現在のモデルでは,コンテキストウィンドウが拡大しても,複雑な振る舞いを正確にシミュレートすることが困難であることを示す。
この結果、個人差や長い尾の挙動が失われ、将来の高忠実度シミュレーション研究における重要な方向性が浮き彫りになる。
論文 参考訳(メタデータ) (2026-04-09T15:26:21Z) - Evaluation as Evolution: Transforming Adversarial Diffusion into Closed-Loop Curricula for Autonomous Vehicles [43.930171390617055]
本研究では,敵対的生成を適応的な進化カリキュラムに変換するクローズドループフレームワークであるAccess as Evolution(E2$)を紹介する。
我々は、トポロジ駆動型サポート選択を利用して重要な相互作用エージェントを特定し、トポロジカルアンチョリングを導入し、プロセスの安定化を図る。
実験的に、$E2$はnuScenesデータセットで9.01%、nuPlanデータセットで最大21.43%の衝突故障発見を改善する。
論文 参考訳(メタデータ) (2026-04-08T01:34:05Z) - Optimization-Guided Diffusion for Interactive Scene Generation [52.23368750264419]
本稿では,拡散型サンプリングにおける構造的一貫性と相互作用認識を実現するための,最適化誘導型トレーニングフリーフレームワークであるOMEGAを提案する。
OMEGAは生成リアリズム,一貫性,可制御性を向上し,身体的および行動学的に有効なシーンの比率を増大させることを示す。
当社のアプローチでは,3秒未満の時間対コリションで,より近いコリジョンフレームを5ドル(約5,500円)で生成することも可能だ。
論文 参考訳(メタデータ) (2025-12-08T15:56:18Z) - Drift No More? Context Equilibria in Multi-Turn LLM Interactions [58.69551510148673]
コンテキストドリフト(Contexts drift)とは、ターン間のゴール一貫性のある振る舞いからモデルが出力する出力の段階的なばらつきである。
シングルターンエラーとは異なり、ドリフトは時間的に展開し、静的な評価指標では捉えにくい。
マルチターンドリフトは、避けられない崩壊というよりも、制御可能な平衡現象として理解できることを示す。
論文 参考訳(メタデータ) (2025-10-09T04:48:49Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。