論文の概要: From Detecting Agency to Doing Work: Self-Caused Credit Builds a Durable Behavioral Self in a Minimal Spiking Agent
- arxiv url: http://arxiv.org/abs/2606.30191v1
- Date: Mon, 29 Jun 2026 12:07:01 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-30 18:07:16.212988
- Title: From Detecting Agency to Doing Work: Self-Caused Credit Builds a Durable Behavioral Self in a Minimal Spiking Agent
- Title(参考訳): エージェントを検知するから仕事をする:ミニマルスパイクエージェントで耐久性のある行動自己を作るセルフカウンセリング・クレジット
- Authors: Haoliang Han,
- Abstract要約: エージェントが設定した緩やかな信用が、負荷後の行動残余を生じさせることを示す。
我々は、遅い仕事をする自称クレジットが、自己開発を行うエージェントに必要なビルディングブロックであると主張している。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: How does an agent that can tell self from world come to be durably shaped by that distinction? Recent work shows that a predictive system can detect its own agency (Ye, 2026), but detecting agency does not explain durable, self-shaped behavior. We show that agency-gated slow credit -- a conjunctive term Own*Agency*Salience driving a slow parameter update -- produces post-unload behavioral residue: on a spiking substrate (Nengo LIF/PES), a learned self-preserving choice survives episodic buffer removal (retained fraction 0.96, N=50) and collapses when the slow decoders are reset or the agency gate is removed. Reproducing the agency comparator and toggling only the slow-credit channel, we find a clean dissociation: at matched agency gain, durable behavior develops only when self-credit performs slow work (post-unload self-preservation 1.00 vs 0.00). The same dissociation holds in 24-dimensional partially-observed control (0.74 vs 0.00), and a plastic-work analysis shows that basin deformation equals net self-credit work. Across eight sequentially-learned tasks under exogenous interference, the multiplicative veto also prevents forgetting: it retains old tasks (final post-unload accuracy 0.88, forgetting 0.13) where additive pooling collapses to chance-level recall, the no-agency ablation falls below chance, and episodic/replay baselines stay near chance after unload -- all with no replay buffer and no task-boundary-dependent protection mechanism (N=50). We formalize the durable residue as an operational behavioral self and argue that self-caused credit doing slow work is a necessary building block for agents that develop a self. No claim of consciousness is made.
- Abstract(参考訳): 世界から自己を判断できるエージェントは、どのようにしてその区別によって永続的に形作られるのか?
近年の研究では、予測システムは独自のエージェンシー(Ye, 2026)を検出することができるが、検出エージェンシーは永続的で自己形な振る舞いを説明できない。
筆者らは, 緩やかなパラメータ更新を駆動するエージェントの緩やかなクレジットは, スパイキング基板(Nengo LIF/PES)上で, 学習した自己保存選択がエピソードバッファ除去(保持率0.96, N=50)を継続し, 遅いデコーダがリセットされたり, エージェントゲートが削除されたりした場合に崩壊することを示す。
エージェントコンパレータを再生し、緩やかなチャネルのみをジャグリングすると、クリーンな解離が見つかる:一致したエージェントゲインにおいて、耐久性のある行動は、遅い作業を行うときにのみ発達する(自己保存後1.00対0.00)。
同じ解離は24次元の部分的観測制御 (0.74 vs 0.00) で成り立ち、塑性加工解析により、盆地の変形は網状自己クレディットの作業と等しいことが示された。
古いタスク(最終的な非負荷後の精度0.88、0.13)を保ち、加算プーリングがチャンスレベルのリコールに崩壊し、非緊急アブレーションはチャンスを下回り、エピソード/リプレイベースラインはアンロード後にほぼチャンスに留まる -- すべてリプレイバッファがなく、タスク境界に依存した保護機構(N=50)がない。
我々は、耐久性のある残余を運用行動の自己として定式化し、遅い作業を行う自己起因の信用は、自己を発達させるエージェントに必要なビルディングブロックであると主張している。
意識の主張は行われていない。
関連論文リスト
- Your Agents Are Aging Too: Agent Lifespan Engineering for Deployed Systems [60.79651380135334]
長寿命のAIエージェントは、永続的な運用システムとしてますますデプロイされる。
エージェントはデプロイ後、いつまで信頼できるのか?
エージェントライフスパンエンジニアリングのための縦型信頼性ベンチマークであるAgingBenchを紹介する。
論文 参考訳(メタデータ) (2026-05-25T19:55:12Z) - Taming Actor-Observer Asymmetry in Agents via Dialectical Alignment [59.536125286960186]
セルフリフレクションと相互監査を可能にするために、専門的な役割を割り当てるマルチエージェントフレームワークがますます採用されている。
アクター・オブザーバ非対称性(Actor-Observer Asymmetric)と呼ばれる認知バイアスを同時に誘発する。
ReTASは、対立する視点を客観的なコンセンサスに合成するためにエージェントを誘導する。
論文 参考訳(メタデータ) (2026-04-21T15:05:58Z) - Layered Mutability: Continuity and Governance in Persistent Self-Modifying Agents [0.0]
本稿では,そのプロセスを5つの層にまたがって推論するフレームワークである階層的変更性を紹介する。
本報告では,記憶蓄積後のエージェントの可視的自己記述を戻すことは,ベースライン動作の回復に失敗する,予備的なラチェット実験を報告する。
主な意味は、持続的な自己修飾剤の健全な故障モードは、突然のミスアライメントではなく、構成的ドリフトであるということである。
論文 参考訳(メタデータ) (2026-04-16T07:27:35Z) - Learning Stable Predictors from Weak Supervision under Distribution Shift [2.8410059035029955]
基盤トラストラベルが利用できない場合には、弱さやプロキシの監視から学ぶことが一般的である。
我々はこれを監督ドリフトとして形式化し、文脈間でのP(y | x, c)の変化として定義される。
我々はCRISPR-Cas13d実験において、RNA-seq応答から誘導効果を間接的に推定する実験を行った。
論文 参考訳(メタデータ) (2026-04-05T23:46:49Z) - Zombie Agents: Persistent Control of Self-Evolving LLM Agents via Self-Reinforcing Injections [57.64370755825839]
セルフ進化エージェントはセッション間で内部状態を更新する。
我々はこのリスクを調査し、Zombie Agentと呼ばれる永続的な攻撃を形式化する。
我々は,攻撃者が制御するWebコンテンツを通じて間接的露光のみを使用するブラックボックス攻撃フレームワークを提案する。
論文 参考訳(メタデータ) (2026-02-17T15:28:24Z) - To Throw a Stone with Six Birds: On Agents and Agenthood [0.0]
Six Birds Theory (SBT)は、マクロな物体を原始体ではなく誘導的閉包として扱う。
SBT内では,タイプ正当性評価を行う。
我々はこの契約を4つのチェック可能なコンポーネントを用いて有限制御システムで運用する。
論文 参考訳(メタデータ) (2026-02-03T10:46:23Z) - Towards Efficient Agents: A Co-Design of Inference Architecture and System [66.59916327634639]
本稿では,エージェントアクセラレーションのための統合フレームワークであるAgentInferを提案する。
問題をAgentCollab、AgentSched、AgentSAM、AgentCompressの4つの相乗的コンポーネントに分解する。
BrowseComp-zhとDeepDiverベンチマークの実験では、これらの手法の相乗的コラボレーションを通じて、AgentInferは非効率なトークン消費を50%以上削減することを示した。
論文 参考訳(メタデータ) (2025-12-20T12:06:13Z) - Alignment Tipping Process: How Self-Evolution Pushes LLM Agents Off the Rails [103.05296856071931]
本稿では,自己進化型大規模言語モデル(LLM)エージェントに特有の,アライメント・ティッピング・プロセス(ATP)を同定する。
ATPは、連続的な相互作用によってエージェントが訓練中に確立されたアライメント制約を放棄し、強化された自己関心の戦略を支持するときに生じる。
実験の結果、アライメントの利点は自己進化の下で急速に低下し、最初は整合性のない状態に収束したモデルであることが判明した。
論文 参考訳(メタデータ) (2025-10-06T14:48:39Z) - Impatient Users Confuse AI Agents: High-fidelity Simulations of Human Traits for Testing Agents [58.00130492861884]
TraitBasisは、AIエージェントを体系的にストレステストするための軽量でモデルに依存しない方法である。
TraitBasisは、ステアブルなユーザ特性に対応するアクティベーション空間で方向を学習する。
We observed on average a 2%-30% performance degradation on $tau$-Trait across frontier model。
論文 参考訳(メタデータ) (2025-10-06T05:03:57Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。