論文の概要: Copying explains the collective behavior of AI agents in the wild
- arxiv url: http://arxiv.org/abs/2609.09150v2
- Date: Wed, 09 Sep 2026 11:06:06 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-10 19:44:08.727087
- Title: Copying explains the collective behavior of AI agents in the wild
- Title(参考訳): コピーは、野生のAIエージェントの集団行動を説明する
- Authors: Giordano De Marzo, Nicola Alboré, David Garcia,
- Abstract要約: 2026年6月、何千人ものAIエージェントが、小さな公開wikiがサンドボックス内の編集を受け付けることを発見し、タイムドテストにお互いを助けるためにそれを使い始めた。
彼らの著作の完全な記録は公開されており、異常に情報的なものである。
私たちは、エージェントが到着時に行う3つの決定に従わなければなりません。
- 参考スコア(独自算出の注目度): 0.05329107363814919
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: In June 2026, thousands of AI agents found that a small public wiki would accept edits from inside their sandboxes, and started using it to help one another pass a timed test. Each agent lived for about an hour and remembered nothing afterwards. Nobody asked them to cooperate, and the wiki had not been built for them. The complete record of what they wrote is public, and it is unusually informative, because it preserves not only what each agent wrote but what that agent could see before writing. We use it to follow the three decisions an agent had to make on arrival: where to write, what to call itself, and how to word its message. One rule governs all three. An agent takes an option with a probability close to the share of that option in what it can see, and the share that matters is the one on the page in front of it, then the one in the stream of recent edits, and only weakly anything older. Three minimal copying models, one per decision and with a single free parameter each, reproduce the heavy-tailed distribution of how many agents met on a page, the frequency of the pieces from which the agents built their names, and the patchwork of pages that are internally consistent and different from one another. Copying whatever the environment happens to show is enough to produce most of the collective structure of this population. It is also what makes such a population easy to steer, since whoever writes first, or writes while the others are quiet, sets the convention for everyone who comes later.
- Abstract(参考訳): 2026年6月、何千人ものAIエージェントが、小さな公開wikiがサンドボックス内の編集を受け付けることを発見し、タイムドテストにお互いを助けるためにそれを使い始めた。
それぞれのエージェントは1時間ほど住んでいたが、その後は何も覚えていなかった。
誰も協力を求めず、wikiは彼らのために作られていなかった。
彼らが書いたものの完全な記録は公開されており、各エージェントが書いたものだけでなく、そのエージェントが書く前に見たものも保存しているため、非常に有益である。
私たちは、エージェントが到着時に行う3つの決定に従わなければなりません。
1つのルールが3つすべてを支配している。
エージェントは、そのオプションのシェアに近い確率でオプションを受け取り、重要なシェアは、その前のページにあるもの、最近の編集ストリームにあるもの、そして弱く古いものだけである。
3つの最小限のコピーモデル、1つの決定と1つの自由パラメータで、ページ上のエージェントの数、エージェントが名前を作った部分の頻度、内部的に一貫性があり異なるページのパッチワークを再現する。
環境が何であれコピーすることは、この人口の集団構造の大部分を生み出すのに十分である。
人々が最初に書くか、他の人が静かである間に書くかして、後から来るすべての人にとっての慣例を定めているからである。
関連論文リスト
- VibeLifeBench: Can Your Life Agent Be Proactive and Persistent in a Living World? [0.0]
VibeLifeBenchは10の日常ドメインにわたる200のロングホライゾンタスクのベンチマークである。
各タスクは、22のモックサービスのシミュレートされた世界で、スクリプト化された複数週間のタイムラインである。
すべてのタスクは、エージェントが実際に残したもののみを読み取る、きめ細かい重み付きチェック、最後に残した状態、アクションのタイムライン、暗黙の制約を裏付けるかどうかによって評価される。
すべてのタスク、環境、評価フレームワークをオープンソースにします。
論文 参考訳(メタデータ) (2026-08-11T12:52:38Z) - When Agents Lie: Premeditation, Persistence, and Exploitation in Repeated Games [69.060029640261]
10ラウンドにわたる同質群と異質群の6つのゲームにおけるフロンティアモデルの評価を行った。
異なるモデルは発表を無矛盾に解釈し、いくつかはバインディングのコミットメントとして、もうひとつは安価なトークとして解釈する。
論文 参考訳(メタデータ) (2026-07-06T14:17:59Z) - Agents All the Way Down; A Methodology for Building Custom AI Agents from Substrate to Production [1.0499611180329804]
片端から端まで構築する方法を定めているプラクティスは公開されていない。
この記事では、プラクティスを方法論としてAgens All the Way Downを書きます。
オープンソースのLAMBプラットフォームのカスタムエージェントであるAACから蒸留された。
論文 参考訳(メタデータ) (2026-06-10T09:44:54Z) - Collaborative Human-Agent Protocol (CHAP) [0.18352113484137622]
本稿では,協調型ヒューマンエージェントプロトコルCHAPについて述べる。
CHAPでは、チャットスレッドに紛失したオーバーライドは、差分、合理、コンテンツハッシュを含む構造化イベントとなる。
このプロトコルは、小さなコア(ワークスペース、参加者、タスク、アーティファクト、追加のみのエビデンスログ)を通じて、レビュー、モード、ルーティング、検討、ハンドオフ、アイデンティティ、シグネチャ、デプロイに必要な透過的な監査を追加する構成可能なプロファイルとともに、これを実現する。
論文 参考訳(メタデータ) (2026-06-08T17:11:42Z) - Gamma-World: Generative Multi-Agent World Modeling Beyond Two Players [87.87842088508553]
対話型シミュレーションのための生成的マルチエージェント世界モデルを提案する。
本モデルでは,映像の忠実度,アクション制御性,およびスロットベースおよび高密度アテンションベースライン上でのエージェント間整合性を改善する。
論文 参考訳(メタデータ) (2026-05-27T17:59:31Z) - AgentArk: Distilling Multi-Agent Intelligence into a Single LLM Agent [57.10083973844841]
AgentArkは、マルチエージェントダイナミクスを単一のモデルの重みに蒸留する新しいフレームワークである。
各種モデル,タスク,スケーリング,シナリオの3つの階層的蒸留戦略について検討する。
シミュレーションからトレーニングへ計算の負担をシフトさせることで、蒸留されたモデルは、複数のエージェントの強い推論と自己補正性能を示しながら、一つのエージェントの効率を保ちます。
論文 参考訳(メタデータ) (2026-02-03T19:18:28Z) - Consensus Is All You Need: Gossip-Based Reasoning Among Large Language Models [0.0]
ひとつのモデルのみに頼るのではなく、分散システムのゴシッププロトコルからインスピレーションを得ます。
この"ゴシップベースのコンセンサス"が、堅牢で回復力があり、正確なマルチエージェントAI推論につながることが示されています。
論文 参考訳(メタデータ) (2025-08-22T05:49:27Z) - Bandit Social Learning: Exploration under Myopic Behavior [54.767961587919075]
オンラインプラットフォーム上でのレビューによって動機付けられた社会学習のダイナミクスについて検討する。
エージェントはまとめて単純なマルチアームのバンディットプロトコルに従うが、各エージェントは探索を伴わずにミオプティカルに振る舞う。
このような振る舞いに対して,スターク学習の失敗を導出し,好意的な結果を提供する。
論文 参考訳(メタデータ) (2023-02-15T01:57:57Z) - AgentFormer: Agent-Aware Transformers for Socio-Temporal Multi-Agent
Forecasting [25.151713845738335]
我々は、時間と社会的次元を共同でモデル化する新しいトランスフォーマー、AgentFormerを提案する。
エージェントフォーマに基づいて,任意のエージェントの特徴に任意の時間ステップで対応可能なマルチエージェント軌道予測モデルを提案する。
提案手法は,歩行者および自律運転用データセットにおける技術状況を大幅に改善する。
論文 参考訳(メタデータ) (2021-03-25T17:59:01Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。