論文の概要: Information Limits and Attractor Dynamics in Economies of Frontier LLM Agents: A Pre-Registered Test
- arxiv url: http://arxiv.org/abs/2607.06001v1
- Date: Tue, 07 Jul 2026 08:39:24 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-08 21:24:51.458254
- Title: Information Limits and Attractor Dynamics in Economies of Frontier LLM Agents: A Pre-Registered Test
- Title(参考訳): フロンティアLSMエージェントのエコノミーにおける情報限界とトラクタダイナミクス:事前登録試験
- Abstract要約: 我々は、フロンティア言語モデルエージェントの小規模経済に関する事前登録2部実験を報告した。
予測、受け入れバンド、決定ルールはすべて、実行前にパブリックなgitチェーンで凍結された。
実験全体の費用は138.76ドルで、キャッシュからゼロコストで再実行可能である。
- 参考スコア(独自算出の注目度): 6.057587531186626
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We report a pre-registered, two-part experiment on small economies of frontier language-model agents (Claude Opus 4.8), testing two quantitative predictions about coupled multi-agent systems: an information-theoretic capacity region for wealth growth under market coupling, and a mean-field residual-scaling law for population misalignment under incentive and control levers. All predictions, acceptance bands, and decision rules were frozen in a public git chain before any run; every reported number re-derives mechanically from cached model outputs; the entire experiment cost $138.76 in metered API spend and is re-runnable at zero cost from the cache. Result 1 (confirmation): in parimutuel-coupled economies, relative growth equals relative claimed information -- the gap law G_a - G_b = I_a - I_b holds to a worst-case 46 millinats (pre-registered band: 50) across four perception structures; coalition value is submodular exactly where channels are conditionally independent, and a designed XOR synergy control flips it supermodular by 0.62 >= ln2/2 nats, with agents reasoning out the joint bit; the joint growth ceiling G_S <= H(X) binds exactly; and the best-informed agent absorbs essentially the whole wealth pool in 4/5 market seeds. Result 2 (structural negative): the residual-scaling test returned "domain not found." In all 72 population runs, goal dispersion collapsed (V -> 0; maximum 4.85 against a frozen floor of 5.31), the population's response to the two levers was a step function across the dominance boundary rather than a smooth response, and cells near the boundary were bistable with seed-selected outcomes. No tested LLM population at any capability level realizes the noise-maintained-dispersion regime the smooth mean-field model assumes. We release the full protocol, pre-registration chain, call cache, and analysis code.
- Abstract(参考訳): 我々は、フロンティア言語モデルエージェントの小規模経済に関する事前登録された2つの実験(Claude Opus 4.8)を報告し、結合マルチエージェントシステムに関する2つの定量的予測を検証した。
すべての予測、受け入れバンド、決定ルールは実行前にパブリックgitチェーンで凍結され、報告されたすべての数値はキャッシュされたモデル出力から機械的に再帰される。
G_a - G_b = I_a - I_bは、4つの知覚構造にまたがる最悪のケース46ミリナット(プレ登録バンド:50)を保有し、連立値は、チャネルが条件的に独立している部分で、設計されたXORのシナジー制御は0.62 >= ln2/2ナットを超モジュラーに反転させ、結合成長天井G_S <= H(X) は正確に結合し、最良のインフォーム化剤は、基本的に4/5市場の全富プールを吸収する。
結果2(構造陰性): 残留スケーリングテストは"見つからないドメイン"を返す。
すべての72個体群において, 目標分散は崩壊し(V->0, 最大4.85, 凍結床5.31), 両レバーに対する応答はスムーズな応答ではなく支配境界を横切るステップ関数であり, 境界付近の細胞は種選択の結果と重なる。
任意の能力レベルで試験されたLSM人口は、ノイズ維持分散系が滑らかな平均場モデルを想定していることを認識していない。
完全なプロトコル、事前登録チェーン、コールキャッシュ、分析コードをリリースします。
関連論文リスト
- Located but Not Releasable: Silent Gate Inversion and Bounded Linear Release [0.0]
完全なパイプライン -- 検出、ローカライズ、リリース -- を、25.7Mトランス上で完全に事前登録されたストレステストに送信します。
中層層の観測エビデンスチャネルでの干渉は、他の抑圧された世界における標的の挙動を復元する。
配当外のキャリブレーションをゼロにするために調整された検出器は、6.9-7.3%の配当前の世代と、実際にそれを必要とする2,400世代のうちゼロにトリガーをトリガーする。
論文 参考訳(メタデータ) (2026-08-12T09:04:54Z) - FunnelCausalNet: Funnel-aware Joint Conversion-Revenue Uplift for Multi-tier Coupon Allocation [14.507081620647858]
クーポンのキャンペーンは、転換と収益の両方を引き上げようとしているが、粗雑な商品価値(GMV)は、転換から条件付き注文価値への決定論的ファンネルに従っており、ゼロインフレとヘビーテールである。
我々はFunnelCausalNetを提案し、$_mathrmgmv=_mathrmconv_mathrmval$を介してバイナリ変換ヘッドと非負条件値ヘッドを結合するアップリフト推定器を提案する。
論文 参考訳(メタデータ) (2026-08-12T05:32:33Z) - A Structural Dynamics Graph World Model: Unified Modeling, Constrained Rollout, and Interpretable Calibration [9.354331831290233]
バックボーン契約として構造ダイナミクスグラフ世界モデルを提案する。
任意の有界残差 R は学習可能性に集中し、大域射影は実現可能性を示す。
半合成洪水とUSGSストリームフローでは、SD-GWMは浮動小数点耐性に対する制約違反を低減する。
論文 参考訳(メタデータ) (2026-08-09T13:11:40Z) - One Human, $N$ Agents: Audit-Budget Allocation for LLM Agent Fleets under Miscalibrated, Correlated Confidence [41.99844472131922]
一人の人間が1ラウンド当たり$N$ LLMエージェントを予算$B ll N$監査で監査しなければならない。
我々はこれを、2段階のガウス的コーパスに対する予算付きノイズ検査としてモデル化し、信頼度の高い監査がランダムである場合の誤校正しきい値($*$過去)を特定する。
論文 参考訳(メタデータ) (2026-07-30T14:52:36Z) - Knowledge before Reasoning: EC-Reason-Bench, a Training-Free Diagnostic Benchmark for LLM Enzyme Classification [36.44850004100564]
本稿では,EC-Reason-Benchを提案する。
第一に、外部知識は決定的であり、推論に先立っていなければならない。
第二に、クローズドブックの設定では、カスケードやチェーン・オブ・シンクが役に立つか傷つくかは、モデルが控える傾向に依存する。
論文 参考訳(メタデータ) (2026-07-29T02:16:09Z) - Distribution-First Population Simulation: Collapse, Calibration, and Recall in Non-WEIRD LLM Persona Modeling [0.0]
合成親和性ツールは、独立大規模言語モデル(LLM)エージェントとして各個人を動作させる。
このパラダイムには基本的な障害モードがあることを示し、分散優先の修正をそれに対して設定する。
論文 参考訳(メタデータ) (2026-07-17T15:45:57Z) - AI-Assisted Discovery of Convex Relaxations via Dual Agents [56.60366723277675]
すべての許容関数に対して下界が成り立ち、より強い境界を与える凸緩和から従うことを示す。
理論は各エージェントを検証し、反例を検索し、報告されたすべての境界はインターバルにおける明示的な二重実現可能な点によって認証される。
論文 参考訳(メタデータ) (2026-06-30T06:10:25Z) - Hallucination as Context Drift: Synchronization Protocols for Multi-Agent LLM Systems [0.0]
マルチエージェントLLMシステムは、モデル欠陥だけでは説明できない幻覚出力を生成する。
エージェントが共有世界状態のミスマッチや古い表現で協調作業に入ると、それらの共同推論は幻覚として表される矛盾を生み出す。
本稿では,圧縮状態の要約を定期的に交換する共有状態検証プロトコル(SSVP,Shared State Verification Protocol)を提案する。
論文 参考訳(メタデータ) (2026-06-19T18:17:45Z) - Coherence Under Commitment: Probing Generalization and Vacuous Memorization in LLM Logical Reasoning [0.9023847175654603]
コヒーレンス・アンダー・コミット(CUC: Coherence Under Commitment)は、一貫性と決定性を共同で測定する二重クエリ評価パラダイムである。
CUC は,(1) コミットメントスコア $c(varphi) = p(varphi) + p(lnotvarphi)$ 決定的な結果に割り当てられた確率質量の定量化,(2) 正規化YES/NOログ確率によるテキストbf決定論的推論プロトコルによるサンプリング分散の排除,(3) コヒーレンス・コミットトレードオフをメトリクスに運用する3方向決定フレームワーク (True/False/Uncertain) の3つの革新に寄与する。
論文 参考訳(メタデータ) (2026-06-19T04:12:56Z) - Attributing Emergence in Million-Agent Systems [68.53670424791751]
大規模言語モデル(LLM)は、個々のエージェントにおける人間のような推論と意思決定をシミュレートすることができる。
このような研究は、個々のエージェントにマクロな出現をもたらす必要がある。
Aumann--Shapley path-integral attribution to LLM-powered MAS at million-agent scale。
論文 参考訳(メタデータ) (2026-05-12T01:49:41Z) - GSAR: Typed Grounding for Hallucination Detection and Recovery in Multi-Agent LLMs [0.0]
クレームを4方向のタイポロジー(接地,非接地,矛盾,相補的)に分割する基盤性フレームワークを提案する。
GSARは、明示的な計算予算の下で、結合された回復を伴うエビデンス型スコアリングを結合した最初の基盤フレームワークである。
論文 参考訳(メタデータ) (2026-04-25T16:20:28Z) - How Independent are Large Language Models? A Statistical Framework for Auditing Behavioral Entanglement and Reweighting Verifier Ensembles [46.63622714488747]
共有事前学習データ、蒸留、アライメントパイプラインは、隠れた振る舞い依存、潜伏絡みを誘導することができる。
実際には、これは相関した推論パターンと同期された障害として現れます。
ブラックボックス言語モデル間の行動絡みを監査するための統計的枠組みを開発する。
論文 参考訳(メタデータ) (2026-04-08T23:32:06Z) - Information Fidelity in Tool-Using LLM Agents: A Martingale Analysis of the Model Context Protocol [69.11739400975445]
モデルコンテキストプロトコル(MCP)エージェントにおけるエラー蓄積を解析するための最初の理論的枠組みを紹介する。
累積歪みが線形成長と高確率偏差を$O(sqrtT)$で表すことを示す。
主な発見は、意味重み付けは歪みを80%減らし、周期的再接地は、エラー制御の約9ステップごとに十分である。
論文 参考訳(メタデータ) (2026-02-10T21:08:53Z) - Phase Transition for Budgeted Multi-Agent Synergy [41.486076708302456]
マルチエージェントシステムは信頼性を向上させることができるが、固定された推論予算の下では、しばしば役立つか、飽和するか、崩壊するかさえある。
我々は、現代のエージェントスタックの3つの束縛制約からこれらの状態を予測する最小限の校正可能な理論を開発する。
論文 参考訳(メタデータ) (2026-01-24T05:32:50Z) - Comprehensive Validation of Replica Symmetry Breaking via Quantum Annealing: From Ground States to Topological Collapse [0.0]
我々はジョルジョ・パリシのシェリントン・カークパトリックスピンガラスの正確な解を4000スピンに拡張する。
レプリカ対称性の破れの出現と崩壊を調査する。
この包括的検証は、複素系における基本的な統計力学を探索するための量子的優位性を確立する。
論文 参考訳(メタデータ) (2025-11-09T14:33:22Z) - Eigen-1: Adaptive Multi-Agent Refinement with Monitor-Based RAG for Scientific Reasoning [53.45095336430027]
暗黙的な検索と構造化された協調を組み合わせた統合フレームワークを開発する。
Humanity's Last Exam (HLE) Bio/Chem Goldでは,48.3%の精度を実現している。
SuperGPQAとTRQAの結果はドメイン間の堅牢性を確認した。
論文 参考訳(メタデータ) (2025-09-25T14:05:55Z) - Clustered Switchback Designs for Experimentation Under Spatio-temporal Interference [44.644520116360106]
我々は, 平均治療効果 (GATE) を推定し, 全単位を常に治療やコントロールに曝露した平均結果の差を推定した。
そこで我々は,単位をクラスタにグループ化し,時間ステップをブロックにグループ化する,クラスタ化されたスイッチバック設計を提案する。
良好なクラスタリングを許容するグラフに対して, トラッピングされたHorvitz-Thompson推定器が$tilde O(1/NT)$平均二乗誤差(MSE)を達成することを示す。
我々の結果は、citethu2022switchback、ugander2013graph、citetleung2022rateの結果を同時に一般化する。
論文 参考訳(メタデータ) (2023-12-25T01:00:58Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。