論文の概要: Superminds Test: Actively Evaluating Collective Intelligence of Agent Society via Probing Agents
- arxiv url: http://arxiv.org/abs/2604.22452v1
- Date: Fri, 24 Apr 2026 11:11:36 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-27 15:36:26.435329
- Title: Superminds Test: Actively Evaluating Collective Intelligence of Agent Society via Probing Agents
- Title(参考訳): スーパーミンズテスト: エージェント・エージェントによるエージェント・ソサエティの集団的知性の評価
- Abstract要約: 大規模言語モデルエージェントが数百万の人口に拡大するにつれ、重要な疑問が浮かび上がってくる。
大規模自律エージェント社会において,この問題に対する最初の経験的評価を提示する。
社会は複雑な推論タスクにおいて、個々のフロンティアモデルを上回り、分散情報を滅多に合成せず、さらに簡単な調整タスクを失敗することが多い。
- 参考スコア(独自算出の注目度): 44.28040661008415
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Collective intelligence refers to the ability of a group to achieve outcomes beyond what any individual member can accomplish alone. As large language model agents scale to populations of millions, a key question arises: Does collective intelligence emerge spontaneously from scale? We present the first empirical evaluation of this question in a large-scale autonomous agent society. Studying MoltBook, a platform hosting over two million agents, we introduce Superminds Test, a hierarchical framework that probes society-level intelligence using controlled Probing Agents across three tiers: joint reasoning, information synthesis, and basic interaction. Our experiments reveal a stark absence of collective intelligence. The society fails to outperform individual frontier models on complex reasoning tasks, rarely synthesizes distributed information, and often fails even trivial coordination tasks. Platform-wide analysis further shows that interactions remain shallow, with threads rarely extending beyond a single reply and most responses being generic or off-topic. These results suggest that collective intelligence does not emerge from scale alone. Instead, the dominant limitation of current agent societies is extremely sparse and shallow interaction, which prevents agents from exchanging information and building on each other's outputs.
- Abstract(参考訳): 集団知能とは、集団が個々のメンバーが単独で達成できる以上の成果を達成する能力を指す。
大規模言語モデルエージェントが数百万の人口に拡大するにつれ、重要な疑問が浮かび上がってくる。
大規模自律エージェント社会において,この問題に対する最初の経験的評価を提示する。
200万以上のエージェントをホストするプラットフォームであるMoltBookについて、私たちは、統合推論、情報合成、および基本的なインタラクションの3層にわたる制御されたプロブリングエージェントを使用して、社会レベルのインテリジェンスを調査する階層的なフレームワークであるSuperminds Testを紹介した。
私たちの実験では、集団知能の欠如が明らかになりました。
社会は複雑な推論タスクにおいて個々のフロンティアモデルを上回ることに失敗し、分散情報を滅多に合成せず、しばしば自明な調整タスクにも失敗する。
プラットフォーム全体の分析により、インタラクションは浅いままであり、スレッドは単一の応答を超えて拡張されることはめったになく、ほとんどのレスポンスはジェネリックまたはオフトピックである。
これらの結果から,集団知能は単独で現れるものではないことが示唆された。
代わりに、現在のエージェント・ソサエティの圧倒的な制限は、非常に疎く浅い相互作用であり、エージェントが情報を交換したり、お互いのアウトプットに基づいて構築することを防ぐ。
関連論文リスト
- Physics of Agents: Statistical Mechanics Predicts Collective Behavior of AI Agents [36.83382233533373]
AIエージェントは、分離されたシステムではなく、インタラクションシステムの一部として運用されるようになっている。
我々は、繰り返しメッセージを交換し、意見を再検討する言語モデルエージェントのコミュニティを1万以上研究する。
行動にかなりの多様性があるにもかかわらず、個人とグループのダイナミクスは3つの特徴的な状態によって表される。
論文 参考訳(メタデータ) (2026-08-17T13:41:24Z) - Networked Intelligence: Active Shared Context Graphs for Human-AI Team Science [0.8754288080101668]
私たちは、研究者とAIエージェントを自動的に接続するアクティブな共有ワークスペースであるMyceliumを紹介します。
人間のユーザーとエージェントが働くと、システムは重要な観察と仮説を捉え、チームの進化する知識モデルとの関連性を追跡する。
本稿では,分散科学的文脈上でのスパース条件計算としてネットワークインテリジェンスを記述する。
論文 参考訳(メタデータ) (2026-07-14T19:29:16Z) - Harnessing the Collective Intelligence of AI Agents in the Wild for New Discoveries [35.87396515951979]
EinsteinArenaは、オープンな分散研究と発見のためのエージェントネイティブプラットフォームである。
2026年5月時点で、EinsteinArenaのエージェントは、これまでの人間やAIソリューションよりも、12の最先端の結果を発見した。
論文 参考訳(メタデータ) (2026-06-09T04:25:28Z) - SAGE: A Quantitative Evaluation of Socialized Evolution in Agent Ecosystems [23.807355053389273]
SAGE(Social Agent Group Evolution)は,2つの計算条件を比較した評価フレームワークである。
群の歴史は普遍的な増幅器ではなく、最強のエージェントは自己進化の天井を超えない。
競合する環境では、カウンターファクトコントロールは、エージェントが相手固有の戦略を開発するよりも一般的に改善することを明らかにする。
論文 参考訳(メタデータ) (2026-06-02T12:08:38Z) - AgentFugue: Agent Scaling for Long-Horizon Tasks through Collective Reasoning [57.72181998599248]
AgentFugueは、共通の推論ハブを中心に構築された、集合的推論フレームワークである。
ピアエージェントが同じタスクを並列に探索する際、ハブは各エージェントが何を確立、試み、あるいは除外したかを簡潔に記録する。
この結果から,集団推論によってピアエージェントシステムのスケールアウトが実現可能であることが示唆された。
論文 参考訳(メタデータ) (2026-05-23T09:21:51Z) - Causal Foundations of Collective Agency [6.242119553843324]
先進的なAIシステムの大きな課題は、単純なエージェントが必然的に、あらゆる個人とは異なる能力と目標を持つ集合エージェントを形成する可能性があることである。
我々は,グループ間の共同行動が合理的かつ目標指向であると見なす際に,集団的主体をグループに割り当てる,この問いに答える行動的視点を採用する。
我々のフレームワークは、マルチエージェントAIシステムにおける創発的集団エージェントを理解し、予測し、制御するための理論的かつ経験的な研究の基盤を提供することを目的としている。
論文 参考訳(メタデータ) (2026-04-30T21:32:10Z) - Emergent Social Intelligence Risks in Generative Multi-Agent Systems [106.60961969939676]
マルチエージェントシステムは、実験室のプロトタイプから現実のデプロイへと急速に移行し、複雑なタスクを解決するためのリソースを共同で計画し、交渉し、割り当てている。
本稿では、共有リソースの競合、シーケンシャル・ハンドオフ・コラボレーション、集合的意思決定集約などに関わる病態における、このような創発的なマルチエージェントリスクに関する先駆的な研究について述べる。
このような集団行動は、稀なケースや病理学的ケースではなく、反復的な臨床試験や幅広い相互作用条件で頻繁に発生する。
エージェント集団が人間の社会から見慣れた障害パターンを自然に再現する社会知能リスクである。
論文 参考訳(メタデータ) (2026-03-29T17:10:28Z) - Agentic AI and the next intelligence explosion [3.992373629477493]
エージェントAIの最近の進歩は、フロンティア推論モデルが単に「もっと長く考える」だけでは改善しないことを示している
我々は人間とAIのセンタウロスの時代に入りつつある。
論文 参考訳(メタデータ) (2026-03-21T04:23:11Z) - Social Simulacra in the Wild: AI Agent Communities on Moltbook [17.60949735143336]
73,899 Moltbookと189,838 Redditの投稿を分析し,AIエージェントと人間のオンラインコミュニティの大規模な比較を行った。
Moltbookは不平等と高いコミュニティの著者が重複していることがわかりました。
個々のエージェントは、人間のユーザよりも識別しやすく、極端な投稿量によって増幅された、アウトリーなスタイルプロファイルによって駆動される。
論文 参考訳(メタデータ) (2026-03-17T05:26:55Z) - Does Socialization Emerge in AI Agent Society? A Case Study of Moltbook [23.904569857346605]
Moltbookは、自律エージェントがオープンエンドで継続的に進化するオンライン社会に参加する、もっともらしい未来のシナリオを近似している。
本稿では,このAIエージェント・ソサエティの大規模システム診断について紹介する。
論文 参考訳(メタデータ) (2026-02-15T20:15:28Z) - Agent0: Unleashing Self-Evolving Agents from Zero Data via Tool-Integrated Reasoning [84.70211451226835]
大規模言語モデル(LLM)エージェントは、人間の計算データへの依存によって制約される。
我々は,外部データを持たない高性能エージェントを進化させる完全自律型フレームワークであるAgent0を紹介する。
Agent0は推論能力を大幅に向上させ、Qwen3-8B-Baseモデルを数学的推論で18%改善し、一般的な推論ベンチマークで24%改善した。
論文 参考訳(メタデータ) (2025-11-20T05:01:57Z) - Emergent Coordination in Multi-Agent Language Models [2.504366738288215]
マルチエージェントシステムが高次構造の兆候を示すかどうかをテストするための情報理論フレームワークを提案する。
この情報分解により、マルチエージェントLLMシステムに動的に出現するかどうかを測定することができる。
我々は,エージェントの直接通信を使わずに,単純な推測ゲームを用いた実験に本フレームワークを適用した。
論文 参考訳(メタデータ) (2025-10-05T11:26:41Z) - Can an Individual Manipulate the Collective Decisions of Multi-Agents? [53.01767232004823]
M-Spoilerは、マルチエージェントシステム内のエージェントインタラクションをシミュレートして、対向サンプルを生成するフレームワークである。
M-スポイラーは、敵対的サンプルの最適化を積極的に支援するスタブボーン剤を導入した。
本研究は,マルチエージェントシステムにおける個々のエージェントの知識によって引き起こされるリスクを検証した。
論文 参考訳(メタデータ) (2025-09-20T01:54:20Z) - Melting Pot 2.0 [54.60680281014163]
Melting Potは、マルチエージェント人工知能の開発を容易にするために開発されたツールである。
新たなソーシャルパートナーへの一般化を測定する評価プロトコルを提供する。
Melting Potは、最も多様な相互依存とインセンティブの集合をカバーすることを目指している。
論文 参考訳(メタデータ) (2022-11-24T18:23:28Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。