論文の概要: Cogentic: Multi-Agent Orchestration for Automated Proof Discovery
- arxiv url: http://arxiv.org/abs/2609.40324v2
- Date: Thu, 01 Oct 2026 21:13:54 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-06 00:14:29.977418
- Title: Cogentic: Multi-Agent Orchestration for Automated Proof Discovery
- Title(参考訳): Cogentic: 自動証明のためのマルチエージェントオーケストレーション
- Abstract要約: Cogenticは、オープンな研究問題に対する自動証明発見のためのマルチエージェントハーネスである。
オンライン学習、オークション理論、メカニズム設計にまたがるオープンな問題に関する新しい結果を生み出す。
- 参考スコア(独自算出の注目度): 20.721552392409013
- License: http://creativecommons.org/licenses/by-nc-sa/4.0/
- Abstract: We present Cogentic, a multi-agent harness for automated proof discovery on open research problems. While frontier language models can generate strong mathematical ideas in a single shot, single-shot generation is often insufficient for open problems that require exploring multiple competing conjectures, overcoming subtle technical obstructions, and retaining intermediate progress over a long horizon. Cogentic addresses these challenges through an iterative prove-verify loop in which an orchestrator allocates a population of independent provers across distinct proof directions, subjects their output to adversarial verification by several specialized components, and promotes confirmed intermediate results into a persistent verified ledger that later rounds build on. The harness is designed to be able to solve research-level math and theoretical computer science problems. Using either Gemini 3.1 Pro or an early version of Gemini 4 Argon as the base model, Cogentic produced novel results on open problems across online learning, auction theory, and mechanism design. Each result was independently verified by domain experts and is developed in full in companion papers. We list these results, and new ones as they are verified, at https://sites.google.com/view/cogentic .
- Abstract(参考訳): オープンな研究課題に対する自動証明発見のためのマルチエージェントハーネスであるCogenticを提案する。
フロンティア言語モデルは単一のショットで強力な数学的アイデアを生成することができるが、単一ショット生成は、複数の競合する予想を探索し、微妙な技術的な障害を克服し、長い地平線上で中間的な進歩を維持することを必要とするオープンな問題に対して不十分であることが多い。
コージェンティックはこれらの課題に、オーケストレータが個別の証明方向を越えて独立したプロバーの集団を割り当て、その出力をいくつかの特定のコンポーネントによる敵対的検証の対象とし、検証された中間結果を、後続のラウンドで構築された永続的な検証された台帳へと促進する反復的証明検証ループを通じて対処する。
このハーネスは、研究レベルの数学と理論的コンピュータ科学の問題を解決するように設計されている。
Gemini 3.1 Pro または Gemini 4 Argon の初期バージョンをベースモデルとして、Cogentic はオンライン学習、オークション理論、メカニズム設計にまたがるオープンな問題に関する新しい結果を生み出した。
それぞれの結果はドメインの専門家によって独立に検証され、共用論文で十分に開発されている。
これらの結果と、検証された新しい結果は、https://sites.google.com/view/cogentic でリストアップします。
関連論文リスト
- Autonomous Mathematical Discovery in an Open-World Multi-Agent Environment [12.952007953406872]
我々は、異なるモデルファミリーのAIエージェントが共通の研究目標を追求する、オープンワールドのマルチエージェント環境であるステーションで自律的な数学的発見を研究する。
生エージェントの対話、証明、検証コードをすべて公開し、これらの発見がどのように現れたのかを透過的に記録します。
論文 参考訳(メタデータ) (2026-08-24T18:00:03Z) - MECA: A Mechanism-Centered Agent for Constructing Well-Specified and Valuable Mathematical Conjectures [10.665021721543729]
既存の未解決問題や予想の多くは、あまりにも広すぎる、不特定でない、あるいは妥当な証明や難読化戦略に結びつくのが難しい。
本稿では,候補文とその支援機構を共同で開発し,予測を構成するマルチエージェントフレームワークMECAを提案する。
文献由来のシードと既存のオープンな問題から100の半開問題を構築し、自動プローバーによる独立した証明と反響試行を通じて評価する。
論文 参考訳(メタデータ) (2026-07-30T05:44:24Z) - LeanMarathon: Toward Reliable AI Co-Mathematicians through Long-Horizon Lean Autoformalization [104.06650149974585]
信頼性の高い研究レベルのLean AutoformalizationのためのマルチエージェントハーネスであるLeanMarathonを紹介します。
4つのコントラクトスコープエージェントがこの青写真を構築し、監査し、証明し、修復する。
我々は4つのErds問題にまたがる最近の2つの研究論文でLeanMarathonを評価した。
論文 参考訳(メタデータ) (2026-06-03T20:09:39Z) - Beyond Individual Intelligence: Surveying Collaboration, Failure Attribution, and Self-Evolution in LLM-based Multi-Agent Systems [65.90791804095561]
マルチエージェントシステムは、特殊エージェント間の構造化された協調を通じてこの問題に対処するが、より厳密な調整は、あまり検討されていないリスクを増幅する。
既存の調査では、個々のエージェント能力、マルチエージェントのコラボレーション、エージェントの自己進化を別々にカバーしている。
この調査は4つの因果関係のあるステージを中心にまとめられた統一されたレビューを提供する。これはLIFEの進展(Lay the capabilities foundation)、協力によるエージェントの統合、帰属による障害の発見、自律的な自己改善によるEvolveである。
論文 参考訳(メタデータ) (2026-05-14T14:36:13Z) - AI-Supervisor: Autonomous AI Research Supervision via a Persistent Research World Model [1.14219428942199]
既存の自動研究システムは、ステートレスでリニアなパイプラインとして動作する。
マルチエージェントオーケストレーションフレームワークである textbfAI-Supervisor を提案する。
エージェントは、人間の関心によって駆動されるエンドツーエンドのAI研究の監督を提供する。
論文 参考訳(メタデータ) (2026-03-25T15:16:51Z) - Improving Coherence and Persistence in Agentic AI for System Optimization [9.443037059325086]
Engramは、反復的にメカニズムを設計、テスト、分析する一連のエージェントを探索する。
本研究では,マルチクラウドマルチキャスト推論,LLM要求ルーティング,自然言語クエリを用いたデータベースにおけるKVキャッシュ再利用の最適化など,さまざまな領域において優れた性能を示すことを示す。
論文 参考訳(メタデータ) (2026-03-22T17:04:50Z) - Towards Autonomous Mathematics Research [48.29504087871558]
Aletheiaは、自然言語のエンドツーエンドの解を反復的に生成し、検証し、修正する数学研究エージェントである。
具体的には、AletheiaはGemini Deep Thinkの高度なバージョンで、推論の問題に挑戦している。
我々は、オリンピアード問題から博士レベルのエクササイズまで、AI支援数学研究におけるいくつかのマイルストーンを通じて、アレクシアを実証する。
論文 参考訳(メタデータ) (2026-02-10T18:50:15Z) - Accelerating Scientific Research with Gemini: Case Studies and Common Techniques [105.15622072347811]
大規模言語モデル(LLM)は、科学研究を加速するための新たな道を開いた。
先進的なAIモデルとどのように協力したかを示すケーススタディのコレクションを提示する。
論文 参考訳(メタデータ) (2026-02-03T18:56:17Z) - When Disagreements Elicit Robustness: Investigating Self-Repair Capabilities under LLM Multi-Agent Disagreements [56.29265568399648]
我々は、不一致が早期のコンセンサスを防ぎ、探索されたソリューション空間を拡張することを主張する。
タスククリティカルなステップの相違は、ソリューションパスのトポロジによってコラボレーションを損なう可能性がある。
論文 参考訳(メタデータ) (2025-02-21T02:24:43Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。