論文の概要: How to Have a Sensitive Debate: An Instance-Optimal Protocol for AI Debate
- arxiv url: http://arxiv.org/abs/2610.02557v1
- Date: Thu, 01 Oct 2026 22:45:03 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-06 00:14:30.11441
- Title: How to Have a Sensitive Debate: An Instance-Optimal Protocol for AI Debate
- Title(参考訳): 敏感な議論の方法:AIに関する最適なプロトコル
- Abstract要約: AIに関する議論は、2つの強力なAI間の議論を活用して、複雑な問題を、直接的に判断できる単純な主張に分解しようとしている。
現在の最良のプロトコルは、サブプロブレムに十分に安定な分解を持つ全ての問題に有効であることが示されている。
本稿では,これらの問題に対して,いくつかの方法で先行作業を改善するための新しいプロトコルを設計する。
- 参考スコア(独自算出の注目度): 12.02696623575991
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: As powerful AI systems reach and sometimes surpass the abilities of human experts across a range of cognitively demanding tasks, the problem of accurate oversight and supervision of these systems has become increasingly urgent. One promising approach is AI debate, which seeks to leverage a debate between two powerful AIs to break complex questions down into simpler claims that can be easily judged directly. Theoretical work on debate has formalized this intuition in the language of computational complexity theory, where the goal is to design protocols (i.e., rules of the debate game) that provide rigorous guarantees on correctness for judging solutions to complex problems with limited supervision. Specifically, the current best protocol has been shown to work for all problems that have sufficiently stable decompositions into subproblems. In this paper, we design a new protocol for this same class of problems that improves on the prior work in several ways. First, correctness holds in a worst-case rather than an average-case sense. Second, being honest and correct is a dominant-strategy equilibrium for both debaters, rather than a Stackelberg equilibrium. Finally, we prove black-box lower bounds, showing that our new protocol is instance-wise optimal. That is, no protocol for this class of problems can outperform ours while making only black-box queries to human judgments. We obtain these results by relating the notion of stable problem decompositions to the concept of fractional block sensitivity from query complexity.
- Abstract(参考訳): 強力なAIシステムが、認知に要求されるタスクの範囲で人間の専門家の能力に到達し、時には超えているため、これらのシステムの正確な監視と監督の問題は、ますます緊急になっている。
これは、2つの強力なAI間の議論を活用して、複雑な質問をより単純なクレームに分解し、直接的に判断することを目指している。
議論に関する理論的研究は、この直観を計算複雑性理論(英語版)の言語で定式化し、そこでは、制限された監督を伴う複雑な問題に対する解の正しさを厳格に保証するプロトコル(すなわち、議論ゲームの規則)を設計することを目的としている。
特に、現在の最良のプロトコルは、サブプロブレムに十分に安定な分解を持つ全ての問題に有効であることが示されている。
本稿では,これらの問題に対して,いくつかの方法で先行作業を改善するための新しいプロトコルを設計する。
第一に、正確さは平均的なケースというよりも最悪のケースである。
第二に、正直で正しいことは、スタックルバーグ均衡ではなく、双方の議論者にとって支配的な戦略均衡である。
最後に、ブラックボックスの低いバウンダリを証明し、新しいプロトコルがインスタンスワイズに最適であることを示す。
つまり、このタイプの問題に対するプロトコルは、人間の判断に対してブラックボックスクエリのみを作成しながら、私たちより優れています。
これらの結果は、安定な問題分解の概念と、クエリの複雑さからの分数ブロック感度の概念を関連付けて得られる。
関連論文リスト
- Debate is efficient with your time [26.121215987560635]
本稿では,検証者が検証しなければならない最小のビット数について,議論を正しく決定するDQCについて紹介する。
PSPACE/poly は O(log n) クエリで決定可能な関数のクラスである。
また、全ての入力ビットに依存する関数はOmega(log n)クエリを必要とし、サイズ s の回路で計算可能な関数は DQC(f) = log(s) + 3 を満たすことも確認した。
論文 参考訳(メタデータ) (2026-02-09T13:21:32Z) - Avoiding Obfuscation with Prover-Estimator Debate [33.14645106993676]
本稿では,複雑な問題に対する人間の判断の正当性を保証するAI討論のためのプロトコルを提案する。
不正直な議論者は、正直な相手に計算的に難解な問題を解くよう強制する計算効率のよい戦略を利用できる。
論文 参考訳(メタデータ) (2025-06-16T15:37:33Z) - T$^2$: An Adaptive Test-Time Scaling Strategy for Contextual Question Answering [49.5489716597489]
T$2$: Think-to-Thinkは質問の複雑さに基づいて推論深度を動的に適応する新しいフレームワークである。
T$2$は、質問を構造的要素に分解し、候補推論戦略と同じような例を生成し、これらの戦略を複数の基準に対して評価し、元の質問に最も適切な戦略を適用する、という4つの重要なステップで機能する。
論文 参考訳(メタデータ) (2025-05-23T03:18:02Z) - PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models [59.920971312822736]
本稿では,高品質なオリンピアードレベルの数学問題を自動生成する新しい手法であるPromptCoTを紹介する。
提案手法は,問題構築の背景にある数学的概念と理論的根拠に基づいて複雑な問題を合成する。
提案手法は, GSM8K, MATH-500, AIME2024などの標準ベンチマークで評価され, 既存の問題生成手法を一貫して上回っている。
論文 参考訳(メタデータ) (2025-03-04T06:32:30Z) - On scalable oversight with weak LLMs judging strong LLMs [67.8628575615614]
我々は、2つのAIが1人の裁判官を納得させようとする議論、すなわち1人のAIが1人の裁判官を説得し、質問をする。
大規模言語モデル(LLM)をAIエージェントと人間の判断のためのスタンドインの両方として使用し、判断モデルがエージェントモデルよりも弱いと判断する。
論文 参考訳(メタデータ) (2024-07-05T16:29:15Z) - Learnability with PAC Semantics for Multi-agent Beliefs [38.88111785113001]
推論と帰納の緊張は、おそらく哲学、認知、人工知能といった分野において最も根本的な問題である。
Valiant氏は、学習の課題は推論と統合されるべきである、と認識した。
古典的な包含よりも弱いが、クエリに応答する強力なモデル理論のフレームワークを可能にする。
論文 参考訳(メタデータ) (2023-06-08T18:22:46Z) - From Checking to Inference: Actual Causality Computations as
Optimization Problems [79.87179017975235]
本稿では、最適化問題として二元非巡回モデルよりも、因果推論の異なる概念を定式化するための新しいアプローチを提案する。
8000ドル以上の変数を持つモデルを用いて,MaxSAT が ILP を上回り,数秒単位でチェック処理を行う場合が多い。
論文 参考訳(メタデータ) (2020-06-05T10:56:52Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。