Fugu-MT 論文翻訳(概要): Are Retrials All You Need? Enhancing Large Language Model Reasoning Without Verbalized Feedback

論文の概要: Are Retrials All You Need? Enhancing Large Language Model Reasoning Without Verbalized Feedback

arxiv url: http://arxiv.org/abs/2504.12951v1
Date: Thu, 17 Apr 2025 13:52:48 GMT
ステータス: 翻訳完了
システム内更新日: 2025-04-25 18:39:44.084368
Title: Are Retrials All You Need? Enhancing Large Language Model Reasoning Without Verbalized Feedback
Title（参考訳）: 再審は必要か? 言語モデルの拡張
Authors: Nearchos Potamitis, Akhil Arora,
Abstract要約: フィードバックなしで再審理の概念を導入する」従来の反復改良法とは異なり,本手法では明示的な自己回帰や言語フィードバックは必要としない。以上の結果から, より単純な再審ベースのアプローチの方が, より高度な推論フレームワークより優れていることが示唆された。
参考スコア（独自算出の注目度）: 2.2406151150434894
License: http://creativecommons.org/licenses/by/4.0/
Abstract: Recent advancements in large language models (LLMs) have catalyzed the development of general-purpose autonomous agents, demonstrating remarkable performance in complex reasoning tasks across various domains. This surge has spurred the evolution of a plethora of prompt-based reasoning frameworks. A recent focus has been on iterative reasoning strategies that refine outputs through self-evaluation and verbalized feedback. However, these strategies require additional computational complexity to enable models to recognize and correct their mistakes, leading to a significant increase in their cost. In this work, we introduce the concept of ``retrials without feedback'', an embarrassingly simple yet powerful mechanism for enhancing reasoning frameworks by allowing LLMs to retry problem-solving attempts upon identifying incorrect answers. Unlike conventional iterative refinement methods, our method does not require explicit self-reflection or verbalized feedback, simplifying the refinement process. Our findings indicate that simpler retrial-based approaches often outperform more sophisticated reasoning frameworks, suggesting that the benefits of complex methods may not always justify their computational costs. By challenging the prevailing assumption that more intricate reasoning strategies inherently lead to better performance, our work offers new insights into how simpler, more efficient approaches can achieve optimal results. So, are retrials all you need?
Abstract（参考訳）: 大規模言語モデル(LLM)の最近の進歩は、汎用的な自律エージェントの開発を触媒し、様々な領域にわたる複雑な推論タスクにおいて顕著な性能を示した。この急上昇は、多くの急進的な推論フレームワークの進化を加速させた。最近の研究は、自己評価と言葉によるフィードバックを通じてアウトプットを洗練させる反復的推論戦略に焦点が当てられている。しかしながら、これらの戦略は、モデルが誤りを認識し修正できるように、さらなる計算複雑性を必要とし、コストが大幅に増加する。本研究では,LLMが誤った回答を識別する問題解決の試みを再試行できるようにすることにより,推論フレームワークを強化するための,恥ずかしいほどシンプルで強力なメカニズムである ‘retrials without feedback' の概念を導入する。従来の反復的精錬法とは異なり,本手法では明示的な自己回帰や言語フィードバックを必要とせず,精錬プロセスを簡素化する。以上の結果から, より単純な再審ベースのアプローチは, 複雑な手法の利点が必ずしも計算コストを正当化するとは限らないことを示唆し, より洗練された推論フレームワークよりも優れていることが示唆された。より複雑な推論戦略が本質的により良いパフォーマンスをもたらすという一般的な仮定に挑戦することによって、我々の研究は、いかにシンプルで効率的なアプローチが最適な結果を得るかについての新しい洞察を提供する。では、再審は必要か?

関連論文リスト

Perceptual Decoupling for Scalable Multi-modal Reasoning via Reward-Optimized Captioning [78.17782197231325]
本稿では,抽出者のキャプション動作と推論目的を一致させる推論誘導型強化学習戦略を提案する。マルチモーダルな数学と科学ベンチマークの実験により、提案手法は最先端の平均性能を達成することを示した。
論文参考訳（メタデータ） (2025-06-05T02:28:07Z)
PixelThink: Towards Efficient Chain-of-Pixel Reasoning [70.32510083790069]
PixelThinkは、外部から推定されるタスクの難しさと内部で測定されたモデルの不確実性を統合する、シンプルで効果的なスキームである。シーンの複雑さと予測信頼度に応じて推論の長さを圧縮することを学ぶ。実験により,提案手法は推論効率と全体セグメンテーション性能の両方を改善した。
論文参考訳（メタデータ） (2025-05-29T17:55:49Z)
Think Deep, Think Fast: Investigating Efficiency of Verifier-free Inference-time-scaling Methods [39.89239733570008]
本研究は推論モデルと非推論モデルの両方に対する推論時間スケーリング手法を包括的に解析する。非推論モデルは、非常に高い推論予算にもかかわらず、推論モデルに大きく遅れていることが分かっています。推論モデルでは、多数決は堅牢な推論戦略であり、一般的に競争力があるか、あるいは他のより洗練されたITC手法よりも優れていることが証明されている。
論文参考訳（メタデータ） (2025-04-18T19:32:55Z)
Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models [54.04678363287392]
大規模言語モデル(LLM)は複雑なタスクにおいて顕著な機能を示した。 OpenAI o1とDeepSeek-R1の最近の進歩は、System-2推論ドメインのパフォーマンスをさらに改善した。
論文参考訳（メタデータ） (2025-03-20T17:59:38Z)
Meta-Reasoner: Dynamic Guidance for Optimized Inference-time Reasoning in Large Language Models [31.556646366268286]
大規模言語モデルは、複雑なタスクを解決するために、より長い推論チェーンに依存している。この試行錯誤アプローチは、しばしば高い計算オーバーヘッドとエラーの伝播をもたらす。推論時間推論を動的に最適化するフレームワークであるMeta-Reasonerを紹介する。
論文参考訳（メタデータ） (2025-02-27T09:40:13Z)
Verbosity-Aware Rationale Reduction: Effective Reduction of Redundant Rationale via Principled Criteria [18.612187958340407]
大規模言語モデル(LLM)は、最終回答の品質を高めるために、広範囲な中間推論単位(トークン、文など)を生成することに依存する。トークンレベルの削減を明確な基準なしで適用する従来の手法は、完全に合理的に訓練されたモデルと比較して、性能が劣る。本稿では,冗長な推論文を識別・除去するために,確率に基づく基準,冗長性を活用した文レベルの合理的化フレームワークを提案する。
論文参考訳（メタデータ） (2024-12-30T15:15:08Z)
Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems [92.89673285398521]
o1のような推論システムは、複雑な推論タスクを解く際、顕著な能力を示した。推論モデルをトレーニングするために、模倣、探索、自己改善のフレームワークを導入します。提案手法は,産業レベルの推論システムと比較して競争性能が向上する。
論文参考訳（メタデータ） (2024-12-12T16:20:36Z)
Make LLMs better zero-shot reasoners: Structure-orientated autonomous reasoning [52.83539473110143]
本稿では,Large Language Models (LLM) の質問をよりよく理解するための構造指向分析手法を提案する。複雑な質問応答タスクの信頼性をさらに向上するために,多エージェント推論システム,構造指向自律推論エージェント(SARA)を提案する。大規模な実験により,提案システムの有効性が検証された。
論文参考訳（メタデータ） (2024-10-18T05:30:33Z)
Recursive Introspection: Teaching Language Model Agents How to Self-Improve [30.086494067593268]
RISE: Recursive IntroSpEctionは,大規模言語モデルを微調整する手法である。実験の結果,RISEはLlama2,Llama3,Mistralの各モデルに対して,数学推論タスクのターン数を増やすことで自己改善を可能にすることがわかった。
論文参考訳（メタデータ） (2024-07-25T17:35:59Z)
Aggregation of Reasoning: A Hierarchical Framework for Enhancing Answer Selection in Large Language Models [84.15513004135576]
最近の研究は、複数の推論チェーンをサンプリングし、応答周波数に基づいてアンサンブルすることで、Large Language Models(LLMs)の推論性能を向上させる。このアプローチは、正しい答えが少数派である場合に失敗する。階層的推論集約フレームワークAoRを導入し、推論連鎖の評価に基づいて回答を選択する。
論文参考訳（メタデータ） (2024-05-21T17:12:19Z)
Large Language Models as an Indirect Reasoner: Contrapositive and Contradiction for Automated Reasoning [74.90592233107712]
本稿では,直接推論 (DR) と間接推論 (IR) を並列な複数の推論経路として考慮し,最終解を導出する直接間接推論 (DIR) 手法を提案する。我々のDIR法は単純だが有効であり、既存のCoT法と簡単に統合できる。
論文参考訳（メタデータ） (2024-02-06T03:41:12Z)
Rationale-Augmented Ensembles in Language Models [53.45015291520658]
我々は、数発のテキスト内学習のための合理化促進策を再考する。我々は、出力空間における合理的サンプリングを、性能を確実に向上させるキーコンポーネントとして特定する。有理拡張アンサンブルは既存のプロンプト手法よりも正確で解釈可能な結果が得られることを示す。
論文参考訳（メタデータ） (2022-07-02T06:20:57Z)

関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。

指定された論文の情報です。
本サイトの運営者は本サイト（すべての情報・翻訳含む）の品質を保証せず、本サイト（すべての情報・翻訳含む）を使用して発生したあらゆる結果について一切の責任を負いません。