論文の概要: Can we only use guideline instead of shot in prompt?
- arxiv url: http://arxiv.org/abs/2409.12979v1
- Date: Tue, 3 Sep 2024 08:14:55 GMT
- ステータス: 翻訳完了
- システム内更新日: 2024-11-07 12:25:44.186834
- Title: Can we only use guideline instead of shot in prompt?
- Title(参考訳): インプロンプトでショットする代わりに、ガイドラインのみを使用することができますか?
- Abstract要約: ショットメソッドは、与えられた例のステップを模倣することによって、モデルに質問に答えるように暗黙的にインスピレーションを与える。
ガイドライン法は、簡潔で簡潔なタスク固有の知識を含むガイドラインに従って、モデルに推論を指示する。
本稿では,フィードバック,ガイドライン,ツリーゲザエージェントからなるデータセットから,タスク固有のガイドラインを自動的に学習するFGTフレームワークを提案する。
- 参考スコア(独自算出の注目度): 36.578562560365384
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Currently, prompting techniques can be mainly divided into two categories:1)shot method implicitly inspires the model to answer the question by mimicing the steps in the given example, e.g., the few-shot CoT. 2) Guideline method explicitly instructs the model to reason by following guidelines, which contains succinct and concise task-specific knowledge. Shot method is prone to difficulties in terms of selection of shots type, the number of shots, and the design of the reasoning steps, so a question arises: can we only use guideline instead of shot in the prompt? To this end, we propose the FGT framework to automatically learn task-specific guidelines from dataset consisting of Feedback, Guideline, and Tree-gather agents. First, the feedback agent is designed to evaluate the outcomes, both right and wrong, of each Q&A to gather insights guiding more effective optimization strategies. Next, the guideline agent is tasked with deriving guidelines from each piece of feedback and storing them in local memory. Lastly, the tree-gather agent aggregates all guidelines hierarchically through a tree structure, ultimately obtaining all unduplicated guidelines from a global perspective. In addition, we induce the model to generate intermediate processes to ensure the reasoning consistent with the guidelines. Experimental results demonstrate that our approach achieves superior performance across multiple tasks, thereby highlighting the effectiveness of using the guidelines in prompt.
- Abstract(参考訳): 現在、プロンプト技術は主に2つのカテゴリに分けられる:1)ショット法は、与えられた例のステップ、例えば、数ショットのCoTを模倣することによって、モデルに暗黙的に質問に答えるよう促す。
2)指針法は,簡潔かつ簡潔なタスク固有の知識を含むガイドラインに従って,モデルに推論を明示的に指示する。
ショット方式は、ショットの種類の選択、ショットの数、推論ステップの設計の難しさを招きがちである。
そこで本研究では,フィードバック,ガイドライン,ツリーガザエージェントからなるデータセットから,タスク固有のガイドラインを自動的に学習するFGTフレームワークを提案する。
まず、フィードバックエージェントは、各Q&Aの結果を正しくも悪くも評価するように設計され、より効果的な最適化戦略を導く洞察を集める。
次に、ガイドラインエージェントは、各フィードバックからガイドラインを導出し、それらをローカルメモリに格納する。
最後に、ツリー収集エージェントは、すべてのガイドラインを階層的に木構造を通して集約し、最終的に、グローバルな視点から、無関係なガイドラインを全て取得する。
さらに,このモデルを用いて中間プロセスを生成し,その推論とガイドラインの整合性を確保する。
実験結果から,本手法は複数のタスクにまたがる優れた性能を実現し,即時的なガイドライン適用の有効性を強調した。
関連論文リスト
- Strategy-Induct: Task-Level Strategy Induction for Instruction Generation [23.56553381765231]
ストラテジーインダクト(Strategy-Induct)は、少数の例題のみからタスクレベルの命令を導出するフレームワークである。
私たちのアプローチはまず、各質問に対して明確な推論戦略を生成し、(ストラテジー、質問)ペアを形成するようにモデルに促します。
これらのペアは、推論を導くタスク命令を誘導するために使用される。
論文 参考訳(メタデータ) (2026-05-20T09:10:43Z) - Automatically Evolving Prompt Guidelines for Task-Specific Optimization [12.329476612271442]
大規模な言語モデルでは、ユーザクエリは不特定であることが多い。
既存の緊急エンジニアリングガイドラインは、この問題を緩和することを目的としており、典型的には汎用的でタスクに依存しない。
最適化手法を用いてタスク固有のガイドラインを進化させる自動アプローチであるAGOPSを提案する。
論文 参考訳(メタデータ) (2026-05-07T15:50:42Z) - Knowledge-Graph Paths as Intermediate Supervision for Self-Evolving Search Agents [21.366388027090736]
自己進化型検索エージェントは、独自の検索タスクを生成し、解決する。
探索セルフプレイ(SSP)フレームワーク上に構築し,多段階探索と推論による質問の生成と回答を行う。
本稿では,知識グラフの経路を,質問構築と報酬形成の中間管理として利用することで,二つのボトルネックに対処する。
論文 参考訳(メタデータ) (2026-05-07T05:46:53Z) - Diverge to Induce Prompting: Multi-Rationale Induction for Zero-Shot Reasoning [23.56553381765231]
Diverge-to-Induce Prompting (DIP) は、まず大きな言語モデルに質問毎に複数の高いレベルの論理を生成するよう促すフレームワークである。
それぞれの根拠は、詳細かつステップバイステップのドラフトプランに詳述され、最後に、これらのドラフトプランは最終計画に誘導されます。
実験により,DIPは単一ストラテジー・プロンプトよりも優れており,プロンプトに基づく推論におけるマルチプラン・インジェクションの有効性が示された。
論文 参考訳(メタデータ) (2026-02-08T16:02:35Z) - Improving Alignment Between Human and Machine Codes: An Empirical Assessment of Prompt Engineering for Construct Identification in Psychology [0.0]
本稿では,テキスト中のコンストラクタをインシデントエンジニアリングで識別するために,インシデント性能を最適化するための実証的フレームワークを提案する。
提案手法は,コードブックによる経験的プロンプト選択,自動プロンプトエンジニアリング,ペルソナプロンプト,チェーンオブ思考推論,説明的プロンプトという5つのプロンプト戦略を実験的に評価した。
3つの構成と2つのモデルで、分類は専門家の判断に最も適しており、コードブックに誘導された経験的プロンプト選択と自動プロンプトエンジニアリングを組み合わせた数発のプロンプトから生まれた。
論文 参考訳(メタデータ) (2025-12-03T14:07:42Z) - Teaching Prompts to Coordinate: Hierarchical Layer-Grouped Prompt Tuning for Continual Learning [69.17264556340244]
連続学習のための階層型階層型プロンプトチューニング手法を提案する。
i) 同じグループの層がほぼ同じプロンプトを共有し、位置符号化によって調整される。
単一のタスク固有のルートプロンプトを使用して、各レイヤグループのサブプロンプトを生成する。
論文 参考訳(メタデータ) (2025-11-15T08:15:51Z) - Robustness via Referencing: Defending against Prompt Injection Attacks by Referencing the Executed Instruction [68.6543680065379]
大型言語モデル(LLM)はインジェクション攻撃に弱い。
本研究では,LLMの命令追従能力を抑えるのではなく,新たな防御手法を提案する。
論文 参考訳(メタデータ) (2025-04-29T07:13:53Z) - Divide-and-Conquer: Tree-structured Strategy with Answer Distribution Estimator for Goal-Oriented Visual Dialogue [30.126882554391837]
Answer Distribution Estimator(TSADE)を用いた樹木構造戦略
本稿では,現在の候補オブジェクトの半数を各ラウンドで除外することで,質問生成をガイドする木構造戦略(TSADE)を提案する。
提案手法は,従来のエルゴディックな質問生成手法と比較して,繰り返し質問やラウンドの少ないタスク指向の精度をエージェントが達成できることを実験的に実証する。
論文 参考訳(メタデータ) (2025-02-09T08:16:09Z) - Prompt Chaining or Stepwise Prompt? Refinement in Text Summarization [31.80150267600029]
Prompt ChainingとStepwise Promptの2つの戦略は反復的なプロセスを実行するように設計されている。
本稿では,これら2つの手法をテキスト要約の文脈で検証し,比較することを目的とした。
実験結果から, プロンプト連鎖法によりより良好な結果が得られることが示された。
論文 参考訳(メタデータ) (2024-06-01T17:28:38Z) - Efficient Prompting Methods for Large Language Models: A Survey [50.171011917404485]
プロンプティングは、特定の自然言語処理タスクに大規模言語モデル(LLM)を適用するための主流パラダイムとなっている。
このアプローチは、LLMの振る舞いをガイドし、制御するために、モデル推論と人間の努力のさらなる計算負担をもたらす。
本稿では, 今後の研究の方向性を明らかにするため, 促進, 効率的な促進のための進歩を概説する。
論文 参考訳(メタデータ) (2024-04-01T12:19:08Z) - Answer is All You Need: Instruction-following Text Embedding via
Answering the Question [41.727700155498546]
本稿では、入力テキストに関する質問として命令を扱い、予測された回答を符号化して表現を得る新しい視点を提供する。
具体的には,抽象的質問応答タスクの言語モデルのみを微調整することで,この組込み解答のアイデアをインスタンス化するInBedderを提案する。
論文 参考訳(メタデータ) (2024-02-15T01:02:41Z) - COMMA: Co-Articulated Multi-Modal Learning [39.778958624066185]
本稿では,従来の手法の制約に対処するため,COMMA(Co-Articulated Multi-Modal Learning)を提案する。
本手法は,両枝の表現アライメントを高めるプロンプトを生成するために,両枝からのプロンプトを考察する。
提案手法は,新しいクラスへの一般化,新しいターゲットデータセット,目に見えないドメインシフトの3つのタスクにまたがって評価する。
論文 参考訳(メタデータ) (2023-12-30T15:47:36Z) - Self-regulating Prompts: Foundational Model Adaptation without
Forgetting [112.66832145320434]
本稿では,PromptSRCと呼ばれる自己正規化フレームワークを提案する。
PromptSRCはタスク固有の汎用表現とタスクに依存しない汎用表現の両方に最適化するプロンプトを導く。
論文 参考訳(メタデータ) (2023-07-13T17:59:35Z) - Guiding Large Language Models via Directional Stimulus Prompting [114.84930073977672]
我々は,特定の所望の出力に対して,ブラックボックス大言語モデル(LLM)を導くための新しいフレームワークであるDirectional Stimulus Promptingを紹介する。
LLMを直接調整するのではなく、小さな調整可能なポリシーモデルを用いて各入力インスタンスに対して補助的な指向性刺激プロンプトを生成する。
論文 参考訳(メタデータ) (2023-02-22T17:44:15Z) - Explanation Selection Using Unlabeled Data for Chain-of-Thought
Prompting [80.9896041501715]
非専門家によって書かれたオフ・ザ・シェルフの説明のように、タスクのために"チューニング"されていない説明は、中途半端なパフォーマンスをもたらす可能性がある。
本稿では,ブラックボックス方式で説明拡散プロンプトを最適化する方法の課題に対処する。
論文 参考訳(メタデータ) (2023-02-09T18:02:34Z) - STPrompt: Semantic-guided and Task-driven prompts for Effective Few-shot
Classification [5.6205035780719275]
本稿ではSTPrompt-Semantic-GuidedおよびTask-driven Promptモデルを提案する。
提案モデルでは,テキスト分類タスクの5つの異なるデータセットにおいて,最先端の性能を実現する。
論文 参考訳(メタデータ) (2022-10-29T04:42:30Z) - Supporting Vision-Language Model Inference with Confounder-pruning Knowledge Prompt [71.77504700496004]
視覚言語モデルは、オープンセットの視覚概念を扱うために、画像とテキストのペアを共通の空間に整列させることで事前訓練される。
事前訓練されたモデルの転送可能性を高めるため、最近の研究では、固定または学習可能なプロンプトが採用されている。
しかし、どのようにして、どのプロンプトが推論性能を改善するのかは、まだ不明である。
論文 参考訳(メタデータ) (2022-05-23T07:51:15Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。