論文の概要: ToolNet: Connecting Large Language Models with Massive Tools via Tool
Graph
- arxiv url: http://arxiv.org/abs/2403.00839v1
- Date: Thu, 29 Feb 2024 02:04:00 GMT
- ステータス: 処理完了
- システム内更新日: 2024-03-05 16:25:27.105913
- Title: ToolNet: Connecting Large Language Models with Massive Tools via Tool
Graph
- Title(参考訳): toolnet: ツールグラフによる大規模言語モデルと大規模ツールの接続
- Authors: Xukun Liu, Zhiyuan Peng, Xiaoyuan Yi, Xing Xie, Lirong Xiang, Yuchen
Liu, Dongkuan Xu
- Abstract要約: 既存のテキスト内学習アプローチは、ツールを単純なテキスト記述のリストにフォーマットし、大きな言語モデルに入力する。
本稿では,トークン消費を適度に増加させ,ツールの数を数千にスケールアップするプラグイン・アンド・プレイ・フレームワークであるToolNetを提案する。
- 参考スコア(独自算出の注目度): 43.95759808077083
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: While achieving remarkable progress in a broad range of tasks, large language
models (LLMs) remain significantly limited in properly using massive external
tools. Existing in-context learning approaches simply format tools into a list
of plain text descriptions and input them to LLMs, from which, LLMs generate a
sequence of tool calls to solve problems step by step. Such a paradigm ignores
the intrinsic dependency between tools and offloads all reasoning loads to
LLMs, making them restricted to a limited number of specifically designed
tools. It thus remains challenging for LLMs to operate on a library of massive
tools, casting a great limitation when confronted with real-world scenarios.
This paper proposes ToolNet, a plug-and-play framework that scales up the
number of tools to thousands with a moderate increase in token consumption.
ToolNet organizes tools into a directed graph. Each node represents a tool, and
weighted edges denote tool transition. Starting from an initial tool node, an
LLM navigates in the graph by iteratively choosing the next one from its
successors until the task is resolved. Extensive experiments show that ToolNet
can achieve impressive results in challenging multi-hop tool learning datasets
and is resilient to tool failures.
- Abstract(参考訳): 幅広いタスクで顕著な進歩を遂げる一方で、大規模言語モデル(llm)は、大規模な外部ツールを使用しても大幅に制限されている。
既存のテキスト内学習アプローチは、ツールを単純なテキスト記述のリストにフォーマットし、LSMに入力することで、LSMはツールコールのシーケンスを生成して、問題を段階的に解決する。
このようなパラダイムは、ツール間の固有の依存関係を無視し、すべての推論負荷をLLMにオフロードする。
したがって、LLMが大規模なツールのライブラリで運用することは依然として困難であり、現実のシナリオに直面すると大きな制限が課される。
本稿では,トークン消費を緩やかに増やしながらツール数を数千に拡大するプラグイン・アンド・プレイフレームワークである toolnet を提案する。
ToolNetはツールを有向グラフに整理する。
各ノードはツールを表し、重み付きエッジはツール遷移を表す。
最初のツールノードから始めて、LCMはタスクが解決されるまで、その後継ノードから次のツールを反復的に選択することでグラフをナビゲートする。
広範な実験により、ツールネットは、マルチホップツール学習データセットに挑戦し、ツールの失敗に対して弾力性のある、素晴らしい結果を得ることができることが示されている。
関連論文リスト
- Look Before You Leap: Towards Decision-Aware and Generalizable
Tool-Usage for Large Language Models [28.19932548630398]
意思決定・汎用ツール・ユース・フレームワーク(DEER)を提案する。
具体的には、まず、自動生成パイプラインを介して、複数の決定ブランチを持つツール使用サンプルを構築します。
提案するDEERは, 各種データセットのベースラインよりも効果的で, 著しく優れる。
論文 参考訳(メタデータ) (2024-02-26T16:11:03Z) - EASYTOOL: Enhancing LLM-based Agents with Concise Tool Instruction [56.02100384015907]
EasyToolは、多種多様で長いツールドキュメントを統一的で簡潔なツール命令に変換するフレームワークである。
トークン使用量を大幅に削減し、現実のシナリオにおけるツール利用のパフォーマンスを向上させることができる。
論文 参考訳(メタデータ) (2024-01-11T15:45:11Z) - Syntax Error-Free and Generalizable Tool Use for LLMs via Finite-State
Decoding [12.58136035688171]
大規模言語モデル(LLM)は、複雑な問題を解決するために外部ツールを使用する上で有望な能力を示している。
既存のアプローチには、追加のトレーニングなしで新しいツールに一般化しないツールデモの微調整や、コンテキスト内のツールドキュメントの提供が含まれる。
ツール拡張 LLM のための有限エンハンスマシン誘導復号法である ToolDec を提案する。
論文 参考訳(メタデータ) (2023-10-10T23:37:53Z) - MetaTool Benchmark for Large Language Models: Deciding Whether to Use
Tools and Which to Use [82.24774504584066]
大規模言語モデル(LLM)は、その印象的な自然言語処理(NLP)能力のために大きな注目を集めている。
このベンチマークは、LLMがツールの使用意識を持ち、ツールを正しく選択できるかどうかを評価するためのものだ。
8つの人気のあるLCMを巻き込んだ実験を行い、その大半は依然として効果的にツールを選択するのに苦労していることがわかった。
論文 参考訳(メタデータ) (2023-10-04T19:39:26Z) - CRAFT: Customizing LLMs by Creating and Retrieving from Specialized
Toolsets [75.64181719386497]
大規模言語モデル(LLM)のためのツール作成・検索フレームワークであるCRAFTを提案する。
タスク用に特別にキュレートされたツールセットを作成し、複雑なタスクを解決する能力を高めるためにこれらのセットからツールを取得するコンポーネントをLLMに装備する。
本手法はフレキシブルに設計されており,既製のLCMを細かな調整なしに未確認領域やモダリティに適応するためのプラグアンドプレイ方式を提供する。
論文 参考訳(メタデータ) (2023-09-29T17:40:26Z) - Large Language Models as Tool Makers [85.00361145117293]
我々はLLM A s Tool Makers (LATM) と呼ばれるクローズドループフレームワークを導入する。
ツール作成: 1 つのツール作成: LLM がタスクセットのためのツールを作成するツールメーカとして機能する 2 つのツール使用: 別の LLM がツールユーザとして機能し、ツールメーカが問題解決のために構築したツールを適用する。
論文 参考訳(メタデータ) (2023-05-26T17:50:11Z) - CREATOR: Tool Creation for Disentangling Abstract and Concrete Reasoning
of Large Language Models [78.65241926912663]
大規模言語モデル(LLM)はツールの利用において大きな進歩を遂げているが、その能力はAPIの可用性によって制限されている。
我々は、LCMがドキュメンテーションとコード実現を使って独自のツールを作成できる新しいフレームワークCREATORを提案する。
我々は,MATH と TabMWP のベンチマークで CREATOR を評価する。
論文 参考訳(メタデータ) (2023-05-23T17:51:52Z) - ToolkenGPT: Augmenting Frozen Language Models with Massive Tools via
Tool Embeddings [25.5476046472217]
大規模な言語モデルを外部ツールで拡張することは、複雑な問題を解決するための有望なアプローチとして現れている。
最近のインコンテキスト学習パラダイムはこれらの問題を緩和するが、制限されたコンテキスト長はいくつかのデモのみを可能にする。
我々は、両者の利点を組み合わせた代替アプローチである$textbfToolkenGPT$を提案する。
論文 参考訳(メタデータ) (2023-05-19T09:54:21Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。