Fugu-MT 論文翻訳(概要): Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?

論文の概要: Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?

arxiv url: http://arxiv.org/abs/2402.14355v1
Date: Thu, 22 Feb 2024 07:55:26 GMT
ステータス: 翻訳完了
システム内更新日: 2024-02-23 16:04:52.009321
Title: Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?
Title（参考訳）: ルールかストーリーか、大言語モデルと対話するためのより優れた共通表現は何か?
Authors: Ning Bian, Xianpei Han, Hongyu Lin, Yaojie Lu, Ben He, Le Sun
Abstract要約: 人間は物語を通して暗黙的にコモンセンスを伝え、伝承する。本稿では,物語を通して表現される大規模言語モデル(LLM)の固有コモンセンス能力について検討する。
参考スコア（独自算出の注目度）: 52.806705229189504
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Abstract: Building machines with commonsense has been a longstanding challenge in NLP due to the reporting bias of commonsense rules and the exposure bias of rule-based commonsense reasoning. In contrast, humans convey and pass down commonsense implicitly through stories. This paper investigates the inherent commonsense ability of large language models (LLMs) expressed through storytelling. We systematically investigate and compare stories and rules for retrieving and leveraging commonsense in LLMs. Experimental results on 28 commonsense QA datasets show that stories outperform rules as the expression for retrieving commonsense from LLMs, exhibiting higher generation confidence and commonsense accuracy. Moreover, stories are the more effective commonsense expression for answering questions regarding daily events, while rules are more effective for scientific questions. This aligns with the reporting bias of commonsense in text corpora. We further show that the correctness and relevance of commonsense stories can be further improved via iterative self-supervised fine-tuning. These findings emphasize the importance of using appropriate language to express, retrieve, and leverage commonsense for LLMs, highlighting a promising direction for better exploiting their commonsense abilities.
Abstract（参考訳）: Commonsenseを使ったマシンの構築は、Commonsenseルールの報告バイアスとルールベースのCommonsense推論の露出バイアスにより、NLPの長年にわたる課題である。対照的に、人間は物語を通して暗黙的に常識を伝え伝承する。本稿では,大規模言語モデル(LLM)がストーリーテリングを通じて表現する固有コモンセンス能力について検討する。 LLMにおけるコモンセンスを検索・活用するためのストーリーとルールを体系的に検討・比較する。 28のコモンセンスQAデータセットによる実験結果から,LLMからコモンセンスを抽出するための表現として,ストーリーがルールより優れ,世代信頼性とコモンセンスの精度が向上した。さらに、ストーリーは日々の出来事に関する質問に答えるより効果的なコモンセンス表現であり、ルールは科学的な問題に対してより効果的である。これはテキストコーパスにおけるコモンセンスのレポートバイアスと一致する。さらに,コモンセンスストーリーの正しさと関連性は,反復的自己指導による微調整によってさらに向上できることを示す。これらの知見は、LLMのコモンセンスを表現、検索、活用するために適切な言語を使うことの重要性を強調し、コモンセンスの能力をうまく活用するための有望な方向性を強調した。

関連論文リスト

RuleArena: A Benchmark for Rule-Guided Reasoning with LLMs in Real-World Scenarios [58.90106984375913]
RuleArenaは、大規模言語モデル(LLM)が推論において複雑な現実世界のルールに従う能力を評価するために設計された、新しくて挑戦的なベンチマークである。航空会社の荷物手数料、NBA取引、税制の3つの実践的領域をカバーするルールアリーナは、複雑な自然言語命令を扱うのにLLMの習熟度を評価する。
論文参考訳（メタデータ） (2024-12-12T06:08:46Z)
What Really is Commonsense Knowledge? [58.5342212738895]
我々は、既存のコモンセンス知識の定義を調査し、概念を定義するための3つのフレームワークに基礎を置き、それらをコモンセンス知識の統一的な定義に統合する。次に、アノテーションと実験のための統合された定義をCommonsenseQAとCommonsenseQA 2.0データセットで使用します。本研究は,2つのデータセットには非常識知識のインスタンスが多数存在し,これら2つのサブセットに対して大きな性能差があることを示す。
論文参考訳（メタデータ） (2024-11-06T14:54:19Z)
Narrative Analysis of True Crime Podcasts With Knowledge Graph-Augmented Large Language Models [8.78598447041169]
大きな言語モデル(LLM)は、複雑な物語の弧や矛盾する情報を含む物語といまだに苦労している。最近の研究は、外部知識ベースで強化されたLLMが、結果の精度と解釈可能性を向上させることを示唆している。本研究では,実際のポッドキャストデータの理解における知識グラフ(KG)の適用性について検討する。
論文参考訳（メタデータ） (2024-11-01T21:49:00Z)
Complex Reasoning over Logical Queries on Commonsense Knowledge Graphs [61.796960984541464]
論理クエリをサンプリングして作成した新しいデータセットであるCOM2(COMplex COMmonsense)を提示する。我々は、手書きのルールと大きな言語モデルを用いて、複数の選択とテキスト生成の質問に言語化します。 COM2でトレーニングされた言語モデルでは、複雑な推論能力が大幅に改善されている。
論文参考訳（メタデータ） (2024-03-12T08:13:52Z)
MORE: Multi-mOdal REtrieval Augmented Generative Commonsense Reasoning [66.06254418551737]
本稿では,テキストと画像の両面を利用したマルチモーダル検索フレームワークを提案し,言語モデルのコモンセンス性を向上する。 Common-Genタスクの実験では、シングルモードと複数モードの事前学習モデルに基づくMOREの有効性が実証されている。
論文参考訳（メタデータ） (2024-02-21T08:54:47Z)
CORECODE: A Common Sense Annotated Dialogue Dataset with Benchmark Tasks for Chinese Large Language Models [42.5532503036805]
CORECODEは、ダイアディック対話に手動で注釈付けされた豊富なコモンセンス知識を含むデータセットである。日常会話における常識知識を,エンティティ,イベント,社会的相互作用の3次元に分類する。クラウドソーシングを通じて, 76,787のコモンセンス知識アノテーションを19,700の対話から収集した。
論文参考訳（メタデータ） (2023-12-20T09:06:18Z)
Commonsense Knowledge Transfer for Pre-trained Language Models [83.01121484432801]
ニューラルコモンセンス知識モデルに格納されたコモンセンス知識を汎用的な事前学習言語モデルに転送するフレームワークであるコモンセンス知識伝達を導入する。まず、一般的なテキストを利用して、ニューラルコモンセンス知識モデルからコモンセンス知識を抽出するクエリを形成する。次に、コモンセンスマスクの埋め込みとコモンセンスの関係予測という2つの自己教師対象で言語モデルを洗練する。
論文参考訳（メタデータ） (2023-06-04T15:44:51Z)
Adversarial Transformer Language Models for Contextual Commonsense Inference [14.12019824666882]
コモンセンス推論はコヒーレントなコモンセンスアサーションを生成するタスクである。課題のいくつかは、推測された事実のトピックに対する制御可能性の欠如、トレーニング中の常識知識の欠如である。我々は、上記の課題に対処する技術を開発する。
論文参考訳（メタデータ） (2023-02-10T18:21:13Z)
ComFact: A Benchmark for Linking Contextual Commonsense Knowledge [31.19689856957576]
そこで我々は,KGから状況に関連のあるコモンセンス知識を特定するために,モデルにコンテキストを付与し,訓練を行う,コモンセンス事実リンクの新しい課題を提案する。われわれの新しいベンチマークであるComFactは、4つのスタイリスティックな多様なデータセットにまたがるコモンセンスのための293kのインコンテキスト関連アノテーションを含んでいる。
論文参考訳（メタデータ） (2022-10-23T09:30:39Z)
Do Children Texts Hold The Key To Commonsense Knowledge? [14.678465723838599]
本稿では,子どもの文章がコモンセンス・ナレッジ・コンピレーションの鍵を握っているかどうかを考察する。いくつかのコーパスによる分析では、子供の文章は確かにより多く、より典型的な常識的主張を含んでいることが示されている。実験により、この利点は一般的な言語モデルに基づくコモンセンス知識抽出設定で活用できることが示されている。
論文参考訳（メタデータ） (2022-10-10T09:56:08Z)
Evaluate Confidence Instead of Perplexity for Zero-shot Commonsense Reasoning [85.1541170468617]
本稿では,コモンセンス推論の性質を再考し,新しいコモンセンス推論尺度であるNon-Replacement Confidence(NRC)を提案する。提案手法は,2つのコモンセンス推論ベンチマークデータセットと,さらに7つのコモンセンス質問応答データセットに対してゼロショット性能を向上する。
論文参考訳（メタデータ） (2022-08-23T14:42:14Z)

関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。

指定された論文の情報です。
本サイトの運営者は本サイト（すべての情報・翻訳含む）の品質を保証せず、本サイト（すべての情報・翻訳含む）を使用して発生したあらゆる結果について一切の責任を負いません。