Fugu-MT 論文翻訳(概要): Long Text Generation Challenge

論文の概要: Long Text Generation Challenge

arxiv url: http://arxiv.org/abs/2306.02334v1
Date: Sun, 4 Jun 2023 11:52:36 GMT
ステータス: 翻訳完了
システム内更新日: 2023-06-06 18:27:11.069140
Title: Long Text Generation Challenge
Title（参考訳）: 長文生成への挑戦
Authors: Nikolay Mikhaylovskiy
Abstract要約: 約1000トークンのプロンプトを前提として,人間のような長文生成の共有タスクであるLTG Challengeを提案する。本稿では,GloVe Autocorrelations Power/Exponential Law Mean Absolute Percentage Error Ratio (GAPELMAPER) と人間評価プロトコルを提案する。
参考スコア（独自算出の注目度）: 0.0
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Abstract: We propose a shared task of human-like long text generation, LTG Challenge, that asks models to output a consistent human-like long text (a Harry Potter generic audience fanfic in English), given a prompt of about 1000 tokens. We suggest a novel statistical metric of the text structuredness, GloVe Autocorrelations Power/ Exponential Law Mean Absolute Percentage Error Ratio (GAPELMAPER) and a human evaluation protocol. We hope that LTG can open new avenues for researchers to investigate sampling approaches, prompting strategies, autoregressive and non-autoregressive text generation architectures and break the barrier to generate consistent long (40K+ token) texts.
Abstract（参考訳）: 我々は,モデルに対して,約1000個のトークンを入力して,一貫した人間ライクな長文(ハリー・ポッター・ジェネラル・オーディエンス)の出力を求める,人間ライクな長文生成の共有タスクであるltg challengeを提案する。本稿では,テキスト構造性に関する新しい統計指標,手袋自己相関パワー/指数法則,絶対パーセンテージ誤差比(gapelmaper)およびヒューマン評価プロトコルを提案する。 LTGが、サンプリングアプローチの調査、戦略の推進、自己回帰的かつ非自己回帰的テキスト生成アーキテクチャ、一貫性のある長文(40K+トークン)を生成するための障壁を突破する新たな道を開くことを願っている。

関連論文リスト

Frankentext: Stitching random text fragments into long-form narratives [28.514420249709726]
フランケンテクス(Frankentexts)は、LLMによって作られた新しいタイプの長文の物語である。そこで我々は,Frankentextsを生成するために,人書きパスを選択して組み合わせてドラフトを作成するように指示し,ユーザ指定のコピー比を維持しながら,反復的にドラフトを修正した。 Gemini-2.5-Proはこのタスクで驚くほどうまく機能し、フランケンテキストの81%が一貫性があり、プロンプトに100%関係している。
論文参考訳（メタデータ） (2025-05-23T17:38:47Z)
Robust and Fine-Grained Detection of AI Generated Texts [0.29569362468768806]
既存のシステムは、短いテキストよりもAI生成したコンテンツを正確に識別するのに苦労することが多い。本稿では,トークン分類のタスクのために構築されたモデルについて紹介する。また,23言語以上のプロプライエタリなLLMが主に共著する2.4M以上のテキストのデータセットも導入した。
論文参考訳（メタデータ） (2025-04-16T10:29:30Z)
A Cognitive Writing Perspective for Constrained Long-Form Text Generation [12.444210620825382]
大きな言語モデル(LLM)は、1回のパスで厳格な要求に従う高品質の長文を生成するのに苦労する。認知の原則によって動機づけられた私たちは,CagWriterを通じて,人間のような認知書記能力を備えたLLMの実現を目指しています。本フレームワークは,(1)タスクを分解する階層的計画を実行する計画エージェントと,(2)これらの計画を並列に実行する複数の生成エージェントの2つの主要なモジュールから構成される。
論文参考訳（メタデータ） (2025-02-18T06:12:14Z)
Detecting Machine-Generated Long-Form Content with Latent-Space Variables [54.07946647012579]
既存のゼロショット検出器は主に、現実世界のドメインシフトに弱いトークンレベルの分布に焦点を当てている。本稿では,イベント遷移などの抽象的要素を機械対人文検出の鍵となる要因として組み込んだ,より堅牢な手法を提案する。
論文参考訳（メタデータ） (2024-10-04T18:42:09Z)
HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models [89.28591263741973]
長文生成における大規模言語モデルの性能を評価するために,階層長文生成ベンチマーク(HelloBench)を導入する。 HelloBenchはブルームの分類に基づいて、長いテキスト生成タスクをオープンエンドQA、要約、チャット、テキスト補完、テキスト生成の5つのサブタスクに分類する。また,人的評価に要する時間と労力を大幅に削減する人的評価手法である階層的長文評価(HelloEval)を提案する。
論文参考訳（メタデータ） (2024-09-24T15:38:11Z)
Length-Aware Multi-Kernel Transformer for Long Document Classification [4.796752450839119]
長いドキュメントは、かなりのメモリ消費のために、ニューラルネットワークモデルに固有の課題を生じさせる。長文分類における新たな課題に対処するため,Longth-Aware Multi- Kernel Transformer (LAMKIT)を提案する。
論文参考訳（メタデータ） (2024-05-11T16:48:06Z)
Unlocking Anticipatory Text Generation: A Constrained Approach for Large Language Models Decoding [75.06872859716049]
大規模言語モデル(LLM)は、テキスト生成の強力な能力を示している。毒性や幻覚などの望ましくない行動が現れることがある。将来制約付き生成問題としてテキスト生成の形式化を提案する。
論文参考訳（メタデータ） (2023-12-11T06:35:33Z)
CoheSentia: A Novel Benchmark of Incremental versus Holistic Assessment of Coherence in Generated Texts [15.866519123942457]
自動生成テキストの人間知覚コヒーレンスに関する新しいベンチマークである sc CoheSentia を紹介する。我々のベンチマークには、自動生成および人称注釈付き500の段落が含まれており、それぞれが両方の方法で注釈付けされている。解析の結果,インクリメンタルモードにおけるアノテータ間の合意は,総合的な代替よりも高いことがわかった。
論文参考訳（メタデータ） (2023-10-25T03:21:20Z)
Concept-Guided Chain-of-Thought Prompting for Pairwise Comparison Scoring of Texts with Large Language Models [3.656114607436271]
既存のテキストスコアリング手法では、大きなコーパス、短いテキストとの競合、手書きのデータが必要である。生成的大言語モデル(LLM)を利用したテキストスコアリングフレームワークを開発した。本稿では、Twitter上の特定の政党への反感を反映したスピーチをよりよく理解するために、このアプローチを適用する。
論文参考訳（メタデータ） (2023-10-18T15:34:37Z)
Copy Is All You Need [66.00852205068327]
既存のテキストコレクションからテキストセグメントを段階的にコピーするテキスト生成を定式化する。提案手法は, 自動評価と人的評価の両方により, より優れた生成品質を実現する。当社のアプローチでは,より大規模なテキストコレクションにスケールアップすることで,さらなるパフォーマンス向上を実現しています。
論文参考訳（メタデータ） (2023-07-13T05:03:26Z)
Deliberate then Generate: Enhanced Prompting Framework for Text Generation [70.10319005141888]
Deliberate then Generate (DTG) プロンプトフレームワークはエラー検出命令とエラーを含む可能性のある候補で構成されている。我々は、要約、翻訳、対話など、7つのテキスト生成タスクにまたがる20以上のデータセットに関する広範な実験を行う。本稿では,DTGが既存のプロンプト手法を一貫して上回り,複数のテキスト生成タスクにおける最先端性能を実現することを示す。
論文参考訳（メタデータ） (2023-05-31T13:23:04Z)
Event Transition Planning for Open-ended Text Generation [55.729259805477376]
オープンエンドテキスト生成タスクは、事前コンテキストに制限されたコヒーレントな継続を生成するためにモデルを必要とする。オープンエンドテキスト生成におけるイベントを明示的にアレンジする新しい2段階手法を提案する。我々のアプローチは、特別に訓練された粗大なアルゴリズムとして理解することができる。
論文参考訳（メタデータ） (2022-04-20T13:37:51Z)
Uniform Complexity for Text Generation [4.867923281108005]
テキスト生成のための統一複雑度(UCTG)は,生成モデルに一様言語特性をプロンプトに関して観察させるという課題を提起する新しいベンチマークテストである。 GPT-2のようなモデルは、プロフェッショナルなテキストで微調整しても、代々使われる入力プロンプトの複雑さを維持するのに苦労している。
論文参考訳（メタデータ） (2022-04-11T15:19:47Z)

関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。