論文の概要: RALS: Resources and Baselines for Romanian Automatic Lexical Simplification
- arxiv url: http://arxiv.org/abs/2607.20078v1
- Date: Wed, 22 Jul 2026 12:31:43 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-23 18:51:38.07451
- Title: RALS: Resources and Baselines for Romanian Automatic Lexical Simplification
- Title(参考訳): RALS:ルーマニアの自動語彙単純化のためのリソースとベースライン
- Authors: Fabian Anghel, Petru Theodor Cristea, Claudiu Creanga, Sergiu Nisioi,
- Abstract要約: このデータセットは、ルーマニア語に対する語彙複雑性予測(LCP)アノテーションと語彙単純化(LS)アプローチの両方を共同でカバーしている。
本稿では,一対のランク付け近似法を用いて,単純化提案の順序付け手法を提案する。
文脈における3,921語サンプルに対して,人間の語彙的複雑性アノテーションを提供する。
- 参考スコア(独自算出の注目度): 0.758305251912708
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We introduce the first dataset that jointly covers both lexical complexity prediction (LCP) annotations and lexical simplification (LS) for Romanian, along with a comparison of lexical simplification approaches. We propose a methodology for ordering simplification suggestions using a pairwise ranking approximation method, arranging candidates from simple to complex based on a separate set of human judgments. In addition, we provide human lexical complexity annotations for 3,921 word samples in context. Finally, we explore several novel pipelines for complexity prediction and simplification and present the first text simplification system for Romanian.
- Abstract(参考訳): ルーマニア語における語彙複雑性予測(LCP)アノテーションと語彙単純化(LS)アノテーションを併用した最初のデータセットを紹介し,語彙単純化手法の比較を行った。
そこで本研究では,人的判断の別集合に基づいて,候補を単純から複雑に配置する,一対のランク付け近似法を用いて,単純化提案を順序付けする手法を提案する。
さらに,文脈における3,921単語サンプルに対して,人間の語彙的複雑性アノテーションを提供する。
最後に,複雑性予測と単純化のための新しいパイプラインについて検討し,ルーマニア語における最初のテキスト単純化システムを提案する。
関連論文リスト
- New Evaluation Paradigm for Lexical Simplification [15.890439726439276]
Lexical Simplification (LS)法では、複雑な単語識別、代用生成、代用ランキングという3段階のパイプラインを使用する。
大規模な言語モデル(LLM)は、単一のプロンプトで文を直接単純化し、従来のパイプラインをバイパスできることがわかった。
本稿では,人間と機械の協調によるオールインワンLSデータセット構築のための新しいアノテーション手法を提案する。
論文 参考訳(メタデータ) (2025-01-25T16:31:37Z) - H-STAR: LLM-driven Hybrid SQL-Text Adaptive Reasoning on Tables [56.73919743039263]
本稿では,2段階のプロセスにシンボル的アプローチと意味的アプローチ(テキスト的アプローチ)を統合し,制約に対処する新しいアルゴリズムを提案する。
実験の結果,H-STARは3つの質問応答(QA)と事実検証データセットにおいて,最先端の手法を大幅に上回っていることがわかった。
論文 参考訳(メタデータ) (2024-06-29T21:24:19Z) - Readability-guided Idiom-aware Sentence Simplification (RISS) for Chinese [1.1650821883155187]
本稿では,データ拡張技術と語彙単純化を組み合わせた新しいフレームワークRISSを提案する。
RISSは,(1)高品質な文ペアをマイニングするRPS (Readability-Guided Paraphrase Selection) と(2)認識単純化 (Aware Simplification) という,慣用的な表現の理解と単純化を促進するモデルを導入する。
論文 参考訳(メタデータ) (2024-06-05T06:15:48Z) - A New Dataset and Empirical Study for Sentence Simplification in Chinese [50.0624778757462]
本稿では,中国語で文の単純化を評価するための新しいデータセットであるCSSを紹介する。
我々は、人間のアノテーションから手作業による単純化を収集し、英語と中国語の文の簡易化の違いを示すデータ解析を行う。
最後に,CSS上で評価することで,大言語モデルが高品質な中国語文の簡易化システムとして機能するかどうかを考察する。
論文 参考訳(メタデータ) (2023-06-07T06:47:34Z) - Exploiting Summarization Data to Help Text Simplification [50.0624778757462]
テキスト要約とテキスト単純化の類似性を解析し,要約データを利用して単純化を行った。
我々はこれらのペアをSum4Simp (S4S) と命名し,S4Sが高品質であることを示す人間評価を行った。
論文 参考訳(メタデータ) (2023-02-14T15:32:04Z) - NapSS: Paragraph-level Medical Text Simplification via Narrative
Prompting and Sentence-matching Summarization [46.772517928718216]
そこで我々はNapSSと呼ばれる2段階戦略を提案する。
NapSSは、オリジナルの物語の流れが保存されていることを保証しながら、関連コンテンツを特定し、単純化する。
本モデルは,英語医療コーパスのSeq2seqベースラインよりも有意に優れている。
論文 参考訳(メタデータ) (2023-02-11T02:20:25Z) - Elaborative Simplification: Content Addition and Explanation Generation
in Text Simplification [33.08519864889526]
テキスト単純化におけるコンテンツ追加に関する最初のデータ駆動型研究について述べる。
我々は、文脈的特異性のレンズを通して、エンティティ、アイデア、概念がどのように精巧化されているかを分析する。
本研究は, 作業の複雑さを概説し, 今後の課題について多くの興味深い方向性を示唆するものである。
論文 参考訳(メタデータ) (2020-10-20T05:06:23Z) - Chinese Lexical Simplification [29.464388721085548]
中国の語彙単純化(CLS)に関する研究は行われていない。
アノテーション取得の難しさを回避するため,我々はCLSの最初のベンチマークデータセットを手作業で作成する。
複雑な単語の代用候補を生成するために,5種類のメソッドをベースラインとして提示する。
論文 参考訳(メタデータ) (2020-10-14T12:55:36Z) - ASSET: A Dataset for Tuning and Evaluation of Sentence Simplification
Models with Multiple Rewriting Transformations [97.27005783856285]
本稿では,英語で文の単純化を評価するための新しいデータセットであるASSETを紹介する。
ASSETの単純化は、タスクの他の標準評価データセットと比較して、単純さの特徴を捉えるのに優れていることを示す。
論文 参考訳(メタデータ) (2020-05-01T16:44:54Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。