論文の概要: A Layered Taxonomy for Chinese Learner Grammatical Error Annotation
- arxiv url: http://arxiv.org/abs/2609.02153v1
- Date: Wed, 02 Sep 2026 06:06:42 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-03 17:53:18.101658
- Title: A Layered Taxonomy for Chinese Learner Grammatical Error Annotation
- Title(参考訳): 中国語学習者の文法的誤りアノテーションのための階層分類法
- Authors: Mengyang Qiu, Jungyeul Park,
- Abstract要約: 本稿では,中国語の文法的誤り訂正と教育的誤り解析を結びつける階層型手法を提案する。
このスキームはまず文字レベルと句読点レベルの正書法誤差を特定し、それらを編集操作とサブタイプによってラベル付けする。
他のエラーには、編集操作、言語ドメイン、音声の一部を組み合わせた3層コアラベルと、オプションの中国語固有の拡張がある。
- 参考スコア(独自算出の注目度): 8.035521056416242
- License: http://creativecommons.org/licenses/by-nc-nd/4.0/
- Abstract: Grammatical error annotation in Chinese learner writing requires labels that are both consistent and linguistically meaningful. This paper proposes a layered scheme linking computational Chinese grammatical error correction (CGEC) with pedagogical error analysis. The scheme first identifies character- and punctuation-level orthographic errors, labeling them by edit operation and subtype. Other errors receive a three-layer core label combining edit operation, linguistic domain, and part of speech, with optional Chinese-specific extensions for aspect, modality, comparison, argument structure, and complements. Drawing on CGEC resources, learner-error taxonomies, and Mandarin grammar, the taxonomy is evaluated through a coverage analysis of automatically extracted MuCGEC edits and a preliminary consistency study in which five large language models apply it to a sample. The results support the layered approach while identifying category boundaries requiring further refinement.
- Abstract(参考訳): 中国語学習者記述における文法的誤りアノテーションは、一貫性と言語学的に意味のあるラベルを必要とする。
本稿では,中国語の文法的誤り訂正(CGEC)と教育的誤り解析を結合した階層型スキームを提案する。
このスキームはまず文字レベルと句読点レベルの正書法誤差を特定し、それらを編集操作とサブタイプによってラベル付けする。
他のエラーには、編集操作、言語ドメイン、および音声の一部を組み合わせた3層コアラベルがあり、アスペクト、モダリティ、比較、引数構造、補間のためのオプションの中国語固有の拡張がある。
CGECリソース、学習者エラー分類学、マンダリン文法に基づいて、自動抽出されたMUCGEC編集のカバレッジ分析と、5つの大きな言語モデルをサンプルに適用した予備的一貫性調査により、分類を評価する。
結果は、さらなる改良を必要とするカテゴリ境界を特定しながら、階層化アプローチをサポートする。
関連論文リスト
- Refining Word-Based Grammatical Error Annotation for L2 Korean [10.887221248702879]
韓国の文法的誤り訂正(K-GEC)では,単語に基づく評価と多くの学習者誤りのモーデムレベルの軌跡との間に構造的ミスマッチが生じる。
本稿では,既存の資源の3つの接続問題に対処することにより,L2韓国語に対する単語ベースの文法的誤りアノテーションを改良する。
論文 参考訳(メタデータ) (2026-05-28T20:27:36Z) - Linguistically Informed Graph Model and Semantic Contrastive Learning for Korean Short Text Classification [2.4071330817126477]
韓国の短文分類のための階層的ヘテロジニアスグラフモデルであるLIGRAMを提案する。
提案モデルでは, 形態素, パート・オブ・スポーチ, 名前の一致度でサブグラフを構築し, 階層的に統合し, 短いテキストで限られた文脈情報を補う。
韓国の4つの短文データセット上でLIGRAMを評価し、既存のベースラインモデルより一貫して優れています。
論文 参考訳(メタデータ) (2026-03-04T02:17:13Z) - A Taxonomy of Errors in English as she is spoke: Toward an AI-Based Method of Error Analysis for EFL Writing Instruction [0.0]
本研究では,英語における誤りの特定,分類,訂正を目的としたAI支援誤り解析システムの開発について述べる。
この体系は、Corder (1967)、Richards (1971)、James (1998) の言語理論に基づく詳細な分類法を採用している。
AIは様々なエラータイプを特定したが、コンテキスト理解の制限を示し、時には未コーディングエラーに遭遇した時に新しいエラーカテゴリを生成した。
論文 参考訳(メタデータ) (2025-11-29T08:45:00Z) - Chinese Grammatical Error Correction: A Survey [2.6914312267666705]
中国語の文法的誤り訂正(CGEC)は自然言語処理において重要な課題である。
CGECは、第二言語 (L2) とネイティブ (L1) の両方における自動筆記支援の需要の増加に対処している。
本調査は、データセット、アノテーションスキーム、評価手法、システム進歩など、CGEC研究の総合的なレビューを提供する。
論文 参考訳(メタデータ) (2025-04-01T17:14:50Z) - Chinese Spelling Correction as Rephrasing Language Model [63.65217759957206]
文中のスペル誤りを検知し,訂正することを目的とした中国語スペル補正(CSC)について検討する。
現在の最先端の手法は、CSCをシーケンスタギングタスクと文対上の細いBERTベースのモデルとみなしている。
本稿では,文字から文字へのタグ付けではなく,追加のスロットを埋め込むことで文全体を言い換える言語モデル(ReLM)を提案する。
論文 参考訳(メタデータ) (2023-08-17T06:04:28Z) - Multilingual Extraction and Categorization of Lexical Collocations with
Graph-aware Transformers [86.64972552583941]
我々は,グラフ対応トランスフォーマアーキテクチャにより拡張されたBERTに基づくシーケンスタグ付けモデルを提案し,コンテキストにおけるコロケーション認識の課題について評価した。
以上の結果から, モデルアーキテクチャにおける構文的依存関係を明示的に符号化することは有用であり, 英語, スペイン語, フランス語におけるコロケーションのタイプ化の差異について考察する。
論文 参考訳(メタデータ) (2022-05-23T16:47:37Z) - Improving Pre-trained Language Models with Syntactic Dependency
Prediction Task for Chinese Semantic Error Recognition [52.55136323341319]
既存の中国語のテキスト誤り検出は主にスペルと単純な文法的誤りに焦点を当てている。
中国の意味的誤りは、人間が容易に認識できないほど過小評価され、複雑である。
論文 参考訳(メタデータ) (2022-04-15T13:55:32Z) - A Syntax-Guided Grammatical Error Correction Model with Dependency Tree
Correction [83.14159143179269]
文法的誤り訂正(英: Grammatical Error Correction, GEC)は、文中の文法的誤りを検出し、訂正するタスクである。
本稿では,依存木の構文知識を利用するためのグラフアテンション機構を採用した構文誘導型GECモデル(SG-GEC)を提案する。
我々は、GECタスクの公開ベンチマークでモデルを評価し、競争結果を得る。
論文 参考訳(メタデータ) (2021-11-05T07:07:48Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。