論文の概要: From Abusive Language Classification to Sequence Labeling Identification
- arxiv url: http://arxiv.org/abs/2610.06287v1
- Date: Mon, 05 Oct 2026 13:14:03 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-09 09:32:17.327382
- Title: From Abusive Language Classification to Sequence Labeling Identification
- Title(参考訳): 乱用言語分類からシーケンスラベル識別へ
- Abstract要約: 産業コンテンツモデレーションは、レイテンシの厳しい制約の下で巨大なメッセージストリームを処理しなければなりません。
ほとんどの乱用言語(AL)検出システムは、文レベルの分類(ALC)に依存している。
Abusive Language Identification (ALI) は、ALスパンとターゲット参照を共同で抽出するシーケンスラベリングタスクとして定義する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by-nc-nd/4.0/
- Abstract: Industrial content moderation must process massive message streams under tight latency constraints, yet most abusive language (AL) detection systems rely on sentence-level classification (ALC), which neither localizes abusive spans nor identifies who is targeted. We define Abusive Language Identification (ALI) as a sequence-labeling task that jointly extracts AL spans and target mentions, and assess whether this approach can be used for text moderation. On a pilot corpus drawn from a production moderation pipeline, we compare ALI with ALC on cross-domain generalization and implicit abuse, and we also evaluate AL and target span detection. ALI remains competitive with ALC while providing localized outputs for moderators, with a modest and configuration-sensitive advantage on implicit abuse. Exact AL boundaries and target spans remain difficult to recover. We complement this comparison with a qualitative analysis and discuss perspectives on complete target--span linking and on structured benchmarks for ALI.
- Abstract(参考訳): 産業コンテンツモデレーションは、レイテンシの厳しい制約の下で大量のメッセージストリームを処理する必要があるが、ほとんどの乱用言語(ALC)検出システムは、乱用されたスパンをローカライズしたり、ターゲットを特定したりしない、文レベルの分類(ALC)に依存している。
Abusive Language Identification (ALI) は、ALスパンとターゲット参照を共同で抽出するシーケンスラベリングタスクとして定義し、本手法がテキストモデレーションに利用できるかどうかを評価する。
生産型モデレーションパイプラインから抽出したパイロットコーパスにおいて,ALIとALCとの比較を行い,ALおよびターゲットスパン検出の評価を行った。
ALIは、モデレーターにローカライズされた出力を提供しながら、ALCと競合し続けている。
厳密なAL境界とターゲットスパンは回復が難しいままである。
この比較を質的な分析と補完し、完全なターゲットリンクとALIのための構造化ベンチマークの視点について議論する。
関連論文リスト
- VARM-Bench: Benchmarking Verifiable Structured Reasoning in Chinese Abusive Speech Moderation [12.885908330308046]
VARM-Benchは、モデレーション決定の条件を決定論的に検証するためのベンチマークである。
本プロトコルは、フィールドの正確性、ターゲットアライメント、出力の妥当性、完全レコード契約、隠れレコードエラーを評価する。
その結果, ラベルレベルの高い性能は, 完全なモデレーションレコードにかなりの誤差を隠蔽する可能性が示唆された。
論文 参考訳(メタデータ) (2026-08-16T07:52:31Z) - Inference-Time Steering for Cross-Lingual Factual Consistency in LLMs [51.56484100374058]
大規模言語モデル(LLM)は目覚ましい多言語流布を示すが、その内部知識表現はハイリソース言語に対して不均等に偏っている。
我々は,これらのバイアスを推論時に緩和できるかどうかを考察し,対象言語でクエリされたかのように,英語の確率モデルに答えるように強制する。
Gemma 3 12Bの実験では、最も強い全体的な介入、効率性のバランス、安全性、ドメイン外の一般化を促すペルソナが明らかにされている。
論文 参考訳(メタデータ) (2026-07-21T16:15:05Z) - STRIDE: Learnable Stepwise Language Feedback for LLM Reasoning [80.78140312980484]
我々はSTRIDEと呼ばれる言語駆動の段階的軌道リダイレクトを提案する。
我々は、結果に基づく報酬のみを使用して生成器と生成検証器を共同で訓練し、外部アノテーションを除去する。
様々な推論ベンチマークの実験では、STRIDEが最先端のベースラインを大幅に上回っていることが示されている。
論文 参考訳(メタデータ) (2026-05-13T11:04:31Z) - Exploring Hierarchical Consistency and Unbiased Objectness for Open-Vocabulary Object Detection [38.31141459207419]
オープン語彙オブジェクト検出(OVD)のための新しい擬似ラベリングフレームワークを提案する。
提案手法は階層的信頼度キャリブレーション(HCC)手法を導入し,信頼性の高いクラスラベル推定を実現する。
また、ベースクラスバイアス問題を緩和するために、オブジェクト性トークンを組み込んだパラメータ効率の高いCLIP適応であるLoCLIPを提案する。
論文 参考訳(メタデータ) (2026-04-25T15:06:07Z) - Job Skill Extraction via LLM-Centric Multi-Module Framework [51.37063712967151]
本稿では,意味検索,文脈内学習,教師付き微調整を組み合わせたLLM中心のフレームワークであるSRICLを提案する。
SRICLは、6つの公的なスパンラベル付きジョブアド文のコーパスにおいて、GPT-3.5よりも相当なSTRICT-F1の改善を達成し、ベースラインを加速し、無効なタグと幻覚したスパンを激減する。
論文 参考訳(メタデータ) (2026-04-23T10:46:07Z) - TAG: Target-Agnostic Guidance for Stable Object-Centric Inference in Vision-Language-Action Models [59.13964209628383]
VLA(Vision-Language-Action)ポリシーは、言語指示や視覚的な観察をロボット行動にマッピングする上で大きな進歩を見せている。
本稿では,VLA政策における乱れや外見に起因したバイアスを明示的に軽減する単純な推論時ガイダンス機構であるTAG(Target-Agnostic Guidance)を提案する。
我々は, LIBERO, LIBERO-Plus, VLABenchなどの標準操作ベンチマーク上でTAGを評価し, クラッタ下での堅牢性を一貫して改善し, ニアミスや不正なオブジェクト実行を減らす。
論文 参考訳(メタデータ) (2026-03-25T17:56:32Z) - AQAScore: Evaluating Semantic Alignment in Text-to-Audio Generation via Audio Question Answering [97.52852990265136]
音声対応大規模言語モデルの推論機能を活用するバックボーン非依存評価フレームワークであるAQAScoreを紹介する。
AQAScoreは人格関連性、ペア比較、構成推論タスクを含む複数のベンチマークで評価する。
論文 参考訳(メタデータ) (2026-01-21T07:35:36Z) - EdaDet: Open-Vocabulary Object Detection Using Early Dense Alignment [28.983503845298824]
本稿では,一般化可能な局所意味論とオブジェクトレベルの予測とのギャップを埋めるために,早期Dense Alignment (EDA)を提案する。
EDAでは、局所的なきめ細かなセマンティクスを維持するために、オブジェクトレベルのアライメントではなく、オブジェクトレベルのインシデントを学習するためにオブジェクトレベルのインシデントを使用します。
論文 参考訳(メタデータ) (2023-09-03T12:04:14Z) - Ambiguity-Resistant Semi-Supervised Learning for Dense Object Detection [98.66771688028426]
本研究では,一段階検出器のためのAmbiguity-Resistant Semi-supervised Learning (ARSL)を提案する。
擬似ラベルの分類とローカライズ品質を定量化するために,JCE(Joint-Confidence Estimation)を提案する。
ARSLは、曖昧さを効果的に軽減し、MS COCOおよびPASCALVOC上で最先端のSSOD性能を達成する。
論文 参考訳(メタデータ) (2023-03-27T07:46:58Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。