論文の概要: Mawqif-XT: An Arabic Benchmark Dataset for Cross-Target Stance Detection
- arxiv url: http://arxiv.org/abs/2608.09539v2
- Date: Thu, 13 Aug 2026 15:13:49 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-14 14:00:09.564343
- Title: Mawqif-XT: An Arabic Benchmark Dataset for Cross-Target Stance Detection
- Title(参考訳): Mawqif-XT:クロスターゲットスタンス検出のためのアラビアベンチマークデータセット
- Abstract要約: 本稿では,996個のアラビア文字を手動で注釈付けしたMawqif-XTを提案する。
各ツイートには、オリジナルのMawqifアノテーションスキームに従って、スタンス、感情、皮肉ラベルがアノテートされている。
Mawqif-v2拡張は、アラビアスタンス検出において、ターゲット間の一般化を評価するためのベンチマークを提供する。
- 参考スコア(独自算出の注目度): 5.221944297474869
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Publicly available Arabic datasets for target-specific stance detection remain limited, particularly for evaluating cross-target generalization. This paper presents the Mawqif-XT, consisting of 996 manually annotated Arabic tweets collected from three public targets: Women Driving, E-Cars, and Trimester System. Each tweet is annotated with stance, sentiment, and sarcasm labels following the original Mawqif annotation scheme. The released extension is intended as a held-out evaluation set for assessing model generalization to both semantically related and previously unseen targets, while the original Mawqif dataset is used for training and development. In addition, we establish baseline results using several Arabic and multilingual transformer models, as well as zero-shot large language models (LLMs), to facilitate reproducible evaluation. Together with the original Mawqif dataset, the Mawqif-v2 Extension provides a benchmark for evaluating cross-target generalization in Arabic stance detection.
- Abstract(参考訳): 公的に利用可能なターゲット固有の姿勢検出のためのアラビアデータセットは、特にターゲット間の一般化を評価するために限られている。
本稿では,女性運転,Eカー,トリメスターシステムという3つの公的な目標から収集した,996件のアラビア語ツイートを手動で注釈付けしたMawqif-XTを提案する。
各ツイートには、オリジナルのMawqifアノテーションスキームに従って、スタンス、感情、皮肉ラベルがアノテートされている。
リリースされた拡張は、セマンティック関連および以前は目に見えないターゲットの両方に対するモデルの一般化を評価するためのホールドアウト評価セットとして意図されており、オリジナルのMawqifデータセットはトレーニングと開発に使用されている。
さらに,複数のアラビアおよび多言語トランスフォーマーモデルとゼロショット大言語モデル(LLM)を用いて,再現可能な評価を容易にする。
オリジナルのMawqifデータセットとともに、Mawqif-v2拡張はアラビアスタンス検出におけるクロスターゲットの一般化を評価するためのベンチマークを提供する。
関連論文リスト
- Czech Dataset for Complex Aspect-Based Sentiment Analysis Tasks [0.7874708385247352]
本稿ではアスペクトベース感情分析(ABSA)のための新しいデータセットを提案する。
レストランドメインからの注釈付きレビューが手作業で3.1Kである。
教師なし学習に適したアノテーションを使わずに2400万のレビューを提供する。
論文 参考訳(メタデータ) (2025-08-11T16:03:28Z) - EMT: A Visual Multi-Task Benchmark Dataset for Autonomous Driving [8.97091577113286]
Emirates Multi-Taskデータセットは、統一されたフレームワーク内でマルチタスクのベンチマークをサポートするように設計されている。
ダッシュカメラの視界から3万枚以上のフレームと570,000点の注釈付きバウンディングボックスで構成され、約150kmの走行経路をカバーしている。
論文 参考訳(メタデータ) (2025-02-26T16:06:35Z) - BESSTIE: A Benchmark for Sentiment and Sarcasm Classification for Varieties of English [8.823927892310238]
BESSTIEは、オーストラリア(en-AU)、インド(en-IN)、イギリス(en-UK)の3種類の英語に対する感情と皮肉の分類のベンチマークである。
Google PlacesレビューのロケーションベースとRedditコメントのトピックベースフィルタリングの2つの方法を用いて,これらの言語品種のデータセットを収集した。
言語変異のネイティブ話者は、感情ラベルと皮肉ラベルでデータセットを手動で注釈付けする。
論文 参考訳(メタデータ) (2024-12-06T02:34:40Z) - Sarcasm in Sight and Sound: Benchmarking and Expansion to Improve
Multimodal Sarcasm Detection [68.82684696740134]
我々は、MUStARDデータセットを最先端の言語、スピーチ、ビジュアルエンコーダでベンチマークし、提供しなければならないマルチモーダルリッチネスの総量を完全に活用する。
emphMUStARD++ Balancedと呼ばれるエクステンションを提案し、エクステンションのインスタンスを列車とテストセットの両方に分割してベンチマークし、さらに2.4%のマクロF1向上を実現した。
論文 参考訳(メタデータ) (2023-09-29T07:00:41Z) - AceGPT, Localizing Large Language Models in Arabic [73.39989503874634]
本稿では,アラビア語のテキストによる事前学習,ネイティブなアラビア語命令を利用したSFT(Supervised Fine-Tuning),アラビア語のGPT-4応答を含む総合的なソリューションを提案する。
目標は、文化的に認知され、価値に整合したアラビア語のLLMを、多様で応用特有のアラビア語コミュニティのニーズに適応させることである。
論文 参考訳(メタデータ) (2023-09-21T13:20:13Z) - FRMT: A Benchmark for Few-Shot Region-Aware Machine Translation [64.9546787488337]
本稿では、Few-shot Region-aware Machine Translationのための新しいデータセットと評価ベンチマークFRMTを提案する。
このデータセットは、英語からポルトガル語と中国語の2つの地域変種へのプロの翻訳で構成されている。
論文 参考訳(メタデータ) (2022-10-01T05:02:04Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。