論文の概要: Do Language Models Know Their Slang? Queer Slang Understanding in User-Generated Content
- arxiv url: http://arxiv.org/abs/2608.04847v1
- Date: Wed, 05 Aug 2026 13:40:48 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-06 14:48:43.944544
- Title: Do Language Models Know Their Slang? Queer Slang Understanding in User-Generated Content
- Title(参考訳): 言語モデルはスラングを知っているか? ユーザ生成コンテンツにおけるクイアスラング理解
- Authors: Arianna Denitto, Beatrice Savoldi,
- Abstract要約: Slang-Qは、自然に生成した英文のデータセットであり、クイア・スラング用語と参照定義とを組み合わせている。
我々はこのリソースを用いて、クエリスラングを理解して定義する能力に基づいて、言語モデルの最初の探索的評価を行う。
- 参考スコア(独自算出の注目度): 2.174476613068234
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Despite its cultural relevance and diffusion, queer slang remains underrepresented in Natural Language Processing research. Towards addressing this gap, we introduce Slang-Q, a manually curated dataset of naturally user-generated English sentences paired with queer slang terms and reference definitions, built upon a newly constructed taxonomy of 118 queer terms. We use this resource to conduct a first exploratory evaluation of language models on their ability to understand and define queer slang under varying prompting conditions. Slang-Q is intended as a basis for studying how current models handle sensitive, community-specific language and whether they can provide accurate and reliable information about such forms of identity and linguistic expression.
- Abstract(参考訳): 文化的な関連性や拡散にもかかわらず、クィア・スラングは自然言語処理の研究において不足している。
このギャップに対処するために,新たに構築された118のクイア項の分類に基づいて構築された,クイアスラング用語と参照定義とを組み合わせて,自然に生成した英語文を手作業で収集したデータセットであるSlang-Qを導入する。
このリソースを用いて言語モデルの最初の探索的評価を行い、様々なプロンプト条件下でキースラングの理解と定義を行う。
Slang-Qは、現在のモデルがコミュニティ固有の言語をどのように扱うか、そしてそれらがそのようなアイデンティティや言語表現の形式について正確かつ信頼性の高い情報を提供できるかどうかを研究するための基盤として意図されている。
関連論文リスト
- SLAyiNG: Towards Queer Language Processing [44.4984082814346]
SLAyiNGは、字幕、ソーシャルメディア投稿、ポッドキャストから派生した注釈付きキースラングを含む最初のデータセットである。
本稿では,スラング用語と定義の収集を含むデータキュレーションプロセスについて述べる。
予備的な結果として,人間のアノテータとOpenAIのモデルo3-miniのアノテータ間合意を計算する。
論文 参考訳(メタデータ) (2025-09-22T07:41:45Z) - Holmes: A Benchmark to Assess the Linguistic Competence of Language Models [59.627729608055006]
言語モデル(LM)の言語能力を評価するための新しいベンチマークであるHolmesを紹介する。
我々は、計算に基づく探索を用いて、異なる言語現象に関するLMの内部表現を調べる。
その結果,近年,他の認知能力からLMの言語能力を引き離す声が上がっている。
論文 参考訳(メタデータ) (2024-04-29T17:58:36Z) - A Study of Slang Representation Methods [3.511369967593153]
我々は,スラング理解に依存した様々な下流タスクに対して,表現学習モデルと知識資源の異なる組み合わせについて検討する。
誤り解析では、語彙外単語、多意味性、分散性、アノテーションの不一致など、スラング表現学習における中核的な課題を識別する。
論文 参考訳(メタデータ) (2022-12-11T21:56:44Z) - Transparency Helps Reveal When Language Models Learn Meaning [71.96920839263457]
合成データを用いた体系的な実験により,すべての表現が文脈に依存しない意味を持つ言語では,自己回帰型とマスキング型の両方の言語モデルが,表現間の意味的関係をエミュレートする。
自然言語に目を向けると、特定の現象(参照不透明さ)による実験は、現在の言語モデルが自然言語の意味論をうまく表現していないという証拠を増大させる。
論文 参考訳(メタデータ) (2022-10-14T02:35:19Z) - AUTOLEX: An Automatic Framework for Linguistic Exploration [93.89709486642666]
本稿では言語学者による言語現象の簡潔な記述の発見と抽出を容易にするための自動フレームワークを提案する。
具体的には、この枠組みを用いて、形態的一致、ケースマーキング、単語順序の3つの現象について記述を抽出する。
本研究では,言語専門家の助けを借りて記述を評価し,人間の評価が不可能な場合に自動評価を行う手法を提案する。
論文 参考訳(メタデータ) (2022-03-25T20:37:30Z) - The Rediscovery Hypothesis: Language Models Need to Meet Linguistics [8.293055016429863]
現代言語モデルの性能向上に言語知識が必須条件であるかどうかを検討する。
その結果, 言語構造を探索した場合, かなり圧縮されるが, 事前学習目的によく適合する言語モデルは, 良好なスコアを保っていることがわかった。
この結果は再発見仮説を支持し,本論文の第2の貢献である言語モデル目標と言語情報との関連性に関する情報論的枠組みを導出する。
論文 参考訳(メタデータ) (2021-03-02T15:57:39Z) - A Computational Framework for Slang Generation [2.1813490315521773]
我々は、スラングコンテキストにおける話者の単語選択をモデル化するフレームワークを開発することにより、スラングの機械生成に向けた最初の一歩を踏み出した。
本フレームワークは,従来の単語のスラング感覚とスラング感覚を関連付けることで,新しいスラングの意味を符号化する。
我々は3つのスラング辞書に対して厳密な評価を行い、我々のアプローチが最先端の言語モデルより優れていることを示す。
論文 参考訳(メタデータ) (2021-02-03T01:19:07Z) - Grounded Compositional Outputs for Adaptive Language Modeling [59.02706635250856]
言語モデルの語彙$-$典型的にはトレーニング前に選択され、後で永久に固定される$-$は、そのサイズに影響します。
言語モデルのための完全合成出力埋め込み層を提案する。
我々の知る限り、この結果はトレーニング語彙に依存しないサイズを持つ最初の単語レベル言語モデルである。
論文 参考訳(メタデータ) (2020-09-24T07:21:14Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。