論文の概要: Letters hide the truth from our eyes: English homophones have meaningfully different phonetic realizations
- arxiv url: http://arxiv.org/abs/2608.26749v1
- Date: Thu, 27 Aug 2026 07:44:14 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-28 16:30:58.293354
- Title: Letters hide the truth from our eyes: English homophones have meaningfully different phonetic realizations
- Title(参考訳): 英語のホモフォンは、意味のある異なる音素認識を持っている
- Authors: Yu-Hsiang Tseng, Mirjam T. C. Ernestus, Louis F. M. ten Bosch, R. Harald Baayen,
- Abstract要約: 英語のホモフォンの単語持続時間の分布は、使用頻度と共変であることが知られている。
本研究は、ホモフォンの音素的実現の他の側面も異なるかどうかを考察する。
- 参考スコア(独自算出の注目度): 0.29165586612027233
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: The distribution of spoken word duration of English homophones is known to co-vary with frequency of use. This study investigates whether other aspects of the phonetic realization of homophones also differ. A series of quantitative investigations of 14,000 homophone tokens in American television news broadcasts revealed that the tokens of homophone pairs such as \textit{weight} and \textit{wait} have different phonetic realizations, and that these can be predicted from their meanings in utterance context. These systematic differences remain even when taking duration-related variation into account. Time-normalized spectrograms emerged as an excellent tool for probing the fine details of phonetic realization, and obviate the need for phonetic transcriptions, which inevitably hide the phonetic truth from our eyes.
- Abstract(参考訳): 英語のホモフォンの単語持続時間の分布は、使用頻度と共変であることが知られている。
本研究は、ホモフォンの音素的実現の他の側面も異なるかどうかを考察する。
アメリカのテレビ放送における14,000個のホモフォントークンの定量的調査により、‘textit{weight} や \textit{wait} のようなホモフォンペアのトークンは異なる音素認識を持ち、それらの意味から発話コンテキストで予測できることが判明した。
これらの系統的な違いは、持続的変化を考慮しても残る。
タイムノーマライズド・スペクトログラムは、音素認識の細部を探究するための優れたツールとして登場し、必然的に私たちの目から音素の真実を隠蔽する音素転写の必要性を回避した。
関連論文リスト
- Beyond bouba/kiki: Multidimensional semantic signals are deeply woven into the fabric of natural language [0.0]
英語の個々の文字音素が構造化された多次元意味信号を持っていることを示す。
本研究は,音意味の象徴性は時折好奇心ではなく,音韻信号の広範で構造的な性質であることを示す。
論文 参考訳(メタデータ) (2026-03-18T03:02:10Z) - Speech Codec Probing from Semantic and Phonetic Perspectives [49.01048570474675]
音声トークン化器は,マルチモーダルシステムにおいて,音声を大言語モデル (LLM) に接続するために必須である。
新たな証拠は、音声表現において「意味」と呼ばれるものは、テキスト由来の意味論と一致しないことを示している。
論文 参考訳(メタデータ) (2026-03-11T03:32:25Z) - Languages in Multilingual Speech Foundation Models Align Both Phonetically and Semantically [58.019484208091534]
事前訓練された言語モデル(LM)における言語間アライメントは、テキストベースのLMの効率的な転送を可能にしている。
テキストに基づく言語間アライメントの発見と手法が音声に適用されるかどうかについては、未解決のままである。
論文 参考訳(メタデータ) (2025-05-26T07:21:20Z) - The Hidden Dance of Phonemes and Visage: Unveiling the Enigmatic Link
between Phonemes and Facial Features [27.89284938655708]
この研究は、音素と顔の特徴の巧妙なリンクを明らかにする。
生理学的観点から見ると、音声の各部分(音素)は、顔の様々な種類の気流と動きに対応している。
その結果, 子音, 特に発声音と比較して, AMは母音からより予測可能であることが示唆された。
論文 参考訳(メタデータ) (2023-07-26T04:08:12Z) - Cross-linguistic differences in gender congruency effects: Evidence from
meta-analyses [0.0]
語が生産される順序は話者の言語に依存することが提案されている。
ドイツ語またはオランダ語の話者は、比較的初期の生産で性別をマークした決定者を選ぶ。
フランス語またはイタリア語の話者は、名詞の音韻学的形式が利用可能になるまで、決定子または形容詞の符号化を延期する。
論文 参考訳(メタデータ) (2021-09-08T08:27:47Z) - Differentiable Allophone Graphs for Language-Universal Speech
Recognition [77.2981317283029]
言語ユニバーサル音声認識システムを構築するには、言語間で共有可能な音声の音韻単位を生成する必要がある。
本稿では,音素転写と音声-音素マッピングのみから,音素レベルの監視を導出するための一般的な枠組みを提案する。
我々は,各言語に対する可読確率的音声-音素マッピングを用いた普遍的な電話ベース音声認識モデルを構築した。
論文 参考訳(メタデータ) (2021-07-24T15:09:32Z) - Phoneme Recognition through Fine Tuning of Phonetic Representations: a
Case Study on Luhya Language Varieties [77.2347265289855]
音韻アノテーションに基づく多言語認識手法であるAllosaurus を用いた音素認識に焦点を当てた。
挑戦的な実世界シナリオで評価するために,我々は,ケニア西部とウガンダ東部のluhya言語クラスタの2つの種類であるbukusuとsaamiaの音声認識データセットをキュレートした。
私たちは、アロサウルスの微調整がわずか100発話であっても、電話のエラー率を大幅に改善することが分かりました。
論文 参考訳(メタデータ) (2021-04-04T15:07:55Z) - Phonotactic Complexity and its Trade-offs [73.10961848460613]
この単純な測度により、言語間のエントロピーを比較することができる。
音素あたりのビット数と単語の平均長との間には-0.74の非常に強い負の相関関係を示す。
論文 参考訳(メタデータ) (2020-05-07T21:36:59Z) - AlloVera: A Multilingual Allophone Database [137.3686036294502]
AlloVeraは、218のアロフォンから14言語のための音素へのマッピングを提供する。
我々は、AlloVeraで構築された「ユニバーサル」アロフォンモデルであるAllosaurusが、音声書き起こしタスクにおいて「ユニバーサル」音声モデルと言語特化モデルより優れていることを示す。
論文 参考訳(メタデータ) (2020-04-17T02:02:18Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。