論文の概要: A Quantitative Confirmation of the Currier Language Distinction
- arxiv url: http://arxiv.org/abs/2604.25979v1
- Date: Tue, 28 Apr 2026 14:18:38 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-30 15:59:36.118922
- Title: A Quantitative Confirmation of the Currier Language Distinction
- Title(参考訳): Currier Language Distinction の定量的確認
- Abstract要約: 本稿では,CurrierのA/B言語の違いが本文の真の構造特性を反映しているかどうかを考察する。
ラベルにアクセスせずに原文字数に適用したβ-Binomial混合モデルは、ARI = 0.383でカーリヤ分割を回復する。
フォリオのサブセットで訓練された教師付きベータ・ビノミアル分類器は、ホールドアウト・フォリオのA/Bアイデンティティを89.2%精度で予測する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We present a quantitative analysis of character-pair substitution ratios in the Voynich manuscript, testing whether Currier's A/B language distinction (1976) reflects a genuine structural property of the text. A Beta-Binomial mixture model applied to raw character counts without access to labels recovers the Currier split with ARI = 0.383. A supervised Beta-Binomial classifier trained on a subset of folios predicts the A/B identity of held-out folios at 89.2% accuracy. The character pairs separate into three functional regimes that constrain any theory of the Voynich writing system.
- Abstract(参考訳): 本稿では,Voynich 写本における文字対置換比の定量的解析を行い,Currier の A/B 言語区別 (1976) が本文の真の構造特性を反映しているかどうかを検証した。
ラベルにアクセスせずに原文字数に適用したβ-Binomial混合モデルは、ARI = 0.383でカーリヤ分割を回復する。
フォリオのサブセットで訓練された教師付きベータ・ビノミアル分類器は、ホールドアウト・フォリオのA/Bアイデンティティを89.2%精度で予測する。
文字対は、ヴォイニヒ文字体系の理論を制約する3つの機能的体系に分けられる。
関連論文リスト
- When AI Writes, Who Gets Cited? Evidence of Citation Monoculture Across Language Models [45.91367912142692]
異なるモデルがいまだに同じ狭い部分集合を選択している可能性を示し、単一の引用が誤りを犯さずに、引用モノカルチャーを生成する。
3つのベンダーの11のモデルが、30のランダムなパネルから少なくとも10の論文を選択しており、実際のタイトルと抽象物があるが、作者が作り直され、再割り当て年、隠れた会場と引用数がある。
論文 参考訳(メタデータ) (2026-08-03T14:27:46Z) - Sixteen models, fewer than two voices: measuring ensemble dispersion where no answer is uniquely correct [37.64799781700206]
平均して10の家系から抽出された16の言語モデルでは、精神療法ケースの1.69の異なる定式化のセマンティック多様性が生み出された。
アウトプットの分散は多様性と不確実性の両方として測定される。
論文 参考訳(メタデータ) (2026-07-31T20:42:53Z) - Selection Shapes the Boundary: A Preregistered Replication of Monotonicity and Label Agreement in Unselected NLI Populations [1.9177583131035885]
以前の研究では、上向きの単調性演算子を含む仮説はラベルの一致が低かった。
我々は,同じオペレータタグと4段階の順序一致結果を用いて,この境界の複製を事前登録した。
より初期の負の境界は、人口レベルの特性よりも低アグリメント選択に条件づけられた構造であると結論付けている。
論文 参考訳(メタデータ) (2026-07-21T16:03:05Z) - Legible-by-Construction: Attention and End-to-End Transformers [0.2663471820643486]
トランスのフィードフォワード層は明示的なファジィ集合演算から再構築することができる。
隠れたユニットは言語モデルの品質を犠牲にすることなく、名前付き論理演算子として読み上げられた。
125Mパラメータの5つの特別なアテンション設計において、44から62%の値チャネルが正当性を持つ。
論文 参考訳(メタデータ) (2026-07-05T14:08:59Z) - Accurate and Efficient Statistical Testing for Word Semantic Breadth [0.0]
分散に基づく統計は、文脈的多様性のプロキシとして機能する。
そこで本研究では,方向の相違から相違点を分離するために,世帯適応型変質試験を提案する。
本手法は, 真の広帯域差に対する感度を保ちながら, Type-I誤差を32.5%削減する。
論文 参考訳(メタデータ) (2026-05-08T17:38:36Z) - Towards a Linguistic Evaluation of Narratives: A Quantitative Stylistic Framework [51.56484100374058]
本研究は, 品質の指標としての言語的次元に着目し, ナラティブアセスメントに対する定量的アプローチを提案する。
本稿では,33種類の定量的言語的特徴を包括的に抽出し,物語の自動評価手法を提案する。
論文 参考訳(メタデータ) (2026-04-21T09:21:40Z) - Agentic Cognitive Profiling: Realigning Automated Alzheimer's Disease Detection with Clinical Construct Validity [66.94391219005291]
本稿では,臨床プロトコルロジックによる自動スクリーニングを実現するエージェント認知プロファイリング(ACP)を提案する。
我々の設計の中心は、すべての定量化を決定論的関数呼び出しに委譲することで、測定から意味的理解を分離することである。
ACPは、タスク試験で90.5%のスコアマッチ率、AD予測で85.3%の精度を達成し、一般的な基準を上回っている。
論文 参考訳(メタデータ) (2026-03-18T06:15:35Z) - Revisiting Northrop Frye's Four Myths Theory with Large Language Models [0.0]
ノースロップ・フライの4つの基本的物語ジャンルの理論は文学的批判に大きな影響を与えた。
パターンに基づく分析を補完する新しいキャラクタ関数フレームワークを提案する。
4つの普遍的性格関数(主人公,メンター,アンタゴニスト,仲間)をユングの精神構造成分にマッピングすることで導出する。
論文 参考訳(メタデータ) (2026-02-17T16:02:52Z) - DEUCE: Dual-diversity Enhancement and Uncertainty-awareness for Cold-start Active Learning [54.35107462768146]
コールドスタートアクティブラーニング(CSAL)は、手動アノテーションのためのラベルなしデータセットから貴重なインスタンスを選択する。
既存のCSAL手法は、弱いクラスと強い代表例を見落とし、バイアス学習をもたらす。
本稿ではCSALのための新しい二変量拡張および不確実性認識フレームワークを提案する。
論文 参考訳(メタデータ) (2025-02-01T04:00:03Z) - Estimating the Influence of Sequentially Correlated Literary Properties in Textual Classification: A Data-Centric Hypothesis-Testing Approach [4.161155428666988]
逐次的に相関した文学的特性の影響を定量化するために,データ中心の仮説テストフレームワークを導入する。
従来の(単語n-gramと文字k-mer)とニューラル(対照的に訓練された)埋め込みを、教師なしと教師なしの両方の分類設定で比較する。
その結果, 逐次相関の制御は偽陽性の低減に不可欠であることが示唆された。
論文 参考訳(メタデータ) (2024-11-07T18:28:40Z) - CopyBench: Measuring Literal and Non-Literal Reproduction of Copyright-Protected Text in Language Model Generation [132.00910067533982]
LM世代におけるリテラルコピーと非リテラルコピーの両方を測定するために設計されたベンチマークであるCopyBenchを紹介する。
リテラル複写は比較的稀であるが、イベント複写と文字複写という2種類の非リテラル複写は、7Bパラメータのモデルでも発生する。
論文 参考訳(メタデータ) (2024-07-09T17:58:18Z) - Explainability of machine learning approaches in forensic linguistics: a case study in geolinguistic authorship profiling [46.58131072375399]
法医学的文脈を考慮した機械学習手法の説明可能性について検討する。
我々は、ドイツ語圏のソーシャルメディアデータに基づく未知のテキストのジオ言語的プロファイリングの手段として、多種多様な分類に焦点を当てた。
抽出した語彙的特徴がそれぞれの品種を実際に代表しており、訓練されたモデルは分類の場所名にも依存していることに注意する。
論文 参考訳(メタデータ) (2024-04-29T08:52:52Z) - Individual Text Corpora Predict Openness, Interests, Knowledge and Level of Education [0.5825410941577593]
個々の検索履歴から経験への開放性の個性次元を予測することができる。
個々のテキストコーパス(IC)は,平均500万ワードトークン数214人の参加者から生成される。
論文 参考訳(メタデータ) (2024-03-29T21:44:24Z) - Ambiguity-Resistant Semi-Supervised Learning for Dense Object Detection [98.66771688028426]
本研究では,一段階検出器のためのAmbiguity-Resistant Semi-supervised Learning (ARSL)を提案する。
擬似ラベルの分類とローカライズ品質を定量化するために,JCE(Joint-Confidence Estimation)を提案する。
ARSLは、曖昧さを効果的に軽減し、MS COCOおよびPASCALVOC上で最先端のSSOD性能を達成する。
論文 参考訳(メタデータ) (2023-03-27T07:46:58Z) - From exemplar to copy: the scribal appropriation of a Hadewijch
manuscript computationally explored [1.9798034349981157]
この研究は、中世の神秘作家ハドゥヴェイヒ(Hadewijch)の自筆譜が保存されている、最も古い写本の2つに捧げられている。
Bを作成した書記者は、Aを模範として用いたと推定される。
機械学習を用いて、原稿AとBを分離する最も特徴的な特徴を特定します。
論文 参考訳(メタデータ) (2022-10-25T14:40:25Z) - PART: Pre-trained Authorship Representation Transformer [52.623051272843426]
文書を書く著者は、自分のテキストに識別情報を印字する。
以前の作品では、手作りの機能や分類タスクを使って著者モデルを訓練していた。
セマンティクスの代わりにテキストの埋め込みを学習するために、対照的に訓練されたモデルを提案する。
論文 参考訳(メタデータ) (2022-09-30T11:08:39Z) - Writer Recognition Using Off-line Handwritten Single Block Characters [59.17685450892182]
我々は、生年月日DoBの6桁の個人番号を使用する。
本稿では,方向測定を行う手作り特徴に基づく認識手法と,ResNet50モデルによる深い特徴に基づく認識手法について検討する。
その結果,DoBでは手書き情報に同一性関連情報が6桁程度存在することがわかった。
論文 参考訳(メタデータ) (2022-01-25T23:04:10Z) - LTIatCMU at SemEval-2020 Task 11: Incorporating Multi-Level Features for
Multi-Granular Propaganda Span Identification [70.1903083747775]
本稿では,新聞記事におけるプロパガンダ・スパン識別の課題について述べる。
本稿では,BERT-BiLSTMに基づくプロパガンダ分類モデルを提案する。
論文 参考訳(メタデータ) (2020-08-11T16:14:47Z) - FixMatch: Simplifying Semi-Supervised Learning with Consistency and
Confidence [93.91751021370638]
半教師付き学習(SSL)は、ラベルのないデータを活用してモデルの性能を向上させる効果的な手段を提供する。
本稿では、整合正則化と擬似ラベル付けという2つの共通SSL手法の単純な組み合わせのパワーを実証する。
筆者らのアルゴリズムであるFixMatchは、まず、弱拡張未ラベル画像上のモデルの予測を用いて擬似ラベルを生成する。
論文 参考訳(メタデータ) (2020-01-21T18:32:27Z) - A Discriminative Latent-Variable Model for Bilingual Lexicon Induction [100.76471407472599]
本稿では,バイリンガルレキシコン誘導のための新しい識別潜在変数モデルを提案する。
我々のモデルは、Haghighi et al. (2008) 以前の二部語マッチング辞書と表現に基づくアプローチを組み合わせたものである。
論文 参考訳(メタデータ) (2018-08-28T14:47:33Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。