論文の概要: SimpleMark: Fast Multi-Bit Text Watermarking under f -Divergence Constraints
- arxiv url: http://arxiv.org/abs/2610.05712v1
- Date: Mon, 05 Oct 2026 02:51:43 GMT
- ステータス: 情報取得中
- システム内更新日: 2026-10-06 21:45:29.770939
- Title: SimpleMark: Fast Multi-Bit Text Watermarking under f -Divergence Constraints
- Title(参考訳): SimpleMark: f-divergence制約下での高速マルチビットテキスト透かし
- Abstract要約: 本稿では,基本言語モデルの分布から$f$-divergenceを直接定義したセキュリティを備えたマルチビットテキスト透かしフレームワークを提案する。
本研究では,所定の分散予算の次点分布を最適にバイアスするコーディングベースの透かし手法を開発した。
本結果は,セキュアなマルチビット透かしの統一的なビューを提供し,特殊なケースとしてよく使われるセキュリティ概念を復元する。
- 参考スコア(独自算出の注目度): 15.459863917488056
- License:
- Abstract: We introduce a framework for multi-bit text watermarking with security defined directly through $f$-divergence from the base language model distribution. Unlike prior approaches that focus on average-key distortion-freeness or a particular statistical distance, our formulation supports general $f$-divergences, including total variation and KL divergence, and enforces the guarantee for each realized key and embedded message. We develop a coding-based watermarking scheme that optimally biases next-token distributions subject to a prescribed divergence budget, and characterize the resulting tradeoff between embedding rate, decoding reliability, and statistical security. Experimentally, we compare our method against prior multi-bit watermarking schemes across modern language models and payload regimes. Our approach achieves substantially lower watermark detectability while maintaining competitive message-recovery performance and generation quality. Our results provide a unified view of secure multi-bit watermarking and recover several commonly used security notions as special cases.
- Abstract(参考訳): 本稿では,基本言語モデルの分布から$f$-divergenceを直接定義したセキュリティを備えたマルチビットテキスト透かしフレームワークを提案する。
平均鍵歪み自由度や特定の統計的距離に着目した従来の手法とは異なり、我々の定式化は全変量やKL発散を含む一般的な$f$-divergencesをサポートし、実現された各キーおよび埋め込みメッセージの保証を強制する。
我々は,所定の分散予算の次点分布を最適にバイアスし,組込み率,復号化信頼性,統計セキュリティのトレードオフを特徴付けるコーディングベースの透かし手法を開発した。
実験により,従来のマルチビット透かし方式と比較した。
提案手法は,競合するメッセージ回復性能と生成品質を維持しつつ,透かし検出可能性を大幅に低下させる。
本結果は,セキュアなマルチビット透かしの統一的なビューを提供し,特殊なケースとしてよく使われるセキュリティ概念を復元する。
関連論文リスト
- LineageMark: Multi-user White-box Watermarking for Contribution Tracing in Model Derivation Chains [5.187057961007583]
LineageMarkは、モデル導出チェーンのためのマルチユーザホワイトボックス透かしフレームワークである。
プロジェクションベースのアプローチでモデルパラメータの透かしを符号化する。
多段階導出によるコントリビュータの透かしを保存し、インクリメンタルなマルチユーザ透かし挿入をサポートする。
論文 参考訳(メタデータ) (2026-06-15T13:43:43Z) - Analyzing and Evaluating Unbiased Language Model Watermark [62.982950935139534]
UWbenchは、偏りのない透かし手法の原理的評価を専門とする、最初のオープンソースベンチマークである。
我々の枠組みは理論的な貢献と経験的な貢献を組み合わせている。
我々は,非バイアス性,検出性,堅牢性という3軸評価プロトコルを確立し,トークン改質攻撃がパラフレーズベースの手法よりも安定したロバストネス評価を提供することを示す。
論文 参考訳(メタデータ) (2025-09-28T19:46:01Z) - An Ensemble Framework for Unbiased Language Model Watermarking [60.99969104552168]
本研究では,アンサンブル・フレームワークであるENSを提案する。
ENSは複数の独立した透かしインスタンスを順次構成し、それぞれ異なるキーによって管理され、透かし信号を増幅する。
実験的な評価では、ENSは信頼できる検出に必要なトークンの数を大幅に減らし、平滑化やパラフレージング攻撃に対する耐性を高めている。
論文 参考訳(メタデータ) (2025-09-28T19:37:44Z) - PMark: Towards Robust and Distortion-free Semantic-level Watermarking with Channel Constraints [49.2373408329323]
大規模言語モデル(LLM)のための透かしレベル(SWM)に関する新しい理論フレームワークを提案する。
PMarkは単純だが強力なSWM手法であり、サンプリングチャネルを通して中央値の次文を動的に推定する。
実験結果から,PMarkはテキスト品質とパラフレージングの両方において,既存のSWMベースラインを一貫して上回ることがわかった。
論文 参考訳(メタデータ) (2025-09-25T12:08:31Z) - Hot-Swap MarkBoard: An Efficient Black-box Watermarking Approach for Large-scale Model Distribution [14.60627694687767]
本稿では,効率的な透かし手法であるHot-Swap MarkBoardを提案する。
ユーザ固有の$n$-bitバイナリシグネチャを、独立して複数の透かしを埋め込むことでエンコードする。
この方法はブラックボックス検証をサポートし、様々なモデルアーキテクチャと互換性がある。
論文 参考訳(メタデータ) (2025-07-28T09:14:21Z) - VLA-Mark: A cross modal watermark for large vision-language alignment model [44.59029116115437]
VLA-Markは視覚対応のフレームワークで、検出可能な透かしを埋め込むと同時に、クロスモーダルコーディネートを通じて意味的忠実さを保っている。
提案手法は,局所的パッチ親和性,大域的セマンティックコヒーレンス,文脈的注意パターンを組み合わせ,マルチスケールの視覚・テクスチュアアアライメントメトリクスを統合する。
実験では、PPLが7.4%低く、BLEUが26.6%高い。
論文 参考訳(メタデータ) (2025-07-18T16:44:41Z) - BiMark: Unbiased Multilayer Watermarking for Large Language Models [68.64050157343334]
テキスト品質とメッセージ埋め込み能力のバランスをとる新しい透かしフレームワークであるBiMarkを提案する。
BiMarkは、短いテキストに対して最大30%高い抽出率を達成すると同時に、低いパープレキシティで示されるテキスト品質を維持する。
論文 参考訳(メタデータ) (2025-06-19T11:08:59Z) - A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models [65.40460716619772]
本研究は,textbfDistribution-textbf Preserving (DiP)ウォーターマークの重要性に焦点をあてる。
現在の戦略とは対照的に,提案したDiPmarkは透かし中に元のトークン分布を同時に保存する。
言語モデルAPIにアクセスせずに検出可能で(アクセス可能)、トークンの適度な変更に対して確実に堅牢である。
論文 参考訳(メタデータ) (2023-10-11T17:57:35Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。