論文の概要: WeaveMark: Robust and Scalable Multi-bit LLM Watermarking via Coded Payload Spreading
- arxiv url: http://arxiv.org/abs/2609.02177v1
- Date: Wed, 02 Sep 2026 06:39:43 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-03 17:53:18.108386
- Title: WeaveMark: Robust and Scalable Multi-bit LLM Watermarking via Coded Payload Spreading
- Title(参考訳): WeaveMark: Coded Payload SpreadingによるロバストでスケーラブルなマルチビットLM透かし
- Authors: Gang-Hyun Park, Ju-Hyeong Lee, Hee-Youl Kwak, Dae-Young Yun,
- Abstract要約: 大規模言語モデル(LLM)のためのマルチビット透かしは、ユーザ識別可能なメッセージを生成されたテキストに埋め込むことで、コンテンツソースのトレースを可能にする。
既存の手法は、抽出精度、テキスト品質、ペイロード容量の基本的なトレードオフに直面している。
我々は,符号化ペイロードの分散に基づく,堅牢でスケーラブルなマルチビットLCM透かし方式であるWeaveMarkを提案する。
- 参考スコア(独自算出の注目度): 2.725232413027825
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Multi-bit watermarking for large language models (LLMs) enables content source tracing by embedding user-identifiable messages into generated text. Existing methods face a fundamental trade-off among extraction accuracy, text quality, and payload capacity. We propose WeaveMark, a robust and scalable multi-bit LLM watermarking scheme based on coded payload spreading. WeaveMark shifts this trade-off frontier by improving payload capacity through multi-bit-per-token spreading, improving extraction accuracy through soft-decision error-correcting code, and preserving text quality through unbiased multilayer reweighting. It further introduces dedicated zero-bit layers for reliable watermark presence detection. Experiments show large gains, especially for long messages and edited text. WeaveMark achieves 89.8% match rate for 32-bit messages at 200 tokens, compared with 20.8% for BiMark. Under 10% substitution attacks on 16-bit messages at 200 tokens, it maintains 86.0% versus 30.7%, while preserving text quality. Our code is available at https://github.com/qkrrkd90-source/WeaveMark.
- Abstract(参考訳): 大規模言語モデル(LLM)のためのマルチビット透かしは、ユーザ識別可能なメッセージを生成されたテキストに埋め込むことで、コンテンツソースのトレースを可能にする。
既存の手法は、抽出精度、テキスト品質、ペイロード容量の基本的なトレードオフに直面している。
我々は,符号化ペイロードの分散に基づく,堅牢でスケーラブルなマルチビットLCM透かし方式であるWeaveMarkを提案する。
WeaveMarkはこのトレードオフフロンティアを、マルチビット/トーケン展開によるペイロード容量の向上、ソフト決定エラー訂正コードによる抽出精度の向上、非バイアスのマルチレイヤ再重み付けによるテキスト品質の保存によってシフトする。
さらに、信頼できる透かし検出のための専用ゼロビット層も導入している。
実験は、特に長いメッセージと編集されたテキストに対して、大きな利益を示します。
WeaveMarkは200トークンでの32ビットメッセージのマッチングレートが89.8%、BiMarkは20.8%である。
200トークンでの16ビットメッセージに対する10%の置換攻撃では、テキストの品質を維持しながら86.0%対30.7%を維持している。
私たちのコードはhttps://github.com/qkrrkd90-source/WeaveMarkで利用可能です。
関連論文リスト
- XMark: Reliable Multi-Bit Watermarking for LLM-Generated Texts [11.826762642822219]
textscXMarkは、LLM(Large Language Model)で生成されたテキストでバイナリメッセージをエンコードしデコードするための新しい方法である。
textscXMarkは、透かし付きテキストの品質を維持しながらデコード精度を著しく改善し、従来の方法よりも優れている。
論文 参考訳(メタデータ) (2026-04-06T23:08:01Z) - MC$^2$Mark: Distortion-Free Multi-Bit Watermarking for Long Messages [62.982950935139534]
マルチビット透かしは、識別子を生成されたテキストに埋め込むことができるが、既存の方法は、長いメッセージを送りながらテキストの品質と透かしの強さを維持するのに苦労している。
本稿では,長文の埋め込みと復号化のための歪みのないマルチビット透かしフレームワークMC$2$Markを提案する。
論文 参考訳(メタデータ) (2026-02-15T07:29:06Z) - MirrorMark: A Distortion-Free Multi-Bit Watermark for Large Language Models [5.735801967350819]
大規模言語モデル(LLM)のための歪みのない透かしであるMirrorMarkを提案する。
MirrorMarkはトークンの確率分布を変更することなくマルチビットメッセージを埋め込み、設計によるテキスト品質の保存を行う。
実験の結果,MirrorMarkは非透かし生成のテキスト品質とほぼ一致し,検出性は著しく向上した。
論文 参考訳(メタデータ) (2026-01-29T19:10:48Z) - Majority Bit-Aware Watermarking For Large Language Models [7.200910949076064]
MajorMarkは、多数ビット認識エンコーディングによるこのトレードオフを改善する新しい透かし手法である。
トークン周波数分析を利用した復号化手法とは対照的に、MajorMarkはクラスタリングベースの復号化戦略を採用している。
我々の手法は復号精度とテキスト生成品質の両方を著しく向上させる。
論文 参考訳(メタデータ) (2025-08-05T18:19:00Z) - PostMark: A Robust Blackbox Watermark for Large Language Models [56.63560134428716]
モジュール式ポストホックウォーターマーキング手法であるPostMarkを開発した。
PostMarkはロジットアクセスを必要としないため、サードパーティによって実装することができる。
PostMarkは既存のウォーターマーキング手法よりも,攻撃を言い換える方が堅牢であることを示す。
論文 参考訳(メタデータ) (2024-06-20T17:27:14Z) - Advancing Beyond Identification: Multi-bit Watermark for Large Language Models [31.066140913513035]
機械生成テキストの識別を超えて,大規模言語モデルの誤用に対処する可能性を示す。
言語モデル生成中にトレーサブルなマルチビット情報を埋め込んだ位置アロケーションによるマルチビット透かしを提案する。
論文 参考訳(メタデータ) (2023-08-01T01:27:40Z) - An Unforgeable Publicly Verifiable Watermark for Large Language Models [84.2805275589553]
現在の透かし検出アルゴリズムは、透かし生成プロセスで使用される秘密鍵を必要としており、公開検出中にセキュリティ違反や偽造の影響を受ける。
両段階で同じキーを使用するのではなく、2つの異なるニューラルネットワークを用いて透かしの生成と検出を行う。
論文 参考訳(メタデータ) (2023-07-30T13:43:27Z) - Towards Codable Watermarking for Injecting Multi-bits Information to LLMs [86.86436777626959]
大規模言語モデル(LLM)は、流布とリアリズムを増大させるテキストを生成する。
既存の透かし方式はエンコーディング非効率であり、多様な情報エンコーディングニーズに柔軟に対応できない。
テキスト透かしを複数ビットでカスタマイズ可能な情報を運ぶことができるCTWL (Codable Text Watermarking for LLMs) を提案する。
論文 参考訳(メタデータ) (2023-07-29T14:11:15Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。