論文の概要: H-CRSPV: Preventing Semantic Omission in Late-Bound Large Language Model Releases
- arxiv url: http://arxiv.org/abs/2610.05989v1
- Date: Mon, 05 Oct 2026 08:41:49 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-09 19:41:46.752118
- Title: H-CRSPV: Preventing Semantic Omission in Late-Bound Large Language Model Releases
- Title(参考訳): H-CRSPV: 後期の大規模言語モデルリリースにおけるセマンティック・エミッションの防止
- Abstract要約: H-CRSPV(Hybrid Cryptographic Relation-based Semantic Plan Verification)は、リリース前に必要セットの完全性を強制するレプリケーション層である。
36個の省略アーティファクトのうち、提出対象バリデーションはすべての36を受理する。
プロトタイプはまた、6つの制限されたソース-リレーショナルIR結合を検証し、全60の試験された突然変異を拒絶する。
- 参考スコア(独自算出の注目度): 4.8539809887204735
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Large-language-model release pipelines increasingly combine commitments, signatures, provenance records, and heterogeneous verification backends. Yet validating every submitted object does not establish that a release realizes every requirement of its registered transformation. An untrusted realization proposer may omit a required relation, propose an unauthorized evidence-sharing assignment, or bind valid evidence to the wrong object. This verification-boundary failure is termed Semantic Omission under Valid Evidence (SOVE). Hybrid Cryptographic Relation-based Semantic Plan Verification (H-CRSPV) is a replicated admission layer that enforces required-set completeness before release consumption. Before evidence selection, an authorized registration entity commits an authenticated authority record. Validators independently derive the required-obligation multiset, check exact entry-occurrence coverage, validate proposal-induced evidence sharing, and bind admissible groups one-to-one to keeper-resolved objects. Evidence remains provisional until the challenge window closes and an atomic finalizer activates the release. The analysis establishes structural exactness and conditional semantic guarantees under explicit assumptions. Across 36 omission artifacts, submitted-object validation accepts all 36 because every submitted object passes its backend-specific verifier. H-CRSPV rejects all 36 while accepting all six honest releases. The prototype also validates six restricted source-to-RelationIR bindings and rejects all 60 tested mutations. In a continuous four-validator Qwen2.5-1.5B workflow, the same authority record remains fixed across three legal releases with different post-registration availability states. These results show that per-object validity does not establish complete, correctly bound, and finalized release evidence.
- Abstract(参考訳): 大規模言語モデルリリースパイプラインは、コミットメント、シグネチャ、プロファイランスレコード、不均一な検証バックエンドをますます組み合わせている。
しかし、全ての提出されたオブジェクトを検証することは、リリースがその登録された変換のすべての要件を実現することを保証しません。
信頼できない実現提案者は、必要な関係を省略したり、許可されていない証拠共有の割り当てを提案したり、証拠を間違った対象に束縛したりすることができる。
この検証境界障害は、正当性証拠(SOVE)の下でのセマンティック・オミッション(Semantic Omission)と呼ばれる。
H-CRSPV(Hybrid Cryptographic Relation-based Semantic Plan Verification)は、リリース前に必要セットの完全性を強制するレプリケーション層である。
証拠選択前、認証登録機関は認証された権限記録をコミットする。
バリケータは、要求オブジェクトの多重集合を独立に導出し、正確な入出力カバレッジを確認し、提案によるエビデンス共有を検証し、許容群を1対1でキーパー解決対象に結合する。
挑戦ウィンドウが終了し、原子ファイナライザがリリースを起動するまで、証拠は一時的なままである。
この分析は、明示的な仮定の下で構造的正確性と条件的意味保証を確立する。
36個の省略アーティファクトのうち、提出対象バリデーションはすべての36を受理する。
H-CRSPVは6つの正直なリリースをすべて受け入れながら全36を拒絶する。
プロトタイプはまた、6つの制限されたソース-リレーショナルIR結合を検証し、全60の試験された突然変異を拒絶する。
継続的4つのバリデータであるQwen2.5-1.5Bワークフローでは、同じ権限記録が、異なる登録後の可用性状態を持つ3つの法的リリースで固定されている。
これらの結果は、オブジェクトごとの妥当性が完全で、正しく、そして最終的なリリース証拠を確立できないことを示している。
関連論文リスト
- Claim-Gated Source-Risk Auditing for Generative Search [5.329247092746233]
生成検索は、サポートされたパスを引用するが、その解釈を変えるソース関係を省略することができる。
クェリソース回答のクレームゲート監査を指定する。
我々は、セマンティックな妥当性を確立するために、独立したアノテーション、保留評価、およびペアのユーティリティテストを定義する。
論文 参考訳(メタデータ) (2026-09-24T07:22:14Z) - Mechanizing Typed Regulatory Actions for Security Tokens: Semantics, Falsification, and Bounded EVM Evidence [9.32030540168344]
セキュリティ標準は、実行された法的効果や、それが持つ証拠やリバース義務を特定せずに、特権的なコントロールを公開します。
我々はIsabelle/HOLで、FREEZE、SEIZE、CONFISCATE、LIQUIDATE、RESTRICT、RECOVERの6つのERC-8319の参照実行セマンティクスを定式化する。
論文 参考訳(メタデータ) (2026-08-29T08:23:27Z) - The Verification Gap in Networked Physical AI: A Post-Semantic Communication Framework [0.7896651877485362]
ネットワーク化された物理AIでは、提案は有効で、タイムリーで、提案に結びついた証拠や、行動の確定に必要な権限がまだ利用できないまま理解される。
我々はこのミスマッチを検証ギャップと呼び、提案生成と物理実行の間のシステムインターフェースのためのポストセマンティック・コミュニケーション・フレームワークを導入します。
論文 参考訳(メタデータ) (2026-08-20T03:17:20Z) - Independent Patch Verification for Coding Agents with a Bidirectional Reconstruct-and-Verify Framework [49.16055123488827]
大規模言語モデルを利用したコーディングエージェントは、バグレポートから直接コードパッチを生成することができる。
報告された問題を真に解決するかどうかを独立に検証するメカニズムは存在しない。
本稿では,RETRACE をトレーニング不要なポストジェネレーション検証フレームワークとして提案する。
論文 参考訳(メタデータ) (2026-08-09T22:59:13Z) - From Trajectories to Evidence: Auditable Experimental Records for Industrial Research Agents [47.678562263387214]
研究エージェントは、産業レコメンデーション設定において、多段階の機械学習実験をますます実施している。
生成されたアーティファクトは、サポートされないか、不完全かもしれないし、実行されたラウンドは無効かもしれないし、あるいは廃止されるかもしれないし、後の修正は、以前の発見を曖昧にするかもしれない。
本稿では,連続的アーティファクトのバウンダリ検証と実行後のクレーム資格を結合するエビデンス・グラウンド・フレームワークを提案する。
論文 参考訳(メタデータ) (2026-08-05T13:37:38Z) - SEER: A Self-Grounded Evidence Interface for Controlled Spatial Relation Classification [71.9783246097687]
SEERは、ペアローカライゼーション中の候補関係を隠蔽し、明示的な主観的/対象的役割を持つクエリ固有ビューを構築し、補完的な証拠として完全なイメージとスパースボックス幾何学を保持する。
正確な逆サポートを持つ関係選択プロトコルでは、オプションリファインメントがエンティティロールを交換し、正確に1つの視覚状態が対応する逆関係に従う場合にのみ前方決定を変更する。
変更されていないプロトコルは、3つのモデルにまたがる2,434個のフィルター付きEmbSpatialペア関係質問に対して +4.35 から +11.79 を得る。
論文 参考訳(メタデータ) (2026-08-04T13:16:15Z) - When AI Agents Commit: Cognitive Serializability Across Data, Evidence, Policy, and Authority [2.124730017640531]
自律的なエージェントは、データベースの読み込み、証拠の回収、政策、信条、委任された権威から突然変異を導き出す。
トランザクション処理は、提案が実行可能なコントラクトを満たすかどうかを決定する。
Cognitive Serializabilityは、不変の実行可能な定義、レジストリ由来の権限計画、シールされたガードファーストコミットトランザクション、封筒後エンベロープ、証人限定の権限を組み合わせたものだ。
論文 参考訳(メタデータ) (2026-07-28T19:36:23Z) - Authenticated Contradictions from Desynchronized Provenance and Watermarking [48.47756819432157]
この研究は、$textitIntegrity Clash$を形式化し、実証的に実証している。
本稿では,3500枚のテスト画像に対して100%の分類精度を達成し,証明メタデータと透かし検出ステータスを共同評価する層間監査プロトコルを提案する。
論文 参考訳(メタデータ) (2026-03-02T20:42:12Z) - Preventing the Collapse of Peer Review Requires Verification-First AI [49.995126139461085]
我々は、真理結合、すなわち、過度に科学的真理をトラックする場所のスコアの厳密さを提案する。
プロキシ・ソブリン評価に向けた相転移を駆動する2つの力の形式化を行う。
論文 参考訳(メタデータ) (2026-01-23T17:17:32Z) - WiCE: Real-World Entailment for Claims in Wikipedia [63.234352061821625]
We propose WiCE, a new fine-fine textual entailment dataset built on natural claim and evidence pairs from Wikipedia。
標準クレームレベルのエンターメントに加えて、WiCEはクレームのサブ文単位に対するエンターメント判断を提供する。
我々のデータセットの真のクレームは、既存のモデルで対処できない検証と検索の問題に挑戦することを含んでいる。
論文 参考訳(メタデータ) (2023-03-02T17:45:32Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。