論文の概要: Four Ways to Forge a Bundle My Own Verifier Calls Clean: Refusal-Site Mutation Testing of an Evidence-Bundle Verifier
- arxiv url: http://arxiv.org/abs/2608.26183v1
- Date: Sat, 22 Aug 2026 07:53:37 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-28 16:30:58.108809
- Title: Four Ways to Forge a Bundle My Own Verifier Calls Clean: Refusal-Site Mutation Testing of an Evidence-Bundle Verifier
- Title(参考訳): 自分専用の検証器を組み立てる4つの方法:証拠境界検証器の拒絶点突然変異試験
- Abstract要約: 外部エンジニアは、見知らぬ人が私のクレームをオフラインで実行し、同じ回答を得られるという前提で、プロトコルを監査しました。
彼の修正をマージし、自分の楽器を固定検証器に向け、同じ欠陥を4回発見しました。
統一された欠陥は暗号化やエキゾチックなものではありません。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: I built a protocol whose premise is that a stranger can re-run my claims offline and get the same answer. An outside engineer audited it and broke it: a bundle whose headline numbers were false verified clean, the cheapest forgery four bytes. I merged his fix, then pointed my own instruments at the fixed verifier and found the same defect four more times, in places his audit did not reach. The cheapest is one capital letter. The unifying defect is not cryptographic or exotic: a check that reports success along a path where it never examined anything. Vacuous pass is a working label, not a discovery; Section 4 names the literatures already occupying it. So I stopped collecting anecdotes and measured. At f59fb62, under the extraction rule of Section 6, the verifier exposes 112 refusal sites; 75 could be deleted with the whole suite and every tamper fixture still green, a score of 0.330. Three of the four hand-found forgeries fall in surviving classes; the fourth is an obligation with no refusal site. Scored alone, the sixteen-fixture corpus built to prove the verifier can refuse catches 10. Testing the refusals themselves took it to 0.941, then to 1.000 at 92e4548 over a grown population of 146 sites; those denominators differ and the series between them is non-monotone, so Section 7.5 carries all eleven, not just the five rows of Table 2. Fixing the four found defects instead moved 37/112 to 39/119, leaving the pre-existing sites at 37. Seven times during this study my own measuring tools reported success while measuring nothing; four were built to detect this class, and one returned a perfect 1.000. Every number here is self-measured on a system I wrote, over a registry that is a closed loop of my own repositories; the one external data point is the audit of Section 2.2. That is stated here rather than buried: it is the paper's credibility, not a caveat.
- Abstract(参考訳): 私は、見知らぬ人が私の主張をオフラインで実行し、同じ答えを得ることができるという前提でプロトコルを構築しました。
ヘッドライン番号が偽確認されたバンドルは、最も安い4バイトの偽造品です。
私は彼の修正をマージし、自分の楽器を固定検証器に向け、監査が届かなかった場所で同じ欠陥を4回発見しました。
最も安いものは1つの大文字です。
統一された欠陥は暗号化やエキゾチックなものではありません。
ヴァララス・パス(Vacuous Pass)は、発見ではなく活動中のラベルであり、第4節では既にそれを占有している文献に言及している。
だから私は逸話の収集をやめて測定した。
f59fb62では、第6節の抽出規則の下で、検証者は112の拒絶サイトを露出し、75はスイート全体と全てのターパーフィクスチャがまだ緑色で、スコアは0.330である。
4つの手作りの偽造物のうち3つは生き残った階級に該当する。
検証者を証明するために構築された16固定コーパスは、単独でキャッチ10を拒否することができる。
拒絶試験自体が0.941となり、人口増加の146か所に対して92e4548で1.000となり、それらの分母は異なっており、その間のシリーズは単調ではないため、第7.5節は表2の5行だけでなく11行全てを担っている。
4つの欠陥は37/112から39/119に修正され、既存の部位は37。
この調査で7回、私の測定ツールは、何も測定せずに成功を報告し、このクラスを検出するために4つが作られ、1つは完全な1.000を返した。
ここでのすべての数値は、私のリポジトリのクローズドループであるレジストリ上で、私が書いたシステム上で自己測定されます。
それは埋もれではなく、紙の信条であり、注意すべきことではありません。
関連論文リスト
- NovaFabric: Tamper-Evident, Replayable Evidence for Autonomous AI Agent Runs [0.0]
我々はNovaFabricを紹介し、監査グレードの実行証拠を作成している。
エージェントロジックを変更することなく実行中のエージェントを、ポータブルなRun Capsuleに記録する。
シードランは4モードのリプレイプロトコルで再実行可能である。
我々は8つの研究課題を測定範囲で評価した。
論文 参考訳(メタデータ) (2026-09-11T08:35:43Z) - What the Window Does Not Contain: Auditing Provenance in a Document-Grounded Instability Benchmark [0.0]
私たちは60のタスクと470のアイテムのベンチマークを作成しました。
私たちは自身のコーパスを監査し、Exerptで構築されたベンチマークが持てる欠陥を見つけました。
コーパスと112,800の生のレスポンスをすべてリリースし、あらゆるドキュメントベンチマークの実行可能なチェックとして監査を行います。
論文 参考訳(メタデータ) (2026-09-05T15:43:05Z) - VeriPhy: Agentic Physical Reasoning for World Model Evaluation and Refinement [57.86962208273888]
テキストのみのプランナが入力された物理義務にプロンプトをコンパイルする監査可能な物理検証システムを提案する。
それぞれのアクションは、ペイロードがタイプされた測定か、明示的にタグ付けされた学習状態である証明付きエビデンスレコードを返す。
我々は, 実発生障害を即時参照, 空間, 時間でローカライズする, 1500クリックの欠陥記録のコーパスにおいて, 評価をアンロックする。
論文 参考訳(メタデータ) (2026-09-02T20:36:45Z) - RosettaBitcoin: An Artifact-Backed Experience Report on Verification Infrastructure for Agent-Assisted Consensus Validators [0.0]
この体験レポートは、12の個別に実装されたBitcoin testnet4コンセンサスバリデータを構築した、単一開発者プロジェクトであるRosettaBitcoinを調査している。
スナップショットの追跡されたエビデンスデータベース、キュレートされたアーティファクトインデックス、標準適合フィクスチャ、検証スクリプト、ブロッカレコード、バージョン履歴を分析します。
このケースは、明示的な障害記録、フィクスチャ、ポート所有、バリデーションがエージェントアシストシステムをより監査可能にすることを示唆している。
論文 参考訳(メタデータ) (2026-09-01T17:22:07Z) - The Recall Trap: A Recall-Maximizing Retriever Configuration Reduces Issue Resolution in Fixed-Budget Code Context [45.88028371034407]
コード修復における制御ケーススタディを報告し,新しい現象ではない。
私たちは、同じスタック上の1つのフラグ(1チャンク毎の重複)を切り替えます。
BM25(3.2pp、重要なパラダイム間相互作用)を逆転させる。
厳格な固定予算では、ファイルごとのハードダイドプリケートや、タスクに対するA/Bパッケージングポリシは、メトリックフラグを調整しないことが示されます。
論文 参考訳(メタデータ) (2026-08-14T19:22:50Z) - Reconcile Once, Write Anytime: A Trust-Tiered Librarian and a Multi-Agent Writer for Drift-Free, Point-in-Time Research [7.426963307811556]
本稿では,保守型ポイントインタイム知識ライブラリをレポート作成から分離する2層エージェントシステムを提案する。
ポータブルなマルチエージェント"ライター"ランタイムは、任意の知識遮断Tにおいて矛盾のないエビデンス基底レポートを構成する。
我々は,555,926枚のエビデンスカードを出力する6,130個のソースの自己収集・公開コーパスを評価した。
論文 参考訳(メタデータ) (2026-08-13T09:09:28Z) - Similarity Gates Approve Reversals: A Validity Audit of Embedding-Cosine Thresholds in Agent Systems [0.0]
エージェントフレームワークは、テキストブロックを埋め込みコサインの類似性によって比較し、固定されたカットオフを決定する品質ゲートを出荷する。
重複フィルタ、セマンティックキャッシュ、ドリフトガード、応答グレーダゲートは、質問に答えるために配置されます。
我々はこのゲートクラスを測定器として監査する。
論文 参考訳(メタデータ) (2026-08-10T20:36:40Z) - Metadata Reconstruction from Values Alone: Recovering Column Semantics in Undocumented Warehouses [0.0]
Rosettaはデータ自体から列と値の意味を検索する。
盲目のi2b2臨床倉庫では、ロゼッタは値だけで134の実際のICD-9符号の95.5%をデコードしている。
論文 参考訳(メタデータ) (2026-08-08T06:12:18Z) - FACTWASH: Catching AI Rewrites That Wash Hearsay into Fact [0.0]
AIシステムは情報を常に書き直す:会話が記憶される記憶となり、ドキュメントが答えになる。
私たちはファクト・ウォッシングと呼んでいる。これはオープンソースのライトタイム・ゲートで、判断的にそれをキャッチし、裁判官ではなく、名前のついた旗や証拠を持っています。
コストの安いチェックはいつ,モデルが必要なのか?
論文 参考訳(メタデータ) (2026-08-04T09:20:54Z) - Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch [47.836680625916266]
テストスイート監査官として機能する市販のコーディングエージェントは、どちらも、公式スイートが見逃すものを公開するために、敵対的なテストスイートを構築します。
認証チェーンは、各エージェントフラッグされた申請が、公式の裁判官に頼らずに、真にバグだらけであるか否かを判定する。
Codeforceは、利用可能なオフィシャルスイートを持たない問題に対して、同じテストビルディングメソッドを使用して、テストされた入力予算毎に5つの再生ベースラインを導出する。
論文 参考訳(メタデータ) (2026-08-03T05:24:03Z) - Judging Is Not Enumerating: Silent Omissions in LLM-Authored Acceptable Sets [13.85834524293015]
私たちは、ロールが想定する能力を測定し、通常、ロールが配置されるプロトコルの下でそれを欠いていることを見つけます。
モデルは、その候補がセット自体の作者よりもはるかに優れているかどうかを判断する。
論文 参考訳(メタデータ) (2026-08-02T05:00:44Z) - Looping Is Not Reliability: State-Bound Evidence and Typed Revision Contracts for Agentic Code Repair [36.56438114281786]
正しいパッチの発見と保持、検証、提出のギャップについて検討する。
我々はエビデンスバウンド型ループ契約を導出し、その機械的に強制可能なサブセットを参照実装でインスタンス化する。
論文 参考訳(メタデータ) (2026-07-27T16:05:23Z) - Abliteration Is Not a Scalpel: Off-Target Effects of Refusal Removal on Decision Disposition Across Model Families [51.56484100374058]
放棄 — モデルの拒絶方向を重みから取り除く — は、一般的な"アンセンソルド"なオープンウェイトモデルの標準的なレシピである。
ディスポジションプローブとして21,600個の決定を不確実性の下で使用し、凍結パイプラインを通じて再生することにより、決定層モデルが唯一の変数となる。
3つのエフェクトは2つのファミリーにまたがって複製される(ゼロを除く週間クラスターCI)
4つ目の効果は符号を逆転する:同じ操作によりGemmaで読み取られた方が自信が弱まり、Qwenで読み取られたものがより多くなる(ファミリーCIは重複しない)。
論文 参考訳(メタデータ) (2026-07-19T22:27:00Z) - Fantastic Adaptive Taxonomies and How to Use Them [100.20614173157708]
AdaMASTは、実行トレースをコンパクトでエビデンスに基づく障害分類に変換する。
コードには手書きのコードはなく、人間による注釈もない。
エージェント・システム・サーチでは、失敗候補の分類コード診断が自由形式より優れている。
論文 参考訳(メタデータ) (2026-07-17T17:41:16Z) - ScientistOne: Towards Human-Level Autonomous Research via Chain-of-Evidence [57.37494162084001]
チェーン・オブ・エビデンス(Chain-of-Evidence, CoE)は、すべてのクレームがエビデンス・ソースにトレース可能であることを要求する検証可能なフレームワークである。
CoE Auditはポストホック監査であり、スコア検証、仕様違反、参照検証、メソッドコードアライメントという4つの整合性チェックが全システムに均一に適用される。
論文 参考訳(メタデータ) (2026-05-25T21:30:27Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。