論文の概要: From Prompts to Contracts: Harness Engineering for Auditable Enterprise LLM Agents
- arxiv url: http://arxiv.org/abs/2607.08028v1
- Date: Thu, 09 Jul 2026 01:08:33 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-10 14:45:27.383979
- Title: From Prompts to Contracts: Harness Engineering for Auditable Enterprise LLM Agents
- Title(参考訳): プロンプトから契約へ:監査可能なLLMエージェントのハーネスエンジニアリング
- Authors: Joongho Ahn, Moonsoo Kim,
- Abstract要約: 製品化は、ソースバウンダリ、エンティティルーティング、回答コントラクト、再現可能なトレースの要件を追加します。
本稿では,このパターンをトレース可能な監査可能なLLMエージェントアーキテクチャに再構成するハーネスエンジニアリング手法を提案する。
韓国の5つの企業グループの公開データスライスでインスタンス化し、3つの研究課題を評価する。
- 参考スコア(独自算出の注目度): 0.24554686192257424
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Enterprise large language model (LLM) applications often begin as prototypes whose behavior is carried by prompts and retrieval context. Productization adds requirements for source boundaries, entity routing, answer contracts, and reproducible traces. We present a harness-engineering approach that reconstructs this pattern into a traceable, auditable LLM-agent architecture: deterministic behavior moves into code, manifests, schemas, and validation artifacts around a replaceable composition boundary, while source-backed claims remain the authority for runtime answers. We instantiate it on a public-data slice of five Korean corporate groups (25 listed companies) and evaluate three research questions. (1) The harness preserves its source-grounding, entity-routing, trace, output-hygiene, and recommendation-language contracts across the fixed validation scenarios; a fault-injection control confirms the validators flag deliberately broken contracts. (2) The checks the harness enforces held under model substitution: across three hosted models, they passed on all 270 composition-boundary runs; failures were confined to the model-composed side and were caught and recorded. (3) The code-owned guarantees are load-bearing, not reproducible by prompting alone: holding the model fixed and varying only the enforcement layer, prompt instructions alone let recommendation-language and internal-trace-leakage violations reach the reader, which the harness blocks entirely. A bolt-on external guardrail prevents such violations too but over-refuses, dropping utility to 88/120 where the harness preserves full utility (120/120); in this ablation, only code-owned enforcement preserves both safety and utility. The result is a reusable engineering pattern for turning exploratory prototypes into auditable applications with versioned source, control, and validation artifacts.
- Abstract(参考訳): エンタープライズ大規模言語モデル(LLM)アプリケーションは、しばしばプロンプトと検索コンテキストによって振る舞いが実行されるプロトタイプとして始まります。
製品化は、ソースバウンダリ、エンティティルーティング、回答コントラクト、再現可能なトレースの要件を追加します。
我々は、このパターンをトレース可能な監査可能なLLMエージェントアーキテクチャに再構築するハーネスエンジニアリングアプローチを提案する。
韓国の5つの企業グループ(上場企業25社)の公開データスライスでインスタンス化し、3つの研究課題を評価する。
1) ハーネスは, 固定されたバリデーションシナリオにおいて, ソースグラウンド, エンティティルーティング, トレース, アウトプット衛生, レコメンデーション言語契約を保存し, 欠陥注入制御により, バリデーションフラグが意図的に壊れていることを確認する。
2) モデル置換の下で実施されるハーネスのチェック: ホストされた3つのモデルにまたがって、全270の合成境界走行をパスし、失敗はモデル複合側に限定され、捕捉および記録された。
(3) コード所有の保証はロード・ベアリング(ロード・ベアリング,ロード・ベアリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・ビーリング,ロード・キー)である。
ボルトオン外部ガードレールは、そのような違反も防止するが、過剰に回避し、ハーネスが完全なユーティリティ(120/120)を保持する88/120にユーティリティを落とし、このアブレーションでは、コード所有の機関のみが安全性とユーティリティの両方を保護している。
その結果、探索プロトタイプをバージョン管理されたソース、コントロール、バリデーションアーティファクトを備えた監査可能なアプリケーションに変換する再利用可能なエンジニアリングパターンが得られた。
関連論文リスト
- A Tutorial on Autonomous Fault-Tolerant Control Using Knowledge-Grounded LLM Agents [0.21313236831585222]
本稿では,Large Language Model (LLM) エージェントが障害回復決定をどのようにサポートするかを検討する。
提案フレームワークは,LSMを制約付き監督プランナとして扱う。
植物固有の知識を使ってリカバリアクションを提案し、すべての提案は外部のバリデータによってチェックされる。
論文 参考訳(メタデータ) (2026-06-30T13:19:45Z) - What to Test Next: Interpretable Coverage Gap Discovery in Driving VLMs [52.50210189669399]
視覚言語モデル(VLM)を駆動するには,操作設計領域(ODD)が定義する様々な条件のシーンを正確に理解する必要がある
SliceScorerは、欠落したスライス推薦のための決定論的スコアリングルールである。
SliceNavは, 従来のスライス発見法よりも, 高リスクカバレッジギャップを効果的に表面化することを示す。
論文 参考訳(メタデータ) (2026-06-01T03:18:01Z) - Do Coding Agents Understand Least-Privilege Authorization? [14.240332406666779]
我々は、現在のモデルが認証境界自体を推測できるかどうか検討する。
We show that frontier model often off permissions by the execution chain while giving unuseed or sensitive accesss。
そこで我々は,まずカバレッジ指向のポリシを生成し,各エントリをグラウンドと感度で監査する,十分性-高度分解法を提案する。
論文 参考訳(メタデータ) (2026-05-14T14:05:58Z) - Beyond Code Reasoning: Specification-Anchored Auditing of Multi-Implementation Distributed Protocols [1.5229705287183657]
SPECAは、明示的で分類されたセキュリティプロパティを自然言語仕様から導き出し、実装間で再利用する監査フレームワークである。
RepoAuditのベンチマークでは、SPECAは100%リコール(F1=0.94)で88.9%の精度に達し、著者が検証した12のバグを地上の真実を超えて表面化している。
Sherlock Fusaka Audit Contest(10のターゲット、366の応募)では、SPECAが専門家が強化した15の脆弱性をすべて回復し、4つの修正確認バグが浮上した。
論文 参考訳(メタデータ) (2026-04-29T09:57:07Z) - Compiling Activation Steering into Weights via Null-Space Constraints for Stealthy Backdoors [48.881343993730844]
安全性に整合した大規模言語モデル(LLM)は、現実世界のパイプラインにますますデプロイされている。
敵は通常の評価では動作しないバックドアのチェックポイントを配布することができる。
最近のポストホック重み付け法は、そのようなバックドアを注入するための効率的なアプローチを提供する。
論文 参考訳(メタデータ) (2026-04-14T06:48:33Z) - SWAP: Towards Copyright Auditing of Soft Prompts via Sequential Watermarking [58.475471437150674]
ソフトプロンプト(SWAP)のための逐次透かしを提案する。
SWAPは、特定のディフェンダー指定のアウト・オブ・ディストリビューション・クラスを通じて、透かしを符号化する。
11のデータセットの実験では、SWAPの有効性、無害性、および潜在的適応攻撃に対する堅牢性を示す。
論文 参考訳(メタデータ) (2025-11-05T13:48:48Z) - PRISM: Proof-Carrying Artifact Generation through LLM x MDE Synergy and Stratified Constraints [4.573877234904622]
PRISMは大規模言語モデルをモデル駆動工学と統合する。
規制対象のアーティファクトとマシンチェック可能な安全およびコンプライアンスクリティカルなドメインの証拠を生成する。
論文 参考訳(メタデータ) (2025-10-29T18:44:22Z) - Towards Copyright Protection for Knowledge Bases of Retrieval-augmented Language Models via Reasoning [58.57194301645823]
大規模言語モデル(LLM)は、現実のパーソナライズされたアプリケーションにますます統合されている。
RAGで使用される知識基盤の貴重かつしばしばプロプライエタリな性質は、敵による不正使用のリスクをもたらす。
これらの知識基盤を保護するための透かし技術として一般化できる既存の方法は、一般的に毒やバックドア攻撃を含む。
我々は、無害な」知識基盤の著作権保護の名称を提案する。
論文 参考訳(メタデータ) (2025-02-10T09:15:56Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。