論文の概要: PRISM: Proof-Carrying Artifact Generation through LLM x MDE Synergy and Stratified Constraints
- arxiv url: http://arxiv.org/abs/2510.25890v1
- Date: Wed, 29 Oct 2025 18:44:22 GMT
- ステータス: 翻訳完了
- システム内更新日: 2025-10-31 16:05:09.542045
- Title: PRISM: Proof-Carrying Artifact Generation through LLM x MDE Synergy and Stratified Constraints
- Title(参考訳): PRISM: LLM x MDE シナジーと成層制約による鋳造人工物生成
- Abstract要約: PRISMは大規模言語モデルをモデル駆動工学と統合する。
規制対象のアーティファクトとマシンチェック可能な安全およびコンプライアンスクリティカルなドメインの証拠を生成する。
- 参考スコア(独自算出の注目度): 4.573877234904622
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: PRISM unifies Large Language Models with Model-Driven Engineering to generate regulator-ready artifacts and machine-checkable evidence for safety- and compliance-critical domains. PRISM integrates three pillars: a Unified Meta-Model (UMM) reconciles heterogeneous schemas and regulatory text into a single semantic space; an Integrated Constraint Model (ICM) compiles structural and semantic requirements into enforcement artifacts including generation-time automata (GBNF, DFA) and post-generation validators (e.g., SHACL, SMT); and Constraint-Guided Verifiable Generation (CVG) applies these through two-layer enforcement - structural constraints drive prefix-safe decoding while semantic/logical validation produces machine-checkable certificates. When violations occur, PRISM performs audit-guided repair and records generation traces for compliance review. We evaluate PRISM in automotive software engineering (AUTOSAR) and cross-border legal jurisdiction (Brussels I bis). PRISM produces structurally valid, auditable artifacts that integrate with existing tooling and substantially reduce manual remediation effort, providing a practical path toward automated artifact generation with built-in assurance.
- Abstract(参考訳): PRISMは、大規模言語モデルとモデル駆動工学を統合して、規制対象のアーティファクトと、安全およびコンプライアンスクリティカルなドメインに対するマシンチェック可能な証拠を生成する。
PRISMは3つの柱を統合している: 統一メタモデル(UMM)は異種スキーマと規制テキストを単一の意味空間に再構成する; 統合制約モデル(ICM)は構造的およびセマンティックな要求を、生成時オートマトン(GBNF, DFA)やポストジェネレーションバリデータ(例えば、SHACL, SMT)を含む実行時アーティファクトにコンパイルする。
違反が発生した場合、PRISMは監査誘導修理を行い、コンプライアンスレビューのための生成トレースを記録する。
我々は,自動車ソフトウェア工学(AUTOSAR)と国境を越えた司法管轄権(Brussels I bis)においてPRISMを評価する。
PRISMは構造的に有効な監査可能なアーティファクトを生成し、既存のツールと統合し、手作業による修復作業を大幅に削減し、組込み保証による自動アーティファクト生成への実践的な道を提供する。
関連論文リスト
- Agent Gym: A Framework for Continuous Evaluation and Evolution of LLM Agents Through Human-in-the-Loop Feedback [0.0]
大きな言語モデル(LLM)エージェントは、基本的な緊張に直面します。エージェントの動作は、デプロイ時に凍結されますが、処理するビジネスルールとエッジケースは、進化し続けます。
既存のアプローチではエージェント構築とワンタイム評価を行うが、継続的デプロイ後の動作補正のための構造的メカニズムは提供しない。
我々はAgent Gymを紹介した。Agent Gymはモジュール型のドメインに依存しないフレームワークで、既存のLLMベースのエージェントを連続的な評価と進化のループでラップする。
論文 参考訳(メタデータ) (2026-08-16T07:27:26Z) - Formal Verification of Agentic Systems over Operational Data [59.98246281888422]
大規模言語モデル(LLM)によって駆動されるエージェントシステムは、永続的な運用データを扱う現実世界にますます展開されている。
既存のアプローチはそのようなシステムレベルの保証を提供していません。
本稿では, 1 つの LLM とツールオーケストレーションハーネスからなるエージェントシステムのリレーショナル操作データに対する検証について述べる。
論文 参考訳(メタデータ) (2026-08-04T13:01:30Z) - Model-Driven Discipline for Multi-Agent LLMs: Requirement-to-Verification Generation of Traceable System Models [62.62160094849002]
RADIANTは、MDEとMulti-Agent Large Language Modelを組み合わせたエンジニアリング方法論である。
工学的なフェーズにまたがる異種モデルを自動的に生成する。
正確かつ自動的な変更インパクト分析を提供する。
論文 参考訳(メタデータ) (2026-07-18T08:50:55Z) - Automating Cause-Effect Specification with Knowledge Graphs and Large Language Models [0.1223474232275842]
本稿では,C&Eロジックの生成を自動化するセマンティックAIフレームワークを提案する。
このフレームワークは知識グラフ(KG)と制約付き大言語モデル(LLM)レイヤを組み合わせる。
論文 参考訳(メタデータ) (2026-06-30T13:03:46Z) - PRIMA: Operational Patterns for Resilient Multi-Agent Research with Verifiable Identity and Convergent Feedback [0.0]
PRIMAは、複数時間にわたる協調型マルチエージェント研究システムとして運用されている。
主なコントリビューションは、生存可能な障害モードのための3つの運用パターンである。
グラフ同型ケーススタディは、生成されたアーティファクトのアーキテクチャ的クレームを根拠にしている。
論文 参考訳(メタデータ) (2026-05-23T23:27:46Z) - Structure-Aware RAG: Structured Retrieval Augmented Generation from Noisy Data for Conversational Agents [68.52563127206808]
SA-RAG(Structure-aware Retrieval Augmented Generation)は、テーブルを中間構造表現として使用して、コンパクトで制御可能なインターフェースを提供する。
メタデータの正規化と有効性をモデル化する品質対応のテーブルメタデータ生成フレームワークを提案する。
2つのノイズの多い実世界のデータセットの実験は、SA-RAGが既存のRAGベースラインを大幅に上回っていることを示している。
論文 参考訳(メタデータ) (2026-05-23T03:07:33Z) - Learning and Enforcing Context-Sensitive Control for LLMs [48.58004364546273]
本稿では,大規模言語モデルの相互作用から文脈依存制約を自動的に学習するフレームワークを提案する。
実験により,本手法は,LLM (1Bパラメータ) の学習と生成を完全制約付きで行うことができることを示した。
論文 参考訳(メタデータ) (2026-04-12T14:50:03Z) - REGAL: A Registry-Driven Architecture for Deterministic Grounding of Agentic AI in Enterprise Telemetry [0.0]
大規模言語モデル(LLM)は、エージェント自動化の新しい形態を可能にする。
本稿では,企業テレメトリにおけるエージェントAIシステムの決定論的基盤化のためのレジストリ駆動型アーキテクチャREGALを提案する。
論文 参考訳(メタデータ) (2026-03-03T14:13:39Z) - From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning [81.97788535387286]
本稿では,エージェントによる検証・編集機構を統一された単一パス推論プロセスに内部化するフレームワークを提案する。
最小限のデータで、SRI-Coderは、ChatモデルがBaseモデルの完了性能を上回ることができる。
FIMスタイルのチューニングとは異なり、SRIは一般的なコーディング能力を保持し、標準のFIMに匹敵する推論遅延を維持する。
論文 参考訳(メタデータ) (2026-01-19T20:33:53Z) - AI Bill of Materials and Beyond: Systematizing Security Assurance through the AI Risk Scanning (AIRS) Framework [31.261980405052938]
人工知能(AI)システムの保証は、ソフトウェアサプライチェーンセキュリティ、敵機械学習、ガバナンスドキュメントに分散している。
本稿では,AI保証の運用を目的とした脅威モデルに基づくエビデンス発生フレームワークであるAI Risk Scanning(AIRS)フレームワークを紹介する。
論文 参考訳(メタデータ) (2025-11-16T16:10:38Z) - "Show Me You Comply... Without Showing Me Anything": Zero-Knowledge Software Auditing for AI-Enabled Systems [2.2981698355892686]
本稿では,新しいMLOps検証フレームワークであるZKMLOpsを紹介する。
ZKP(Zero-Knowledge Proofs)暗号プロトコルを運用し、証明者が証明者に対して、文が真実であることを納得させることができる。
我々は、金融リスク監査における規制コンプライアンスの研究を通じて、この枠組みの実践性を評価する。
論文 参考訳(メタデータ) (2025-10-30T15:03:32Z) - Metacognitive Self-Correction for Multi-Agent System via Prototype-Guided Next-Execution Reconstruction [58.51530390018909]
大規模言語モデルに基づくマルチエージェントシステムは、協調的な問題解決において優れているが、エラーのカスケードには脆弱である。
我々は,MASにリアルタイム,教師なし,ステップレベルの誤り検出と自己補正を付与するメタ認知フレームワークMASCを提案する。
論文 参考訳(メタデータ) (2025-10-16T05:35:37Z) - Automatic Building Code Review: A Case Study [6.530899637501737]
建設担当者は、プロジェクトのサイズと複雑さが増大するにつれて、労働集約的で、エラーを起こし、コストがかかる設計文書のレビューに直面します。
本研究では,BIMに基づくデータ抽出と自動検証を統合したエージェント駆動型フレームワークを提案する。
論文 参考訳(メタデータ) (2025-10-03T00:30:14Z) - Safe and Certifiable AI Systems: Concepts, Challenges, and Lessons Learned [45.44933002008943]
この白書は、T"UV AUSTRIA Trusted AIフレームワークを提示する。
エンド・ツー・エンドの監査カタログであり、機械学習システムの評価と認定のための方法論である。
セキュアなソフトウェア開発、機能要件、倫理とデータプライバシという3つの柱の上に構築されているのは、EU AI Actの高レベルの義務を、特定かつテスト可能な基準に翻訳するものです。
論文 参考訳(メタデータ) (2025-09-08T17:52:08Z) - Large Language Model-Driven Code Compliance Checking in Building Information Modeling [3.2648052741820166]
本研究では,ビルディングインフォメーション・モデリングにおける手動コードコンプライアンスチェックの時間的およびエラーの原因となる特性について考察する。
この重要なプロセスを半自動化するために、LLM(Large Language Model)駆動のアプローチを導入している。
開発システムは、GPT、Claude、Gemini、LlamaなどのLLMとRevitソフトウェアを統合し、ビルドコードを解釈し、Pythonスクリプトを生成し、半自動コンプライアンスチェックを実行する。
論文 参考訳(メタデータ) (2025-06-25T15:50:34Z) - AI4Contracts: LLM & RAG-Powered Encoding of Financial Derivative Contracts [1.3060230641655135]
大規模言語モデル(LLM)と検索拡張生成(RAG)は、AIシステムが構造化されていないテキストから情報を抽出し整理する方法を再構築している。
本稿では,テンプレート駆動型LLMフレームワークであるCDMizerと,構造化テキスト変換のためのRAGベースのフレームワークを紹介する。
論文 参考訳(メタデータ) (2025-06-01T16:05:00Z) - Training Language Models to Generate Quality Code with Program Analysis Feedback [66.0854002147103]
大規模言語モデル(LLM)によるコード生成は、ますます本番環境で採用されているが、コード品質の保証には失敗している。
実運用品質のコードを生成するためにLLMにインセンティブを与える強化学習フレームワークであるREALを提案する。
論文 参考訳(メタデータ) (2025-05-28T17:57:47Z) - SOPBench: Evaluating Language Agents at Following Standard Operating Procedures and Constraints [59.645885492637845]
SOPBenchは、各サービス固有のSOPコードプログラムを実行可能な関数の有向グラフに変換する評価パイプラインである。
提案手法では,各サービス固有のSOPコードプログラムを実行可能関数の有向グラフに変換し,自然言語SOP記述に基づいてこれらの関数を呼び出しなければならない。
我々は18の先行モデルを評価し、上位モデルでさえタスクが困難であることを示す。
論文 参考訳(メタデータ) (2025-03-11T17:53:02Z) - Semantic Integrity Constraints: Declarative Guardrails for AI-Augmented Data Processing Systems [39.23499993745249]
セマンティッククエリにおけるLLM出力に対する正当性条件を指定・強制するためのセマンティック整合性制約(SIC)を導入する。
SICは、従来のデータベース整合性制約をセマンティックセッティングに一般化し、グラウンド、サウンドネス、排他といった一般的なタイプの制約をサポートする。
本稿では,SICをクエリ計画と実行環境に統合するシステム設計について述べる。
論文 参考訳(メタデータ) (2025-03-01T19:59:25Z) - Towards Copyright Protection for Knowledge Bases of Retrieval-augmented Language Models via Reasoning [58.57194301645823]
大規模言語モデル(LLM)は、現実のパーソナライズされたアプリケーションにますます統合されている。
RAGで使用される知識基盤の貴重かつしばしばプロプライエタリな性質は、敵による不正使用のリスクをもたらす。
これらの知識基盤を保護するための透かし技術として一般化できる既存の方法は、一般的に毒やバックドア攻撃を含む。
我々は、無害な」知識基盤の著作権保護の名称を提案する。
論文 参考訳(メタデータ) (2025-02-10T09:15:56Z) - A General Framework for Verification and Control of Dynamical Models via Certificate Synthesis [54.959571890098786]
システム仕様を符号化し、対応する証明書を定義するためのフレームワークを提供する。
コントローラと証明書を形式的に合成する自動化手法を提案する。
我々のアプローチは、ニューラルネットワークの柔軟性を利用して、制御のための安全な学習の幅広い分野に寄与する。
論文 参考訳(メタデータ) (2023-09-12T09:37:26Z) - Relational Action Bases: Formalization, Effective Safety Verification,
and Invariants (Extended Version) [67.99023219822564]
我々はリレーショナルアクションベース(RAB)の一般的な枠組みを紹介する。
RABは両方の制限を解除することで既存のモデルを一般化する。
データ対応ビジネスプロセスのベンチマークにおいて、このアプローチの有効性を実証する。
論文 参考訳(メタデータ) (2022-08-12T17:03:50Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。