論文の概要: Automated SysML-Based Verification of Discipline-Specific Models
- arxiv url: http://arxiv.org/abs/2606.29006v1
- Date: Sat, 27 Jun 2026 16:56:22 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-30 18:07:15.758178
- Title: Automated SysML-Based Verification of Discipline-Specific Models
- Title(参考訳): SysMLによるディシプリン特異モデルの自動検証
- Abstract要約: このプロジェクトは、モデルベースの検証に適した検証プロセスでこの問題に対処する。
文献調査と利害関係者へのインタビューを組み合わせた混成手法を用いて、検証済み利害関係者のニーズを導出した。
このプロセスは2つの独立したSysMLツールチェーンでエンドツーエンドで実証された。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Current examples of SysML-based verification of discipline-specific models in the literature typically have two flaws. Firstly, they are developed in a tool-specific manner using proprietary APIs, limiting portability. Secondly, they focus on performance properties modelled via parametric diagrams, overlooking behavioural and interface properties that also require verification. This project addresses the problem with a verification process tailored to model-based verification, informed by common SysML tool capabilities and the UML Testing Profile, that enables automated verification of discipline\-/specific models from SysML test cases and returns the results to the SysML model for traceability. A mixed-method approach combining literature research and stakeholder interviews was used to derive validated stakeholder needs, which drove the specification and design of the process. The process was demonstrated end-to-end in two independent SysML tool-chains to evidence tool-agnosticism, and was shown to verify behavioural and interface requirements, including ordering, timing, and state-based responses, using SysML behavioural diagram constructs that parametric approaches alone cannot address.
- Abstract(参考訳): SysMLに基づく文献における規律固有のモデルの検証の現在の例は、典型的には2つの欠点がある。
まず、プロプライエタリなAPIを使用してツール固有の方法で開発され、ポータビリティが制限される。
次に、パラメトリック図でモデル化されたパフォーマンス特性に注目し、検証を必要とする振る舞い特性とインターフェース特性を見渡す。
このプロジェクトは、一般的なSysMLツール機能とUML Testing Profileによって通知されるモデルベースの検証に適した検証プロセスと、SysMLテストケースから規律/特定のモデルの自動検証を可能にし、トレーサビリティのためのSysMLモデルに結果を返します。
文献調査と利害関係者へのインタビューを組み合わせた混成手法を用いて、検証済みの利害関係者のニーズを導出し、プロセスの仕様と設計を推進した。
このプロセスは2つの独立したSysMLツールチェーンで実証され、ツール非依存の証拠となり、パラメトリックアプローチだけでは対処できないSysMLの振る舞いダイアグラムを使用して、順序付け、タイミング、状態ベースの応答を含む振る舞いとインターフェースの要求を検証することが示されている。
関連論文リスト
- Formal Verification of Agentic Systems over Operational Data [59.98246281888422]
大規模言語モデル(LLM)によって駆動されるエージェントシステムは、永続的な運用データを扱う現実世界にますます展開されている。
既存のアプローチはそのようなシステムレベルの保証を提供していません。
本稿では, 1 つの LLM とツールオーケストレーションハーネスからなるエージェントシステムのリレーショナル操作データに対する検証について述べる。
論文 参考訳(メタデータ) (2026-08-04T13:01:30Z) - Model-Driven Discipline for Multi-Agent LLMs: Requirement-to-Verification Generation of Traceable System Models [62.62160094849002]
RADIANTは、MDEとMulti-Agent Large Language Modelを組み合わせたエンジニアリング方法論である。
工学的なフェーズにまたがる異種モデルを自動的に生成する。
正確かつ自動的な変更インパクト分析を提供する。
論文 参考訳(メタデータ) (2026-07-18T08:50:55Z) - LiveFMBench: Unveiling the Power and Limits of Agentic Workflows in Specification Generation [75.05397479715576]
大規模言語モデル(LLM)とエージェントは有望な進歩を示しているが、その真の能力と失敗モードは未だ不明である。
CプログラムのためのLCMおよびエージェントベースの形式仕様生成に関する、最初の体系的および汚染に配慮した研究を提案する。
論文 参考訳(メタデータ) (2026-05-02T11:31:33Z) - Bridging Natural Language and Interactive What-If Interfaces via LLM-Generated Declarative Specification [7.203839699772057]
自然言語 (NL) WIA 質問を中間表現を介してインタラクティブな視覚インタフェースに変換する2段階のワークフローを提案する。
このワークフローを、11のWAAタイプ、5つのデータセット、3つの最先端LCMにまたがる405のWAA質問でベンチマークします。
その結果、モデル全体で、仕様の半分(52.42%)が介入なしに正しく生成されることがわかった。
論文 参考訳(メタデータ) (2026-04-08T23:35:33Z) - PAT-Agent: Autoformalization for Model Checking [17.082027022913998]
PAT-Agentは自然言語の自動形式化と形式モデル修復のためのエンドツーエンドフレームワークである。
これは、大きな言語モデルの生成能力と形式的検証の厳密さを組み合わせたものである。
論文 参考訳(メタデータ) (2025-09-28T06:32:14Z) - CompassVerifier: A Unified and Robust Verifier for LLMs Evaluation and Outcome Reward [50.97588334916863]
評価と結果報酬のための正確で堅牢な軽量検証モデルであるCompassVerifierを開発した。
数学、知識、多種多様な推論タスクにまたがる多分野の能力を示し、様々な答えの型を処理する能力を示す。
我々は,複数のデータソースから収集したモデル出力からなるVerifierBenchベンチマークを導入し,メタエラーパターンを手動で解析してCompassVerifierを強化する。
論文 参考訳(メタデータ) (2025-08-05T17:55:24Z) - Instance-Level Data-Use Auditing of Visual ML Models [49.862257986549885]
機械学習(ML)システムにおけるデータの不正使用に関する法的論争の傾向は、信頼性の高いデータ利用監査機構の必要性を浮き彫りにしている。
本稿では、データ所有者がMLモデルにおける個々のデータインスタンスの使用を監査できるように設計された、最初のプロアクティブな、インスタンスレベルのデータ利用監査手法を提案する。
論文 参考訳(メタデータ) (2025-03-28T13:28:57Z) - Inference-Time Intervention in Large Language Models for Reliable Requirement Verification [2.3759432635713895]
推論時間介入技術は微調整に代わる有望な手段である。
我々は、介入が通常時間を要する要求検証プロセスを自動化するためのきめ細かい制御を可能にする方法を実証する。
提案手法は, ベースラインモデルと微調整手法の両方において, 頑健で信頼性の高い出力を実現する。
論文 参考訳(メタデータ) (2025-03-18T10:49:36Z) - Matchmaker: Self-Improving Large Language Model Programs for Schema Matching [60.23571456538149]
本稿では,スキーママッチングのための合成言語モデルプログラムを提案する。
Matchmakerは、ラベル付きデモを必要とせずに、ゼロショットで自己改善する。
実証的に、Matchmakerが以前のMLベースのアプローチより優れている実世界の医療スキーママッチングベンチマークを実証する。
論文 参考訳(メタデータ) (2024-10-31T16:34:03Z) - Using Quality Attribute Scenarios for ML Model Test Case Generation [3.9111051646728527]
機械学習(ML)モデルテストの現在のプラクティスは、モデルパフォーマンスのテストの優先順位付けである。
本稿では,品質属性(QA)のシナリオに基づいて,システムおよびモデル関連テストケースを抽出,定義する手法を提案する。
QAベースのアプローチはMLモデルテストと評価をサポートするプロセスとツールであるMLTEに統合されている。
論文 参考訳(メタデータ) (2024-06-12T18:26:42Z) - OSM: Leveraging Model Checking for Observing Dynamic 1 behaviors in
Aspect-Oriented Applications [0.0]
観測ベース統計モデルチェック(OSM)フレームワークは、基本的なシステムコードから直接実行可能な形式モデルを構築するために開発された。
これにより、プリコンディションシフト中の電子健康記録システムの未収量性能が保証される。
論文 参考訳(メタデータ) (2024-03-03T00:03:34Z) - ReEval: Automatic Hallucination Evaluation for Retrieval-Augmented Large Language Models via Transferable Adversarial Attacks [91.55895047448249]
本稿では,LLMベースのフレームワークであるReEvalについて述べる。
本稿では、ChatGPTを用いてReEvalを実装し、2つの人気のあるオープンドメインQAデータセットのバリエーションを評価する。
我々の生成したデータは人間可読であり、大きな言語モデルで幻覚を引き起こすのに役立ちます。
論文 参考訳(メタデータ) (2023-10-19T06:37:32Z) - DeforestVis: Behavior Analysis of Machine Learning Models with Surrogate Decision Stumps [46.58231605323107]
複雑なMLモデルの振る舞いを要約する視覚解析ツールであるDeforestVisを提案する。
DeforestVisは、より多くの切り株をインクリメンタルに生成することで、複雑さとフィデリティのトレードオフを探索するのに役立つ。
DeforestVisの適用性と有用性について,2つのユースケースと,データアナリストとモデル開発者とのエキスパートインタビューで紹介する。
論文 参考訳(メタデータ) (2023-03-31T21:17:15Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。