論文の概要: Toward Reliable Scientific Visualization Pipeline Construction with Structure-Aware Retrieval-Augmented LLMs
- arxiv url: http://arxiv.org/abs/2603.16057v1
- Date: Tue, 17 Mar 2026 01:52:11 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-18 17:42:07.066659
- Title: Toward Reliable Scientific Visualization Pipeline Construction with Structure-Aware Retrieval-Augmented LLMs
- Title(参考訳): 構造対応検索型LLMによる信頼性のある可視化パイプライン構築に向けて
- Abstract要約: 本稿では,パイプライン対応のvtk.jsコード例をコンテキストガイダンスとして提供する構造対応検索拡張生成ワークフローを提案する。
構造化されたドメイン固有のコンテキストによってパイプライン実行性が大幅に改善され、修正コストが削減されることを示す。
- 参考スコア(独自算出の注目度): 8.621769369142395
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Scientific visualization pipelines encode domain-specific procedural knowledge with strict execution dependencies, making their construction sensitive to missing stages, incorrect operator usage, or improper ordering. Thus, generating executable scientific visualization pipelines from natural-language descriptions remains challenging for large language models, particularly in web-based environments where visualization authoring relies on explicit code-level pipeline assembly. In this work, we investigate the reliability of LLM-based scientific visualization pipeline generation, focusing on vtk.js as a representative web-based visualization library. We propose a structure-aware retrieval-augmented generation workflow that provides pipeline-aligned vtk.js code examples as contextual guidance, supporting correct module selection, parameter configuration, and execution order. We evaluate the proposed workflow across multiple multi-stage scientific visualization tasks and LLMs, measuring reliability in terms of pipeline executability and human correction effort. To this end, we introduce correction cost as metric for the amount of manual intervention required to obtain a valid pipeline. Our results show that structured, domain-specific context substantially improves pipeline executability and reduces correction cost. We additionally provide an interactive analysis interface to support human-in-the-loop inspection and systematic evaluation of generated visualization pipelines.
- Abstract(参考訳): 科学的可視化パイプラインは、ドメイン固有の手続き的知識を厳格な実行依存でエンコードする。
このように、自然言語記述から実行可能な科学的可視化パイプラインを生成することは、特に可視化オーサリングが明示的なコードレベルのパイプラインアセンブリに依存するWebベースの環境では、大きな言語モデルでは依然として困難である。
本研究では, LLM を用いた科学的可視化パイプライン生成の信頼性について検討し, 代表的な Web ベースビジュアライゼーションライブラリとして vtk.js に着目した。
本稿では,パイプラインに沿ったvtk.jsコード例をコンテキストガイダンスとして提供し,適切なモジュール選択,パラメータ設定,実行順序をサポートする構造対応検索拡張生成ワークフローを提案する。
複数の多段階の科学的可視化タスクとLCMをまたいだワークフローの評価を行い、パイプライン実行可能性と人間の修正作業の信頼性を測定した。
この目的のために,有効なパイプラインを得るのに必要な手動介入量の指標として補正コストを導入する。
その結果、構造化されたドメイン固有のコンテキストによってパイプライン実行性が大幅に改善され、修正コストが削減されることがわかった。
また、人間のループ内検査と生成した可視化パイプラインの系統的評価をサポートする対話型解析インタフェースを提供する。
関連論文リスト
- Evaluating Modern RAG: Textual, Multimodal, Dense, and Late Interaction Pipelines [1.4180331276028662]
Retrieval-augmented Generation (RAG) システムは伝統的に、文書から情報を抽出し取り出すテキストベースのパイプラインに依存してきた。
視覚言語モデル(VLM)を利用したマルチモーダルパイプラインの最近の進歩は、視覚信号とテキスト信号を共同で符号化することで、検索品質を向上させるが、計算コストとメモリコストは増大する。
我々は,高密度および遅延相互作用アーキテクチャを含む現代テキストおよびマルチモーダルパイプラインを評価し,そのトレードオフを分析し,検索性能とシステム効率のバランスをとるための実用的なガイダンスを提供する。
論文 参考訳(メタデータ) (2026-08-24T12:25:52Z) - RepoReasoner: Evaluating Repository-Level Code Reasoning Ability of Long-Context Language Models [54.53236295237077]
リポジトリレベルのコード推論を評価するベンチマークであるRepoReasonerを紹介します。
出力予測は、ファイル間でのきめ細かいステートフルな実行推論を計測します。
Call Chain Predictionは、ノイズの多いコンテキスト下での高レベルのアーキテクチャ依存性の理解を評価する。
論文 参考訳(メタデータ) (2026-07-28T17:12:41Z) - SemPiper: Interactive Code Synthesis for Semantic Operators in Machine Learning Pipelines [7.868559688632956]
機械学習パイプラインをセマンティックデータ演算子で拡張するプログラミングモデルであるSemPipesを実演する。
セマンティック演算子の場合、SemPipesはパイプライントレーニング時に特別な実装を合成する。
本稿では,MLパイプライン開発におけるLLMの制御可能,最適化可能,実用的な統合を実現するためのセマンティック演算子について述べる。
論文 参考訳(メタデータ) (2026-06-12T11:40:09Z) - PARM: Pipeline-Adapted Reward Model [60.769414637325326]
リワードモデル(RM)は、大規模言語モデル(LLM)を人間の好みと整合させることの中心であり、高度な復号化戦略を推進している。
これまでの作業はシングルステップ生成に重点を置いていたが、現実のアプリケーションはますますマルチステージパイプラインを採用するようになっている。
我々は、最適化のためのコード生成を通じてこれを調査し、報酬モデルを定式化とソリューション段階の両方に統合するパイプラインを構築する。
論文 参考訳(メタデータ) (2026-04-20T14:29:08Z) - kRAIG: A Natural Language-Driven Agent for Automated DataOps Pipeline Generation [0.5833117322405447]
我々は、自然言語仕様をプロダクション対応KubeReason Pipelines(KFP)に変換するAIエージェントであるkRAIGを紹介する。
ユーザ意図の曖昧さを解決するために,パイプライン合成に先立って意図を明確に示すインタラクションフレームワークReQuesActを提案する。
本フレームワークは,最先端のエージェントベースラインと比較して,抽出とロードの精度が3倍向上し,変換精度が25%向上する。
論文 参考訳(メタデータ) (2026-03-19T17:53:00Z) - Autonomous Data Processing using Meta-Agents [2.3732259124656907]
我々はメタエージェント(ADP-MA)を用いたtextbf Autonomous Data Processingを提案し,データ処理パイプラインを動的に構築し,実行し,反復的に洗練するフレームワークを提案する。
ADP-MAは、コンテキスト対応の最適化、適応的なワークロード分割、拡張性のためのプログレッシブサンプリングを強調している。
ADP-MAはパイプライン構築、実行監視、代表データ処理タスク間の適応的な改善を示すインタラクティブなデモを通じてデモを行う。
論文 参考訳(メタデータ) (2026-01-30T20:58:17Z) - A Dialectic Pipeline for Improving LLM Robustness [0.0]
ドメイン固有のデータの微調整や、別のテキスト化されたホック検証器の訓練といった手法は、計算資源を必要とする。
本稿では,LLMの一般化能力を保ちながら,自己対話による解の質を向上する弁証的パイプラインを提案する。
提案した弁証法パイプラインは,標準モデル解の有意なマージンによって性能を向上できることがわかった。
論文 参考訳(メタデータ) (2026-01-28T14:42:49Z) - AI Agent for Reverse-Engineering Legacy Finite-Difference Code and Translating to Devito [0.0]
本研究では,従来の有限差分実装のDevito環境への変換を容易にする統合AIフレームワークを開発する。
Retrieval-Augmented Generation (RAG)とオープンソースのLarge Language Modelsは、システムのハイブリッドLangGraphアーキテクチャにおいて、マルチステージ反復によって結合される。
論文 参考訳(メタデータ) (2026-01-26T11:31:00Z) - Operon: Incremental Construction of Ragged Data via Named Dimensions [1.6212518002538465]
既存のワークフローエンジンには、タグ付けされたデータ固有の形状と依存関係を追跡するネイティブサポートがない。
我々はRustベースのワークフローエンジンであるOperonを紹介します。
論文 参考訳(メタデータ) (2025-11-20T06:16:31Z) - ContextNav: Towards Agentic Multimodal In-Context Learning [85.05420047017513]
ContextNavは、自動検索のスケーラビリティと人間のようなキュレーションの品質と適応性を統合するエージェントフレームワークである。
リソースを意識したマルチモーダル埋め込みパイプラインを構築し、検索可能なベクトルデータベースを維持し、エージェント検索と構造アライメントを適用して、ノイズ耐性のあるコンテキストを構築する。
実験の結果、ContextNavはさまざまなデータセットで最先端のパフォーマンスを実現している。
論文 参考訳(メタデータ) (2025-10-06T07:49:52Z) - Text-to-Pipeline: Bridging Natural Language and Data Preparation Pipelines [18.75611679837171]
我々は,NLデータ作成命令をDPパイプラインに変換する新しいタスクであるText-to-Pipelineを紹介する。
Parrotは、体系的な評価をサポートする大規模なベンチマークである。
ParROTは、プロダクションパイプラインから変換パターンをマイニングし、23,009の現実世界のテーブル上でインスタンス化する。
論文 参考訳(メタデータ) (2025-05-21T15:40:53Z) - Benchmarking Agentic Workflow Generation [80.74757493266057]
複数面シナリオと複雑なグラフワークフロー構造を備えた統合ワークフロー生成ベンチマークであるWorfBenchを紹介する。
また,サブシーケンスとサブグラフマッチングアルゴリズムを利用したシステム評価プロトコルWorfEvalを提案する。
我々は、生成されたタスクが下流のタスクを強化し、推論中により少ない時間で優れたパフォーマンスを達成することを観察する。
論文 参考訳(メタデータ) (2024-10-10T12:41:19Z) - In-context Demonstration Matters: On Prompt Optimization for Pseudo-Supervision Refinement [71.60563181678323]
大規模言語モデル(LLM)は様々なタスクで大きな成功を収めており、生成品質をさらに向上させるためには微調整が必要である場合もある。
これらの課題に対処する直接的な解決策は、教師なしの下流タスクから高信頼のデータを生成することである。
本稿では,プロンプトと全体的な擬似スーパービジョンを両立させる新しい手法,擬似教師付きデモアライメント・アライメント・アライメント・プロンプト・最適化(PAPO)アルゴリズムを提案する。
論文 参考訳(メタデータ) (2024-10-04T03:39:28Z) - Instruction Tuning for Large Language Models: A Survey [52.86322823501338]
我々は、教師付き微調整(SFT)の一般的な方法論を含む、文献の体系的なレビューを行う。
また、既存の戦略の欠陥を指摘しながら、SFTの潜在的な落とし穴についても、それに対する批判とともに検討する。
論文 参考訳(メタデータ) (2023-08-21T15:35:16Z) - Demonstrate-Search-Predict: Composing retrieval and language models for
knowledge-intensive NLP [77.817293104436]
本稿では,LMとRMの間の洗練されたパイプラインにおいて,自然言語テキストを渡すことに依存するフレームワークを提案する。
我々は、オープンドメイン、マルチホップ、会話設定で質問に答えるための新しいDSPプログラムを作成した。
論文 参考訳(メタデータ) (2022-12-28T18:52:44Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。