論文の概要: The Other Half of Workflow Portability: Evidence-Backed HPC Site Profiles with Agentic Discovery
- arxiv url: http://arxiv.org/abs/2610.00971v1
- Date: Thu, 01 Oct 2026 03:01:31 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-03 01:19:23.870796
- Title: The Other Half of Workflow Portability: Evidence-Backed HPC Site Profiles with Agentic Discovery
- Title(参考訳): ワークフローポータビリティの残りの半分:エージェントディスカバリを備えたエビデンスベースのHPCサイトプロファイル
- Abstract要約: あるHPCサイトで開発されたワークフローを別のHPCサイトに移行することは、ある程度の試行錯誤なしにはめったに成功しない。
我々は,この知識を実用的なものにするための構造化されたエビデンス支援文書を提案する。
我々は、Purdue Anvil、TACC Stampede3、Notre Dame CRCでプロファイルを構築し、実際のワークフローをプレライトするケーススタディを提示します。
- 参考スコア(独自算出の注目度): 1.867104854396265
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Moving a workflow developed and tested at one HPC site to another rarely succeeds without some amount of trial and error. Package managers rebuild software environments, containers ship whole filesystems, and workflow specifications such as backpacks package a workflow with its software, data, and resource requirements. These approaches address one half of workflow portability: what a workflow needs. But none describes how a given HPC site must be used, and that missing half is why even a portable workflow requires manual adjustment at each new site. That gap includes the site's resource shape, storage configuration, network permissions, and operating policies. This information may be explicit in the batch system, hidden in the prose of documentation, or buried deep within a router's configuration, making it difficult for an automated deployment tool to turn site knowledge into useful deployment decisions. We propose the HPC site profile, a structured, evidence-backed document that makes this knowledge actionable. We automatically construct it in three steps that mirror where the information lives: measuring the login node, extracting typed fields from documentation with a bounded language-model agent, and submitting pilot jobs for eligible unresolved fields. Every field is verified against its evidence or discarded, so a rule, not the model, decides what enters the profile. The profile then preflights a workflow into an execution plan or an early, explainable failure. We build profiles at Purdue Anvil, TACC Stampede3, and Notre Dame CRC and present a case study of preflighting a real workflow.
- Abstract(参考訳): あるHPCサイトで開発され、テストされたワークフローを別のサイトに移すことは、ある程度の試行錯誤なしにはめったに成功しない。
パッケージマネージャはソフトウェア環境を再構築し、コンテナはファイルシステム全体を出荷する。
これらのアプローチはワークフローのポータビリティの半分に対処します。
しかし、特定のHPCサイトをどのように使うべきかは説明されていない。
このギャップには、サイトのリソース形状、ストレージ構成、ネットワークパーミッション、運用ポリシーが含まれる。
この情報は、バッチシステム、ドキュメントの散文に隠されたり、ルータの構成に深く埋もれたりすることで、自動化されたデプロイメントツールがサイト知識を有用なデプロイメント決定に変換するのが難しくなる可能性がある。
我々は,この知識を実用的なものにするための構造化された証拠文書であるHPCサイトプロファイルを提案する。
ログインノードを計測し、境界言語モデルエージェントで文書から型付きフィールドを抽出し、未解決のフィールドに対してパイロットジョブを提出する。
すべてのフィールドは、その証拠に対して検証されるか、破棄されるため、モデルではなくルールがプロファイルに入るものを決定する。
プロファイルはワークフローを実行計画や、早期で説明可能な失敗に準備する。
我々は、Purdue Anvil、TACC Stampede3、Notre Dame CRCでプロファイルを構築し、実際のワークフローをプレライトするケーススタディを提示します。
関連論文リスト
- COVENANT: Natural-Language Workflow Compilation for Aligned Agent Execution [12.755574564434788]
本稿では,ワークフロー対応エージェント実行のためのコンパイラ・アンド・インタープリタアーキテクチャであるCOVENANTを提案する。
私たちの重要な洞察は、ワークフロー命令をプロンプトではなく、ソースプログラムとして扱うことです。
COVENANTは命令をワークフロー抽象構文木(WAST)に変換し、ワークフロー制御フローグラフ(WCFG)に変換する。
論文 参考訳(メタデータ) (2026-07-28T07:59:50Z) - Tencent WorkBuddy Bench: A Multi-Domain Coding-Agent Benchmark with Contamination-Resistant Task Construction [57.138342889101345]
Tencent WorkBuddy Benchは、コーディングエージェントのためのマルチドメイン評価スイートである。
本報告では, 設計手法, スコアリングプロトコル, クロスモデルリーダーボードについて述べる。
論文 参考訳(メタデータ) (2026-07-23T04:34:06Z) - A Case for Agentic Tuning: From Documentation to Action in PostgreSQL [41.66343157817528]
PerfEvolveは専門家のチューニング方法論を実行可能なスキルに変換する。
PerfEvolveは、最先端のドキュメント駆動チューニングベースラインを最大35.2%向上させる。
論文 参考訳(メタデータ) (2026-05-19T15:26:28Z) - GraphFlow: An Architecture for Formally Verifiable Visual Workflows Enabling Reliable Agentic AI Automation [0.0]
GraphFlowは、ミッションクリティカルなプロセスにおけるエージェントAI自動化の信頼性向上を目的とした、ビジュアルワークフローシステムである。
既存のワークフロープラットフォームは、耐久性のある実行と可観測性を提供するが、セマンティックな正確性を保証するものはほとんどない。
3つの臨床現場で1年間のパイロットが8,728件のコホート登録ワークフローを実行し、97.08%の完成率を記録した。
論文 参考訳(メタデータ) (2026-05-14T15:33:05Z) - Claw-Eval-Live: A Live Agent Benchmark for Evolving Real-World Workflows [67.92316850084575]
ワークフローエージェントのライブベンチマークであるClaw-Eval-Liveを紹介する。
各リリースは、公開ワークフロー要求信号から構築される。
Claw-Eval-Liveは実行トレース、監査ログ、サービス状態、実行後のワークスペースアーティファクトを記録する。
論文 参考訳(メタデータ) (2026-04-30T17:23:19Z) - From Research Question to Scientific Workflow: Leveraging Agentic AI for Science Automation [0.0]
我々は,Hyperflow WMS上で動作する1000 Genomes集団遺伝ワークフロー上でのアーキテクチャの実装と評価を行った。
150クエリに関するアブレーション調査では、Skillsはフルマッチインテントの精度を44%から83%に引き上げ、スキル駆動の遅延ワークフロー生成はデータ転送を92%削減する。
論文 参考訳(メタデータ) (2026-04-23T17:52:52Z) - Learning to Compose for Cross-domain Agentic Workflow Generation [56.630382886594184]
クロスドメインワークフロー生成のためのオープンソースのLLMを作成します。
さまざまなドメインにわたる再利用可能なワークフロー機能のコンパクトなセットを学びます。
当社の1パスジェネレータは、20イテレーションを消費するSOTAリファインメントベースラインを超えています。
論文 参考訳(メタデータ) (2026-02-11T18:27:22Z) - ComfyGPT: A Self-Optimizing Multi-Agent System for Comprehensive ComfyUI Workflow Generation [96.44354750396019]
ComfyGPTはタスク記述に基づいてComfyUIを生成するように設計された自動最適化マルチエージェントシステムである。
FlowDatasetは、13,571のワークフロー記述ペアを含む大規模なデータセットである。
FlowBenchはワークフロー生成システムを評価するためのベンチマークである。
論文 参考訳(メタデータ) (2025-03-22T06:48:50Z) - The Hidden Costs of Automation: An Empirical Study on GitHub Actions Workflow Maintenance [45.53834452021771]
GitHub Actions(GA)は、エンジニアリングタスクの自動実行を合理化するオーケストレーションプラットフォームである。
欠陥の修正、依存関係の更新、あるいは既存のワークフローファイルの修正には、人間の介入が必要である。
論文 参考訳(メタデータ) (2024-09-04T01:33:16Z) - Spider2-V: How Far Are Multimodal Agents From Automating Data Science and Engineering Workflows? [73.81908518992161]
我々は、プロのデータサイエンスとエンジニアリングに焦点を当てた最初のマルチモーダルエージェントベンチマークであるSpider2-Vを紹介する。
Spider2-Vは、本物のコンピュータ環境における現実世界のタスクを特徴とし、20のエンタープライズレベルのプロフェッショナルアプリケーションを組み込んでいる。
これらのタスクは、エンタープライズデータソフトウェアシステムにおいて、コードを書き、GUIを管理することで、マルチモーダルエージェントがデータ関連のタスクを実行する能力を評価する。
論文 参考訳(メタデータ) (2024-07-15T17:54:37Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。