論文の概要: Qualixar OS: A Universal Operating System for AI Agent Orchestration
- arxiv url: http://arxiv.org/abs/2604.06392v1
- Date: Tue, 07 Apr 2026 19:22:20 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-09 17:30:51.204813
- Title: Qualixar OS: A Universal Operating System for AI Agent Orchestration
- Title(参考訳): Qualixar OS: AIエージェントオーケストレーションのためのユニバーサルオペレーティングシステム
- Abstract要約: Qualixar OSは、ユニバーサルAIエージェントオーケストレーションのための最初のアプリケーション層オペレーティングシステムである。
10のLLMプロバイダ、8以上のエージェントフレームワーク、7つのトランスポートにまたがる、異種マルチエージェントシステムの完全なランタイムを提供する。
Qualixar OSは、217のイベントタイプと8の品質モジュールで2,821のテストケースで検証されている。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We present Qualixar OS, the first application-layer operating system for universal AI agent orchestration. Unlike kernel-level approaches (AIOS) or single-framework tools (AutoGen, CrewAI), Qualixar OS provides a complete runtime for heterogeneous multi-agent systems spanning 10 LLM providers, 8+ agent frameworks, and 7 transports. We contribute: (1) execution semantics for 12 multi-agent topologies including grid, forest, mesh, and maker patterns; (2) Forge, an LLM-driven team design engine with historical strategy memory; (3) three-layer model routing combining Q-learning, five strategies, and Bayesian POMDP with dynamic multi-provider discovery; (4) a consensus-based judge pipeline with Goodhart detection, JSD drift monitoring, and alignment trilemma navigation; (5) four-layer content attribution with HMAC signing and steganographic watermarks; (6) universal compatibility via the Claw Bridge supporting MCP and A2A protocols with a 25-command Universal Command Protocol; (7) a 24-tab production dashboard with visual workflow builder and skill marketplace. Qualixar OS is validated by 2,821 test cases across 217 event types and 8 quality modules. On a custom 20-task evaluation suite, the system achieves 100% accuracy at a mean cost of $0.000039 per task. Source-available under the Elastic License 2.0.
- Abstract(参考訳): ユニバーサルAIエージェントオーケストレーションのためのアプリケーション層オペレーティングシステムQuarlixar OSについて紹介する。
カーネルレベルのアプローチ(AIOS)やシングルフレームワークツール(AutoGen、CrewAI)とは異なり、Quarial OSは10のLLMプロバイダ、8以上のエージェントフレームワーク、7つのトランスポートにまたがる異種マルチエージェントシステムのための完全なランタイムを提供する。
1)グリッド,フォレスト,メッシュ,メーカパターンを含む12のマルチエージェントトポロジの実行セマンティクス,(2)LLM駆動のチーム設計エンジンであるForge,(3)Qラーニング,5つの戦略,ベイジアンPOMDPを併用した3層モデルルーティング,(4)Goodhart検出,JSDドリフト監視,アライメントトリレンマナビゲーションを備えたコンセンサスベースの判断パイプライン,(5)HMAC署名とステガングラフによる4層コンテンツ属性,(6)Claw BridgeによるMCPおよびA2Aプロトコルのサポート,(7)ビジュアルワークフローとマーケットプレースを備えた24タブのプロダクションダッシュボード。
Qualixar OSは、217のイベントタイプと8の品質モジュールで2,821のテストケースで検証されている。
カスタム20タスク評価スイートでは、1タスクあたり0.000039ドルの平均コストで100%精度を達成している。
ソースコードはElastic License 2.0で入手できる。
関連論文リスト
- ProCUA-SFT Technical Report [80.97543110323542]
コンピュータ使用エージェント(CUA)の訓練には、全デスクトップ環境で収集された大規模で多様な軌跡データが必要である。
93Kの合成軌道から抽出した3.1MステップレベルのSFTサンプルのデータセットであるProCUA-SFTについて述べる。
ProCUA-SFTの微調整UI-TARS 7Bは、OSWorldで45.0%、ベースモデルよりも18.7ポイント改善されている。
論文 参考訳(メタデータ) (2026-06-15T22:04:11Z) - PerspectiveGap: A Benchmark for Multi-Agent Orchestration Prompting [6.877973774604102]
PerspectiveGapは、マルチエージェントシステムのためのオーケストレーションプロンプトを構成するLLMの機能を評価するためのベンチマークである。
10社の27社の商用モデルによる実験では、GPT-5.5は全てのライバルより大幅に優れていた。
論文 参考訳(メタデータ) (2026-06-07T23:26:12Z) - KYA: A Framework-Agnostic Trust Layer for Autonomous Systems with Verifiable Provenance and Hierarchical Policy Composition [0.0]
KYA(Know Your Agents)は、自律システムのためのオープンソースのフレームワークに依存しない信頼層である。
PyPIのveldt-kyaパッケージとしてApache 2.0で利用可能である。
論文 参考訳(メタデータ) (2026-05-25T02:59:54Z) - EngiAI: A Multi-Agent Framework and Benchmark Suite for LLM-Driven Engineering Design [0.4499833362998488]
3つの評価次元を持つベンチマークスイートを導入する。
本稿では,LangGraph上に構築されたマルチエージェントシステム(MAS)の実装であるEngiAIを紹介する。
論文 参考訳(メタデータ) (2026-05-19T12:12:09Z) - DiagramNet: An End-to-End Recognition Framework and Dataset for Non-Standard System-Level Diagrams [12.352523861911076]
システムレベル図のための最初のマルチモーダルデータセットであるDiagramNetを紹介する。
本稿では、複雑な視覚的推論を知覚、推論、知識の各段階に分解するプログレッシブトレーニングパイプラインを提案する。
DiagramNetベンチマークでは、提案したワークフローに3B-パラメータモデルを組み込むことで、2025 EDA Elite Challengeの勝者を超え、GPT-5、Claude-Sonnet-4、Gemini-2.5-Proをエンドツーエンド評価で2倍以上上回っている。
論文 参考訳(メタデータ) (2026-05-02T09:21:30Z) - Mobile-Agent-v3.5: Multi-platform Fundamental GUI Agents [56.72789202127874]
この記事では、最新のネイティブGUIエージェントモデルであるGUI-Owl-1.5を紹介する。
クラウドとエッジのコラボレーションとリアルタイムのインタラクションを実現するために、さまざまなプラットフォーム(デスクトップ、モバイル、ブラウザなど)をサポートしている。
オープンソースモデル上で20以上のGUIベンチマークで最先端の結果を得る。
論文 参考訳(メタデータ) (2026-02-15T01:52:19Z) - Many Hands Make Light Work: An LLM-based Multi-Agent System for Detecting Malicious PyPI Packages [3.7667883869699597]
PyPIのようなオープンソースリポジトリの悪意のあるコードは、ソフトウェアサプライチェーンに対する脅威が増大している。
本稿では,悪質なPyPIパッケージを検出するために協調言語モデルを用いたマルチエージェントシステムであるLAMPSを提案する。
論文 参考訳(メタデータ) (2026-01-17T19:43:22Z) - STEP3-VL-10B Technical Report [115.89015065130127]
STEP3-VL-10Bは、コンパクト効率とフロンティアレベルのマルチモーダルインテリジェンスとのトレードオフを再定義する軽量基盤モデルである。
そこで我々はPallel Coordinated Reasoning(PaCoRe)を実装して,テスト時間計算をスケールし,リソースをスケーラブルな知覚推論に割り当てる。
MMBenchでは92.2%、MMMUでは80.11%、AIME2025では94.43%、MathVisionでは75.95%である。
論文 参考訳(メタデータ) (2026-01-14T17:58:24Z) - Towards a Science of Scaling Agent Systems [79.64446272302287]
エージェント評価の定義を定式化し,エージェント量,コーディネーション構造,モデル,タスク特性の相互作用として,スケーリング法則を特徴付ける。
協調指標を用いて予測モデルを導出し,R2=0をクロスバリデーションし,未知のタスク領域の予測を可能にする。
ツールコーディネーショントレードオフ: 固定的な計算予算の下では, ツールヘビータスクはマルチエージェントのオーバーヘッドから不均衡に悩まされ, 2) 能力飽和: 調整が減少または負のリターンを, 単一エージェントのベースラインが45%を超えると達成できる。
論文 参考訳(メタデータ) (2025-12-09T06:52:21Z) - UltraCUA: A Foundation Model for Computer Use Agents with Hybrid Action [77.63125913907771]
本稿では,GUIプリミティブと高レベルのプログラムツールコールのギャップを埋める基盤モデルであるUltraCUAを提案する。
7Bおよび32Bモデルによる実験は、最先端のエージェントよりも大幅に改善されている。
論文 参考訳(メタデータ) (2025-10-20T17:48:26Z) - Towards Engineering Multi-Agent LLMs: A Protocol-Driven Approach [13.760107452858044]
本稿では,マルチエージェントのための3つの中核SE設計原則をインスタンス化するプロトコル層方法論である,SEMAP(Software Engineering Multi-Agent Protocol)を紹介する。
コード開発では、機能レベルの開発が69.6%減少し、デプロイメントレベルの開発が56.7%に達する。
論文 参考訳(メタデータ) (2025-10-14T03:49:30Z) - OmniNova:A General Multimodal Agent Framework [0.5439020425819]
特殊なツールを備えた大規模言語モデル(LLM)は、インテリジェントな自動化システムに新たな機会をもたらす。
OmniNovaはモジュール型のマルチエージェント自動化フレームワークで、言語モデルとWeb検索、クローリング、コード実行機能といった特殊なツールを組み合わせる。
論文 参考訳(メタデータ) (2025-03-25T19:21:01Z) - FusionLLM: A Decentralized LLM Training System on Geo-distributed GPUs with Adaptive Compression [55.992528247880685]
分散トレーニングは、システム設計と効率に関する重要な課題に直面します。
大規模深層ニューラルネットワーク(DNN)のトレーニング用に設計・実装された分散トレーニングシステムFusionLLMを提案する。
本システムと手法は,収束性を確保しつつ,ベースライン法と比較して1.45~9.39倍の高速化を実現可能であることを示す。
論文 参考訳(メタデータ) (2024-10-16T16:13:19Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。