論文の概要: RANalyzer: Automated Continuous RAN Software Evaluation and Regression Analysis
- arxiv url: http://arxiv.org/abs/2604.23153v1
- Date: Sat, 25 Apr 2026 05:49:44 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-28 17:12:07.183141
- Title: RANalyzer: Automated Continuous RAN Software Evaluation and Regression Analysis
- Title(参考訳): RANalyzer: 継続的RANソフトウェア評価と回帰分析を自動化する
- Authors: Ravis Shirkhani, Reshma Prasad, Leonardo Bonati, Tommaso Melodia, Michele Polese,
- Abstract要約: 本稿では,ソフトウェアアップデートのパフォーマンスへの影響を定量化する自動テスト分析フレームワークRANalyzerを提案する。
フレームワークはCI/CD/CTパイプラインに統合され、大規模なソフトウェアアップデートの自動化、継続的な評価が可能になる。
- 参考スコア(独自算出の注目度): 13.239476173711635
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Software-driven O-RAN architectures enable rapid innovation through frequent, independent updates to virtualized components. However, attributing performance variations to specific software changes is challenging due to the stochastic nature of wireless systems, where channel conditions, interference, and hardware variability confound analysis. Traditional threshold-based monitoring and manual troubleshooting do not scale with modern software evolution. This paper presents RANalyzer, an automated test analysis framework that quantifies the performance impact of software updates beyond what can be explained by wireless channel conditions. RANalyzer combines LLM-assisted semantic extraction with residuals analysis. The first categorizes code changes by affected protocol layers and functional components, while the second provides insights on the effect of load, channel, or code changes on the test performance. We contribute an extensive dataset collected over more than two years of continuous over-the-air testing on an experimental O-RAN testbed, comprising over 8,600 automated tests across 69 releases of the OAI stack. By modeling expected performance and interpreting deviations as software-induced effects, we identify degraded instances attributable to code changes and correlate them with specific change categories. The framework can be integrated into CI/CD/CT pipelines for automated, continuous evaluation of software updates at scale.
- Abstract(参考訳): ソフトウェア駆動のO-RANアーキテクチャは、仮想化コンポーネントへの頻繁で独立したアップデートを通じて、迅速なイノベーションを可能にする。
しかし、特定のソフトウェアの変更に性能の変化をもたらすのは、チャネル条件、干渉、ハードウェアの変動が相反する解析を行う無線システムの確率的な性質のためである。
従来のしきい値ベースの監視と手動のトラブルシューティングは、現代のソフトウェア進化ではスケールしない。
本稿では、無線チャネル条件で説明できる以上のソフトウェア更新の性能への影響を定量化する自動テスト分析フレームワークRANalyzerを提案する。
RANalyzerはLLMによる意味抽出と残基分析を組み合わせた。
ひとつは、影響を受けるプロトコル層と機能コンポーネントによるコード変更を分類し、もうひとつは、負荷、チャネル、あるいはコード変更がテストパフォーマンスに与える影響に関する洞察を提供する。
OAIスタックの69リリースにまたがる8,600以上の自動テストを含む,実験的なO-RANテストベッド上での2年以上にわたる連続的オーバー・ザ・エアテストのデータセットをコントリビュートする。
期待される性能をモデル化し、偏差をソフトウェアが引き起こす影響として解釈することにより、コードの変更に起因する劣化したインスタンスを特定し、それらを特定の変更カテゴリと相関付ける。
フレームワークはCI/CD/CTパイプラインに統合され、大規模なソフトウェアアップデートの自動化、継続的な評価が可能になる。
関連論文リスト
- Dynamic analysis enhances issue resolution [53.50448142467294]
DAIRA(Dynamic Analysis-enhanced Issue Resolution Agent)は、エージェントの推論サイクルに動的解析を組み込む自動修復フレームワークである。
テストトレース駆動の方法論によって駆動されるDAIRAは、軽量モニタを使用して重要なランタイムデータを抽出する。
Gemini 3 Flash Previewを使用すると、DAIRAは新たな最先端(SOTA)パフォーマンスを確立し、SWE-bench Verifiedデータセットで79.4%の解像度を達成する。
論文 参考訳(メタデータ) (2026-03-23T14:48:54Z) - SUNSET -- A Sensor-fUsioN based semantic SegmEnTation exemplar for ROS-based self-adaptation [2.8210523386413087]
アーキテクチャに基づく自己適応の厳密かつ反復的な評価を可能にするROS2ベースの例であるSUNSETを提案する。
SUNSETには、セグメンテーションパイプライン、トレーニングされたMLモデル、不確実性注入スクリプト、ベースラインコントローラ、ステップバイステップの統合と評価ドキュメントが含まれている。
論文 参考訳(メタデータ) (2026-01-20T08:40:57Z) - InspectCoder: Dynamic Analysis-Enabled Self Repair through interactive LLM-Debugger Collaboration [71.18377595277018]
大きな言語モデル(LLM)は、診断が難しい複雑なロジックエラーを伴うバグの多いコードを生成することが多い。
対話型デバッガ制御による動的解析を LLM に委ねる初のエージェントプログラム修復システムである InspectCoder を提案する。
論文 参考訳(メタデータ) (2025-10-21T06:26:29Z) - LLMShot: Reducing snapshot testing maintenance via LLMs [0.5218155982819203]
スナップショットテストは、現代のソフトウェア開発におけるUIバリデーションの重要なテクニックとして登場した。
本稿では、VLM(Vision-Language Models)を利用して、スナップショットテストの失敗を自動的に解析する新しいフレームワークであるLLMShotを紹介する。
論文 参考訳(メタデータ) (2025-07-14T08:47:19Z) - Thinking Longer, Not Larger: Enhancing Software Engineering Agents via Scaling Test-Time Compute [61.00662702026523]
より大規模なモデルではなく、推論時間の増加を活用する統合されたテスト時間計算スケーリングフレームワークを提案する。
当社のフレームワークには,内部TTCと外部TTCの2つの補完戦略が組み込まれている。
当社の textbf32B モデルは,DeepSeek R1 671B や OpenAI o1 など,はるかに大きなモデルを上回る 46% の課題解決率を実現している。
論文 参考訳(メタデータ) (2025-03-31T07:31:32Z) - FENXI: Deep-learning Traffic Analytics at the Edge [69.34903175081284]
本稿では,TPUを利用して複雑な解析を行うシステムであるFENXIを提案する。
FENXIは、さまざまな粒度で動作するオペレーションとトラフィック分析を分離する。
分析の結果,FENXIは限られた資源しか必要とせず,転送ラインレートのトラヒック処理を継続できることがわかった。
論文 参考訳(メタデータ) (2021-05-25T08:02:44Z) - TELESTO: A Graph Neural Network Model for Anomaly Classification in
Cloud Services [77.454688257702]
機械学習(ML)と人工知能(AI)はITシステムの運用とメンテナンスに適用される。
1つの方向は、修復自動化を可能にするために、繰り返し発生する異常タイプを認識することである。
与えられたデータの次元変化に不変な手法を提案する。
論文 参考訳(メタデータ) (2021-02-25T14:24:49Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。