論文の概要: End-to-End Historical Music Restoration in Latent Space
- arxiv url: http://arxiv.org/abs/2610.00607v1
- Date: Wed, 30 Sep 2026 19:11:36 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-03 01:19:23.727055
- Title: End-to-End Historical Music Restoration in Latent Space
- Title(参考訳): 潜在空間におけるエンド・ツー・エンドの歴史的音楽復元
- Abstract要約: 本稿では,教師付きエンドツーエンドのオーケストラHMRベンチマークを提案する。
合成劣化関数とエンドツーエンドの深層学習復元法の両方について検討する。
その結果, 既存のHMRベースラインよりも, 貫入性, 非貫入性, 主観的評価が優れていた。
- 参考スコア(独自算出の注目度): 29.120077629906543
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Historical music restoration (HMR) has almost exclusively focused on constrained problems such as Super-Resolution or the restoration of solo pieces, under-exploring the general task of restoring orchestral historical music, which has multiple instruments. This under-exploration is largely because the HMR domain, early-20th-century recordings, has no pre-degradation ground-truth pairs, making the restoration task unsupervised and more challenging. This paper presents a supervised end-to-end orchestral HMR benchmark by exploring both the synthetic degradation functions and the end-to-end generative deep-learning restoration methods. We simulate the historical recording degradation chain more faithfully than prior work, which makes orchestral restoration into a tractable supervised problem. A latent flow-matching model trained on the resulting synthetic pairs outperforms existing HMR baselines on intrusive, non-intrusive, and subjective evaluations. We also curate and release a 9.3-hour license-free, unpaired, historical classical-music test set, along with code and audio demos.
- Abstract(参考訳): ヒストリカル・ミュージック・リバイバル (HMR) は、スーパー・リゾリューション (Super-Resolution) やソロ・ピースのリバイバルといった制約のある問題にのみ焦点を合わせており、複数の楽器を持つオーケストラ・ヒストリカル・ミュージックを復元する一般的な課題を探求している。
この地下探査は、20世紀前半に録音されたHMRドメインが、劣化前の地対を持たないため、修復作業は監督されず、より難しいためである。
本稿では, 合成劣化関数とエンドツーエンドの深層学習復元法の両方を探索し, 教師付きエンドツーエンドのオーケストラHMRベンチマークを提案する。
我々は,過去の記録劣化連鎖を従来よりも忠実にシミュレートし,オーケストラの復元をトラクタブルな教師付き問題へと導く。
その結果, 既存のHMRベースラインよりも, 貫入性, 非貫入性, 主観的評価が優れていた。
また、コードとオーディオのデモとともに、9.3時間のライセンスなし、ペアなし、歴史的なクラシック音楽のテストセットをキュレートし、リリースしています。
関連論文リスト
- Music Restoration via Latent Operator Optimization and Diffusion Model Priors [15.43777154891635]
音楽の復元は、未知の効果、歪み、腐敗によって劣化した観察記録からクリーンな信号を回復しようとする。
本稿では,事前訓練されたオーディオオートエンコーダの潜時空間で動作する汎用的復元法であるLOUDARを提案する。
劣化した入力よりも常に改善され、波形および潜伏領域における教師なしおよび教師なしのベースラインと競合することを示す。
論文 参考訳(メタデータ) (2026-08-03T09:36:40Z) - FIGMA: Towards FIne-Grained Music retrievAl [65.98380295254817]
自然言語記述による音楽の検索はCLAPのような対照的な音声テキストモデルで改善されているが、現在のシステムはいまだに大まかなセマンティッククエリに限られている。
この制限は、長いキャプションで訓練されているにもかかわらず、CLAPベースのモデルは、最初の数個のトークンのみを効果的に活用する。
本研究では,グローバルな音声テキストアライメントとフレームレベルのトークンアライメントを共同で最適化することで,この制限に対処するマルチビューコントラストアーキテクチャであるFIGMAを提案する。
論文 参考訳(メタデータ) (2026-06-04T18:05:39Z) - EpiAgent: An Agent-Centric System for Ancient Inscription Restoration [60.77886293107454]
EpiAgentは、階層的な計画問題として碑文復元を定式化するエージェント中心のシステムである。
EpiAgentは、既存の方法よりも優れた復元品質とより強力な一般化を実現している。
我々の研究は、専門家レベルのエージェント主導による文化遺産の復元に向けた重要な一歩である。
論文 参考訳(メタデータ) (2026-04-10T14:37:54Z) - Music Source Restoration with Ensemble Separation and Targeted Reconstruction [6.528712884168779]
初の音楽ソース復元(MSR)チャレンジは、完全に混成されたマスタード音楽からオリジナル、未処理の茎を回収することを目的としている。
まず、事前訓練された分離モデルのアンサンブルが予備的なソース推定を生成する。
そして、事前訓練されたBSRNNベースの復元モデルが、これらの見積を洗練させるためにターゲットの再構築を行う。
論文 参考訳(メタデータ) (2026-03-13T07:40:42Z) - The Costs of Reproducibility in Music Separation Research: a Replication of Band-Split RNN [24.79659407567392]
この点に関しては、BSRNN(Band-split Recurrent Neural Network)モデルが有望である。
残念ながら、完全なコードが利用できないため、簡単には再生できない。
本稿では,BSRNNを可能な限り再現する試みである。
論文 参考訳(メタデータ) (2026-03-10T04:54:53Z) - Depth-Structured Music Recurrence: Budgeted Recurrent Attention for Full-Piece Symbolic Music Modeling [3.82316323394692]
Depth-Structured Music Recurrence (DSMR) は、完全な作曲から終わりまで学習する訓練時間設計である。
我々の主要なインスタンスである2スケールのDSMRは、低層に長い履歴ウィンドウを割り当て、残りの層に一様短いウィンドウを割り当てます。
MAESTROのピアノパフォーマンスデータセットでは、2スケールのDSMRはパープレキシティ(5.96対5.98)でフルメモリのリカレント参照と一致し、GPUメモリは約59%削減され、スループットは約36%向上した。
論文 参考訳(メタデータ) (2026-02-23T13:13:41Z) - Summary of The Inaugural Music Source Restoration Challenge [52.405241781545634]
Music Source Restoration (MSR)は、プロの混在したオーディオからオリジナル、未処理の楽器を復元することを目的としている。
MSR Challengeは、Multi-Mel-SNR、Zimtohrli、FAD-CLAPを用いたスタジオ生産混合物の客観的評価を特徴とする。
勝利システムは4.46dBのMulti-Mel-SNRと3.47のMOS-Overallを達成し、それぞれ第2位のシステムに対して91%と18%の相対的な改善を達成した。
論文 参考訳(メタデータ) (2026-01-07T19:31:06Z) - Source Separation of Small Classical Ensembles: Challenges and Opportunities [2.8457245667398188]
非因果深層学習を用いた西洋ポピュラー音楽の音源分離は非常に効果的である。
クラシック音楽のためのMSSは未解決の問題である。
古典的なアンサンブルは、音楽に固有の大きなバリエーションのような問題のために、ポピュラー音楽よりも分離するのが困難である。
論文 参考訳(メタデータ) (2025-05-23T12:39:23Z) - UniRestorer: Universal Image Restoration via Adaptively Estimating Image Degradation at Proper Granularity [79.90839080916913]
We present our UniRestorer with improve restoration performance。
具体的には、劣化空間上で階層的クラスタリングを行い、マルチグラニュラリティ・ミックス・オブ・エキスパート(MoE)復元モデルを訓練する。
UniRestorerは、既存の劣化診断法と -aware 法とは対照的に、劣化推定を利用して劣化特定回復の恩恵を受けることができる。
論文 参考訳(メタデータ) (2024-12-28T14:09:08Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。