論文の概要: Higher-order-ReLU-KANs (HRKANs) for solving physics-informed neural
networks (PINNs) more accurately, robustly and faster
- arxiv url: http://arxiv.org/abs/2409.14248v1
- Date: Sun, 29 Sep 2024 11:21:48 GMT
- ステータス: 処理完了
- システム内更新日: 2024-11-06 23:26:16.397483
- Title: Higher-order-ReLU-KANs (HRKANs) for solving physics-informed neural
networks (PINNs) more accurately, robustly and faster
- Title(参考訳): 物理インフォームドニューラルネットワークのための高次ReLU-KAN(HRKAN)
ネットワーク(PINN)はより正確で、堅牢で、より速く
- Authors: Chi Chiu So, Siu Pang Yung
- Abstract要約: 新しいタイプのニューラルネットワークモデルであるコルモゴロフ・アルノルドネットワーク(KAN)が、MLP(Multilayer Perceptions)の代替として提案されている。
適合精度を高めるため、ReLU-KANと呼ばれるカンの修正が提案されている。
本研究では, アクティベーション関数であるHigherorder-ReLU(HR)について提案する。
- 参考スコア(独自算出の注目度): 1.9580473532948401
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Finding solutions to partial differential equations (PDEs) is an important
and essential component in many scientific and engineering discoveries. One of
the common approaches empowered by deep learning is Physics-informed Neural
Networks (PINNs). Recently, a new type of fundamental neural network model,
Kolmogorov-Arnold Networks (KANs), has been proposed as a substitute of
Multilayer Perceptions (MLPs), and possesses trainable activation functions. To
enhance KANs in fitting accuracy, a modification of KANs, so called ReLU-KANs,
using "square of ReLU" as the basis of its activation functions, has been
suggested. In this work, we propose another basis of activation functions,
namely, Higherorder-ReLU (HR), which is simpler than the basis of activation
functions used in KANs, namely, Bsplines; allows efficient KAN matrix
operations; and possesses smooth and non-zero higher-order derivatives,
essential to physicsinformed neural networks. We name such KANs with
Higher-order-ReLU (HR) as their activations, HRKANs. Our detailed experiments
on two famous and representative PDEs, namely, the linear Poisson equation and
nonlinear Burgers' equation with viscosity, reveal that our proposed
Higher-order-ReLU-KANs (HRKANs) achieve the highest fitting accuracy and
training robustness and lowest training time significantly among KANs,
ReLU-KANs and HRKANs. The codes to replicate our experiments are available at
https://github.com/kelvinhkcs/HRKAN.
- Abstract(参考訳): 偏微分方程式(PDE)の解を見つけることは、多くの科学的・工学的な発見において重要な要素である。
ディープラーニングによって強化される一般的なアプローチの1つは、物理情報ニューラルネットワーク(PINN)である。
近年,MLP(Multilayer Perceptions)の代わりに,トレーニング可能なアクティベーション機能を持つニューラルネットワークモデルKAN(Kolmogorov-Arnold Networks)が提案されている。
適合精度を高めるため, アクティベーション関数の基盤として「ReLU二乗」を用いた「ReLU-KAN」と呼ばれるカンの修正が提案されている。
本研究では, 活性化関数である高次ReLU(HR)を, カンで使用される活性化関数であるBsplinesよりも単純で, 効率的なカン行列演算が可能であり, 物理インフォームドニューラルネットワークに必須なスムーズで非ゼロな高次微分を持つ, 活性化関数の別の基底として提案する。
我々は、高次ReLU(HR)をアクティベーションとしてHRKAN(HRKAN)と呼ぶ。
線形ポアソン方程式と非線形バーガース方程式の粘度に関する2つの有名なPDEに関する詳細な実験により,提案した高次ReLU-KAN (Higher-order-ReLU-KANs) がKans,ReLU-KANs,HRKANsの間で高い適合精度とトレーニングロバスト性,および最低トレーニング時間を達成することを明らかにした。
実験を再現するコードはhttps://github.com/kelvinhkcs/HRKAN.comで公開されている。
関連論文リスト
- Learnable Activation Functions in Physics-Informed Neural Networks for Solving Partial Differential Equations [0.0]
物理情報ネットワーク(PINN)における学習可能なアクティベーション関数を用いた部分微分方程式(PDE)の解法について検討する。
従来のMLP(Multilayer Perceptrons)とKAN(Kolmogorov-Arnold Neural Networks)に対する固定および学習可能なアクティベーションの比較を行った。
この発見は、PDEソルバのトレーニング効率、収束速度、テスト精度のバランスをとるニューラルネットワークアーキテクチャの設計に関する洞察を提供する。
論文 参考訳(メタデータ) (2024-11-22T18:25:13Z) - SPIKANs: Separable Physics-Informed Kolmogorov-Arnold Networks [0.9999629695552196]
偏微分方程式(PDE)の解法として物理情報ニューラルネットワーク(PINN)が誕生した。
我々はSPIKAN(Sparable Physics-Informed Kolmogorov-Arnold Networks)を紹介する。
この新しいアーキテクチャは変数分離の原則をPIKANに適用し、各次元が個別のKAで扱われるような問題を分解する。
論文 参考訳(メタデータ) (2024-11-09T21:10:23Z) - Kolmogorov-Arnold Transformer [72.88137795439407]
Kolmogorov-Arnold Transformer(KAT)は,階層をKAN(Kolmogorov-Arnold Network)層に置き換える新しいアーキテクチャである。
C1)基本関数,(C2)非効率,(C3)重みの3つの主要な課題を特定する。
これらの設計により、KATは従来のトランスフォーマーよりも優れている。
論文 参考訳(メタデータ) (2024-09-16T17:54:51Z) - KAN-ODEs: Kolmogorov-Arnold Network Ordinary Differential Equations for Learning Dynamical Systems and Hidden Physics [0.0]
コルモゴロフ・アルノルドネットワーク(KAN)は多層パーセプトロン(MLP)の代替品である
この研究は、Kansをニューラル常微分方程式(ODE)フレームワークのバックボーンとして適用する。
論文 参考訳(メタデータ) (2024-07-05T00:38:49Z) - ReLUs Are Sufficient for Learning Implicit Neural Representations [17.786058035763254]
暗黙的神経表現学習におけるReLUアクティベーション関数の使用について再考する。
2次B-スプラインウェーブレットにインスパイアされ、ディープニューラルネットワーク(DNN)の各層にReLUニューロンに一連の簡単な制約を組み込む。
我々は、一般的な信念とは対照的に、ReLUニューロンのみからなるDNNに基づいて最先端のINRを学習できることを実証した。
論文 参考訳(メタデータ) (2024-06-04T17:51:08Z) - Artificial to Spiking Neural Networks Conversion for Scientific Machine
Learning [24.799635365988905]
物理インフォームドニューラルネットワーク(PINN)をスパイキングニューラルネットワーク(SNN)に変換する手法を提案する。
SNNは従来のニューラルネットワーク(ANN)と比較してエネルギー効率が高いと期待されている
論文 参考訳(メタデータ) (2023-08-31T00:21:27Z) - Globally Optimal Training of Neural Networks with Threshold Activation
Functions [63.03759813952481]
しきい値アクティベートを伴うディープニューラルネットワークの重み劣化正規化学習問題について検討した。
ネットワークの特定の層でデータセットを破砕できる場合に、簡易な凸最適化の定式化を導出する。
論文 参考訳(メタデータ) (2023-03-06T18:59:13Z) - Neural Basis Functions for Accelerating Solutions to High Mach Euler
Equations [63.8376359764052]
ニューラルネットワークを用いた偏微分方程式(PDE)の解法を提案する。
ニューラルネットワークの集合を縮小順序 Proper Orthogonal Decomposition (POD) に回帰する。
これらのネットワークは、所定のPDEのパラメータを取り込み、PDEに還元順序近似を計算する分岐ネットワークと組み合わせて使用される。
論文 参考訳(メタデータ) (2022-08-02T18:27:13Z) - Deep Reinforcement Learning with Spiking Q-learning [51.386945803485084]
スパイクニューラルネットワーク(SNN)は、少ないエネルギー消費で人工知能(AI)を実現することが期待されている。
SNNと深部強化学習(RL)を組み合わせることで、現実的な制御タスクに有望なエネルギー効率の方法を提供する。
論文 参考訳(メタデータ) (2022-01-21T16:42:11Z) - Comparisons among different stochastic selection of activation layers
for convolutional neural networks for healthcare [77.99636165307996]
ニューラルネットワークのアンサンブルを用いて生体医用画像の分類を行う。
ReLU, leaky ReLU, Parametric ReLU, ELU, Adaptive Piecewice Linear Unit, S-Shaped ReLU, Swish, Mish, Mexican Linear Unit, Parametric Deformable Linear Unit, Soft Root Sign。
論文 参考訳(メタデータ) (2020-11-24T01:53:39Z) - Revisiting Initialization of Neural Networks [72.24615341588846]
ヘッセン行列のノルムを近似し, 制御することにより, 層間における重みのグローバルな曲率を厳密に推定する。
Word2Vec と MNIST/CIFAR 画像分類タスクの実験により,Hessian ノルムの追跡が診断ツールとして有用であることが確認された。
論文 参考訳(メタデータ) (2020-04-20T18:12:56Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。