論文の概要: Brain-inspired spike-timing plasticity for reliable label-efficient event-camera vision
- arxiv url: http://arxiv.org/abs/2605.17686v1
- Date: Sun, 17 May 2026 22:56:16 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-19 17:57:48.398376
- Title: Brain-inspired spike-timing plasticity for reliable label-efficient event-camera vision
- Title(参考訳): ブレインインスパイク刺激型プラスティックティクスを用いたラベル効率の高いイベントカメラビジョン
- Abstract要約: ローカルスパイクタイピング依存可塑性(STDP)モジュールは、GPUをサポートせずに単一のCPUスレッドで動作する。
密度勾配訓練検出器は, 勾配訓練, 密度行列乗算, 局所可塑性自由運転を建設によって組み合わせることができない。
- 参考スコア(独自算出の注目度): 0.3823356975862005
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Deploying event-camera object detectors is constrained by per-frame labeling requirements and GPU compute demands. This work introduces three local spike-timing-dependent plasticity (STDP) modules, including sequence, candidate, and tube-reliability modules, that operate on a single CPU thread without GPU support. On the FRED drone benchmark, the proposed framework spans three label-efficient supervision tiers. A strict zero-label detector achieves 53.8% mAP@30, approximately 26 train-derived bits achieve 76.9% mAP@30, and an STDP candidate-reliability gate achieves 78.60 +/- 0.42% mAP@30. Under acquisition-order drift, the cohort gate outperforms streaming k-means by 2.03 +/- 0.58 percentage points across 20 of 20 positive trials, while a no-drift control falsifies the effect. STDP reduces single-model variance by 6.6 times, and one trained gate matches a 44-seed ensemble bound. The gate transfers to Intel Lava with 89% top-2 agreement. On the EVUAV benchmark, a tube-level STDP layer reduces false alarms from 454 to 331e-4 at Pd >= 88%. Dense gradient-trained detectors cannot provide this combination of gradient training, dense matrix multiplication, and local plasticity-free operation by construction.
- Abstract(参考訳): イベントカメラオブジェクト検出器のデプロイは、フレーム単位のラベル付け要件とGPU計算要求によって制限される。
この研究は、シーケンス、候補、チューブ信頼性モジュールを含む3つのローカルスパイクタイピング依存プラスチック(STDP)モジュールを導入し、GPUサポートなしで単一のCPUスレッドで動作する。
FREDのドローンベンチマークでは、提案されたフレームワークは3つのラベル効率の高い監視層にまたがっている。
厳密なゼロラベル検出器は53.8% mAP@30、約26の列車由来ビットは76.9% mAP@30、STDP候補信頼性ゲートは78.60 +/- 0.42% mAP@30である。
取得順序のドリフトの下では、コホートゲートは20の陽性試験のうち20の20の20の20の20の20の20の20の20の20の2.03+/-0.58ポイントでストリーミングk平均よりも優れ、no-driftコントロールは効果を偽る。
STDPはシングルモデルのばらつきを6.6倍に減らし、1つの訓練されたゲートは44シードのアンサンブル境界と一致する。
ゲートはIntel Lavaに89%のトップ2契約で転送される。
EVUAVベンチマークでは、管レベルのSTDP層は、Pd>=88%で454から331e-4に誤報を低減させる。
密度勾配訓練検出器は, 勾配訓練, 密度行列乗算, 局所可塑性自由運転を建設によって組み合わせることができない。
関連論文リスト
- SoRoMoX: Fast, Differentiable, and Parallelizable Soft Robot Models [40.64972837908431]
SoRoMoXは、統一された制御可能なインターフェースを通じて、明瞭な、Piecewise Constant Strain、および可変ストレインモデルを実装している。
連続したCPUロールアウトは最先端の代替よりも18.1倍速く、GPU並列ロールアウトはスループットを最大234.6倍向上させる。
論文 参考訳(メタデータ) (2026-08-06T23:31:47Z) - Cutting AI Datacenter Energy with Reinforcement Learning: Measured Power Control of LLM Training from One GPU to the Fleet [0.0]
7B,14B,72Bの半秒間パワーテレメトリによるGRPOトレーニングを1~4A100s(380,000以上)で実施する。
PPOメタコントローラをトレーニングし、負荷の発生パラメータを測定パワーに適応させる。
経済と炭素の結果を定量化し、低コストのパイロットを指定する。
論文 参考訳(メタデータ) (2026-07-27T20:51:03Z) - Bit-Accurate FPGA Evaluation of Learned Feature Gating in a Fixed-Point Fourier-Feature Automatic Modulation Classifier [0.0]
この研究は、24のスパースDFTエネルギー特性、8の位相/統計特性、32から128から11の多層パーセプトロンを用いて、コンパクトな固定点分類におけるトレードオフを測定する。
ゲーテッドモデルとアンゲートモデルは、トレーニング後の量子化(PTQ)と量子化対応トレーニング(QAT)でトレーニングされる。
論文 参考訳(メタデータ) (2026-07-27T15:36:06Z) - Traffic-Aware Randomized Smoothing for LLM-Based Network Intrusion Detection [1.4915002678801434]
本稿では,侵入検知システムに対するTA-RS(Traffic-Aware Randomized Smoothing)を提案する。
ガウスノイズを制御可能部分空間(DC)にのみ注入する認証された防御法である。
2つのデータセットに対して、55-100%の認証精度を達成する。
論文 参考訳(メタデータ) (2026-07-15T13:08:19Z) - LocalNav: Distilling Frontier VLMs and Embodied RL for On-Device Object Goal Navigation [53.88286427894783]
視覚言語モデル(VLM)は、ロボット分野において、言語コンテキストによる環境認識を可能にする強力なツールとして登場した。
しかし、彼らの計算フットプリントは、通常、それらをクラウド実行に制限し、リソースに制約のあるロボットへのローカルなデプロイによる低レイテンシの推論を妨げる。
本稿では,大規模フロンティアモデルからの複雑な空間意味推論を,組み込みGPUデバイス上でエッジ実行を行うための軽量な4BパラメータローカルVLMに転送する蒸留戦略を提案する。
論文 参考訳(メタデータ) (2026-06-26T09:11:59Z) - Distributional Energy-Based Models for Uncertainty-Aware Structured LLM Reasoning [40.342912574072024]
大規模言語モデルは、旅行計画やコードソリューションのような構造化されたアウトプットを生成する。
個々の推論ステップは正しく見えるが、アウトプット全体が予算に違反したり、テストケースに失敗したり、あるいは以前の推論に矛盾することがある。
構造化LCM出力の検証のための決定論的解析制約付き学習品質スコアラを提案する。
論文 参考訳(メタデータ) (2026-05-15T17:08:27Z) - Towards Real-Time Autonomous Navigation: Transformer-Based Catheter Tip Tracking in Fluoroscopy [35.565354067805835]
本研究の目的は, 実時間カテーテル先端追跡パイプラインの開発と評価である。
U-Net、U-Net+Transformer、SegFormerなどのディープラーニングセグメンテーションモデルをトレーニングし、ベンチマークした。
2級のSegFormerは平均絶対誤差4.44mm、U-Net(4.60mm)、U-Net+Transformer(6.20mm)、および3級モデル(5.19-7.74mm)を上回った。
論文 参考訳(メタデータ) (2026-05-14T01:42:56Z) - EULER-ADAS: Energy-Efficient & SIMD-Unified Logarithmic-Posit Engine for Precision-Reconfigurable Approximate ADAS Acceleration [0.12314765641075437]
EULER-ADASは、エネルギー効率と信頼性を意識したADASアクセラレーションのためのSIMD対応の対数有界型ニューラルネットワークエンジンである。
提案したデータパスは,有界正規化ポジット表現,段階適応対数マンティサ乗算とビットトランケーション,SIMD共有クイア蓄積経路を組み合わせたものである。
FPGAの実装により、提案された構成により、LUT数を41.4%、遅延を76.1%、パワーを71.9%削減できる。
論文 参考訳(メタデータ) (2026-05-07T19:20:10Z) - Instance-level Visual Active Tracking with Occlusion-Aware Planning [61.982298426203165]
Visual Active Tracking (VAT)は、カメラを3D空間でターゲットに追従することを目的としている。
VATは、視覚的に類似したイントラクタからの混乱と、閉塞下での深刻な障害という、現実世界のデプロイメントにおいて2つの重要なボトルネックに直面している。
3つの相補的なモジュールを持つ統一パイプラインであるOA-VATを提案する。
論文 参考訳(メタデータ) (2026-04-23T09:11:50Z) - ChipCraftBrain: Validation-First RTL Generation via Multi-Agent Orchestration [0.0]
MAGEのようなマルチエージェントのアプローチはVerilogEvalでは95.9%に達したが、厳しい産業ベンチマークではテストされていない。
本稿では,シンボリック・ニューラル推論と適応型マルチエージェントオーケストレーションを組み合わせた自動RTL生成フレームワークChipCraftBrainを提案する。
論文 参考訳(メタデータ) (2026-04-21T17:20:24Z) - WISV: Wireless-Informed Semantic Verification for Distributed Speculative Decoding in Device-Edge LLM Inference [56.297697169678095]
WISV(Wireless-Informed Semantic Verification)は、分散投機的復号化フレームワークである。
WISVは最大60.8%の許容長の増加、37.3%の対話ラウンドの削減、31.4%のエンドツーエンドレイテンシの改善を実現している。
NVIDIA Jetson AGX OrinとA40搭載サーバからなるハードウェアテストベッド上でWISVを検証する。
論文 参考訳(メタデータ) (2026-04-20T01:29:56Z) - Quantization Impact on the Accuracy and Communication Efficiency Trade-off in Federated Learning for Aerospace Predictive Maintenance [0.0]
フェデレートラーニング(FL)は、分散航空宇宙艦隊間のプライバシ保護による予測メンテナンスを可能にする。
本稿では,対称均一量子化がカスタム設計軽量畳み込みモデルの精度-効率トレードオフに与える影響について検討する。
Int4はFD001とFD002でFP32と区別できない精度を実現する。
論文 参考訳(メタデータ) (2026-04-09T17:13:15Z) - Sharpness-Aware Surrogate Training for On-Sensor Spiking Neural Networks [0.0]
シュロゲートフォワードSNNにシャープネス対応シャープネス認識(SAST)を導入し,トレーニング対象がスムーズで勾配が正確であることを示す。
2つのイベントカメラベンチマークでは、スワップのみのハードスパイク精度が、N-MNISTでは65.7%から94.7%に改善され、DVS Gestureでは31.8%から63.3%に改善された。
これらの結果は、SASTがテスト設定下でのオンセンサースパイク推論のためのより広範なツールボックスの有望なコンポーネントであることを示唆している。
論文 参考訳(メタデータ) (2026-04-06T23:32:17Z) - BWTA: Accurate and Efficient Binarized Transformer by Algorithm-Hardware Co-design [71.97035034203275]
バイナライゼーションにおけるゼロ点歪みを解析し,BWTA量子化方式を提案する。
本稿では,Smooth Multi-Stage Quantizationを提案し,レベルワイド・デグラデーション・ストラテジーとMagnitude Alignment Projection Factorを組み合わせた。
実験の結果、BWTAはTransformerベースのモデルに対して、GLUEでは平均3.5%、タスクでは2%未満の精度でフル精度のパフォーマンスにアプローチしていることがわかった。
論文 参考訳(メタデータ) (2026-04-05T04:25:07Z) - SHIELD8-UAV: Sequential 8-bit Hardware Implementation of a Precision-Aware 1D-F-CNN for Low-Energy UAV Acoustic Detection and Temporal Tracking [4.962717354668883]
ShiELD8-UAV (ShielD8-UAV) は、高精度1D機能駆動CNNアクセラレータのシーケンシャルな8ビットハードウェア実装である。
この設計は共有マルチ精度データパス上で層単位で実行し、複製された処理要素を不要にする。
その結果、逐次実行と高精度量子化とシリアライズ対応プルーニングを組み合わせることで、実用的な低エネルギーエッジ推論が可能となった。
論文 参考訳(メタデータ) (2026-03-01T12:09:15Z) - Unsupervised Conformal Inference: Bootstrapping and Alignment to Control LLM Uncertainty [49.19257648205146]
生成のための教師なし共形推論フレームワークを提案する。
我々のゲートは、分断されたUPPよりも厳密で安定した閾値を提供する。
その結果は、ラベルのない、API互換の、テスト時間フィルタリングのゲートになる。
論文 参考訳(メタデータ) (2025-09-26T23:40:47Z) - GDP: Stabilized Neural Network Pruning via Gates with Differentiable
Polarization [84.57695474130273]
ゲートベースまたは重要度に基づくプルーニング手法は、重要度が最小のチャネルを削除することを目的としている。
GDPは、各チャネルのオン・アンド・オフを制御するために、ベルやホイッスルのない畳み込み層の前に接続することができる。
CIFAR-10とImageNetデータセットを用いて行った実験は、提案したGDPが最先端のパフォーマンスを達成することを示している。
論文 参考訳(メタデータ) (2021-09-06T03:17:10Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。