Fugu-MT 論文翻訳(概要): Image Augmentation for Multitask Few-Shot Learning: Agricultural Domain Use-Case

論文の概要: Image Augmentation for Multitask Few-Shot Learning: Agricultural Domain Use-Case

arxiv url: http://arxiv.org/abs/2102.12295v1
Date: Wed, 24 Feb 2021 14:08:34 GMT
ステータス: 翻訳完了
システム内更新日: 2021-02-26 01:29:39.231755
Title: Image Augmentation for Multitask Few-Shot Learning: Agricultural Domain Use-Case
Title（参考訳）: マルチタスクFew-Shot Learningの画像拡張:農業ドメイン利用事例
Authors: Sergey Nesteruk, Dmitrii Shadrin, Mariia Pukalchik
Abstract要約: 本稿では,植物フェノミクスドメインの例に基づいて,小規模で不均衡なデータセットに挑戦する。画像拡張フレームワークを導入することで,トレーニングサンプル数を大幅に拡大することができる。本手法は,少数のトレーニングサンプルが利用可能であれば,モデル性能が向上することを示す。
参考スコア（独自算出の注目度）: 0.0
License: http://creativecommons.org/licenses/by/4.0/
Abstract: Large datasets' availability is catalyzing a rapid expansion of deep learning in general and computer vision in particular. At the same time, in many domains, a sufficient amount of training data is lacking, which may become an obstacle to the practical application of computer vision techniques. This paper challenges small and imbalanced datasets based on the example of a plant phenomics domain. We introduce an image augmentation framework, which enables us to extremely enlarge the number of training samples while providing the data for such tasks as object detection, semantic segmentation, instance segmentation, object counting, image denoising, and classification. We prove that our augmentation method increases model performance when only a few training samples are available. In our experiment, we use the DeepLabV3 model on semantic segmentation tasks with Arabidopsis and Nicotiana tabacum image dataset. The obtained result shows a 9% relative increase in model performance compared to the basic image augmentation techniques.
Abstract（参考訳）: 大規模データセットの可用性は、特にコンピュータビジョンにおけるディープラーニングの急速な拡張を触媒している。同時に、多くの領域において、十分な量のトレーニングデータが不足しており、コンピュータビジョン技術の実践的応用の障害となる可能性がある。本稿では,植物フェノミクスドメインの例に基づいて,小規模で不均衡なデータセットに挑戦する。本研究では,オブジェクト検出,意味セグメンテーション,インスタンスセグメンテーション,オブジェクトカウント,画像デノージング,分類などのタスクのためのデータを提供しながら,トレーニングサンプル数を大幅に拡大できる画像拡張フレームワークを提案する。本手法は,少数のトレーニングサンプルが利用可能であれば,モデル性能が向上することを示す。実験では,シロイヌナズナとニコチアナ・タバカムの画像データセットを用いた意味セグメンテーションタスクにdeeplabv3モデルを用いた。その結果, 基本画像強調法と比較して, モデル性能が9%向上した。

関連論文リスト

Maximizing Generalization: The Effect of Different Augmentation Techniques on Lightweight Vision Transformer for Bengali Character Classification [0.0]
ディープラーニングモデルは、過度な適合を避けるために、大規模なデータセットに大きく依存する。大規模なデータセットは多くのドメイン、特にBengaliのようなリソース制限言語では利用できない。データ拡張(Data augmentation)とは、データのサイズと多様性を高めるための一連のテクニックである。
論文参考訳（メタデータ） (2026-03-03T04:14:11Z)
Scaling Up Single Image Dehazing Algorithm by Cross-Data Vision Alignment for Richer Representation Learning and Beyond [47.425906124301775]
本稿では,よりリッチな表現学習のためのクロスデータビジョンアライメント手法を提案する。データの外部アライメントを使用することで、データセットは、しっかりと整列された異なるドメインからのサンプルを継承する。提案手法は, 実際のヘイズフリー画像に最も近いデハズド画像のデハズ化やデハズド画像の生成において, 他の先進的手法よりも著しく優れている。
論文参考訳（メタデータ） (2024-07-20T10:00:20Z)
SatSynth: Augmenting Image-Mask Pairs through Diffusion Models for Aerial Semantic Segmentation [69.42764583465508]
我々は,地球観測における注釈付きデータの不足に対処するために,生成的画像拡散の可能性を探る。我々の知る限りでは、衛星セグメンテーションのための画像と対応するマスクの両方を最初に生成する。
論文参考訳（メタデータ） (2024-03-25T10:30:22Z)
Deep Domain Adaptation: A Sim2Real Neural Approach for Improving Eye-Tracking Systems [80.62854148838359]
眼球画像のセグメンテーションは、最終視線推定に大きな影響を及ぼす眼球追跡の重要なステップである。対象視線画像と合成訓練データとの重なり合いを測定するために,次元還元法を用いている。提案手法は,シミュレーションと実世界のデータサンプルの相違に対処する際の頑健で,性能が向上する。
論文参考訳（メタデータ） (2024-03-23T22:32:06Z)
Let Segment Anything Help Image Dehaze [12.163299570927302]
低レベルコンピュータビジョンタスクに先立って,大規模モデルを統合するためのフレームワークを提案する。低レベル視覚タスクの導出における大規模モデルの有効性と適用性を示す。
論文参考訳（メタデータ） (2023-06-28T02:02:19Z)
Multimodal Data Augmentation for Image Captioning using Diffusion Models [12.221685807426264]
本研究では,Stable Diffusionと呼ばれるテキスト・ツー・イメージ・モデルを利用してトレーニングセットを拡張するデータ拡張手法を提案する。 MS COCOデータセットの実験は、いくつかのベンチマーク手法に対する我々のアプローチの利点を実証している。生成されたデータを意図的にフィルタリングした後、トレーニング効率及び有効性に関するさらなる改善が得られる。
論文参考訳（メタデータ） (2023-05-03T01:57:33Z)
Advancing Plain Vision Transformer Towards Remote Sensing Foundation Model [97.9548609175831]
約1億のパラメータを持つプレーンビジョントランスフォーマーを利用して、リモートセンシングタスク用にカスタマイズされた大規模なビジョンモデルを提案する。具体的には、RS画像における大きな画像サイズと様々な向きのオブジェクトを扱うために、回転する様々なウィンドウアテンションを提案する。検出タスクの実験は、DOTA-V1.0データセット上で81.16%のmAPを達成したすべての最先端モデルよりも、我々のモデルの方が優れていることを示す。
論文参考訳（メタデータ） (2022-08-08T09:08:40Z)
CHALLENGER: Training with Attribution Maps [63.736435657236505]
ニューラルネットワークのトレーニングに属性マップを利用すると、モデルの正規化が向上し、性能が向上することを示す。特に、我々の汎用的なドメインに依存しないアプローチは、ビジョン、自然言語処理、時系列タスクにおける最先端の結果をもたらすことを示す。
論文参考訳（メタデータ） (2022-05-30T13:34:46Z)
Image Data Augmentation for Deep Learning: A Survey [8.817690876855728]
我々は、異なる画像データ拡張手法を体系的にレビューする。本稿では,レビュー手法の分類法を提案し,これらの手法の長所と短所について述べる。また,3種類のコンピュータビジョンタスクに対して,様々なデータ拡張手法による広範囲な実験を行った。
論文参考訳（メタデータ） (2022-04-19T02:05:56Z)
Few-Shot Learning for Image Classification of Common Flora [0.0]
MAML(Model-Agnostic Meta Learning)を用いた画像分類のためのメタラーニング分野の最先端の研究と、さまざまな最先端のトランスファーラーニングウェイトとアーキテクチャをテストした結果を紹介します。その結果、データセットが十分に大きい場合、両方のプラクティスが十分なパフォーマンスを提供しますが、十分なパフォーマンスを維持するためにデータスパーシャビリティが導入されると、どちらも苦労しています。
論文参考訳（メタデータ） (2021-05-07T03:54:51Z)
Factors of Influence for Transfer Learning across Diverse Appearance Domains and Task Types [50.1843146606122]
現在の最新のコンピュータビジョンモデルでは、簡単な転送学習が一般的です。転校学習に関するこれまでの体系的な研究は限られており、作業が期待される状況は十分に理解されていない。本論文では,非常に異なる画像領域にまたがる転送学習の広範な実験的研究を行う。
論文参考訳（メタデータ） (2021-03-24T16:24:20Z)
Data Augmentation for Meta-Learning [58.47185740820304]
メタ学習アルゴリズムは、各トレーニングステップでデータ、クエリデータ、タスクをサンプリングする。データ拡張は、クラス毎に利用可能な画像の数を増やすだけでなく、全く新しいクラス/タスクを生成するためにも使用できる。提案したメタ固有データ拡張は,数ショットの分類ベンチマークにおいて,メタラーナーの性能を著しく向上させる。
論文参考訳（メタデータ） (2020-10-14T13:48:22Z)
Multi-task pre-training of deep neural networks for digital pathology [8.74883469030132]
私たちはまず、多くのデジタル病理データセットを22の分類タスクと約900kの画像のプールに組み立て、変換しました。特徴抽出器として使用されるモデルは、ImageNet事前訓練されたモデルよりも大幅に改善されるか、同等のパフォーマンスを提供するかを示す。
論文参考訳（メタデータ） (2020-05-05T08:50:17Z)

関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。

指定された論文の情報です。
本サイトの運営者は本サイト（すべての情報・翻訳含む）の品質を保証せず、本サイト（すべての情報・翻訳含む）を使用して発生したあらゆる結果について一切の責任を負いません。