Fugu-MT 論文翻訳(概要): SANIP: Shopping Assistant and Navigation for the visually impaired

論文の概要: SANIP: Shopping Assistant and Navigation for the visually impaired

arxiv url: http://arxiv.org/abs/2209.03570v1
Date: Thu, 8 Sep 2022 05:35:03 GMT
ステータス: 翻訳完了
システム内更新日: 2022-09-09 13:00:18.622342
Title: SANIP: Shopping Assistant and Navigation for the visually impaired
Title（参考訳）: SANIP:視覚障害者のためのショッピングアシスタントとナビゲーション
Authors: Shubham Deshmukh, Favin Fernandes, Amey Chavan, Monali Ahire, Devashri Borse, Jyoti Madake
Abstract要約: 提案モデルは3つのピソンモデル、すなわちカスタムオブジェクト検出、テキスト検出、バーコード検出から構成される。手持ちオブジェクトのオブジェクト検出のために、Parle-G、Tide、Laysといったデイリーグッズを含む独自のカスタムデータセットを作成しました。提案する他の2つのモデルでは、検索されたテキストとバーコード情報はテキストから音声に変換され、盲人に送信される。
参考スコア（独自算出の注目度）: 0.0
License: http://creativecommons.org/licenses/by-sa/4.0/
Abstract: The proposed shopping assistant model SANIP is going to help blind persons to detect hand held objects and also to get a video feedback of the information retrieved from the detected and recognized objects. The proposed model consists of three python models i.e. Custom Object Detection, Text Detection and Barcode detection. For object detection of the hand held object, we have created our own custom dataset that comprises daily goods such as Parle-G, Tide, and Lays. Other than that we have also collected images of Cart and Exit signs as it is essential for any person to use a cart and also notice the exit sign in case of emergency. For the other 2 models proposed the text and barcode information retrieved is converted from text to speech and relayed to the Blind person. The model was used to detect objects that were trained on and was successful in detecting and recognizing the desired output with a good accuracy and precision.
Abstract（参考訳）: 提案したショッピングアシスタントモデルSANIPは、視覚障害者が手持ちの物体を検知するのを助けるとともに、検出および認識された物体から取得した情報の映像フィードバックを得る。提案モデルは3つのピソンモデル、すなわちカスタムオブジェクト検出、テキスト検出、バーコード検出から構成される。手持ちオブジェクトのオブジェクト検出のために、私たちはparle-g、tide、laysといった日用品を含む独自のデータセットを作成しました。それ以外は、カートの使用が不可欠であり、緊急時には出口標識に気付くため、CartとExitのサインの画像も収集しました。他の2つのモデルでは、検索されたテキストとバーコード情報がテキストから音声に変換され、盲人に中継される。このモデルは、訓練されたオブジェクトを検出し、適切な精度と精度で望ましいアウトプットの検出と認識に成功するために使用された。

関連論文リスト

Fine-Grained Open-Vocabulary Object Detection with Fined-Grained Prompts: Task, Dataset and Benchmark [6.93847426808971]
3F-OVDは、教師付ききめ細かい物体検出をオープン語彙設定に拡張する新しいタスクである。両方の設定で、データセット上で最先端のオブジェクト検出器をベンチマークします。
論文参考訳（メタデータ） (2025-03-19T03:41:46Z)
Uncertainty Estimation for 3D Object Detection via Evidential Learning [63.61283174146648]
本稿では,3次元検出器における鳥の視線表示における明らかな学習損失を利用して,3次元物体検出の不確かさを定量化するためのフレームワークを提案する。本研究では,これらの不確実性評価の有効性と重要性を,分布外シーンの特定,局所化の不十分な物体の発見,および(偽陰性)検出の欠如について示す。
論文参考訳（メタデータ） (2024-10-31T13:13:32Z)
Intent3D: 3D Object Detection in RGB-D Scans Based on Human Intention [86.39271731460927]
RGB-Dを用いた3次元物体検出における新たな課題として,「背中を支えたいもの」などの人間の意図に基づく3次元対象物検出がある。 ScanNetデータセットの1,042のシーンから209のきめ細かいクラスに関連付けられた44,990の意図的テキストからなる新しいIntent3Dデータセットを紹介した。我々はまた、この意図に基づく検出問題に対処するために設計された、我々のユニークなアプローチであるIntentNetを提案する。
論文参考訳（メタデータ） (2024-05-28T15:48:39Z)
Latent Object Characteristics Recognition with Visual to Haptic-Audio Cross-modal Transfer Learning [9.178588671620963]
この研究は、潜伏する観測不可能なオブジェクトの特性を認識することを目的としている。視覚は一般的にロボットによる物体認識に使われるが、隠された物体を検出するには効果がない。本稿では,視覚から触覚へのクロスモーダル・トランスファー学習手法を提案する。
論文参考訳（メタデータ） (2024-03-15T21:18:14Z)
SeSame: Simple, Easy 3D Object Detection with Point-Wise Semantics [0.7373617024876725]
自律運転では、3Dオブジェクト検出は、経路計画や動き推定を含む下流タスクに対してより正確な情報を提供する。本稿では,既存のLiDARのみに基づく3Dオブジェクト検出における意味情報の強化を目的としたSeSameを提案する。 KITTIオブジェクト検出ベンチマークにおいて,提案手法の有効性を示す実験を行った。
論文参考訳（メタデータ） (2024-03-11T08:17:56Z)
PatchContrast: Self-Supervised Pre-training for 3D Object Detection [14.603858163158625]
PatchContrastは、3Dオブジェクト検出のための新しい自己教師付きポイントクラウド事前学習フレームワークである。提案手法は,3つの一般的な3次元検出データセットにおいて,既存の最先端モデルよりも優れていることを示す。
論文参考訳（メタデータ） (2023-08-14T07:45:54Z)
SalienDet: A Saliency-based Feature Enhancement Algorithm for Object Detection for Autonomous Driving [160.57870373052577]
未知の物体を検出するために,サリエンデット法(SalienDet)を提案する。我々のSaienDetは、オブジェクトの提案生成のための画像機能を強化するために、サリエンシに基づくアルゴリズムを利用している。オープンワールド検出を実現するためのトレーニングサンプルセットにおいて、未知のオブジェクトをすべてのオブジェクトと区別するためのデータセットレザベリングアプローチを設計する。
論文参考訳（メタデータ） (2023-05-11T16:19:44Z)
Open-Vocabulary Point-Cloud Object Detection without 3D Annotation [62.18197846270103]
オープン語彙の3Dポイントクラウド検出の目的は、任意のテキスト記述に基づいて新しいオブジェクトを識別することである。様々な物体を局所化するための一般的な表現を学習できる点クラウド検出器を開発した。また,画像,点雲,テキストのモダリティを結合する,非偏差三重項クロスモーダルコントラスト学習を提案する。
論文参考訳（メタデータ） (2023-04-03T08:22:02Z)
Detect Only What You Specify : Object Detection with Linguistic Target [0.0]
本稿では,最近提案されたTransformer-based Detectorに基づくターゲット検出のためのLanguage-Targeted Detector (LTD)を提案する。 LTDはエンコーダ・デコーダアーキテクチャであり,条件付きデコーダにより,テキスト入力を言語文脈として,符号化された画像について推論することができる。
論文参考訳（メタデータ） (2022-11-18T07:28:47Z)
Detect-and-describe: Joint learning framework for detection and description of objects [0.0]
我々は、オブジェクトを同時に検出し、それらの属性を推測する新しいアプローチを提案し、それを検出および記述(DaD)フレームワークと呼ぶ。 DaDはディープラーニングベースのアプローチであり、オブジェクト検出をオブジェクト属性予測にも拡張する。我々は,aPascalテストセット上でのオブジェクト属性予測において,受信者動作特性曲線(AUC)の下で97.0%を達成する。
論文参考訳（メタデータ） (2022-04-19T11:57:30Z)
Learning Object Detection from Captions via Textual Scene Attributes [70.90708863394902]
キャプションには、オブジェクトの属性やそれらの関係など、画像に関するよりリッチな情報が含まれている、と我々は主張する。本稿では,この「テキストシーングラフ」の属性を用いて物体検知器を訓練する手法を提案する。得られたモデルが、いくつかの挑戦的なオブジェクト検出データセットに対して、最先端の結果を達成することを実証的に実証した。
論文参考訳（メタデータ） (2020-09-30T10:59:20Z)
DOPS: Learning to Detect 3D Objects and Predict their 3D Shapes [54.239416488865565]
LIDARデータに対する高速な1段3次元物体検出法を提案する。我々の手法の中核となる新規性は高速かつシングルパスアーキテクチャであり、どちらも3次元の物体を検出し、それらの形状を推定する。提案手法は,ScanNetシーンのオブジェクト検出で5%,オープンデータセットでは3.4%の精度で結果が得られた。
論文参考訳（メタデータ） (2020-04-02T17:48:50Z)

関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。

指定された論文の情報です。
本サイトの運営者は本サイト（すべての情報・翻訳含む）の品質を保証せず、本サイト（すべての情報・翻訳含む）を使用して発生したあらゆる結果について一切の責任を負いません。