論文の概要: Endoshare: A Source Available Solution to De-Identify and Manage Surgical Videos
- arxiv url: http://arxiv.org/abs/2510.20087v1
- Date: Thu, 23 Oct 2025 00:07:58 GMT
- ステータス: 翻訳完了
- システム内更新日: 2025-10-25 03:08:17.023126
- Title: Endoshare: A Source Available Solution to De-Identify and Manage Surgical Videos
- Title(参考訳): Endoshare: 手術ビデオの特定と管理を行うためのオープンソースソリューション
- Abstract要約: 低侵襲手術における内視鏡的ビデオの融合,標準化,同定のためのクロスプラットフォームアプリケーションであるEndoshareを提案する。
開発は、反復的でユーザ中心のフィードバックで、ソフトウェア開発ライフサイクルに従った。
- 参考スコア(独自算出の注目度): 8.446356840831314
- License: http://creativecommons.org/licenses/by-nc-sa/4.0/
- Abstract: Video-based assessment and surgical data science can advance surgical training, research, and quality improvement. However, widespread use remains limited by heterogeneous recording formats and privacy concerns associated with video sharing. We present Endoshare, a source-available, cross-platform application for merging, standardizing, and de-identifying endoscopic videos in minimally invasive surgery. Development followed the software development life cycle with iterative, user-centered feedback. During the analysis phase, an internal survey of clinicians and computer scientists based on ten usability heuristics identified key requirements that guided a privacy-by-design architecture. In the testing phase, an external clinician survey combined the same heuristics with Technology Acceptance Model constructs to assess usability and adoption, complemented by benchmarking across different hardware configurations. Four clinicians and four computer scientists initially tested the prototype, reporting high usability (4.68 +/- 0.40/5 and 4.03 +/- 0.51/5), with the lowest score (4.00 +/- 0.93/5) relating to label clarity. After refinement, the testing phase surveyed ten surgeons who reported high perceived usefulness (5.07 +/- 1.75/7), ease of use (5.15 +/- 1.71/7), heuristic usability (4.38 +/- 0.48/5), and strong recommendation (9.20 +/- 0.79/10). Processing time varied with processing mode, video duration (both p <= 0.001), and machine computational power (p = 0.041). Endoshare provides a transparent, user-friendly pipeline for standardized, privacy-preserving surgical video management. Compliance certification and broader interoperability validation are needed to establish it as a deployable alternative to proprietary systems. The software is available at https://camma-public.github.io/Endoshare/
- Abstract(参考訳): ビデオベースのアセスメントと手術データ科学は、手術訓練、研究、品質改善を促進することができる。
しかし、ビデオ共有にまつわる不均一な記録フォーマットやプライバシー上の懸念により、広く使われていることは依然として限られている。
低侵襲手術における内視鏡的ビデオのマージ,標準化,識別のための,ソースアクセス可能なクロスプラットフォームアプリケーションであるEndoshareについて紹介する。
開発は、反復的でユーザ中心のフィードバックで、ソフトウェア開発ライフサイクルに従った。
分析期間中、10人のユーザビリティヒューリスティックに基づいた臨床医とコンピュータ科学者の内部調査では、プライバシ・バイ・デザインアーキテクチャを導く重要な要件が特定された。
テストフェーズでは、外部臨床医が同じヒューリスティックとTechnology Acceptance Model構造を組み合わせて、さまざまなハードウェア構成のベンチマークによって補完されるユーザビリティと導入性を評価した。
4人の臨床医と4人のコンピュータ科学者がこのプロトタイプを最初にテストし、高い使用性(4.68 +/- 0.40/5と4.03 +/- 0.51/5)を報告し、ラベルの明快さに関する最も低いスコア(4.00 +/- 0.93/5)を報告した。
改善後、検査段階は、高い知覚力(5.07 +/- 1.75/7)、使いやすさ(5.15 +/- 1.71/7)、ヒューリスティックな使いやすさ(4.38 +/- 0.48/5)、強い推奨(9.20 +/- 0.79/10)を報告した10人の外科医を調査した。
処理時間は、処理モード、ビデオの長さ(p <= 0.001)、機械計算パワー(p = 0.041)によって変化した。
Endoshareは、標準化されたプライバシー保護型外科的ビデオ管理のための透明でユーザフレンドリーなパイプラインを提供する。
プロプライエタリシステムに代わるデプロイ可能な代替手段として、コンプライアンス認証と広範な相互運用性検証が必要である。
ソフトウェアはhttps://camma-public.github.io/Endoshare/で入手できる。
関連論文リスト
- MedCUA-Bench: A Screenshot-Only Benchmark for Clinical Computer-Use Agents [37.61856213612204]
MedCUA-Benchは,臨床用コンピュータ使用エージェントの対話型ベンチマークである。
実際の製品マニュアルとオープンソース医療システムから再構築された10の医療ドメインにわたる18の臨床シナリオをカバーする。
23エージェント中、最高のクローズドソースモデルは54.2%の精度で成功し、実際のOpenEMRでは9%以下にとどまっている。
論文 参考訳(メタデータ) (2026-06-02T06:02:35Z) - UniSurgSAM: A Unified Promptable Model for Reliable Surgical Video Segmentation [18.74680721916099]
視覚的,テキスト的,あるいは音声的プロンプトによる信頼性の高い手術ビデオ分割を可能にする統合PVOSモデルUniSurgSAMを提案する。
本稿では,幻覚の抑制を目的とした存在認識復号法,拡張シーケンス上のマスクドリフトを防止する境界認識長期追跡法,障害回復のための段階間のループを閉じる適応状態遷移の3つの重要な設計を提案する。
UniSurgSAMは、あらゆる急進的なモダリティと粒度にわたる最先端のパフォーマンスをリアルタイムで達成し、コンピュータ支援手術の実践的な基盤を提供する。
論文 参考訳(メタデータ) (2026-04-04T08:44:10Z) - Scaling Video Pretraining for Surgical Foundation Models [51.92777479821822]
SurgRecは、スケーラブルで再現可能な、外科的ビデオ理解のための事前学習のレシピだ。
内視鏡,腹腔鏡,白内障,ロボット手術を対象とする10,535ビデオと214.5Mフレームの大規模なコーパスをキュレートした。
論文 参考訳(メタデータ) (2026-03-31T16:31:25Z) - SKINOPATHY AI: Smartphone-Based Ophthalmic Screening and Longitudinal Tracking Using Lightweight Computer Vision [0.21787848945040766]
SKINOPATHY AIは、コモディティなモバイルハードウェアを通じて、補完的で説明可能な5つのスクリーニングモジュールを提供する、スマートフォンファーストのWebアプリケーションである。
このシステムは、OpenCVとMediaPipe、MongoDBが支援するセッション永続化、PDFレポート生成を備えたReact/FastAPIスタックとして実装されている。
論文 参考訳(メタデータ) (2026-02-26T02:32:25Z) - MedScope: Incentivizing "Think with Videos" for Clinical Reasoning via Coarse-to-Fine Tool Calling [51.31633278218137]
MedScope(メドスコープ)は、ロングフォームなプロシージャを追求する粗大な証拠を実行する、ツールを用いた臨床ビデオ推論モデルである。
ClinVideoSuiteは、エビデンス中心の、きめ細かい臨床ビデオスイートだ。
フルできめ細かいビデオ理解ベンチマークでは、MedScopeは最先端のパフォーマンスを実現している。
論文 参考訳(メタデータ) (2026-02-11T09:47:02Z) - UniSurg: A Video-Native Foundation Model for Universal Understanding of Surgical Videos [81.9180187964947]
我々は,学習パラダイムを画素レベルの再構成から潜在動作予測に移行する基礎モデルUniSurgを提案する。
大規模な事前トレーニングを可能にするため,13の解剖学的領域にわたる50源からの3,658時間の動画を含む,これまでで最大規模の手術用ビデオデータセットをキュレートした。
これらの結果は、UniSurgを、ユニバーサルでモーション指向の外科的ビデオ理解の新しい標準として確立している。
論文 参考訳(メタデータ) (2026-02-05T13:18:33Z) - Prompt Triage: Structured Optimization Enhances Vision-Language Model Performance on Medical Imaging Benchmarks [5.200534363670116]
ヴィジュアル言語基礎モデル(VLM)は様々なイメージングタスクを約束するが、しばしば医療ベンチマークでは性能が劣る。
我々は、医療ビジョン言語システムにおける構造化された自動プロンプト最適化のための宣言的自己改善Pythonフレームワークに適応する。
我々は,放射線学,消化器学,皮膚学にまたがる5つの医療画像処理のためのプロンプトパイプラインを実装し,4つのプロンプト最適化手法を用いて10個のオープンソースVLMを評価した。
論文 参考訳(メタデータ) (2025-11-14T22:01:08Z) - Hulu-Med: A Transparent Generalist Model towards Holistic Medical Vision-Language Understanding [112.46150793476603]
Hulu-Medは透明な医療用VLMで、これらすべてのモダリティの理解を統一する。
パッチベースのビジョンエンコーダとLCMデコーダを統一して構築され、Hulu-Medは2Dから3D、ビデオの理解のために167万 (M) のサンプルを徐々に訓練した。
論文 参考訳(メタデータ) (2025-10-09T17:06:42Z) - MedFoundationHub: A Lightweight and Secure Toolkit for Deploying Medical Vision Language Foundation Models [9.098674571831088]
医用視覚言語モデルをデプロイするためのGUIツールキットであるMedFoundationHubを提案する。
医師はプログラミングの専門知識を使わずに、さまざまなモデルを手動で選択および使用することができる。
また、Dockerが管理するオペレーティングシステムのデプロイメントを通じて、プライバシ保護の推論を保証する。
論文 参考訳(メタデータ) (2025-08-28T01:39:16Z) - One Patient's Annotation is Another One's Initialization: Towards Zero-Shot Surgical Video Segmentation with Cross-Patient Initialization [1.0536099636804035]
ビデオオブジェクトセグメンテーションは、リアルタイムな外科的ビデオセグメンテーションに適した新興技術である。
しかし、追跡されたオブジェクトを選択するために手動で介入する必要があるため、その採用は限られている。
本研究では,他の患者からの注釈付きフレームを追跡フレームとして使用することで,この課題を革新的な解決法で解決する。
この非従来的アプローチは、患者の追跡フレームの使用実績と一致したり、超えたりすることさえできる。
論文 参考訳(メタデータ) (2025-03-04T03:11:03Z) - TEMSET-24K: Densely Annotated Dataset for Indexing Multipart Endoscopic Videos using Surgical Timeline Segmentation [2.9776992449863613]
現在のビデオ分析は、手作業によるインデックス作成に依存している。
TEMSET-24Kは,経肛門的内視鏡的マイクロサマリー(TEMS)ビデオマイクロクリップからなるオープンソースデータセットである。
各クリップは、新しい階層的ラベリング分類を用いて、臨床専門家によって慎重に注釈付けされる。
論文 参考訳(メタデータ) (2025-02-10T17:37:34Z) - Foundation Model for Endoscopy Video Analysis via Large-scale
Self-supervised Pre-train [27.188088885290025]
本研究では,大規模な内視鏡映像データを用いた基礎モデルであるEndo-FMを提案する。
私たちのデータセット全体は、最大500万フレームの33Kビデオクリップで構成されており、さまざまなプロトコル、対象臓器、疾患タイプが含まれています。
我々のEndo-FMは、現在最先端(SOTA)の自己指導型事前学習とアダプタベースのトランスファー学習を、かなりの差で上回っている。
論文 参考訳(メタデータ) (2023-06-29T07:34:25Z) - Perception Test: A Diagnostic Benchmark for Multimodal Video Models [78.64546291816117]
本稿では,事前学習したマルチモーダルモデルの知覚と推論能力を評価するために,新しいマルチモーダルビデオベンチマークを提案する。
知覚テストは、スキル(記憶、抽象化、物理学、セマンティックス)と、ビデオ、オーディオ、テキストモダリティ間の推論(記述的、説明的、予測的、反ファクト的)のタイプに焦点を当てている。
このベンチマークは、ゼロショット/少数ショットまたは限定的な微調整方式で、転送機能の事前訓練されたモデルを探索する。
論文 参考訳(メタデータ) (2023-05-23T07:54:37Z) - Pseudo-label Guided Cross-video Pixel Contrast for Robotic Surgical
Scene Segmentation with Limited Annotations [72.15956198507281]
シーンセグメンテーションを促進するために,新しい擬似ラベル付きクロスビデオコントラスト学習法であるPGV-CLを提案する。
本研究では,ロボット外科手術データセットEndoVis18と白内障手術データセットCaDISについて検討した。
論文 参考訳(メタデータ) (2022-07-20T05:42:19Z) - 4D-OR: Semantic Scene Graphs for OR Domain Modeling [72.1320671045942]
本稿では,手術シーンを記述・要約するために意味シーングラフ(SSG)を提案する。
シーングラフのノードは、医療スタッフ、患者、医療機器など、部屋内のさまざまなアクターやオブジェクトを表す。
人工膝置換手術を10回行った4D-ORデータセットを作成した。
論文 参考訳(メタデータ) (2022-03-22T17:59:45Z) - LRTD: Long-Range Temporal Dependency based Active Learning for Surgical
Workflow Recognition [67.86810761677403]
本稿では,費用対効果の高い手術ビデオ解析のための新しい能動的学習法を提案する。
具体的には,非局所的再帰的畳み込みネットワーク (NL-RCNet) を提案する。
手術ワークフロー認識タスクを実行することで,大規模な手術ビデオデータセット(Cholec80)に対するアプローチを検証する。
論文 参考訳(メタデータ) (2020-04-21T09:21:22Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。