論文の概要: Differentially Private and Fairness-Audited Score Diffusion for Irregular Longitudinal Health Records
- arxiv url: http://arxiv.org/abs/2609.22401v2
- Date: Tue, 22 Sep 2026 11:17:06 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-23 18:04:03.869815
- Title: Differentially Private and Fairness-Audited Score Diffusion for Irregular Longitudinal Health Records
- Title(参考訳): 不規則経時的健康記録における個人差とフェアネス差の検討
- Abstract要約: 本報告では,有界な統計量を組み合わせた患者レベルプライベートジェネレータであるTRUST LONGSYNTHについて述べる。
720例を含む5つのコホート・ベンチマークを独立に評価した。
一方、ブライア、キャリブレーション、相関、自己相関の誤差はそれぞれ6.1%、17.0%、28.0%、30.1%減少した。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Sharing irregular longitudinal health records can accelerate model development, yet synthetic releases may leak participation, distort temporal dependence, suppress rare events, or reduce utility for underrepresented groups. We present TRUST LONGSYNTH, an auditable patient level private generator that combines bounded sufficient statistics, zCDP accounted Gaussian releases, conditional analytic score diffusion, block banded temporal covariance, separate missingness and gap models, and a protected event sampling floor with population weights. The method was evaluated on five independently generated, three cohort benchmarks containing 720 patients, fourteen irregular observation slots, six mixed variables, informative missingness, and a rare deterioration outcome. At epsilon = 12 and delta = 10 to the power of minus 5, TRUST LONGSYNTH achieved mean train synthetic test real AUPRC 0.342, Brier score 0.088, expected calibration error 0.082, correlation error 0.222, autocorrelation error 0.317, and membership attack AUROC 0.499. Relative to the private diagonal score baseline, AUPRC increased by 7.5 percent, while Brier, calibration, correlation, and autocorrelation errors decreased by 6.1 percent, 17.0 percent, 28.0 percent, and 30.1 percent, respectively. The method did not dominate every nonprivate or discrete baseline, and corrected paired tests were inconclusive with five seeds. Canary exposure was 1.8 percent, compared with 28.8 percent for DP Score in the same stress test. These findings support a transparent privacy utility fairness evaluation protocol, not clinical validity or unconditional release safety, and motivate governed external validation on real multi site records.
- Abstract(参考訳): 不規則な経時的健康記録の共有は、モデル開発を加速させるが、合成リリースは、参加をリークしたり、時間的依存を歪ませたり、稀な出来事を抑えたり、または、表現不足な集団の実用性を低下させる可能性がある。
TRUST LONGSYNTHは,有界な統計量とzCDPによるガウシアンリリース,条件付き分析スコア拡散,ブロックバンド時間共分散,個別の欠落とギャップモデル,および集団重み付き保護イベントサンプリングフロアを併用した,患者レベルプライベートジェネレータである。
720名を含むコホート・ベンチマーク,14名の不規則な観察スロット,6名の混合変数,情報の欠如,希少な劣化結果について評価した。
エプシロン=12とデルタ=10でマイナス5の出力に到達し、TRUST LONGSYNTHは平均合成試験の実AUPRC 0.342、ブライアスコア0.088、期待校正誤差0.082、相関誤差0.222、自己相関誤差0.317、会員攻撃AUROC 0.499を達成した。
一方、ブライア、キャリブレーション、相関、自己相関の誤差はそれぞれ6.1%、17.0%、28.0%、30.1%減少した。
本法はすべての非私的, 離散的ベースラインを支配せず, 補正されたペアテストは5種で不確定であった。
カナリア曝露は1.8%、DPスコアは28.8%であった。
これらの結果は,臨床的妥当性や非条件リリースの安全性ではなく,透明性のあるプライバシーユーティリティフェアネス評価プロトコルをサポートし,実際のマルチサイトレコードに対する管理された外部バリデーションを動機付けている。
関連論文リスト
- Marginal Fidelity Does Not Establish User Simulation in Demographic Synthetic Survey Panels: Response Contracts, Support Collapse and Conditioning Failure [51.736723807086385]
人口密着協定は、個別のシミュレーションの証拠ではなく、エスカレーション契約の証拠であり、シミュレーションされた回答者なしで得られる推定値である。
9つのアライメントされたモデルバッテリペアでは、非個人個体数のクエリの平均は6.27 MAE対12.39であり、9つの比較すべてで勝利する。
論文 参考訳(メタデータ) (2026-09-07T10:22:22Z) - Neurosymbolic Alignment for Physiologically-Safe Clinical Language Models [34.30791848883716]
本稿では,HGNNをベースとした生理的世界モデルと7B臨床LLMを併用したトレーニングタイムフレームワークであるNeurosymbolic Alignmentを提案する。
候補者の反応は、ホメオスタティックな制約、マルチホップパスの妥当性、薬物相互作用の罰則を用いて評価される。
臨床安全ベンチマーク(CSB: Clinical Safety Benchmark)は、遺伝子的臨床推論における生理的制約違反に対する2500-scenarioベンチマークである。
論文 参考訳(メタデータ) (2026-08-25T13:20:03Z) - PGP-Clinical-TimeKAN: Prior-Guided Joint Probabilistic Forecasting of Clinical Trajectories [33.074550441856196]
PGP-Clinical-TimeKANは多変量生理学の合同確率予測のための軌道優先のフレームワークである。
欠如を意識した時間エンコーダ、ソフトオルガン前駆体、患者固有の関係、非線形コルモゴロフ・アルノルドメッセージ、低ランクの多変量学生-tヘッドを組み合わせる。
論文 参考訳(メタデータ) (2026-08-24T23:33:35Z) - Passing Coarse Marginal Checks Can Be Cheap: Persona Mixtures and Imprecise Treatment-Response Estimates in an LLM Persona Panel [0.0]
戦略ゲームにおける16個の軽量人格条件付きGPT-4.1構成の固定パネルについて検討した。
変化は急激なインデクシングであったが、そのシェアは不確実性の仮定に依存していた。
結果は、1つの固定されたモデル・プロンプトパネルに関係し、人間の置換性を確立しない。
論文 参考訳(メタデータ) (2026-08-02T04:10:11Z) - KAISEN: Reproducible Subgroup Fairness Auditing for Clinical Risk Models [0.0]
KAISENは、サブグループの成層、不均質の測定、メカニズム診断、ポストホック緩和、ドリフトモニタリングを含む5段階の監査パイプラインである。
すべての結果は、既知の根拠の真実と共に合成され、臨床的妥当性が確立されない。
論文 参考訳(メタデータ) (2026-07-30T17:57:18Z) - Calibrated Alzheimer's Conversion Risk in Mild Cognitive Impairment: Persistent Homology of Clinical Trajectories with Conformal Guarantees [0.0]
軽度の認知障害からアルツハイマー病への転換を予測することは、臨床試験とケア計画の中心である。
既存のモデルは個々のレベルの不確実性評価を提供しておらず、透明な漏洩監査を含むことは滅多にない。
本研究は, 持続的ホモロジーの経時的臨床軌道点雲への応用について紹介する。
論文 参考訳(メタデータ) (2026-07-20T00:00:17Z) - Calibration, Uncertainty Communication, and Deployment Readiness in CKD Risk Prediction: A Framework Evaluation Study [0.0]
慢性腎臓病の機械学習モデルは、しばしば内部テストセットに強い差別的スコアを与える。
UCI CKDデータセット(400例,62.5%)を用いた5つの分類器の訓練を行った。
キャリブレーション品質,コンフォーマルな予測カバレッジ,8基準の展開準備フレームワークについて検討した。
論文 参考訳(メタデータ) (2026-05-20T17:12:48Z) - From Black Box to Glass Box: Cross-Model ASR Disagreement to Prioto Review in Ambient AI Scribe Documentation [43.148402136307716]
異種ASRシステム間のクロスモデル不一致は、基準のない不確実性信号として機能する。
商用APIとオープンソースエンジンにまたがる8つのASRシステムを備えた,50の公開医療用オーディオクリップを転写した。
低アグリメント領域は内容の不一致に富み、高リスク質量のクインタイル全体では53.9%から73.9%に増加した。
論文 参考訳(メタデータ) (2026-03-02T13:02:13Z) - PanCanBench: A Comprehensive Benchmark for Evaluating Large Language Models in Pancreatic Oncology [48.732366302949515]
大規模言語モデル(LLM)は、標準化された検査において専門家レベルの性能を達成したが、複数の選択精度は現実の臨床的有用性や安全性を十分に反映していない。
我々は、未確認患者の質問に対して、専門家のルーブリックを作成するための、ループ内人間パイプラインを開発した。
LLM-as-a-judge フレームワークを用いて,22のプロプライエタリおよびオープンソース LLM の評価を行い,臨床完全性,事実精度,Web-search 統合について検討した。
論文 参考訳(メタデータ) (2026-03-02T00:50:39Z) - Correcting Class Imbalances with Self-Training for Improved Universal Lesion Detection and Tagging [43.06199185109424]
CT研究におけるユニバーサル病変検出・タグング(ULDT)は,腫瘍の負担評価と経過に伴う病変の進行(成長・収縮)の追跡に重要である。
以前の研究では、DeepLesionデータセット(4,427人、研究10,594人、CTスライス32,120人、病変32,735人、体の一部のラベル8人)をアルゴリズム開発に使用していたが、このデータセットは完全に注釈付けされておらず、クラス不均衡を含んでいる。
我々は,DeepLesionの11.5%のサブセットを限定的に使用して,ULDTのための自己学習パイプラインを開発した。
論文 参考訳(メタデータ) (2025-04-07T15:57:03Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。