論文の概要: Detecting High-Potential SMEs with Heterogeneous Graph Neural Networks
- arxiv url: http://arxiv.org/abs/2602.19591v2
- Date: Fri, 27 Feb 2026 06:35:57 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-02 13:30:11.360806
- Title: Detecting High-Potential SMEs with Heterogeneous Graph Neural Networks
- Title(参考訳): 不均一グラフニューラルネットワークによる高電位中小企業の検出
- Abstract要約: 中小企業は米国の事業の99.9%を占め、経済活動の44%を生んでいる。
我々は、SME-HGTという異種グラフ変換フレームワークを導入し、特定の公開データを用いて、どのフェーズIの受賞者がフェーズIIの資金調達に進むかを予測する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Small and Medium Enterprises (SMEs) constitute 99.9% of U.S. businesses and generate 44% of economic activity, yet systematically identifying high-potential SMEs remains an open challenge. We introduce SME-HGT, a Heterogeneous Graph Transformer framework that predicts which SBIR Phase I awardees will advance to Phase II funding using exclusively public data. We construct a heterogeneous graph with 32,268 company nodes, 124 research topic nodes, and 13 government agency nodes connected by approximately 99,000 edges across three semantic relation types. SME-HGT achieves an AUPRC of 0.621 0.003 on a temporally-split test set, outperforming an MLP baseline (0.590 0.002) and R-GCN (0.608 0.013) across five random seeds. At a screening depth of 100 companies, SME-HGT attains 89.6% precision with a 2.14 lift over random selection. Our temporal evaluation protocol prevents information leakage, and our reliance on public data ensures reproducibility. These results demonstrate that relational structure among firms, research topics, and funding agencies provides meaningful signal for SME potential assessment, with implications for policymakers and early-stage investors.
- Abstract(参考訳): 中小企業(中小企業)は米国の事業の99.9%を占め、経済活動の44%を生んでいるが、体系的に高力の中小企業を特定することはオープンな課題である。
SME-HGTは、SBIRフェーズIの受賞者が公開データのみを用いてフェーズIIの資金調達に進むかを予測する不均質グラフトランスフォーマーフレームワークである。
我々は,32,268の企業ノード,124の研究トピックノード,13の政府機関ノードを3つの意味関係型で約99,000のエッジで接続した異種グラフを構築した。
SME-HGTは、時間的に分割されたテストセットで0.621 0.003のAUPRCを達成し、5つのランダムシードに対してMLPベースライン(0.590 0.002)とR-GCN(0.608 0.013)を上回っている。
100社のスクリーニング深度で、SME-HGTはランダム選択よりも2.14リフトで89.6%の精度を達成している。
我々の時間的評価プロトコルは情報漏洩を防ぎ、公開データへの依存は再現性を保証する。
これらの結果は、企業、研究トピック、資金調達機関間の関係構造が、政策立案者やアーリーステージ投資家に影響を及ぼす中小企業の潜在的評価に有意義なシグナルをもたらすことを示している。
関連論文リスト
- Modality-Decoupled Federated Learning for Privacy-Preserving Embodied Intelligence in 6G [90.42669277637026]
第6世代(6G)無線ネットワークは、大規模なインボディードインテリジェンスのための重要な基盤を提供すると期待されている。
本稿では、6Gネットワークにおけるプライバシー保護型インテリジェンスのためのモダリティ分離FLフレームワークであるFedMVLAを提案する。
論文 参考訳(メタデータ) (2026-09-09T01:36:44Z) - Marginal Fidelity Does Not Establish User Simulation in Demographic Synthetic Survey Panels: Response Contracts, Support Collapse and Conditioning Failure [51.736723807086385]
人口密着協定は、個別のシミュレーションの証拠ではなく、エスカレーション契約の証拠であり、シミュレーションされた回答者なしで得られる推定値である。
9つのアライメントされたモデルバッテリペアでは、非個人個体数のクエリの平均は6.27 MAE対12.39であり、9つの比較すべてで勝利する。
論文 参考訳(メタデータ) (2026-09-07T10:22:22Z) - Explainable Machine Learning for Broadband Adoption Disparities: Tract-Level Prediction and SHAP-Based Factor Profiling [6.076837441966713]
米国は、ブロードバンド拡大のためのインフラ投資および雇用法を通じて、およそ650億ドルを割り当てている。
本稿では,全国83,359施設を対象に,ブロードバンドの普及格差をプロファイリングするための機械学習フレームワークを提案する。
論文 参考訳(メタデータ) (2026-08-29T07:39:08Z) - Planetary Prediction Engine: Autonomous Geospatial Prediction via Intelligent Data Selection and Foundation Model Embeddings [8.285606894669046]
我々は、自然言語クエリからこのエンドツーエンドワークフローを実行する自律型AIシステムであるPPE(Planetary Prediction Engine)を紹介する。
PPEはマルチモーダルデータセットをオンザフライで合成し、オープンウェブと地球観測プラットフォームにまたがる関連するco変数を検索する。
PPEは、最先端または手動で調整されたエキスパートベースラインを一貫して上回る。
論文 参考訳(メタデータ) (2026-08-26T17:50:52Z) - Accounting Graph Transformer for Short-History Multi-KPI Forecasting in Small Businesses [1.3750624267664158]
本研究は、13の所得計算、バランスシート、キャッシュフロー、および71の月次台帳のワーキング・キャピタル・パフォーマンス指標を共同12カ月間予測した。
11,993の予測は1,060の未確認企業に由来するが、AGTはサンプルマクロ平均絶対誤差(MAE)を0.6990 pm 0.0013$で達成している。
AGTは、シード-42の比較において、LightGBM、TimeMixer、SOFTSと全13でベストマッチする。
論文 参考訳(メタデータ) (2026-08-07T09:47:44Z) - Knowledge Index of Noah's Ark [63.143852586221534]
KINAは,261分野にわたる899項目のベンチマークである。
ボーナス・オン・バートーナメントがFOSDを弱く支配していることを示す。
トップモデルであるGemini-3.1-Pro-Previewは53.17%、Claude-Opus-4.6は49.92%、GPT-5.4は48.55%に達した。
論文 参考訳(メタデータ) (2026-06-03T17:06:49Z) - Effective Performance Measurement: Challenges and Opportunities in KPI Extraction from Earnings Calls [43.85438181764358]
SECの申請書やコンテキスト内学習法で訓練されたモデルで得られた情報を評価する。
そこで本稿では,LLMを用いた非構造化呼起こ書き起こしからのオープンエンド抽出を行うシステムを提案する。
論文 参考訳(メタデータ) (2026-05-04T20:40:05Z) - AgentRaft: Automated Detection of Data Over-Exposure in LLM Agents [40.88941407116349]
本稿では,大規模言語モデル(LLM)エージェントにおけるデータオーバー露光(DOE)リスクを検出するための,最初の自動化フレームワークであるAgentRaftを紹介する。
実世界のエージェントツール6,675のテスト環境でAgentRaftを評価した。
論文 参考訳(メタデータ) (2026-03-08T09:40:54Z) - From Black Box to Glass Box: Cross-Model ASR Disagreement to Prioto Review in Ambient AI Scribe Documentation [43.148402136307716]
異種ASRシステム間のクロスモデル不一致は、基準のない不確実性信号として機能する。
商用APIとオープンソースエンジンにまたがる8つのASRシステムを備えた,50の公開医療用オーディオクリップを転写した。
低アグリメント領域は内容の不一致に富み、高リスク質量のクインタイル全体では53.9%から73.9%に増加した。
論文 参考訳(メタデータ) (2026-03-02T13:02:13Z) - Coverage-Aware Web Crawling for Domain-Specific Supplier Discovery via a Web--Knowledge--Web Pipeline [0.0]
既存のビジネスデータベースは、かなりのカバレッジギャップに悩まされている。
我々はtextbfWeb-Knowledge--Web (W$to$K$to$W) パイプラインを提案する。
ドメイン固有のWebソースをクロールして、候補サプライヤエンティティを見つける。
構造化された知識をヘテロジニアスな知識グラフに統合する。
論文 参考訳(メタデータ) (2026-02-27T18:31:42Z) - Soft Clustering Anchors for Self-Supervised Speech Representation Learning in Joint Embedding Prediction Architectures [45.74430728311433]
JEPA(Joint Embedding Predictive Architectures)は、自己教師型音声表現学習において有望なアプローチを提供するが、明示的な根拠なしに表現の崩壊に悩まされる。
本稿では,GMM-Anchored JEPAを提案する。GMM-Anchored JEPAはガウス混合モデルの対数メル分光法に一度適合し,凍結した軟体後部をトレーニングを通して補助目標とする。
50k時間音声では、GMMアンカーがASR(28.68% vs. 33.22% WER)、感情認識(67.76% vs. 65.46%)、スロットフィリング(64.7% vs. 59.1% F1)を改善している。
論文 参考訳(メタデータ) (2026-01-30T20:51:37Z) - FUGC: Benchmarking Semi-Supervised Learning Methods for Cervical Segmentation [63.7829089874007]
本稿では,頚椎椎間板断裂における半教師あり学習のための最初のベンチマークであるFetal Ultrasound Grand Challenge (FUGC)を紹介する。
FUGCは、500のトレーニング画像、90の検証画像、300のテスト画像を含む890のTVSイメージのデータセットを提供する。
Dice similarity Coefficient (DSC), Hausdorff Distance (HD), and Runtime (RT), with a weighted combination of 0.4/0.4/0.2。
論文 参考訳(メタデータ) (2026-01-22T01:34:39Z) - SmallML: Bayesian Transfer Learning for Small-Data Predictive Analytics [0.0]
SmallMLは50~200という小さなデータセットで、エンタープライズレベルの予測精度を達成する。
顧客データの検証では、96.7%+/-4.2%のAUCがビジネス当たり100の観測結果を示している。
3300万の米国中小企業のエンタープライズグレードの予測を可能にすることで、SmallMLはAIの民主化における重要なギャップに対処する。
論文 参考訳(メタデータ) (2025-11-18T02:00:55Z) - Agentic World Modeling for 6G: Near-Real-Time Generative State-Space Reasoning [70.56067503630486]
第6世代(6G)インテリジェンスは、流動的なトークン予測ではなく、想像と選択の能力を校正している、と我々は主張する。
We showed that WM-MS3M cuts mean absolute error (MAE) by 1.69% vs MS3M with 32% less parameters and similar latency, and achieve a 35-80% lower root mean squared error (RMSE) than attention/hybrid baselines with 2.3-4.1x faster inference。
論文 参考訳(メタデータ) (2025-11-04T17:22:22Z) - Shoot First, Ask Questions Later? Building Rational Agents that Explore and Act Like People [81.63702981397408]
限られたリソースを前提として、言語モデル(LM)に基づいたエージェントは、どの程度合理的に行動するのか?
エージェント情報探索をベンチマークし,強化する手法を開発し,人間の行動から洞察を抽出する。
Spotterエージェントでは、LMのみのベースラインよりも14.7%の精度で精度を向上し、Captainエージェントでは、期待情報ゲイン(EIG)を0.227ビット(達成可能なノイズ天井の94.2%)まで引き上げる。
論文 参考訳(メタデータ) (2025-10-23T17:57:28Z) - Advanced spectral clustering for heterogeneous data in credit risk monitoring systems [8.92280593592798]
異種データ中の有意なクラスタを特定するために,Advanced Spectral Clustering (ASC)を提案する。
スペクトルクラスタリング理論を異種データアプリケーションでブリッジすることにより、ASCは、30%低いデフォルトリスクを示す採用中心の中小企業のような意味のあるクラスタの識別を可能にする。
論文 参考訳(メタデータ) (2025-08-30T16:06:00Z) - Credit Risk Analysis for SMEs Using Graph Neural Networks in Supply Chain [2.060688901523233]
本稿では、空間依存をマッピングし、デフォルトリスクを予測するグラフニューラルネットワーク(GNN)ベースのフレームワークを提案する。
DiscoverとAnt Creditの実際のデータセットに対するテストは、GNNが従来のGNNベースラインを超えることを示している。
また、規制当局が銀行に対するサプライチェーンの破壊の影響をモデル化し、物質不足からローンデフォルトを正確に予測し、CCARリスクバッファーの鍵となるデータを提供する。
論文 参考訳(メタデータ) (2025-07-10T15:33:53Z) - Person Recognition at Altitude and Range: Fusion of Face, Body Shape and Gait [70.00430652562012]
FarSightは、顔認識のためのエンドツーエンドシステムで、顔、歩行、体形を横断する生体計測の手がかりを統合する。
FarSightは、4つのコアモジュールにまたがる新しいアルゴリズムを組み込んでいる。
論文 参考訳(メタデータ) (2025-05-07T17:58:25Z) - A Cross-Country Analysis of GDPR Cookie Banners and Flexible Methods for Scraping Them [6.533686617147407]
ePrivacy Directive and consent-observatory.eu(ePrivacy Directive and consent-observatory.eu)の下で31カ国で上位1万のウェブサイトを調査した。
ウェブサイトの67%は同意インターフェースを使用しているが、拒否オプションがないため、最小限に準拠しているのは15%に過ぎない。
規制当局のガイダンスや罰金がコンプライアンス率に影響を及ぼした証拠はほとんどないが、CMPによって18%のコンプライアンスのばらつきが説明されている。
論文 参考訳(メタデータ) (2025-03-25T13:44:26Z) - Heterogeneous Federated Learning via Grouped Sequential-to-Parallel
Training [60.892342868936865]
フェデレートラーニング(Federated Learning, FL)は、プライバシ保護のためのコラボレーション機械学習パラダイムである。
本稿では,この課題に対処するため,データヘテロジニアス・ロバストFLアプローチであるFedGSPを提案する。
その結果,FedGSPは7つの最先端アプローチと比較して平均3.7%の精度向上を実現していることがわかった。
論文 参考訳(メタデータ) (2022-01-31T03:15:28Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。