論文の概要: GPTKB 2.0: Direct Construction of Disambiguated Knowledge Bases from Large Language Models
- arxiv url: http://arxiv.org/abs/2608.03729v2
- Date: Wed, 05 Aug 2026 14:18:51 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-06 14:48:43.294747
- Title: GPTKB 2.0: Direct Construction of Disambiguated Knowledge Bases from Large Language Models
- Title(参考訳): GPTKB 2.0:大規模言語モデルによる曖昧な知識ベースの構築
- Abstract要約: GPTKB 2.0は、大きな言語モデルから直接曖昧なKBを構築するための方法論である。
我々は、GPTKB 2.0を大規模に実行し、1M以上の曖昧なエンティティと38.4Mのトリプルを含む物質化KBを得る。
- 参考スコア(独自算出の注目度): 11.119171720690238
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Automated Knowledge Base Construction (AKBC) is a core NLP task, and recent work proposes generating knowledge bases directly from large language models (LLMs), treating the model itself as the knowledge source. However, LLMs natively possess no representation of entities, leading to duplicate entries as well as conflations. We propose GPTKB 2.0, a methodology for constructing disambiguated KBs directly from LLMs. GPTKB 2.0 incorporates on-the-fly disambiguation of entities, relations and classes, and is meticulously designed to satisfy both scalability and disambiguation accuracy. We analyze the central design decisions and characterize the trade-offs between accuracy, scale, and cost. We execute GPTKB 2.0 at scale, obtaining a materialized KB containing over 1M disambiguated entities and 38.4M triples. This represents the first million-scale LLM-native KB with explicit internal canonicalization of entities, relations, and classes, a significant departure from prior Wikimedia-centric works. GPTKB 2.0 is available at https://gptkb.org/.
- Abstract(参考訳): 自動知識ベース構築(AKBC)は中核的なNLPタスクであり、最近の研究は、大規模言語モデル(LLM)から直接知識ベースを生成し、モデル自体を知識源として扱うことを提案する。
しかし、LSMは本質的に実体の表現を持たないため、重複したエントリや融合をもたらす。
LLM から直接不明瞭な KB を構築する手法である GPTKB 2.0 を提案する。
GPTKB 2.0は、エンティティ、リレーション、クラスのオンザフライでの曖昧さを取り入れており、スケーラビリティと曖昧さの両立を念頭に設計されている。
中心となる設計決定を分析し、正確性、スケール、コストのトレードオフを特徴付ける。
我々は、GPTKB 2.0を大規模に実行し、1M以上の曖昧なエンティティと38.4Mのトリプルを含む物質化KBを得る。
これは、エンティティ、リレーション、クラスを明示した内部標準化を備えた最初の100万スケールのLLMネイティブKBであり、以前のウィキメディア中心の作品から大きく離れている。
GPTKB 2.0はhttps://gptkb.org/.comで入手できる。
関連論文リスト
- GPTKB 2.0: Browsing, Querying, and Auditing a Disambiguated LLM-Derived Knowledge Base [11.119171720690238]
本稿では,大規模言語モデル(LLM)から得られた大規模曖昧な知識ベース(KB)を探索するWebデモを紹介する。
GPTKB 2.0は、1.6Mの標準エンティティに38.4Mのトリプルと207.6Kの統合関係と66Kの統合クラスを含んでいる。
インターフェースはさらに、構造化されたSPARQLクエリ、SPARQLに翻訳された自然言語質問、ユーザが提供するテキストから標準GPTKB 2.0エントリへのエンティティリンクをサポートする。
論文 参考訳(メタデータ) (2026-08-07T09:10:30Z) - KG-CF: Knowledge Graph Completion with Context Filtering under the Guidance of Large Language Models [55.39134076436266]
KG-CFはランキングベースの知識グラフ補完タスクに適したフレームワークである。
KG-CFは、LLMの推論能力を活用して、無関係なコンテキストをフィルタリングし、現実世界のデータセットで優れた結果を得る。
論文 参考訳(メタデータ) (2025-01-06T01:52:15Z) - Bridge: A Unified Framework to Knowledge Graph Completion via Language Models and Knowledge Representation [14.801411392475439]
我々は、知識グラフ(KG)の構造と意味情報を共同で符号化するブリッジと呼ばれる新しいフレームワークを提案する。
具体的には、PLMのセマンティック知識をよりよく活用するために、PLMによって個別にエンティティと関係を戦略的に符号化する。
我々は、KGとPLMのギャップを埋めるために、BYOLと呼ばれる自己教師付き表現学習法を用いて、3重の異なる2つの視点でPLMを微調整する。
論文 参考訳(メタデータ) (2024-11-11T01:59:04Z) - Enabling LLM Knowledge Analysis via Extensive Materialization [15.276041443299905]
GPTKBは、GPT-4o-miniという290万以上のエンティティに対して101万トリプルの知識ベースである。
我々は、GPTKBを用いて、GPT-4o-miniの事実知識を、スケール、精度、バイアス、一貫性の観点から内部的に分析する。
論文 参考訳(メタデータ) (2024-11-07T17:57:03Z) - KBLaM: Knowledge Base augmented Language Model [8.247901935078357]
本稿では,Large Language Model (LLM) を外部知識で拡張するための知識ベース拡張言語モデル (KBLaM) を提案する。
KBLaMは文書のコーパスから構築された知識ベース(KB)で動作し、KB内の各知識を連続鍵値ベクトル対に変換する。
提案手法では,A10080GBの1つのGPU上で,8Kコンテキストウィンドウのみの8B事前学習LLMに,10Kトリプル以上の大容量KBを組み込むことが可能である。
論文 参考訳(メタデータ) (2024-10-14T12:45:10Z) - Bridging LLMs and KGs without Fine-Tuning: Intermediate Probing Meets Subgraph-Aware Entity Descriptions [49.36683223327633]
大規模言語モデル(LLM)は、幅広い世界の知識をカプセル化し、強力なコンテキストモデリング能力を示す。
実効的で効率的なKGCを実現するために,LLMの強みを頑健な知識表現と相乗化するための新しいフレームワークを提案する。
従来手法に比べて47%の相対的な改善を達成し,我々の知る限り,ファインチューニング LLM に匹敵する分類性能を初めて達成した。
論文 参考訳(メタデータ) (2024-08-13T10:15:55Z) - How Reliable are LLMs as Knowledge Bases? Re-thinking Facutality and Consistency [60.25969380388974]
大規模言語モデル (LLM) は知識ベース (KB) として研究されている。
現在の評価手法は、信頼性の高い性能の他の決定的な基準を見越して、知識の保持に過度に焦点を絞っている。
我々は,事実と一貫性を定量化するための新しい基準と指標を提案し,最終的な信頼性スコアを導いた。
論文 参考訳(メタデータ) (2024-07-18T15:20:18Z) - KG-Agent: An Efficient Autonomous Agent Framework for Complex Reasoning
over Knowledge Graph [134.8631016845467]
我々は、KG-Agentと呼ばれる自律LLMベースのエージェントフレームワークを提案する。
KG-Agentでは、LLM、多機能ツールボックス、KGベースのエグゼキュータ、知識メモリを統合する。
有効性を保証するため、プログラム言語を利用してKG上のマルチホップ推論プロセスを定式化する。
論文 参考訳(メタデータ) (2024-02-17T02:07:49Z) - LLM2KB: Constructing Knowledge Bases using instruction tuned context
aware Large Language Models [0.8702432681310401]
本稿では,大規模言語モデルを用いた知識ベース構築システム LLM2KB を提案する。
ISWC 2023で開かれたLM-KBCチャレンジでは,21関係の平均F1スコアが0.6185に達した。
論文 参考訳(メタデータ) (2023-08-25T07:04:16Z) - KoLA: Carefully Benchmarking World Knowledge of Large Language Models [87.96683299084788]
我々は知識指向LLMアセスメントベンチマーク(KoLA)を構築した。
人間の認知を模倣して、知識関連能力の4段階の分類を形成し、19ドルのタスクをカバーします。
私たちは、LLMによって事前訓練されたコーパスであるウィキペディアと、継続的に収集された新興コーパスを使用して、目に見えないデータや進化する知識を扱う能力を評価します。
論文 参考訳(メタデータ) (2023-06-15T17:20:46Z) - Information Association for Language Model Updating by Mitigating
LM-Logical Discrepancy [68.31760483418901]
大規模言語モデル(LLM)は、時代遅れの事前学習データのために現在の情報を提供するのに苦労する。
知識編集や連続的な微調整など,従来のLCMの更新方法は,新たな情報の一般化に重大な欠点がある。
これらの欠点の中核となる課題は,言語モデリングの確率と論理的確率の差を特徴とするLM論理的相違である。
論文 参考訳(メタデータ) (2023-05-29T19:48:37Z) - Improving Entity Disambiguation by Reasoning over a Knowledge Base [2.223733768286313]
本稿では,記号的知識ベースに基づく推論によってエンティティをリンクするEDモデルを提案する。
我々のモデルは、6つの確立されたEDデータセットの最先端のベースラインを平均1.3F1で上回ります。
論文 参考訳(メタデータ) (2022-07-08T19:13:53Z) - Reasoning Over Virtual Knowledge Bases With Open Predicate Relations [85.19305347984515]
Open Predicate Query Language (OPQL) を紹介します。
OPQLは、テキストから完全にトレーニングされた仮想知識ベース(VKB)を構築する方法である。
OPQLは2つの異なるKB推論タスクにおいて、以前のVKBメソッドよりも優れていることを示す。
論文 参考訳(メタデータ) (2021-02-14T01:29:54Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。