論文の概要: A Registry-Bound LLM Pipeline for Evidence-Grounded Trait Extraction across Tropical Plants, Aquatic Species, and Exotic Pets
- arxiv url: http://arxiv.org/abs/2606.00994v1
- Date: Sun, 31 May 2026 04:17:47 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-02 21:34:29.017882
- Title: A Registry-Bound LLM Pipeline for Evidence-Grounded Trait Extraction across Tropical Plants, Aquatic Species, and Exotic Pets
- Title(参考訳): 熱帯植物、水生植物、および外来ペットのエビデンス・グラウンドトルート抽出のための登録境界LPMパイプライン
- Abstract要約: 養殖熱帯植物,水生植物およびペット種について,大規模に構造的形質記録を作成した登録パイプラインについて述べる。
パイプラインは706,220回実行され、409,820種(99.985%)で5,489,881回の形質記録を維持、81.57%を高い信頼性で達成した。
- 参考スコア(独自算出の注目度): 0.66124666332321
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We describe a registry-bound large-language-model extraction pipeline producing evidence-grounded structured trait records at scale, on cultivated tropical plant, aquatic, and pet species. Four mechanisms render LLM-derived rows auditable: a versioned 39-key closed-vocabulary trait registry constraining every admitted value to a typed schema; a per-row verbatim evidence quote tying each value to source text; a per-row confidence label (high or medium; low dropped pre-persist); and multi-version preservation. Applied to 409,880 publishable species from the Tropical Species Encyclopedia, the pipeline executed 706,220 runs and persisted 5,489,881 trait records across 409,820 species (99.985%), 81.57% at high confidence. We report three validation layers in descending evidentiary strength: at full population, 90.12% of 5,427,588 evidence-bearing rows have their quote as a verbatim source substring (93.49% excluding one compliance meta-trait); a quote-supports-value audit on n=100 stratified non-red-zone rows yielded 100/100 (lower bound 96.30%); face-validity on n=50 red-zone rows yielded 50/50 Accept (lower bound 92.86%). Per-record correctness is not claimed; 100% pending human curation. The contribution is the four-mechanism framework.
- Abstract(参考訳): 本報告では, 熱帯植物, 水生植物, ペット種について, 大規模に構造的特性を示す証拠を蓄積した大言語モデル抽出パイプラインについて述べる。
LLM由来の行を監査可能な4つのメカニズム: バージョン管理された39キーのクローズドボキャブラリ特性レジストリが、型付きスキーマにすべての値を制限する。
熱帯種百科事典の409,880種に適用され、パイプラインは706,220回実行され、409,820種 (99.985%) にわたって5,489,881回の形質記録を維持、81.57%を高い信頼性で維持した。
本報告では,全人口の90.12%,5,427,588行のエビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・アビデンス・ア・アビデンス・アビデントメント・アストリング (93.49%) と評価された。
記録毎の正当性は主張されていない。
貢献は4つのメカニズムのフレームワークです。
関連論文リスト
- VeriPhy: Agentic Physical Reasoning for World Model Evaluation and Refinement [57.86962208273888]
テキストのみのプランナが入力された物理義務にプロンプトをコンパイルする監査可能な物理検証システムを提案する。
それぞれのアクションは、ペイロードがタイプされた測定か、明示的にタグ付けされた学習状態である証明付きエビデンスレコードを返す。
我々は, 実発生障害を即時参照, 空間, 時間でローカライズする, 1500クリックの欠陥記録のコーパスにおいて, 評価をアンロックする。
論文 参考訳(メタデータ) (2026-09-02T20:36:45Z) - From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts [4.093009863847175]
セキュリティ研究成果物は、エージェント駆動の脆弱性によってますます生成される。
公衆に入手可能で、飛行可能で、飛行可能で、飛行可能で、飛行確認済みの人工物とのギャップは、十分に測定されていない。
我々はこの文献について事前登録されたコンセンサス監査を行う。
論文 参考訳(メタデータ) (2026-08-10T13:05:02Z) - Metadata Reconstruction from Values Alone: Recovering Column Semantics in Undocumented Warehouses [0.0]
Rosettaはデータ自体から列と値の意味を検索する。
盲目のi2b2臨床倉庫では、ロゼッタは値だけで134の実際のICD-9符号の95.5%をデコードしている。
論文 参考訳(メタデータ) (2026-08-08T06:12:18Z) - Leak It: A Probabilistic Approach to Training-Data Extraction from Black-Box Language Models [0.0]
確率レンズによるブラックボックス,サンプリングベーストレーニングデータ漏洩について検討した。
我々はブラインドベースライン批判をサンプリング体制に拡張する。
ブラックボックス抽出監査ツールである leakit をリリースしています。
論文 参考訳(メタデータ) (2026-07-31T15:44:43Z) - Fantastic Adaptive Taxonomies and How to Use Them [100.20614173157708]
AdaMASTは、実行トレースをコンパクトでエビデンスに基づく障害分類に変換する。
コードには手書きのコードはなく、人間による注釈もない。
エージェント・システム・サーチでは、失敗候補の分類コード診断が自由形式より優れている。
論文 参考訳(メタデータ) (2026-07-17T17:41:16Z) - Verifier-Guided Twelve-Tone Composition: A Generate-Verify-Repair Harness for Symbolic Music Generation [37.048771679940984]
本稿では,言語モデルの提案を表現的検証を伴う生成-検証-再生-トレースループでラップするニューロシンボリックハーネスを提案する。
完全なパイプラインは、全体の合法性を主張することなく、イベントローカルの一貫性を改善する。
論文 参考訳(メタデータ) (2026-07-13T09:52:09Z) - ITPEval: Benchmarking Formal Translation Across Interactive Theorem Provers [77.95933562142014]
ITPEvalは、4つの主要なIPP間で自動形式証明翻訳を評価するための最初のベンチマークである。
itpevalは、状態が分離されたウォームバックエンドを備えた、統合されたマルチITP認証インフラストラクチャです。
論文 参考訳(メタデータ) (2026-07-07T22:05:55Z) - A cross-domain tropical species dataset with Chinese vernacular names and CITES source links [0.66124666332321]
本報告では,410,499種の活動性熱帯種のバージョン別クロスドメインデータセットについて述べる。
このデータセットは、GBIF, Plants of the World Online, iNaturalist, NCBIの分類学の分類学識別子と結合する。
未検証のマシン生成提案を除外するタイプロジーの下で、名前ごとの明示的な証明を持つ中国の頂点層。
論文 参考訳(メタデータ) (2026-06-02T05:08:12Z) - ScientistOne: Towards Human-Level Autonomous Research via Chain-of-Evidence [57.37494162084001]
チェーン・オブ・エビデンス(Chain-of-Evidence, CoE)は、すべてのクレームがエビデンス・ソースにトレース可能であることを要求する検証可能なフレームワークである。
CoE Auditはポストホック監査であり、スコア検証、仕様違反、参照検証、メソッドコードアライメントという4つの整合性チェックが全システムに均一に適用される。
論文 参考訳(メタデータ) (2026-05-25T21:30:27Z) - Claim-Selective Certification for High-Risk Medical Retrieval-Augmented Generation [0.0]
混在した証拠は、ある主張を支持し、別の主張の条件を必要とし、第三の主張に矛盾する可能性がある。
我々は、クレーム選択応答を検証可能なクレームに検証し、回収された証拠に対して評価し、インテントを意識したセレクタによって完全な、部分的、紛争、棄却にマッピングする。
結果として生じるインターフェースは、アクションラベル予測と、混在する証拠の下でのエビデンスリンクされたクレーム選択を分離する。
論文 参考訳(メタデータ) (2026-05-21T03:29:50Z) - Hallucination as Exploit: Evidence-Carrying Multimodal Agents [10.441697487723568]
マルチモーダルエージェントはますます、スクリーンショットやドキュメント、Webページからツールコールを選択している。
本稿では,自由形式モデルテキストを不許容な証拠として扱うエビデンス搬送型マルチモーダルエージェント(ECA)を提案する。
ECAは不透明なモデルの信念を検証者、スキーマ、実装レベルで監査可能な残留物に変換する。
論文 参考訳(メタデータ) (2026-05-18T23:40:43Z) - How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings [56.70440596502351]
昨年は20以上のオープンドキュメントパースモデルが見られたが、ベンチマークはほぼOmniDocBenchにのみ依存している。
HTML/CSSのドキュメントイメージをレンダリングするベンチマークであるPureDocBenchは、10のドメイン、66ページ、1,475ページをカバーしています。
論文 参考訳(メタデータ) (2026-05-08T09:30:31Z) - Perturbation Dose Responses in Recursive LLM Loops: Raw Switching, Stochastic Floors, and Persistent Escape under Append, Replace, and Dialog Updates [0.0]
我々は、他のどこかで落ち着いたループを動かすのに、注入されたテキストがどれだけ必要か、そしてそれが継続するかどうかを調査する。
12,000文字の尾クリップの下では、目的地とコヒーレントな持続性台地が16%近く、ソースとバスンの脱出は36%近くで400。
4段階のファルシフィケーション・バッテリは、高線量のデスティネーションコヒーレントディップを有限水平、エンドポイント定義感度の特徴として再キャストする。
論文 参考訳(メタデータ) (2026-05-04T05:16:43Z) - CoVerRL: Breaking the Consensus Trap in Label-Free Reasoning via Generator-Verifier Co-Evolution [52.691495954442985]
CoVerRLは1つのモデルがジェネレータと検証ロールを交換するフレームワークで、各機能が他方をブートストラップする。
Qwen と Llama のモデルファミリーでの実験では、CoVerRL は数理推論のベンチマークで4.7-5.9% でラベルなしのベースラインを上回っている。
自己検証の精度は55%から85%以上改善され、両方の能力が真に共存することを確認した。
論文 参考訳(メタデータ) (2026-03-18T14:38:55Z) - Data Provenance Auditing of Fine-Tuned Large Language Models with a Text-Preserving Technique [36.96848724920411]
我々は、見えないUnicode文字を文書に埋め込むテキスト保存型透かしフレームワークを導入する。
我々は50の文書を微調整した後の応答を検出する際に0.1%未満の失敗率を実験的に観察した。
100%TPR@0% FPRに対応する18,000以上の課題において、突発的な回答は得られなかった。
論文 参考訳(メタデータ) (2025-10-07T08:34:08Z) - Causal Understanding by LLMs: The Role of Uncertainty [43.87879175532034]
近年の論文では、LLMは因果関係分類においてほぼランダムな精度を達成している。
因果的事例への事前曝露が因果的理解を改善するか否かを検討する。
論文 参考訳(メタデータ) (2025-09-24T13:06:35Z) - Contrastive Learning to Improve Retrieval for Real-world Fact Checking [84.57583869042791]
ファクト・チェッキング・リランカ(Contrastive Fact-Checking Reranker, CFR)を提案する。
我々はAVeriTeCデータセットを活用し、証拠文書からの人間による回答とクレームのサブクエストを注釈付けする。
データセットの精度は6%向上した。
論文 参考訳(メタデータ) (2024-10-07T00:09:50Z) - Lazy Layers to Make Fine-Tuned Diffusion Models More Traceable [70.77600345240867]
新たな任意の任意配置(AIAO)戦略は、微調整による除去に耐性を持たせる。
拡散モデルの入力/出力空間のバックドアを設計する既存の手法とは異なり,本手法では,サンプルサブパスの特徴空間にバックドアを埋め込む方法を提案する。
MS-COCO,AFHQ,LSUN,CUB-200,DreamBoothの各データセットに関する実証研究により,AIAOの堅牢性が確認された。
論文 参考訳(メタデータ) (2024-05-01T12:03:39Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。