論文の概要: EVE: A Domain-Specific LLM Framework for Earth Intelligence
- arxiv url: http://arxiv.org/abs/2604.13071v1
- Date: Fri, 20 Mar 2026 13:35:05 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-19 19:09:11.657811
- Title: EVE: A Domain-Specific LLM Framework for Earth Intelligence
- Title(参考訳): EVE:地球情報のためのドメイン特化LLMフレームワーク
- Authors: Àlex R. Atrio, Antonio Lopez, Jino Rohit, Yassine El Ouahidi, Marcello Politi, Vijayasri Iyer, Umar Jamil, Sébastien Bratières, Nicolas Longépé,
- Abstract要約: 我々は,アース・バーチャル・エキスパート(EVE)を紹介した。これは,アース・インテリジェンスのためのドメイン特化LSMを開発するための,オープンソースのエンドツーエンドイニシアティブである。
EVE-InstructはMistral Small 3.2上に構築され、推論と質問応答に最適化されたドメイン適応24Bモデルである。
- 参考スコア(独自算出の注目度): 2.902986183752367
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We introduce Earth Virtual Expert (EVE), the first open-source, end-to-end initiative for developing and deploying domain-specialized LLMs for Earth Intelligence. At its core is EVE-Instruct, a domain-adapted 24B model built on Mistral Small 3.2 and optimized for reasoning and question answering. On newly constructed Earth Observation and Earth Sciences benchmarks, it outperforms comparable models while preserving general capabilities. We release curated training corpora and the first systematic domain-specific evaluation benchmarks, covering MCQA, open-ended QA, and factuality. EVE further integrates RAG and a hallucination-detection pipeline into a production system deployed via API and GUI, supporting 350 pilot users so far. All models, datasets, and code are ready to be released under open licenses as contributions to our field at huggingface.co/eve-esa and github.com/eve-esa.
- Abstract(参考訳): 我々は,Earth Virtual Expert (EVE)を紹介した。EVEは,アースインテリジェンスのためのドメイン特化LSMの開発と展開のための,オープンソースのエンドツーエンドイニシアティブである。
EVE-InstructはMistral Small 3.2上に構築され、推論と質問応答に最適化されたドメイン適応24Bモデルである。
新たに構築された地球観測と地球科学のベンチマークでは、一般的な能力を保ちながら、同等のモデルより優れている。
本研究は,MCQA,オープンエンドQA,ファクトリティを対象とする,キュレートトレーニングコーパスと,最初の体系的ドメイン固有評価ベンチマークをリリースする。
EVEはさらにRAGと幻覚検出パイプラインをAPIとGUI経由でデプロイされた運用システムに統合し、350人のパイロットユーザをサポートする。
すべてのモデル、データセット、コードをオープンライセンスでリリースする準備が整い、Huggingface.co/eve-esaとgithub.com/eve-esaのフィールドへのコントリビューションとして提供されます。
関連論文リスト
- GISclaw: An Open-Source LLM-Powered Agent System for Full-Stack Geospatial Analysis [1.1417805445492082]
GISclawは、LLM推論コアと永続的なPythonサンドボックスを統合する、オープンソースのエージェントシステムである。
GISclawは、Single Agent ReActとDual Agent Plan-Replanパイプラインという、2つのプラグイン可能なエージェントアーキテクチャを実装している。
システムは50タスクGeoAnalystBenchベンチマークで最大96%のタスク成功を達成する。
論文 参考訳(メタデータ) (2026-03-27T09:46:59Z) - Helios: A Foundational Language Model for Smart Energy Knowledge Reasoning and Application [7.294864378911716]
Heliosは、スマートエネルギードメインに適した、大きな言語モデルである。
Enersysは、エンドツーエンドのデータセット構築のためのマルチエージェント協調フレームワークである。
スマートエネルギーシナリオでLLMを評価するためのベンチマークであるEnerBenchをリリースする。
論文 参考訳(メタデータ) (2025-12-22T11:43:35Z) - GEO-Bench-2: From Performance to Capability, Rethinking Evaluation in Geospatial AI [52.13138825802668]
GeoFMは地球観測を変革しているが、評価には標準化されたプロトコルが欠けている。
GEO-Bench-2は、分類、セグメンテーション、回帰、オブジェクト検出、インスタンスセグメンテーションにまたがる包括的なフレームワークでこの問題に対処する。
GEO-Bench-2のコード、データ、およびリーダーボードは、パーミッシブライセンスの下で公開されている。
論文 参考訳(メタデータ) (2025-11-19T17:45:02Z) - ALAS: Autonomous Learning Agent for Self-Updating Language Models [0.0]
大規模言語モデル(LLM)は、しばしば知識の切れ目があり、新しい情報に対する正確性を制限する。
我々は、LLMの知識を最小限の介入で継続的に更新するモジュールパイプラインであるALASを紹介する。
ALASは、ターゲットドメインの学習カリキュラムを自律的に生成し、Webから最新の情報を(引用とともに)検索し、質問応答訓練データに蒸留し、教師付き微調整によりモデルを微調整する。
我々は,ALASが知識更新クエリに対して90%の精度でエンジニアリングオーバーヘッドを最小限に抑えることを示す。
論文 参考訳(メタデータ) (2025-08-14T06:55:51Z) - TerraTorch: The Geospatial Foundation Models Toolkit [1.0673387795964326]
TerraTorchは、PyTorch Lightning上に構築されたGeospatial Foundation Models用の微調整およびベンチマークツールキットである。
ドメイン固有のデータモジュール、事前に定義されたタスク、およびさまざまなデコーダヘッドとバックボーンをペアにするモジュールモデルファクトリを統合する。
論文 参考訳(メタデータ) (2025-03-26T13:59:29Z) - Large Action Models: From Inception to Implementation [51.81485642442344]
大規模アクションモデル(LAM)は動的環境内でのアクション生成と実行のために設計されている。
LAMは、AIを受動的言語理解からアクティブなタスク完了に変換する可能性を秘めている。
創発から展開まで,LAMを体系的に開発するための総合的なフレームワークを提案する。
論文 参考訳(メタデータ) (2024-12-13T11:19:56Z) - Towards a Classification of Open-Source ML Models and Datasets for Software Engineering [52.257764273141184]
オープンソースの事前訓練モデル(PTM)とデータセットは、さまざまな機械学習(ML)タスクに広範なリソースを提供する。
これらのリソースには、ソフトウェア工学(SE)のニーズに合わせた分類がない。
我々は、人気のあるオープンソースのMLリポジトリであるHugging Face (HF)上で、SE指向の分類をPTMとデータセットに適用し、時間とともにPTMの進化を分析する。
論文 参考訳(メタデータ) (2024-11-14T18:52:05Z) - Enhancing Open-Domain Task-Solving Capability of LLMs via Autonomous Tool Integration from GitHub [79.31134731122462]
オープンドメインのタスク解決能力を評価するためにOpenActベンチマークを導入します。
我々は,オープンドメインの進化するクエリに,GitHubから専門ツールを自律的に統合することで対処できる,新しいLLMベースのエージェントシステムであるOpenAgentを紹介する。
論文 参考訳(メタデータ) (2023-12-28T15:47:30Z) - Walking Your LiDOG: A Journey Through Multiple Domains for LiDAR
Semantic Segmentation [16.857861952638498]
We study domain generalization for LiDAR semantic segmentation (DG-LSS)。
その結果,メソッド間の大きなギャップが確認され,ドメイン間設定で評価された。
そこで本研究では,DG-LSSに特化して設計された最初の手法を提案する。
論文 参考訳(メタデータ) (2023-04-23T17:43:29Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。