論文の概要: K-EXAONE Technical Report
- arxiv url: http://arxiv.org/abs/2601.01739v1
- Date: Mon, 05 Jan 2026 02:30:59 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-01-06 16:25:22.733679
- Title: K-EXAONE Technical Report
- Title(参考訳): K-EXAONE技術報告
- Abstract要約: K-EXAONEはLG AI Researchが開発した大規模多言語言語モデルである。
256Kのコンテキストウィンドウをサポートし、韓国語、英語、スペイン語、ドイツ語、日本語、ベトナム語をカバーしている。
我々はK-EXAONEを、推論、エージェント、一般、韓国語、多言語能力にまたがる総合的なベンチマークスイートで評価した。
- 参考スコア(独自算出の注目度): 76.23621600385238
- License: http://creativecommons.org/licenses/by-nc-nd/4.0/
- Abstract: This technical report presents K-EXAONE, a large-scale multilingual language model developed by LG AI Research. K-EXAONE is built on a Mixture-of-Experts architecture with 236B total parameters, activating 23B parameters during inference. It supports a 256K-token context window and covers six languages: Korean, English, Spanish, German, Japanese, and Vietnamese. We evaluate K-EXAONE on a comprehensive benchmark suite spanning reasoning, agentic, general, Korean, and multilingual abilities. Across these evaluations, K-EXAONE demonstrates performance comparable to open-weight models of similar size. K-EXAONE, designed to advance AI for a better life, is positioned as a powerful proprietary AI foundation model for a wide range of industrial and research applications.
- Abstract(参考訳): 本稿では,LG AI Research が開発した大規模多言語言語モデル K-EXAONE について述べる。
K-EXAONEは236Bの総パラメータを持つMixture-of-Expertsアーキテクチャ上に構築されており、推論中に23Bのパラメータを活性化する。
256Kのコンテキストウィンドウをサポートし、韓国語、英語、スペイン語、ドイツ語、日本語、ベトナム語をカバーしている。
我々はK-EXAONEを、推論、エージェント、一般、韓国語、多言語能力にまたがる総合的なベンチマークスイートで評価した。
これらの評価の中で、K-EXAONEは類似サイズのオープンウェイトモデルに匹敵する性能を示す。
K-EXAONEは、AIをより良くするために設計されたもので、幅広い産業・研究応用のための強力な独自AI基盤モデルとして位置づけられている。
関連論文リスト
- A.X K2 Technical Report [16.892621349469206]
我々は、強調アプリケーションのための高性能基盤として、スクラッチから訓練された言語モデルであるA.X K2を紹介する。
A.X K2はA.X K1を30ポイント以上改善している。
A.X K2は強力なオープンウェイトベースラインに対して競争力があり、数学や韓国語のベンチマークでそれらをマッチングまたは超える。
論文 参考訳(メタデータ) (2026-08-31T03:04:30Z) - K-EXAONE 2.0 Technical Report [59.84003637088418]
K-EXAONE 2.0はLG AI Researchが開発したオープンウェイトな多言語基盤モデルである。
Apache 2.0ライセンスでリリースされたK-EXAONE 2.0は、幅広いAIエコシステムを評価、デプロイ、適応、構築可能にする。
論文 参考訳(メタデータ) (2026-08-05T06:41:48Z) - A.X K1 Technical Report [24.287781467694227]
A.X K1はMixture-of-Experts (MoE)言語モデルである。
A.X K1は、約10Tトークンのコーパスで事前訓練され、多段データ処理パイプラインでキュレートされる。
A.X K1は、さまざまな現実世界のシナリオにまたがるスケーラブルなデプロイメントを容易にするために、明示的に制御可能な推論をサポートする。
論文 参考訳(メタデータ) (2026-01-14T06:11:17Z) - KyrgyzBERT: A Compact, Efficient Language Model for Kyrgyz NLP [0.0]
KyrgyzBERTは、KyrgyzのためのモノリンガルBERTベースの言語モデルである。
このモデルは35.9Mパラメータを持ち、言語の形態的構造のために設計されたカスタムトークンを使用する。
Kyrgyz-sst2は、Stanford Sentiment Treebankを翻訳し、手動で完全なテストセットを注釈付けすることで構築された感情分析ベンチマークである。
論文 参考訳(メタデータ) (2025-11-25T11:05:53Z) - KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models [36.90941464587649]
本稿では,韓国語指導フォロータスク評価(KITE)について紹介する。
事実知識や複数選択テストに重点を置いている既存の韓国のベンチマークとは異なり、KITEは多様なオープンエンド命令フォロータスクを直接ターゲットとしている。
論文 参考訳(メタデータ) (2025-10-17T11:45:15Z) - Kimi K2: Open Agentic Intelligence [118.78600121345099]
Kimi K2は32億の活性化パラメータと1兆の総パラメータを持つ大きな言語モデルである。
MuonClipに基づいて、K2は15.5兆のトークンで事前訓練され、損失のスパイクはゼロだった。
Kimi K2は、オープンソース非思考モデルの間で最先端のパフォーマンスを達成する。
論文 参考訳(メタデータ) (2025-07-28T05:35:43Z) - Seed-X: Building Strong Multilingual Translation LLM with 7B Parameters [53.59868121093848]
7Bパラメータサイズを持つオープンソースの言語モデル(LLM)のファミリーであるSeed-Xを紹介する。
ベースモデルは、28言語にわたるモノリンガルコンテンツとバイリンガルコンテンツの両方を含む、多種多様な高品質データセットで事前訓練されている。
その後、インストラクションモデルは、Chain-of-Thought(CoT)推論によって翻訳され、強化学習(RL)によりさらに強化され、多様な言語対をまたいだより良い一般化が達成される。
論文 参考訳(メタデータ) (2025-07-18T03:19:43Z) - HyperCLOVA X THINK Technical Report [0.0]
HyperCLOVA X THINKはHyperCLOVA Xファミリの最初の推論中心の大規模言語モデルである。
韓国の約6兆ドル(約660兆円)の高品質な韓国のトークンと、ターゲットとする韓国の合成データで強化された英語のトークンを事前訓練した。
韓国のベンチマークでも同様の大きさのモデルに対して、競争力のあるパフォーマンスを提供する。
論文 参考訳(メタデータ) (2025-06-27T17:23:12Z) - Aya Expanse: Combining Research Breakthroughs for a New Multilingual Frontier [72.5652085347547]
8Bおよび32Bパラメータ多言語モデルの新世代であるAya Expanseモデルファミリを導入する。
Cohere For AIとCohereでの数年間の研究を活用することで、Aya Expanseは多言語パフォーマンスにおける新たな最先端技術を確立している。
Aya Expanse 8B と 32B が主要なオープンウェイトモデルより優れていることを示すために,23言語に翻訳された Arena-Hard-Auto データセットの評価を行った。
論文 参考訳(メタデータ) (2024-12-05T15:41:06Z) - EXAONE 3.0 7.8B Instruction Tuned Language Model [41.95996640625627]
EXAONE 3.0命令調整言語モデルは、Large Language Models (LLMs) の最初のオープンモデルである。
EXAONE 3.0は、同じ大きさの他の最先端のオープンモデルに対して、命令追従機能を備えた非常に競争力のある実世界のパフォーマンスを示す。
比較分析の結果,EXAONE 3.0は韓国では特に優れており,一般的なタスクや複雑な推論において魅力的な性能を実現していることがわかった。
論文 参考訳(メタデータ) (2024-08-07T04:38:38Z) - HyperCLOVA X Technical Report [119.94633129762133]
韓国語と文化に合わせた大型言語モデル(LLM)のファミリーであるHyperCLOVA Xを紹介する。
HyperCLOVA Xは韓国語、英語、コードデータのバランスの取れた混合でトレーニングされ、その後、高品質な人間アノテーション付きデータセットによる命令チューニングが行われた。
このモデルは、韓国語と英語の両方で、包括的な推論、知識、常識、事実性、コーディング、数学、チャット、指示追従、無害など、様々なベンチマークで評価されている。
論文 参考訳(メタデータ) (2024-04-02T13:48:49Z) - Memory-efficient NLLB-200: Language-specific Expert Pruning of a
Massively Multilingual Machine Translation Model [92.91310997807936]
NLLB-200は202言語をカバーする多言語ニューラルネットワークモデルである。
そこで本研究では,最大80%のエキスパートの除去を,それ以上の微調整を行なわずに行うことができるプルーニング法を提案する。
論文 参考訳(メタデータ) (2022-12-19T19:29:40Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。