論文の概要: Analysis of the first Genetic Engineering Attribution Challenge
- arxiv url: http://arxiv.org/abs/2110.11242v1
- Date: Thu, 14 Oct 2021 23:21:06 GMT
- ステータス: 翻訳完了
- システム内更新日: 2023-03-11 12:02:06.467583
- Title: Analysis of the first Genetic Engineering Attribution Challenge
- Title(参考訳): 最初の遺伝子工学的帰属問題の解析
- Abstract要約: 第1回遺伝子工学属性チャレンジの結果を報告する。
トップスコーリングチームは、エンジニアシーケンスの真のラボ・オブ・オリジンを特定することで、従来のモデルよりも劇的にパフォーマンスを向上しました。
あるチームは、非常に高速なニューラルネットワークのないアプローチで非常に高い精度を達成した。
- 参考スコア(独自算出の注目度): 0.11018458069795269
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: The ability to identify the designer of engineered biological sequences --
termed genetic engineering attribution (GEA) -- would help ensure due credit
for biotechnological innovation, while holding designers accountable to the
communities they affect. Here, we present the results of the first Genetic
Engineering Attribution Challenge, a public data-science competition to advance
GEA. Top-scoring teams dramatically outperformed previous models at identifying
the true lab-of-origin of engineered sequences, including an increase in top-1
and top-10 accuracy of 10 percentage points. A simple ensemble of prizewinning
models further increased performance. New metrics, designed to assess a model's
ability to confidently exclude candidate labs, also showed major improvements,
especially for the ensemble. Most winning teams adopted CNN-based
machine-learning approaches; however, one team achieved very high accuracy with
an extremely fast neural-network-free approach. Future work, including future
competitions, should further explore a wide diversity of approaches for
bringing GEA technology into practical use.
- Abstract(参考訳): 遺伝子工学アトリビューション(gea:genetic engineering attribution, 遺伝子工学アトリビューション)と呼ばれる、遺伝子配列の設計者を特定する能力は、生物工学の革新に対する正当な信用を確保するのに役立つ。
本稿では,geaを推進するための公共データサイエンスコンペティションである第1回遺伝子工学アトリビューションチャレンジの結果を紹介する。
トップスケーリングチームは、10パーセンテージのtop-1とtop-10の精度向上を含む、エンジニアリングされたシーケンスの真のラボ・オブ・オリジンを識別する前のモデルを大きく上回った。
入賞モデルの単純なアンサンブルはさらに性能を高めた。
モデルが確実に実験室を除外できる能力を評価するために設計された新しい指標も、特にアンサンブルのために大きく改善された。
ほとんどの勝利チームはcnnベースの機械学習アプローチを採用したが、あるチームは非常に高速なニューラルネットワークフリーアプローチで非常に高い精度を達成した。
将来のコンペを含む今後の取り組みは、gea技術を実用化するための幅広いアプローチをさらに探究するべきである。
関連論文リスト
- HiPerRAG: High-Performance Retrieval Augmented Generation for Scientific Insights [72.82973609312178]
HiPerRAGは360万以上の科学論文から知識をインデクシングし取り出すワークフローである。
コアとなるのはマルチモーダル文書解析のための高スループットモデルであるOreoと、クエリ対応エンコーダの微調整アルゴリズムであるColTrastだ。
HiPerRAGは、既存の科学的質問応答ベンチマークと、この研究で導入された2つの新しいベンチマークで堅牢なパフォーマンスを提供する。
論文 参考訳(メタデータ) (2025-05-07T22:50:23Z) - GLiNER-BioMed: A Suite of Efficient Models for Open Biomedical Named Entity Recognition [0.06554326244334868]
GLiNER-BioMedは、バイオメディシンに特化したジェネラリストモデルと軽量モデル(GLiNER)のドメイン適応スイートである。
従来の手法とは対照的に、GLiNERは任意のエンティティ型を推論するために自然言語ラベルを使用するため、ゼロショット認識が可能である。
いくつかのバイオメディカルデータセットの実験では、GLiNER-BioMedは両方のゼロショットシナリオで最先端を達成している。
論文 参考訳(メタデータ) (2025-04-01T11:40:50Z) - GENERator: A Long-Context Generative Genomic Foundation Model [66.46537421135996]
本稿では,98k塩基対 (bp) と1.2Bパラメータからなるゲノム基盤モデル GENERator を提案する。
DNAの386Bbpからなる拡張データセットに基づいて、GENERatorは、確立されたベンチマークと新しく提案されたベンチマークの両方で最先端のパフォーマンスを実証する。
また、特に特定のアクティビティプロファイルを持つエンハンサーシーケンスを即応的に生成することで、シーケンス最適化において大きな可能性を秘めている。
論文 参考訳(メタデータ) (2025-02-11T05:39:49Z) - Learning Evolution via Optimization Knowledge Adaptation [50.280704114978384]
進化的アルゴリズム(EA)は、複雑なタスクの解を見つけるために、進化的演算子を通して集団を維持する。
最適化知識適応進化モデル(okaEM)を導入し,最適化能力を向上する。
okaEMは、様々な知識伝達設定におけるパフォーマンス向上のために、事前知識を活用する。
自然選択と遺伝子組換えの原理をエミュレートすることができる。
論文 参考訳(メタデータ) (2025-01-04T05:35:21Z) - Knowledge-Guided Biomarker Identification for Label-Free Single-Cell RNA-Seq Data: A Reinforcement Learning Perspective [24.247247851943982]
本稿では、既存の遺伝子選択アルゴリズムからのアンサンブル知識を利用して、予備的境界や事前知識を確立する反復的な遺伝子パネル選択戦略を提案する。
我々は、専門家の行動によって形成される報酬関数を通じて強化学習を取り入れ、動的洗練と遺伝子パネルの標的選択を可能にした。
本研究は, 単細胞ゲノムデータ解析における本手法の可能性を明らかにするものである。
論文 参考訳(メタデータ) (2025-01-02T07:57:41Z) - Generative AI in Health Economics and Outcomes Research: A Taxonomy of Key Definitions and Emerging Applications, an ISPOR Working Group Report [12.204470166456561]
ジェネレーティブAIは、健康経済学と成果研究(HEOR)において大きな可能性を秘めている
生成AIは、HEORに大きな可能性を示し、効率性、生産性を高め、複雑な課題に対する新しいソリューションを提供する。
ファウンデーションモデルは複雑なタスクを自動化する上で有望だが、科学的信頼性、バイアス、解釈可能性、ワークフローの統合には課題が残っている。
論文 参考訳(メタデータ) (2024-10-26T15:42:50Z) - EEGPT: Unleashing the Potential of EEG Generalist Foundation Model by Autoregressive Pre-training [9.57946371147345]
EEGPTはこれらの課題に対処するために設計された最初の一般のEEG基盤モデルである。
まず,各電極を基本単位として扱う電極ワイド・モデリング手法を提案する。
第2に、最初の自己回帰型脳波事前学習モデルを開発する。
第3に,学習可能な電極グラフネットワークを用いたマルチタスク転送学習パラダイムを提案する。
論文 参考訳(メタデータ) (2024-10-14T12:17:54Z) - Horizon-wise Learning Paradigm Promotes Gene Splicing Identification [6.225959701339916]
本稿では,Horizon-wise Gene Splicing Identification (H-GSI) という遺伝子スプライシング識別作業のための新しいフレームワークを提案する。
提案するH-GSIは,文字列データをテンソルに変換する前処理手順,長いシーケンスを扱うスライディングウインドウ手法,SeqLabモデル,予測器の4つのコンポーネントから構成される。
切断された固定長配列で遺伝子情報を処理している既存の研究とは対照的に、H-GSIは1つの前方計算でシーケンス内の全ての位置を予測する水平方向同定パラダイムを採用している。
論文 参考訳(メタデータ) (2024-06-15T08:18:09Z) - Predicting Genetic Mutation from Whole Slide Images via Biomedical-Linguistic Knowledge Enhanced Multi-label Classification [119.13058298388101]
遺伝子変異予測性能を向上させるため,生物知識を付加したPathGenomic Multi-label Transformerを開発した。
BPGTはまず、2つの慎重に設計されたモジュールによって遺伝子前駆体を構成する新しい遺伝子エンコーダを確立する。
BPGTはその後ラベルデコーダを設計し、最終的に2つの調整されたモジュールによる遺伝的突然変異予測を行う。
論文 参考訳(メタデータ) (2024-06-05T06:42:27Z) - BioDiscoveryAgent: An AI Agent for Designing Genetic Perturbation Experiments [112.25067497985447]
そこで,BioDiscoveryAgentを紹介した。このエージェントは,新しい実験を設計し,その結果の理由を明らかにし,仮説空間を効率的にナビゲートし,望ましい解に到達させる。
BioDiscoveryAgentは、機械学習モデルをトレーニングすることなく、新しい実験を独自に設計することができる。
6つのデータセットで関連する遺伝的摂動を予測することで、平均21%の改善が達成されている。
論文 参考訳(メタデータ) (2024-05-27T19:57:17Z) - Histo-Genomic Knowledge Distillation For Cancer Prognosis From Histopathology Whole Slide Images [7.5123289730388825]
ゲノムインフォームドハイパーアテンションネットワーク(G-HANet)は、トレーニング中にヒストリーゲノム知識を効果的に蒸留することができる。
ネットワークは、クロスモーダル・アソシエーション・ブランチ(CAB)とハイパーアテンション・サバイバル・ブランチ(HSB)から構成される。
論文 参考訳(メタデータ) (2024-03-15T06:20:09Z) - Improving Biomedical Entity Linking with Retrieval-enhanced Learning [53.24726622142558]
$k$NN-BioELは、トレーニングコーパス全体から同様のインスタンスを予測のヒントとして参照する機能を備えたBioELモデルを提供する。
k$NN-BioELは、いくつかのデータセットで最先端のベースラインを上回ります。
論文 参考訳(メタデータ) (2023-12-15T14:04:23Z) - ProBio: A Protocol-guided Multimodal Dataset for Molecular Biology Lab [67.24684071577211]
研究結果を複製するという課題は、分子生物学の分野に重大な障害をもたらしている。
まず、この目的に向けた最初のステップとして、ProBioという名前の包括的なマルチモーダルデータセットをキュレートする。
次に、透明なソリューショントラッキングとマルチモーダルなアクション認識という2つの挑戦的なベンチマークを考案し、BioLab設定におけるアクティビティ理解に関連する特徴と難しさを強調した。
論文 参考訳(メタデータ) (2023-11-01T14:44:01Z) - BiomedGPT: A Generalist Vision-Language Foundation Model for Diverse Biomedical Tasks [68.39821375903591]
汎用AIは、さまざまなデータ型を解釈する汎用性のために、制限に対処する可能性を秘めている。
本稿では,最初のオープンソースかつ軽量な視覚言語基盤モデルであるBiomedGPTを提案する。
論文 参考訳(メタデータ) (2023-05-26T17:14:43Z) - Deep metric learning improves lab of origin prediction of genetically
engineered plasmids [63.05016513788047]
遺伝工学の属性(GEA)は、配列-ラブの関連を作る能力である。
本稿では,計量学習に基づいて,最も可能性の高い実験室をランク付けする手法を提案する。
我々は、特定の実験室のプラスミド配列のキーシグネチャを抽出することができ、モデル出力の解釈可能な検査を可能にする。
論文 参考訳(メタデータ) (2021-11-24T16:29:03Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。