Curriculum Direct Preference Optimization for Diffusion and Consistency Models [110.1] テキスト・ツー・イメージ・ジェネレーションのためのカリキュラム学習に基づくDPOの新しい拡張版を提案する。
我々のアプローチであるCurriculum DPOは、9つのベンチマークにおける最先端の微調整アプローチと比較される。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 11:26:34 GMT)
A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems [93.8] 推論(Reasoning)は、論理的推論、問題解決、意思決定を可能にする基本的な認知プロセスである。
大規模言語モデル(LLM)の急速な進歩により、推論は高度なAIシステムを区別する重要な能力として浮上した。
我々は,(1)推論が達成される段階を定義するレジーム,(2)推論プロセスに関与するコンポーネントを決定するアーキテクチャの2つの側面に沿って既存の手法を分類する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 01:27:49 GMT)
Quantum Rabi oscillations in the semiclassical limit: backreaction on the cavity field and entanglement [90.0] 強い原子-磁場結合では、$pi $pulseの持続時間が100omega -1$以下である場合、原子励起確率の挙動は教科書から大きく逸脱する。
この研究の残りの部分では、空洞上の量子ビットのバックリアクションと結果として生じる原子-磁場の絡み合いを数値的に研究する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 23:24:59 GMT)
VisuoThink: Empowering LVLM Reasoning with Multimodal Tree Search [89.4] VisuoThinkは、視覚空間と言語ドメインをシームレスに統合する新しいフレームワークである。
プログレッシブなビジュアルテキスト推論を可能にし、ルックアヘッドツリーサーチによるテストタイムスケーリングを組み込む。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 08:37:30 GMT)
LLMs Can Generate a Better Answer by Aggregating Their Own Responses [83.7] 大きな言語モデル(LLM)はタスク間で顕著な機能を示しているが、複雑な問題に直面している場合、追加のプロンプト技術を必要とすることが多い。
この制限は、共通LLMポストトレーニング手順が差別的判断タスクの明示的な監督を欠いているという事実に起因している、と我々は主張する。
本稿では,モデルの識別機能を必要とせず,解答品質を向上させる手法である生成自己集合(GSA)を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:53:51 GMT)
MaPa: Text-driven Photorealistic Material Painting for 3D Shapes [79.1] 本稿では,テキスト記述から3次元メッシュの材料を作成することを目的とする。
テクスチャマップを合成する既存の方法とは異なり、我々はセグメントワイドな手続き的な材料グラフを生成することを提案する。
我々のフレームワークは高品質なレンダリングをサポートし、編集にかなりの柔軟性を提供します。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:58:01 GMT)
QUDsim: Quantifying Discourse Similarities in LLM-Generated Text [70.2] 本稿では,会話の進行過程の違いの定量化を支援するために,言語理論に基づくQUDと質問意味論を紹介する。
このフレームワークを使って$textbfQUDsim$を作ります。
QUDsimを用いて、コンテンツが異なる場合であっても、LLMはサンプル間で(人間よりも)談話構造を再利用することが多い。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 23:46:09 GMT)
End-to-end Open-vocabulary Video Visual Relationship Detection using Multi-modal Prompting [68.4] Open-vocabulary video visual relationship detectionは、ビデオの視覚的関係の検出をカテゴリを超えて拡張することを目的としている。
既存の方法は、通常、閉じたデータセットで訓練された軌跡検出器を使用して物体の軌跡を検出する。
我々はCLIPの豊富な意味的知識を活用して新しい関係を発見するオープン語彙関係を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 17:13:15 GMT)
Dyn-E: Local Appearance Editing of Dynamic Neural Radiance Fields [62.1] トレーニングビデオの1フレームに画素を操作することにより,ダイナミックNeRFの局所的な外観を編集する新しいフレームワークを提案する。
この手法を用いることで、専門知識のないユーザは、ダイナミックなシーンの外観に望ましいコンテンツを容易に追加できる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:54:06 GMT)
Multi-class Support Vector Machine with Maximizing Minimum Margin [60.1] Support Vector Machine (SVM) は、パターン認識タスクに広く応用されている機械学習技術である。
本稿では,クラス損失のペア化と最小マージンの最大化を両立するマルチクラスSVMの新たな手法を提案する。
実験により,提案手法の有効性と優位性を示す。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:28:45 GMT)
You Need a Transition Plane: Bridging Continuous Panoramic 3D Reconstruction with Perspective Gaussian Splatting [57.4] 本稿では,連続的なパノラマ3次元シーンをガウススプラッティングで橋渡しするための新しいフレームワークTPGSを提案する。
具体的には、個々の立方体面内で3Dガウスを最適化し、縫合されたパノラマ空間でそれらを微調整する。
屋内、屋外、エゴセントリック、ローミングのベンチマークデータセットの実験は、我々のアプローチが既存の最先端の手法より優れていることを示している。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:42:50 GMT)
Convergence of Score-Based Discrete Diffusion Models: A Discrete-Time Analysis [56.4] 連続時間マルコフ連鎖(CTMC)に基づくスコアベース離散拡散モデルの理論的側面について検討する。
本稿では,事前定義された時間点におけるスコア推定値を利用する離散時間サンプリングアルゴリズムを一般状態空間$[S]d$に導入する。
我々の収束解析はジルサノフ法を用いて離散スコア関数の重要な性質を確立する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 07:56:07 GMT)
MASH: Masked Anchored SpHerical Distances for 3D Shape Representation and Generation [55.9] Masked Anchored SpHerical Distances (MASH)は、3次元形状のマルチビューでパラメタライズドな表現である。
MASHは、表面再構成、形状生成、完成、ブレンディングなど、複数の用途に汎用性がある。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:28:12 GMT)
Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities [49.1] 大規模言語モデル(LLM)のリスクと能力の評価は、AIのリスク管理とガバナンスフレームワークにますます取り入れられている。
現在、ほとんどのリスク評価は、システムから有害な振る舞いを誘発する入力を設計することで実施されている。
本稿では,遅延活性化や重みへの修正が可能なモデル改ざん攻撃を用いたLCMの評価を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 22:03:08 GMT)
Generalized Quantum Stein's Lemma and Second Law of Quantum Resource Theories [47.0] 量子情報理論の基本的な問題は、量子情報処理のためのリソースの変換性を単一の関数で特徴づけるために、類似の第2法則を定式化できるかどうかである。
2008年、有望な定式化が提案され、仮説テストの量子バージョンの変種における最適性能とリソース変換可能性のリンクが提案された。
2023年、この補題の元々の証明に論理的ギャップが発見され、そのような第二法則の定式化の可能性に疑問が投げかけられた。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 11:03:06 GMT)
Efficient and Asymptotically Unbiased Constrained Decoding for Large Language Models [46.4] 本稿では,制約付き並列プリフィックス検証(PPV)のための動的重要サンプリング手法を提案する。
PPVは、動的重要度サンプリングを利用して理論的に保証された不偏性を実現し、プレフィックスツリーの非効率性を克服する新しいアルゴリズムである。
実験により,既存の手法よりも効率と出力品質が優れていることを示した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 08:49:21 GMT)
Painting 3D Nature in 2D: View Synthesis of Natural Scenes from a Single Semantic Mask [45.0] 本稿では,自然シーンの多視点一貫したカラーイメージを合成するために,単一のセマンティックマスクを入力として利用する新しいアプローチを提案する。
提案手法は,様々な自然シーンのベースライン手法より優れ,フォトリアリスティックで多視点一貫した映像を制作する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 10:00:56 GMT)
DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning [44.8] DeepRetrievalは強化学習(RL)アプローチで、教師付きデータなしで試行錯誤によるクエリ生成のためにLLMをトレーニングする。
検索指標を報奨として,検索性能を最大化するクエリを生成する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:17:26 GMT)
A Short Survey on Small Reasoning Models: Training, Inference, Applications and Research Directions [42.8] 大きな推論モデル(LRM)の推論能力は、ゆっくりとした思考プロセスを通じて著しく進歩している。
対照的に、より大きなものから蒸留される小さな推論モデル(SRM)は、より効率が高く、異なる能力を示すことができる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 06:45:57 GMT)
LoR-VP: Low-Rank Visual Prompting for Efficient Vision Model Adaptation [41.8] 視覚プロンプトのための低ランク行列乗算を導入した新しい視覚プロンプト設計法(LoR-VP)を提案する。
LoR-VPは、画像ピクセルの行と列をまたいだ共有およびパッチ固有の情報を可能にする。
実験では、最先端の視覚的プロンプト法と比較して、性能と効率の両面で大きな改善が示されている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 02:16:47 GMT)
Deploying Large AI Models on Resource-Limited Devices with Split Federated Learning [39.7] 本稿では、SFLAM(Quantized Split Federated Fine-Tuning Large AI Model)と呼ばれる新しいフレームワークを提案する。
エッジデバイスとサーバ間のトレーニング負荷を分割することで、SFLAMはデバイス上の大規模なモデルの操作を容易にすることができる。
SFLAMは、トレーニング効率を高めるために、量子化管理、電力制御、帯域幅割り当て戦略を取り入れている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 07:55:11 GMT)
Towards Stepwise Domain Knowledge-Driven Reasoning Optimization and Reflection Improvement [37.7] CoTs(Chain of Thoughts)の段階的な監督は、モンテカルロ木探索(MCTS)の助けを借りて、コーディングや数学などの論理的推論タスクを強化する。
本稿では,段階的知識駆動推論最適化(Stepwise Domain Knowledge-Driven Reasoning Optimization)の枠組みを提案する。
また、より優れた視点から推論思考について自己回帰を反復的に学習する、反射経路に対する優先最適化についても紹介する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:25:01 GMT)
BRIGHT: A globally distributed multimodal building damage assessment dataset with very-high-resolution for all-weather disaster response [37.4] ビル被害評価(BDA)は、人的被害を減らすために災害後の重要な能力である。
近年の研究では、目に見えない災害事象の正確なマッピングを実現するためのAIモデルの開発に焦点が当てられている。
本稿では, veRy-hIGH-resoluTion Optical and SAR image (BRIGHT) を用いたBDAデータセットを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 05:28:08 GMT)
A Constrained Optimization Approach for Gaussian Splatting from Coarsely-posed Images and Noisy Lidar Point Clouds [37.0] カメラポーズ推定と3次元再構成を同時に行うための制約付き最適化手法を提案する。
実験により,提案手法は既存の(マルチモーダル)3DGSベースラインを著しく上回ることを示した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 08:34:43 GMT)
Generative Regression Based Watch Time Prediction for Short-Video Recommendation [37.0] 短いビデオレコメンデーションシステムでは、時計の時間予測が重要なタスクとして現れている。
最近の研究は、連続時計時間推定を正規回帰タスクに変換することによって、これらの問題に対処しようとしている。
本稿では,WTPをシーケンス生成タスクとして再構成する新しい生成回帰(GR)フレームワークを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:16:19 GMT)
Forecasting Sparse Movement Speed of Urban Road Networks with Nonstationary Temporal Matrix Factorization [36.7] 非定常時間行列因子化(NoTMF)モデルは、高次元およびスパース運動速度データを低次元潜在空間に投影する。
NoTMFは季節情報を含む一貫した時間ダイナミクスを維持している。
配車車の軌道から推定されるUberの移動速度データセットについて実験を行った。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:56:39 GMT)
FVQ: A Large-Scale Dataset and A LMM-based Method for Face Video Quality Assessment [36.7] 顔映像品質評価(FVQA)は、一般的な映像品質評価(VQA)に加え、検討すべきである。
FVQ-20Kは2万件の顔ビデオとそれに対応する平均世論スコア(MOS)アノテーションを含む。
また,FVQ-Raterという特殊なFVQA手法を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:26:02 GMT)
Conformal Calibration: Ensuring the Reliability of Black-Box AI in Wireless Systems [36.4] この論文は、計算量的に軽量で高度な統計ツールを採用することによって、芸術の状態を超越した一般的なフレームワークであるコンフォーマルキャリブレーションをレビューする。
コンフォーマルキャリブレーションをAIモデルライフサイクルに織り込むことで、ネットワークオペレータは、ブラックボックスAIモデルの信頼性を、無線システムの信頼性の高い実現技術として確立することができる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 19:05:00 GMT)
Multi-scale Activation, Refinement, and Aggregation: Exploring Diverse Cues for Fine-Grained Bird Recognition [36.0] Fine-Grained Bird Recognition (FGBR) が注目されている。
近年の研究では、平易なViTモデルの受容領域が限られており、表現豊かさを妨げていることが示されている。
MDCM(Multi-scale Diverse Cues Modeling)と呼ばれる新しいFGBRフレームワークを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:47:24 GMT)
Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models [33.2] Cybenchは、サイバーセキュリティタスクを特定し、それらのタスク上でエージェントを評価するためのフレームワークである。
4つの異なるCTFコンペティションから、40のプロフェッショナルレベルのCapture the Flag(CTF)タスクが含まれています。
GPT-4o, OpenAI o1-preview, Claude 3 Opus, Claude 3.5 Sonnet, Mixtral 8x22b Instruct, Gemini 1.5 Pro, Llama 3 70B Chat, Llama 3.1 405B Instruct。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:26:07 GMT)
GLINT-RU: Gated Lightweight Intelligent Recurrent Units for Sequential Recommender Systems [32.9] 本稿では,軽量かつ効率的なトランスフォーマーベースシーケンシャルレコメンデータシステムであるGLINT-RUを紹介する。
厳密な選択ゲートを組み込むことで、GLINT-RUは時間依存と微粒な位置情報を適応的にキャプチャし、高品質な潜伏表現を生成する。
3つのデータセットに対する大規模な実験により、GLINT-RUはより優れた予測精度と推論速度を達成することが示された。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 17:18:17 GMT)
DreamRenderer: Taming Multi-Instance Attribute Control in Large-Scale Text-to-Image Models [32.7] FLUXモデル上に構築されたトレーニング不要のアプローチであるDreamRendererを紹介します。
DreamRendererでは、バウンディングボックスやマスクを通じて各インスタンスのコンテンツを制御することができる。
1)Hard Text Attribute BindingのためのBridge Image Tokens – 複製された画像トークンをブリッジトークンとして使用することで,テキストデータのみに事前トレーニングされたT5テキストの埋め込みが,ジョイントアテンション中の各インスタンスの適切な視覚属性をバインドする。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:35:37 GMT)
A Unified and General Humanoid Whole-Body Controller for Versatile Locomotion [30.4] 本稿では,多目的移動のためのヒューマノイド全体制御系であるHugWBCを提案する。
HugWBCは、タスクや振る舞いの面において一般的なコマンド空間を設計することにより、現実世界のヒューマノイドロボットが様々な自然歩行を生成できるようにする。
HugWBCは遠隔操作のような外部上半身コントローラからのリアルタイムの介入もサポートし、精度の高いロコ操作を可能にする。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 14:15:59 GMT)
SAMGPT: Text-free Graph Foundation Model for Multi-domain Pre-training and Cross-domain Adaptation [29.9] テキストのないマルチドメイングラフ事前学習とクロスドメイン適応のための新しい構造アライメントフレームワークを提案する。
複数のソースドメインを起源とするグラフから、マルチドメインの知識を学ぶように設計されている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 06:20:31 GMT)
A Champion-level Vision-based Reinforcement Learning Agent for Competitive Racing in Gran Turismo 7 [29.8] 我々は、エゴ中心のカメラビューとオンボードセンサーデータにのみ依存するビジョンベースの自律レースエージェントを導入する。
この研究は、競争力のあるレースシナリオにおいてチャンピオンレベルのパフォーマンスを示す最初のビジョンベースの自律レースエージェントを示す。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 00:20:43 GMT)
Hardware Scaling Trends and Diminishing Returns in Large-Scale Distributed Training [29.4] ハードウェア構成と並列化戦略の注意深い検討が,モデルサイズ,トレーニングデータ,総計算の効果的なスケーリングに重要であることを示す。
我々は、モデルサイズ、ハードウェア構成、分散並列化戦略における大規模LLMトレーニングワークロードの性能に関する広範な実証的研究を行う。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 19:46:24 GMT)
NoTeS-Bank: Benchmarking Neural Transcription and Search for Scientific Notes Understanding [27.9] NoTeS-Bankは、ノートベースの質問応答におけるNeural Transcription and Searchの評価ベンチマークである。
NoTeS-Bankは複数のドメインにまたがる複雑なメモで構成され、非構造化およびマルチモーダルなコンテンツを処理するモデルを必要とする。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:11:32 GMT)
A Comprehensive Survey of Reward Models: Taxonomy, Applications, Challenges, and Future [27.0] Reward Model (RM) は、Large Language Models (LLM) を向上する驚くべき可能性を実証した。
我々は、関連する研究の概要を概観し、選好収集、報酬モデリング、利用の視点を探究する。
本稿では、初心者にRMの総合的な紹介を提供し、今後の研究を促進することを目的としている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 16:07:36 GMT)
WAGLE: Strategic Weight Attribution for Effective and Modular Unlearning in Large Language Models [26.1] 本稿では,大規模言語モデル(LLM)におけるモデルウェイトと未学習プロセスの相互作用について考察する。
重みの「影響」と「影響」とを相互に関連付けることによって,重みの「影響」を記憶・保持するLLMアンラーニング手法であるWAGLEを設計する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:23:46 GMT)
Mixture of Group Experts for Learning Invariant Representations [25.9] わずかに活性化されたMixture-of-Experts (MoE)モデルはトークン当たりの一貫した計算コストを維持しながらパラメータ数を効果的に増加させる。
スパース表現にインスパイアされた上位$kのルーティングによるバニラMOEの新しい視点を示す。
グループエキスパートの混合(Mixture of Group Experts, MOGE)と呼ばれるトップ$kのルーティング入力に対するグループスパース正規化手法を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:58:02 GMT)
BioChemInsight: An Open-Source Toolkit for Automated Identification and Recognition of Optical Chemical Structures and Activity Data in Scientific Publications [25.8] 既存の光学化学構造認識ツールは、分子構造と生体活性プロファイルを自律的に関連付けることができない。
BioChemInsightは、DECIMERとMolVecを統合したオープンソースのパイプラインで、化学構造認識、Qwen2.5-VL-32B、生体活性抽出と単位正規化のためのPaddleOCRである。
システムは利用可能なSARデータセットを生成し、データ前処理時間を数週間から数時間に短縮する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 04:56:44 GMT)
To Shuffle or not to Shuffle: Auditing DP-SGD with Shuffling [25.7] Differentially Private Gradient Descent (DP-SGD)アルゴリズムは、正式な差分プライバシー(DP)を保証する機械学習(ML)モデルのトレーニングを可能にする。
互換性と計算オーバーヘッドが向上するため、サブサンプリングをシャッフルに置き換えることが一般的になった。
本稿では,DP-SGDをシャッフル処理により解析する新しいDP監査手法を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:32:37 GMT)
Flux Already Knows - Activating Subject-Driven Image Generation without Training [25.5] バニラフラックスモデルを用いた画像生成のためのゼロショットフレームワークを提案する。
我々は、追加のデータ、トレーニング、推論時の微調整なしで強力なID保存機能を起動する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 20:41:53 GMT)
Word Embeddings Track Social Group Changes Across 70 Years in China [24.4] 中国における社会集団の公的な言語表現に革命的な社会変革がどのように反映されているかを研究する。
複数の時間分解能でダイアクロニック単語を埋め込むと、中国語の表現は西洋の表現と大きく異なることが分かる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:46:13 GMT)
VideoAds for Fast-Paced Video Understanding: Where Opensource Foundation Models Beat GPT-4o & Gemini-1.5 Pro [24.0] 広告ビデオ上でMLLMのパフォーマンスをベンチマークするための最初のデータセットであるVideoAdsを紹介する。
VideoAdsは、複雑な時間構造を持つよく計算された広告ビデオで構成されており、テキストに手動で注釈付けされた多様な質問が伴っている。
オープンソースのMLLMであるQwen2.5-VL-72Bは、ビデオ広告で73.35%の精度を実現し、GPT-4oとGemini-1.5 Proを上回っている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 17:05:35 GMT)
Conceptwm: A Diffusion Model Watermark for Concept Protection [23.6] 現在の透かし方式は、特定の概念をターゲットにした洗練された方法で適用するのではなく、すべての画像に透かしを追加する。
既存の透かし法は、特定の概念のいくつかのイメージで微細な透かしを埋め込むのに苦労している。
拡散モデルの概念に知覚不能な透かしをシームレスに埋め込む新しい概念指向透かしフレームワークを導入する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:14:10 GMT)
Text-Promptable Propagation for Referring Medical Image Sequence Segmentation [20.7] Ref-MISSは、自然言語の記述に基づいて、医学画像の配列に解剖学的構造を分割することを目的としている。
既存の2Dおよび3Dセグメンテーションモデルは、医用画像のシーケンスを通して興味のあるオブジェクトを明示的に追跡するのに苦労する。
医用画像のシーケンスセグメンテーションを参照するためのモデルとして,テキスト・プロンプタブル・プロパゲーション(TPP)を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:10:07 GMT)
Efficient Exploration and Discriminative World Model Learning with an Object-Centric Abstraction [19.6] エージェントにオブジェクト中心のマッピング(アイテムとその属性のセットを記述する)を与えることで、より効率的な学習が可能になるかどうかを検討する。
この問題は、ピクセルへの高レベルの状態抽象化でアイテムをモデル化し、プリミティブアクションへの高レベルの時間抽象化で属性を変更することで、階層的に最もよく解決されている。
我々は,識別的世界モデルを学ぶ完全モデルに基づくアルゴリズムを提案し,数に基づく本質的な報酬のみを用いて効率的に探索し,その後に発見された(抽象的な)状態に到達する計画を立てる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 14:17:14 GMT)
Linguistic Comparison of AI- and Human-Written Responses to Online Mental Health Queries [17.1] ジェネレーティブAIと大規模言語モデル(LLMs)は、スケーラブルで、時周のメンタルヘルス支援のための新しい可能性を導入した。
本研究ではReddit上の55のオンラインサポートコミュニティから24,114の投稿と138,758のオンラインコミュニティ(OC)の回答を得た。
その結果、AI応答はより冗長で、読みやすく、分析的に構造化されているが、言語的多様性や人間と人間の相互作用に固有の個人の物語は欠如していることが判明した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 16:20:02 GMT)
RICCARDO: Radar Hit Prediction and Convolution for Camera-Radar 3D Object Detection [16.9] 我々は,単分子検出器から得られた物体特性に基づいて,レーダの衝突分布を予測するモデルを構築した。
我々は,予測分布をカーネルとして,単分子検出近傍の実際のレーダ点と一致させる。
提案手法は, nuScenes 上での最先端レーダーカメラ検出性能を実現する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 05:37:42 GMT)
FakeShield: Explainable Image Forgery Detection and Localization via Multi-modal Large Language Models [16.7] FakeShieldは、画像の信頼性を評価し、改ざんされた領域マスクを生成し、画素レベルおよび画像レベルの改ざんヒントに基づいた判断基準を提供するフレームワークである。
実験では、FakeShieldは様々な改ざん手法を効果的に検出し、ローカライズし、従来のIFDL法と比較して説明可能で優れた解を提供する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 08:08:04 GMT)
Breaking the Lens of the Telescope: Online Relevance Estimation over Large Retrieval Sets [15.5] 本稿では,オンライン関連度推定という新たな手法を提案する。
オンライン関連度推定は、ランキングプロセスを通して、クエリの関連度推定を継続的に更新する。
TRECベンチマークの手法をハイブリッド検索と適応検索の2つのシナリオで検証する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 22:05:50 GMT)
PathVLM-R1: A Reinforcement Learning-Driven Reasoning Model for Pathology Visual-Language Tasks [15.5] 病理画像に特化して設計された視覚言語モデルPathVLM-R1を提案する。
我々は,Qwen2.5-VL-7B-インストラクタをベースとして,厳密に設計したポストトレーニング戦略により,病理的タスクのパフォーマンスを向上させた。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:32:16 GMT)
Exploration of Plan-Guided Summarization for Narrative Texts: the Case of Small Language Models [15.1] 計画誘導要約は、生成した要約を原文に接地することで、小言語モデル(SLM)の幻覚を減らそうとする。
我々は、詳細な詳細をターゲットとした既存の計画誘導ソリューションを分析し、また、より高レベルで物語に基づく計画定式化を提案する。
以上の結果から,概略品質や忠実度を計画することなく,ベースラインでのアプローチが著しく改善されることが示唆された。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 04:11:37 GMT)
PCDP-SGD: Improving the Convergence of Differentially Private SGD via Projection in Advance [15.0] Differentially Private SGD(DP-SGD)は、集中型および連合型の両方の設定において、トレーニングデータの理論的保証を提供する。
冗長な勾配ノルムを圧縮し,より重要な勾配成分を保存することを目的とした,汎用フレームワークPCDP-SGDを提案する。
我々は,PCDP-SGDがコンピュータビジョンタスクにおける最先端のDP-SGD変種と比較して高い精度を実現することを証明した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:38:42 GMT)
Speculative Thinking: Enhancing Small-Model Reasoning with Large Model Guidance at Inference Time [15.0] 推論レベルでの推論において,大規模推論モデルによるより小さな推論のガイドを可能にする,トレーニング不要なフレームワークであるSpeculative Thinkingを紹介した。
より有能なモデルに回帰ステップを戦略的に委譲することにより,提案手法は推論モデルの推論精度を向上し,出力を短縮する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:25:32 GMT)
Depth Estimation Based on 3D Gaussian Splatting Siamese Defocus [14.4] 本稿では,3次元幾何学における深さ推定のための3次元ガウススプラッティングとシームズネットワークに基づく自己教師型フレームワークを提案する。
提案したフレームワークは、人工的に合成されたデータセットと実際のぼやけたデータセットの両方で検証されている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:16:20 GMT)
Language-based Audio Moment Retrieval [14.2] 音声モーメント検索(AMR)と呼ばれる新しいタスクを提案し設計する。
従来の言語ベースの音声検索タスクとは異なり、AMRはテキストクエリに基づいて、未編集の長い音声の関連モーメントを予測することを目的としている。
我々は、モーメントアノテーションを付加した大規模なシミュレーションオーディオ録音からなる専用のデータセット、Clatho-Momentを構築した。
次に、AMRタスクの基本的なフレームワークとして、Audio Moment DETR (AM-DETR) と呼ばれるDETRベースのモデルを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 12:28:34 GMT)
AMNet: An Acoustic Model Network for Enhanced Mandarin Speech Synthesis [14.2] AMNetは、マンダリン音声合成の性能を向上させるために設計された音響モデルネットワークである。
フレーズ構造をモデルに埋め込み、局所的な畳み込みモジュールを導入することで、AMNetは局所情報に対するモデルの感度を高める。
AMNetは音素の特徴を音素から切り離し、トーンモデリングの明確なガイダンスを提供する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 14:02:31 GMT)
Shrinkage Initialization for Smooth Learning of Neural Networks [14.2] ニューラルネットワークに対する改良されたアプローチが提示され、ネットワークの各レイヤの変換を初期化するための縮小アプローチが採用されている。
ランダムな層を持つ任意のネットワークの構造に対して普遍的に適応できるが、安定した性能が得られる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 07:11:35 GMT)
Accurate Diagnosis of Respiratory Viruses Using an Explainable Machine Learning with Mid-Infrared Biomolecular Fingerprinting of Nasopharyngeal Secretions [14.0] 呼吸器ウイルス(RV)の正確な同定は、アウトブレイクコントロールと公衆衛生にとって重要である。
本研究では,鼻咽頭内分泌物からのAttenuated Total Reflectance Fourier Transform Infrared Spectroscopy (ATR-FTIR)とRoPE-SATモデルを組み合わせた診断システムを提案する。
モデル選択された赤外線領域と既知の生体分子の署名とを関連付けることにより,本システムがウイルス特異的なスペクトル指紋を効果的に認識できることを確認した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:33:01 GMT)
SCFlow2: Plug-and-Play Object Pose Refiner with Shape-Constraint Scene Flow [13.7] SCFlow2は6次元オブジェクトポーズ推定のためのプラグアンドプレイ改良フレームワークである。
RGBDフレームの3Dシーンフローによる反復の正規化として追加の深さを定式化する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:48:01 GMT)
Zero-Shot Statistical Tests for LLM-Generated Text Detection using Finite Sample Concentration Inequalities [13.7] コンテンツの証明は、教育機関、ソーシャルメディアプラットフォーム、企業など、多くの組織の機能に不可欠である。
LLM(Large Language Models)が生成するテキストが、人間が生成したコンテンツとほとんど区別できないようになるにつれて、この問題はますます難しくなってきている。
テキスト長の増加に伴い,テストのI型およびII型エラーが指数関数的に減少することを示す。
我々の研究は、有害または偽のLCM生成テキストの起源を確実に発見することを可能にし、新たなAI規制に対する誤った情報やコンプライアンスに対抗するのに役立ちます。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 18:05:42 GMT)
ZIP-FIT: Embedding-Free Data Selection via Compression-Based Alignment [13.3] ZIP-FITは、gzip圧縮を使用して、潜在的なトレーニングデータとターゲットタスク分布のアライメントを測定するデータ選択フレームワークである。
ZIP-FIT選択データに基づいてトレーニングされたモデルは、ベースラインよりも85.1%高速なクロスエントロピー損失を達成する。
ZIP-FITは、小さく、よく整合したデータセットが、より大きながターゲットの少ないデータセットよりも優れていることを示している。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 19:39:18 GMT)
UniFlowRestore: A General Video Restoration Framework via Flow Matching and Prompt Guidance [13.0] ビデオ画像は、しばしばぼやけ、ノイズ、圧縮アーティファクトなどの複雑な劣化によって影響を受ける。
伝統的な復元手法は「単一タスクの単一モデル」パラダイムに従っており、結果として一般化が貧弱で計算コストが高い。
提案するUniFlowRestoreは,プロンプト誘導ベクトル場下での時間連続進化として復元をモデル化する一般的なビデオ復元フレームワークである。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 04:06:40 GMT)
Semantic Commit: Helping Users Update Intent Specifications for AI Memory at Scale [12.1] 我々は、AIインターフェースが自然言語データのリポジトリに新しい情報を統合するのにどのように役立つかを検討する。
非局所的な影響で意味変化を管理するための手法とUIを開発する。
インテント仕様の更新時にユーザがコンフリクトを解決する方法を理解するために,SemanticCommitというインターフェースを開発した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 17:07:08 GMT)
Auto-Drafting Police Reports from Noisy ASR Outputs: A Trust-Centered LLM Approach [11.5] 本研究では,複雑な,騒々しい,複数ロールの対話データから,警察報告のドラフトを生成するためのAI駆動システムを提案する。
我々のアプローチは、法執行機関の相互作用の重要な要素をインテリジェントに抽出し、ドラフトに含めます。
このフレームワークは、将来の警察行為において、レポートプロセスを変革し、監視、一貫性、公平性を保証する可能性を秘めている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 08:05:37 GMT)
From Visual Explanations to Counterfactual Explanations with Latent Diffusion [11.4] 本稿では,近年の顕著な研究における2つの課題に対処するための新しいアプローチを提案する。
まず、ターゲットクラスの"概念"と元のクラスを区別するために、どの特定の反事実的特徴が重要かを決定する。
第二に、非ロバスト分類器に対して、対向的に堅牢なモデルのサポートに頼ることなく、重要な説明を提供する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:04:00 GMT)
DL-QAT: Weight-Decomposed Low-Rank Quantization-Aware Training for Large Language Models [11.2] ポストトレーニング量子化(PTQ)は一般的な手法であるが、しばしば低ビットレベルの課題に直面している。
量子化対応トレーニング(QAT)はこの問題を軽減することができるが、計算資源が大幅に必要である。
そこで本研究では,QATの利点をマージし,総パラメータの1%未満のトレーニングを行ないながら,低域量子化意識トレーニング(DL-QAT)を導入する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:57:02 GMT)
Adaptive and Efficient Log Parsing as a Cloud Service [11.1] ByteBrain-Logは、クラウド環境向けに設計された革新的なログ解析フレームワークである。
平均で229,000ログを処理し、最速のベースラインで840%のスピードアップを達成した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 07:53:19 GMT)
Context-Aware Adaptive Sampling for Intelligent Data Acquisition Systems Using DQN [11.1] マルチセンサーシステムは、モノのインターネット、環境モニタリング、インテリジェントな製造で広く利用されている。
従来の固定周波数サンプリング戦略は、しばしば深刻なデータ冗長性、高エネルギー消費、適応性に繋がる。
本稿では,DQNに基づくマルチセンサ適応サンプリング最適化手法を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:11:56 GMT)
Keypoint Detection and Description for Raw Bayer Images [10.4] キーポイント検出と局所的特徴記述は、ロボット知覚における基本的なタスクであり、SLAM、ロボットのローカライゼーション、特徴マッチング、ポーズ推定、および3Dマッピングのようなアプリケーションに不可欠である。
既存の手法は主にRGB画像で動作するが,画像信号処理(ISP)の必要性を回避して,生画像を直接処理する新しいネットワークを提案する。
この研究は、生画像に特化してキーポイント検出と特徴記述ネットワークを開発する最初の試みであり、リソース制約のある環境に対してより効率的なソリューションを提供する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:11:58 GMT)
MolGround: A Benchmark for Molecular Grounding [10.2] そこで本研究では,モデル参照能力の評価を目的とした分子基盤ベンチマークを提案する。
これまでに117kのQAペアからなる分子理解ベンチマークを構築した。
我々のシステムはGPT-4oを含む既存のモデルよりも優れており、その基盤出力は従来のタスクを強化するために統合されている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 10:20:16 GMT)
Tile Codes: High-Efficiency Quantum Codes on a Lattice with Boundary [10.2] タイル符号は、局所性と安定化度の観点から少し柔軟性を増すことで、通常の表面コードを一般化する。
We finds codes with parameters $[288, 8, 12]]$ using weight-6 stablers and $[288, 8, 14]]$ using weight-8 stablers, are out out out out of all known constructions in this direction。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 10:25:26 GMT)
Text To 3D Object Generation For Scalable Room Assembly [9.3] 本稿では,スケーラブルで高品質でカスタマイズ可能な室内3Dシーンのための,合成データ生成のためのエンドツーエンドシステムを提案する。
本システムはテキストプロンプトから高忠実度3Dオブジェクトアセットを生成し,レンダリングツールを用いて事前に定義されたフロアプランに組み込む。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 20:13:07 GMT)
Building Machine Learning Limited Area Models: Kilometer-Scale Weather Forecasting in Realistic Settings [8.6] フレキシブルバウンダリ強制法による境界条件付きキロメートルスケール機械学習限定領域モデルを構築するためのフレームワークを提案する。
境界幅,グラフ構築,バウンダリ強制統合など,設計選択の体系的評価を行う。
本研究は,地域気象予報の将来において,機械学習の限られた領域モデルの可能性を示すものである。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 20:58:02 GMT)
Beyond Glucose-Only Assessment: Advancing Nocturnal Hypoglycemia Prediction in Children with Type 1 Diabetes [8.2] デッド・イン・ベッド症候群は1型糖尿病(T1D)の若年者で、長期合併症を伴わない突然の死亡を示す。
1つの主要な仮説は、睡眠中の血糖値の危険な低下である夜間低血糖(NH)によるものである。
本研究の目的は、生理的データと機械学習(ML)技術を活用して、T1Dの小児におけるNH予測を改善することである。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 18:07:40 GMT)
Pneuma: Leveraging LLMs for Tabular Data Representation and Retrieval in an End-to-End System [8.1] Pneumaは、表形式のデータを効率的かつ効果的に発見するために設計された検索拡張世代(RAG)システムである。
テーブル表現のために、Pneumaはスキーマと行レベルの情報を保存し、包括的なデータ理解を保証する。
テーブル検索では、PneumaはLLMをフルテキストやベクトル検索といった従来の情報検索技術で強化する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:20:50 GMT)
Reconstructing Sepsis Trajectories from Clinical Case Reports using LLMs: the Textual Time Series Corpus for Sepsis [7.7] 臨床症例報告と退院サマリーは、患者遭遇の最も完全かつ正確な要約であり得るが、それらは最終的、すなわち、遭遇後のタイムスタンプである。
我々は,大規模言語モデルを用いた症例報告において,時間的局所的な発見を表現し,抽出し,注釈するパイプラインを構築した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:07:44 GMT)
Illusion Worlds: Deceptive UI Attacks in Social VR [7.7] 本稿では,ユーザを隠蔽的に操作し,虚偽の仮想コンテンツを通じて有害な動作を行う4つの新しいUI攻撃を提案する。
仮想空間におけるオブジェクトやスクリプトを高速に解析し,不審な要素を数秒以内に検出する,積極的な対策であるMetaScannerを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 12:55:13 GMT)
MoE-Lens: Towards the Hardware Limit of High-Throughput MoE LLM Serving Under Resource Constraints [7.3] MoE-Lensは、リソース制約のある環境に対する総合的なパフォーマンスモデリングによって設計された推論システムである。
システム実行メカニズムをキャプチャして、重要なハードウェアボトルネックを特定し、達成可能なスループットを正確に予測します。
多様なMoEモデルとデータセットに基づいて評価され、MoE-Lensは最先端のソリューションを平均で4.6倍(最大25.5倍)上回る。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:26:56 GMT)
Dose-finding design based on level set estimation in phase I cancer clinical trials [7.0] MTD推定問題をレベルセット推定問題とみなすことができる。
LSEの枠組みにおける新しい線量フィリング設計を提案する。
提案設計では, 線量毒性曲線の後方分布の不確実性を考慮した取得関数に基づいて次の線量を決定する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:44:20 GMT)
LD4MRec: Simplifying and Powering Diffusion Model for Multimedia Recommendation [6.9] マルチメディアレコメンデーションのための光拡散モデル(LD4MRec)を提案する。
LD4MRecはフォワードフリー推論戦略を採用しており、観測されたノイズの振る舞いから直接将来の振る舞いを予測する。
3つの実世界のデータセットで実施された実験は、LD4MRecの有効性を示した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 04:52:46 GMT)
SynthTRIPs: A Knowledge-Grounded Framework for Benchmark Query Generation for Personalized Tourism Recommenders [6.9] 本稿では,Large Language Models (LLMs) を用いた合成旅行クエリ生成のための新しいSynthTRIPsフレームワークを提案する。
我々のアプローチは、人格に基づく好み(予算、旅行スタイルなど)と明確な持続可能性フィルタ(歩行性、空気質など)を組み合わせることで、現実的で多様なクエリを生成する。
本手法は他の推奨システムドメインにも適用した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 16:48:35 GMT)
Eye Gaze as a Signal for Conveying User Attention in Contextual AI Systems [6.9] マルチモーダルAIシステムは、ユーザーとシステムの間の明示的な通信チャネルに依存している。
ユーザの注意情報を伝えるためのウェアラブルアイトラッキングの可能性を探る。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:42:34 GMT)
Detecting Instruction Fine-tuning Attack on Language Models with Influence Function [6.8] インストラクションの微調整攻撃は、モデルアライメントを損なうとともに、現実のデプロイメントにおいてセキュリティリスクを引き起こす。
本稿では,影響関数を用いて攻撃を検知・緩和する,シンプルで効果的な手法を提案する。
我々は,大規模データセットに対する言語モデル命令の微調整攻撃を検出するための影響関数を初めて適用した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 00:50:28 GMT)
REMEMBER: Retrieval-based Explainable Multimodal Evidence-guided Modeling for Brain Evaluation and Reasoning in Zero- and Few-shot Neurodegenerative Diagnosis [6.4] 検索型マルチモーダル誘導型脳評価・推論モデルREMEMBERについて紹介する。
REMEMBERは、脳MRIスキャンを用いたゼロショットと少数ショットのアルツハイマーの診断を容易にする新しい機械学習フレームワークである。
実験結果から,REMEMBERはゼロショットと少数ショットの堅牢な性能を実現することが示された。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 22:06:15 GMT)
PathSeqSAM: Sequential Modeling for Pathology Image Segmentation with SAM2 [6.3] PathSeqSAMは2次元病理スライスをglomerul2のメモリ機構を用いたシーケンシャルなビデオフレームとして扱う新しい手法である。
そこで本手法では,スライスとLoRA間の物理距離の変動を考慮した距離認識型アテンション機構を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 05:30:08 GMT)
Graph-Based Prediction Models for Data Debiasing [6.2] データ収集におけるバイアスは、低レポートと過剰レポートの両方から発生し、医療と公共の安全において重大な課題を提起する。
グラフベースのOver- and Under-Reporting Debiasing (GROUD) は,真のインシデント数と関連するレポートバイアス確率を共同で推定することにより,レポートデータを排除する新しいグラフベースの最適化フレームワークである。
GROUDは、アトランタの緊急電話や新型コロナウイルスワクチンの有害事象報告を含む、挑戦的なシミュレーション実験と実世界のデータセットの両方で検証する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:34:49 GMT)
From Punchlines to Predictions: A Metric to Assess LLM Performance in Identifying Humor in Stand-Up Comedy [6.1] 大きな言語モデルが広く採用されていることを踏まえ、ユーモアとAIの交わりは笑い事ではない。
本研究では,スタンドアップコメディの書き起こしからユーモラスな引用を正確に識別するモデルの有効性を評価する。
ユーモラスなパンチラインを抽出する能力について,様々なプロンプトの中からLLMを評価するために考案された新しいユーモラス検出指標を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 02:19:53 GMT)
Optical ISAC: Fundamental Performance Limits and Transceiver Design [6.0] 本稿では,光ポイントツーポイントシステムにおける最適容量歪み(C-D)トレードオフを特徴付ける。
我々は、最適速度歪み(R-D)領域を考察し、いくつかの内外境界(OB)を探索する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:02:36 GMT)
seg2med: a segmentation-based medical image generation framework using denoising diffusion probabilistic models [5.9] seg2medは高度な医用画像合成フレームワークである。
これはTotalSegmentatorから解剖学的マスクに条件付けされた高品質な合成医療画像を生成する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 11:32:32 GMT)
Inferring Outcome Means of Exponential Family Distributions Estimated by Deep Neural Networks [5.9] カテゴリーまたは指数関数的な家族結果の推定手段に関する推測は、まだ未定である。
本稿では,ノイズの異なるレジームに分割するトラルニケーション手法を提案する。
本手法をeICUデータセットからの実世界データに適用し,患者のリスクを予測する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:32:42 GMT)
NetTAG: A Multimodal RTL-and-Layout-Aligned Netlist Foundation Model via Text-Attributed Graph [5.9] NetTAGは、ゲートセマンティクスとグラフ構造を融合するネットリスト基盤モデルである。
多様なゲートタイプを処理でき、様々な機能および物理的タスクをサポートする。
ゲートとグラフの自己教師対象で事前訓練し、RTLとレイアウトステージに合わせることで、NetTAGは包括的な回路内在をキャプチャする。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:39:25 GMT)
Probability Distribution Alignment and Low-Rank Weight Decomposition for Source-Free Domain Adaptive Brain Decoding [5.8] 脳の復号化は現在、個人差、モダリティアライメント、高次元埋め込みにおいて重大な課題に直面している。
ソースフリーなドメイン適応型脳復号化フレームワークを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 07:28:16 GMT)
An Enhanced Iterative Deepening Search Algorithm for the Unrestricted Container Rehandling Problem [5.7] コンテナリハンドリング問題(CRP)は、特定の運用ルールの下でスタック間でコンテナを並べ替えることである。
本稿では,探索効率を向上させるために,改良された下界と統合された拡張深度探索アルゴリズムを提案する。
提案手法は,より一般的なUCRP変種を解く際に,最先端の精度の高いアルゴリズムよりも優れていることを示す。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 01:58:30 GMT)
Broad Critic Deep Actor Reinforcement Learning for Continuous Control [5.0] 新しいハイブリッドアクター・クリティック強化学習(RL)フレームワークが導入された。
提案するフレームワークは,広範学習システム(BLS)とディープニューラルネットワーク(DNN)を統合する。
このハイブリッド設計は一般化可能であり、既存のアクター批判アルゴリズムを拡張できる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 14:53:47 GMT)
Improved visual-information-driven model for crowd simulation and its modular application [4.7] データ駆動のクラウドシミュレーションモデルは、シミュレーションの精度とリアリズムを高める利点を提供する。
データ駆動の群集シミュレーションモデルを開発することは、依然としてオープンな問題である。
本稿では,視覚情報抽出手法と出口手がかりを取り入れたデータ駆動モデルを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:07:36 GMT)
Quantum Strong-to-Weak Spontaneous Symmetry Breaking in Decohered One Dimensional Critical States [4.6] 我々は混合状態における新しいタイプの相転移を明らかにし、Emphquantum strong-to-weak spontaneous symmetric Break (SW SSB) と呼ぶ。
SW SSB 相と自明なルッティンガー液相を直線臨界線で分離した 2-サイト XX 脱コヒーレンスの下で XXZ 臨界スピン鎖のグローバル相図をマッピングする。
注目すべきことに、我々の場合のSW SSB遷移は、任意に小さなデコヒーレンス強度の下でもハミルトンパラメータをチューニングすることによってのみ駆動できるという意味で、遠祖的な量子普遍性である。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 08:17:39 GMT)
Wormhole Memory: A Rubik's Cube for Cross-Dialogue Retrieval [4.6] 本研究では,異なる対話間で任意に検索可能なルービックキューブとしてメモリを実現するワームホールメモリモジュール(WMM)を提案する。
実験結果から,WMMは対話間のメモリ取得能力と定量的指標の安定性を示した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 16:47:37 GMT)
Visual moral inference and communication [4.5] 本稿では,自然画像からの道徳的推論を支援する計算フレームワークを提案する。
テキストのみに基づくモデルでは、視覚刺激に対する人間の道徳的判断のきめ細やかな把握ができないことがわかった。
我々の研究は、視覚的道徳的推論を自動化し、公共メディアにおける視覚的道徳的コミュニケーションのパターンを発見するための道を開いた。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 00:46:27 GMT)
Adding New Categories in Object Detection Using Few-Shot Copy-Paste [4.4] 単純な閉塞機構さえも、新しい対象カテゴリを導入する際には、高い性能を達成するのに十分であることを示す。
数百のカテゴリにわたる50万以上の画像を含む大規模なトレーニングデータセットに、新しいカテゴリの15のイメージを追加することで、新しいカテゴリの数千のインスタンスを含む、目に見えないテストセットに対して95%の精度を達成することができる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 07:41:54 GMT)
Rethinking Remaining Useful Life Prediction with Scarce Time Series Data: Regression under Indirect Supervision [4.3] 本稿では,パラメータ化静的回帰(パラメータ化静的回帰)と呼ばれる統合フレームワークを導入する。
提案手法は,非常に少ない時系列データを扱う場合の予測精度において,競合性能を示す。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 13:14:35 GMT)
Lifetime-limited Gigahertz-frequency Mechanical Oscillators with Millisecond Coherence Times [4.3] 量子アプリケーションに必要なコヒーレンス時間は、フォノンデコヒーレンス(英語版)の物質起源を調査するために、極めて敏感な新しい技術を必要とする。
我々は、非侵襲レーザー分光法と材料分析を組み合わせることで、結晶性媒体におけるフォノン脱コヒーレンスの鍵源を同定する。
我々は、高周波量子メモリの基礎として、100ms以上のコヒーレンス時間への経路を同定する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:36:37 GMT)
PQS (Prune, Quantize, and Sort): Low-Bitwidth Accumulation of Dot Products in Neural Network Computations [4.1] ニューラルネットワーク計算におけるドット生成物の低ビット幅蓄積を実現するために,Prune,Quantize,Sortの3つの手法を併用したPQSを提案する。
本手法は,複数の画像分類タスクにおいて,浮動小数点ベースラインと同等の精度でモデル精度を達成しつつ,アキュムレータビット幅を2.5倍削減する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:51:42 GMT)
Multi-modal and Multi-view Fundus Image Fusion for Retinopathy Diagnosis via Multi-scale Cross-attention and Shifted Window Self-attention [4.1] マルチモーダル・マルチビュー・ファンドス画像の同時解釈は網膜症予防に重要である。
マルチスケール・クロスアテンションに基づくマルチモーダル・ファンドス画像融合法を提案する。
また、眼科医が作業負荷を減らし、診断精度を向上させるために網膜症診断フレームワークを設計した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 07:06:15 GMT)
Multi-Modal Brain Tumor Segmentation via 3D Multi-Scale Self-attention and Cross-attention [4.1] Transformerの導入により、3D医療画像の長距離依存情報モデリング機能が、自己認識機構を介してハイブリッドモデルに導入される。
エンコーダ・デコーダ構造に基づくCNN-Transformerハイブリッド3次元医用画像分割モデルTMA-TransBTSを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 05:53:59 GMT)
Lumos: Efficient Performance Modeling and Estimation for Large-scale LLM Training [4.1] 大規模LLMトレーニングのためのトレース駆動性能モデリングおよび推定ツールキットであるLumosを提案する。
Lumosは平均3.3%のエラーで実行時間をリプレイでき、他のランタイムの詳細とともに、異なるモデルや設定で実行できる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 18:43:24 GMT)
BIGS: Bimanual Category-agnostic Interaction Reconstruction from Monocular Videos via 3D Gaussian Splatting [3.9] 本稿では,3次元ガウス的手と未知の物体をモノクロビデオから再構成するBIGS(Bimanual Interaction 3D Gaussian Splatting)を紹介する。
提案手法は,3Dハンドポーズ推定(MPJPE),3Dオブジェクト再構成(CDh,CDo,F10),レンダリング品質(PSNR,SSIM,LPIPS)の2つの課題に対して,最先端の精度を実現する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 06:30:24 GMT)
"It's not a representation of me": Examining Accent Bias and Digital Exclusion in Synthetic AI Voice Services [3.9] 本研究では、混合手法を用いて2つの合成AI音声サービス(SpeechifyとElevenLabs)を評価する。
以上の結果から,5つの地域,英語のアクセントにおける技術的特徴の相違が判明した。
現在の音声生成技術は、言語特権とアクセントに基づく差別を不注意に強化することができる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:31:22 GMT)
GMG: A Video Prediction Method Based on Global Focus and Motion Guided [3.9] 現在の予測モデルは、特徴抽出のために畳み込み操作やスライディングウィンドウに依存している。
気象データは、しばしば非剛体で、その運動過程は予測不可能な変形を伴う。
これら2つの課題に対処するためのGMGモデルを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 14:06:13 GMT)
Langformers: Unified NLP Pipelines for Language Models [3.7] LangformersはオープンソースのPythonライブラリで、NLPパイプラインを合理化するように設計されている。
会話型AI、事前学習、テキスト分類、文の埋め込み/更新、データラベリング、セマンティック検索、知識蒸留を結合型APIに統合する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 10:17:49 GMT)
Cycle Training with Semi-Supervised Domain Adaptation: Bridging Accuracy and Efficiency for Real-Time Mobile Scene Detection [3.5] モデル性能を最適化するために,探索段階と安定化段階を交互に行う3段階のトレーニングプロセスを採用した,Cycle Trainingと呼ばれる新しいトレーニングフレームワークを提案する。
モバイルシーン検出のためのCamSSDデータセットに関する総合的な実験により、我々のフレームワークは分類精度を大幅に向上するだけでなく、リアルタイムの推論効率も向上することを示した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 17:42:45 GMT)
A Lightweight Moment Retrieval System with Global Re-Ranking and Robust Adaptive Bidirectional Temporal Search [3.4] デジタルビデオコンテンツの指数的成長は、モーメントレベルのビデオ検索において重要な課題となっている。
現在の検索システムは、計算の非効率性、時間的文脈制限、動画コンテンツをナビゲートする本質的な複雑さによって制約されている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 17:49:46 GMT)
MatWheel: Addressing Data Scarcity in Materials Science Through Synthetic Data [3.3] 本研究では,条件生成モデルにより生成された合成データを用いて,材料特性予測モデルをトレーニングするMatWheelフレームワークを提案する。
条件付き生成モデルとしてCGCNN, 条件付き生成モデルとしてCon-CDVAEを用いて, Matminerデータベースから得られた2つのデータ・スカース・マテリアル・プロパティ・データセットの実験を行った。
以上の結果から, 合成データは, 2つのタスクのすべてにおいて, 実データに近い, あるいはそれを超える性能を達成できる可能性が示唆された。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:31:29 GMT)
Minority Reports: Balancing Cost and Quality in Ground Truth Data Annotation [3.1] 高品質なデータアノテーションは、機械学習ベースのソフトウェアを開発する上で、不可欠だが労力がかかる、コストのかかる側面である。
マイノリティレポートの検出と削除により、アノテーションの精度とコストの本質的にのトレードオフについて検討する。
提案手法では,実行前に冗長なアノテーションタスクを割り当てる手法を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:04:56 GMT)
Are Open-Vocabulary Models Ready for Detection of MEP Elements on Construction Sites [3.1] 高度な視覚システムを備えた地上ロボットは、機械、電気、配管(MEP)システムの監視などのタスクを自動化することができる。
本研究は, 細調整, 軽量, クローズドセットオブジェクト検出器と比較して, オープン語彙型視覚言語モデルの適用性を評価する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 20:48:26 GMT)
Chest X-ray Classification using Deep Convolution Models on Low-resolution images with Uncertain Labels [3.0] 胸部X線から深部CNNモデルへの入力画像サイズの違いによる分類結果について報告する。
正面および側方研究において,多ラベル分類モデルのアンサンブルを用いる。
心臓病、統合、浮腫については、モデルアーキテクチャーで3%高い精度を得る。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 01:13:00 GMT)
SDIGLM: Leveraging Large Language Models and Multi-Modal Chain of Thought for Structural Damage Identification [2.9] SDIGLMは, マルチモーダル構造損傷同定モデルである。
このマルチモーダル CoT を活用することで、SDIGLM は様々なインフラタイプで95.24%の精度を達成し、構造的損傷の特定において汎用 LMM を超えている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 11:37:10 GMT)
Text-to-Image Models and Their Representation of People from Different Nationalities Engaging in Activities [2.7] 1つのシナリオでは、ほとんどの画像、もう1つのシナリオは、伝統的な服装を身に着けている個人を描いている。
この表現パターンと特定国に関連する地域との間に統計的に有意な関係が認められた。
これは、この問題が特定の地域、特に中東と北アフリカ、サハラ以南のアフリカに不均等に影響を及ぼしていることを示している。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 04:37:55 GMT)
Entanglement Spectrum Dynamics as a Probe for Non-Hermitian Bulk-Boundary Correspondence in Systems with Periodic Boundaries [2.5] 周期的開量子フェルミオン系における絡み合いスペクトルのクエンチダイナミクスを考察する。
この結果から、非エルミート位相はフェルミオン系のサブシステム内の非条件動力学に顕著なインプリントを残していることが明らかとなった。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 06:37:17 GMT)
Extremely low-bitrate Image Compression Semantically Disentangled by LMMs from a Human Perception Perspective [2.5] 人間のプログレッシブ・コンプレッション・メカニズムにインスパイアされたセマンティック・ディスタングル・イメージ・圧縮フレームワークを提案する。
我々はLMMを利用して、全体記述、オブジェクト詳細記述、セマンティックセグメンテーションマスクを含む重要なセマンティックコンポーネントを抽出する。
本研究では,事前学習したControlNet上に構築され,オブジェクトレベルのテキスト記述やセマンティックマスクによって条件付けられたオブジェクトの詳細を復元する,注意誘導型オブジェクト復元モデルを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 11:05:12 GMT)
Multi-aspect Knowledge Distillation with Large Language Model [2.3] マルチモーダル大言語モデル(MLLM)を用いた多視点知識蒸留法を提案する。
本手法は主に画像分類に適用し,オブジェクト検出などのモデル拡張の可能性を探究する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 12:38:44 GMT)
MedIL: Implicit Latent Spaces for Generating Heterogeneous Medical Images at Arbitrary Resolutions [2.2] MedILは、異質なサイズと解像度で医療画像をエンコードするために開発された、一級のオートエンコーダである。
我々は,MedILが大規模マルチサイト・マルチレゾリューションデータセットに対して臨床的に関連性のある特徴をいかに圧縮し,保存するかを示す。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 19:52:56 GMT)
Passive environment-assisted quantum communication with GKP states [2.2] ボソニック純損失チャネルは、チャネルの透過率が50%未満であるときに量子容量がゼロである。
システムとその環境に対する理想のゴッテマン・キタエフ・プレスキル状態(GKP)を選択することにより、ビームスプリッタによる量子情報の完全な伝送は、任意に低い透過率で達成可能であることを示す。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 23:49:24 GMT)
The StudyChat Dataset: Student Dialogues With ChatGPT in an Artificial Intelligence Course [2.1] textbfStudyChatは、LLMベースのチューターと現実世界の学生のインタラクションをキャプチャする公開データセットである。
我々はChatGPTのコア機能を複製したWebアプリケーションをデプロイし、それをLLMとの学生インタラクションのログに使用します。
これらの相互作用を分析し、行動傾向を強調し、特定の利用パターンがコースの結果にどのように関係しているかを分析する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 02:42:06 GMT)
Training Human-Robot Teams by Improving Transparency Through a Virtual Spectator Interface [2.1] アフターアクションレビュー(英: After-action Review、AAR)は、オペレーターとチームがタスクパフォーマンスを向上させるのに役立つ専門的な議論である。
我々は,人間のロボットチームパフォーマンスを向上させるために,VSI(Virtual Spectator Interface)と呼ばれる新しいトレーニングレビューツールを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 22:20:02 GMT)
Deep Neural Koopman Operator-based Economic Model Predictive Control of Shipboard Carbon Capture System [2.1] クープマンフレームワークにおけるデータ駆動型動的モデリングと経済予測制御手法を提案する。
この統合モデリングと制御のアプローチは、船舶の燃焼後炭素捕獲プラントの安全でエネルギー効率の良いプロセス運用を実現するために用いられる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 12:51:12 GMT)
A mixed-integer program for circuit execution time minimization with precedence constraints [2.0] 本稿では,実行時間を最小化するために,量子回路をスケジューリングするための混合整数プログラミングモデルを提案する。
提案手法は、重複しないゲート(異なるキュービットに作用するゲート)を同時に実行することによって並列性を最大化する。
MIPスケジューラは、グレーディや層状アプローチよりも回路実行時間が短く、最大24%節約できることを示した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 16:06:09 GMT)
crowd-hpo: Realistic Hyperparameter Optimization and Benchmarking for Learning from Crowds with Noisy Labels [2.0] クラウドワークは、クラスラベルを取得するためのコスト効率のよいソリューションである。
群衆から学ぶための様々なアプローチが提案されている。
Crowd-hpoは、現実的なベンチマークおよび実験プロトコルである。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 05:36:16 GMT)
InterQ: A DQN Framework for Optimal Intermittent Control [1.4] 強化学習による離散時間線形システムの通信制御協調設計について検討する。
最適なスケジューリングポリシを開発するために,深層ニューラルネットワークを用いてQ関数を近似する深部強化学習アルゴリズムであるInterQを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 01:18:53 GMT)
Automating Transfer of Robot Task Plans using Functorial Data Migrations [1.4] ファクタは、計画ドメイン間の構造化されたマップを提供し、計画の再設計を必要とせずにタスクプランの転送を可能にする。
本稿では,AI2-THOR Kitchen環境と互換性のあるタスクプランを標準Blocksworldドメインから移行することで,このアプローチを実証する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:06:26 GMT)
Using Vision Language Models for Safety Hazard Identification in Construction [1.2] 本稿では,建設リスクの同定のための視覚言語モデル(VLM)に基づくフレームワークを提案し,実験的に検証した。
GPT-4o, Gemini, Llama 3.2, InternVL2を含む最先端のVLMを1100の建設現場画像のカスタムデータセットを用いて評価した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 05:11:23 GMT)
Parameterized Synthetic Text Generation with SimpleStories [1.1] 本稿では,英語と日本語のそれぞれに200万の物語からなる,単純な言語による大規模な合成物語データセットを提案する。
提案手法では,複数の抽象化レベルの特徴を持つプロンプトのパラメトリゼーションを用いて,物語の特徴を体系的に制御することができる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 11:44:47 GMT)
Mesoscopic cavity quantum electrodynamics with phase-disordered emitters in a Kerr nonlinear resonator [1.1] 量子光学において新しいハミルトニアンを実現することができる数エミッターキャビティQEDシステムを示す。
この研究は、新しい提案を実現し、量子電磁力学における基礎物理学を研究するための固体欠陥系の可能性を示す。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 19:55:06 GMT)
A Multi-Layered Security Analysis of Blockchain Systems: From Attack Vectors to Defense and System Hardening [1.1] Bitcoinの応用により、ブロックチェーン技術は徐々に理解できるようになる。
ブロックチェーン技術のインターネットへの初期の適用により、ブロックチェーン技術のセキュリティも広く関心を集めてきた。
本稿では、ブロックチェーンシステムのデジタル通貨取引プラットフォームが直面するセキュリティ上の脅威をまず分析する。
次に、ブロックチェーン2.0と密接に関連するスマートコントラクトのセキュリティ問題を分析し、ブロックチェーンパブリックチェーン、コンセンサスメカニズム、P2Pのセキュリティ脅威を分析し、研究する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 11:23:47 GMT)
Footprints of Data in a Classifier: Understanding the Privacy Risks and Solution Strategies [0.9] 一般データ保護規則(Right Erasure)第17条は、潜在的な妥協を防ぐために、システムから永久にデータを除去することを要求する。
そのような問題の1つは、予測モデルに埋め込まれたトレーニングデータの残余のフットプリントから生じる。
本研究は,分類器システムの2つの基本的な側面 – 訓練品質と分類器訓練方法 – が,プライバシの脆弱性にどのように寄与するかを検討する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 08:36:16 GMT)
Efficient Implementation of Reinforcement Learning over Homomorphic Encryption [0.8] 制御ポリシ合成をモデルベース,シミュレータ駆動,データ駆動のアプローチに分類する。
プライバシー強化のための完全同型暗号(FHE)の実装について検討する。
私たちの研究は、セキュアで効率的なクラウドベースの強化学習の可能性を示している。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 20:34:26 GMT)
The boundary of Kirkwood-Dirac quasiprobability [0.8] カークウッド・ディラック準確率(Kirkwood-Dirac quasiprobability)は、合同量子観測器の測定統計を記述している。
我々は、KD準確率の外部境界を与えるため、軽微な仮定の下で量子後準確率を導入する。
驚くべきことに、古典的確率とKD準確率の両方に有効ないくつかの非自明な境界を導出することができる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 14:23:36 GMT)
Optimizing FDTD Solvers for Electromagnetics: A Compiler-Guided Approach with High-Level Tensor Abstractions [0.7] 差分時間領域シミュレーションのためのMLIR/LLVMインフラストラクチャに基づくエンドツーエンドのドメイン固有コンパイラを提案する。
我々は3次元のカーネルを明示的な計算意味論を持つ3次元テンソル抽象の演算として実装する。
ループタイリング、融合、ベクトル化といったハイレベルな最適化はコンパイラによって自動的に適用される。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 08:08:12 GMT)
Evaluating probabilistic and data-driven inference models for fiber-coupled NV-diamond temperature sensors [0.7] 連続波光磁気共鳴(ODMR)測定による温度推定における推定モデルが不確実性に与える影響について検討した。
このモデルでは、スピンハミルトンパラメータの温度依存性を利用して、ODMRデータのスペクトル特徴から温度を推定する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 19:48:13 GMT)
Enhancing Tourism Recommender Systems for Sustainable City Trips Using Retrieval-Augmented Generation [0.7] 本稿では,大規模言語モデルと改良型検索拡張パイプラインを用いて,持続可能な都市旅行を実現するための新しいアプローチを提案する。
我々は,都市の人気度と季節的需要に基づいて,サステナビリティ指標を組み込むことで,従来のRAGシステムを強化した。
Sustainability Augmented Re rank (SAR)と呼ばれるこの修正は、システムの推奨事項と持続可能性の目標との整合性を保証する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 19:45:38 GMT)
Improving the Accuracy and Efficiency of Legal Document Tagging with Large Language Models and Instruction Prompts [0.7] Legal-LLMはLarge Language Models (LLM) の命令追従機能を利用する新しいアプローチである。
提案手法は,マイクロF1とマクロF1スコアを用いて,POSTURE50KとEURLEX57Kの2つのベンチマークデータセット上で評価する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 18:57:04 GMT)
Convergence of the Stochastic Heavy Ball Method With Approximate Gradients and/or Block Updating [0.6] 我々は,より一般的な条件下でのヘビーボール (SHB) アルゴリズムの収束を確立する。
我々の解析は凸関数だけでなく、PL(Polyak-Lojasiewicz)およびKL(Kurdyka-Lojasiewicz)条件を満たすより一般的な関数も受け入れている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 14:51:39 GMT)
Machine Learning-Based Cyberattack Detection and Identification for Automatic Generation Control Systems Considering Nonlinearities [0.6] AGCシステムの通信計測への依存は、それらを偽データ注入攻撃(FDIA)に晒す
本稿では、FDIAを識別し、漏洩した測定値を決定する機械学習(ML)ベースの検出フレームワークを提案する。
その結果,F1スコアは99.98%,FDIAは99.98%であった。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 23:06:59 GMT)
Label-free segmentation from cardiac ultrasound using self-supervised learning [0.6] コンピュータビジョン,臨床領域知識,深層学習を用いた自己教師型(手動ラベルなし)セグメンテーションのためのパイプラインを構築した。
8,393枚の心エコー画像(4,476,266枚,平均61年,女性51%)を用いて,450枚の心エコー画像(93,000枚)をトレーニングし,生体計測値の算出を行った。
本研究は,超音波からのセグメンテーションのための手動ラベルフリー,臨床的に有効な,高度にスケーラブルな方法であることを示す。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 02:31:32 GMT)
Unleashing Optimizations in Dynamic Circuits through Branch Expansion [0.2] 条件分岐を体系的に拡張・洗練する新しい手法を提案する。
本手法は,既存のトランスパイラを補完し,分岐特異な単純化を行う。
本手法は,動的回路の動作経路の深さとゲート数を一定に削減できることを示す。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 14:18:27 GMT)
Bipartite Relativistic Quantum Information from Effective Field Theory Approach with Implications to Contextual Meanings of Locality and Quantumness [0.0] ブラックホールの有無にかかわらず2つの静的UDWチャージ量子ビットの相対論的量子情報(RQI)について検討する。
メディエータ場の量子状態のRQIはUDW検出器の最終状態の減少によって探索することができる。
QFTとRQIは、異なる物理的理由に基づいて量子性に同意するが、局所性には同意しない。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:20:24 GMT)
WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization [0.0] 芸術的なイメージスタイリングは、テキストや画像が提供するコンテンツをターゲットスタイルでレンダリングすることを目的としている。
コンテンツとスタイルのゆがみの現在の手法は、画像の監督に依存している。
本稿では,芸術的イメージスタイリングのためのコンテンツスタイルのゆがみに対するマルチモーダルアプローチを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:23:37 GMT)
Understanding Intention to Adopt Smart Thermostats: The Role of Individual Predictors and Social Beliefs Across Five EU Countries [0.0] スマートサーモスタットの採用は、その機能に関する個々の信念と強く関連しているように見える。
本稿の最後には、スマートヒーティング技術のポリシー作成とマーケティングの意義について論じる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:09:35 GMT)
Towards Optimal Differentially Private Regret Bounds in Linear MDPs [0.0] 我々は、LSVI-UCB++を民営化し、オフラインRLから分散認識解析に適応させることにより、新しい微分プライベートアルゴリズムを設計する。
我々のアルゴリズムは、以前のプライベートメソッドよりも改善され、$widetildeO(d sqrtH3 K + H4.5 d7/6 K1/2 / epsilon)$の後悔の限界を達成する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 20:51:51 GMT)
Towards On-Device Learning and Reconfigurable Hardware Implementation for Encoded Single-Photon Signal Processing [0.0] ワンシッド・ジャコビ回転型オンラインシーケンス・エクストリーム・ラーニング・マシン(OSOS-ELM)に基づくオンライン・トレーニング・アルゴリズムを提案する。
我々は、ARMコアを統合した異種FPGA上でOSOS-ELMを実行する際の並列性を完全に活用する。
単一光子信号解析を含む3つのケーススタディにより,本手法の有効性を検証した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 00:58:52 GMT)
Time operator from parametrization invariance and implications for cosmology [0.0] 対応する量子作用素を定義し、その結果、消滅するハミルトニアンと正則に共役する。
宇宙論的な設定で導入された時間変数の一般的な式を導出する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:48:42 GMT)
Spin Squeezing via One-Axis Twisting in a Quadrupolar NMR system under relaxation effects [0.0] スピンスクイーズの起源は、核四極子モーメントと分子環境における電場勾配との相互作用に起因する。
非カルテシア角運動量作用素が提案され、その分散は力学中に量子効果を捉える。
任意のスピン量子数に対して、スクイーズパラメータの上限と熱平衡におけるハイゼンベルクの不確実性も予測される。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 01:38:37 GMT)
Spatial and temporal circuit cutting with hypergraphic partitioning [0.0] 本稿では,空間的シナリオと時間的シナリオの両方に適したハイパーグラフに基づく回路切断手法を提案する。
量子回路を高レベルハイパーグラフとしてモデル化することにより、Stoer-Wagner、Fiduccia-Mattheyses、Kernighan-Linなどの分割を適用できる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 20:31:07 GMT)
Revisiting Lamb Shift Theory through Brownian Motion of the Proton [0.0] 本稿では,水素原子におけるラムシフトの理論的導出について述べる。
従来の量子電磁力学(QED)とは異なり、提案手法は実験的に適合するパラメータを導入せず、完全に既知の物理量に基づく完全自己整合的な説明を提供する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 11:16:06 GMT)
Privacy Preservation in Gen AI Applications [0.0] LLM(Large Language Models)は、意図せずユーザインタラクションからPII(Personally Identible Information)を吸収し、明らかにする。
ディープニューラルネットワークの複雑さは、プライベート情報の意図しない保存とリリースの追跡や停止を困難にしている。
本研究では,データ抽出やモデルインバージョン,メンバシップ推論といった攻撃を通じて生成AIの弱点を検出することで,これらの問題に対処する。
LLMを扱う前にPIIを識別、変更、削除する手法を使用することで、機能を犠牲にすることなくプライバシを確保する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 06:19:37 GMT)
Non-Markovian spontaneous emission in a tunable cavity formed by atomic mirrors [0.0] 導波管型量子電磁力学装置に配置した2レベル試験原子の非マルコフ自然放出ダイナミクスを解析した。
テスト原子の非マルコフ力学とフィールドの創発スペクトル密度を解析した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 16:54:36 GMT)
Neural Posterior Estimation on Exponential Random Graph Models: Evaluating Bias and Implementation Challenges [0.0] 指数乱数グラフモデル(ERGM)のためのニューラルリテラル推定(NPE)の最初の体系的実装を提案する。
NPEは、難解なERGM確率に対する解法推定の異なる角度を提供するが、NPEのアモータイズ特性を用いてより効率的でスケーラブルな推論を可能にする。
我々の研究は、NPEの採用に特別な課題を課す可能性があるERGM固有の領域に焦点を当てている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 21:37:11 GMT)
Narrative Context Protocol: an Author-centric Storytelling Framework for Generative AI [0.0] 本研究では,ナラティブ・コンテキスト・プロトコル (NCP) を提案する。
客観的な物語モデルに従って著者の意図を符号化することにより、NCPは物語の移植性と、生成システムに対する意図に基づく制約を可能にする。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 18:17:10 GMT)
Local Temporal Feature Enhanced Transformer with ROI-rank Based Masking for Diagnosis of ADHD [0.0] 我々は、静止状態磁気共鳴(rsf-MRI)から重要な脳バイオマーカーを効果的に検出できるADHD診断変換器モデルを提案する。
このモデルは個々の特徴を学習するだけでなく,ADHD診断における注意構造との相関も学習する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 02:03:35 GMT)
Laser Scan Path Design for Controlled Microstructure in Additive Manufacturing with Integrated Reduced-Order Phase-Field Modeling and Deep Reinforcement Learning [0.0] レーザーパウダーベッド融合(L-PBF)は広く知られている添加物製造技術である。
L-PBFの鍵となる課題は、製品品質に影響を与える複雑なミクロ構造の形成である。
本稿では,物理誘導型機械学習による走査経路の最適化手法を提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 00:27:23 GMT)
Large Language Models integration in Smart Grids [0.0] 大規模言語モデル(LLM)は私たちの社会の運営方法を変えつつあり、間違いなく電力システムにも影響を及ぼすでしょう。
本稿では、8つの主要なカテゴリにわたる30の実世界のアプリケーションについて包括的に分析する。
データプライバシやモデルの信頼性といった重要な技術的ハードルと、可能なソリューションについて検討する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:29:30 GMT)
Large Language Models as Particle Swarm Optimizers [0.0] LMPSOでは、各粒子の速度は次の候補解を生成するプロンプトとして表される。
提案したLMPSOアプローチは,トラベリングセールスマン問題(TSP)を含む複数の問題領域にまたがって評価される。
実験の結果,LMPSOは,解が構造化シーケンスとして表される問題に対して特に有効であることが示された。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:04:13 GMT)
Ground State Energy of He molecule Using a Four-Qubit Photonic Processor with the Variational Quantum Eigensolver [0.0] 我々は、He分子基底状態エネルギーを計算するために量子プロセッサアプリケーションを探索した。
その結果,従来の計算手法に比べて精度が大幅に向上した。
この研究は、量子化学、計算物理学、データ科学の分野における量子プロセッサの可能性を強調している。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 12:23:11 GMT)
From spin to pseudospin symmetry: The origin of magic numbers in nuclear structure [0.0] マジックナンバーは核構造の中心にあり、閉じた殻を持つ核の安定性が向上していることを反映している。
カイラル有効場理論から導かれた核相互作用における運動量分解能の異なるシェル構造の進化について検討する。
スピン対称性から擬スピン対称性への普遍的な遷移は、分解スケールが小さくなるにつれて明らかとなり、魔法の数が自然に現れる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:26:47 GMT)
Explorer: Robust Collection of Interactable GUI Elements [0.0] 私たちは、あるユーザに対して、あるアプリやデジタル環境を通じて、関連するUI要素が正しく検出されていることを、いかに信頼する必要があるかを示します。
Proposed Explorerシステムは、トレーニングプロセスがアプリケーションのライブバージョンにアクセス可能なオンスクリーンボタンとテキスト入力フィールドを検出することに焦点を当てている。
Explorerはまた、インタラクティブなユーザーセッションの記録を可能にし、その後のセッションがどのように重複し、時として同様の状態に戻るかのマッピングを可能にする。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 22:02:29 GMT)
Enhancing Dialogue Systems with Discourse-Level Understanding Using Deep Canonical Correlation Analysis [0.0] 談話レベルの理解のために,Deep Canonical correlation Analysisを統合した新しいフレームワークを提案する。
このフレームワークは会話トークンを学習し、発話と周囲の文脈の関係を捉える。
Ubuntuダイアログコーパスの実験では、応答選択の大幅な向上が示されている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 06:19:08 GMT)
Closer look at sum uncertainty relations and related relations [0.0] 量子系の状態のヒルベルト空間におけるベクトルのノルムの不等式から続く様々な不確実性関係の弱かつ臨界点を解析する。
ハイゼンベルク・ロバートソンの不確実性関係に現れる標準偏差の積の上界が存在することを示す。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 08:11:00 GMT)
Can postgraduate translation students identify machine-generated text? [0.0] 本研究では、言語訓練を受けた個人が、人文からの機械出力を識別する能力について検討する。
23人の大学院翻訳生がイタリア語の散文の抜粋を分析し、人書きかAI生成かを示すために可能性スコアを割り当てた。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 09:58:09 GMT)
Can Large Language Models Detect Verbal Indicators of Romantic Attraction? [0.0] 以上の結果から,ChatGPTはスピードデートの成功の客観的指標と主観的指標の両方を予測できることがわかった。
われわれの発見は、ChatGPTがどのようにしてその予測に到達し、それが犯す誤りについて洞察を与える。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 20:24:02 GMT)
Can Large Language Models Become Policy Refinement Partners? Evidence from China's Social Security Studies [0.0] 大規模言語モデル(LLM)の急速な開発は、複数の分野にまたがる運用パラダイムを再構築している。
本研究では,中国の社会保障問題に対する政策レコメンデーション作成におけるLCMの能力境界と性能特性について検討した。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 08:50:12 GMT)
CI-RKM: A Class-Informed Approach to Robust Restricted Kernel Machines [0.0] 制限されたカーネルマシン(RKM)はカーネルマシンファミリー内の汎用的で強力なフレームワークである。
本稿では,クラスインフォームド重み付き関数を統合することにより,RKMフレームワークの新たな拡張を提案する。
提案手法は,カーネルベースの学習モデルの開発において,大きな進歩をもたらす。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 11:12:30 GMT)
Authoritarian Recursions: How Fiction, History, and AI Reinforce Control in Education, Warfare, and Discourse [0.0] この研究は、AI技術が権威主義的制御の構造をいかに再現するかを研究するために、混合メソッドのアプローチを採用する。
この研究は、未確認の自律性、アルゴリズムの不透明度、監視正規化、構造バイアスの増幅など、繰り返し発生する害パターンを特定する。
この発見は、歴史、批判的社会理論、技術設計からの教訓を統合する包括的な倫理的枠組みを求めている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 01:01:26 GMT)
Application of Contrastive Learning on ECG Data: Evaluating Performance in Japanese and Classification with Around 100 Labels [0.0] 心電図(ECG)は、その強力で非侵襲的な性質から、心臓血管診断の基本的なツールである。
機械学習の最近の研究は、ECGデータから貴重な情報を抽出することでこの問題に対処している。
全国の病院に来院した一般患者からの心電図データを利用して,多くの日本人ラベルを保有した。
比較学習の枠組みを用いて,98のラベルを分類しても,日本語の言語モデルは従来の研究に匹敵する精度を達成できることがわかった。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 18:20:44 GMT)
An Exact Link between Nonlocal Magic and Operator Entanglement [0.0] 非安定化剤性(英: Nonstabilizerness、通称マジック)は、その準備に必要な非クリフォード資源に関連する状態の量子的性質である。
我々は,非局所魔法の生成と演算子の絡み合いを,ユニタリ進化の下で正確に対応させる。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 22:40:04 GMT)
Adiabatic Encoding of Pre-trained MPS Classifiers into Quantum Circuits [0.0] 本稿では,事前学習したMPS分類器をポストセレクション付き量子MPS回路に符号化し,性能を維持しながら徐々にポストセレクションを除去するフレームワークを提案する。
我々は、ある人工データセット上で、qMPS分類器をスクラッチから訓練することは、不規則な高原のために指数関数的に難しいことを証明しているが、我々の断熱符号化はこの問題を回避している。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 15:12:46 GMT)
A Practical Approach to using Supervised Machine Learning Models to Classify Aviation Safety Occurrences [0.0] 本稿では,教師付き機械学習(ML)モデルを用いて航空事故を事故または重大事故のカテゴリーに分類する実践的アプローチについて述べる。
現在,ML Webアプリケーションとして実装されている実装は,一般の航空調査報告から得られたデータセットに基づいて訓練されている。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 03:46:33 GMT)
A Multi-view Discourse Framework for Integrating Semantic and Syntactic Features in Dialog Agents [0.0] マルチターン対話モデルは,会話の文脈を利用して人間的な応答を生成することを目的としている。
既存の手法はしばしばこれらの発話間の相互作用を無視したり、それら全てを等しく重要なものとして扱う。
本稿では,検索に基づく対話システムにおける応答選択のための談話認識フレームワークを提案する。
論文参考訳(メタデータ) (Sat, 12 Apr 2025 04:22:18 GMT)