Ceiling of a Task: When Can a Transformer Succeed Without Its Chain of Thought? [84.0] 推論モデルは、答える前に長いチェーンの思考を生成する。
これらの鎖の内容が実際の計算作業を行うか、大半が装飾的であるかが議論されている。
各変圧器に保持されるシリアルタスクについて3つの結果を示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:02:40 GMT)
Naturalness-guided Manifold Flow Matching for Sign Language Production [78.4] テキストから手話の動きを生成するための自然言語誘導マニフォールドフローマッチングフレームワークを提案する。
多様体の固有幾何を利用して、運動分布を特徴付ける運動自然度尺度を導入する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:12:10 GMT)
YuE2: Unifying Symbolic and Audio Music Generation at Frontier Quality [74.6] 我々は,記号プランニングにより,フロンティア品質の象徴的およびオーディオ音楽生成を統一するYuE2を紹介する。
1つのAR-NAR Mixture-of-Transformers (MoT)は、まずメロディとハーモニーを指定する可読性スコアを書き、セマンティックミュージックトークンに拡張し、フルソングオーディオとして実現する。
専門家の聞き取りは、プロプライエタリな曲のジェネレータとの競争力をさらに確立し、Suno v4.5よりも8のベストを保ち、Suno v5に対してほぼバランスの取れた好みを与える。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:55:13 GMT)
Opera: A Verbal Critic Framework for Long-horizon Coding Agents [74.6] 本稿では,各修正を永続的なノートとして扱う言語批判フレームワークであるOperaについて紹介する。
Operaは、周期的およびイベント駆動のトリガを通じていつレビューするかを決定し、型付きオペレーターと問題を診断し、配信前に可視的な証拠に対するフィードバックを監査し、エージェントのその後のアクションを追跡して、単なるコンプライアンスと実際の解決を区別する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:42:57 GMT)
TeacherGRPO: Closing the Capacity Gap in Reasoning Distillation via Teacher Alignment [70.4] 強力な教師モデルから小さな学生への蒸留はギャップカースに面している。
教師がより高度に成長するにつれて、複雑な分布は生徒が近似できるものから多様化し、パフォーマンスが低下する。
本研究では,教師がデータを捨てたり,推論品質を劣化させたりすることなく,直接生徒の分布に適応する教師アライメントを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:13:54 GMT)
On the Token Value Inequality in Efficient Reasoning [68.7] 連鎖推論により、大規模な言語モデルによって複雑なタスクにおいて大幅なパフォーマンス向上が達成された。
推論トレースのすべてのトークンは、同等に価値がありますか?
本稿では,重要な経験的発見を基盤とした診断・最適化フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:15:38 GMT)
IVT-Guard: All-in-One Reasoning Model for AI-Generated Content Detection [68.6] 本稿では,画像,ビデオ,テキストモダリティ間でAIGC検出を統一かつ解釈可能なフレームワークであるIVT-Guardを提案する。
IVT-Guardは、ドメイン内、ドメイン外、データセット間における最先端検出性能を達成する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:00:55 GMT)
One Attack to Fool Them All: Highly Transferable Black-Box Adversarial Attacks on Frontier MLLMs [68.3] 敵対的攻撃は長い間、機械学習システムに根本的な脅威をもたらしてきた。
我々は高度に転送可能なブラックボックス攻撃フレームワークであるO-Attackを提案する。
O-AttackはGPT-5.4(29.1%から77.2%)、Claude-4.6(42.8%から81.6%)、Gemini-3.1(38.2%から80.9%)で攻撃成功率を上げる
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:33:38 GMT)
CoLMbo-SV: A Grounded Language Model for Explainable Speaker Verification [54.8] 我々は,強い話者識別と構造的,音響的な比較報告を組み合わせた話者言語モデルであるtextbfCoLMbo-SVを提案する。
事前訓練された話者エンコーダを言語モデルに接続し、明示的な音響測定を提供することにより、CoLMbo-SVは、その報告で発声された証拠に対する検証を制限することなく、音声比較を検査できるようにする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 04:51:53 GMT)
DISCERN: Can AI Agents Work Like Scientists and Guide Discovery? [54.8] 私たちは、自動研究ワークフローの3つの重要なレベルを評価するために、実際に利用可能なデータセットのベンチマークであるdisCERNを紹介します。
エージェントはレベル1の60.8%、レベル2の34.2%、レベル3の評価の0.6%で完璧なスコアを得る。
これらのプロファイルは、科学的な援助を監督する機会を特定するが、現在のエージェントは信頼できる自律的な分析や発見をまだ示していない。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:29:32 GMT)
PPG-LM: A Photoplethysmography-Language Model with Multi-Level Clinical Alignment [53.7] Photoplethysmography (Photoplethysmography)は、臨床モニターや消費者向けウェアラブルによって広く記録されている。
PPG-LMは,ERHで捉えた信号由来の監督とより広い臨床状況から生理的表現を学習する最初のPPG言語モデルファミリーである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:38:47 GMT)
Beyond Solo and Consistency: Vindicating Multi-Agent Debate via Conditional Progressive Pruning [52.1] マルチエージェント・ディベート(MAD)は、最も効果的なテスト時間スケーリング手法の1つである。
既存のMADフレームワークは、同じ厳格なコスト制限の下で、強力なSingle AgentとConsistencyベースのベースラインを破ることができません。
マルチラウンドMADを完全に活用する軽量プルーニングフレームワークである Conditional Progressive Pruning (CPP) を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:16:04 GMT)
Local LMO is Secretly a Projection Method! [51.6] 局所線型オラクル (Local LMO) は射影を計算することなく制約付き凸問題を解く。
局所LMOは、半空間の局所化の深さによってインデックス付けされるような、より広い射影法に属することを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:03:50 GMT)
The Undetected Damage of Quantization on Retrieval and How to Fix It [51.0] 分類精度を保った量子モデルでは,トップ1検索結果の14ドルから46%の値がまだ変化していることを示す。
この失敗を2つの上位モデルスコア間のギャップに結び付け、そのギャップを使用して、定量化された回答をいつ信頼するかを決めます。
この差が最大の丸め誤差の2倍を超える場合にのみ、トップ1結果が量子化を継続することが保証されていることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:43:31 GMT)
Save Your Saturated Data: Learning Beyond Reward Saturation in Group-Based RL [51.0] グループ相対強化学習は、サンプル応答の報酬変動に依存する。
言語モデルがますます有能になるにつれて、既存のトレーニングデータが報酬飽和状態になる可能性がある。
このような飽和データから有用な学習信号を回収できるかどうかを検討する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 02:50:57 GMT)
ManiEdit: Sequential Unstructured Knowledge Editing for Language Models from a Manifold Perspective [49.8] 既存のモデル編集手法は、構造化されていない長文の知識を逐次編集するのに苦労する。
ManiEditは、2つのコアコンポーネントからなる新しい多様体対応編集フレームワークである。
ManiEditは最先端のパフォーマンスを実現し、最強のベースラインである+27.81 BERTScoreと+8.50 ROUGE-Lを上回った。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:02:43 GMT)
TraceDance: An Automated System for Building Agent Behavior Benchmarks from Real-World Agent Deployment Traces [49.6] TraceDanceは、ユーザが指定した望ましくない振る舞いのデプロイメントトレースからターゲットベンチマークを構築するエージェントシステムである。
効率的な構築のために、Anchor-and-Confirmはプログラム可能な検索と、Flash大言語モデルによる候補レベルの確認を組み合わせる。
コーディングと一般的なツールの実験では、252,557のセッションで描画され、ビルドターゲット要求の95.3%を満たす4,125のインスタンスで107のベンチマークを生成する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:58:39 GMT)
Hamiltonian JEPA: Action-Conditioned World Models with an Inherited Control State [49.5] ピクセルからの計画には、安定かつ予測可能な潜在空間以上のものが必要である。
統合埋め込み予測アーキテクチャ(JEPA)は、将来の表現を予測することでピクセル再構成を避ける。
我々はこの2つを分離するH-JEPAを紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:05:41 GMT)
TaskAnchor: Grounding Task State in Reactive VLAs for Long-Horizon Manipulation [49.0] TaskAnchorは、VLAのネイティブ入力空間に実行コンテキストを注入することで、タスク状態をグラウンドする軽量アダプタである。
RMBench上のpi0.5とX-VLAのベースラインの平均成功率は約6倍となり、RoboMemArena上でのpi0.5のタスク成功率は2倍になる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:49:31 GMT)
The Price of Locality: Why Forward-Forward Underperforms Backpropagation? [48.8] フォワードフォワードアルゴリズム(FFA)は、バックプロパゲーションをレイヤワイドな局所的なコントラッシブな目的に置き換える。
本稿では、同時更新による最適化フロアと、局所更新機構によって駆動されるレイヤ表現の幾何学的崩壊という、2つの構造的障害モードを診断する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:27:55 GMT)
Understanding Confabulation and Rethinking Reconstruction in Activation Explanations [48.4] 自然言語オートエンコーダ(NLA)は、モデルのアクティベーションに関する教師なしのテキスト説明を生成する。
Flow-NLAは、説明と互換性のあるアクティベーションの分布をモデル化し、拡散バウンダリを用いて言語化を訓練する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:04:31 GMT)
You Only Edit Once: Incentivizing In-Context Capability of LLMs via Local Demonstration Refinement [48.4] 大規模言語モデル(LLM)の推論性能向上には,インコンテキスト学習(ICL)が不可欠である。
本研究は,制約付き局所探索問題としてフレーミングすることで選択を簡略化し,局所的な実演編集(LDE)を行う。
テスト時に、Jev-LDEは検索したデモセットの1つの編集を実行し、続いてターゲットのLSMからの1つの推論を実行し、反復的なコンテキストスコアリングやサブセット検索を回避する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:26:28 GMT)
FeCoSplat: Feedback-Guided Compression for Feed-Forward 3D Gaussian Splatting [48.0] フィードフォワード3DGSのためのフィードバック誘導圧縮フレームワークを提案する。
実験により、FeCoSplatは、特に低速で、良好な速度歪曲性能が得られることが示された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:01:29 GMT)
PhysAlign: A Benchmark for Evidence-Grounded Role Alignment in Multimodal Physics Reasoning [44.0] 物理図理解の鍵となる課題は、視覚情報をそれが記述する物理的実体、関係、条件と正しく関連付けることである。
PhysAlignは、マルチモーダルモデルが物理図から認識された情報をその物理的役割と正しく関連付けるかどうかを評価するために設計されたベンチマークである。
これには、986の物理問題にまたがる3,341個の人間検証プローブが含まれており、視覚認識と物理的ロール対応の体系的な評価を可能にしている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:34:22 GMT)
InfoEdit: Probing Global Layout Reasoning in Infographic Editing [43.9] 本研究では,8つの論理関連ファミリーを対象とした1000のインフォグラフィックのベンチマークと,4つの編集タスク間で4,000の編集命令との組み合わせ,およびリフロー対応評価プロトコルを提案する。
8つのフロンティアエディタにまたがって、GPT-Image-2だけが平均成功率の60%をクリアしている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:45:45 GMT)
Just Let Linear States Forget the Distant Past: Prefix Caching via Suffix Replay for Hybrid LLMs [43.4] ハイブリッドLLMは、長いコンテキスト推論コストを削減するために、リニアアテンション層とフルアテンション層をインターリーブする。
フルアテンションKVキャッシュはトークン対応可能であるが、リニアアテンションレイヤは任意の接頭辞境界にロールバックできないリカレントステートを保持する。
SuffixReplayは、LLMがキャッシュをサポートするすべてのページ境界でキャッシュされたプレフィックスを再利用できるようにする最初のプレフィックスキャッシュシステムである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:43:56 GMT)
Green AI: Cost of LLM-Based Code Completion [43.4] コード補完は、ソフトウェア開発において、大規模言語モデル(LLM)の最も広く使われているアプリケーションの1つである。
LLMの精度が向上したにもかかわらず、推論のエネルギーコストは未調査のままである。
本研究では,LLMコード補完における精度とエネルギー消費のトレードオフについて検討する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:54:10 GMT)
BOReFT: Manifold Steering of Language Models for Black-box Optimization [43.3] 本稿では,凍結言語モデルにおける隠れ状態介入のコンパクトで低次元空間を学習するBOReFTを紹介する。
学習領域は意味領域にまたがり,検索を支援するスムーズ性を示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:25:26 GMT)
QuPID: Quantum Parameter-Efficient Input-Dependent Retrieval Adaptation for Medical RAG [43.2] QuPIDは、量子パラメータ効率の入力依存型検索適応である。
凍結した画像の特徴を限られたデータでローカルアーカイブに適応させる。
凍った医療エンコーダよりも、ChestX-ray14とmuraでAT-5(P@5)の精度が高い。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:22:58 GMT)
ReDrive: Shaping Representations with World Modeling for End-to-End Driving [43.1] ReDriveは、将来の表現予測を通じて計画指向の視覚的特徴を強化するエンドツーエンドの駆動フレームワークである。
NAVSIMの実験では、NAVSIM v1では91.0PDMS、NAVSIM v2では90.8Sを達成した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:12:15 GMT)
FORUM: Frozen Outputs Reconciled Using Model Agreement for Visual Grounding [38.5] 凍結MLLMを2つの固定幾何規則でガイドした無トレーニング試験時間融合であるFOUMを提案する。
Forumは、Ref-Adv-sベンチマークの平均精度の平均5%で397B-パラメータを上回ります。
標準のRefCOCO+への利得の推移と、支配的なメンバーを持たないバランスの取れたラインナップは、まだ397Bモデルを5%上回っている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:33:20 GMT)
SketchSSM: Write to the Full State, Read from a Compact Sketch [38.3] 我々はSketchSSMを導入し、読み取りを近似しながらフルステート更新を保存する。
SketchSSMは、4つのデコードベンチマークで状態アクセストラフィックを約10倍削減し、4つのRULER検索タスクをリコールする。
1つのNVIDIA B300では、標準的なvLLMベースライン上のリニアアテンションカーネルのスピードアップが、それぞれMamba-2、GDN、KDAの7.78x、5.22x、および5.20xに達し、Nemotron 3 Superの2.64倍高いデコードスループットを持つ。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 00:31:35 GMT)
When to Evict, Not What to Keep: Draft-Guided Eviction for Training-Free KV-Cache Compression [38.0] SnapKV、H2O、PraamidKVといったKVキャッシュ圧縮手法は、プリフィルの終了時にトークンを除去する。
この目的が2つの異なる方法で失敗することを示します。
Draft-Guided Eviction は、完全なキャッシュを使用して最初の k=2 の応答トークンをドラフトした後まで、eviction をデフレする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:04:59 GMT)
MoGround: Measuring and Mitigating Modality Distraction in Vision-Language Models [37.9] MoGroundは、4つの視覚領域にまたがるビジョン言語データセットで、すべての質問に対する回答が、正確に1つのモダリティから利用できることが保証されています。
この保証により、あるモデルが1つのモダリティのみから正しい解答をした後、他のモダリティから無関係な内容が加わったとき、間違った解答に切り替えるという、モダリティの逸脱を測定することができる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:29:40 GMT)
SpatialSpeak: QA-Native Reconstruction with Local and Global Context for Spatial Chain-of-Thought Reasoning [37.9] 視覚言語モデル(VLM)は、多視点空間推論の幾何学的先行の恩恵を受けることができる。
解答のみのトレーニングは、中間幾何学的推定と定量的空間的回答の導出におけるそれらの使用を直接監督するものではない。
本研究では,空間的CoT学習と事前学習を結びつける2段階のフレームワークであるSpatialSpeakを紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:31:57 GMT)
Achieve What You Imagined: Learning to Align Actions with Visual Plans [37.7] 世界行動モデルは、将来の視覚的な観察とロボットのアクションを共同で予測することができる。
視覚的予測と、生成された行動によって引き起こされる結果の間には、相違がある可能性がある。
我々は、フリーズされた行動条件付き世界モデルを用いて、行動条件付き結果の予測とフィードバックの構築を行う。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:32:40 GMT)
ALDER: Discovering the Laws of a World by Acting in It [37.6] 本稿では,モデルのテストと修正のための新しい実験を積極的に提案するALDERを紹介する。
競合する有効な仮説を区別するために、コストと安全を意識したセレクタクエリの介入を行う。
結果として得られた反例は証拠台帳を更新し、次の構造修正を導く。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:30:08 GMT)
LoopTrack: A Simple Baseline for Parameter-Efficient Transformer Tracking [37.5] 現在のTransformerベースのトラッキング手法は、ターゲットテンプレートとターゲットローカライゼーションのための検索領域間の相互作用をモデル化するために、複数のTransformerブロックを別々のパラメータでスタックするのが一般的である。
そこで本研究では,ループ型アーキテクチャにおいて,パラメータを共有した一連のTransformerブロックを繰り返し適用し,パラメータ効率のよいTransformer追跡フレームワークであるLoopTrackを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:17:44 GMT)
DexTaG: Tactile-as-Guidance in Reinforcement Learning for Dexterous Manipulation [37.3] グラブベースのモーションキャプチャーは、デクスタラスハンドのデモデータを収集するためのスケーラブルなアプローチとして現れている。
人手とロボット手の間の運動的ギャップのため、記録された人間の動作を直接ロボットに実行することはできない。
触覚誘導型RLフレームワークであるDexTaGを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:56:41 GMT)
AevaScenes: An FMCW LiDAR Dataset and Benchmark for Long-Range Perception [37.0] 我々は16の検出クラスに800万以上の注釈付き3Dボックスと24のセマンティッククラスにまたがるポイント毎ラベルを持つ575のシーケンス(57.5Kフレーム)からなるFMCW LiDARデータセットを提案する。
3次元オブジェクト検出、シーンフロー推定、セマンティックセグメンテーションの3つのタスクでベンチマークを定義する。
遠距離車両や歩行者のAP検出において,特に低レイテンシ単一フレーム設定において,最大2倍の大幅な改善が見られた。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:16:14 GMT)
Deep Learning Techniques for Phoneme Recognition in Italian Children' s Speech [36.7] 国際音声アルファベット(IPA)に音声を翻訳するための効率的なツールが欠如しているため、音声療法士はしばしば障害の診断に困難に直面している。
この課題に対処するBrocaは、コンフォーマーベースのディープラーニングシステムで、成人スピーチの8日間で事前訓練され、イタリアの児童スピーチの165分間のデータセットで微調整される。
ブロカは、声調、アクセント、発声誤りなど、子供の発話における音韻変動の処理に最適化され、イタリア語で13.36%の重み付け音素誤り率を達成した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 00:47:57 GMT)
Learning Dynamics of Continual Learning: A Unified View of Data Attribution, Forgetting, and Plasticity Loss [36.6] 現代の言語モデルは、一度訓練されたり凍結されたりするのではなく、生涯にわたって更新される可能性が高い。
これらの課題は、進化する更新-振る舞いの相互作用によって管理されていることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:38:02 GMT)
Flow-Matching-Based Protein Structure Tokenizer Made Efficient and Easy [36.3] ProFiTはタンパク質構造トークン化のための軽量なフローマッチングトークン化器である。
幅広い設定で広範囲な評価を行い、ProFiTが様々な下流タスクに適応可能であることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 02:56:09 GMT)
Reliable Replay through Spatial Coherence in Online Continual Learning [36.2] 本研究では,幅広い学習環境に適用可能な汎用リプレイアロケーション手法であるSPHERE(SPatial Coherent Risk Control for REplay)を提案する。
移動目標の感度から元の損失変化に対するリプレイ係数を導出し、ベースラインリハーサルを維持するためにそれらを均一なリプレイとブレンドする。
実験により、SPHEREは精度を向上し、ノイズラベルビジョンタスク、連続言語モデル調律、不完全なテスト報酬を伴うコード生成強化学習における忘れを少なくすることが示された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:27:53 GMT)
JustQuant: You Don't Need Smoothing, SVD, or Rotation for 4-Bit Activation Quantization [34.3] 本稿では,低ビット量子化の複雑さを,デプロイ時の演算子からトレーニングプロセスに移行するフレームワークを提案する。
テーセウスQADは、シーセウス船の段階的な置換プロセスに類似した、多段階の監督を徐々に適用している。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:17:24 GMT)
AquaWAM: A Dynamics-aware World Action Model for Underwater Embodied Agents [34.2] AquaWAMは、水中のエンボディエージェント用に設計された世界初の世界行動モデルである。
将来の画像を予測する代わりに、AquaWAMは、スラスタデッドバンド、各コマンドを延ばす慣性グライダー、および周囲の流れを含む、アクションコンディションと受動的物理力学の両方をモデル化する。
AquaWAMは、高次元の視覚観測ではなく、コンパクトなナビゲーション状態をモデル化することにより、従来のWAMと比較して、モデルのサイズと計算コストを大幅に削減する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:09:26 GMT)
Does Learning to Predict the World Help Agents Act? Auditing World-Model Post-Training [33.7] 訓練後、エージェントは次の観察を予測し、その予測を報酬または直接的な監視信号に変換する必要がある。
我々は、トレーニングプロセス中に、真の次の観測対象を、分布不一致の観察に置き換える。
この発見をVisualWebArenaに一般化します。そこでは、ランダムリワードトレーニングがベースモデルに対してpass@64を14.3%上昇させます。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:07:05 GMT)
Q-WAM: 4-Bit Quantization of World Action Models with Action-Subspace Protection [33.3] モデルが生成する動作を保存したWAMのための新しい4ビット重み活性化量子化法を開発した。
我々は,3つのWAM上でのQ-WAMをシミュレーションおよび実世界の展開において評価した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:24:30 GMT)
SceneScaffold: Active Scene-State Construction for Unified 3D Scene Understanding [33.3] SceneScaffoldは、統合された3Dシーン理解のためのアクティブなシーン状態構築フレームワークである。
SceneScaffoldは、スーパーポイントレベルの視覚的エビデンスを、異なる構造的役割を持つシーンステートコンポーネントに整理する。
SceneScaffoldの有効性を示すために,3次元視覚的接地,質問応答,高密度キャプションなど,統合された3次元シーン理解タスクの実験を行った。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:39:53 GMT)
Beyond the Training Horizon: Mechanisms and Limits of Length Generalization in Looped Transformers [33.2] ループトランスフォーマーは、トレーニング中に遭遇したチェーンよりも長い推論チェーンに一般化することができる。
We compare two looped-transformer, which we called Matched-Recurrence Looped Transformer (MR-Loop) and Decoupled-Recurrence Looped Transformer (DR-Loop)。
リカレントステートはタスク関連コンテンツだけでなく,その計算状態も符号化する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:15:00 GMT)
Cross-modal Translation via Conditional Latent Denoising for Video Deepfake Detection [32.9] 本稿では,ビデオディープフェイク検出のための条件付き遅延デノイングによるクロスモーダル翻訳というフレームワークを提案する。
これは、ラテント空間における不均一なモジュラリティの異なる分布を接続し、スムーズなクロスドメイン情報転送を可能にする。
提案したCTCLDは包括的ドメインアライメントを可能にし,堅牢なビデオディープフェイク検出手法を実現する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:16:15 GMT)
Inspire: Benchmarking Scientific Literature Search for Open Research Problems [32.9] INSPIREは、先行文献を検索し、解法で修正された研究問題を進行させるエージェントを評価するためのベンチマークである。
現在のエージェントは、より広範な事前作業のポートフォリオを組み立てるよりも、孤立した前駆体をより容易に回収できることを示します。
また,テスト時間情報を変更することなく,保持検索の改善を図っている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:21:51 GMT)
Turning Speech Language Models into Multilingual Listeners [32.6] 音声言語問題を理解する言語モデル(SLM)は、少数の高ソース言語しかサポートしない。
このギャップは、多言語音声訓練データセットの不足に起因している。
我々は,23言語で1080万問合せ対の9200時間からなる大規模で人工的に生成され,人間によって検証されたデータセットであるMultiSPEECHQAを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 04:43:24 GMT)
Rethinking Contextualization by Reinterpreting Attention Head Channels [32.4] 我々は、個別の辞書として個々の単語と注意頭に焦点を当て、文脈化を研究する。
異なる単語は異なる量の情報を持ち、表現力の低い単語はより文脈的な情報を吸収する傾向にある。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:10:31 GMT)
DevelopmentODE: Structured Neural ODEs for Early Brain Development Dynamics Across a Decade [32.4] 長期の神経発達予測は、通常、子どもは数回の不規則な間隔でのみ観察されるため、困難である。
本稿では,共有発達幾何学における集団的・主観的変異を整理する構造的連続時間フレームワークであるDevelopmentODEを提案する。
DevelopmentODEは、ショート・ホライズン予測とロング・ホライズン予測で競合するベースラインを一貫して上回る。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 00:24:57 GMT)
Finite Probes Suffice: Identifiability and Universality for Weight-Space Learning [31.7] 有限プローブに基づく表現が神経機能学の学習に十分である場合について検討する。
隠れプローブ応答から学習するための簡単なアーキテクチャであるHIDDENPROBEを紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:31:08 GMT)
AnyStep-WAM: Budget-Aligned Distillation and Adaptive Inference for World Action Models [31.6] 我々は、調整可能な予算予測とシーン依存アロケーションのための一般的なフレームワークであるAnyStep World Action Modelを紹介する。
軽量なリスクベネフィットスケジューラは、1段階のプレビューから難易度と予算固有の生徒教育者の忠実度を予測する。
本手法は, タスク成功率を維持しつつ, 平均復調歩数を60.2%, 49.8%, 85.28%削減する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:49:05 GMT)
EfficientAgent: What Makes KV Cache Offloading Work for Concurrent Agents? [31.5] LLMエージェントはすべてのターンで会話全体を再送し、そのほとんどが既に前のターンで処理されていた。
同じワークロードでは、ひとつのデプロイメントをスピードアップし、別のデプロイを遅くし、3分の1で何も変更しない。
この作業セットによってホスト層のサイズと管理を行うEfficientAgentを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:01:29 GMT)
Recursive Harness Distillation across Agents for Robot Manipulation [31.3] エージェント間の再利用可能なガイダンスとして介入経験を蓄積する再帰的ハーネス蒸留を提案する。
強いエージェントは、その経験をライトエージェントのプレイブックに蒸留し、ライトエージェントの実行フィードバックを用いてプレイブックを精製する。
結果として得られたプレイブックは、モデルパラメータを更新することなく、エージェントが新しいタスクインスタンスに蓄積された介入知識を再利用することを可能にする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:01:15 GMT)
Same Outcome, Different Readout: What Does a Steerable Valence Direction in LLMs Represent? [31.1] デコダビリティとアクティベーションステアリングの成功は、それ自体は、方向のトラックを構築するものを確立しない。
迷路作業において、現実的な結果と情報的履歴を分離する制御的介入を用いて、良い結果の方向性について検討する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:57:17 GMT)
ECG-Scroll: A Long-Horizon, Streaming Benchmark and Agent Environment for Interpretation of Ambulatory Electrocardiograms [30.5] 我々は、長期のECG解釈を、長期のオンライン(ストリーミング、因果)シーケンシャルな意思決定プロセスとして再放送する。
ベンチマークとして、長い増幅記録はチャンク単位でエージェントチャンクにストリームされ、局所化、定量化、即時に発作的なイベントにフラグを付ける必要がある。
エージェント環境として、3つの能力を持つシングルランスECGモデルに決して触れない固定されたジムスタイルのインタラクション層である。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 02:38:13 GMT)
ANTMAN: Adaptive Need Tracking for Multi-Agent Navigation in Large Information Spaces [30.4] ANTMANは、未解決の情報要求の進化をランタイム調整の単位として扱う適応調整フレームワークである。
ANTMANは, 分割駆動ベースラインの15倍以上と比較して, アクティブコーディネートをわずか1.23倍に向上させることを示した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:55:15 GMT)
On the Two Faces of Adam in Separable Linear Classification [30.0] ログロス下でのソフトマックスパラメトリゼーションを用いた分離線形分類において, 決定論的, 完全バッチ, バイアス補正されたAdamの挙動を考察する。
アダムは安定性定数$$が 0 であるとき、最大ノルム・マルジン最適度に近付くことが知られ、一方正の$はユークリッド・マルジン最適度に近付くことが知られている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:37:36 GMT)
How code helps different tasks? A decompositional lens on LLM post-training [30.0] 実行検証されたコードコーパスを,その解の計算パターンに基づいて解釈可能なカテゴリに分解する。
質問応答, 数学, コード生成について, 個別のカテゴリと, 命令調整モデル間のバランスの取れた混合体を比較した。
次に、これらの結果から導かれるコンパクトな混合物を合成し、共同トレーニングにおいて個々のカテゴリーで観察される利益が持続するかどうかを検討する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:57:54 GMT)
TT-VidT: Decoupling the Temporal Axis for Efficient Motion-Centric Video Pretraining [29.6] TT-VidTはJester, Some-Something V2, ARID, Diving48を同時に微調整し, 最強の非TT行を54%121%改善した。
最終比較では、TT-VidTがJester、Something V2、ARID、Diving48のファインチューニングを同時にリードし、最強の非TT行よりも54%121%改善した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:09:23 GMT)
RINI: Seeing the Prior Is Not Enough [29.2] 3つの実験では、コントリビューションを持つ事前と同一のトピック制御で生成された提案を比較した。
175件の解釈可能な公開提案の人間の分析では、137件が事前の関連性を認識しているが、61件は確立された貢献を正しく評価している。
本稿では,証拠に対する拠出請求を監査する研究思想ノベルティ検査(RINI)を紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:42:35 GMT)
How Strong Is the Evidence for the Artificial Hivemind? Reevaluating Evidence for the Open-Ended Homogeneity of Language Models [29.1] 最近の研究は、言語モデルはオープンエンド世代において顕著な均一性を示し、人間の創造性に長期的な脅威をもたらす人工Hivemindのような振る舞いをフレーミングしていると主張している。
この結論は3つの方法で支持され、推論時間介入(prompting)によって測定された応答の多様性が確実に上昇することを示します。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 21:28:04 GMT)
When Do Models Admit They Are Wrong? Failure Disclosure Is Unstable Under Reinforcement Learning [28.9] アウトカムベースの強化学習は、同様のタスクパフォーマンスを持つモデルを生成することができるが、その失敗についてコミュニケーションするまったく異なる方法がある。
我々は、失敗の開示について研究する: あるモデルが、試みられた解決策が失敗していることを認めているかどうかを、黙秘または成功として提示するよりはむしろ調査している。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:01:03 GMT)
VisionHOPE: Visual Backbones as Self-Modifying Learning Systems [28.6] 自己修正学習システムとして定式化された最初の汎用視覚バックボーンであるVisionHOPEを紹介する。
VisionHOPEは、コンテンツを格納し、キーと値の表現を生成し、学習率と保持を統制する5つの結合記憶を通じて、この共進化を実現する。
提案したVisionHOPEは、ImageNet-1K、COCO、ADE20Kの競合する結果を達成し、汎用視覚バックボーンの実践的基盤として自己修正学習システムを確立する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:54:38 GMT)
TerMeZO: Ternary Sparse Zeroth-Order Optimization for Fine-tuning BitNet Models at the Edge [28.3] 1次勾配を持つ微調整アンゲージモデル(LLM)は、推論に必要なものよりも数倍大きなメモリを必要とする。
本稿では,三元数量化器自体の幾何学を利用して細調整時に値が変化する可能性のある潜時重みを同定する,スパースなMeZO方式であるTerMeZOを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:14:44 GMT)
QwenGyre: An Elastic Reinforcement Learning Framework for Training xLong-Horizon Agents [28.2] 大規模言語モデル(LLM)エージェントは、ますます極端に長い(xlong)水平タスクをこなす。
オンライン強化学習(RL)をこのような実行に適用することは、2つの根本的な課題をもたらす。
我々は、xlong-horizon online RLのエンドツーエンドフレームワークであるQwenGyreを紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:02:03 GMT)
An Empirical Study and Open Testbed for Federated Fine-Tuning of Vision-Language-Action Models [28.2] フェデレーション学習は、共有ポリシを学ぶことによって、分散デモンストレーションを活用するための有望なアプローチである。
我々は,3つの近代事前訓練型VLA政策のファインチューニングに関する体系的研究を行った。
ヘテロジニアスデータを一元的に微調整する能力など,連合型VLA学習の機会を強調した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:16:22 GMT)
Climbing the Hill: Prompt Injection Red-Teaming Against Frontier Models with Curriculum Reinforcement Learning [28.0] コールドスタート問題に対処するカリキュラムベースの手法を提案する。
GPT-5.6-Luna, GPT-5.6-Terra on AgentDynに対して93.8%, 45.0%の攻撃成功率(ASR@10)を達成することができる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:44:58 GMT)
Pulseflow: PPG Counterfactual Generation Via Latent Transport [27.9] 光胸腺造影は、心房細動(AF)検出を含む連続的心血管モニタリングにおいて重要なモダリティとなっている。
ラベル付きAFレコードは、多くの臨床環境では限定的であり、限られたターゲットデータしか入手できない場合、モデル適応が困難になる。
我々は、条件表現学習と非可逆的潜在輸送を組み合わせたソース条件の反ファクト生成フレームワークであるPulseFlowを導入し、ソースからの情報を保持しながら心リズムを編集する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:09:04 GMT)
ZeroGAR: Benchmarking the Adversarial Robustness of Zero-Shot Graph Models [27.5] ゼロショットグラフモデル(ZGM)は、ソースグラフから伝達可能な知識を学習し、適応のない未確認対象グラフに直接適用する。
既存のグラフロバストネスベンチマークは、主に教師付き設定に重点を置いており、基本的には未探索のままである。
ZGMの対角的ロバスト性を評価するための最初の体系的ベンチマークであるZeroGARを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:27:53 GMT)
TTRSD: Test-Time Reinforcement Learning with Self-Distillation for Vision-Language Models [27.3] テスト時強化学習により、未ラベル入力を用いて視覚言語モデルに適応することができる。
我々は,多視点応答レベル自己蒸留と視覚的コントラストトークン選択を組み合わせたテスト時強化学習フレームワークTTRSDを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:49:39 GMT)
Quantifying Behavioral Tails in Black-Box Language Models [27.1] RareTrapは、ブラックボックスの大規模言語モデルにおける厳しい振る舞いの確率を推定するためのフレームワークである。
我々は,RareTrapが資源消費の厳しい振る舞いを誘発し,その確率を最大200評価で計算することを発見した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:00:00 GMT)
Benign Overfitting for General Norms and Distributions [26.5] 一般ノルムおよび一般(準ガウス)分布に対する線形回帰における良性オーバーフィッティングを解析する手法を開発した。
この証明は,高次元の場合においてほぼユークリッドであることを示すために,集中度と中央限度ツールを用いて,双対最適化問題の幾何学を解析する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:34:13 GMT)
Dynamic Kuramoto-Hodge Operators for PDEs on Complex Geometries and Topologies [26.4] トポロジに制約のある相互作用と学習協調を組み合わせた動的倉本-ホッジ演算子(DKHO)について紹介する。
トポロジーは情報がどこに流れるかを決定するが、学習されたダイナミクスは各PDEインスタンスとどのように交換されるかに適応する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:55:47 GMT)
Positions Are Not Facts: The Mismatch Between KV Caches and Memory [26.4] レコード全体を隠蔽し、置換された値だけを隠蔽し、古いテキストを削除し、キャッシュを再計算する。
マスキングは8つのモデル全てに新しい値を強く好ませるが、6つのモデルはユニットエラーや停止失敗によって完全な答えを失う。
その後の州は、以前の記録から有用な情報も保持している。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:56:16 GMT)
RMB: Reward Model Boosting Mitigates Reward Hacking [26.2] ヒューマンフィードバックからの強化学習(Reinforcement Learning from Human Feedback)は、大きな言語モデルと人間の好みを整合させる技術である。
ポリシーの最適化がプロキシの報酬モデルを改善するという、報酬のハッキング問題に悩まされることが多い。
本稿では,RLHF に対する報酬信号の堅牢性と信頼性を高める新しい手法である Reward Model Boosting (RMB) を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:03:12 GMT)
The cost of useful natural gradient updates [24.9] 実現可能で、少なくとも$varepsilon$を失えば、その方向への最良の利得が得られます。
また、イベント傾きのサンプル境界、減衰フィッシャー解のサンプル境界、アフィン分類器の集団-KL証明も提供する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:07:28 GMT)
BridgeCast: Bridging Ocean Wave Forecasts to Reanalysis via Flow Matching with Exogenous Variables [24.5] BridgeCastは、偏見補正のための物理AIフレームワークのハイブリッドである。
物理モデル予測をリアナリシスのような分野に変換することを学ぶ。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 00:43:54 GMT)
PARSEE-VAD: Efficient Training-Free Online Video Anomaly Detection via Proposition-Aware Reasoning and Streaming Evidence Escalation [24.4] 凍結したマルチモーダル言語モデルによるトレーニング不要なオンラインビデオ異常検出には,2つの課題がある。
本稿では,意味的エビデンス獲得とスコア状態の進化を分離するフレームワークであるPARSEE-VADを紹介する。
実験はトレーニングなしのオンラインパフォーマンスを示し、選択的ルーティングは専門的な計算を減らします。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:24:55 GMT)
SWE-Game: Can Coding Agents Build the Games We Want? [24.3] SWE-Game(SWE-Game)は、2Dおよび3Dの13のゲームプレイカテゴリにまたがる41のレファレンス・ゴドットゲームに基礎を置く247のタスクのベンチマークである。
5つのタスクタイプは、ゲーム設計文書からの簡単な実装、スケルトン完成、83のインジェクトされたフォールトケースの修復、Godot-to-Unity移植から開発をカバーしている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:38:20 GMT)
Seeing and Solving Are Not Enough for Vision-Language Models [23.9] 視覚言語モデル(VLM)は、視覚情報抽出と下流問題の解法を組み合わせることで、視覚的な疑問に答える。
不正確な答えは、必ずしも視覚的抽出や問題解決の失敗を反映しているか?
モデルは、別々にテストされても、元のマルチモーダルな質問で失敗しても、両方の能力で成功するかもしれない。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:57:04 GMT)
Next Thoughts Are Distributions: Generative Autoregressive Reasoning in the Latent Space [23.9] 本稿では,次の連続的思考をマルチモーダル分布としてモデル化した自己回帰的思考フロー(ATF)を紹介する。
ATFは、コンパクトな潜在トレースと強化学習の利点により精度を向上する。
以上の結果から, 連続推論がより効果的である可能性が示唆された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:26:32 GMT)
OSCC: Certified Observation-Safe Coupling Optimization for Gradient-Noise Control in Imperfect-Information Learning [23.8] 無効な結合は、隠された状態を隠蔽し、内因性ポリシーのランダム性を同期させ、または、偽の履歴が分岐した後の誤ったチャンスイベントを発生させる。
本稿では,限界保存,情報状態安全性,ブランチローカルなポリシーランダム性,セマンティックイベントアライメント,トレース・ビオークル・リプレイなどを通じて,許容可能なクラスを定義するフレームワークであるオブザーバセーフ・カウンタファクト・カップリング(O SCC)を紹介する。
我々は, 限界保存結合に対して, ポリシ・ヤコビアン重み付き対角外帰還共分散が雑音変化を決定することを示す勾配対応結合基準を導出する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:10:30 GMT)
SINGED: Correct Outputs Do Not Certify Safe Execution in LLM Agents [23.3] ツールを使用する言語モデルエージェントは、サードパーティのアーティファクトを選択して実行する。
要求された出力に対して良質な代替品と一致するが、タスク契約によって禁止される効果を付加する実装について検討する。
SINGEDはランク、エビデンス、選択に敏感な結果と実行のギャップを露呈する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:37:04 GMT)
Learning to Sell: Reinforcement Learning for Strategic Large Language Model Agents in Multi-Product Markets [23.3] 本研究では,マルチテムバーゲティング環境において,このようなエージェントを効果的に売り手として機能させるための機械学習アプローチを開発する。
我々は,この問題を構造化された4部分メッセージプロトコルを用いて,部分観測可能なマルコフ決定プロセスとして定式化する。
この枠組みを評価するために,制約順守,売り手余剰抽出,割当品質を定量化する多次元計量スイートを構築した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:51:56 GMT)
FocusDrive: Reasoning with Visual Focus for Autonomous Driving [23.2] 視覚的焦点を明示するエンド・ツー・エンド・プランニングを組織する構造的マルチモーダル推論フレームワークを提案する。
まず、運転者の視線予測を通してこの焦点表現を評価し、既存のNAVSIM訓練シーンにおける駆動焦点アノテーションを用いた推論計画におけるその役割について検討する。
W3DAとNAVSIMの実験では、テキストベースのチェーンよりもFocusDriveが改良され、競合する視線予測とエンドツーエンドの計画性能が実証された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 04:17:40 GMT)
Do We Really Need KL Divergence for On-Policy Distillation of Large Language Models? [23.0] オンライン蒸留(OPD)はLLMの効率的なポストトレーニングパラダイムとして登場した。
更新方向を単純に保つだけで、効果的なOPDに十分であることを示す。
C-MOPD(Consensus Multi-Teacher On-Policy Distillation)を導入し、MOPD(Multi-Teacher On-Policy Distillation)を改善する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:40:33 GMT)
VIDEAS: Distilling Explicit Action Semantics from Demonstration Videos for World Models via Prior-Guided Simulation [22.8] VIDEASは、連続的な物理力学を基礎モデルのための明示的なアクションセマンティクスに変換するデータ蒸留フレームワークである。
AgiBot-Worldデータセットから34Kの高品質なサンプルを学習した言語ベースワールドモデルの8B/9BパラメータスイートであるVIDEAS-WMを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:19:17 GMT)
No Free Efficiency: Revisiting the Trade-off Between Training Efficiency and Model Vulnerability [21.4] 効率指向トレーニングは、敵の攻撃やプライバシ攻撃に対する感受性を高めることを示す。
我々はさらに分析を「ゼロRLトレーニング」に拡張し、単純化されたRLレシピを用いてトレーニングしたモデルが破滅的な忘れ込みに対する感受性を著しく高めていることを発見した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:25:23 GMT)
VPTwin: Real-Sim-Real Video Prediction for Robotic Manipulation Planning [20.7] VPTwinはリアルタイムリアルタイムビデオ予測フレームワークで、リアルタイム同期シミュレーションツインを使用して、現実の将来の予測をアンロックする。
映像予測における身体幻覚の大幅な減少と,計画性能の大幅な改善が示された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 02:21:30 GMT)
GSM: Efficient Language Modeling with Shared Global State [20.7] 本稿では,符号化段階における長距離情報の選択と集約に集中する因果エンコーダ・デコーダアーキテクチャを提案する。
実験の結果、GSMは計算効率を向上し、モデル性能を維持しながらキャッシュオーバーヘッドを低減することがわかった。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:19:21 GMT)
Supervision Recovery for Time Series Anomaly Detection via Context-Anchored Pairing [20.6] 時系列異常検出(TSAD)は、時間的異常が文脈に依存しているため、依然として困難である。
TSADの監視・回復フレームワークであるCAPS(Context-Anchored Pair Supervision)を提案する。
CAPSは、理想的異常監視を、同じ時間的文脈下での正常な結果と異常な結果の一致した比較と見なしている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:26:55 GMT)
What Survives the Codec Shift: Pooled No-Vocals Residuals for Speech Deepfake Detection [20.5] 生成機構が変化すると、どの音響表現が識別情報を保持しているかは明らかでない。
適応ゲーティングにより,発話レベルにプールされた非ネイティブ表現をトークンレベルXLS-R特徴と統合するデュアルビュー検出器を提案する。
提案されたMN-Pは、EERを全体として54.2%削減し、未確認状態に対して60.9%削減する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:58:08 GMT)
Can Protein-Derived Knowledge Improve Pathology Foundation Models? [20.5] クロスモーダル転送からプロテオミクスの知識獲得を分離する3段階のフレームワークを提案する。
まず,12,695個のサンプルレベルのバルクタンパク質プロファイル上にPFE(Proteomic Foundation)をプリトレーニングした。
第2に、パッチ領域スライディングエンコーダであるProSlideをプレトレーニングして、ペアのWSI-omicsサンプルからタンパク質の発現を予測する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:58:10 GMT)
RepFlow: Reciprocal Supervision Improves Generation and Representation in Flow Models [19.7] 生成モデルでは、ノイズの除去によって視覚構造を学習するが、内部状態はノイズレベルとネットワーク深さの両方で絡み合っている。
本稿では、生成器の進化する計算からそのような表現を学習し、生成をガイドするRepFlowを紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 04:57:19 GMT)
EverMine: Dissecting the Self-Evolution of Research Capabilities in Long-Horizon Alpha Research [19.7] 自己進化型エージェントは、研究のフィードバックを再利用可能なスキル、ツール、研究ルールに変えることを目的としている。
EverMineは研究状態をヒストリ(Hist)、現在のファクターポートフォリオ(Frontier)、再利用可能な機能(Cap)に分解する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:46:09 GMT)
BIRD: Distilling Decision Boundaries into Rationales for MLLM Adaptation [18.2] BIRDは、未解決の局所的な決定境界を見つけるためにモデル固有の混乱を使用し、これらの混乱を合理的に解決する証拠を蒸留する。
その後、視覚的差異から解答盲候補の証拠を生成し、どの証拠が最も効果的に正しい解答の選好を強化するかを機能的に検証する。
医学およびチャートVQAの実験では、BIRDは2つのターゲットMLLM間で競合する合理化手法よりも優れていた。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:16:29 GMT)
Dense Is Not Enough: Hierarchical Supervision Allocation for Long-Horizon On-Policy Distillation [18.0] 生産的なガイダンスは将来のユーティリティと現在の学習可能性の交差点にあると我々は主張する。
本稿では,LENS-OPDを提案する。LENS-OPDは,ロケート,リファイン,内在化による監視を組織する粗大なフレームワークである。
以上の結果から, 有効長期蒸留には, 適切な深さ, 正しい決定, 正しいトークンの指導が必要であることが示唆された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:44:55 GMT)
Does Execution Require Target KV Fidelity? A Mixed-Fidelity KV Runtime for LLM Serving [17.9] ElasticKVは、ターゲットフィデリティがゲート実行を必要としないという観測に基づいて構築された混合忠実KVランタイムである。
この状態を実現するために、ElasticKVは、(i)フィデリティ低減を再利用可能なGPUキャパシティに変換するペア構造化レイアウト、(ii)デュアルモードアテンションバックエンド、(iii)圧力対応フィデリティ管理を組み合わせる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:03:38 GMT)
Robust Biomolecular Complex Design Across Protein Conformational Landscapes [17.9] モデルに依存しない進化的フレームワークであるFlexEvoを紹介します。
FlexEvoは、カテゴリバランスの平均相対的な性能劣化を47.8%から4.4%に減らし、サンプルあたり1.4~3.1分しか適応しないことを示した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:28:14 GMT)
Behavioral Monitoring of JEPA World Models with Jacobian Centroids [17.8] World Model (WM)ベースの計画では、モデルが現在のタスクと行動的に一致しているかどうかを監視する必要がある。
We show that centroids--sub-component Jacobian row-sums---- effectively identified the behavioral properties of WMs。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 21:30:47 GMT)
In-Context Adaptation of Encoder-Decoder Models in Speech Recognition [17.8] 本研究は,すべてのエンコーダ・デコーダモデルに対して,コンテキスト内適応が固有の能力であるかどうかを考察する。
語彙情報と話者情報の両方が順応に寄与することを示す。
この結果から,ASRのコンテキスト内適応は,特定のアーキテクチャやトレーニング,実証的なアプローチに特有のものではないことが示唆された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:34:08 GMT)
Test-Time Spatial Reasoning for Robot Manipulation Using Generative Real-to-Sim [17.7] 我々は,超並列物理シミュレーションによる空間的推論を明示的に行う,トレーニング不要なテストタイムフレームワークであるSimifyを紹介した。
シーンの1枚のRGB-D画像から、Simifyは3D生成モデルと視覚言語モデルを活用するシミュレーション可能な資産を再構築する。
実ロボットハードウェア上で定量的な実験を行い、複雑なオブジェクト再構成タスクをエンドツーエンドで実行できることを実証する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:28:10 GMT)
What Shared Prefixes Hide: Trajectory Dropout for On-Policy Distillation [17.7] 共有プレフィックスがトークンレベルの更新を弱める可能性があることが分かりました。
生徒の信頼度の高さは、教師が反対しても補正勾配を弱めることがある。
我々はこれらの弱化信号を公開する簡単な訓練時間介入であるトラジェクトリ・ドロップアウトを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:08:31 GMT)
SciGen-Verifier: A Multimodal Reasoner for Explainable Verification in Scientific Image Generation [17.6] 我々は、科学的画像生成、後続命令の分散化、多分野推論、世界知識ドメインの説明可能な検証のためのベンチマークを構築した。
我々は,冷間開始制御による微調整と,カリキュラムに基づく2段階強化学習パイプラインによる推論駆動型マルチモーダル検証を開発した。
SciGen-Verifyでは、SciGen-Verifierはより大規模なプロプライエタリモデルと競合するパフォーマンスを達成する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:23:36 GMT)
Information Blackhole: Exploring Backdoor Mechanism in 3D Point Cloud Reconstruction [17.5] ポイントクラウドオートエンコーダは3Dワールド表現の基本コンポーネントであり、多くのセーフティクリティカルな下流アプリケーションをサポートする。
ポイントクラウド オートエンコーダに対する バックドア攻撃は ほとんど未調査のままだ
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:46:59 GMT)
HiLoRe: What to Store, Compress, or Recompute for Efficient GRPO Training [16.3] HiLoReは、高精度ストレージ、低精度圧縮、決定論的再計算にグラフ対応リカバリユニットを割り当てる。
アクター更新スループットはGCで13.5%、ベースラインで7.9%に達する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:47:15 GMT)
Dual-Vocabulary Language Model for Cross-Tokenizer Distillation [15.6] 入力トークン化(#1)と出力ロジット(#2)の両方において、異なる教師学生トークン化者が誤調整を導入する
既存のアプローチでは、同じテキストスパンをマッチングしたり、トークンをバイトに変換することで、前者に対応する。
本稿では,教師の頭部を新たな学生語彙投影ヘッドに置き換えたDual-Vocabulary Language Model (DVLM)を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:13:21 GMT)
Where Do Test-Time Scaling and Training Fall Short in Individual Stance Prediction? [15.5] 我々は,広く利用されているテストタイムスケーリング戦略とポストトレーニング手法を評価した。
生成、選択、学習の4つの障害モードを特定します。
我々は、すべての候補者の姿勢に対する直接的なスコアと、サポートの明示的な評価を組み合わせた、シンプルなアプローチを探求する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:27:05 GMT)
Improving the Diversity of LLM Outputs without a Trade-off [15.1] DAST(Diversifying Arithmetic Smpling with TokenTour)は, LLM出力の多様性を高める手法である。
トークンIDはしばしば無意味な順序で配置され、類似した意味を持つトークンが連続的に現れるように再割り当てされる。
この順序を算術的サンプリング(あるいは準モンテカルロ法)と組み合わせることで、分布を保ちながら実行中に類似のトークンが生成されにくくする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 00:07:59 GMT)
Reachability is not enough: Diagnosing long-range behavior in GNNs [14.8] グラフニューラルネットワーク(GNN)は、そのアーキテクチャが遠くのノードを接続できるため、しばしば長距離と呼ばれる。
各グラフ距離における強い入力が予測にどのように影響するかを測定する枠組みを導入する。
局所的なメッセージパッシングは影響を緩やかに広げることができるので、有限な実装は、主に近くの入力に依存する可能性がある。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:33:55 GMT)
Does Adversarial Training Improve Generalization in Multi-View VLAs? Revealing and Mitigating View Collapse [14.6] 逆行訓練(AT)は、個々のシフトを明示的に予測することなく、ロバストネスに対するモデル適応的なアプローチを提供する。
本研究では, 事前学習VLMから直接適応した多視点VLAを用いて, 7つのLIBERO-Plusシフト軸の一般化を評価する。
以上の結果から,多視点のロバスト性は相互依存の変化から改善された認識を分離する必要があること,そしてATは汎用的な分布シフトの利点よりも選択的に提供できることが示唆された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:11:35 GMT)
Towards Eliminating Catastrophic Forgetting in the Curriculum Learning of Math Reasoning Tasks [14.6] EWC(Elastic Weight Consolidation)は、数学的推論における破滅的な忘れを抑制するために提案されている。
EWCは、カリキュラムのトレーニングデータから代表的検証セットを構築するために影響関数を使用する。
IV-EWCはこの問題を緩和し、バニラのカリキュラム学習と比較して平均162%の忘れを減らした。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:19:24 GMT)
The Visual Target Matters: Learning across the Visual Hierarchy for Brain-to-Image Retrieval [14.6] 脳と画像の検索は、非侵襲的な神経反応を引き起こす視覚刺激を特定することを目指している。
既存の方法は通常神経エンコーダを訓練し、固定された最終層視覚目標を回復させる。
本稿では,凍結した視覚バックボーンの深度から,実験非依存の視覚目標を学習するNeuroGlyphを紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:04:43 GMT)
Learning to Learn from Context: Synthetic Training from Perturbed Public Documents [13.7] 現実世界のタスクは、事前訓練されたパラメトリック知識ではなく、複雑なタスク固有のコンテキストから学ぶために、大きな言語モデル(LLM)を必要とすることが多い。
この研究は、小さな摂動を伴う高品質な公開文書の利用を試み、LLMが文脈依存の推論トレースと回答をうまく生成できることを実証的に発見する。
我々は, (i) 原文の書き直しによる暗記リスクの低減, (ii) 文書に対する推論を必要とする質問や文言の生成, (iii) 文書を文脈として回答する合成パイプラインを構築し, (iv) 真に文書に依存しているサンプルのみを認める。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:05:22 GMT)
AgentBoundary: Counterfactual Evaluation of Safety in Tool-Using LLM Agents [13.6] 大規模な言語モデルの安全性の整合性は、要求に答えるか拒否するかに大きく取り組まれている。
エージェント的設定では、同じモデルが実行中にパーミッションクリティカルな証拠として振る舞うかどうかを判断しなければならない。
AgentBoundは、ツール使用エージェントの安全性のための、最初の4方向の対物生成・評価フレームワークである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:19:52 GMT)
One Latent, Many Tokens: Jointly Learning Compressed Embeddings for Efficient Language Diffusion [13.5] 本稿では,圧縮機,フローマッチングモデル,復号モジュールを共同で訓練するJPEG-DLMを紹介する。
より構造化され、拡散でモデル化しやすく、確実にトークンにデオード可能な圧縮埋め込みを学ぶ。
LM1B および OWT 上の近年の拡散流モデルの中では,Gen-PPL の平均値とスループットが最も低い。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:00:45 GMT)
SphMind: Towards Robust, Training-Free VLM-based Spatial Reasoning with a 360 Camera [13.5] 360度カメラは、周囲の全体的広視野(FoV)ビューを具現化したAIエージェントを提供する。
MLLMは、従来の2次元視点画像に基づいて訓練され、球形形状によって引き起こされる厳しい歪みやラッパーアラウンドの不連続に苦慮する。
幾何学的推論から意味認識を分離する学習自由なプラグアンドプレイフレームワークであるSphMindを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:15:05 GMT)
LLMs learn different forms of metacognition when trained to predict their own accuracy [13.5] 私たちは、関係する知識があるかどうかに関わらず、答えを常に生成するように、大きな言語モデルを訓練します。
訓練された信頼感は2つの異なるシグナルを反映している。
これらの結果は、キャリブレーショントレーニングがモデルに、自信を持ってコミットしたエラーを一般的に検出するように教えるものではないことを示唆している。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:02:33 GMT)
Unmask the State: When Does State Adaptation Matter for Masked Diffusion Language Models [13.3] 戦略の逆転を通じて、ある選択肢が一定の選択に好適な選択肢となるような問題について検討する。
我々はMDMを5つの軸(スコア、基数、地域、コミットメント、計画)に分類し、適応機会を最良の候補行動の一段階の利点として定義する。
この見解は、適応値はそのような逆転の周波数と大きさの両方に依存することを示している。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:27:32 GMT)
Position Aware Layer Queries for Test Time Training in Vision Language Models [13.0] テストタイムトレーニング(TTT)は、従来の微調整が不可能な場合に、入ってくるテストサンプルにモデルを適応させる。
私たちは、小さなモデル(学生)を介して、凍結したVLMをVLMの1つの前方通過に適応できる軽量なアプローチであるLayer Query Network (LQN)を紹介します。
LQNは位置一貫性規則化(Location Consistency Regularization, LCR)に依存しており、高価なO(H x W)画像をO(1)座標サンプリングに置き換えている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:29:30 GMT)
KoopCell: Koopman-Based Generative Model for Learning Single-Cell Dynamics from Distribution Snapshots [13.0] そこで我々は,Koopman-Mori-Zwanzig理論に基づく統一的生成フレームワークを提案し,表現と予測線形潜在力学を共同で学習する。
分岐力学をモデル化するために,マルコフ型埋め込みにより非マルコフ型メモリを潜在クープマン力学に組み込むクープセル-Mを開発した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:20:36 GMT)
Quizzing the Translation: A Prover-Grounded Evaluation Metric for NL$\rightarrow$FOL [12.9] 対象の式から2種類のプローブを導出するSIVを導入し、定理証明器を用いて各候補の翻訳を検証する。
SIVはAUCのトップに到達し、専門家がラベル付けした大きなエラーを独自に検出し、格付けする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:27:50 GMT)
What Happens During Autonomous Deep Research After the User Steps Away? [12.8] 自律的なディープリサーチでは、ユーザーはタスクと関連するバックグラウンドを提供し、さらに人間の介入なしに拡張された調査を行うためにエージェントを離れる。
我々は、この初期ユーザー情報を中間行動にどのように反映するか、そしてこれらの行動が最終勧告にどう関係するかを考察する。
タスク関連ユーザファクタを1つ変更して、残りのコンテキストを固定しながら、取得要求、作業ドラフト、最終報告を比較します。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:29:38 GMT)
One Model Is Not a Crowd: Multi-LLM and Aspect-Conditioned Diverse Comment Generation [12.8] 合成コメントスレッドが人間の言論に固有の多様性を捉えることができるかどうかを考察する。
複数の人間集団とアスペクト駆動型談話の性質に触発されて、複数のLCMとアスペクト条件生成を組み合わせることにより、コメントの多様性がよりよく近似できるという仮説を立てた。
その結果,マルチLLMとアスペクト条件付き生成は人間のコメント分布とよく一致していることがわかった。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:25:36 GMT)
What Gets Measured Gets Managed: Sign-aware Recommendation Needs Sign-aware Evaluation [12.2] State-of-the-the-art graph-based sign-aware recommender system is paradoxically valence-blind。
署名されたメトリクスのファミリーであるSigned Recall,Signed HR,Signed NDCGを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:17:30 GMT)
Generative Embodied Multiple Behavior Control Systems for Human-like Agents [12.2] 習慣行動は、人間の日常生活において重要な役割を担っているものの、ほとんど見過ごされている。
本稿では,目標指向行動と習慣行動を協調的にモデル化するマルチコントロールシステムを提案する。
GEMSの有効性は, 習慣行動の活用と多行動制御システム連携の利点を示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:38:47 GMT)
Structure-Adaptive Tree Field Integrators [12.1] 距離依存カーネルを持つ木上に定義された一般テンソル場を統合するための新しい近似アルゴリズムのクラスを提案する。
STAD-TFIは、パスバックボーンと単一フーリエセパレータを中心に構築された分解によって、ツリーの基盤構造を利用する。
高速なTFI法を適用して,シンクホーン法に基づく最適輸送問題の解の計算と高精度な緩和を導出できることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:35:43 GMT)
Population Physics, Population Problems: Safety and Emergence in LLM Societies [12.0] 我々は,大規模言語モデル(LLM)社会システムにおいて,自己組織化を測定するための枠組みを導入する。
スケジューリンググリッド、ソーシャルネットワーク(Moltbook)、Twitter風の誤情報シミュレーション(Rogue)の3つのシステムに適用する。
以上の結果から, LLMの安全性が向上したり, 監視されたりしても, 集団レベルの病態が出現する可能性が示唆された。
このようなシグネチャを計測することは、協調した集団行動を検出するための軽量でエージェントに依存しない診断層を提供する、と我々は主張する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:48:06 GMT)
The Error You See Is Not the Error You Made: Progression-aware Reasoning Origin for Reasoning Error Localization [12.0] ファーストエラーローカライゼーションのためのプログレッシブ・アウェア・フレームワークを提案する。
入力側証拠だけでは, 誤り伝播下での確実な局所化には不十分な理由が示されている。
オープンフォーム、医療、構造化された推論タスクにわたる実験は、強力な検証基準よりも一貫した改善を示している。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:03:59 GMT)
JIVE: Jacobian-Informed Volume Expansion for Diverse Generative Sampling [12.0] 生成モデルはしばしばモード崩壊と限られたサンプル多様性に悩まされる。
JIVEは、ジェネレータの終端ヤコビアンの先頭の特異部分空間に沿う速度摂動を注入することにより、生成の多様性を高める訓練自由フレームワークである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:41:25 GMT)
Not Too Hard, Not Too Easy: Learning from Intermediate States for LLM Structured Reasoning [11.1] モデルは、問題の制約を満たすまで、不完全または不正な候補解を何度も修正することができる。
我々は,事前学習した言語モデルが,そのような状態の修正を学べるかどうか,また,このフロンティアにおける状態のトレーニングが推論をより広範囲に改善するかどうかを検討する。
FOCUSは、モデルが一定回数のリカレント更新と状態の中で、その状態がどの程度改善され、そこからかなりの進歩を得られるかを測定する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:22:42 GMT)
Skill2Env: Capability-Oriented Environment Synthesis from Skills for General Agents [11.1] Skill2Envは、スキルから始まり、エージェント能力要求を使用してタスクと環境合成をガイドする機能指向フレームワークである。
本稿では,解決法の実行証拠を用いて,不十分なタスク設計を識別する反復的タスクハードニングを提案する。
Skill2Env環境から生成した1.5Kの高速軌道を教師付き微調整に利用し、幅広いエージェントベンチマークで一貫した改善を観察する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:13:47 GMT)
Training Witnesses: Trusting the Training without Trusting the Trainer [10.8] 本稿では,ニューラルネットワークトレーニングランにおけるトレーニング,データ使用,評価の認定方法であるWitnessesを紹介する。
私たちの重要な洞察は、高速な行動指紋と時々再生する課題が、ニューラルネットワークのトレーニングを監査するのに十分であるということです。
我々は,DDPとFSDPをまたいだ1億から2Bスケールの言語モデルトレーニングにおいて,本手法を検証し,この最小オーバーヘッドを実証する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:50:44 GMT)
StoryEngine: A State-Grounded Agentic Framework for Video Storytelling [10.6] StoryEngineは、ビデオストーリーテリングのためのステートグラウンドのエージェントフレームワークである。
信頼できるセマンティックプランと信頼できない視覚的観察を分離する。
StoryEngineは、すべての評価範囲で最先端のメソッドを一貫して上回る。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:42:16 GMT)
LLM4Trust: Exploring the Capabilities of Large Language Models for Trust Evaluation [10.5] 信頼評価は、リスク軽減と意思決定をサポートすることでサイバーセキュリティにおいて重要な役割を果たす。
大きな言語モデル(LLM)は、強力なゼロショット推論能力と幅広い知識のため、魅力的な代替手段を提供する。
LLM4Trustは,信頼度評価のためのLCMの能力を体系的に探求する最初のベンチマークフレームワークである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:42:59 GMT)
Two Heads Are Better Than One: Aggregating Weaker LLMs for Better Forecasts [10.5] 大規模言語モデル(LLM)は、現実の出来事を予測するためにますます使われるが、最強の個人予測モデルへのアクセスにはコストがかかるか制約がある。
我々は16個の比較群で70個のLSM予測器を評価し、それぞれ1000以上の共有サブクエストを持ち、1,121個の弱いモデルペアを得た。
学習された線形プールは16グループ中11グループで最強の個人と一致または上回り、全16グループでブリアスコアの5%以内となる弱いペアを識別する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:59:18 GMT)
ABO-Med: Accelerated Bilevel Optimization for Few-Shot Medical Image Classification [10.0] 本稿では,ABO-Medを提案する。
また,医療画像のためのモダリティを意識した拡張戦略であるMedRAug(MedRAug)も導入した。
実証的に、ABO-Medはいくつかの公的医療データセットで先行ベースラインを上回り、1.99%から18.76%に上昇した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:55:08 GMT)
HARMONIA: Interpretable Graph Learning through Mixtures of Neural Bases [9.9] HARMONIA: ニューラルネットワークの混合による解釈可能なグラフ学習。
機能モデリングには、HARMONIAがMixture of Neural Bases (MoNB)を導入している。
構造モデリングでは、HARMONIAはRelative Random Walk Probabilities (RRWP)を使用してマルチホップとマルチパスの関係をキャプチャする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:15:57 GMT)
The Text Beside the Image: Detection, Utility and Leakage for Trustworthy Multimodal Medical Data and Beyond [9.9] 本稿では,医用画像のテキスト成分を計測し,それらについて報告する。
同一文書上の識別子検出,下流ユーティリティ,残余ID漏洩を計測する。
クロスドキュメントリンクは、トレーニングなしの電子メールクエリの0.93%で、まず正しい人物をランク付けする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:35:24 GMT)
A Statistical Perspective on Knowledge Distillation: Foundations, Classical Methods, and Large Language Model Extensions [9.3] 知識蒸留(KD)は,高容量モデルの能力を効率の良い生徒に伝達するための重要なパラダイムとして登場した。
このレビューでは、教師の予測を事前情報として定式化する統一ベイズ的KDの定式化によってギャップを埋める。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:29:34 GMT)
NLPG: Natural-Language Policy Gradients for Self-Evolving Language Agents [9.2] 大規模な言語モデルエージェントは、検索、ツールの使用、推論、検証のための複合プログラムにますます依存している。
既存の強化学習とプロンプト最適化アプローチは、スカラー報酬に依存するか、あるいはすべてのプロンプトを繰り返し変更する。
本研究では、モデルパラメータやプログラム構造を変更することなく、固定エージェントを改善するための外部ポリシーメモリ手法であるNLPGを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:01:48 GMT)
When an Evaluation Rule Writes Training Labels: Measuring Human-Reference Forgiveness in NAVSIM [8.7] NAVSIMの著者はこの人間関係の許諾を導入し、1つの軌道を採点する際の文脈的に正当化された操作を罰することを避けた。
ラベル生成では、パスする16,384の候補を全列に設定する。
オーバライト前のターゲットと、すべての103,288のナビトレインシーンでリリースされたラベルを比較します。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 04:12:48 GMT)
Modular Discovery of General Game-Playing Algorithms with Large Language Models [8.6] ルールのみから任意のゲームにまたがる一般的なゲームプレイングは、ゲームクラスによって異なる要件と厳格な決定時間制約のため、依然として困難である。
我々は,Large Language Models (LLMs) を用いて汎用ゲームプレイングアルゴリズムの探索を行う。
我々は、OpenSpielトレーニングやホールトアウトゲーム、手続きシミュレーションエンジン、PPOを介してトレーニングされた深いニューラルポリシー値表現を持つゲームなど、400以上の多様な環境で発見されたメカニズムをベンチマークした。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 02:37:19 GMT)
Direct Hidden-State Alignment: Mapping and Controlling Preference Expression in LLMs [8.6] トレーニング後、ターゲットの振る舞いをゼロから生成する必要はない。
本稿では,行動選好を固有残差計算の符号付き因果効果にマッピングするResidual Competition Maps (RCMs)を提案する。
次に、ベースモデル重みよりも推論時隠れ状態を適応空間として扱うダイレクトハイドデン状態アライメント(DHSA)を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:04:25 GMT)
The Breakdown of Classical Minicrypt Equivalences in the Quantum-Computation Classical-Communication Model [8.6] 量子計算の古典通信環境において,古典的ミニ暗号の風景が崩壊することを示す。
第一に、量子擬決定論的評価を許容しても片方向関数は存在しない。
第2に、QCCCビットのコミットメントは存在しない。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 02:10:48 GMT)
Residual Learning-Based Control of Vehicle Platoons with $\ell_2$ Stability Guarantees via Recurrent Equilibrium Networks [8.6] 本稿では,異種車両プラトンに対する残差学習に基づく制御フレームワークを提案する。
Recurrent Equilibrium Network (REN) は、保存された軌道と名義モデル予測誤差を用いてオフラインで訓練される。
実験では、名目制御器に対する間隔と速度誤差の低減が示されている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:16:26 GMT)
When Evidence Changes the Subject: Subject-Typed Claim Licensing for Learned Routing [8.5] 複合システムには第2の次元、すなわち科学的主題が必要であると我々は主張する。
この問題に対処するために、要求対象に関するより弱い結論を、他の対象に関する肯定的かつ非代替的な信用から分離する、主観的クレームライセンシング(subject-typed claim license)を用いて対処する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:15:43 GMT)
LiteEvo: Automated, Cost-Efficient Harness Evolution for Generalization to Unseen Tasks [8.5] LiteEvoは、ツールフリーなメタエージェントが再利用可能なコンポーネントのためにマイニングエージェントをトラジェクトリする軽量なハーネス進化アルゴリズムである。
ツールフリーなメタエージェントが再利用可能なコンポーネントのためにマイニングエージェントをトラジェクトリする軽量なハーネス進化アルゴリズムLiteEvoを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:18:39 GMT)
From Position Risks to Block Survival: Faster Generation for Diffusion Language Models [8.5] 拡散言語モデル(DLM)は複数のトークンを並列に予測することで生成を加速することができる。
これらのトークンの予測方法と、最終的に生成にどのように貢献するかの間には、ミスマッチがあります。
BRISK-DLM(BRISK-DLM)は、提案学習の最適化と、検証された進捗に対する選択によって、両者のミスマッチに対処するフレームワークである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:11:26 GMT)
From PDF to Evidence: Structure-Aware Retrieval for Clinical Practice Guidelines [7.6] 各ページイメージを型付き構造要素に解析し、文書のレイアウトに従う構造対応エビデンスユニットを検索する。
9つの情報源から得られた26の治験ガイドラインでは、構造認識ユニットがまず金元素をBM25、密集、ハイブリッド検索でランク付けしている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:55:19 GMT)
Is Online Interaction Necessary for Recovery? A Minimalist Approach to Robust Planning via Perturbation [7.6] 本稿では,ロボット実行の基準軌跡として,アクションの有限水平列を予測するアクションシーケンス計画に焦点をあてる。
本稿では,既存の実演のみを用いて回復を改善するための簡単なトレーニング手法であるPerturbation-Augmented Recovery Supervision (PARS)を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 00:25:35 GMT)
From HL to H+L-1 Parameters: A Hankel-Toeplitz Forecaster for Long-Term Time Series Forecasting [7.3] 本研究では,従来の定常予測理論により,よりコンパクトな線形予測器のパラメータ共有を導出する方法について検討する。
我々のHankel-Toeplitz Forecasterは、逆フィルタと予測マップの両方を定義するインパルス応答を学習する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:35:52 GMT)
How Synthetic Labels Improve Conformal Prediction: A Perspective on Conditional Coverage [7.3] 本研究は,少量の信頼性サンプルしか得られない場合に,合成ラベルが条件付きカバレッジを向上させることができるかどうかを考察する。
合成ラベル付きプールがピンボールリスクを推定し、ペアの信頼と合成の結果がそのバイアスを補正し、独立した信頼された分割が最終的な適合化を行う。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:47:29 GMT)
Taming the Greeks: Option Portfolios with Inductive Biases [7.2] 体系的なオプション取引のためのエンドツーエンドのディープラーニングフレームワークを提案する。
リスク調整されたパフォーマンスを最適化するためにトレーニングされたニューラルネットワークは、従来のルールベースの戦略より優れていることが示されている。
本稿では、パフォーマンス駆動型損失と異なるリスク感受性のペナルティを組み合わせた一般的なトレーニング目標を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:05:50 GMT)
Scope-WM: Scoped Computation for Efficient Visual World Models [7.2] 予測関連潜伏領域と有望なアクションシーケンスを対象とする,効率的なビジュアルワールドモデルであるScope-WMを提案する。
計画中、Scope-WMはMPC検索で発見された高品質なアクションシーケンスを保存、再利用する。
難しいPush-Tタスクでは、Scope-WMはGPUのピークメモリ使用量と計画時間をそれぞれ18.1%、密度の高いDINO-WMの14.3%に削減する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 04:57:41 GMT)
The Privacy Fallacy of Crowdsourced Fine-Tuning: Extracting Proprietary Data via Topic-Based Poisoning [7.1] Supervised Fine-tuning (SFT) は、大規模な言語モデルを下流タスクに適応するために広く使われている。
ユーザ会話のクラウドソーシングは、SFTデータを大規模に収集するための確立したアプローチである。
悪意のあるユーザは、クラウドソースされたデータのごく一部を悪用して、これまで見つからなかった命令の抽出を増幅できるだろうか?
我々は、デプロイされたモデルへのブラックボックス、出力のみのアクセスのみを使用することで、これが可能であることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:36:22 GMT)
Self-Designed Evaluators and Warm Memory for Long-Horizon Agents [7.1] SelfSuiteは、重み付き審査員による評価スイートで、テイクベストの再試行をゲートし、型付き、結果追跡されたメモリをラベル付けする。
Tau2-benchとAppWorldの5段階のベンチマークで、SelfSuiteはラベルなしでプレーンエージェントの上位にスコアを付けている。
2つ目のモデルファミリーに関する単行研究は、同じ順序を示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:19:10 GMT)
What Does a Skill Actually Do? Estimands and Evaluation Validity for Tool and Skill Use in LLM Agents: A Critical Review [6.4] 大きな言語モデル(LLM)エージェントは、数千のエントリを保持するライブラリから実行時に選択された外部ツールや再利用可能なスキルをますます引き出す。
このレビューでは、各設計がどの設計と比較し、どの仮定に基づいているかを問う。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:26:34 GMT)
What Does It Mean to Forget a Person? Individual-Level Unlearning in Vision-Language Models [6.4] IDUnlearn-BenchはVision-Language Models (VLM)における個人レベルのマルチモーダル・アンラーニングのための最初のベンチマークである
属性中心の記憶が成功すると、かなりのアイデンティティレベルの知識がそのまま残され、モノトニックではないことがよく示される。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:47:10 GMT)
When Does the Concept of "Dog" Emerge in an Audio LLM? [6.3] Qwen2.5-Omni-7Bにおける犬のbarkingについて,Jacobian Lens(J-lens)読み出しと方向性介入を用いて検討した。
我々は、犬や樹皮のプロンプトや動物識別の要求なしに、この情報をデオードできることを発見した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:09:36 GMT)
3D Point Tracking with State Space Models [6.3] 3Dポイントトラッカーは、3Dと4Dの再構築、ロボットナビゲーション、自動運転を支えている。
1つの点の2次元画像軌跡が固定されると、そのメートル法精度を規定する量は、そのピクセル線に沿った深さである。
最適構成は同一条件下で評価された手法の中で最高の絶対距離精度が得られる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:56:35 GMT)
Is AI Widening the Wage Gap? A Hybrid Agentic Simulation for Labor Equity [6.1] 人工知能(AI)は労働市場を変革しているが、賃金分配への影響と基盤となるメカニズムはまだ十分に理解されていない。
この枠組みと中国からの社会デマログラフデータを用いて、賃金分配の繰り返しAIショックの変化をシミュレートする。
その結果、トップ・ボトム・インカム・デック(TB10)における労働者の平均賃金比率とジニ係数が持続的に増加し、AIショックが賃金格差を拡大し、所得不平等を悪化させることが示唆された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:50:23 GMT)
Estimation is Not Enough: Carpet-Bombing Detection via Per-Packet Uniformity Testing [6.1] Carpet-bombing攻撃は1つ以上の宛先IPプレフィックスにトラフィックを均一に分散させる。
既存のカーペット爆弾検出器は、数秒から数分のレイテンシで動作します。
カーペット爆弾の最初のスケッチベース検出モデルであるSweepSketchを紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:20:28 GMT)
ActiveMem: Dynamic Latent Memory Trees for Long-Horizon Agents [6.1] ActiveMemは階層型メモリフレームワークで、エージェントエクスペリエンスを依存性対応の潜伏実行ツリーに整理する。
我々は、ActiveMemが既存のメモリベースエージェントよりもタスク補完、推論安定性、メモリ効率を一貫して改善していることを示します。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:30:01 GMT)
FINGR: Learning Dexterous Hand Control for Real-World Rubik's Cube Solving [6.1] FINGR (Future-supervised Interaction Network with Geometric Representations) は指相対幾何学と将来の対話予測を組み合わせた政策である。
実のところ、我々の政策は、ベースフロー政策の79.7%と比較して、300ターンの試行よりも99.0%成功している。
グルーピングとテーブルアシストのリグラスと統合され、約137秒で10個のスクランブルされた2時間2時間2ドルキューブを解く。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:15:58 GMT)
MAD-Guard: Controlled Study of Autoregressive Generation versus Direct Decision Interfaces for Closed Multimodal Forensic Tasks [6.1] 閉鎖型マルチモーダル法医学的タスクに対する出力-決定インタフェースの制御に関する研究であるMAD-Guardを提案する。
我々は、決定インターフェース(AR-SFT [generate] $to$ Logit Slice $to$ Binary Direct Head $to$ +choice $to$ +act $to$ CLM-Head)の進行を評価し、遅延をバックボーン表現に分解する。
5つのベンチマークから5000枚以上のアウトオブサンプル画像が得られ、私たちのフレームワークは合成、カモフラージュ、文書偽造に優れています。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:45:14 GMT)
COGNIT-Guard: Calibrated Standalone Direct-Decision Guardrails with Heterogeneous CPU-NPU Confidence Cascading under Explicit Latency and False-Positive Constraints [6.1] 実時間プレインジェクション安全ガードレールの独立直接決定基盤モデルの校正について検討した。
検証校正型CPUゲートキーパと信頼ゲートエスカレーションを結合したCOGNIT-GuardをNPUレジデント322M双方向直接決定モデルに提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:32:15 GMT)
From Constitutions to Control: Interpretable Rewards for Aligning Language Models [6.0] 言語モデルの整合化に対する現在のアプローチは、どのような振る舞いが報われているのか、あるいは目標とする方法でその報酬を変更するのが難しくなっています。
汎用構成を解釈可能かつ調整可能な報酬モデルに変換するためのルーブリックベースのフレームワークを開発する。
また,学習報酬に対する影響を低減し,選好判断におけるバイアスを緩和できることを示した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 01:44:01 GMT)
Teach Yourself Where to Look: On-Policy Attention Self-Distillation for Reasoning [5.9] 自衛隊の自衛隊は、認証されたソリューションにアクセス可能な特権教師からの密集したトークン配布指導を用いて、自衛隊の自衛隊のモデルを推論する。
我々は, トークンレベルの監視と, 溶液条件の注意蒸留を補完する, OPASD(On-Policy Attention Self-Distillation)を導入する。
OPASDはトークンのみのOPSDを一貫して上回り、平均精度は4.98から8.40ポイント向上した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 04:38:41 GMT)
Quantum Monte Carlo Tree Search with Fixed Confidence [5.8] 本稿では, 固定信頼条件下でのモンテカルロ木探索(MCTS)の改善について検討する。
ゴールは、クエリの複雑さを最小化しながら、高い確率で、与えられたゲームツリーのほぼ最適移動を特定することである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:00:47 GMT)
Lost with a Map: Conversational State and Behavioral Reliability in Language Models [5.8] タスク指向の対話はターン間で情報の維持と更新を必要とするが、言語モデルは明示的な信念状態のオブジェクトを公開しない。
我々は,MultiWOZとSGDの4つのファミリーから8つの命令調整言語モデルの中で,会話状態がどのように表現され,更新され,使用されるかを検討する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:57:52 GMT)
Steer2Grasp: Inference-Time Embodiment-Aware Steering for Diverse Physically Feasible Grasp Diffusion [5.8] 我々は、推論時グリップステアリングのためのトレーニング不要なエボディメント非依存フレームワークであるSteer2Graspを提案する。
本手法は,基礎となるグリップに近接を維持しつつ,実現可能なグリップ生成を大幅に改善する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:13:48 GMT)
Feedback Makes Perfect: A Closed-Loop Framework for NL-to-STL Translation [5.8] Signal Temporal Logic (STL) は、サイバー物理システムの厳密な検証と制御を可能にする。
大規模言語モデルは自然言語(NL)要求をSTLに変換することができるが、より強力な翻訳者は精度の高い天井に近づく。
我々はNL-to-STL変換をクローズドループフィードバックプロセスとして再構成する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:46:39 GMT)
Plug-and-Play Methods Provably Converge Even with Improperly Trained Denoisers: Convergence by Architectural Design [5.7] Plug-and-Playメソッドは、近位演算子を学習されたデノイザに置き換え、最先端の品質を生み出す。
Proximal Networks (LPNs) は Denoiser アーキテクチャを記述し、それは正確には近位演算子正規化器である。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 01:45:27 GMT)
What masking geometry works best for EEG foundation models? [4.3] EEGファンデーションモデルは、臨床および認知神経科学応用にまたがるスケーラブルな脳信号デコーディングを約束する。
デザインの選択の中で、マスキング戦略は特に重要であり、モデルが何を予測し、どのコンテキストから予測するかを決定する。
本稿では,2つのフレームワークにまたがる1つのパイプラインマスキング構成を用いて,ネットワーク,時間的マスキング戦略,およびトレインモデルを定式化する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:55:29 GMT)
Surgical Master Console Using General-Purpose Robot Arms and a Separable Articulated Distal Interface: Porcine In-Vivo Evaluation [3.8] 汎用ロボットマニピュレータはプログラム可能なベースを提供し、手術固有の相互作用は分離可能な遠位アダプターに集中する。
完全なバイマニュアルハードウェアは5500ドル(約5,500ドル)で、一般的なバイマニュアルの商業的な触覚の基準を下回る。
共通マスターステートはアイザック・シムまたはRCMに制限されたデュアルFR3プラットフォームを駆動する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:53:51 GMT)
Contact-Stable Deformable Tissue Simulation Using Implicit Integration and Live-Pose Grasp Constraints for Laparoscopic Surgery Robot Policy Evaluation [3.8] 手術ロボットのクローズドループ評価は、変形し、つかみ、持ち上げることができる組織を必要とし、ロボットが操作する解剖学を再現する。
本稿では,この組織を外科領域のRGB-D記録から再構成し,楽器を除去し,水密ボリュームに閉鎖し,四面体化したシミュレータを提案する。
暗黙の統合、衝突メッシュから分離したシミュレーションメッシュ、数値ガード、生きた組織のポーズで捕獲された拘束力などである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:35:26 GMT)
Correct then Forecast: Observer State-Space Models for Time Series Forecasting [3.8] 時系列予測のためのオブザーバ状態空間モデル(OSSM)を紹介する。
OSSMは測定同化から潜在状態の伝播を分離する。
また,OSSMは,対応するSSMベースラインと同じパラメータ数とトレーニング設定を維持しつつ,大幅な改善を実現していることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:40:42 GMT)
Learning in the Transverse Subspace: A Minimal Representation for Divergence-Free Operator Learning [3.8] 微分自由ベクトル場は非圧縮性流れや多くのPDE系における基本状態変数である。
神経保護法(NCL)ポテンシャルを含む冗長パラメータ化は、複数の補助的な表現を同じ物理場にマッピングする。
実(D)-次元領域上の実(D)-成分の発散のないベクトル場を符号化する最小表現を導入する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 00:38:20 GMT)
The Rashomon Wikipedia: A Data-Perspectivist Analysis of Divergent Historical Narratives [3.8] 本稿では,5言語にわたるウィキペディア記事を分析し,言語間歴史バイアスについて検討する。
我々は、ポサダの戦い(1330年)、ソ連によるベッサラビア占領(131940年)、タルゴヴィスト夜襲(1462年)の3つの論争的な出来事に焦点を当てた。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:25:34 GMT)
Recovering Lower-Dimensional Semialgebraic Support of a Measure from its Moments [3.7] モーメントマトリクスのカーネルは、サポートと十分に正規なフル次元サポートの回復によって消滅するカーネルを明らかにすることができることを示す。
この研究は、モーメントマトリックスのカーネルがサポートによって消滅するカーネルを明らかにし、十分な正則なフル次元サポートの回復を行うような、代数的サポートを伴うリカバリ対策の研究を補完する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:09:33 GMT)
Knowing Is Not Choosing: What Explicit Verification Adds Beyond Generative Preference [3.4] 事実的リコールは、正しい候補を生成し、利用可能な候補をランク付けし、最終回答を選択する3つのステップに分けます。
P(mathrmTrue)$による明示的な検証は、Gemma、Qwen3、Llamaの平均ログライクなランキングを改善する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:13:39 GMT)
When Does Backpropagating Through Policy Memory Matter? Physical Credit, Optimizer Updates, and Observability [3.3] Transformer-XLとTruncatedのバックプロパゲーションは、その値を保持しながら保存された履歴の2番目のパスをカットした。
パラメータ勾配, 計算結果の更新, およびトランスフォーマー容器軌道モデルおよび四重項追跡ポリシーの継続訓練を計測する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:46:06 GMT)
CSC: Calibrated Simplicity for Conflict-Aware Social Bot Detection in the LLM Era [3.2] ソーシャルボット検出は、誤情報増幅、協調操作、歪んだ公開談話からオンラインプラットフォームを保護するために不可欠である。
大規模な言語モデルは、セマンティック・カモフラージュが安価で、流動的でスケーラブルであるため、テキストのみからソーシャル・ボットを検出するのをはるかに難しくしている。
競合認識型LPM時代のソーシャルボット検出のための校正・簡易化フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:19:13 GMT)
Annealed Sinkhorn with Momentum: Certified Unregularized Optimal Transport in Linear Memory [3.2] 非正規化された離散的最適輸送に対してBDRS(Bregman Douglas-Rachford splitting)を特徴付ける。
線形メモリにおける任意の原始双対証明書を開発する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:09:27 GMT)
Evaluating System One Models for Agent Security Decisions: Reliability, Calibration, and Selective Automation [2.9] System Oneモデルは、入力を許可、ブロック、エスカレートするためにソフトウェアが使用できる確率で型付き決定を公開する。
我々は,Jev,Laya,Decider,Bespoke Nimbleを特殊分類器および言語モデル判定器に対して評価する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:30:13 GMT)
Simultaneously Query-Optimal Quantum Linear-System Algorithm [2.9] Oleft(logfrac1varepsilonright)$ query to $U_A$ and $Oleft(/sright)$ query to $U_b$。
すべての量子線型系アルゴリズムと全ての解ノルムスケールに対して、そのアルゴリズムは$(/s)$行列クエリと$(/s)$状態準備クエリの両方を必要とする単一のエルミートインスタンスが存在する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:49:21 GMT)
Printability-Constrained Adversarial Decals for Near-Nadir Aerial Perception: Measured Ink Gamuts, Nested Realism Constraints, and a Physical-World Bound [2.9] 空中知覚のための適応パッチは一般的にデジタルコンポジットとして評価され、実装の詳細として印刷が残されている。
本研究は、特定のプリンタが再現できる色域、車両が提供するフラットパネルのサイズ、およびパッチが高度から撮像されたときに発生する細かな詳細の損失の3つの物理的制約を追及する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:35:19 GMT)
EHRAdapt: Adapting Pretrained Language Models to Electronic Health Records with Semantic Priors for Rare Clinical Events [2.8] EHRAdaptは,凍結した言語モデルの埋め込み空間に直接マップするアダプタである。
モダリティは学習された埋め込みを受け、学習された注意バイアスを通じて時間ギャップが入り、イベントコードは専用のベクトルを受け取る。
EHRAdaptは、すべてのバックボーンでホールドアウトされた次のイベント予測において、すべてのアブレーションを上回ります。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:07:08 GMT)
BaatCheet: A Multilingual Corpus for Dialogue Translation in Indian Languages [2.8] 約49,000の対話を含む多言語対話コーパスであるBaatCheetを紹介する。
我々は、7つのトレーニングデータ構成にまたがる5つのオープンソースのLCMを微調整し、微調整によってゼロと数ショットのベースラインよりもかなりの利得が得られることを発見した。
対話翻訳の品質を総合的に評価するために,SQM誘導型ダイレクトアセスメントプロトコルを用いて,自動メトリクス,LCM-as-judge,人的アセスメントなどの複数の評価戦略を採用する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:00:46 GMT)
SurgFlow: 3D Object-Centric Contact Flow for Surgical Robot Manipulation [2.6] 本稿では,アクションラベルのない立体的手術ビデオから3次元物体中心接触流を学習するフレームワークであるSurgFlowを紹介する。
各対象点について、将来の3次元軌跡と接触点を予測する。
da Vinci Research Kit (dVRK) において、SurgFlowは39ステージのうち37ステージの評価に成功し、組織除去、バイマン露呈、針の取り出し、ハンドオーバなどを行った。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:25:57 GMT)
Tsubame: Tree Replay for Diffusion-Based Speculative Decoding [2.5] 拡散型ドラフト作成者のための2パス木投機的復号化フレームワークであるツバメを紹介する。
ツバメは、サンプルチェーンに対する不利益を逆転させる設定を含む、決定論的木よりも受け入れ長とスループットを向上させる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:18:32 GMT)
Large Language Models for Model-Based Robot Design [2.5] 大規模言語モデル(LLM)は、ロボット設計に有用な工学的知識を提供する。
しかし、直接生成された設計は暗黙の仮定に依存し、実現可能性や最適性を保証するものではない。
物理関係, 互換性制約, 目的を含む明示的な工学モデルを構築するために, LLMを用いたフレームワークを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:11:02 GMT)
Relevance Is Not Sufficient Evidence: Detecting Evidence Gaps Before Generation in RAG [2.2] Retrieval-augmented Generationは、外部ソースで大きな言語モデルを構築する。
12個の発電機が40.0-99.3%の証拠不十分な質問に答えている。
質問のすべての部分がカバーされているか、どの文が答えを提供するのか、そして、その文を一緒に読んでいる小さな言語モデルで十分な判断を下すか、という3つの信号を組み合わせてRINSEを紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:39:51 GMT)
Temporal Graph Learning of Wearable Actigraphy and Sleep Traces for Modelling Adolescent Crystallized Intelligence [2.1] 本研究では,睡眠活動型テンポラル統合回帰ネットワークであるSATURNを提案する。
参加者は、日々の行動と時間的隣接をコードする21ノードの時間グラフとして表現される。
STURNは家族によって制御され、年齢差のBMI階層化されたクロスバリデーションの下で、R2 = 0.2783 pm 0.0127$を達成し、フラット化された機械学習を継続的に改善している。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:19:46 GMT)
MAC-Net: A Multi-Task Deep Learning Framework for Modeling Cognitive Function From Task-Based fMRI [2.1] タスクベースfMRI(tfMRI)から個々の認知機能をモデル化するためのマルチタスク・アクティベーション・コントラスト・ネットワーク(MAC-Net)を提案する。
MAC-NetはtfMRIの特徴を専用神経経路に分離し、変数を終端遅延融合経路に制限する。
MAC-Netは再現可能な認知機能推定を行い,臨床翻訳のための堅牢な神経工学的枠組みを確立した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:45:24 GMT)
Explainable Deep Learning of Resting-State Functional Connectomes Reveals Network Biomarkers of Adolescent Intelligence [2.1] 我々は,流動,結晶化,全知能を予測するために,疎投影残差ネットワークに基づく説明可能なディープラーニングフレームワークを開発した。
このフレームワークは既存のアプローチよりも優れており、Pearson相関は流体、結晶化、全知能の0.44、0.58、0.56である。
これらの結果から,局所的な計算ハブと分散通信経路の相互作用から知能が出現することが示唆された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:10:51 GMT)
MISHAP-Bench: A Hallucination Benchmark for Large Audio-Language Models [2.0] 大規模な音声言語モデル (LALM) は、音声に関する流動的な応答を生成するが、しばしば、プラウシブルで根拠のない主張をすることで幻覚させる。
既存の音声幻覚ベンチマークは、主に応答の正しさを計測し、LALMが幻覚するかどうか、単に音声を理解するのに失敗するか、はっきりしないままである。
本研究は,2つの幻覚的カテゴリーを定義して,正当性に基づく評価に挑戦する。 (i) 主張が音声に根ざしていない状況, (ii) 知識, (ii) 音声関連トピックに関する主張が外部から検証可能な事実からの支持を欠いている状況,である。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:17:28 GMT)
Terminal-Register Certification for Finite-Measurement Learning of Multiscale Quantum States [2.0] 逆2次元多スケールエンタングルメント再正規化アンサッツ(MERA)による純粋一次元状態の学習について検討する。
理想的な逐次および終端測定スケジュールが一致した因果操作の下で同じ完全ビット列分布を提供することを確認した。
雑音認識定理は、有限ショット証明書に個別の摂動総変量実装予算を導入する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:41:20 GMT)
A packet-level digital hardware twin for commissioning megahertz diagnostic edge AI and plasma control system integration in tokamaks [2.0] 高帯域プラズマ診断は、リアルタイムトカマク制御を目的とした機械学習および信号処理アルゴリズムへの入力をますます提供する。
我々は,メガヘルツ診断エッジAIアーキテクチャのためのパケットレベルのディジタルハードウェアツインを開発した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:47:52 GMT)
Sparsity by Default: The Theory and Practice of ARD in Gaussian Process Regression for Variable Selection [1.9] 自動妥当性決定(ARD)はガウス過程(GP)回帰における入力選択のための標準装置である。
ARDは、カーネル学習とのシームレスな統合、ユニバーサルソフトウェアのサポート、低コストによって、耐えられると我々は主張する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:19:50 GMT)
Curating Merchant-Matching Training Data with Two Confidence-Gated Local LLM Judges [1.9] マーチャントマッチングは、検索された商人エンティティにノイズの多い支払い記述子を解決し、マッチを返さない。
トレーニングラベルをキュレートする上で重要な課題は、教師の棄権と、受け入れられる実体が存在しないという証拠を区別することである。
2つの局所的大言語モデルの裁判官間の合意が擬似ラベルの信頼性を向上させるかどうかを検討する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:55:34 GMT)
On Embedding Design in Quantum Physics-Informed Neural Networks [1.8] 量子物理学インフォームドニューラルネットワーク(QPINN)は、物理に基づく残留物に対するパラメータ化量子回路のトレーニングにより偏微分方程式(PDE)を解く。
可変回路で利用可能な特徴表現を形作る機能変換として埋め込みを定式化する統合埋め込みフレームワークを導入する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:00:50 GMT)
Principal Steering Subspaces for Online Adaptation of Frozen Generative Robot Policies [1.7] 主ステアリング部分空間(PSS)は有限差分デコーダ応答から固定された低次元制御基底を構成する。
PSSはより早く収束し、フルラテント制御よりも安定な遅延学習挙動を示す。
PSSは、凍結生成ロボットポリシーのオンライン適応のための実践的基盤としてデコーダ応答幾何学をサポートしている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:04:16 GMT)
Context Spanning: A Communication Framework for Full-Duplex Speech Models and External LLM Backends [1.6] コンテキストは、外部情報を二重言語モデルに直接注入できることを示し、二重言語システムのための新しいシンプルで強力なメカニズムを導入する。
提案手法は,フルデュープレックスベンチマークにおいて高い性能を達成し,会話の可能性を示す質問応答タスクの強力な結果を得る。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:48:21 GMT)
A Free Knob: Decoupling Calibration and Predictive Skill in Threshold-Based Evaluation [1.6] 固定された稀な操作点において、最大臨界成功指数(CSI)は、振幅校正と空間的識別を一致させる。
我々はモノトン校正を対称監査として再利用し、ホールドアウトデータに適合したポストホック変換を各システムに個別に適用した。
この効果は、試験期間前の窓に変換が取り付けられる際に持続し、キャリブレーションにより、より良い校正基準線によって隠された利点が明らかになる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:08:55 GMT)
Elucidating the Design Space of Regression-based Diffusion Reinforcement Learning [1.4] DiffusionNFT、FlowAWR、RAMは対照的なモチベーションを持つ代表的なシステムである。
それぞれが1つの発散制約付き報酬最大化問題の解であることを示す。
さらに, 設計空間を実験的に検討し, 回帰式拡散RLのトレーニングレシピに光を当てた。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:52:04 GMT)
BERT4DTI : BERT-based Model for Predicting Drug-Protein Interactions [1.3] シーケンスベースのDTIモデルは、3つの実用的な制限に直面している。
BERT4DTIは、SMILES文字列をChemBERTaで、アミノ酸配列をProtBERTでコードする。
畳み込み層と多層パーセプトロンを用いて、結果として生じる相互作用特徴を分類する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:57:31 GMT)
Source Anchoring for Physical Consistency in Flow Matching Models [1.3] 深部生成モデルは、物理系状態の偏微分方程式とモデル分布を解くために用いられる。
投影型流れマッチング法は、制約のない雑音分布からの流れを補正することによって物理を強制する。
生成開始前の音源雑音に物理的制約をエンコードする関数フローマッチング法である,物理一貫性のためのソースアンカリング(SAPC)を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:29:41 GMT)
Valid and Efficient Split Conformal Regression for Time Series [1.2] 時系列の1ブロック上のモデルに適合する等角化量子回帰と等角化中央回帰について検討する。
時系列における分割共形回帰に対して,非漸近的カバレッジ保証と間隔長の精度を同時に確立する。
キャリブレーション長は推定中心よりも早く収束し、通常の中心に対して一致する下界を与えることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:38:19 GMT)
Conformal Coverage of Time Series: Validity and Inference [1.2] 現実のカバレッジに対する推論は、特に時系列に関して、比較的ほとんど注目されていない。
仮定を混同することなく、限界被覆誤差の非漸近境界を導出する。
非常に強い時間的依存が、実現されたカバレッジの非ガウス的制限法につながることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:43:45 GMT)
PI-NOMT: Physics-Informed Neural Optimal Mass Transport for Brain Fluid Dynamics [1.2] 脳イメージングにおいて、ダイナミックコントラスト強調MRI(DCE-MRI)はトレーサー濃度の時間分解測定を提供する。
この問題を、輸送体自体が推論の主対象である物理インフォームド潜在状態推論として定式化する。
本研究では, 密度, 速度, 情報源を連続的ニューラルネットワークとして表現するフレームワークであるPhysical-Informed Neural Optimal Transport (PI-NOMT)を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:23:53 GMT)
QureRadEmbed: Structuring Radiological Similarity through Attribute and Reasoning Supervision [1.2] QureRadEmbedは2つの補完信号で訓練された4Bラジオロジー対応エンコーダである。
3段階のカリキュラムは、これらの信号をレポート三重奏と組み合わせ、摂動を見つけ、シングルアトリビュートとクロスアトリビュートコントラストを見つける。
その結果、検索、構造化されたレポートインデックス作成、効率的なレポート比較のための再利用可能なラジオロジー対応評価器表現をサポートした。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 01:14:08 GMT)
Notes on Generative Modeling for Feedback Control and Planning [1.2] 制御系の状態空間における動的に制約されたサンプリング問題として制御を考察する。
制御可能性、最適制御、軌道計画といった概念は、対応するアルゴリズムの拡張を導く上で重要な役割を果たす。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:40:08 GMT)
Scalable and Data-Driven Decision Support in the Maintenance, Repair, and Overhaul Process [1.2] 修復プロセスを通じて,機械学習に基づく意思決定支援を支援するスマートエキスパートシステム(SES)を提案する。
SESは、先進的なガスタービン会社の実際の産業データを用いて評価され、総合的な意思決定支援の適合性と囲むITアーキテクチャの安定性に関する定式化された要件を実証的に満たしている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:03:36 GMT)
Pretraining Transformers with Quantized Softmax in Attention [0.8] 低精度トランスフォーマーシステムは注目行列乗算の定量化をますます進めている。
事前トレーニング中、近似ソフトマックスはモデルと前方の計算を訓練する勾配を変化させる。
我々は,ローグリッドのキャリブレーションごとのキャリブレーション,ハードラウンドリング,および正規化に対するストレートスルーサロゲートの配置が異なる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:09:52 GMT)
Approximating Softmax in Pretrained LLMs: Model Sensitivity and Kernel Acceleration [0.8] NVIDIA Blackwell B200では、テンソルコアスループットが特殊関数の指数スループットを2桁以上上回る。
我々は,10個のフリーズデコーダのみのモデルにおいて,ソフトマックスを推論で近似することにより,事前学習モデルに何が必要かを特徴付ける。
B200では、パッチされたFP8の注目は因果8Kでは12.4%、非因果8Kでは25.8%、ホスト側の呼び出し待ち時間測定では25.8%である。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:03:42 GMT)
A Multi-Dataset Benchmark of YOLO-Based Weed Detection in Precision Agriculture [0.8] 本稿では,精密農業における雑草検出のための深度物体検出装置のマルチデータセットベンチマークを提案する。
7つの公共雑草検出データセットを用いて,ナノ,小型,中型の評価を行った。
その結果,YOLO26mは平均精度が最も高く,YOLO26sは実用的精度・効率のトレードオフとして優れていることがわかった。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:44:17 GMT)
API Secrets Should Never Become Tokens in the LLM's Vocabulary: A Threat Analysis of API Credential Handling in LLM Agent Systems and an Empirical Evaluation of a Vault-Mediated Execution Boundary [0.8] 本稿では,エージェントシステムにおけるクレデンシャル・エクスポージャー・脅威連鎖を定式化する。
モデルがコネクタを選択し、信頼された要求境界が認証を提供する。
我々は,2つのブラックボックス実験において,Corvic Security Vaultという製品の実装を評価した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:55:16 GMT)
Theory Guided and Interpretable Neural Operator Design for Partial Differential Equation Learning [0.7] 本稿では,ニューラル演算子学習と適応フーリエ分解(AFD)理論を取り入れた新しいPDE解法 AFDONetを提案する。
AFDONetは、アーキテクチャとコンポーネントの設計が確立された数学的フレームワークによって完全にガイドされる最初のニューラルPDEソルバである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:18:27 GMT)
An Active-Bottleneck Mechanism for Weak-to-Strong Generalization [0.7] 弱弱の一般化は、教師の予測で訓練された学生がその教師より優れているときに起こる。
完全に収束した隆起のない2段階の学習の下で、これがいつ起こるかを研究する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:36:00 GMT)
HESP: Separating What to Probe from When to Stop in Local LLM Alert-Triage Agents [0.6] 本稿では,モデル外の調査手順を保持するコントローラであるHESPについて述べる。
HESPは競合する説明の台帳を保持し、コスト毎の情報ゲインによって読み取り専用プローブを選択し、現在の証拠によって裏付けられている評決のみを受け入れ、調査自体を終わらせることができる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:54:05 GMT)
MultiEcho: An Experimental Science of Learned Worlds [0.6] MultiEchoは、物理法則とは独立かつ関係なく、学習世界の法則を研究するためのフレームワークである。
3参照推定器は完全な介入応答を予測し、介入パラメータを回復する。
実験は応答予測可能性、介入可読性、物理的精度を区別する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:17:42 GMT)
An Empirical Study on how Computing Students Interact with Large Language Models for Learning Purposes [0.6] LLM(Large Language Models)は、教育において人気のあるツールである。
本研究は,学習におけるLLMツールの使用方法,学習の影響の認識,およびこれらのツールの使用に依存する戦略について検討する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:50:40 GMT)
NxM-Version Programming for Quantum Software: High-Level Components across Frameworks and Engines [0.6] 本稿では,Apache NiFiデータフローキャンバス上のコンポーネントとして,量子ソフトウェアフレームワークの高レベルルーチンをパッケージ化するQuanifiを提案する。
1つのNiFiフローがそれぞれの$N$の実装をM$エンジン上で実行し、すべての結果にその実装とエンジンがラベル付けされているため、その不一致は、実装、エンジン、または1つの実装-エンジンペアにリンクすることができる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:58:33 GMT)
ORBIT: A Framework for Multi-Agent Safety and Security Evaluations [0.6] 実験的なマルチエージェント安全性とセキュリティ研究のための評価フレームワークであるORBITを紹介する。
ORBITは、通信トポロジ、メモリ、スケジューリング、エージェントロールの設定を可能にする。
4つの脅威タイプと4つの防衛戦略、および非敵の失敗をサポートする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 02:20:08 GMT)
Engineering Defect-Phonon Interactions Through Heterophase-Interfaces in Silicon Carbide Membranes [0.5] 広帯域半導体の点欠陥は、固体プラットフォームにおいてスピンおよびフォトニック量子ビットを提供する。
固有電子-フォノン相互作用は広いフォノン側バンド放出と弱いゼロフォノン-ライン遷移を誘導する。
結晶工学の戦略として,遠隔エピタキシー技術に基づくヘテロ相制御インタフェースを導入する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:13:23 GMT)
Eyes on the Road: A Naturalistic Comparison of MTW Rider Gaze in Urban Indian Traffic [0.5] 自動車化された二輪車(MTW)がインドの道路を支配しているが、運転行動研究では不足している。
本研究では,都市交通におけるMTW運転者の視線行動の大規模解析を行った。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:03:16 GMT)
Diffusion-Based Rollouts as a Stabilization Mechanism for Long-Horizon Environmental Forecasting [0.4] 低次元水位時系列と高次元降水場を用いた予測のための安定化機構として拡散型ロールアウトについて検討した。
水位実験では、ロールアウトが外部予測情報へのアクセスを失うと、予測は徐々にイベントレベルの忠実度を失う。
ロールアウト全体を通して数値気象予報から条件を保った降水実験では、拡散は空間構造と事象検出技術をより良く保存する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 21:16:27 GMT)
Jev in Medicine: A Benchmark Evaluation. Preliminary Results [0.4] Jevは、事前定義された回答オプションに確率を割り当て、外部では答えられない、非生成的な"System One"モデルである。
MetaMedQA, PubMedQA, diagnosisArena-MCQ, NEJM Case Challengesの4つのベンチマークでJev 1.13を評価した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:33:04 GMT)
CORTEX: A Verified Experience Layer for Generalist Agents [0.4] 我々は,認証済み体験の外部レイヤを通じて,特殊エージェントを接続する汎用AIシステムフレームワークであるCORTEXを紹介する。
各エピソードはタスク条件、ソースとツールの状態、決定的な述語、証明トレース、検証および結果を記録する。
我々は、正確なリプレイとソース・バージョン分離のためのシステム契約を定式化し、再利用の節約時に導出する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:06:32 GMT)
The limits of exactness: On the failure of automatic differentiation in physics-informed machine learning [0.4] 数学的意味での正確さは物理学の忠実さと同じではないと私は主張する。
私は、微分は数値的に完全であり、なおも問題に対する誤った微分であると主張する。なぜなら、ADは構成上、解が従わなければならない物理的構造の概念を持たないからである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 01:30:50 GMT)
Optimizing the Phi-2 Small Language Model for Real-time Chatbot Applications Using Parameter-Efficient Fine-Tuning (PEFT) with QLoRA Quantization [0.4] 本研究は,リアルタイムインタラクションにおけるモデル応答の精度を維持しつつ,メモリ使用量を大幅に削減することを目的とする。
この研究の結果は、効率的でスケーラブルでアクセスしやすいAI技術の開発に重大な影響を及ぼす。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 21:12:40 GMT)
MA-JEPA: Joint-Embedding World Models for Multi-Agent Reinforcement Learning [0.4] 自己教師付き共同埋め込み予測(JEPA)は,マルチエージェント強化学習のための学習信号を提供することができる。
観測結果の再現を目標表現の予測に置き換える世界モデルMAJEPAを紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:37:30 GMT)
Mask-Induced Displacement in Audio XAI via Logit Trajectory Decomposition [0.3] 摂動に基づくXAI手法は、スペクトル領域をマスキングし、保持信号に対する出力変化を信用することで特徴的重要性を推定する。
この仮定を検討するために,ロジト空間軌道分解法を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:53:57 GMT)
Larry Caused the Car to Stop, But the Model Didn't Notice: Transformer Blindness to the M-Heuristic [0.3] DeBERTaのようなエンコーダベースの変換器がM-Huristicを使用しているかを検討する。
M-ヒューリスティック(M-Heuristic)は、言語形式が顕著な意味を暗示する新グリス主義の原理である。
DeBERTa、RoBERTa、BARTは、これらの形態のプラグマティックな区別を捉える証拠を示さない。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:24:39 GMT)
RAISE: Reinforcing Access Control Policy Synthesis in LLMs via Symbolic Evaluation [0.3] 検証可能なCedarポリシー合成のためのトレーニングとセマンティック評価の両方をサポートする最初のデータセットを構築した。
44のドメインに5,800のシナリオがあり、1,408は単一の合成組織を表している。
RAISEは2段階の形式的検証からポリシーシンセサイザーを訓練し、教師付き微調整(SFT)に続いて、検証信号から学習する強化学習段階を学習する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:53:13 GMT)
Mycelium: A Generalizable Cross-Grid Multi-Task Model for Electrical Distribution Systems [0.3] 電配電網の動作はスパース、ノイズ、不完全な時系列測定から異種ネットワークをまたいだ推論を必要とする。
我々は,ネットワーク位置と名目位相方向を符号化する構造を考慮した通信エッジと電気参照機能を備えたグラフ変換器Myceliumを提案する。
マイセリウムは、最も報告されたベンチマーク指標でタスク固有の神経ベースラインより優れていることが観察される。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 02:40:10 GMT)
How Much Imprecision is Enough Imprecision in my Classifier? A Practical Elicitation Procedure [0.2] 本稿では,設定された予測に対するユーザの利便性を測定するための実用的かつ運用的な手順を提案する。
提案手法は,実際のアプリケーションに対するアプローチの実践性を強調し,少数のインスタンスをユーザに提示する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:23:48 GMT)
E-CONAN (Entailment, CONtradition And Neutral) Diagnostics Dataset Investigating Linguistic Phenomena in Arabic Natural Language Understanding [0.2] 多様な言語現象の誤りを分析することは、自然言語理解の改善に不可欠である。
いくつかのベンチマークには、調査ときめ細かいエラー解析のために設計された診断データセットが含まれている。
E-CONANデータセットは、NLUデザイナがエラー分析や詳細な調査を行うことで、モデルをよりよく理解するのに役立つ。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:56:05 GMT)
Controlling Speaking Rate in Autoregressive TTS via Activation Steering [0.2] 自動回帰音声合成システム(TTS)は、自然言語を合成するが、一度訓練すると、発話速度をほとんど制御しない。
我々は,1つのデコーダブロックのアクティベーションを,検出された速度軸に沿ってクランプすることで,再学習することなく,推論時に発話速度を判断できることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:03:08 GMT)
PDFa11yMut: Measuring Mutation-Specific Detection in PDF Accessibility Checkers [0.2] PDFa11yMutは、ペア構造レベルの変換を基準適合ベースラインに適用することで、突然変異特異的チェッカーの挙動を測定する。
このアーティファクトは、再利用可能な演算子、構造的および純粋オーラクル、ペア化されたベースライン/ミュータントエビデンス、およびスコープ付き突然変異試験研究のための再現可能な分析に寄与する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:35:34 GMT)
Parameter-Efficient 3D Segmentation of Liver and Liver tumors: Depthwise factorization Scales Better Than Dense Convolution with Spatial Dimensionality [0.1] 3次元の高密度畳み込みネットワークは、医用画像セグメンテーションにおける最強のパフォーマーである。
深く分離可能な因子化は このペナルティを共有しません
肝臓上の高密度3D U-Netを+0.031 Dice (paired p = 0.006) で、腫瘍上で+0.041 (95 % CI [+0.005, +0.081], paired p = 0.056) で超える3D U-Netを構築する。
LiTSと2次元内視鏡のベンチマークでは、ネットワークの学習可能なフィルタの大部分が、精度を犠牲にすることなく固定シフトに置き換えられるが、全てを置き換えることができる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 01:29:31 GMT)
A Computer Vision Approach to Visual Fraud Detection in Phishing Websites Using YOLOv8 [0.1] 本稿では、レンダリングされたWebページを、信頼されたブランドと一致するか、そうでない図として扱うフィッシング検出の視覚的アプローチについて述べる。
YOLOv8畳み込みニューラルネットワークは、レイアウト、ロゴ配置、カラースキーム、ログインフォーム構造に基づいて、フルページのWebサイトのスクリーンショットをフィッシングまたは合法に分類するように訓練された。
システムはホールドアウトテストセットで92%の精度に達し、100ミリ秒で1枚のスクリーンショットを処理し、前処理ベースラインと比較して偽陽性率を11%削減した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:19:12 GMT)
ADPTNet: Adaptive with Prescriptive Timescales Non-Linear SSM for Sequence Modelling [0.1] ニューロモルフィックコンピューティングは、高エネルギー集約型トランスフォーマーベースのAIに代わる実行可能な選択肢を提供することを目指している。
本研究では,Adaptive with Prescriptive Timescales Network (ADPTNet) を4つの特性を同時に実現するための潜在的なソリューションとして提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:56:14 GMT)
The Effects of Incremental Instruction Delivery on Language-Model Creative Writing [0.1] インクリメンタルなインタラクションは、明示的な要求チェックがキャプチャできない方法で、創造的なアーティファクトに影響を与えます。
我々はCreative Integrityを,共同執着と物語構造のコンパクトな尺度として定義する。
50組以上のマッチングされたペアの3光線による研究は、構造/コヒーレンス、工芸、ジャンルの効率性において、FULLの利点を独立に回復させる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:39:31 GMT)
CompliantWBC: Whole-Body Compliance for Heavy Humanoids via Force Latent Estimation and Residual Impedance Targets [0.1] 人中心環境において、重いヒューマノイドを高負荷下で展開するためには、全身準拠の制御が不可欠である。
従来の力覚学習ベースのパイプラインは、エンドエフェクタ抵抗、リンクごとの上体ばね、エンドエフェクタ硬度変調に重点を置いていた。
適合WBCとのギャップを埋める:(1)RLでトレーニングされたベースポリシーは、多地点のボディインピーダンス参照コントローラによって誘導され、古典的カルトインピーダンスを任意の制御リンクに拡張する;(2)フリーズベース上でリンクインピーダンス平衡を編集し、粗いが構造化された境界的残留ポリシー。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:24:14 GMT)
Federated Multi-Modal Human Activity Recognition using Multi-Agent Reinforcement Learning [0.1] ヘテロジニアスウェアラブルセンサからのヒューマンアクティビティ認識(HAR)は、IoHT(Internet of Health Things)の基礎となる。
既存のマルチモーダル融合法は、しばしば、モダリティの重要性、取得コスト、センサー品質の違いを見越して、センサーストリームに固定重量を割り当てる。
本稿では,集中型HARのためのマルチエージェント強化学習に基づく適応的かつ低コストなマルチモーダルHARフレームワークを提案し,FedMHARとしてフェデレート学習に拡張する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:59:51 GMT)
TutlAit v1: a crowdsourced Moroccan Tamazight speech dataset with Arabic transcriptions and regional accent labels [0.1] 本稿では、現代標準アラビア語テキストと明示的な地域アクセントラベルを組み合わせたモロッコのタマジット音声コーパスであるTutlAitデータセットについて述べる。
データは、クラウドソーシングのためのWebアプリケーションであるTutlAitで収集された。
データセットには、合計75,231秒(約20.9時間、約3.01GB)の13,384のオーディオファイルが含まれている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:28:38 GMT)
Laya as a Typed Probabilistic Assessor: An Independent Reproduction and a Preregistered Study of Calibration and Selective Escalation [0.0] カードはリスクを過信とみなし、測定された方向は逆であり、その方向は、自信に満ちたカスケードのどちらが失敗するかを決定する。
1つの不整合温度は、誤校正の大部分を取り除き、出荷されたオプション単位のテーブルを上回っている。
E1の再現は解析凍結に先行し、E2-E8は前向きに事前登録され、22の検査のうち20の検査はBenjamini-Hochberg FDRの下で$q5$(2 descoped)で拒絶された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:53:26 GMT)
Yorùbá in Unicode: An Overview of a Problem [0.0] 本論文は,出版書籍からWebプラットフォーム,モバイルキーボードに至るまで,現実世界のさまざまなコンテキストにおける障害を文書化する。
UnicodeのNFC正規化安定ポリシーを、簡単な修正を防ぐ構造的制約として識別する。
4つのコアYirb文字に対する形式的なエンコーディング要求を、解決への最も耐久性の高いパスとして提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:37:24 GMT)
When Privacy Moves ML-Mediated Decisions On Device: Information and Incentive Misalignment in Auctions [0.0] 我々は,36個のキャンペーンと50個のデバイスを用いた,オークション論理に富んだデバイス上でのシミュレーションにおいて,情報の不一致について検討した。
30対の需要経路、比例 ペイシングでさえ1回の安定化の後17.77%、当初の20時間の予算圧力の下で50回のギグ後に1,669.31%を超過している。
可視予算のノーセールガードは、このスコア単位の粒度でゼロラグのコンプライアンスを正確にするが、他のデバイスのデビットが見えないため、11.88%は1ニッチでオーバースペンドする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:25:27 GMT)
When Known Physics Helps Neural PDE Models: Residual Constraints Out-Regularize Generic Priors for Nonlinear Dynamics [0.0] 既知方程式の残差が等調予算において最高の一般正則化器より一貫して優れていることを示す。
我々の結果は、既知の物理がニューラルPDEモデルに非冗長な情報を提供するとき、そうでないとき、そしてそれを強制する時、バイアスをもたらすときを識別する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:15:09 GMT)
When Does Geometric View Synthesis Help Wine Label Retrieval? A Public One-Shot Benchmark Across Self-Supervised and Vision-Language Backbones [0.0] 幾何学的ビュー合成は、単一のワインラベル写真をトレーニングセットに拡張することができるが、事前訓練された画像エンコーダでの価値は不明確である。
そこで本研究では,1000クラスのWineSensedをベースとした公開ベンチマーク,1クラスあたりの登録写真,4,295のリアルタイムクエリについて検討する。
初期のDINO視覚変換器(ViT-S/16)のレシピでは、幾何学的ビューはトップ-1の精度を34.1%から62.6-63.7%に上げ、2次元(2D)拡張の3倍に向上した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:31:19 GMT)
When Do Agents Help? Embedding, LLM and Agentic Alignment of Classical Texts and Their Translations [0.0] この研究は、パリ語、サンスクリット語、ミシュナ語、ヘブライ語、チベット語で452のテキストの7つのシステムを比較した。
エージェントは452テキストすべてに対して構造的に有効な出力を生成し、437は直接呼び出しを行う。
盲目の3-LLMパネルは、ソースと人間の参照に対して全ての生成ミスマッチを評価する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:53:49 GMT)
Weird Machine Compositors: Exploiting AI Orchestration at the Expression Layer [0.0] オーケストレーションプラットフォームは、サンドボックスの列挙とブロックを通じて、ユーザが提供する式を保護する。
これらのサンドボックスは、命令セットが基礎となる言語仕様である奇妙なマシンであることを実証する。
これらの発見は,オーケストレーション製品カテゴリ全体にわたって,サンドボックス障害の広範なパターンの中に置かれています。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:49:02 GMT)
Validating Memory-Optimal Transformer Kernels on Real Hardware: From Formal Derivation to Measured Performance Across Two HPC Clusters [0.0] 我々は、アレーの数学(MoA)を用いて導出したトランスフォーマーカーネルのメモリ最適コスト関数を検証する。
本稿では,CPUとGPUの2つのHPCクラスタ上での測定性能に対して,これらの予測を検証した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:52:05 GMT)
The Potential of Nighttime Light Imagery for Detailed Local Economic Analysis [0.0] この写本は、もともと日本語で出版された論文の英訳と拡張版(2022年)である。
湯沢(新潟県魚沼郡)を中心に、地域経済とスポーツ・ツーリズムのアトラクションを分析している。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:25:17 GMT)
The Fully Depolarizing Noise Conjecture for Entangled Physical States: A Twenty-Year Perspective [0.0] 絡み合った物理量子ビットにおける相関誤差に関する2006年の予想を再考する。
この予想はまだ未定だが、最近の実験量子コンピューティングの進歩は、現在のデバイスでの実験的なテストの範囲内にある。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:26:16 GMT)
The Artifact Promotion Control Model: An Implementation Case Study. Build on Target Machines vs. Build Once and Promote Artifacts [0.0] アーティファクトプロモーション(Artifact promotion)とは,ソフトウェアを一度ビルドして,同じビルドされたコピーをテストと運用環境を通じて移動する,という意味だ。
紙はそれらを1つのモデルとして組み立てる。
Part IIは、AWS上のプロダクションWebアプリケーションの匿名ケーススタディで、リリースがひとつのコマンドであり、アップロードから実行中のフリートへのアーティファクトパスが自律的である。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:42:42 GMT)
TNF based Spectral Embedding for Effective Application of Supervised Machine Learning Techniques in Automobile Insurance Fraud Detection [0.0] 我々は、自動車保険データセットを用いて、決定木(DT)、ランダムフォレスト(RF)、XGBoost、LightGBM、グラディエントブースティングマシン(GBM)などの分類モデルを調査してきた。
本研究は,65種類のモデルの組み合わせについて検討した後,自動車保険の不正行為を効果的に検出するための革新的な手法を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:59:22 GMT)
StatD2GAN: When Calibration Masks Generator Quality in Held-Out Evaluation of Synthetic Weather Sequences [0.0] 我々は,進化的重み適応を持つ3つの識別器GANであるStatD2GANの評価を,ホールドアウトプロトコルを中心に再構築した。
等方性キャリブレーションにより,コルモゴロフ-スミルノフ間距離は, 試験された全ての建築物に対して, 位置当たりのノイズ/シフトフロアの2%以内となることを示す。
選別表現判別器は、除去が多変量依存を著しく低下させる唯一の成分である。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:59:38 GMT)
StarBOA: Real-Time Mamba State-Space Unrolling for Sparse Radar Micro-Doppler in ISAC Networks [0.0] ISAC(Integrated Sensing and Communications)では、レーダーセンシングは、最大90%の欠落データを持つチャープサブサンプリングの下で動作しなければならない。
本稿では,注意を因果マンバ状態空間モデルに置き換えるStarBOAを提案する。
StarBOAは100ドル以上の時間的履歴を追加の計算コストなしで統合する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:37:01 GMT)
SpecRead: A Benchmark for Measuring Whether Language Models Understand Hardware Specifications [0.0] 生成能力から仕様理解を分離するベンチマークであるSpecReadを提案する。
Icarus Verilog シミュレーションが観測可能な振る舞いを変えるために示す突然変異のみを保持する。
SpecReadは、決定論的チェックによって自動的に修正可能で、グレーゾーンのケースは保守的なメインスコアで誤算される。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:00:47 GMT)
SlopBench: How Well Can We Rank Language Models by Slop? A Multi-Domain Benchmark of Repetitive AI Writing [0.0] SlopBench氏は、どのモデルが固く反復的な散文の読者をAIスロップと呼ぶのかを尋ねる。
電子メール,ソーシャルポスト,エッセイ,職場チャットにおいて,手書きタスク112件のモデル18件を評価した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:38:23 GMT)
Self-discovering RL in the Era of Experience: Is Learning History an Asset or a Burden? [0.0] 自己発見RL則の初回因果メカニスティック監査を行う。
歴史の学習が資産や重荷として働く場合をテストする。
この研究はマイクロレベルの学習力学におけるマクロRSIの野望を基礎にしている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 20:56:26 GMT)
Scalable Attribution and Control of Model Behavior During Training [0.0] トレーニング中のモデル行動の帰属と制御には、各サンプルのコントリビューションを次の更新前に素早く特定する必要がある。
このあいまいさを相互情報を通じて解決し、それぞれの例の貢献について、複合的な行動変化がどの程度の量を示すかを定量化する。
この相互情報は挙動勾配特異性(BGU)の対数関数であることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:27:01 GMT)
SR4-Fit: A Unified Interpretable Rule-Based Machine Learning Framework for Informative and Trustworthy Decision-Making [0.0] ブラックボックスモデルは、予測を正当化するためにポストホックな説明を必要とする。
自然な代替手段は、設計によって解釈可能なモデルを使用することである。
本稿では,分類と回帰の両方に対して本質的に解釈可能なSR4-Fitを提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:26:46 GMT)
Reset Is Not Recovery: Evaluating Recoverability from False Conversational Context via Sycophancy Hysteresis [0.0] ユーザが間違った回答を繰り返し主張した後、モデルがクリーンコンテクストの振る舞いに戻るかどうかを調査し、そのプレッシャーを取り下げる。
複数選択の事実対話のためのリカバリ・アフター・プレッシャプロトコルを導入し,サイコフィナンシーを測定した。
以上の結果から,対話長,信頼度,信頼度,気晴らし,単なる虚偽回答,オプションを含む慣性によっては説明できないことが明らかとなった。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 15:33:35 GMT)
Representational Simplicity and Circuit Size Dissociate in a Threshold-Dependent Way: A Controlled Test via Adversarial Training [0.0] 本稿では,表現的あるいは帰属的単純さが回路レベルで因果的単純さに変換されるかどうかを検討する。
これは、表現的または帰属的単純さが回路レベルで因果的単純さに変換されるかどうかに関する最初の制御実験である。
本研究では,スパース・オートエンコーダの分解性,タスク帰属におけるSAE特徴エンゲージメント,生の計算グラフから回収した忠実回路の大きさの3つの相補的軸に沿ったモデルを比較した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 07:35:31 GMT)
Raven: The Harness of Harnesses for Composable Agentic Intelligence [0.0] 私たちはRavenを紹介します。Ravenはオープンソースのマルチエージェントエコシステムで、特定のモデルやドメイン用のモジュールハーネスを自動構築し、進化させます。
我々の理論は、利用可能な個々のエージェント以上の信頼性の高いタスクカバレッジを拡張するのに十分な条件を確立する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:44:48 GMT)
Quantization Error Is Spectrally Flat: A Single Random Probe Is a Calibrated, Data-Free Sensitivity Estimator, with Application to Budget-Targeted Mixed-Precision Quantization [0.0] 単一のランダムガウスプローブは、層の量子化誤差の偏りのない推定を与える。
35B MoEと9B高密度モデルからの1,683個のテンソルを横切ると、有効次元は、同じ形状の雑音値の0.93から0.96倍になる。
1つのプローブはテンソルあたりの感度を4から7%の範囲で測定し、20個のプローブは1.3から1.4%に達する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 21:03:53 GMT)
Protected Cores Are Not Enough: Certifying AI-Proposed Revisions of Temporal Specifications [0.0] 我々は、信頼できないAI提案者が時間的仕様修正を提案し、象徴的な知事がそのアクティベーションを制御するシンボリックアーキテクチャを導入する。
制御された合成実験では、凍結された教師付きAIプロジェクタを使用して、マスクされたコアの障害を1つの決定で説明し、繰り返し支配された修正を繰り返します。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:13:45 GMT)
Preparation-controlled relaxation in an overdamped RLC circuit: A pedagogical route to the spectral Mpemba effect [0.0] 破壊された抵抗インダクタ・キャパシタ(RLC)回路は古典的で実験的に利用できるスペクトルMpembaアナログを提供する。
我々はこのメカニズムを決定論的からオープンシステム記述へと発展させる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 06:31:52 GMT)
Posterior Regimes and Latent Deception: Variational Bayesian Inference in Hidden Markov Models for Sequential Fraud Detection in Financial Transactions [0.0] 隠れマルコフモデルの3段階進行について述べる: 最大様相(Baum-Welch)、変分ベイズ的(VBEM)、ニューラル変分的拡張(Neural VBEM)。
モデルの自然な出力、すなわち、政権メンバーシップの後方確率は、不正な確率に対して日常的に誤っていることを示す。
このモデルは、ドロップインランキングの代替ではなく、キャリブレーションされたトリアージ層と解釈可能性層として位置づけられるのが最適である、と我々は主張する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:52:18 GMT)
Pinned and Still Unstable: Within-Judge Verdict Variance and the Noise Floor of LLM-as-Judge Leaderboards [0.0] LLM評価は、審査員を固定されたモデルスナップショットにピン留めし、温度ゼロで復号すると再現可能な判定が得られると仮定する。
この仮定は、LLM-as-Judgeがクラウドサービスインフラ上でどのように運用されているかという特性として失敗することを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 00:19:41 GMT)
PerceptFence: Content-Mediation Architecture and Deterministic Coverage for Screen-Share AI Assistants [0.0] ライブスクリーン共有AIアシスタントは、生の画面と音声ストリームを観察するが、ユーザはアシスタントが観察、保持、開示する可能性のあるものに対して実行時コントロールをほとんど持たない。
本稿では、キャプチャ、メモリ、モデル応答間のコンテンツ層仲介アーキテクチャであるPerceptFenceを紹介する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:44:04 GMT)
Paragraph Boundaries Are Not White Space:Compression Depth as the Signature of Hierarchical Structure [0.0] 段落,文,トークンの指標を表す階層的回転位置符号化(hRoPE)を別のチャネルとして使用する。
トークン距離特性推定器を用いてパラグラフ間注目度を測定した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:13:41 GMT)
Occupation-selective photon-pair interactions in a flux-pumped SQUID resonator [0.0] 信号モードで2つの光子を生成または消滅させる縮退ペアプロセスについて検討する。
励起を交換しないが、この制御モードは共振周波数とペア遷移の強度の両方を変更する。
その結果、1つの調和モードの状態が別の非線形過程のスペクトル位置と結合強度の両方を制御するボソン制御パラメトリック相互作用が確立された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:09:10 GMT)
OOD Generalization as a Bifurcation Problem [0.0] 構成結合は一様過程ではなく,高度に局所化された相転移であることを示す。
我々は,このクリティカルウィンドウに厳密なマルチパススコアを制限したハイブリッドサンプリング戦略である外科的ガイダンスを提案する。
OOD2桁のMNISTテストベッドでは,術中組成の忠実度を推論コストのごく一部で達成する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:36:15 GMT)
Nonlinear engineering of Hong-Ou-Mandel interference with structured light [0.0] 香港・ウー・マンデル干渉計に入る光子の対は、測定自由度における状態の対称性によって束縛または反バンチする。
ポンプのパリティは, 構成から破壊的干渉への遷移の形状と頻度に影響を与えることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:30:36 GMT)
Never Emitted: Reporter Attribution in GitHub's Machine-Readable Vulnerability Records [0.0] GitHubはエコシステム内のアドバイザリにCVE識別子を割り当てている。
この情報はレポーターから収集され、受け入れるように要求され、アドバイザリページに表示され、独自のREST APIを通じて提供されます。
GitHubに割り当てられた238件のCVEレコードは、リンクアドバイザリが少なくとも1つのパーティを公に信用している。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 02:11:36 GMT)
Native Association: Confidence-Aware Human Perception in the Wild with a Foundation VLM [0.0] 我々は、0.77B視覚言語モデルを微調整することで、アソシエーションをネイティブにする。
1つの余分なフォワードパスは、リジェクションオプションをサポートするフィールド毎の信頼を与える。
利得は構造の中に存在し、重み付けはしない。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:00:02 GMT)
Multi-Terrain Mastery: A Comprehensive Controller for Bipedal Locomotion [0.0] 両足歩行の汎用性とロバスト性を高めるための多段制御器を提案する。
本論文は, 傾斜面および粗面の安定性向上を目的とした姿勢足関節モータを用いた以前の研究に基づいて構築した。
未確認の地形に対する性能とロバスト性を維持するのに不可欠な新しいインパクトマップを導入する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:49:58 GMT)
More than 83.69% of the zeros of the Riemann zeta function are distinct [0.0] 新規成分は、自由クリッピングパラメータを有する短いマトリックス不等式である。
これは、異なる零点の数の観点から、このエネルギーの低い境界を強化する。
行列の不等式、しきい値補題、ブロック二分法、計数アセンブリ、正確な算術はLean 4で正式に証明される。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 00:19:21 GMT)
Minimal output entropy for the channels that add or remove a box of a Young diagram, and a Pauli principle for every permutation symmetry [0.0] U(d)$ の二つの既約表現は、1つの箱によってヤング図形が異なるが、4つの共変量子チャネルで接続される。
それぞれのチャネルに対して、コヒーレントな状態の出力が他のすべての出力を最大化することを示す。
フック長の観点で最適出力を明示的に計算する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:07:06 GMT)
M3-Score: Fidelity, Memorization and Coverage as Separate Axes for Evaluating Generative Radiology Image Models [0.0] M3-ScoreはRadioDINO-s16に基づく評価フレームワークである。
BraTS脳MRIでは、忠実度軸が重度増加の5つの比較セットを指示した。
20倍のサンプルサイズで、平均M3値はFréchet Inception Distanceの2.52と比べて1.05倍に変化した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:10:15 GMT)
Long-Horizon Analog Design Bench: Benchmarking Agents on Hours-Long Analog and Mixed-Signal Circuit Design Tasks [0.0] 現在、符号化エージェントは数時間のツール駆動ループを維持しているが、長い水平アナログ回路と混合信号回路を電気的仕様に運べる能力は未測定のままである。
我々はAnalog Design Benchを紹介した。Analog Design Benchは17のチップ設計者が貢献する50のトランジスタレベルの設計タスクの長期エージェントベンチマークである。
2250回の2時間試験で15のエージェント構成を評価し,8.0%から78.0%までの完全特定パス率を観察した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 08:28:40 GMT)
Local Many Worlds in Spacetime: Deutsch-Hayden Descriptors and Local Wavefunctions [0.0] ベルの定理は、超決定論や後続性を持たない局所的かつ空間的に分離可能な物理理論は、多くの局所世界の理論でなければならないことを証明している。
量子力学の局所的な多くの世界形式論は、ローレンツ共変因果構造を持つ時空における透明な分離可能な物理理論である。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:07:24 GMT)
Latent Class Analysis of Digital Content Use Contexts in AI-Generated Synthetic Personas [0.0] この研究は5つのエンゲージメント・モード、発見と共有、対話、読書、リスニングについて言及した。
視聴中心(20.8%)、読書中心(3.8%)、聴取中心(2.1%)、低視聴(73.3%)の4つのクラスが登場した。
観察中心級と低年齢級の確率は10年ごとに0.15倍になった。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 12:46:24 GMT)
Large Language Models Substantially Compress Well-Being Inequality but Largely Preserve Its Socioeconomic Structure [0.0] 大規模言語モデル(LLM)を用いて合成集団を生成する研究は、モデル出力が人間の経験の多様性を圧縮することを示した。
このような圧縮は、必ずしも人間の不均一性の社会的構造を消去するとは限らない。
世界価値調査第7波の66カ国・地域の93,901人の回答者を用いて、人口統計学、社会経済学、縦断的プロファイルから、回答者の生活満足度を予測する6つのLSMを依頼した。
いずれのモデルも、生活満足度の全体的分散をかなり下支えしているが、これらの差分を正規化した後は、不平等な状態における人間の所得の勾配をほぼ再現した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 00:37:57 GMT)
Jev Matches 7B Language Models for Speech-Neuroprosthesis Rescoring [0.0] 音声神経補綴は、脳の活動から試みられた音声を解読する。
最終的にデコーダの候補文を再描画する。
価格は1000文あたり0.07米ドルで、GPUは必要ない。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:04:23 GMT)
Is your uncertainty map wrong, or is its target? Exact diagnostics for the Tweedie diagonal, and a gradient-free alternative [0.0] 拡散モデルは、ベースラインからフォローアップされた医療スキャンを予測することができるが、臨床医は、その予測がどこに信頼されるかを示すボクセルマップが必要である。
14のモデルコーパス条件における6つのチェックポイントの正確な対角線を計算する。
脳MRIでは、Jacobianベースの推定器がすべてメモリを使い果たし、T-PTは20本鎖のMonte-Carloアンサンブルを導く。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:32:06 GMT)
Investigating the Effect of k-NN Preprocessing on Developing Graph Neural Networks: A Fairness-Based Perspective [0.0] フェアグラフ畳み込みニューラルネットワーク(GCN)を設計する手法を開発し、複数のアプリケーションデータセット上でテストする。
提案手法は,グラフ構築中のk-NNアルゴリズムの近傍サイズの変化が,結果モデルの分類性能と公平性に与える影響について検討する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 10:02:21 GMT)
Internet and Enterprise Strategy Revisited: From Digital Connectivity to AI-Enabled Enterprises, 1996 - 2026 [0.0] この記事では、1996年の記事「インターネットとエンタープライズ戦略」を再考する。
2026年までにデジタル接続がAI対応のエンタープライズ環境へと進化するにつれて、その提案がどのように確認され、変換され、あるいは矛盾するかを評価する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:05:24 GMT)
Interactions Protect Periodically Driven Time Crystals Against Dephasing but Destabilise Multipolar-Driven Order [0.0] より強い相互作用は、周期的に駆動される時間-結晶秩序を、無作為なマルチポーラ駆動下での劣化に対して保護することを示す。
障害スキャンは、相互作用がパルスエラーのブロックキャンセルを損なうトゲリングフレーム画像をサポートする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:51:40 GMT)
Identical Runs, Different Results: Benchmarking AI Coding Agents on Open-Weight Models [0.0] 同じコーディングエージェントの繰り返し実行は、異なるベンチマークスコアを与えることが知られている。
このバリエーションは、ある機械学習タスクを集中的に複製することで、エージェントを自身のタスクで実行しているチームにとって何を意味するのかを問う。
6つのオープンウェイトモデルエンドポイント上の6つのエージェントを比較し、固定設定下で6つのエージェントモデルペアリングを52回ずつ実行し、そのうち3つを同じファミリーのより大きなモデル上で繰り返します。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:05:02 GMT)
How many photons can a molecule scatter before its coherence is lost? [0.0] 本稿では, 脱コヒーレンス率を計算し, 分子偏光率のベクトルと部分で表す。
この現象が起こる波長は、CaF分子として同定される。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 11:39:41 GMT)
High-Level Text Preprocessing for Semantic Similarity Analysis of Discursive Texts: A Framework and Empirical Demonstration [0.0] 本稿では,各文書の実際のクレームをその分散構造から分離する高レベルテキスト前処理を提案する。
この枠組みは哲学的テキストを用いて実証されているが、法的なテキスト、政策文書、学術論文、その他のジャンルに適用可能なドメインに依存しない問題に対処する可能性がある。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:32:31 GMT)
Groupwise Selective State-Space Filtering for Accurate and Streaming Action Boundary Detection [0.0] アクション境界検出は、アクションクラスを割り当てることなく、未トリミングされたビデオをインターバルに分割する。
ステートフルな変種は、ゼロニューラルルックアヘッド、ワンサンプルピーク確認、バウンドメモリによる特徴ストリーミング推論を可能にする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:29:04 GMT)
Greenpixie's AI Token Methodology: Assessing the Energy, Water and $\mathrm{CO_2\text{-}eq}$ Impact of AI Tokens for Open and Closed Weight Models [0.0] 本稿では,クラウドホスト型大規模言語モデル(LLM)のエネルギーコストを推定する手法について述べる。
また、これらのエネルギー測定を用いて、二酸化炭素(mathrmCO-texteq$)排出量、使用量と実施量、AIトークン当たりの水消費量を推定する方法について述べる。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:10:47 GMT)
From Grey-Box to Green-Box: When can Physics-Informed Machine Learning Reduce Carbon Footprints in Structural Health Monitoring? [0.0] 物理インフォームド機械学習や「グレーボックス」モデルは、伝統的なブラックボックス学習者の制限を克服するために開発された。
この研究は、追加の利点が環境への影響を低減できるかどうかを探求する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:08:20 GMT)
FoldAttention: Declared-Reference Softmax for Fast Decode and Deterministic Backward [0.0] KVキャッシュをスキャンする前に有限参照$Z_i$を固定するソフトマックスアテンションの付加的な定式化であるFoldAttentionを提案する。
1)最後の重みのゲートキーと値の読み出しをバイトがフェッチされる前に行い、コールごとの深さのT$は2-T$以下で鍵をカットする。
H100$T=16$で、FoldAttentionは7つの実モデル世代 1.36-2.30$times$を最速のBF16ベースラインより高速に、最大3.09$times$高速にデコードする。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 09:44:57 GMT)
Fine Until Fine-Tuned: Repeated Solutions Make Reasoning Fragile [0.0] s1のようなレシピは、何千、あるいは少なめの動作するソリューションを何度も示して、小さなデータで推論するようにモデルに教えます。
我々はQwen3.5-9B-Baseを、競合数学問題に対する独自の正しい解法で微調整した。
繰り返しは、彼らの推論の脆弱さを次のステージに任せることに気付きます。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:31:05 GMT)
Feedback-Robust AI for Patient Knowledge Graphs [0.0] ClosedLoopBenchについて紹介する。物理,薬理学,臨床実習で固定された徴候と29の関係について検討する。
ヌルストリーム下でのVitalDBでは、グラフ毎に0.06-0.10の偽の概念レベルの関係インスタンスがあり、相関構造は10-12である。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 05:39:43 GMT)
Event-Only Wingbeat Counting under Camera Motion: A Controlled MuJoCo Benchmark [0.0] 完了したウィングビートをカウントするには、周波数変化や停止を含む個々のサイクルを特定する必要がある。
イベントのみのイメージ変換補償から運動訓練を分離する制御された MuJoCo ベンチマークを提案する。
正確なカウント精度と時間的に一致したサイクルF1とカウントエラーを報告した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 14:47:37 GMT)
Effective atom-dimer bands of three-body lattice systems at strong coupling: exact critical mass ratios and a statistics-quasimomentum duality [0.0] 無限強度の接触相互作用を持つ正方格子上の3つの粒子について検討した。
正値 pi/(pi-2) の臨界質量比は 0 準同値である。
すべての定数は格子二次数、コンピュータ代数、正確な対角化、無限格子解法によって独立に検証される。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:53:49 GMT)
Dynamic Sculpting of Photon Statistics in a Raman-Coupled Cavity QED System [0.0] 光子統計の制御は、古典的および量子フォトニクスにおける多くの応用において重要である。
本稿では,量子干渉による束縛と反膨れ状態の間の光子統計を積極的に制御する手法を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:42:52 GMT)
Dual-Fit Imperative in Security Leadership: A Grounded Theory Investigation of CISO Role Enactment in Modern Organisations [0.0] 最高情報セキュリティ責任者(CISO)は戦略的に重要な執行役として登場した。
CISOの役割は、現代の組織において、さまざまな組織的コンテキストでどのように実現されているか?
この研究は、思惑的な推論の枠組みとGioiaメソッドを備えた構成主義的根拠理論を採用し、オーストラリアのセキュリティ幹部20人のインタビューを基にしている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 01:06:49 GMT)
Do System One Decisions Add Up? A Study of Probabilistic Coherence [0.0] 決定モデルは、同じ決定を小さなステップに分割した場合に、すべての質問に対して1にまとめる確率を与えることができます。
本研究は, 直接微視的予測と広いカテゴリの確率, それらのカテゴリを通して再構成された予測とを比較した。
カテゴリーレベルの総変分の平均は、Jevでは0.219から0.349、Layaでは0.424から0.689までである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 22:15:56 GMT)
Deterministic synthesis and processing of frequency-bin qubits in a macroscopically coherent quantum memory [0.0] 我々は、空洞支援量子メモリを制御するための追加の自由度として、マクロスピンコヒーレンスを利用する。
我々のメモリは、単純な高周波回転を用いて任意の周波数ビンフォトニック量子ビットを確定的に合成する。
本研究は,量子ネットワークのための基本信号処理により,量子ストレージをブリッジする統合プラットフォームを構築した。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 13:36:15 GMT)
DeltaSeek: Toward Active Perception in Evolving Construction Environments [0.0] DeltaSeekは、構築環境の進化におけるアクティブな認識に向けた最初のフレームワークである。
我々は、エンボディメントの許容可能な観測セットを形式化し、UR5eを備えたHusky A300で評価する。
両方の実施形態で観察される変更は、手首カメラが6.0ドル、シャシーカメラが15.2ドルである。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 18:36:49 GMT)
Correlation Between Nighttime Light and Various Statistical Indicators in Japan [0.0] 本写本は、もともと日本語で出版された論文の英訳と拡張版である。
衛星観測による夜間光強度は、主要な社会経済指標と密接に相関していることが証明されている。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 19:27:55 GMT)
Conformal Factuality Control for Multi-Hop Retrieval-Augmented Generation [0.0] 本稿では,これまでRAGのために開発されていたクレームレベル共形事実性制御が,この設定において有効であるかどうかを考察する。
分割共形クレームフィルタリングをマルチホップRAGに適用し,HotpotQA,Natural Questions,TriviaQAで評価した。
その結果、共形事実性はマルチホップRAGにまで拡張され、名目上の信頼性はクレーム保持と棄却とともに解釈されなければならないことが示された。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 23:55:03 GMT)
Classifying Dominant Temporal Orientation without Pretrained Text Embeddings: A Novel Morphosyntactic Inventory Vector Approach [0.0] 文の過去、現在、または将来のグローバル参照区間を特定するための代替手法を提案する。
本研究では,部分音声数,係り受け関係数,明示的未来パターン数からなる固定長インベントリベクトルを用いて文を符号化する。
過去,現在,未来とアノテートされた1,799の構文的に複雑な英語文の評価は、バランスのとれた高精度な多クラス分類を示し、総合的な多クラス精度は92%である。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 02:40:26 GMT)
Beyond the Prompt: Linking What Developers Ask, Do, and Understand with Coding Agents [0.0] Understandは、開発者がエージェントに書くものを分析するためのエンドツーエンドのワークフローである。
5つのステージ(Capture、Prepare、Analyze、Integrate、Interpret)と3つの楽器:プロンプトコードブック、スクリーン記録されたアクティビティやイベントをコーディングするためのスキーム、プロセスとソリューションを説明するためのルーブリックを分離する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 16:15:30 GMT)
Beyond Tasks: A Vision for Reproducing an Animal-like Behavioral Substrate Using Modern Robot Learning Techniques [0.0] 我々は,身体的,環境的,社会的要求の変化に応じて,位置,応答性,行動的整合性を維持する能力について検討する。
人工エージェントにおけるこのような能力を研究するための概念レンズとして, 倫理行動基質を提案する。
本研究では,人間中心環境における持続的相互作用と適応を研究するための有用な研究環境として,ロボット動物の仲間を提案する。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 03:41:32 GMT)
Beyond Fixed Features: Architecture-Dependent Sensitivity to Node Representations under Heterophily [0.0] グラフニューラルネットワーク(GNN)は、ホモフィリックグラフではよく機能するが、ヘテロフィリックな設定では苦戦する。
ノード表現では,アーキテクチャ性能が条件付きであることを示す。
論文参考訳(メタデータ) (Sun, 27 Sep 2026 17:03:21 GMT)