Listen to the Latents: Self-Correcting Speech Recognition in Large Audio Language Models Through Hidden-State Interactions [120.6] 音声認識システムは、その意味的知識を活用するために、大規模言語モデル(LLM)を統合している。
我々は, 暖房適応型LLMベースASRモデルを改良し, 自己の適応型LLMを応用した。
本稿では,2つの観測を動機とした目標補正戦略であるハイブリッド検索を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:46:48 GMT)
Learning Where Outcomes Change:Credit-Addressable Reasoning for Multimodal Geometry [105.9] 推論中に露出したセマンティックユニットは、学習が代替品と比較し、クレジットを割り当てる場所を定義する。
我々は,この原理を,ライン順応可能な実行可能コードとして視覚的関係を表すCode-CoTでインスタンス化し,推論を型付きイベントに整理する。
9つの幾何ベンチマークで、CE-GRPOは平均76.04の精度を達成し、Qwen3-VL-8Bと軌跡レベルGRPOをそれぞれ8.09$と3.43ポイント上回る。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:44:36 GMT)
PaperBanana-Interact: Scientific Diagram Refinement with Multi-Turn Human Feedback [101.6] ユーザ要求3,518の注釈付き292個の画像を含むマルチターンダイアグラム生成のためのベンチマークを提案する。
PaperBananaBenchは不満足な要件を特定し、kを自然言語のフィードバックに変換する。
本稿では,内部の批判と修正のループを通じて図を洗練するマルチエージェントシステムPaperBanana-Interactを紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:52:32 GMT)
ZimaBlue: Evolving Generalizable World Action Models through Scalable Video Pre-training [93.4] 大規模ビデオから一般化可能なワールドアクションモデルを学ぶためのフレームワークであるZimaBlueを紹介した。
ZimaBlueは3段階のトレーニングカリキュラムに従っており、まず大規模な人間とロボットの自我中心のビデオで因果的エンボディドビデオの事前トレーニングを行う。
ZimaBlueはさらに複数のベンチマークで高いパフォーマンスを実現している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:09:52 GMT)
When LLM Meets Tree Search: A Systematic View of Inference as Search in Large Language Models [92.7] テスト時間スケーリング(TTS)は、推論時間計算を固定モデルに割り当てることで推論を改善する重要な方向として登場した。
この調査は、木探索に基づく推論の最近の進歩を体系化し、推論をデコードではなく、インスタンス固有の最適化と見なす。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:49:56 GMT)
Fine-Tuning Low-Bit Models with Gradient in Quantized Code Space [78.1] 微調整の低ビットモデルは、最終配置されたチェックポイントを同じ低ビット形式に保ちながら、量子化されたモデルを適用することを目的としている。
GradCodesは、異なる量子化データタイプにわたる微調整の低ビットモデルを一貫して改善する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:54:30 GMT)
Scaling Large Reasoning Models beyond Human Supervision: A Path toward Superintelligence [77.3] 検証可能な報酬による強化学習は、数学やコードの推論を大幅に改善することができる。
しかし、人間の直接監督は、モデル生成体験のスケールと複雑さに追随することはできない。
本稿では,人間の指導が学習ループから徐々に遠ざかっていくにつれて,LRMがいかに改善していくかを検討する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:48:48 GMT)
MNIST-PRO: MNIST is Back as a Partially Observable World for AI Agents [74.8] MNIST-PRO (MNIST-PRO) は、MNISTの桁認識を、ルックバック制約付きシーケンシャルな視線に基づく検索タスクに変換することで、エージェント認識を分離するベンチマークである。
生の視覚履歴、テキスト状態、構造化されたメートル法グリッドマップ、統合された視覚キャンバスを含む4つの記憶表現の10つのマルチモーダルモデルを評価する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:05:39 GMT)
Co-Evolving Actor-Conditioned Critics for Non-Verifiable Generation [73.1] 批評家が初期反応についてフィードバックを与え、俳優が修正する。
我々は,対象俳優が意図した弱点に対処する上で,そのフィードバックが有効かどうかに依存するアクター条件のリビジョンガイダンスとして批判する。
TAIScoreは、演出、初期反応、批評、リビジョンを一緒に評価し、批評が真の弱点を狙うかどうか、俳優がそれに従うかどうか、意図した側面が改善するかどうかを評価する。
実験によると、TAIScoreで訓練された8B批評家は、ゼロショット120B批評家と結果のみまたは批判のみの報酬で訓練された批評家の両方を上回っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:50:57 GMT)
SIR: Self-improving Red-teaming for Compute Use Agents [71.7] コンピュータ・ユース・エージェント(CUA、Computer use agent)は、マウス、キーボード、端末を通じて画面を認識し、実際のオペレーティングシステムに作用する視覚言語モデルである。
操作中に信頼できないコンテンツに晒されるため、間接的プロンプトインジェクション(IPI)に弱い。
SIRは,平易な言語で記述された再利用原則の小さなライブラリからステルスインジェクションを構成するブラックボックスIPIアタックである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:39:43 GMT)
PaperGym: Rubric-Centered Evolution for Research-Plan Generation [69.6] 各研究論文を完全なトレーニング環境に変換する統合フレームワークであるPaperGymを紹介する。
PaperGymは論文の構造を利用しており、質問は研究目標と背景から合成され、基準は手法と実験から導かれる。
レシピが固定され、PaperGym-20kで訓練されたモデルが3方向比較の58.1%を獲得し、Hub Scienceの28.2%が勝利した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:31:18 GMT)
Modality Disentangled Learning for Incomplete Multimodal Emotion Recognition: A Primitive Memory Distillation Perspective [69.4] 本稿では,感情認識システムにおけるモダリティの欠如を解決するために,Primitive Memory Distillation (PriMD) フレームワークを提案する。
PriMDはモジュール間の共有セマンティクスをモダリティ固有の表現から切り離し、その後、後者を学習可能なセマンティクスプリミティブに識別する。
制約されたメモリ空間内のモダリティ固有の情報の欠如を補償し、教師モデルと整合する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:38:47 GMT)
Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving [68.3] Qwen-Drive-1.0は、自動運転のためのビジョン言語基盤モデルに向けた最初のステップである。
Qwen-Drive-1.0は、事前訓練された視覚言語モデル(VLM)のアーキテクチャを保持し、統合されたフレームワーク内に3D知覚、視覚的質問応答、モーションプランニングを統合する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:59:54 GMT)
CateKV: On Sequential Consistency for Long-Context LLM Inference Acceleration [67.2] ケイトKVは、一貫したヘッドに対して重要なトークン情報のみを保持するハイブリッドKVキャッシュ方式である。
Cate KV はメモリ使用量を最大$2.72 times$に減らし、シングルサンプル入力で$2.18times$に減らした。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:02:37 GMT)
CAST: Critique-Aware Supervision for Training Reliable Long-Horizon Tool-Calling Agents [67.0] 大規模言語モデル(LLM)エージェントは、長期的、インタラクティブでステートフルな環境にますますデプロイされている。
これらの設定では、間違った購入を返金するなどの1つの間違ったアクションは、不可逆なタスクの失敗を引き起こし、実行前にインターセプトされなければならない。
CASTは、スパースタスクの結果を批判学習と政策最適化のためのアクションレベル監視に変換する、批判に意識したトレーニングフレームワークである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:59:51 GMT)
Lies We Can See: Joint Verbal and Non-Verbal Deception by VLM Agents in Embodied Social Interactions [66.8] LLMとVLMのエージェントによる戦略的な騙しは、AIのアライメントと安全性の懸念の中心として現れている。
既存のテストベッドはテキストのみであり、単一の固定エージェント構成で実行される。
我々は,MineAmongUsを紹介した。これはUsサンドボックス内の3次元マルチモーダルで,インポスタエージェントは共同弁論と非言語行動を通じて乗組員を騙さなければならない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:24:29 GMT)
Agents in the Large: Perception-Centered Architecture for Persistent Agents [66.3] 永続エージェント(Pera)のための知覚中心型アーキテクチャを提案する。
Pera氏は、サービス関連信号を継続的に知覚する知覚と制御コンポーネントを中心に組織された永続的なエージェントについて説明する。
私たちはPeraを使って、最近の作業を振り返りに整理し、詳細なケーススタディを調べ、より有能な永続的なエージェントを構築するための前向きな洞察を提供します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:04:52 GMT)
S3Gym: Can LLMs Turn Self-Testing and Self-Judging into Self-Improvement? [66.2] 大規模言語モデル(LLM)は、ますます外部環境と相互作用し、かなりの行動経験を蓄積する。
エージェントがその振る舞いを積極的にテストし、得られた経験を判断し、その経験を使って将来の意思決定を改善することができるかどうかは不明だ。
LLM自己改善評価のための対話型ベンチマークである textbfStextsuperscript3Gym を導入する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:05:41 GMT)
LOCI: A Locator-Critic with Refinement Loop [65.5] VLM(Vision-Language Models)は、複雑な視覚的理解を必要とするタスクに苦戦している。
中心的な問題は、高レベルの推論ではなく、画像に重要な詳細を見つけることに失敗している、と我々は主張する。
証拠検証から視覚検索を分離する学習自由フレームワークであるLocator-Critic(LOCI)を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:26:00 GMT)
REER-PT: Reverse-Engineered Reasoning for Perplexity-Guided Pre-training Data Augmentation [64.8] 我々は,Reverse-Engineered Reasoning (REER) を生の事前学習データに拡張するスケーラブルなフレームワークである textbfREER-PT を紹介する。
REER-PTは予測が難しいが、それ以前のコンテキストから推論できる継続を識別し、コンテキストと継続の間の欠落した接続を再構築する簡潔な推論アノテーションを挿入する。
このスパース変換は、ソーステキストを保存し、トレーニング前のオンライン推論ロールアウトを避けることで、標準的な次世代の予測と互換性を維持します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:34:19 GMT)
Dr. Claw: An AI Scientist Workspace for Vibe Research [64.2] Claw博士はオープンソースのワークスペースで、既存のコーディングエージェントエグゼキュータを制御可能なヒューマン・イン・ザ・ループワークフローでラップする。
永続状態オブジェクト、再利用可能なスキルライブラリ、マルチエグゼクティブコーディネーションは、人間の決定とAIの実行を結びつける。
Claw博士は、監査可能な、回復可能なプロセストレイルを維持しながら、研究の完全性により高いスコアを付けます。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:58:47 GMT)
Aspire: Can Models Self-Evolve from Vague Goals? [61.7] 我々はあいまいなゴール駆動型自己進化のベンチマークであるASPIREを紹介する。
ASPIREは、統一された対話環境におけるモデルウェイトとエージェントハーネスの進化をサポートする。
実験の結果,曖昧な目標が探索努力を目標解釈に向けることが示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:14:59 GMT)
Answer Probing-Guided Search for Diverse Solution Exploration of LLMs [61.6] 大規模言語モデル(LLM)は、推論中に単一の高信頼のソリューションに収束する傾向がある。
本稿では,探索された回答の隠れ状態の類似性と難易度による木探索をガイドするAnswer Probing-Guided Tree Search (APTS)を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:01:36 GMT)
HorizonNet for visual terrain navigation [60.7] 本報告では,沿岸部や列島で活動する無人表面船(USV)の位置推定の問題について検討する。
本研究では,USV周辺の360度パノラマ画像から水平線を抽出する位置推定手法を提案する。
提案手法は位置推定をGPSレベルの精度で達成することで有望な結果をもたらす。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:58:13 GMT)
VIBE: Video Instruction-aligned Background music gEneration [58.3] 現在のV2Mモデルは意味制御に欠け、命令違反をペナルティ化することができない。
本研究では,コンディショニング接続を利用した新しいテキスト・ビデオ・音楽生成モデルであるVIBEを紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:19:55 GMT)
Distributed Implicit Harm: A Compositional Safety Blind Spot in MLLM-Based Video Moderation [58.1] 分散インプリシットハーム(DIH)は、ビデオの分解軸に沿って分散されたコンポーネント間の関係から害が発生する場所である。
視覚セグメント間の時間的調和(DIH-T)と音声と視覚ストリーム間の相互調和(DIH-M)の2症例について検討する。
我々は,個々の良性成分を有害なシナリオに分解し,明示的な推論アノテーションで多種多様なDIHビデオを生成するマルチエージェントフレームワークを開発した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:17:49 GMT)
Verification-Aware Training for Speculative Decoding [57.8] VAT(Verification-Aware Training)は、トレーニングステップ毎に検証をシミュレートし、その結果の受け入れパターンと拒否パターンを監督するプラグインフレームワークである。
VATはトレーニング対象のみを変更するため、ドラフトアーキテクチャやターゲットモデル、推論手順を変更することなく、既存のメソッドの上にレイヤー化することができる。
VATは平均受理期間を最大11.4%改善し、ウォールクロックのスピードアップを最大8.7%向上させ、数学、コード、チャットベンチマークで一貫した利益を得ている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:42:10 GMT)
PRISM: Predictive Recomposition via Semantic Latent Decomposition for View-invariant Video Representation Learning [57.7] クロスビュービデオ表現学習は、視点不変のアクションセマンティクスを捉えることを目的としている。
本稿では,映像をビュー不変かつビュー不変のラテントに分解し,言語監督の下で再分解するPRISMを提案する。
PRISMは、EgoExo4D、EgoExoLearn、AE2の最先端の結果を達成し、ゼロショット設定でドメイン内モデルを超えた。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:43:02 GMT)
On the Design of Qwen3.8-Next Architecture: Evaluation, Efficiency, and Training Stability [57.0] Qwen3.8-Flash-Nextは125Bパラメータ、トークンあたり6Bアクティベートされ、加速器から保持されるn-gram埋め込みテーブルの51Bパラメータを持つスパースミックス・オブ・エキスパートモデルである。
トレーニング前の14のベンチマークでは、このモデルは前モデルの397B-A17Bを8点、残りを少なくとも2.6ポイント、アクティベートされたパラメータが1/3、トレーニングトークンが1/3、トレーニング用FLOPが1/9であった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:35:07 GMT)
CometVLA: Co-Training on an Embodied Data Pyramid towards Physical Understanding [56.6] 視覚言語アクション(VLA)モデルは、物理コモンセンスを必要とする操作タスクにおいて脆弱なままである。
VLMの物理的理解の改善が下流のアクション生成に実際に寄与するかどうかは不明だ。
我々は,ロボットの動作データと実施状況に厳密に整合した物理VQAコーパスとベンチマークであるCometVLAを提示する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:55:34 GMT)
Learning to Restore More: Continual Capability Expansion for Pretrained Image Restoration Models [54.9] トレーニングされた復元者が、以前に学んだことを忘れずに、継続的に新しい能力を身につける方法について検討する。
本稿では,連続的な機能拡張フレームワークであるRestoreMoreを提案する。
RestoreMoreは、学習前の能力の保存と改善をしながら、新しい復元能力を一貫して獲得することを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:19:58 GMT)
Toppling the Hierarchy in Byte-level Language Modeling [54.6] 最先端のバイトレベルモデルは階層構造を使用し、バイトレベルからワードレベルにダウンサンプリングし、バイトレベルに戻ります。
階層設計自体が文字レベルの理解を制限しており、純粋バイトレベルのモデルは文字操作タスクにおける階層的変異を一貫して上回っていることがわかった。
本研究では,階層型バイトモデルのキャラクタレベルの故障を解析し,計算効率と微粒化文字理解との明確なトレードオフを確立する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:11:55 GMT)
E-Commerce Bench: Evaluating LLM Agents on Long-Horizon Autonomous Business Operation [54.5] E-Commerce Benchは、マルチラウンドのネゴシエーションと動的イベントを1年間のビジネス運用に統合する、最初のオープンソースベンチマークです。
年末の資産を含む7次元にわたる18のフロンティアモデルを評価し,1つのモデルが支配的でないことを発見した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:03:57 GMT)
AdaPath: Query-Adaptive Path-Finding via Path-Bank for Multi-Hop Implicit Biomedical KGQA [54.4] 我々はPath-Bankからクエリ適応メタパスを検索するパスフィンディングフレームワークであるAdaPathを提案する。
AdaPathは、バイオメディカルクエリにおいて欠落した手がかりを提供すると同時に、密集した知識グラフの近傍を効果的に刈り取っている。
我々はBioStrat-QAをリリースした。これはマルチホップクエリを、どれだけの中間的推論を公開しているかによって階層化するベンチマークである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:32:23 GMT)
Faster Than Flash: Exploiting Attention Sparsity for Efficient Long-Context Decoding [51.5] 我々は,Faster Flash Decoding (FFD) という,長文デコーディングにおいてメモリ壁を壊すように設計されたハードウェア・アルゴリズムの共同設計フレームワークを提示する。
FFDはセレクタとコンピュータを完全に融合したカーネルに統合し、外部メタデータのインデックスをコンテンツ認識スキャンに置き換える。
最大11.6倍のカーネルレベルのスピードアップと256Kコンテキスト長のスケーリングを実現し、2.37倍のスループット向上を実現している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:13:20 GMT)
Safin-1: Safety from Within through Memory-Native State Evolution [51.2] Safin-1は、メモリルーティングと状態進化を通じてこの原理を実現する基礎モデルのファミリーである。
Safin-1 は、構造化メモリ状態を維持するネットワークアーキテクチャである Memory-Anchor Routing across Context History (MARCH) 上に構築されている。
安全状態を通じて下流の安全タスクにおけるこのインターフェースについて検討し,安全性を著しく向上した有効な状態ベース適応を実証する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:48:48 GMT)
T3S: Improving Multi-Task Reinforcement Learning with Task-Specific Feature Selector and Scheduler [51.1] マルチタスク強化学習(MTRL、Multi-task reinforcement learning)は、複数のタスクを同時にトレーニングする技法である。
本稿では,機能セレクタとタスクスケジューラの2つのコンポーネントで構成される,タスク特化機能セレクタとスケジューリング(T3S)と呼ばれる新しいMTRLフレームワークを提案する。
具体的には、機能セレクタはハイパーネットワークを使用してタスク固有のソフトマスクを構築し、グローバルな共有表現によってタスク固有の機能を構築することができる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:30:06 GMT)
VisLens: Single-Pass Interpretable Visual Search for Multimodal LLMs [50.6] 我々は,ロジットレンズ上に構築されたビジュアル検索手法であるemphVisLens (Visual Focus via Logit Lens)を提案する。
VisLensは以前のベースラインにマッチまたは超過し、相当なレイテンシのアドバンテージを提供する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:43:42 GMT)
Not All Fallbacks Are Failures: Understanding and Recovering from Fallbacks in Mobile Voice Assistants [50.6] 日常環境における一般的な健康支援のためのスマートウォッチベースの音声アシスタントのフォールバックハンドリングについて検討した。
私たちの分析は,500人以上のユーザの実世界利用データに基づいて,匿名化された3,030件のデータセットを作成した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:06:42 GMT)
ReDeck: Step-Level Render-Grounded Refinement for Document-to-Slide Generation [50.5] 本稿では,文書・スライド生成のためのステップレベルのレンダリング・グラウンド・リファインメント・フレームワークであるReDeckを提案する。
局所的な修復とグローバルな品質のバランスをとるために、ReDeckでは、空間的エラーに対する複数のグラニュラフィードバック、セマンティックとデザインのガイダンスに対するターンレベルの適応的批判、ハードレイアウトの検証のための提出レベルゲートを使用している。
GPT-5.4、Claude-4.6、Gemini-3.1の他、ReDeckは既存のスライド生成エージェントより一貫して優れている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:12:10 GMT)
From Final Artifacts to Trajectories: Retrospective Process Supervision for Evidence-Grounded Long-Form Generation [49.5] RetroGenは、レトロスペクティブプロセスの監視のための自己改善フレームワークである。
専門の工芸品から潜伏軌跡を再構築し、その工芸品に対して検証し、証拠を裏付け、独自の再建データに基づいて模型を訓練する。
実験の結果、RetroGenは接地、忠実な合成、長期にわたるエビデンス検索のタスクを改善していることがわかった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:47:39 GMT)
A Human-in-the-Loop Autonomous Agent for Industry Time Series Forecasting [48.6] 本稿では,予測指向ハーネス工学によって構築された予測システムであるCastClawを紹介する。
CastClawはデータ、特殊なモデル、分析ツール、ユーザ入力、バージョン管理された実行レコードを1つのランタイムで接続する。
CastClawは、2026年1月から6月にかけて、北朝鮮の地方電力負荷データでオフラインで検証された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:36:41 GMT)
WHALE: A Simple Recipe for Joint Harness-Weight Optimization [48.6] WHALE(Weight-Harness Alternating LEarning)は、2つのフェーズを切り替えるレシピである。
3つの領域にわたるQwen3.5-2B/4Bエージェント(質問応答、数学的推論、チェスパズル)を使用して、WHALEは重量のみ、ハーネスのみ、Fast-Slow Trainingの4.15-24.38ポイントを最高の平均@8の精度で上回る。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:12:55 GMT)
SkillZip Pro: Execution-Aware Dynamic Compression of Progressively Loaded Skills for Self-Evolving Agents [48.4] 完全かつ段階的に装填されたスキルバンドルのための評価フリー圧縮機である。
メソッドはファイルを圧縮し、ルートや宣言された環境契約がすでに提供している場合、参照またはサブスキルからコンテンツを削除する。
ルーティングを保存するため、必要なファイルと直接呼び出し可能なエントリは書き直し後も到達可能である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:41:16 GMT)
Type-Balanced Contextual Learning for Incremental Named Entity Recognition [47.3] インクリメンタル名前付きエンティティ認識(INER)は、情報抽出において重要なタスクである。
本稿では,文ダンプレット学習方式と文脈整合性損失を特徴とするTBCL法を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:15:41 GMT)
ProofPulse: Interactive Proof Coverage Analysis for Dafny [47.2] 帰納的検証は、実装がその仕様を満たすことを保証しますが、成功した検証は仕様の品質を保証しません。
本稿では,3値の証明カバレッジモデルを用いて,仕様品質を診断するDafny用ツールであるProgrampulseを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:00:31 GMT)
Dec-BFTRL: Squre-Root Regret for Decentralized Online Upper-Linearizable Optimization under Separation Access with Application to Continuous Submodular Maximization [46.7] 本研究は,効率的な分離アクセス下での内部動作を用いたオンラインペイオフの分散最適化について検討する。
Dec-BRL (Dec-BRL) による分散バリアの追従について検討する。
3つのDR-サブモジュラー問題をカバーする4つのラッパーインスタンスを与える。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:29:54 GMT)
Update from Hell: Can Coding Agents Survive Hidden Breakage in Dependency Upgrades? [46.7] DEPBENCHは5つのパッケージエコシステムにわたる203の実際の依存性アップグレードタスクからなるベンチマークである。
我々は、DEPBENCH上でのメインストリームのコーディングエージェントの評価を行い、現在のエージェント機能と実世界のソフトウェア保守ニーズとの間に重要なギャップを浮き彫りにしている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:13:51 GMT)
SocialReasonBench: A Video-QA Benchmark for Social Reasoning with Counterfactual Narrative Videos [46.1] 社会的根拠に基づく推論を評価するためのビデオ多重選択QAベンチマークであるSocialReasonBenchを紹介する。
Detroit: Become Humanのゲームプレイビデオから作られたこのベンチマークは、プレイヤーの決定がソーシャルな結果に繋がる分岐したストーリーラインを活用する。
SocialReasonBenchは、意図認識、感情的共感、道徳的ジレンマ、反事実的推論、因果的先行性を含む7つの推論次元をカバーしている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:55:52 GMT)
Real-Time Scene-Adaptive Tone Mapping for High-Dynamic Range Object Detection [45.7] 本稿では,HDR RAW入力とLDR sRGB要求とのギャップを埋める新しいトーンマッピング手法を提案する。
我々のパイプラインはNVIDIA Jetsonプラットフォーム上で4Kの高ビット深度HDR入力をリアルタイムに処理する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:52:53 GMT)
One Adapter, Many Tasks: Task-Conditioned Feature Transformations for Continual Learning [45.4] textbfFACET: task-conditioned textbfFetextbfAture transformation with textbfConditiontextbfEd feature consistextbfTency。
本手法は,トレーニング可能なパラメータとGFLOPを著しく少なくし,優れた性能を実現する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:03:45 GMT)
Motus2: A Self-Evolving General World Model for Dexterous Manipulation [44.9] 一般的な実施エージェントは、統一されたシステム内で知覚し、予測し、行動し、評価し、改善するべきである。
我々は、デクスタラス操作のための自己進化型一般世界モデルであるMotus2を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:44:33 GMT)
Driving on Memory [44.8] 高いベンチマークスコアは、モデルがその前のシーンを理解し、それに従って行動できることを反映すべきである。
我々は、モデルのカメラ入力を、同じ場所にある前のドライブからのメモリに置き換える。
メモリはNAVSIMでほぼ十分であり、主要なエンドツーエンドメソッドのパフォーマンスに到達または超える。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:10:04 GMT)
Physical Adversarial Examples for Person Detectors in Thermal Images Based on 3D Modeling [44.7] 本研究では, 現実のシナリオにおいて, 熱人検出装置の回避を目的とした赤外線対向服を提案する。
このデザインは3Dモデリングに基づいており、2Dモデリングに比べて現実世界に近い多角的シーンをシミュレートしやすくしている。
身体的攻撃では、屋内で80.11%、屋外で76.85%の攻撃成功率をYOLOv9に対して達成した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:09:41 GMT)
Temporal Forcing: 4D Representation Alignment for Vision-Language-Action Models [44.6] VLAモデルの4次元表示アライメント法であるTemporal Forcingを提案する。
まず,バニラVLAモデルを用いて観測履歴を時間的に認識された潜在表現に要約する履歴経路を提案する。
そして、潜在表現は、時間的に一貫した幾何学的表現を通して進化する3次元世界をキャプチャする事前訓練された4次元基礎モデルによって抽出された幾何学的特徴と整合する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:47:29 GMT)
TuringLLM: Efficiently Scaling Foundation Models Toward Physical AI [43.6] 本稿では,トークン毎に約2Bパラメータを活性化するMixture-of-Experts言語モデルであるTuring-20B-A2Bを提案する。
このモデルは動的トップk構成でQuantile Routingを採用し、トークン適応型のエキスパートアロケーションを可能にする。
このモデルはプログレッシブな3段階のカリキュラムで事前訓練され、継続事前訓練を通じて128Kのネイティブコンテキストに拡張されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:42:35 GMT)
MULTI3IR: A Benchmark for Multi-perspective Multi-domain Multi-modal Information Retrieval [42.6] Multi$3$IRは、オープンエンドクエリの多面的視点をレトリバーがいかによくカバーするかを評価するベンチマークである。
104.9KのStack Exchangeクエリで構成され、各クエリの暗黙の視点をキャプチャするパースペクティブ記述が注釈付けされている。
また,パラメータとラベル効率のよい手法であるSPINを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:19:26 GMT)
PLC-DPO: Posterior Label Correction in Noisy and Ambiguous Preference Optimization [40.9] 本稿では,好みを安定的に最適化するための後ラベル補正DPOを提案する。
主要な考え方は、適切な修正措置を取るために、政策基準マージンをオンライン証拠として使うことである。
PLC-DPOは、DPOに対する最良の平均勝利率を得る(次ベット法では60.5対55.5)
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:11:33 GMT)
Can Video World Models Track Unobserved World States? [40.9] ビデオワールドモデルはシミュレータとしてますます使われているが、視覚的忠実性だけでは、モデルは世界の隠れた状態を維持するわけではない。
このギャップをアクション条件付きビデオシェルゲーム(S_5$状態追跡のビジュアルアナログ)で調べる。
エクストラポーレートを行う2つのメカニズムを見つけ、どちらもチャンクにまたがって状態を保持し、それを修正します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:29:24 GMT)
Language-Statistical Analysis of Neural Audio Codec Tokens Across Architectures, Corpora, and Noise Conditions [40.6] ニューラルオーディオコーデック(NAC)は、音声を離散トークンシーケンスに変換する。
本稿では,マルチコードブック残差ベクトル量子化(RVQ),シングルコードブックVQ,非VQ設計にまたがる13個のNACのトークン統計を解析する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:15:36 GMT)
Selection-Aware Stress Testing for Interactive Agents [40.1] SASSTは、発見タスクの事前実行機能からタスクの重み付けを学習し、別個の確認タスクで同じペア比較を評価する。
プロトコルはサポートと安定性をチェックし、計画されたすべてのクレームにジョイントバウンドを使用し、クレームを返さない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:58:04 GMT)
MURANO: Design, Run, and Reproduce Mechanistic Interpretability Experiments as Composable Pipelines [40.1] Muranoは、大規模言語モデルの機械的解釈可能性の研究を設計、実行、再現するためのオープンソースのフレームワークである。
確立された解釈可能性研究の2つの再現と1つの説明的スパースオートエンコーダのケーススタディを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:02:35 GMT)
Behavior-Skill: A Fine-Grained Benchmark for Evaluating Vision-Language-Action Policies in Long-Horizon Tasks [40.0] 本稿では,長期タスクの学習と評価を改定するベンチマークであるBehavior-Skillを提案する。
50世帯のタスクにまたがる1万件のデモから、34のセマンティックスキルカテゴリから235,492のスキルインスタンスが含まれている。
本研究では,長期VLAポリシーの分析と改善のための中間機能プロファイルを公開することで,行動スキルがフルタスク評価を補完することを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:03:48 GMT)
Beyond the Payload: How User Invocation Shapes Coding Agent Vulnerability to Repository Poisoning [39.6] コーディングエージェントは、サードパーティリポジトリからのプロジェクトのブートストラップなど、ソフトウェアエンジニアリングタスクにますます使用されている。
これらのユーザ側の選択をPrompt-Level設定(PLC)と呼び、CIPR(Coding In Poisoned Repos)を導入します。
CIPRは、20のリポジトリに1,920のインスタンス、4つのタスクタイプ、3つのソーシャルメディアベースのプロンプトスタイル、3つのスキル/ルール条件、そしてアタック成功率(ASR)とエージェントアラートレート(AR)を含む。
脆弱性は非常にコンテキスト依存的であり、タスクタイプはASRの4.5倍の違いをテストで生成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:26:01 GMT)
SetMIR: Multi-Interest Retrieval as Set Prediction [39.3] 本稿では,多目的検索を集合予測問題として扱うSetMIRを提案する。
SetMIRは、ユーザの行動履歴をトランスフォーマーでエンコードし、学習可能なクエリを使って、ユーザの関心事の集合をデコードする。
SnapのDynamic Product Ads(DPA)データでは、SetMIRは、各メトリックで学習した4つのマルチ関心レトリバーを上回っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:02:02 GMT)
Local Private Information Retrieval for Graph-Based Replicated Systems [39.2] マルチサーバ,グラフ対応のプライベート情報検索(PIR)システムにおけるプライバシの定義を再考する。
提案したプライバシ設定では,ユーザは特定のサーバからメッセージインデックスを隠蔽することに関心がある。
この緩和されたプライバシ要件を,ローカルユーザのプライバシと結果のPIR問題をグラフ上のローカルPIRとして生成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:50:47 GMT)
One AI Signal, Many Human Judgments: A Bayesian Cascade Analysis of AI-based Credibility Indicators in Online Information Spread [39.1] ソーシャルメディアプラットフォームは、ユーザーが誤情報を判断するのに役立つAIベースの信頼性指標をますます利用している。
本稿では,従来のベイズカスケードモデルを共有公開信号としてAIインジケータで拡張することにより,この設定のためのソーシャルラーニングレンズを提案する。
我々は、AIが公的な歴史の意味を変えることを示す。この視点を通して、AIが公的な歴史の意味を変えることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:27:21 GMT)
Sycophantic Agreement Transfers with Neutral Data via Contrastive Preference Optimization [38.7] シコファン的合意(Sycophantic agreement)は、言語モデルが過剰にユーザを肯定する行動である。
比較的選好最適化の目的の意図しない結果として,シコファン的合意が生まれる可能性が示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:52:57 GMT)
SMG: Semantic Motion Graph for Monocular Dynamic Gaussian Splatting [38.7] 単眼ビデオからの動的ガウススプラッティングについて検討する。
提案するセマンティック・モーション・グラフ(SMG)は,ガウス運動を低ランクなセマンティック・モーションとしてモデル化する手法である。
SMGは、挑戦的な実世界のベンチマークにまたがる単分子動的ガウススプラッティングにおける最先端の性能を達成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:06:18 GMT)
ATGS: Anchored Temporal Gaussian Splatting for Long Volumetric Video Representation [38.3] ボリュームビデオは、ダイナミックな現実世界のシーンの没入型自由視点レンダリングを可能にする。
既存の手法は長いシーケンスや複雑な動きに苦しむため、しばしば時間的不安定性と視覚的アーティファクトに繋がる。
ボリュームビデオ再構成のためのガウススプラッティングに基づくフレームワークである ourname を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:09:16 GMT)
Lazy Grounding: Attacking Search Agents with Factual Evidence [38.1] 検索エージェントは、近くの質問に対する事実証拠によって誤解される可能性がある。
我々は、近くの証拠を用いて、ベンチマーク質問の回答変更による遅延グラウンドを露呈する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:19:04 GMT)
Multimodal Shared Latent Representation of Narration, Microscope and iOCT Images for Phase Recognition in Vitreoretinal Surgery [37.9] 硝子体手術における文脈認識型コンピュータによるフィードバックには,外科的位相認識が重要である。
手術用ナレーションと術中OCTを橋渡しするための共有アンカーとして顕微鏡ビューを用いたフレームワークを提案する。
これは、顕微鏡視、i OCT Bスキャン、および外科的位相認識のための共有潜在空間における外科的ナレーションを統一する最初の試みである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:41:07 GMT)
Knowing Beyond the Known: Reinforced Knowledge Specification for Multi-Label Class-Incremental Learning [37.9] 中心となる障害は、既知の知識と未知の知識のあいまいな境界である、と我々は主張する。
我々はKBK(Knowing Beyond the Known)を提案する。これは、歴史的、現在、そして将来的な学習を統合するために、既知のか否かを明示的にモデル化する強化知識仕様フレームワークである。
KBKは、MS-COCO B0-C10設定上のAccのAvg.Accの2.7%を超えている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:33:20 GMT)
LITERARYBIGFIVE: Author-Personalized Text Generation in a Unified Interpretable Space [37.8] LiteraryBigFiveは、権威的な書き込み特性を統一的で解釈可能な空間内の座標として再構成するフレームワークである。
著者と中立の通路間の活性化空間のコントラストから各解釈可能な軸を導出する。
さらに,テキスト生成を目標座標に適応的に誘導する解釈可能なステアリング機構を導入する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:43:45 GMT)
Improving Information Extraction with Learned Queries [37.7] 質問設計の改善だけで、18.6F1スコアポイント、すなわち、より大きな抽出モデルを使用するよりもパフォーマンスを向上させることを示す。
本稿では,抽出結果に対する質問を反復的に洗練するフィードバック駆動最適化手法であるLoQとFeedQを紹介する。
質問設計を第一級問題として扱うための情報抽出研究の広範なシフトを支援するために,12,820の最適化された質問のデータセットをリリースする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:35:31 GMT)
AtlasNLP: A Country-Aware Atlas of Dataset Representation in NLP [37.5] AtlasNLPは、正規化されたNLPタスクカテゴリ全体で13,000以上のNLPデータセットレコードの国別アトラスである。
AtlasNLPには、人為的な参照セットであるAtlasNLP-Goldと、ACLから派生した大規模コレクションであるAtlasNLP-Coreが含まれている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 00:48:30 GMT)
Beyond Language Priors: Diagnosing and Fixing Visual-Origin Hallucinations in Multimodal LLM [37.1] 視覚的特徴抽出と画像とテキストの埋め込みの誤調整から幻覚が生じる視覚的オリジン幻覚の証拠を提示する。
本稿では、この問題を修正するために、ACFT(Adversarial Contrastive Fine-Tuning)を提案する。
ACFTは、LLaVA、MiniGPT-4、Qwen2.5-VLにまたがるPOPE、MME、および4つの記述レベル幻覚ベンチマークの最先端性能を達成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:38:24 GMT)
CheXGround: Anatomical Region Tokens for Grounded Longitudinal Chest X-ray Interpretation [37.0] 地域型長方形胸部X線言語モデルであるCheXGroundを紹介する。
CheXGroundは、現在のおよび以前の解剖学的領域を抽出し、時間的に拡張されたROIトークンとしてエンコードし、生成中のグローバルな時間的イメージコンテキストと組み合わせる。
我々は,CheXGroundを,単スタディ,縦方向の視覚質問応答(VQA),縦方向の所見生成,時間的接地VQA,解剖学的接地で評価した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:25:40 GMT)
A hybrid quantum-classical neural network for learning to route [37.0] 本研究では、ルーティング学習のためのハイブリッド量子古典ニューラルネットワークについて研究する。
静電容量化車両の経路問題では、エンコーダのフィードフォワード交換が最も有望な設計として現れる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:36:36 GMT)
Reactivating Test-Time Scaling for Plane Geometry Problem Solving [36.8] 平面幾何学問題 (PGP) の解法は、正確な視覚認識と正確な多段階の記号推論を必要とする。
本稿では,各シンボルプログラムを異種推論トレースに変換するマルチトレース合成(MTS)を提案する。
また,自己適応推論を効率的に行うために,図を推論前の構造化意味節にパーセプションするパーセプション強化(PA)トレーニングや,コンセンサスガイド型マルチトレースアンサンブル(CG-MTE)を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:15:04 GMT)
Dynamic Hub-and-Spoke Memory for Streaming Video Understanding [36.4] Dynamic Hub-and-Spoke Memory (D-HSM)は、リモート履歴を構造化されたテキストメモリとして表現するトレーニング不要のフレームワークである。
D-HSMは、選択した歴史的ビデオチャンクをタイプされたテキスト観察に変換し、エンティティ中心のハブ・アンド・スポークメモリに格納する。
質問に答えると、D-HSMは、コンパクトな質問認識メモリサブセットを動的に検索し、ハブ・アンド・スポークリンクを通じて拡張し、最新のビジュアルウィンドウと組み合わせてフリーズ・VLMの応答予測を行う。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:02:28 GMT)
TUE-Detector: A Tool-Using Expert MLLM-Based Detector for AI-Generated Videos [36.3] MLLMを用いたAI生成ビデオ検出器(TUE-Detector)を提案する。
TUE-Detectorは、一般的なMLLMをタスク調整ツールを使用するエキスパート検出器に訓練する。
適切なツールの呼び出し、不自然性の具体的な証拠の収集、信頼性のある検出の証拠の推論を学ぶ。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:42:38 GMT)
Benchmarking External Generalization of SPD Matrix Learning for Resting-State fMRI Connectome Prediction [35.5] テストデータが完全に保持された rs-fMRI データセットから得られる場合、データセット内のパフォーマンスが継続するかどうかを問う。
6つのrs-fMRIデータセットに再現可能な年齢予測ベンチマークを導入する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:15:08 GMT)
UFPR-PEs: A Brazilian Face Recognition Benchmark with Self-Declared Race/Color Labels [34.9] UFPR-PEsは、ブラジルの選挙で選出された政治家が、公式の自己宣言型人種/色カテゴリーに注釈を付けた公開ビデオを用いて、顔認識バイアス評価のベンチマークである。
我々のベンチマークは圧縮された公開ビデオから構築され、現実的な条件下で性能を解析できるように、難しいサンプルを保存する。
その結果,認識性能は画像品質と大きく異なっており,サブグループギャップは単独でではなく視覚的困難と共同で解釈する必要があることがわかった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:27:15 GMT)
WebWorld: The Browser as a World Model for Self-Improving Web Code [34.5] WebWorldは、VLMがこのブラウザ・アズ・ワールド・モデルと自律的に対話することを可能にする。
WebWorld-27BはRaw-27BをHTMLBench-400で5.3ポイント、MiniAppBench-Valで14.9ポイント改善した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:00:12 GMT)
Vision Is Not Overhead: One-Pass Block Drafting for Lossless Speculative Decoding in Vision-Language Models [34.5] 視覚言語モデル(VLM)の投機的復号化は自己複製サイクルで達成されている。
修正されていないVLMターゲット上でロスレスな最初のワンパスブロックドラフトであるGLANCEを提示する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:50:35 GMT)
WildSEEK: Evaluating Language Models for Information-Seeking [33.7] 実際のユーザインタラクションから3K情報検索クエリを手動でアノテートしたデータセットであるWildSEEKを紹介した。
また,LLM生成応答の評価フレームワークを提案する。
情報検索クエリの3分の1以上はリスクが高く、より頻繁に分析される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:25:10 GMT)
Where Identity Lives: Localized, Retain-Free Identity Unlearning in Multimodal Large Language Models [33.3] 認識を損なう、共有された視覚言語計算にダメージを与える。
私たちはこれをPathway-Aware Visual-Atribute Anchoring (PAVA)に変換し、これらのレイヤを更新し、忘れられたイメージからモデル自身の事前学習回答を抽出することで、画像のグラウンドドビヘイビアを保存するビジュアル-アトリビュートアンカーとペアリングする。
MLLMU-Bench と ReMem では、PAVA はリザーブセットのみの手法の中で最強のレザーブ・リザーブ・リザーブ・トレードオフを提供し、リザーブ・ベースラインとの競争力を維持している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:51:05 GMT)
UTILMEM: Benchmarking Evidence Utilization in Long-Term Conversational Memory [32.6] メモリ使用率を評価するための診断ベンチマークであるUtilMemを紹介する。
従来のファクトメモリベンチマークの強い性能は、有効メモリ利用に確実に変換されないことが判明した。
これらの知見は,記憶されている情報へのアクセスと有効利用との間に大きなギャップを生じさせ,長期の会話記憶の進歩には,検索妨害に対する証拠統合と堅牢性を明確に支援するアーキテクチャが必要であることを示唆している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:41:26 GMT)
TwinKV: A Composable Repair Pass for KV Cache Eviction via Pairwise Key Redundancy [32.3] ロングコンテキスト推論はキー値(KV)キャッシュのメモリフットプリントによってボトルネックとなる。
我々はTwinKVを紹介した。これはトレーニング不要で注意のない冗長性信号で、トークンのキーがコンテキスト内でほぼ重複しているかどうかを検出する。
我々はTwinKVを、LongBench、LooGLE、RULERの4つの最近の消去ポリシーと、圧縮比0.3,0.5,0.7$の短文MMLU-Proノハーム制御で構成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:59:21 GMT)
CORAL: A Benchmark for Structure-aware and Brain-wide Neuron Reconstruction in Light Microscopy [32.2] CORALは、光顕微鏡画像から自動的にニューロンを再構築する構造を意識した最初のベンチマークである。
脳全体のニューロン追跡フレームワークを開発し、任意の局所的再構成手法を脳全体の規模に拡張する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:32:59 GMT)
ScenePilot: Grow-and-Repair Policy for Text-Driven 3D Indoor Scene Generation [31.8] テキスト駆動型屋内シーン生成は、データセット境界レイアウトモデリングから、大規模言語と視覚言語モデルによるオープン語彙合成へと進歩した。
textbfGrow-and-perturb フレームワークである textbfScenePilot を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:22:11 GMT)
CAER: Causal Action Effect Reweighting for World Model Training [31.7] 本稿では,その行動に因果的に影響される可能性のあるトークンに対する監督を再分配する訓練パラダイムであるCausal Action Effect Reweighting(CAER)を紹介する。
CAERは、モデル自身の予測とアクション条件なしでこれらのトークンをオンラインにローカライズし、結果のエフェクトマップを、合計係数の質量を保存する重みに正規化し、使用される場所だけを変える。
不均一なアクション条件付きワールドモデルタスクによる実験により、CAERは一様MSEトレーニングよりも優れたソリューションに収束し、生成したビデオの物理的一貫性、制御性、視覚的品質が一貫した改善が得られた。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:49:56 GMT)
Wrong Prediction, Right Answer: Recovering Evidence from Collapsed LLM Sequence Scores [31.7] 多様な推論ベンチマーク間で一貫した読み出しギャップを観察する。
隠れ状態プローブは、ネイティブシークエンススコアが完全に崩壊しても正解を復号することに成功した。
以上の結果から,無作為な内部論理を隠蔽する表現障害が明らかにゼロショット推論の欠点であることが明らかとなった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:43:55 GMT)
LUCAID: Agentic Multimodal AI for Lung Cancer Precision Pathology [31.4] LUCAID (LUCAID) は、肺がんの精密診断のためのエージェントAIシステムである。
統合剤は、診断推論を9つのモジュールと結合する。
LUCAIDは、モジュール出力をインタラクティブにクエリし、結果をコンテキスト化するためのレポートを生成することができる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:03:11 GMT)
Open-Source Autonomous Driving System Analysis and Multi-Disciplinary Hardware-in-the-Loop Research Paradigm with Reinforcement-Learning Testing and Large Language Models [31.3] オープンソースの自動運転システムは、インテリジェントな自動車研究のための検査可能なソフトウェア基盤を提供する。
本稿では,Apollo-on-Hongqi EV環境について検討し,実車実験フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:58:20 GMT)
Tunable Exceptional Points for Quantum Sensing in a Spin--Orbit-Angular-Momentum Coupled BEC [31.1] ボース・アインシュタイン凝縮体の固有非エルミートボゴリューボフダイナミクスに基づく可変EPセンシングプラットフォームについて検討する。
我々は複数のEPを同定し、その軌道をマッピングし、PT対称安定状態からEPが近づくと強い量子フィッシャー情報拡張を明らかにする。
スピン密度測定は量子フィッシャー情報限界に近づき、ボース・アインシュタイン凝縮体におけるチューナブルEP強化量子センシングへの実験的にアクセス可能な経路を提供する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:03:30 GMT)
CANVAS: Consistency-Aware Navigation via Visual Adaptive Sampling for Long-Context Text-to-SVG Generation [30.8] 自己回帰型大規模モデルは、最近、単純なアイコンから複雑な長文グラフまで、テキストからSVGの生成が進歩した。
CANVAS(Consistency-Aware Navigation via Visual Adaptive Sampling)は、トレーニング不要でレンダリング対応の推論フレームワークである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:27:46 GMT)
Exploring Collaboration between a language and a non-language agent [30.6] textscLLAMIA-Benchは、行動模倣、状態評価、自然言語説明という3つの側面にまたがる6つのチェスタスクからなるスイートである。
単一の14Bモデル、textscLLAMIAは、潜在状態の内部化でトレーニングされ、タスクスペシャリストとフロンティアモデルにマッチまたは超過する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:25:10 GMT)
Using Grounded Theory for Agent Behavior Analysis at Scale [30.6] 本稿では,データから理論まで,基本的飽和基準と監査可能な軌跡を用いて,接地理論をエージェント軌道解析に適用することを提案する。
本稿では,エージェント軌道理論に基づく最初のマルチエージェントパイプラインであるAutoTraceGTを提案する。
AutoTraceGTは6つの軌道コーパスをまたいだコードブックを制作し、人によって注釈付けされ、それらが見逃す追加パターンの73-91%の障害モードを回復する。
これらの結果は、Grounded Theoryが機械学習研究者やエージェント開発者が実際に何をするのかを研究するためのスケーラブルな分析ツールを提供していることを示唆している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:47:45 GMT)
MVC-Bench: Benchmarking Calibration of Medical Vision-Language Models [30.3] MVCBenchは、ヴィジュアル言語モデル(VLM)と医用ヴィジュアル言語モデル(Medical-VLM)を用いた医用画像分類のためのキャリブレーション中心のベンチマークである。
i) モダリティ、バックボーン、ドメインシフトに対するロバスト性(ii) キャリブレーション戦略の有効性と、(iii) 急進的およびランダムな条件下での安定性を評価する。
1638以上の制御実験において,精度と予測誤差(ECE)を主指標として報告し,相補的校正法を用いて結果を報告する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:39:07 GMT)
Learning Dynamics of Logits Debiasing for Long-Tailed Semi-Supervised Learning [29.9] 長い尾の分布は、擬似ラベルが多数派を好む実世界の半教師付き学習(SSL)で一般的である。
学習力学のレンズを通してLTSSLを再考し,ロジットの偏りを理論的に評価する。
ラベル付きデータを用いたクラス認識型プルーニングとラベル付きデータによる信頼性ベースのソフトプルーニングにより,勾配予算を再配置する原理に基づく動的プルーニングフレームワークDyTrimを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:38:45 GMT)
COGTRL: Training LLMs for Scientific Discovery Assistance using Cognitive Traces via Reinforcement Learning [29.9] 大規模な言語モデル (LLMs) は、科学的な研究のために訓練され、科学的な発見の補助として統合されつつある。
LLMは、認知的トレースを生成するために訓練された場合、科学文献にのみ訓練された場合よりも、科学的発見アシスタントとして優れた性能を示すことを示す。
認知的根拠に基づく推論をエミュレートするためにLLMを訓練する軌道レベルの強化学習フレームワークであるCOGTRLを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 00:53:21 GMT)
DUPIN: Attack Learning Is Still Needed! Demonstrating Few-Shot after Unsupervised Pretraining Is A Nimble Forensics Learner [29.8] そこで我々は,DUPINと呼ばれる,学習に基づく攻撃法医学の新たなアプローチを提案する。
DUPINは、大量の監査イベントを前兆グラフの形で教師なしの事前トレーニングを行う。
その後、少数のラベル付き攻撃例を活用して、検出能力を微調整する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:00:42 GMT)
Vocal Music under Phoneme-Conditional Analysis [29.6] 音素条件解析を用いて,音素の音響的影響について検討する。
9つの類型的多様言語と数千曲の歌にまたがって、5つの音響次元に沿って効果を測定する。
その結果,音韻構造は各言語がどのように歌われているかを計測可能な痕跡を残していることが示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:03:36 GMT)
From Intent to Evidence: Policy-Steered Multi-Strategy Retrieval for Long-Video Agents [28.8] VESTAは、ルート条件付き取得・検証・統合ループとして組織された、トレーニング不要の長ビデオエージェントである。
時間的エビデンス台帳は、観測結果を適応的で圧縮された時間的位置、証明、カバレッジ、コンフリクト、検証結果、仮説支持の視点に集約する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:55:48 GMT)
Beyond Polarization: The Generative Constraint of Chain-of-Thought in Pointwise Reranking [28.8] ポイントワイドの文書の再評価では、Chain-of-Thoughtモデルは一般的に直接スコアリングモデルよりもパフォーマンスが低い。
私たちの実証的研究は、このギャップが最大32Bのパラメータにわたって安定していることを確認し、モデルとデータキャパシティの共同創設者を除外しました。
次に, 強化学習, きめ細かな監督, アーキテクチャの疎結合を利用したストレステストを適用し, これらの偏差を明示的に修復する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:51:49 GMT)
PixelIR: Fidelity-Perception Decoupling via Pixel-Space Image-Residual Flow Matching for Efficient One-Step Real-World Super-Resolution [28.8] リアルワールド・イメージ・スーパーレゾリューション(Real-ISR)は、知覚的に現実的な詳細を再構築しながら、劣化した観察によって支えられた構造を保存することを目的としている。
画素空間画像-残差フローマッチングに基づいて構築された,忠実度知覚デカップリングフレームワークであるPixelIRを提案する。
実験によると、PixelIRはRealSRとDRealSRの両方でPSNR、SSIM、LPIPSをリードする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:39:54 GMT)
Beyond Textual Chain-of-Thought: A Survey on Action-Grounded Reasoning in Autonomous Driving [28.6] Chainof Thought (T) 推論は、答えを生成する前に中間ステップを引き出す生成モデルを利用する。
自律運転では、推論は物理的世界と同じ構造を共有しなければならない。
本稿では,中間状態の形式を組織軸として扱う表現中心分類法を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:16:11 GMT)
HubMixer: Progressive Latent Hub Mixing for Parameter-Efficient Feature Interaction in Recommendation [28.5] HubMixerはパラメータ効率のよい遅延ハブミキシングアーキテクチャで、機能の相互作用を推奨する。
オフライン実験では、HubMixerはSOTAモデルより優れている。
クアイシュ州のショートビデオ採用事業におけるオンラインA/Bテストは、統計学的に5.48%の改善が認められた。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:55:40 GMT)
Can LLMs Take the Pulse of the Economy? A Real-Time Evaluation of LLM Nowcasts on Macroeconomic Indicators [28.4] 大規模言語モデル (LLM) エージェントは, ヘッドラインマクロ経済指標の候補候補として期待されている。
LiveMacroEval (LiveMacroEval) は、LLMのエージェントが16の主要マクロ経済指標の時限放送を行う、ライブで汚染に強いベンチマークである。
Nowcastの品質は、発表風株のリターンに対するLiveMacro Scoreと、シミュレーションされたPolymarketスタイルのトレーディングによるLiveBetting Scoreを通じて評価される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 00:53:28 GMT)
Semantic-Spatial Discriminability Enhancement for Generalized Visual Grounding [28.4] 汎用ビジュアルグラウンド(GVG)タスクは、参照表現に基づいて画像内のターゲットをローカライズすることを目的としている。
本稿では,汎用視覚接地のためのセマンティック・空間識別性向上(SSDE)フレームワークを提案する。
SSDEは、細粒度セマンティクスと空間的局所化における識別能力を高めることを目的としている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:37:36 GMT)
Constant Individual Regret in General Games [27.8] EmphECHO-OFTRL:高次楽観主義(ECHO)のためのEMAカスケードを備えた楽観的追従型リーダーについて紹介する。
もし$m_max$が最大のアクションセットサイズであるなら、すべての水平線に対して$Tgeq1$を同時にすると、ゲーム内の$N$のプレイヤーは、$O(textrmpoly(N, log m_max))$で囲まれた上界を後悔する。
我々のアルゴリズムは、現代のフィルタ設計にインスパイアされた新しい楽観主義の形式を利用する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:59:16 GMT)
APT: Anchor-aligned Perturbations for Tamper Localization in Fully Regenerated Images [27.6] プロアクティブなタンパーの局在化は、分布の前に知覚不能な信号を画像に埋め込む。
本稿では,高密度ベクトル幅の局所化信号を埋め込んだ半フレジル遅延空間摂動法 APT を提案する。
COCOの実験では、APTがFR IoUの0.92を達成し、最強のベースラインを上回っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:56:39 GMT)
SlideBank: A Persistent Hierarchical Evidence Bank for Consistent Whole-Slide Reasoning [27.5] 全体スライディング画像(WSI)は、スパース、ヘテロジニアス、分散形態学のため、視覚言語推論に難題である。
私たちはSlideBankを紹介します。SlideBankは、トレーニング不要のフレームワークで、各WSIを永続的で概念的で、空間的に根拠づけられたエビデンスバンクとして表現します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:37:52 GMT)
Dual-Layer Agentic Memory with Fast Write Routing and Slow Consolidation [27.4] 本稿では,メモリ管理をコスト対応ルーティングと周期的パラメトリック統合を通じて書き込みフェーズに移行するフレームワークを提案する。
1.7B/8Bカスケードは、入力の50%未満をエスカレートしながら、最大68%の冗長な外部メモリをプルーする。
さらに、周期的な統合は外部知識の内在化に成功し、モデルの境界が発展するにつれて、ルータが冗長な書き込みを適応的に抑制できることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 00:06:25 GMT)
CoLT-Drive: Counterfactual Long-Tail Benchmarking and Knowledge-Preserving Adaptation for Driving Affordance Prediction [27.2] 長い尾の自律運転障害はまれな物体認識エラーとみなされることが多い。
我々は、この問題を、モデルがフロントビューイメージ、エゴモーション履歴、ナビゲーションコマンドを構造化された横方向メタアクションにマッピングする、意思決定レベルの駆動能力予測として定式化する。
デプロイ可能な小型のVLMを改善するために,構造化された知覚と意思決定のプロンプトを組み合わせた知識保存適応フレームワークであるKPA,SLERPベースのエキスパートマージ,レギュラー対応のLORA混在モジュールであるRegMoEを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:44:30 GMT)
Does On-Policy Distillation Really Distill? From Noisy Teacher to Self-Improvement [27.1] オンライン蒸留(OPD)は、証明可能な報酬(RLVR)による強化学習の希薄な結果レベルの利点の代替として、高密度トークンレベルの監督を提供する。
我々は,OPD訓練中の教師の指導を定量的に分析し,教師の規模で有意な雑音が増大することを示した。
学習は低ログ確率トークンに焦点を合わせ, 教師が提案したトークンの性能に一致した1つの負の優位性を用いる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:22:10 GMT)
Synthetic Worlds for Temporal Evaluation and Knowledge Updating in LLMs [26.7] 大規模言語モデル(LLM)は静的事前学習コーパスに依存しており、その知識は時間が経つにつれて時代遅れになる。
知識編集を評価する既存のアプローチは、急激な汚染に悩まされるか、あるいは、厳格な知識と矛盾する対実的な編集に依存している。
制御された評価のためのコヒーレントなイベントトラジェクトリを生成する架空の、現実的な未来の世界のベンチマークであるSc ParallelEventsを紹介する。
sc Synapseは、モデル生成データを用いて、ミッドトレーニングとインストラクションチューニングを通じてモデルパラメータを更新するトレーニングフレームワークである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:06:35 GMT)
HSRM: Hidden-State Reward Models for Test-Time Verification [26.6] 本稿では,ジェネレータの内部表現を直接読み取ることで,候補解の検証を行う軽量な隠れ状態報酬モデルHSRMを紹介する。
結果ラベルを持つ自己生成軌道から訓練され、人手によるプロセスの監督も事前訓練された大規模な検証も必要としない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:12:19 GMT)
FoldingAgent: Inferring Parametric Origami Procedures from Demonstration Videos [26.4] 本稿では,折り紙デモビデオから直接,明示的なパラメトリック折り畳みプログラムを推定するためのエージェントフレームワークFoldingAgentを提案する。
本フレームワークは,一組の専門ツールを備えた事前学習型視覚言語モデルの推論能力を利用する。
そこで我々は,PurelandFoldのアプローチを評価した。PurelandFoldは多様なPureland Oigamiビデオの地上形状とアクションラベルを新たにキュレートしたベンチマークである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:09:22 GMT)
SPARK: Skeleton-Guided Reasoning Synthesis from Large-Scale Scientific Literature [26.2] SPARKはSci-Base上に構築された紙指向合成フレームワークである。
SPARKはそれぞれの論文を、その中心の主張を捉え証拠を裏付けるコンパクトな推理骨格に蒸留する。
我々はSpark-234Kという科学推論データセットを構築し、既存のリソースよりも難易度と多様性が著しく高い。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:55:30 GMT)
Three Steps at a Time: Learning Representations from Action Sequences in Contrastive RL [26.1] 私たちは、アクションチャンクを操作するために、対照的な強化学習を使用します。
我々の実証研究は、CRLの文脈では、アクションチャンクは単一のアクションよりもゴールに関するより多くの情報を持っていることを示唆している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:47:03 GMT)
DiffPDE: Masked Diffusion Language Models as PDE Solver [26.0] DiffPDEは,個別拡散言語モデルを利用してコード修復を行うフレームワークである。
DiffPDEは、ローカライズされた再マスキングとインフィル戦略を導入することで、正しいコンテキストを維持しながら、誤った領域のみを再生する。
逐次介入を必要とする結合バグに対処するために,強化学習方式である反復GRPOを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:01:13 GMT)
CapFrame: Text-Instructed Viewpoint Grounding in 3D Gaussian Scenes via Geometric Pseudo Labels [26.0] CapFrameは関連するビューを取得し、MLLMによる質問評価プロセスを通じてランク付けするフレームワークである。
命令を向きとレイアウトの擬似ラベルに変換し、3DGSでレイアウトと向きのロスを伴って、異なる最適化によってカメラのポーズを洗練する。
実験により、CapFrameは視点探索や適応された軌道生成ベースラインよりもテキストに整合した視点を生成することが示された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:56:32 GMT)
DiffSAC: Diffusion-guided Sampling for Consensus-based Robust Estimation [25.8] コンセンサスに基づくロバスト推定のための拡散誘導サンプリング手法を提案する。
DiffSACは有効最小セットの分布を学習し、各データポイントに対する信頼性を洗練する。
少数の高品質の最小セットを出力し、コンセンサス評価による最良の仮説の同定を可能にする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:15:11 GMT)
Beyond Parallel Blindness: Information Floors and Model Gaps in Block Drafting [25.7] ブロックのドラフトアは、前のターゲットトークンが実現する前に、1つのフォワードパスでいくつかのトークンを提案します。
彼らの拒絶は2つの損失を混合する: ブロック内パス情報不足と観測可能な情報の完全なモデリングである。
我々は2つを情報フロアで分離し、指定された条件付き順序で最小限の拒絶を期待する。
4つのドメインにわたるターゲットロールアウトと4つのオープンウェイトターゲット、フロンティアAPIターゲットから両方を推定すると、3つの結果が得られます。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:02:16 GMT)
Ladders in Chaos: When, How, (and Perhaps Why) Does Test-Time Scaling Improve LLM Machine Translation [25.7] 大規模言語モデル(LLM)の2種類のテストタイムスケーリングは、効果的で広く採用されているパラダイムとして現れている。
シーケンシャルサンプリングは高い性能の天井を持ち、より多様性があり効果的なサンプルプールを提供することを示す。
逐次スケーリングが機械翻訳を改善するメカニズムを説明する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:42:25 GMT)
Framework and Benchmark for Code-Driven Agentic Testing in Web Development [25.6] textbfCode-driven textbfAgentic textbfTesting (CAT)は、エージェントがブラウザを動かすためにPlaywrightコードを書き、フィードバックを収集し、バグを明らかにするためにWebアプリケーションを自律的に探索するパラダイムである。
CATJudgeはブラウザとコンピュータのツールをひとつの環境に統合するエージェントフレームワークで、CATTestは102のAI生成Webアプリケーションのベンチマークで、慎重に注釈付けされたバグが書かれています。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:07:51 GMT)
SemPOI-RL: Aligning LLM Semantic Reasoning for Interpretable Out-of-Town POI Sequential Generation [25.5] SemPOI-RLは、大規模言語モデルを構造化シーケンス生成と整合させるフレームワークである。
まず、利用者の出身地軌跡から目的地指向の旅行スタイルを推定するために、LSMを微調整する。
次に、セマンティックPOIアライメントモジュールを導入し、これらの推論されたスタイルを、位置認識軌道生成のためのスタイル条件付きマスク付きオートエンコーダにグルーピングする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:52:41 GMT)
Audio-Driven Adversarial Defense for 3D Talking Face Generation with totally Visual Fidelity Preservation [25.3] 音声駆動型3次元音声合成のための非受容型音声防御法を提案する。
音声信号の知覚的マスキング領域内の保護的摂動を隠蔽するために,精神音響マスキングを利用する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:22:05 GMT)
MMDS-Bench: Benchmarking Multimodal Large Language Models on Dynamic Stance in Social Media Interactions [25.0] ソーシャルメディアの親-応答相互作用におけるマルチモーダル動的姿勢分類のための診断ベンチマークであるMMDS-Benchを紹介する。
MMDS-Benchには7ラベルの動的スタンス分類を付加した3,482のマルチモーダルインスタンスが含まれている。
我々は,12のオープンソースおよびオープンソースマルチモーダル大言語モデルを評価し,推論品質を評価するための基準基底LLM-judgeプロトコルを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:53:08 GMT)
InfraOcc: An Infrastructure Occupancy Benchmark with Static-to-Dynamic Reasoning [24.5] InfraOccは、インフラ側のセマンティック占有率の最初のベンチマークである。
静的なインフラストラクチャは97.3%の占有ボクセルを埋め、フレームをまたいで持続するのに対し、ダイナミックな参加者は1カ所あたりの占有フレーム比が1.8%しか持たない。
本稿では,ProSD-Occを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:56:50 GMT)
HiRS-Agent: A Hierarchical Multi-Agent System for Reliable Long-Horizon Remote Sensing Task Solving [24.4] HiRS-Agentは、長期RSタスク解決のための階層型マルチエージェントシステムである。
Manager Layerは動的ルーティング、ステップレベルの検証、再計画、終了制御を処理する。
Specialist LayerはRSワークフローに従ってドメイン固有のツールを整理し、サブタスク推論とツール実行を担当する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:13:41 GMT)
Fine-Grained Multi Image Object Hallucination Benchmark [24.4] 我々は、微細なマルチイメージオブジェクト幻覚ベンチマークであるMIOHを紹介する。
29モデルの評価により, GPT-5やGemini-2.5-Proのような最先端システムでさえ, 異なる故障パターンを示すことが明らかとなった。
MIOHは、より信頼性の高いマルチモーダルAIシステムを開発する上で、重要な評価ツールである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:53:03 GMT)
One Policy Is Enough: Single-Agent Reinforcement Learning Outperforms Tree Search for Chemistry Tool Learning [24.1] CheMatAgentは、2人の学者によるツールコールツリーを検索する。
我々のモデルは、左右の世代で推論、ツールコール、リターンをインターリーブし、教師付きウォームアップと結果レベルの強化学習によって訓練する。
ChemToolBench多ツール化学では、両バックボーンのCheMatAgentを用いてツールF1を5.5%改善し、Qwen-2.5-7Bでは9.6%改善し、Llama-3.1-8Bでは3.7%と3.9%改善した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:22:19 GMT)
ECLIPSE: Self-Evolving Stealthy Prompt Injection Attack against Long-Horizon Agentic Systems [24.1] 大規模言語モデル(LLM)エージェントは、繰り返しツールコールによって長期タスクの計画と実行が可能になった。
本研究では, 長期エージェントシステムのための自己進化型, ステルス型プロンプトインジェクションフレームワーク ECLIPSE を提案する。
ECLIPSEは2つのコンポーネントを通じて直接ユーザプロンプトインジェクションと間接ツールサイドインジェクションを組み合わせる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:32:22 GMT)
SMOTE-VAR: An Uncertainty-Aware Oversampling Method for Predicting Depression Remission in University Students [24.0] 大学生は、うつ病などの一般的なメンタルヘルスの状態を非常に高い率で経験する。
成績の悪い生徒を識別するための新しいアプローチは、より早く、よりターゲットを絞った介入を可能にする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 00:26:13 GMT)
SimCRAFT: Distilling Remote Sensing Agents via Synthetic Trajectories and Contextual Retrieval-Augmented Fine-Tuning [24.0] SimCRAFTは、洗練されたRSオーケストレーション機能をコンパクトな7Bスケールモデルに蒸留する、モデルに依存しないフレームワークである。
この研究は、軽量RSインテリジェンスのための競争力のあるオープンウェイトベースラインに貢献し、効率的な自律デプロイメントを可能にしている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:45:33 GMT)
RealCAD: Towards Real-World Image-to-CAD Reconstruction under Domain Shift and Parameter Bias [23.4] 既存のイメージ・トゥ・CAD法は主に合成レンダリングに基づいて開発されている。
本稿では,DeepCADが採用する局所正規化が,いくつかの離散値に関する幾何パラメータに集中していることを示す。
本稿では,これらの制約を表現,画像,特徴レベルで処理する統合フレームワークであるRealCADを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:27:22 GMT)
Graph Evidence Is Not Enough: Diagnosing Native Decoder Use in Graph-Augmented LLMs [23.3] グラフ拡張された大きな言語モデルは、しばしば、外部計算によって生成されたグラフ証拠をネイティブデコーダで使用することができると仮定する。
グラフエビデンスを提供することは、使用可能にすることとは同じではないことを示す。
診断駆動インタフェース設計がネイティブデコーダのユーザビリティを向上させることを示す例として,S$2$GEを挙げる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:27:01 GMT)
GPAgentBench-2K: Benchmarking Large Language Model Agents in Complex Clinical Action Space [23.2] GPAgentBench-2Kは、プライマリケアの臨床的意思決定のための最初の制約付きMDPベンチマークである。
我々の環境は6つの基本的な臨床行動の完全なスペクトルをモデル化し、行動空間に先立ってトポロジカルなワークフローを課し、第一級の成果として安全インフォームドな禁忌を運用する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:13:47 GMT)
Lingua Franca or Probing Artifact? Rethinking Latent Language in Multilingual LLMs [23.1] 現在のプローブは、単一の内部言語フランカを直接露呈するのではなく、多言語処理の異なる側面を露呈している、と我々は主張する。
この質問は、モデルファミリー、トレーニング体制、ドメイン、タスク、チェックポイント、最大27の言語で研究する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:09 GMT)
SwarmBench: Can Large Language Models Act as Agent Swarm Orchestrators? [22.3] 大規模言語モデルに基づくマルチエージェントシステムは、固定された相互作用トポロジから動的に編成されたエージェント・スワムへと進化している。
精度,効率,コスト,プロセス品質など,複数の観点からモデル性能を評価するベンチマークであるSwarmBenchを提案する。
さらに,経験抽出と経験再生に基づくシンプルで効果的なSwarmExpを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:02:04 GMT)
Extracting Knowledge from Tools in LLM Agents [21.5] LLMエージェントは通常、知識ベースのツールを使用して、ツールの呼び出しを通じて、基礎となるファイル、データベース、検索インデックスにアクセスする。
本稿では,ツールによる知識抽出のリスクを体系的に検討する。
クエリのみの抽出攻撃であるToolSiphonを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:55:17 GMT)
MR-JEPA: A General Purpose Video Foundation Model for Cardiac MRI [21.2] CMRのための自己教師型ビデオ基盤モデルMR-JEPAを提案する。
従来のCMRビデオモデルとは異なり、MR-JEPAはシーケンシャルなマルチシーケンスデータに基づいて事前訓練される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:36:24 GMT)
Rubric-to-Code Credit Assignment for Reinforcement Learning [21.2] textbfRubric-to-Code Credit Assignment (RCCA)は、明示的な機能的ルーリックに関するトレーニングタスクを構築する。
textbfLing-RCCA-FlashはMiniAppBenchで41.25得点し、Ling-3.0-Flashを32.20ポイント改善し、Claude Opus 4.5をわずかに上回った。
また、ArtifactsBenchでは76.19に到達し、SFTモデルを4.48ポイント改善し、GPT-5スコアを3.64ポイント越えて公式のArtifactsBenchリーダーボード設定の下で新しいトップスコアを確立した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:54:20 GMT)
Beyond Object Selection:Markerless Gaze-based Robot Placement at Arbitrary Position [21.2] 視線に基づく操作では、ポーズの精度が必ずしもタスクの精度に変換されるとは限らない。
本稿では,視線特定対象の空間誤差を直接測定するGSIE(Gaze- Surface Intersection Error)を紹介する。
実験により、GSIEでは、従来のポーズの指標によってランク付けされたアライメント手法が常に最適であるとは限らないことが示された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:27:14 GMT)
Failure or Drift? Evaluating Monocular SLAM under Synthetic and Real-World Corruptions [21.1] 画像空間, 幾何学的認識, 複合汚職の下で, 古典的特徴ベースシステムと2つの学習的トラッカーを評価する。
その結果、学習したトラッカーは破滅的な損失を持続的、時には重篤な漂流に置き換えることがわかった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:28:26 GMT)
Aligning Multi-Trajectory Supervision with Policy Optimization for VLA Driving [21.1] 視覚言語行動駆動法は、多軌道模倣学習とグループ言語ポリシー最適化をますます組み合わせている。
模倣を改善するハイスコアな軌道は、現在の政策の実行可能な行動分布とミスマッチした利点推定を誘導することによって、その後のGRPOを劣化させる可能性がある。
本稿では,多軌道監視と政策最適化を連携させる新しい枠組みを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:17:18 GMT)
DASC: Decay-Aware State Compression for Hybrid Linear-Attention Serving [21.0] 我々はGated DeltaNet(GDN)とKim Delta Attention(KDA)の崩壊構造を分析する。
異なる頭とチャネルが、明らかに異なる時間スケールでプレフィックス情報を保持していることがわかり、それは、エンプレメンテーション水平線(enmphretention horizons)と呼ばれる。
本研究では, モデル重みから保持地平線を導出し, 長期状態単位を選択し, タグ付き状態チェックポイントレイアウトにまとめるEmphDecay-Aware State Compression (DASC)を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:42:43 GMT)
ScienceArena: Benchmarking LLMs on Latest Scientific Olympiad Competitions [20.6] ScienceArenaは、物理、化学、生物学の13の公開科学コンペティションのオリンピックスタイルのベンチマークである。
我々はScienceArenaを専門家が監査したデジタル化パイプラインで構築し、公式の試験、数字、ソリューション、ルーリックをオリンピックのメダリストが検証した構造化アイテムに変換する。
メダリストの注記によれば、失敗は視覚的基盤、構造的忠実さ、そしてグローバルな問題制御に起因していることが多い。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:52:29 GMT)
ConvDeck: Conversational Paper-to-Slide Generation via Stage-Specific User Feedback [20.5] ConvDeckは、対話型紙-スライド生成のためのマルチエージェントパイプラインである。
ユーザーは、プレゼンテーション概要と最終スライドデッキの両方を、それぞれの決定が下された段階で洗練することができる。
本評価は,物語のコヒーレンス,コンテンツ品質,視覚的提示を保ちながら,ステージ固有の会話フィードバックがユーザ目標満足度を向上させることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:34:25 GMT)
Beyond Consensus: Downward Bias and Role Asymmetry in Multi-Agent LLM Judges for Subjective Evaluation [20.3] 我々は,主観的評価タスクにおいて,コンセンサスに基づくMADプロトコルと比較した。
我々の主張は、この性能低下は相互作用自体よりも、主に非対称的な役割に起因していることを示している。
これらの結果から, マルチエージェントのコンセンサスは, 真のヒトのアライメントを犠牲にして, 人工的なアライメントを強制できることが示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:28:55 GMT)
RW-LoRA: Communication-Efficient Decentralized LoRA Fine-Tuning via Random Walks [20.2] LoRAのような微調整の計算手法は、大規模な基礎モデルに適応するための標準的なアプローチとなっている。
既存の分散LoRAメソッドの多くは集中集約に依存しており、Gossipベースの分散LoRAは複数のモデルコピー間で繰り返し同期を必要とする。
本稿では,複数のモデル複製を維持する代わりに,ネットワークを横断する単一モデルトークンを逐次更新するランダムなLoRAファインタニング方式を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:24:24 GMT)
BiG-SURE - Bipartite Graph for Semantic Uncertainty and Reliability Estimation of LLMs [19.8] BiG-SUREは温度間セマンティック合意に基づく不確実性推定器である。
テキストQA,多言語QA,マルチモーダルQAタスクでBiG-SUREを評価する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:48:34 GMT)
Whole-Slide Image Analysis under Realistic Few-Shot Annotation Protocols [19.7] 本研究では,空間的および生物学的な手がかりを組み合わせ,条件付きランダムフィールドを全スライド画像に適用するSlideCRFを提案する。
また,空間的局所的なクリックとスクリブルに基づく,現実的なアノテーションプロトコルのセットも提供する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:17:44 GMT)
Size-Independent Robustness in Multipartite Bell Self-Testing [19.6] 量子ネットワークのサイズによらず、頑健なマルチパーティ・セルフテストを確立する。
我々は、$n$-qubit Greenberger-Horne-Zeilinger(GHZ)状態に対して、完全に解析的でデバイスに依存しない自己テスト境界を導出する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:16:06 GMT)
Enhancing Low-Resource Language Reasoning via High-Resource Language Feature Transfer [19.5] 高リソース言語(HRL)は、タスク固有の推論(数学的推論)に役立つ潜在計算をより確実に引き出すことができる。
本稿では,言語間におけるタスク関連スパース機能を識別し,伝達するための機械的介入フレームワークを提案する。
当社のフレームワークは、機能欠如ではなく、メカニズム誘発の失敗として、言語横断的な推論ギャップを再構築しています。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:47:41 GMT)
Exact joint eigenvalue densities of non-Hermitian random matrices are Calogero scattering states [19.5] 正確な結合固有値密度を解くことは、ランダム行列理論の中心である。
ヴァンダーモンド因子はカロジェロモデルの散乱状態波動関数である。
多くの既知の合同密度とは対照的に、密度は対の相互作用を持つ固有値の気体として記述することはできない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:43 GMT)
Duality between the level statistics of Hermitian and non-Hermitian random matrices [19.5] 我々は、エルミート確率行列と非エルミート確率行列のレベル統計の正確な双対性を明らかにする。
これらの結果は、エルミートと非エルミート確率行列理論のより深い対応の先端になることを期待している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:37 GMT)
Beamforming Design Via GNN in mmWave Cell-Free Massive MIMO Using Sub-6 GHz CSI [19.5] 本稿では, グラフニューラルネットワーク(GNN)を用いて, 6GHz以下のCSIから, 完全ディジタルセルフリーのミリ波ビームフォーミングを効果的に学習できることを示す。
異なるネットワークトポロジ間のユーザ間干渉や基地間協調を捉えるために,メッセージパッシング機構を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:55:46 GMT)
StreamScout: Learning When to Look Deeper for Streaming Video Understanding [19.5] ビデオの理解をストリーミングするには、無制限のビデオストリーム上で任意の瞬間にやってくる質問に答える必要がある。
StreamScoutは適応型推論フレームワークで、ストリームが展開するにつれて、コンテキスト内の軽量なテキストタイムラインのみを保持する。
3つのバックボーンと3つのストリーミングベンチマーク、StreamScoutとその変種は、従来よりも一貫してパフォーマンスが向上している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:35:25 GMT)
Zeva: In-Context Causal Learning for Generalizable Embodied Manipulation [19.3] 我々は、ポリシーモデルを凍結させながら、ロボット自身の物理的相互作用経験からコンテキスト内学習を可能にする最初のフレームワークであるZevaを紹介する。
シミュレーションと実世界の操作の実験により、ゼヴァは比較されたフロンティアVLAとWAMの中で最高の性能を達成していることが示された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:39:00 GMT)
The Privacy-Hallucination Tradeoff in Differentially Private Language Models [19.3] 差分プライベート(DP)言語モデルにおけるプライバシ・ハロシン化のトレードオフについて検討する。
DPで事前訓練されたり、微調整されたりすると、非DPに比べて幻覚がより多く生じる傾向が示されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:39:03 GMT)
Learning Compositional Spatio-Temporal Video Grounding with Synthetic Curriculum [19.1] 既存の評価とトレーニングデータは、単純なクエリに重点を置いている。
現実のシナリオで一般的なコンポジションクエリでは、ターゲットはその属性と他のエンティティとの関係によって曖昧にされなければならない。
本研究では,時間的シーングラフを難易度として活用する合成データエンジンを構築し,制約プログラミング問題としてクエリベンチをキャストする。
このエンジン上に構築されたST-CompBenchは、時間的複雑さと空間的干渉をキャプチャする、明示的な難易度によるベンチマークである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:01:31 GMT)
EvoSkill Injection: Red-Teaming Autonomous Skill Generation and Evolution in Self-Evolving Agents [18.9] 自己進化型エージェントは、過去の経験からスキルを生成し、洗練し、再利用することで、継続的な能力進化を可能にする。
しかし、自律的なスキル進化は、悪意のある能力を生成、保存、再利用する新たな攻撃面を導入している。
本稿では,自己進化エージェントの自律的スキル生成と進化パイプラインを対象とした脅威モデルとして,EvoSkill Injectionを定義する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:25:03 GMT)
SleepWalking: Privileged Representation Shaping for End-to-End Blind Locomotion in Legged Robots [18.7] SleepWalking for Robot Locomotion (SWAQ)は、ポリシー学習のためのエンドツーエンドフレームワークである。
我々は,SWAQがDWAQよりも高いピーク平均地形レベルを達成することを示す。
その結果, 意味論的目的は, 配置したコントローラのアーキテクチャ的分解を必要とせずに, 学習を構造化できる可能性が示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:42:03 GMT)
ATLAS: Dual-Horizon Diagnostic Evaluation for Industrial Tool-Use Agents [18.6] ATLASは、産業用工具使用エージェントのための二重水平診断評価フレームワークである。
要求の地平線では、軌跡的診断信号は、実行場所と機能上の懸念に欠陥を関連付ける。
インタラクションの地平線において、ユーザワイズ信号は、継続的なインタラクション間でサービスが応答性を維持しているかどうかを評価する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:25:24 GMT)
Two Centuries of Sexism in British Parliament: A Computational Analysis of Women's Representation in the Hansard Corpus [18.5] 英国議会の200年間にわたる6,531回の演説の分析(ハンサード、1803-2005)
その結果,女性表現に反対する言論の54%が性差別的内容を含んでいることが判明した。
抗参政権のレトリックは敵意と善意のフレーミングを兼ね備えているのに対し、親参政権のセクシズムは圧倒的に善意である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:10:05 GMT)
GUIDE: Guiding Internal Evidence with Language Instructions [18.4] 言語命令による内部エビデンスの使用制御フレームワークであるGUIDEを紹介する。
また,GUIDEは,主にタスク動作を保ちながら,エビデンスに依存した構造化および命令整合的な再配布を誘導することを示す。
このことは、複数のエビデンスソースがモデル予測にどのように貢献するかを制御するために、出力制御を超えてマルチモーダル命令に従うことができることを示唆している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:50:03 GMT)
IMPACT: Attention Is the Interaction Map for Scalable Interaction-Aware World Model Training [18.3] IMPACTは,事前誘導と目標設定を併用したスケーラブルなインタラクション対応フレームワークである。
IMPACTは、対応するMSE訓練ベースラインを一貫して上回り、相互作用の忠実度、物理的妥当性、視覚的品質を改善している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:36 GMT)
A Lagrangian View of Flow Matching [18.0] ラグランジアン(粒子中心)の観点から、別のボトムアップ機械的導出を示す。
この部分微分方程式の解法はフローマッチングの直線軌道を解析的に得ることを示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:13:33 GMT)
Cross-Spectral Reservoir Correlations as a Resource for Finite-Time Quantum Otto Engines [17.9] 有限時間量子オットーエンジンにおいて, 縦-横-横-スペクトル共振器相関について検討した。
クロススペクトル相関は、加工媒体の集団とコヒーレンスを変化させ、熱力学的性能を変化させる。
これらの結果は、有限時間量子熱機械を制御するための追加資源として、対角圏外貯水池スペクトルを確立する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:28:04 GMT)
PAVE: Predictive Alignment and Value-Guided Evolution for World-Action Policies [17.9] 直接視覚-言語-アクションポリシーは、継続的なロボット動作を効率的に生成するが、標準的な行動クローンは2つの相補的なギャップを残している。
結果に依存しない予測学習と結果認識型政策改善を組み合わせた,直接的な世界行動政策である方法を紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:36:11 GMT)
Does Reasoning Mitigate Backdoor Attacks? A Neuro-Symbolic Perspective [17.5] Neuro-Symbolic (NeSy) AIは最近、信頼できるAIを実現するための新しいパラダイムとして登場した。
NeSyモデルは、平均的にニューラルネットワークよりも堅牢であるが、その堅牢性は、強制される推論プロセスの厳密性に大きく依存している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:13:05 GMT)
SlideMix: Enhancing Whole Slide Image Analysis via Multimodal Shuffling [17.5] 複数インスタンス学習(MIL)は、タイルレベルの特徴をスライドレベルの予測に集約するために広く使用されている。
MILに基づくWSI分析のためのモデルに依存しないマルチモーダル拡張フレームワークであるSlideMixを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:25:02 GMT)
RailSyn: Diagnosis-Guided Image Generation for Traceable Data Completion in Railway Foreign Object Detection [17.4] RailSynは、実際の参照インスペクタと要件に準拠したジェネレータで構成される診断誘導フレームワークである。
このシステムはC_gap$から13.64%のローカルシェルの占有を達成し、実際の完了領域のカバレッジを計測する。
実験の結果、AP50--95は最大4.9ポイントまで上昇し、9つの主流検出器で一貫した改善が見られた。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:47:28 GMT)
OCR-MetaReasoning Benchmark: Evaluating the Meta-Reasoning Ability of MLLMs in Text-Rich Image Understanding [17.1] OCR-MetaReasoning(英語版)は、推論、誘導、誘拐を異なる方向として扱う、制御された単一イメージのベンチマークである。
モデルでは可視光ルールアプリケーションとレイアウトに敏感な推論に苦慮している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:20:05 GMT)
CPR for LLMs: Critical-Point Routing against Catastrophic Forgetting in Domain Adaptation [17.1] Supervised Fine-tuning (SFT)は、大規模言語モデルをターゲットドメインに適応するためのデファクトスタンダードである。
既存のアプローチは、通常、忘れを緩和するためにSFT損失を変更するが、必然的にドメイン・ジェネリティー・トレードオフに沿って機能する。
モデルレベルで2つの機能を分離し、ドメイン固有の知識が必要な場合にのみSFT専門家を選択的に呼び出すことで、このトレードオフを回避します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:19:10 GMT)
Augmenting Interviewer Judgments of Patient Experience with Automatic Language Analysis [17.0] セッション後インタビュアーの評価と自動言語に基づく予測を組み合わせ、患者が報告した対話品質を推定する枠組みを評価する。
以上の結果から, 簡易平均化による判断とモデル予測を組み合わせることで, 総合評価が最強であることが示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:56:28 GMT)
CM2: Multimodal Cultural Reasoning via an Integrated Multi-Agent Framework [16.9] 本稿では,人間文化解釈の認知経路を基盤としたマルチエージェントフレームワークCM2を提案する。
CM2はマルチモーダル認識、検索強化生成、ネットワーク推論、ゲート融合、報酬駆動フィードバックを統合している。
複数のMLLMバックボーンにまたがるCM2Dの実験は、CoTや典型的な推論パラダイムよりも一貫した利得を示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:29:04 GMT)
Good Memory Has ECC: Evaluating the Memory of Vision-Language Models Beyond Accuracy [16.9] 本稿では,システムの容量を超えるメモリを測定するベンチマークおよび評価プロトコルであるECCBenchを紹介する。
トレーニング済みのVLMは、ビデオではなくテキストでメモリを圧縮し、双方で校正が不十分であることがわかった。
幅広いメモリバックボーンのセットの中で、いくつかの非トランスフォーマーアーキテクチャは、RoPEトランスフォーマーよりも圧縮校正トレードオフが優れている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:05:17 GMT)
Ignorance or Incompetence? Constructing Knowledge-Gated, Verifiable Tasks for LLM Agents [16.7] 本稿では,タスク命令をコンパクトなアーティファクトから分離するナレッジ付きタスク構築プロトコルを提案する。
1つのフロンティアエージェント構成は、アーティファクトで68.0%のパスレート、それなしで0%のパスレートを達成する。
保持されたタスクがポストトレーニングを改善するという確証はない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:39:27 GMT)
Learning to Evaluate Before Improving: Automatic Rubric Induction for Automatic Research Agents [16.4] AutoSciRubは評価ファーストのフレームワークで、研究実行前にタスク固有の実行ファイルを誘導する。
AutoSciRubは、未特定の命令を原子科学的目標に分解し、関連する文献やタスク可視データに基礎を置いて、特定の、実行可能な、検証可能な基準を合成する。
改訂期間中、ルーブリック誘導検証は未測定の基準を特定し、研究報告の目的の精査を可能にする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:48:51 GMT)
Slow to See, Slow to Suppress: Understanding the Effects of Modality in Context-Memory Conflicts [16.4] 視覚言語モデルがコンテキスト記憶の競合をどのように扱うかを検討する。
モデルは、テキストに現れるエンティティに関するコンテキスト内情報を好むが、画像に現れるエンティティに関するパラメトリック情報を好む。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:37:07 GMT)
MemeBridge: A Dataset for Benchmarking and Mitigating the Bidirectional Cultural Gap in Meme Interpretation [16.4] 本稿では,米国産ミームを中心としたキュレートデータセットであるMemeBridgeを紹介する。
ここでの文脈は、背景信念、規範、ミーム理解を形成する共有前提を含む暗黙の文化的知識を指す。
我々は、米国参加者の予想される誤解がしばしば不正確であることを観察する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:38:23 GMT)
Stick to What You Know: A Study of Knowledge-Aligned Supervised Fine-Tuning [16.3] Supervised Fine-tuning (SFT) は、ターゲットの応答を模倣するベース言語モデルを訓練する。
これらのターゲットは、ベースモデルが堅牢に内部化されていない知識を必要とするかもしれない。
我々はこれを幻覚の源として研究し、緩和法群をEmphknowledge-aligned SFTとして検討した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:43:51 GMT)
BRF-GS: Hyperspectral Bidirectional Reflectance Factor Modeling and Image Generation Based on 3D Gaussian Splatting [16.3] 双方向反射率(BRF)は、地球表面の指向性放射特性を特徴づける。
既存の3次元放射移動モデルは複雑なシーン構築と計算集約的な放射移動解法を必要とする。
BRFモデリングと高スペクトル反射率画像生成のための3DGSベースのフレームワークであるBRF-GSを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:56:57 GMT)
AVENUE: Audio-Video EditiNg Understanding and Evaluation [16.2] AVENUE, Audio-Video EditiNg Understanding and Evaluationを紹介する。
制御可能なAV編集モデルに向けた進捗を駆動するためのベンチマークおよびモダリティ対応評価フレームワークである。
一つのモダリティを編集する場合、既存のモデルは、パラダイムに関係なく、意図しない変更をしばしば誘発する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:05:01 GMT)
Hypotheses-Guided Self Distillation for Continual Personalization [16.2] 我々はHypReflectを紹介した。HypReflectは継続的パーソナライゼーションのための信頼性が高くスケーラブルなフレームワークだ。
HypReflectは、多様なユーザ信号から明示的で不確実性を認識した選好仮説を推論する。
結果は、信頼性とスケーラブルな継続的パーソナライゼーションへの一歩を示唆している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:52:21 GMT)
The Fragility of Jailbreak Robustness Across Operational States [16.2] 既存のジェイルブレイク評価では、デフォルト設定(バニラ状態)で測定された単一攻撃成功率(ASR)を用いて、ロバスト性を特徴付けるのが一般的である。
攻撃が固定されたままでも、Jailbreakの堅牢性は運用状態の変動に対して非常に脆弱であることがわかった。
以上の結果から, 単一のバニラ状態評価は脱獄時のロバスト性を完全に特徴づけるものではなく, 非バニラ動作状態におけるロバスト性の変化を調査するためのモチベーション評価である可能性が示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:14:47 GMT)
KItCAT: Knowledge Injection via Input Corruption for Auto-regressive Training [16.1] KItCAT: Corrupted Auto-Regressive Trainingによる知識注入について紹介する。
KItCATは、複数のデータセットとモデルファミリをまたいだCPTよりも一貫して改善されていることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:30:32 GMT)
PRIME: Mitigating Subgroup Optimization Competition in Shared CTR Top Networks with Plug-in Residual Input-Conditioned Mixture of Expert [16.1] 4つのモデルと4つのセマンティックフィールドを持つアバズ上での競合について検討する。
我々は,低ランクの残留専門家を混在させたPRIME(Plug-in Residual Input- Conditioned Mixture of Experts)を紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:37:44 GMT)
Marginal Coordinate Test for Fréchet Regression with Random Objects [15.9] 分離可能な距離空間におけるユークリッド予測器とランダムオブジェクト応答を用いた回帰テストを開発する。
我々は、重み付けされた中央2乗のヌル限界、ワイルドブートストラップの有効性、および固定検出可能な代替品に対する一貫性を確立する。
同時推論では、truncated p-to-e calibrationとe-BHを組み合わせることで、一般的な依存下での誤検出率の制御が可能になる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:48:12 GMT)
When Models Hear What They Expect: Diagnosing Prosodic Heuristics in Multimodal Sarcasm Detection [15.9] マンダリン系中国語と英語の皮肉検出について検討した。
表現的韻律の共有ステレオタイプ,すなわち高いピッチと不規則なパジングにモデル誤差がクラスタリングされていることがわかった。
同じ操作テンプレートを変更せずにGemini3 Flash Previewに適用することは、その効果を再現し、ステレオタイプがQwen Omniファミリを超えて広がることを示唆している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:34:35 GMT)
ICON Decomposition: Auditing Deep Neural Networks with Multivariate Variance-based Concept-level Explanations [15.8] ディープニューラルネットワークは、しばしばショートカット学習として知られる失敗である急激な関連を悪用する。
現在の概念に基づく説明可能性メソッドは、一度に1つの概念をテストし、レイヤからデオード可能かどうかを問う。
ICON分解は、他のすべての概念と結果から、各概念が説明できる層の分散度を定量化する。
シミュレーションデータでは、ICONは既存の7つの方法よりも概念の重要性を正確に回復する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:35:50 GMT)
PEARL: Front-Loading Relational Chains for Multi-Hop Table Retrieval [15.8] PEARLはトレーニング不要のフレームワークで、パラダイムを垂直パーティショニングベースのサブテーブルエンコーディングにシフトする。
PEARLは、事前に特定されたジョインパス上でマルチホップクエリを生成することで、検索コーパスをオフラインに拡張する。
実験の結果、PEARLは既存のメソッドを一貫して上回り、3ホップクエリのR@2で最大30.05%のゲインを達成している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:56:40 GMT)
Measure Before You Manage: Evaluating Agent Working Memory in Coding Agents [15.7] 符号化エージェントにおける作業記憶の管理と評価について,意味的不均一性がどのように形成されるかを検討した。
意味的に異なるワーキングメモリオブジェクトは、保持と圧縮の挙動が異なることが分かりました。
これらの教訓は、状態の保存、コンテキストの配信、管理作業、タスクまたはプロセスの結果の4つのレベルにまとめています。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:34:51 GMT)
Minimax bounds for watermarked and masked recursive discrete distribution estimation [15.7] 識別機構が欠如していることから, 合成試料の添加により, 新しい実試料の限界効果が著しく低下することが示されている。
検出の偽陰性率も消えない限り,透かしを追加することで性能を向上させることは不可能であることを示す。
本稿では,残りの状態のギャップをジェンセンギャップに狭めるランダム化手法であるマスキングを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:00:09 GMT)
Optimization Landscape Geometry in VQE for Frustrated Quantum Spin Models [15.6] フラストレーションスピンモデルの階層上での高精度ベクトルVQE計算の8つの古典をベンチマークする。
我々は、局所的なミニマ、勾配、曲率、接地状態の到達性の観点から、基礎となるハミルトン・アンザッツの風景を特徴づける。
モデル階層間で性能が大幅に変化していることが分かり、ランドスケープ構造と密接な関係があることがわかりました。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:42:49 GMT)
SeqAlign3DVG: A Sequence-Aligned Benchmark and Voxel Reasoning Framework for 3D Visual Grounding [15.5] SeqAlign3DVGは、時間順に順序付けされ、厳密な3D画像ベースの視覚的グラウンドティングに特化した新しいベンチマークである。
9,622のシングルビューと14,493のシーケンスサンプルで構成されており、豊富な記述、複雑な関係、複数インスタンスの曖昧さが特徴である。
提案手法は,Deep-freeプロトコルの下での最先端性能を実現し,複雑な関係や外観の手がかりによって定義されるターゲットの局所化を大幅に改善する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:38:29 GMT)
Not All Matches Are Equally Valuable: An Online Experiment of Retention-Focused Recommendation in a Job-Matching Platform [15.4] 実際のジョブマッチングプラットフォームを調査した結果、最近のマッチングがほとんどないユーザの方が、プラットフォームを離れる可能性がずっと高いことが分かりました。
本稿では,ユーザを混乱させないために,ベースラインのマッチングに焦点を絞ったランキングを調整する,シンプルな後処理手法を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:11:02 GMT)
Universal Transformers for Circuit Computations: Perfect Length Generalization in Tiny Transformers [15.4] 我々は,任意の深さや長さの問題を学習し,評価することのできる,確実に正しい変圧器パラメータ化を提案する。
提案手法は,変圧器に埋め込まれた回路モデルとしてアルゴリズムタスクを概念化し,単一の前方通過で深度1回路の低減を可能にする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:42:11 GMT)
Auditing MCQA Benchmarks through Probability Landscapes [15.4] 本稿では,複数の質問応答ベンチマークを監査するための2成分確率的フレームワークを提案する。
ベンチマークレベルの分析では、トップ予測確率を用いて確率景観を特徴付ける。
アイテムレベルの診断では、ノイズ注入を導入し、意味のあるトラクタ競合を減らす。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:28:31 GMT)
ALTSTEER: Selective Safety Steering for Moving Beyond Hard Refusals to Constructive Alternatives [15.4] ALTSTEERは、単一の推論パス内で構成的リダイレクトによる選択的介入を結合する推論時フレームワークである。
Llama-3.1 と Qwen2.5 の評価は、ALTSTEER が建設的セーフコンプリート挙動を改善しつつ良性を維持していることを示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:25:13 GMT)
LLM-Based Knowledge Graph Completion Combining Discrete Structural Coding with Similar Entity Information [15.2] 知識グラフ補完は、テキスト記述と関係構造の両方を使用するモデルを必要とする。
離散構造符号化と類似したエンティティ情報を組み合わせたLCMベースのKGCのためのCoSCを提案する。
FB15k-237の実験では、CoSCはMRRとHits@10の既存のベースラインより優れており、Hits@1.1では競争力を維持している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:39:44 GMT)
Quantum-interference metrology of dissipative Kerr solitons [15.1] 光マイクロ共振器のカーソリトンは、コヒーレント電気通信から精密分光まで、チップスケールの周波数コムを支えている。
ここでは,香港-奥羽-マンデル干渉に基づくマイクロコムソリトンの量子干渉メトロジーを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:30:04 GMT)
MCSeg: Pre-training and Fine-tuning Volumetric Pyramid Transformer for Multi-modal Cardiac Image Segmentation [15.0] マルチモーダル心セグメンテーションに適したボリュームトランスフォーマーネットワークであるMCSegを導入する。
従来のスキップ接続とは異なり、SFPはシングルスケールの3Dビジョントランスフォーマー(ViT)エンコーダとマルチスケールのCNNデコーダを効果的にブリッジする。
MCSegは、CTデータセットのイメージCHD、マルチモーダルデータセットのMM-WHS、MRIデータセットのHVSMR-2.0、MSD Heartにおいて、一貫して11のSOTAメソッドを上回ります。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:27:10 GMT)
CLIN: an Objective Framework for Evaluating Creativity in Short Persian Literary Text [15.0] 大規模言語モデル(LLM)のアウトプットにおける創造性を評価することは、創造性が多次元で人間中心であるため、依然として困難である。
低リソース言語であるペルシャ語における短い文学的文章をLLMがいかに確実に評価するかを検討する。
TTCTによる構造的特性,例えばオリジン性, フルーエンシ, 実験ではアライメントが強いが, より主観的な次元, 特に感情や魅力には弱いことが判明した。
この次元に依存した振る舞いを動機として、構造化された創造性次元をシンプルで解釈可能なプロキシメトリクスで近似できるかどうかを考察する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:22:20 GMT)
Evidence-Bounded Mental Health Reasoning from Heterogeneous Speech Protocols [14.9] 本稿では,プロトコルを意識したエビデンス制御フレームワークであるEvidence Package BenchmarkとEviBoundを紹介する。
EviBoundは5方向の音響コンセンサスを通じてエビデンスツールを編成し、不当な主張を抑えるために境界批評家を強制する。
我々の研究は、より安全なNLP研究のためのエビデンスに一貫性のあるプロトコル対応システムに向けて、制約のない精度を超えて進んでいる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:58:22 GMT)
KORD: Breaking the Key-Generation Bottleneck in Dealerless FSS via Protocol--Hardware Co-Design [14.8] 本稿では, ディーラーレスFSS鍵生成のコストを劇的に削減するプロトコル-ハードウェアの共同設計である KORD を提案する。
KORDは生成プロトコルを再構築し、以前のディーラーレスプロトコルの相互作用を1ラウンドにまとめる。
ルート後分析プロジェクトでは、204MHzで毎秒1275万の32ビットDPFキーを21.5K LUTを使用しており、AESレーンの利用率は99.8%である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:37:01 GMT)
UniDiffFusion: A Unified Diffusion Framework for Multi-Task and Degradation-Robust Image Fusion [14.8] 一般画像融合は、複数のソース画像から補完的な情報を統合することを目的としている。
既存の手法はしばしばタスク固有のモデルに依存し、様々な劣化条件下で堅牢な性能を維持するのに苦労する。
マルチタスクと劣化ロバスト画像融合のための統合拡散フレームワークUniDiffFusionを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:21:51 GMT)
Rethinking the Test-Time Prompt Tuning Objective from the Perspective of Calibration [14.6] テスト時間プロンプトチューニング(TPT)は強力なパラダイムとして登場し、複数の拡張ビュー上でエントロピー最小化(EM)を介して各テストサンプルに対してプロンプトを精製する。
本稿では,従来のEM損失の代替として,クロスエントロピーによる拡張ビューから導出される目標分布と,オリジナルビュー予測を一致させることを提案する。
我々は,信頼度に応じて各拡張ビュー予測に信頼性を考慮した温度スケーリングを適用し,不確かさを和らげつつ,信頼度予測を鋭くする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:33:05 GMT)
CanonNav: Disentangling Navigation Behavior from Camera Geometry in Cross-Platform Visual Navigation [14.6] CanonNavはヴィジュアルナビゲーションフレームワークで、ナビゲーションの振る舞いをカメラの幾何学から切り離す。
クロスプラットフォームのデモから学ぶために、補完的な計画監督が組み込まれている。
RGBベースのベースラインを一貫して上回り、挑戦的なシナリオではRGBベースのメソッドを上回ります。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:52:54 GMT)
Towards a Belief-Based World Model for LLM Agents [14.4] 世界モデルは、政策パフォーマンスを高めるための有望な方法です。
推論中、エージェントは現在、候補アクションの結果をシミュレートするためにワールドモデルを使用しています。
シミュレーションは部分的な可観測性の下での意思決定のための不完全なインターフェースである,と我々は主張する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:48:38 GMT)
VCAR: Training-Free 3DGS Segmentation via View Completeness and Axis-Aware Boundary Refinement [14.4] VCARは、View CompletenessとAxis-awareのバウンダリリファインメントに基づく、トレーニング不要の粗大なセグメンテーション戦略である。
VCARは、トレーニングなしで最先端のセグメンテーション精度と効率を達成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:32:26 GMT)
Pretrained, Curriculum-Tuned, and Ensembled: A Tracer-Aware Interactive Segmentation Pipeline for AutoPET V [14.3] 本稿では,対話型解剖ガイド法によるTRIAGE,Tracer-aware Refinementを提案する。
本稿では,対話型解剖ガイド法によるTRIAGE,Tracer-aware Refinementを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:13:09 GMT)
Data-Centric Neuromotor Interfaces for Portable Human-Machine Interaction [14.3] 本稿では、生理的特徴が基本的な分離性をもたらし、認識に十分な差別的手がかりを提供するデータ中心パラダイムを提案する。
筋特異的電極と統合された様々な電気生理学的信号を収集するために開発された無線高帯域システムは、表面筋電図ベースのインターフェースを形成する。
高度に分離可能なデータを出力すると、94.36%のモデルが34のジェスチャーで精度を達成し、エッジデバイスに迅速に展開できる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:17:46 GMT)
RealSWE: A Compositional Evaluation of Coding Agents under Realistic User Requests [14.3] コーディングエージェントは、GitHubのキュレートされた問題から構築されたSWE-benchベンチマークファミリで一般的に評価されている。
本研究では,6カテゴリの情報分類と4次元の言語スタイルを定義し,実際のユーザプロンプトに適用する。
実際のプロンプトの88%は問題ステートメントしか持たないが、ベンチマークの問題の7%に過ぎないことが判明した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:23:59 GMT)
Converse and Collision-Based Achievability for Node Localization with Hybrid Distance-Spectral Graph Positional Encodings [14.2] 本研究では、アンカー距離プロファイルと量子化低周波ラプラシアエネルギー座標を組み合わせたハイブリッド距離スペクトル符号化法を提案する。
エンコーディングを観測マップとして扱うと、単純なx-refined Converseが得られる。
実験により、ハイブリッドエンコーディングは距離のみのベースラインやスペクトルのみのベースラインよりも構文木幾何を回復することが示されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:08:39 GMT)
BLARM: Animating 3D Objects from Video via Blending Latent Rigid Motion Primitives [14.1] BLARMはビデオに追従する時間的コヒーレントなアニメーションメッシュを予測する。
学習した時間変化のある剛体動き成分のコンパクトな集合を用いてアニメーションを表現する。
BLARMは、モノクロビデオからコンパクトで解釈可能なモーション構造を復元しながら、正確で時間的に安定したアニメーションを生成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:21:54 GMT)
Q-Strata: Hierarchical Bit Allocation for Mixed-Precision Quantization of Mixture-of-Experts LLMs [14.1] 本稿では,ブロック内の割り当てを低コストなプロキシでランク付けし,ブロック間を割り当てるバイレベルアロケータを提案する。
Q-Strataは、一様ビット幅のGPTQや最先端のMoE MPQメソッドよりもWikiText2の難易度が低い。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:39:01 GMT)
DSEffi-Bench: Demystifying Large Language Models' Capability in Efficient Data Science Code Generation [13.9] LLM生成DSコードの実行効率を目標とする最初のベンチマークであるDSEffi-Benchを紹介する。
3層にまたがる16のモデルを評価したところ、正確性だけでは効率を評価できないことがわかった。
人間の分類では、79.1%の効率障害がアルゴリズムの複雑さを超えて拡大している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:59:26 GMT)
Bridge: Automatically Mining Ecosystem-Scale API Update Mappings and Client Update Instances [13.9] APIアップデートマッピングは、自動ライブラリ更新技術の開発と評価に不可欠である。
私たちは、エコシステムスケールのライブラリ更新データセットを自動構築するクライアント駆動フレームワークであるBridgeを紹介します。
Bridgeは、それぞれ2,557ライブラリと999ライブラリにわたる18,900と4,456のAPIアップデートマッピングを表す、381,661 Javaと277,259 Pythonクライアントアップデートインスタンスをマイニングする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:28:08 GMT)
Every Token Leaves a Ripple in the Stream of Thought: Eliciting Model-Internal Token Saliency for Chain-of-Thought Compression [13.7] CoT推論(Chain-of-Thought reasoning)は、多段階の問題解決を改善するが、長い推論トレースは計算コストを増大させる。
トークンの重要性を2つの相補軸に沿って定義するtextscMIST(Token-level CoT 圧縮のためのモデル内部サリエンシ)を提案する。
textscMISTは、ベースラインメソッドよりも一貫して優れており、モデル内部のサリエンシが推論の重要さに効果的なプロキシを提供することを示唆している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:41:14 GMT)
Functional Degeneracy in Neural Networks: Measurement and Pruning [13.6] 我々は行動回復ランクを通して機能的縮退を定量化する。
タスクが飽和した後でも、構造的および刈り上げのマグニチュードがより多くの自由度を維持していることがわかった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:09:19 GMT)
TSPFN: A Temporal Tabular Foundation Model for Physiological Time Series Classification [13.6] TSPFNはTabPFNのアーキテクチャを時系列データに再設計する基礎モデルである。
これは、複数の医療領域にまたがる14万の現実世界の生理的時系列に事前訓練されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:58:22 GMT)
SePArate: Segmenting Patterns from Defects in Wafer Manufacturing Using Weak Supervision [13.6] 弱教師付きウエハ欠陥分割法であるSePArateを提案する。
SePArateは、画像レベルのアノテーションのみを活用することで、パターンのピクセルレベルの分離を可能にする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:07:57 GMT)
Proximity3D: Shape from Capacitive Proximity on Sensing Manifold [13.5] 曲面容量繊維を形状センサとして使用し,その表面を非平面感応多様体として扱う。
本稿では、センサビュー全体にわたってこれらのフィールドを集約し、観測対象の形状を復元する多視点フィードフォワード再構成モデルを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:00:19 GMT)
Do VLMs Share Safety Neurons Across Modalities? [13.4] 視覚言語モデル(VLM)は、バックボーンのLLMがテキストで同じコンテンツを拒否する場合でも、画像を通して配信される有害な要求に従うことができる。
本稿では,自己修復を考慮した反復アブレーションを用いた2段階検出パイプラインを提案する。
視覚的およびテキスト的安全信号の分離を行うViSafe-DetectとViSafe-Evalの2つのモダリティアイソレーションベンチマークを導入する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:17:41 GMT)
Reconciling Process Supervision with Outcome-Based Credit in Agentic Policy Optimization [13.4] 我々は、特権付き監督を成果ベースアクションクレジットに変換するTASPOを紹介する。
3つのエージェントベンチマークで、TASPOはGRPOよりも10.6%改善し、目に見えないタスクを一般化する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:51:50 GMT)
GeoFF3D: Coordinate-Anchored Feed-Forward Reconstruction for Large-Scale UAV Mapping [13.2] 座標アンコールモデルと空間的大規模再構成フレームワーク(SLRF)を組み合わせたGeoFF3Dを提案する。
SLRFは画像を空間的に重なり合うチャンクに分割し、共有ビューの事前を伝播し、局所的な再構築を階層的に集約する。
GeoFF3Dは2000枚の画像を約5分で再構築し、スケーラブルで堅牢な大規模UAV再構成を実証している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:12:34 GMT)
Hi-Q: Hierarchical Evidence-guided Query Refinement for Multi-Hop Question Answering [13.2] Hi-Qは階層的なクエリ改善のためのエビデンス条件付きフレームワークである。
我々は3つのマルチホップ質問回答(QA)ベンチマークでHi-Qを評価する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:55:07 GMT)
Validity-Aware Jailbreak Evaluation for Large Language Models [13.2] 本稿では, 応答を段階的に分解し, 妥当性と正当性の両方を評価する検証中心のジェイルブレイク評価フレームワークを提案する。
SEAVは、セマンティック解釈と、外部知識ソースを用いた検索地上検証を組み合わせる。
その結果,正しさの強制は頑健さを著しく低下させることがわかった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:57:53 GMT)
Uncertainty-Aware End-to-End AI Weather Forecasting: Disentangling Observation and Model Contributions [13.2] エンド・ツー・エンドの天気予報システムは、地球観測から直接、熟練したグローバルグリッドとステーションの天気予報を生成する。
ここでは、観測システムから継承された1つのアレータリック不確実性を各コンポーネントに付加することにより、Aardvark気象モデルを確率予測として表現する。
アンサンブルは中距離でERA5に対して校正され(スプレッドスキル比0.98)、RMSEは決定論的モデルの2.4%に抑えられ、リードタイム毎にCRPSで打ち負かされ、運用中のECMWFアンサンブルを追尾する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:49:00 GMT)
Will the User Ever Know? Covert Indirect Prompt Injection on Tool-Using LLM Agents [13.1] アタック成功率(ASR)は、インジェクションが成功するかどうかをカウントするが、エージェントの最終応答でユーザが気付くものを無視する。
エージェントは通常の応答を返しながらインジェクションを実行するか、最終応答でインジェクションされたアクションを報告する。
ICoAはインジェクションの実行後にエージェントをユーザタスクに戻して隠蔽結果を誘導するIPI攻撃である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:20:45 GMT)
FlowVVTON: Flow-Guided Mask-Free Video Virtual Try-On [13.1] FlowVVTONは、マスク依存を完全に排除するマスクフリーフレームワークである。
2段階のトレーニング戦略は、フロー誘導時間監視を導入する前にマスクのない空間アライメントを確立する。
TikTokDressの実験によると、FlowVVTONはベースラインをかなり上回っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:37:47 GMT)
Higher Structures in Deep Learning [13.0] トレーニングニューラルネットワークにおける高純度現象の実証的研究を行う。
我々は,多層パーセプトロンのハイパーグラフィック的一般化を導入し,進化的アルゴリズムとの関係を探る。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:22:30 GMT)
Towards Cognitive Process-Aware Proactive Writing Support [13.0] 本研究は,認知過程に関連する14種類の記述支援タイプと,各プロセスに関連付けられた特性的相互作用の挙動を同定する。
私たちはこのフレームワークをAToM CoWriterでインスタンス化します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:21:11 GMT)
Quantifying and Mitigating Korean Jamo-Level Typographical Vulnerabilities in Large Language Models [12.9] 韓国では、通常の文字レベルの編集モデルでは捉えられない追加の文字摂動レベルが導入されている。
音節ブロックはジャムと呼ばれるサブキャラクタユニットで内部的に構成されているため、キーボードレベルのエラーは音節内で発生しうる。
この脆弱性を定量化するために、KMMLUベンチマークに5つのジャモレベルの摂動型を適用し、4つの言語モデルを評価する。
本稿では,入力を連鎖推論にルーティングするTypo-Aware Chain-of-Thought (TACoT)を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:28:14 GMT)
SpiderLS: Leveraging Full ZX Reduction for Lattice Surgery Compilation [12.9] 格子手術のコンパイルは、フォールトトレラント量子プログラムを効率的な表面コード実現に変換する上で中心的な役割を果たす。
近年の研究では,ZX-ダイアグラムを格子手術コンパイルの中間表現として利用することの利点が示されている。
我々は、全ZX還元を利用して事前アプローチを拡張したSpiderLSを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:28:07 GMT)
S3C-LLM: Skill-Code Guided Agentic Language Models for Spectrum-to-Structure Elucidation [12.9] 本稿では,S3C-LLMについて紹介する。
分子を直接予測するのではなく、S3C-LLMはモダリティ固有の分光技術を取得し、解析コードを実行して入力スペクトル上でこれらのスキルをインスタンス化し、結果のピークレベルのエビデンスと公式制約をSMILESを生成する前に統合する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:55:32 GMT)
DTD-VAE: Disentangled Temporal Dependencies VAE for Credit Risk Prediction [12.7] 時間依存性変動自動エンコーダ(DTD-VAE)について紹介する。
時間的依存を解消し、過去の顧客の好みと信用リスクに関連する特徴を区別するように設計されている。
ROC-AUCは3.2%-4.86%、精度比は6.41%-9.71%である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 00:01:12 GMT)
CoJEPA: Combining Contrastive Learning and JEPA for Global-Local Music Representations [12.2] JEPA(Joint-Embedding Predictive Architecture)は、潜在空間における自己教師付き予測を通じて、豊かな表現を学習する上で、強力なパフォーマンスを示している。
コントラスト学習は、訓練に安定し、強力なグローバル表現を生み出すが、その目的のグローバルな性質によって局所的なタスクに制限される。
マスクされたシーケンストークンでJEPAオブジェクトと共同でトレーニングされた単一の共有バックボーンと、クラストークンで対照的な目的である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:36:13 GMT)
Parallel Time-Band Mixing with Learned Observation-Adding for Robust ASR Front-Ends [12.1] 並列時間帯ミキサー(PTBM)ブロック上に構築したシーケンス並列帯域分割拡張フロントエンドを提案する。
PTBMは、バンド内時間混合とフレーム単位のクロスバンドアテンションを統一並列アーキテクチャに統合する。
凍結したWhisperバックエンドを用いたDNSチャレンジとCHiME-4の実験は、提案するフロントエンドが繰り返し発生する帯域分割ベースラインと比較して単語エラー率を一貫して減少させることを示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:43:17 GMT)
Rotational Equivariance in Machine Learning: A Comprehensive Tutorial [12.1] 回転対称性は3次元データにおける機械学習における最も重要な構造原理の1つである。
このチュートリアルは回転同値に関する包括的紹介を提供する。
ユークリッドグラフ、群作用と表現、球面調和、ウィグナー行列、テンソル積、クレブシュ・ゴルダン分解にメッセージパッシングを導入する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:21:31 GMT)
FaVOR: LLM-Based Agentic Framework for Factor Mining via Empirical Validation [12.0] 仮説レベルのエビデンスを取り巻く要素を再構成するエージェントフレームワークであるFaVORを提案する。
FaVORは、仮説に基づく因子発見が、建設、体制破壊、経済的に忠実な信号を生み出すことを示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:16:06 GMT)
Beneath the Diff: Diagnosing and Mitigating Algorithmic Mode Collapse in Code-Level Autonomous Research Loops [12.0] 我々は、反復的なメトリック駆動のコード編集が、ループを超えて一般化する真の改善をもたらすことを示す。
本稿では,カテゴリ被覆再重み付け,永続的な編集メモリ,検証ゲートを組み合わせた軽量化を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:11:19 GMT)
SegWave: Wavelet-Driven Segmentation of Tampered Regions [11.8] SegWaveは、空間領域と周波数領域のキューを併用して画像改ざん検出を行うハイブリッドフレームワークである。
SegWaveは、トランスフォーマーベースのアーキテクチャとディスクレットウェーブレット変換(DWT)を統合し、局所化されたマルチスケールの周波数不整合を演算の指標として捉えている。
複数のベンチマークデータセットの実験では、SegWaveは最先端のタンパリング検出方法よりも一貫して優れていることが示されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:54:11 GMT)
Frequency-aware forecasting for short-term typhoon gust prediction [11.8] WDANetは、定常ウェーブレット分解、特徴量線形変調戦略、デュアルブランチエンコーダデコーダアーキテクチャを統合した周波数対応予測フレームワークである。
WDANetは、24時間予測の地平線を越えて実験的な設定下において、短いリードタイムの利点を示す。
極端な風のイベントの間、WDANetはガストピークをより正確に捉え、最高のRMSEおよびMAE性能を得る。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:47:32 GMT)
Learning What to Retain: Gated-Memory Routing for Efficient Collaboration in Multi-Agent LLM Systems [11.8] 大規模言語モデル(LLM)ベースのマルチエージェントシステムは、複数のエージェントがどのように構成され、どのように協調するかをオーケストレーションすることによって、複雑な推論に取り組む。
本稿では,クエリと学習した実行メモリに関する各決定を条件に,Gated-Memory Routingを提案する。
最も高いベースラインを2.44ポイント越え、HumanEval推論コストを31.9%削減した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:42:57 GMT)
DELE-w0.5: Inferring Action from Future Latent State for Robotic Manipulation [11.7] 我々は、ビデオ生成がワールドアクションモデリングの不要な目的であると主張している。
ロボット操作においては、世界モデルの目的は、中間の瞬間に世界がどのように見えるかを再現するのではなく、アクションの実行後に世界が到達する状態を予測することである。
本稿では,映像生成に頼らずに将来予測状態からロボット動作を推定するDELE-w0.5を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:42:58 GMT)
ExecRubrics: Executable Tool-Augmented Rubrics for Verifiable and Efficient Long-Form Evaluation [11.6] 本稿では,ルーブリックをコンパクトな実行可能プログラムとして表現するフレームワークであるExecRubricsを提案する。
ExecRubricsは評価ロジックを検証可能なPythonスコアリング関数としてエンコードし、自然言語のルーリックインテントを操作意味論として提供する。
提案手法は,ブラックボックス・ルーリック・エバルに代わる,より高速で説明しやすい,曖昧な代替手段を提供することにより,新しい自動評価手法を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:54:03 GMT)
OreProof: Verifiable Provenance with Limited Disclosure for Critical-Minerals Supply Chains Using Zero-Knowledge Proofs [11.6] OreProofは、臨界ミネラルサプライチェーンのためのプロトタイプトレーサビリティプラットフォームである。
ハイブリッドオンチェーン/オフチェーンデータモデル、選択的な開示のためのGroth16ゼロ知識証明、Merkleバッチのアンカーパイプライン、UNTP準拠の検証証明を組み合わせたものだ。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:34:45 GMT)
Cost-efficient Active Learning for Referring Image Segmentation and Grounding [11.4] 地域アノテーションとともに自然言語参照表現を収集する問題に対処する。
本稿では,モデルの信頼性が単一領域に崩壊するか,複数の候補に分散するかを計測する新たな獲得機能であるReferred Region Ambiguityを紹介する。
私たちのフレームワークは、いくつかのALベースラインを一貫して上回り、ユーザスタディでは、最大1.6倍の高速な記述ラベリングを実現しています。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:29:28 GMT)
SpectraTac: A Compact Camera-Free Optical Tactile Sensor with Distributed Color Sensing [11.3] SpectraTacは、アクティブな赤緑色(RGB)照明と空間分布カラーセンシングを組み合わせた、カメラなしの光学触覚センサである。
この装置は直径19.2mm、高さ4mmであり、材料コストはUSD5以下である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:25:51 GMT)
Lucida: Parse, Generate, and Place for Composable Real-to-Sim Scene Modeling [11.3] 構成可能なシーンモデリングは、実際の屋内シーンを、観察されたように配置された完全な編集可能なオブジェクトアセットとして復元することを目的としている。
Luciaはビデオをシーングラフに解析し、ノードはインスタンスごとのマルチビューのエビデンスを持っている。
Luciaは、マルチターンGUIインタラクションとして配置するVLMポリシーであるGizmoActで資産を配置する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:03:20 GMT)
Error-Type-Aware Loss Reweighting for Robust Named Entity Recognition with Noisy LLM Labels [11.3] 名前付きエンティティ認識のための誤り型認識損失再重み付けを提案する。
我々のアプローチは単純で効率的であり、追加のトレーニングリソースを必要としない。Wikigoldのノイズレベルが最大4.6ポイントで、データセットレベルのノイズレベルが15%から40%である場合、F1を0.8~2.0ポイント改善する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:05:08 GMT)
Learning-Assisted Congestion-Aware Route Scheduling for Semiconductor Fab Material Control Systems [11.3] 本稿ではTN-DCR(Transport-network-aware dynamic congestion representation)を提案する。
TN-DCRは、構造経路先行、マルチウィンドウネットワーク全体の混雑状況、経路レベルのボトルネック露光、誘導グラフ対応経路埋め込みを組み合わせる。
制御されたクローズドループ評価では、平均納期は16.4%減少し、内部リソース待ち時間は22.6%減少するが、スループットは基本的に変化しない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:53:20 GMT)
Group Adaptive Clipping Policy Optimization [11.2] 検証可能な報酬を伴う強化学習のためのグループ相対的政策最適化は、すべてのロールアウトに対して、固定重要サンプリング(IS)比クリッピング境界を用いる。
GAPO(Group Adaptive Clipping Policy Optimization)は、GRPOメソッドのプラグイン修正であり、クリッピング境界をロールアウトの利点に適応させる。
GAPOは報酬形成を必要とせず、クリッピング閾値のみを適用しながら標準のPPO/GSPOサロゲートを保持する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:32:32 GMT)
MRMAD: A Multi-Round Multi-Audio Benchmark for Evaluating Acoustic Degradation Perception in Large Audio-Language Models [11.1] 大規模音声言語モデル(LALM)における音声劣化知覚と理解のベンチマークであるMRMADを導入する。
MRMADは音声、音楽、音声にまたがり、複数の音声入力の多ターン対話としての評価を行う。
現在のモデルは、劣化を確実に診断、比較、または理由付けを怠りながら、粗い内容を認識することが多い。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:51:41 GMT)
Deploying and Evaluating a Smart-Agriculture Agentic Engine for Full-Season Soybean Farm Operations [11.1] 本稿では,ハルビン工科大学スマート・アグリカルチャー・サイトにおけるオペレーティングダイズ研究農場におけるフルタイム農業エージェントシステムであるFAIRYについて述べる。
フェアリーは、準備、植林、灌水、施肥、害虫と病気の治療、収穫、穀物処理、乾燥、空間記録にまたがるフルシーズンの尾根でのエージェント操作を実行し、評価する。
我々はFAIRYを用いて,大豆100シーズンにおける9つの最先端エージェントコントローラの評価を行った。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:53:17 GMT)
Motion-Saliency Complementary Masked Modeling for Point Cloud Video Understanding [11.0] MoSaiCは、セルフ教師付きポイントクラウドビデオ表現学習のための新しいMotion-Saliency Complementary masked Modelingフレームワークである。
MoSaiCには、CMSM(Curriculum Motion-Saliency Masking)、NFM(Normal-Flow Motion)モデリング、C TCP(Cross-view Token Consistency Prediction)の3つのコンポーネントがある。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:48:33 GMT)
VisER: Visual Evidence and Reliance for Object Hallucination Detection in LVLMs [10.9] 対象レベルの幻覚検出のためのトレーニング不要な指標であるVisERを提案する。
ビジュアルエビデンス(Visual Evidence)は、オブジェクトとコンテキストの互換性が画像トークンからのオブジェクト固有のエビデンスによって裏付けられているかどうかを測定する。
Visual Relianceは、生成されたプレフィックスよりもイメージによってオブジェクトがサポートされているかどうかを測定する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:05:22 GMT)
Beyond Surface Forms: Symbolic Edits as a Test for Logical Reasoning with LLMs [10.8] 本稿では、論理的推論問題に対して、制御されたラベル保存編集を生成するためのツール駆動フレームワークを提案する。
これらの変化に対応して,様々な大規模言語モデル(LLM)を累積および個別の演算子によって編集し,その振る舞いを解析する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:06:01 GMT)
It's a matter of timescale: non-linear utility in successor features and multi-objective planning and learning [10.8] 多目的RL(SERとESR)における現在の主要なアプローチは不十分である。
それぞれのアプローチは、異なるタイムスケールにおけるユーザーユーティリティに対する非線形効果を扱いますが、異なるタイムスケールで異なる効果が同じ決定問題の中で起こり得ることを考慮してはいません。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:09:23 GMT)
LLM-as-a-Demographic: Whom Sociodemographic Prompting Helps, and Whom It Hurts [10.7] ソシオドモグラフィーは、アノテータの人口統計上の判断を対応するグループの判断に合わせるために、裁判官にアノテータの人口統計プロファイルを指示する。
3つの主観的課題に対する23個のオープンウェイトLDMのラベル分布を実アノテータ群と比較した。
まず第一に、人口統計のない裁判官は、視点中立ではない:モデルは、大学教育を受けた注釈学者であるホワイトの判断を最もよく再現する。
第二に、人口動態の条件付けは非対称であり、裁判官を多数派へと移動させ、少数派から遠ざかる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:33:15 GMT)
Learning to infer and manipulate through distributed whole-arm interaction in a soft robot [10.6] ゾウやタコのような動物では、物体に関する非視覚的な情報を取得し、それと物理的に関わることは不可分なプロセスである。
本稿では,タスク関連情報を共同で公開し,操作動作を整理する物理インテリジェンスフレームワークを提案する。
これを可能にする重要な革新は、(i)広いワークスペース探索の基準を提供する事前訓練された探索政策、(ii)単一のリカレントポリシー内での探索と把握を統合した共同最適化、(iii)観察マッピングと政策微調整を含む2段階のsim-to-real適応である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:35:00 GMT)
Efficient and High-Quality Depth Estimation via Pixel-Space Diffusion with Linear Attention [10.6] ラピス(Lapis)は、1段階拡散による効率的かつ高忠実な深さ推定を実現する生成フレームワークである。
粗い階層構造によってこれらの制限を修正します。
最新のSOTA(State-of-the-art)の精度と境界シャープネスを様々な解像度で一貫して達成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:27:50 GMT)
Elite-Weighted Supervised Fine-tuning for Goal-Directed Molecular Optimization [10.5] Elite-Weighted Supervised Fine-tuning (EW-SFT)は、高色分子のエリート選択を誘導するために報酬を使用する。
EW-SFTは、対応するネイティブキナーゼ基準化合物よりも一貫して優れている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:10:51 GMT)
What Survives the Next Model? Benchmarking LLM-Based Techniques Against Single-Prompts [10.5] ICSE 2026から35のLarge Language Models (LLMs) に基づく技術論文を分析した。
我々は、それらの複雑なツールが、最も単純な代替手段である、単一の自動生成プロンプトによって、より優れているかどうかを評価する。
コード生成や修復のような建設的なテクニックは、単一プロンプトによる置換に適していると考えています。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:16:57 GMT)
NoisEasier: Test-Time Noise Optimization for Text-to-Video Generation [10.5] 拡散モデルは最近、テキスト・ツー・ビデオ(T2V)の生成が進んでいるが、それでも細かな構成アライメントに苦慮している。
ノイズ最適化によるT2V生成を改善するテスト時間スケーリングフレームワークであるNoisEasierを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:17:52 GMT)
Not All Agreement Counts as Corroboration: Provenance-Conserving Multi-View Fusion for Typed Action Admission in Human-Robot Collaboration [10.3] PACTはエビデンスカウンタビリティを、前立腺保存核融合とタイプドアクションエントリーのためのリレーショナル変数として扱う。
48のシーンクラスタで31,200以上の評価を行い、PACTは0.0861の共通支持型正規化リスクカバーエリア(ncsAURC)を達成した。
完全なソースレコードでは、ネイティブスコアはPACTを好むが、共通の後点スコアはネストしたディリクレとの違いを狭め、製品融合を好む。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:21:35 GMT)
Uncovering and Mitigating Aggregation-Induced Reward Hacking in Multi-Reward Reinforcement Learning [10.3] Adaptive Multi-Reward Projection (AMRP) は、3つの信号、相対的不足、報酬のボラティリティ、最近の進歩を用いて集約重みを再配置する軽量なオンライン手法である。
AMRPは、固定および動的重み付けベースラインに対する報奨バランスとダウンストリームパフォーマンスを一貫して改善する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:24:22 GMT)
DIASENTINEL: An Auditable Multi-Agent System for Guideline-Grounded Diabetes Risk Screening [10.2] 大規模言語モデル(LLM)は、有望な臨床的決定支援を提供するが、幻覚的な事実、推奨された推奨、引用エラーに弱いままである。
本報告では,1年2型糖尿病リスクスクリーニングとガイドライン接地レポート生成のための,完全にオンプレミスのマルチエージェントシステムであるDIASENTINELについて述べる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:40:43 GMT)
Mind the Gap: Theory-of-Mind-Grounded Friction for Epistemic Alignment [10.1] 我々は,Frictive Policy Optimization における制御信号として,理論・オブ・ミンド(ToM)推論を運用する。
表現レベルでは、2階のチャンネルを非難することで、誤解のリコールが65%$から26%$に削減される。
政策レベルでは、報酬形成(FAR)と信頼領域(FTR)の変種は介入F1とDPOに対する保証コンテキスト校正を改善している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:57:29 GMT)
CompanionSim: Synthetic Data for Evaluating Anthropomorphism in Human-AI Relationships [10.0] 今や多くの人がAIシステムを生産性ツールだけでなく、ソーシャルコンパニオンと見なしている。
シミュレーションフレームワークCompanionSimをリリースした。
驚いたことに、コンパニオンシップの行動によって、AIチャットボットに対する自由度、人間らしく、信頼度が低下することがわかりました。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:51:47 GMT)
Performative Privacy: When Differential Privacy Maximizes Utility [10.0] データ漏洩が将来の参加を減少させる、パフォーマンスプライバシを導入します。
有限のプライバシー予算が、長期にわたって非私的推定を上回っていることが示される。
これは、差分プライバシーが保護機構としてだけでなく、長期的なユーティリティの観点からも最適であることを示す最初の証拠となる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:21:08 GMT)
Autoresearch for Marketplace Catalogs: From Legacy Forms to AI-Native Matching [9.9] 両面のサービスマーケットプレースは、決定論的リクエストフォームの取り込みから、AIネイティブな確率的マッチングへと移行している。
固定形フィールドよりも推論意図に頼れば、これらのプラットフォームはプロバイダ側の選好分類を再生せざるを得ない。
我々は、この分類を一度に生成する自動検索ループを提示し、2026年4月から米国の大手消費者サービス市場において、132の職業にまたがって生産されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:18:07 GMT)
OPUS: A Simple yet Effective Unified Framework for Open-Vocabulary Detection [9.9] 本稿では,テキスト,インタラクティブ視覚,ジェネリックビジュアル,混合プロンプトをサポートする統一型検出器OPUSについて述べる。
OPUSは最先端のVisual-I性能を実現し、68.1/69.2/54.7 APに到達し、バランスの取れたテキストとVisual-Gの精度を維持した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:57:12 GMT)
QTEA: Ternary LLMs with Sparse Residual Salient Weight and By-Column Optimization [9.8] 3次値に重みを量子化し,残差補償器として正重みを用いるサブ2ビットPTQフレームワークQTEAを提案する。
Qwen3-14Bでは、QTEAは全ての重量を1重量あたり1.7ビットに圧縮し、最強の3次PTQベースラインの平均精度を16.7%向上させた。
またWikiTextとC4では、それぞれ1.40(times)と2.61(times)の低いパープレキシティを実現している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:33:36 GMT)
The Safety Relay in Roleplay Jailbreaks: A Component-Resolved Causal Analysis of Harm Recognition and Refusal [9.7] 危害の証拠が残されているにもかかわらず、ロールプレイがコンプライアンスをいかに生み出すかを示す。
我々は、危険認識から拒絶への接続の維持という、将来の安全を守るための具体的な目標を特定した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:03:49 GMT)
TrainSDC: Characterizing and Mitigating Silent Data Corruption in Large Language Model Training [9.6] 本稿では,Transformer トレーニングにおいて,主要な計算インタフェースにまたがるサイレントデータ破損(SDC)の脆弱性を初めて体系的に評価する。
そこで本研究では,Q/Kパス再計算,残差ゲイン監視,指数認識勾配スケーリングからなる評価誘導型保護フレームワークTrainSDCを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:33:26 GMT)
Strong Drafts Need Compact Memories: Long-Context Speculative Decoding with Compressed KV Cache [9.6] 長文文書要約アプリケーションは、数万のトークンにまたがるプレフィックスから生成する必要がある。
投機的復号(SD)は、モデル出力を変更することなくレイテンシを低減するが、そのスピードアップは受け入れられたドラフトトークンとドラフトステップの遅延の両方に依存する。
長文SDのためのメモリ拡張ドラフトを導入し、圧縮されたドラフトサイドKVメモリを備えた強力な独立したドラフトを実装した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:03:30 GMT)
Certified Safety Radii in Forecast-Error Space for Wasserstein Distributionally Robust Small Signal Stability-Constrained AC Optimal Power Flow via Lifted Spectrahedral Containment [9.6] 我々は、交流最適潮流における小信号安定性を強固にするための代替的幾何を利用する。
我々は、元の不確実性空間および持ち上げ空間においてサンプルワイド安全な半径を認証し、対応する不確実性球のパワーフロー画像全体が凸安定領域に含まれることを確認した。
結果の変数は、経験的なサンプルから失敗までの距離の下位境界として認定され、したがってワッサーシュタイン分布制約の距離に基づく再構成に直接結合することができる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:32:04 GMT)
Beyond Token-Level Guidance: Inference-Time Alignment of Specialized LLMs via Cross-Family Representation Steering [9.4] 推論時メソッドは、ドメイン能力を損なうことなく安全性を確実に改善することができない。
我々は,任意の家族の誘導モデルから抽出された安全方向を用いて,ベースモデル隠れ表現を操る推論時アライメント手法であるCRESTを提案する。
CRESTは、ドメイン固有の機能と、すでに整合したモデルの安全性を保ちながら、特殊化が弱まった安全を改善します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:34:58 GMT)
Developer Attitudes and Practices Towards Optimizing Software Energy Consumption [9.4] エネルギー消費は少数のプロジェクトにおいて明確に考慮されている。
より一般的に、開発者は実行時間やCPU利用などのプロキシプロパティを最適化することで、間接的にエネルギー使用に影響を与える。
採用の大きな障壁として、組織的不関心、限られたツール、教育的ギャップがあげられます。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:57:36 GMT)
Timing-Aware Repurchase Prediction for Web-Scale E-Commerce: Survival Models for Multi-Surface Grocery Recommendation [9.3] 電子商取引における買い戻し推奨者は、一般的に「この顧客がこの商品をW日以内に購入するのか」という二分質問として扱われる。
私たちは、このスタックを、直接購入する時間を予測するサバイバルモデルに置き換え、主要な食料品のEコマースプラットフォームから何百万もの顧客に対して評価します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:50:07 GMT)
SatDL: Jointly Optimizing Data Redistribution and Training for Satellite-Based Distributed Learning [9.3] 衛星ベースの分散学習は、大規模なグローバル分散センサーデータを使用して、機械学習モデルを軌道上で直接訓練することを約束する。
トレーニング収束は、厳密な非IIDデータ、特にラベルの不均衡によって著しく遅くなる。
エンドツーエンドの学習時間を最小化するために設計されたデータ再分散フレームワークであるSatDLを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:40:24 GMT)
MusGU+: Toward a Musician-Centered Evaluation Framework and Discovery Tool for Generative Music AI [9.2] ジェネレーティブ・ミュージック・システムは、音楽制作を民主化するツールとしてますます提示されているが、音楽家にとっての実用性はまだ未熟である。
適応性,ユーザビリティ,制御性という3つの側面から構成されたミュージシャン中心の評価フレームワークであるMusGU+を紹介する。
10の代表的な生成音楽システムを評価し,これらの基準に従ってミュージシャンがモデルを探索・フィルタリングできるインタラクティブな発見ツールを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:12:51 GMT)
Accelerating Chemical Kinetics for Exoplanet Atmospheres using Neural Networks [9.1] 本研究では,太陽系外惑星大気に対する局所箱型ケミカル・キネティクス・ソルバについて述べる。
この代理モデルは古典的解法よりも数桁高速であることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:06:22 GMT)
MELON: A Large-Scale Dataset for Multi-Event Text-to-Long-Video Retrieval [9.1] 既存のテキストビデオ検索データセットは、主に1つの支配的なイベントを含むショートフォームのクリップで構成されている。
我々は,テキストビデオ検索を,複雑なマルチイベント構造を持つ長編ビデオに拡張するために設計された,最初の大規模データセットであるMELONを紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:20:35 GMT)
Hidden Threat in Synthetic Data: Covert Targeted Bias Injection through Benign Text [9.1] 本研究では,社会的バイアスを意味論的に良質な合成データを通じて,整列モデルに注入できるかどうかを検討する。
実験では、良質な合成データが標的バイアスを伝達するための隠蔽チャネルとして機能することが示された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:28:36 GMT)
Why Are LLM Backdoor Defenses Fragmented? A Feature-Level Explanation with Sparse Autoencoders [9.0] スパースオートエンコーダ (SAE) を用いた大規模言語モデル (LLM) バックドアの系統的特徴レベル力学解析について述べる。
高コントリビュートなSAE特徴にバックドアによるロジットシフトを辿り、それらを4つの役割(interac?tion, suppressed, mixed, weight-modified feature)に分類した。
これらの結果から,SAE分析は防御の断片化を説明できることが明らかとなった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:55:42 GMT)
Context Inference Attacks Without Jailbreaks [9.0] セキュリティゲームを通じて,Emphcontext-inference攻撃を導入,形式化する。
我々は、攻撃者の知識を減らし、既知のコンテキスト、未知のコンテキスト、エージェントが自身のツールコールを通じて取得するコンテキストの3つの設定を評価する。
1回の攻撃は3つの設定を全て変更せずに行う。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:53:52 GMT)
TDDM-Melatt: A Decoupled Memory and Diffusion Framework for Generalizable Encrypted Traffic Classification [9.0] 本稿では,拡散型データ拡張を用いたメモリベーストラフィック分類フレームワークを提案する。
我々は,エンコーダとデコーダを構築するためにCG-LSTM(Competitive Gating Long Short-Term Memory)を用いたメモリ分離トラフィック表現モデルであるMelattを設計する。
厳密なフローレベルの分割と匿名化の下で、TDDM-Melattは6つの基本的な分類モデルと6つのSOTA表現学習モデルより優れています。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:11:52 GMT)
A Model with No Head and Many Thoughts [8.9] 本稿では,軽量プロジェクタによる推論において,LMヘッドを置き換える手法であるSoft Latent Thinkingを紹介する。
我々は、Soft Latent Thinkingがすべてのkでpass@kを一貫して改善し、チェーンオブソート中のステップ毎の計算を削減していることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:45:41 GMT)
Unmasking Face Embeddings: Reading, Rendering and Naming with Foundation Models [8.9] モデル間の互換性の組込みに関する最近の研究に基づいて、簡単な計算済みの線形変換を用いてFRモデルと既製の基礎モデルとを接続する。
この相互運用性は、顔の埋め込みを意味的および視覚的にリッチなバイオメトリック表現として公開し、解釈可能性、検索、再構築、テンプレートセキュリティに影響を及ぼす。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:46:54 GMT)
Rethinking Language's Role in Efficient VLA for Autonomous Vehicles: Toward Smarter, Trustworthy Driving [8.9] Vision-Language-Action(VLA)モデルが自動走行(AD)を改造
レイテンシとメモリの予算は厳しく、自動回帰デコーディングは本質的にシーケンシャルです。
この作業は、トレーニングコストが1回だけ支払われる間に、デプロイされたフレーム毎に推論コストが再帰するため、言語がいつ、いつ、どこで振る舞うべきかという中心的な疑問を再考する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:51:51 GMT)
Compact and Infinite-Order Error Analysis for Null-Space SVD Estimation [8.8] 雑音行列からのNull-space推定について検討する。
トレーニング中の個々に順序付けられたヌル方向 (geq m) に対して、ウィッシュアート分割行列 (W) が厳密な二階経験的ランクを与えることを証明する。
不平等なスパイクについては、正確な人口オーバーラップ基準とモンテカルロの信頼性証明書(99%)が観察された中間ランクを説明する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:30:48 GMT)
Ouroboros: Self-Referential Backdoor Attacks on Speech Enhancement via Clean Audio Triggers [8.8] Ouroborosは、音声強調モデルの理想的なクリーンアウトプットを自然なトリガーとして活用する、新しいバックドアアタックフレームワークである。
Ouroborosは、パフォーマンスの低下を最小限に抑えながら、未修正のほぼ完璧な攻撃成功率を達成する。
オーロボロは、標的となるコンテンツ改ざん攻撃を一般化し、一般的なフィルタリングや微調整の防御に対して効果を保っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:46:41 GMT)
Stratified Consistency Distillation for Natural Language Formalization [8.7] そこで我々は,論理翻訳の精度を向上させるために,微調整に基づくStratified Consistency Distillation手法を提案する。
実験の結果,Pass@KとEquivalent Logical similarityの両指標で有意かつ一貫した改善が得られた。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:08:08 GMT)
Geometry-aware Latent Autoregressive Generative Model for PDEs in Complex Domains [8.6] 極めて不規則かつ厳密な構造の中で物理を解くために,PDE(GeoLAMP)のための幾何対応潜在自己回帰生成モデルを提案する。
潜在空間において,フローマッチングを用いた因果自己アテンション変換器を提案し,時間的ダイナミクスをモデル化する。
フレキシブルデコーダは任意の点上の高分解能物理場を再構成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:42:37 GMT)
Beyond Ranking Accuracy: Evaluating LLM-Cited Feature Rationales for Next Basket Repurchase Recommendation [8.4] 大型言語モデル(LLM)は、特徴に基づく人間可読理性を通じて、そのような証拠を提示する潜在的方法を提供する。
我々は,リズム,頻度,傾向,ユーザ行動,アイテムの人気にまたがる再購入機能を構築した。
クロスモデル特徴マスキングプロトコルを用いて, LLM に係わる特徴とモデル固有属性法を比較した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:48:32 GMT)
PRACTICE: From Experience to Expertise in Self-Evolving Embodied Agents [8.4] 我々は,過去のインタラクションの軌跡から永続的なスキルライブラリを発見し,維持するために,スキル学習者を訓練する。
そこで,本研究では,オンライン・スキル・エグゼクティブ・蒸留を用いて,学習者と教師の連携を図る。
実験では、コンパクトなスキル学習者が、連続したライブラリ更新ラウンドで一貫したパフォーマンス向上を提供することを示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:26:16 GMT)
Provably Efficient Federated Reinforcement Learning with Linear Function Approximation and Logarithmic Communication Cost [8.4] 本稿では,線形関数近似を用いたオンライン強化学習のためのフェデレーションアルゴリズムであるFed-LSVIを提案する。
Fed-LSVI が $widetildemathcal O(sqrtMd3H4T)$,$d$ is the feature dimension, $H$ is the horizon length, $M$ is the number of agent, $T$ is the number of episodes per agent。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:11:54 GMT)
PropUQ-MAS: Propagation-Aware Uncertainty Quantification for LLM Multi-Agent Systems [8.3] PropUQ-MASはマルチエージェントシステムのためのエラー伝搬対応UQフレームワークである。
上流メッセージから受け継いだローカル不確実性と不確実性を組み合わせることで、各ステップの信頼性を推定する。
PropUQ-MASはMASのUQを継続的に改善し、平均相対利得はAUROCで+6.10%、PRRで+47.58%である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:14:07 GMT)
SURE-Challenge: Evaluating Speech Evidence Before Speech-LLM Generation [8.3] 音声非サポート型リジェクション評価チャレンジ(SURE-Challenge)について
このベンチマークは、LibriSpeech由来の書き起こしと第一単語の質問応答を無音、色付きノイズ、合成トーン、ソース曖昧なバブルと組み合わせている。
リーク画面付き474例のSURE-Challengeテストセットでは、Qwen2-Audioは15/204の入力を拒否する一方、固定ルールは196/204を拒否し、サポートされた精度は変わらない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:31:55 GMT)
Auditing Generative Audio Calls for Known-Task Audio-LLM Evaluation [8.3] 既知のクローズドセットタスクでは、音響的エビデンスへのアクセスと、生成的オーディオモデルを呼び出す必要性が重要である。
我々はこの区別を制御された呼判断問題として評価する。
既知のタスクエンドポイントのクレームに対して、関連する量は、転写とエンコーダの証拠が既に使われている後の生成呼び出しの限界値である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:27:04 GMT)
TopGQ: Fast GNN Post-Training Quantization Leveraging Topology Information [8.3] TopGQは、トレーニング後のGNN量子化フレームワークである。
本研究では、外次元と内次元の両方に沿って活性化量子化を可能にする2軸スケール吸収法を提案する。
また、ノードの局所構造のプロキシであるTopPINを導入し、量子化時に類似したトポロジを持つノードをグループ化する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:49:03 GMT)
Towards Stream Learning on Embedded Systems: Benchmarking the Memory Consumption of Stream Learning Methods [8.2] 最先端のストリーム学習では,概念適応に強く焦点をあてる一方で,資源利用は副産物として評価されることが多い。
モデルサイズ予算が128から約8MiBの13個の実ストリームおよび合成ストリームに対して,7つの代表的なストリーム分類器をベンチマークした。
その結果、2つの異なるリソース障害モードが明らかになった。アダプティブアンサンブルは、初期フットプリントが安定していても、ほとんど即座に小さな予算を超えることができる。
明示的なコンパクトな手法は、最小の予算の下で唯一実行可能な選択肢であるが、より大きな予算が適応的なアンサンブルを競争力のあるものにするため、通常は追い越される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:01:31 GMT)
TRIPPULSE: Multi-Agent Travel Planning with Review-Grounded Reasoning [8.2] レビューグラウンドトラベルプランニングのためのマルチエージェントフレームワークであるTRIPPULSEを提案する。
我々は,100K以上の実世界レビューでTRIPCRAFTを増強し,人間中心の旅行体験との整合性を評価するためのLCM-as-a-Judge尺度であるReview-Grounded Per-Sona Alignment (RGPA)を導入した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:02:37 GMT)
CIG-RL: Curiosity-Driven Information-Guided Reinforcement Learning for Source Term Estimation in Uncertain Environments [8.1] ソース項推定(STE)は、ガス源の重要な特性を推定することを目的としている。
深層強化学習(DRL)はその高速な意思決定能力で有望な代替手段を提供する。
我々は,好奇心駆動型情報誘導型強化学習を,堅牢で効率的なSTEのために提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:13:55 GMT)
LLM-Driven Autonomous Vehicles Inherit Human Driver Biases in Pedestrian Yielding: Results and Implications From A New Benchmark [8.1] 自律走行車(AV)に対する公的な信頼は、技術的成功だけでなく、意思決定の公平性にも依存する。
AV研究の最近の傾向は、一般的な目的の「常識」モデルを用いてAV意思決定を導くことである。
モデルバイアスの分析もAV評価の一部であるべきだと論じる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:11:49 GMT)
CoMPASS: Collaborative Molecular Property Prediction via Adaptive Small-Large Model Synergy [8.0] 正確な分子特性予測には、統計的信頼性と化学的推論の両方が必要である。
CoMPASSは、小型モデルコラボレーションのための検索校正フレームワークである。
その結果, 生成的推論は, 根拠的, 制御された補正によって, 校正予測を増強すべきであることが示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:14:01 GMT)
Deriving Scaling Laws for OpenEuroLLM Models: Learning Rate, Batch Size and Loss [8.0] 本研究では,英語対応コーパス上での高密度大言語モデルの学習速度とバッチサイズのスケーリング挙動について検討した。
我々はこれらの関係を捉えたモデルを開発する。
本研究は,OpenEuroLLMモデル開発のための第1のベースラインとスケーリング手順を確立する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:44:10 GMT)
A Universal Context-Reuse Layer for Cross-Model KV Sharing [7.9] 我々は、ソースモデルによって生成されたKV状態を異なるターゲットモデルによって消費される表現に変換するエンフクロスモデルKV共有について検討する。
Qwen2.5-7B$rightarrow$ Qwen2.5-1.5Bの場合、翻訳されたKV状態はLongBench2の精度を27.59%から34.48%に改善し、ネイティブ1.5Bベースラインよりも6.89ポイント向上した。
クロスファミリーQwen2.5-1.5B$rightarrow$ Gemma-2-2B設定の場合、KVハンドオフは目標側のプリフィルコストを削減します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:28:17 GMT)
Context Staircase: Signature-Aligned Dynamics of Token Embeddings under Small Initialization [7.9] トークン埋め込みは、言語モデルにおける離散トークンと連続計算を接続する基本的な表現単位である。
進化する埋め込み構造は,トークン条件付きラベルや文脈分布と密接に関連している。
これらの埋め込み構造は、タスク学習とセマンティック構造を組込み空間に組み込むことの両方において重要な役割を担っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:33:09 GMT)
A Simple Transformer Pipeline for Full-Key Side-Channel Attacks on Uncropped Datasets [7.9] ディープラーニングに基づくサイドチャネル分析は、これまではシングルバイトのターゲットと手作業によるトレースに重点を置いてきた。
本稿では,標準的なトランスフォーマーエンコーダのバックボーンを用いたアンクロッピングフルキー攻撃のためのオープンソースのトランスフォーマー実装を提案する。
我々は,以前報告した結果と競合する性能を実現するために,未収録のASCADv1f,ASCADv1r,CHES-CTF-2018の実装,トレーニングレシピ,事前訓練したウェイトをリリースする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 00:40:45 GMT)
PAC: Progress-Augmented Advantage Curriculum for Multi-Task Reinforcement Learning of LLMs [7.9] LLMのマルチタスク強化学習のための進歩的アドバンテージカリキュラムを提案する。
これは、タスクが引き起こせるポリシー更新の規模を計測する利点に基づく学習性と、それらの更新がタスクのパフォーマンスを改善したかどうかを示す最近の報酬ゲインの2つのタスクレベル信号を組み合わせる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:59:07 GMT)
Calibrating Small Language Models for Claim Check-Worthiness Detection [7.9] NN-PPIは予測パワー推論のポイントワイド拡張であり、推論時にモデル予測を軽量なポストホック層として校正する。
NN-PPIはベースラインモデルのサイズと性能に応じて12%から33.80%の重み付けF1ゲインを達成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:04:57 GMT)
Multivariate Scientific Data Compression with Learned Cross-Variable Latent Decorrelation and Autoregressive Entropy Modeling [7.8] 本稿では,2つの相補的な機構で共有CAESAR-Vバックボーンを増強する,誤り制御多変量学習圧縮機であるCAESAR-LDARを提案する。
トレーニング可能な変換は、アライメントされた遅延チャネル間の依存を再編成し、因果自己回帰階層は変換後に残った局所的な空間構造をキャプチャする。
燃焼、気候、乱流データにわたる実験では、この2つのメカニズムが異なる状況で有用であることが示されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:10:06 GMT)
SpecMind: Enabling Spectrum Intelligence via Multi-Agent Hybrid Retrieval-Augmented Generation [7.7] SpecMindは、異種データソースに対する推論を行うスペクトルインテリジェンスのための新しいシステムである。
実世界のライセンス記録とポリシー手順に基づくデータセットであるSpecBenchを開発した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:04:59 GMT)
Seeing the Unseen: Visual Similarity for Pixel Language Model Adaptation [7.6] ピクセルベースの言語モデル(LM)は、テキストの描画画像を処理して従来のトークン化ツールを置き換える。
我々は、画素ベースのLMの継続事前学習が、データスケール、初期スクリプトの露出、他のブラフミックスクリプトで記述された言語からの言語間移動の影響について分析する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:11:05 GMT)
(V)LMs generalize beyond surface co-occurrence: Evidence from cross-modal number agreement [7.6] 両暴露条件にまたがるクロスモーダル一般化の非自明な証拠を見いだす。
これは、VLMのような統計的学習者が表面レベルの共起を超越して一般化できることを示唆している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:31:20 GMT)
Learning Materials Properties from Scarce Labels and Unlabeled Crystals [7.6] SemiMatは、半教師付き材料特性回帰のベンチマークである。
MatRankは、継続的擬似ラベルの不確実性に対する信頼性の高い目標である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:24:24 GMT)
Unconditional Certified Randomness without Structure [7.6] 量子乱数オラクルモデルにおいて、認証されたランダム性プロトコルを得る。
我々は、このプロトコルの非条件のセキュリティを証明し、ランダムなオラクルに適応的な量子クエリを指数的に多数生成する敵に対して証明する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:17:49 GMT)
HBQ: Hierarchical Scaling Block Quantization with Hardware-Efficiency-Aware Design for Accurate LLM Inference [7.5] Block Quantization (BQ)は、大規模言語モデル(LLM)の効率的なデプロイのための有望なアプローチである。
設計空間探索(DSE)によるハードウェア/ベンチマーク結果を提供する。
従来の方法とは異なり、HBQは効率を最大化するために大きなブロックを使用し、第2レベルの量子化のために低オーバヘッド(SIG)スケーリングを導入している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:39:52 GMT)
RATIO: A Benchmark for Retrieval Across Typed Ideation Operations in Scientific Literature [7.5] RATIOは3つの操作で関連性を定義する大規模なベンチマークである。
RATIOはCS文学にまたがる数百万のフルテキスト科学論文から構築されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:28:22 GMT)
Empirical Software Engineering in Practice: Insights from Google [7.4] 経験的ソフトウェアエンジニアリングのレギュラーコラム(ACM SIGSOFT SEN-ESE)の一部として、私たちは、さまざまな企業のESE実践者へのインタビューに、一連の記事を書きたいと考えています。
ESE in Practice”の第1版では、GoogleのDeveloper IntelligenceチームのCiera Jaspan氏とCollin Green氏が参加しています。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:48:08 GMT)
LLM Post-Training as Brownfield Maintenance: An Industrial Perspective on Dataware Engineering [7.4] 私たちは、この作業が実際に難しい理由について、メンテナの視点を提供しています。
本研究は, 教員の蒸留を使用可能なトレーニングデータに転換する介入を2.84倍に増やした。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:08:41 GMT)
Logos: An Agent Harness on a Cross-Process Bus [7.4] 本論文は, 計算モデルも言語モデルも, モデル外におけるすべてのクロスステップ状態を保持しておらず, 音質不変性は, 状態空間のみで定義されることを示す。
これは、プラグインがプロセスであり、共有状態だけが追加のみのトランスクリプトである、ROSライクなクロスプロセスエージェントハーネスである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:59:16 GMT)
Centering before Pruning: Lightweight Geometry Correction for Diversity-Based Visual Token Pruning in LVLMs [7.4] 生の視覚トークン間の類似性は、正の範囲に強く集中しており、非冗長トークンを識別する能力を制限する。
中心コサイン類似度を用いてサブセットの多様性を測定するtextbfCentered Geometry textbfPruner (Cen-Prune)を提案する。
Cen-Pruneは、既存の多様性ベースのプルーナー全体のパフォーマンスを堅牢に改善する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:13:29 GMT)
Photon-efficient quantum repeater chains via hyperentanglement-assisted purification [7.3] BDCZと組み合わされた終端経路の各セグメントでDAHRPPを統合したDAHR変異体を提案し,解析する。
DAHRの単光子ペア性能のマッチングには,BBPSSWの精製を2~3ラウンド行う必要があることを数値的に示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:44:53 GMT)
GraspHOI: Full-Body 3D Human-Object Reconstruction with Finger-Level Grasps from a Single In-the-Wild Image [7.2] 既存のモノクロフルボディ3次元人-物体相互作用(HOI)法は, 指レベルのグリップ最適化とカテゴリー非依存オブジェクト再構成を組み合わせない。
本研究では,1つの画像から全体3D HoIを再構成する最初のフレームワークであるGraspHOIについて述べる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:54:53 GMT)
SurgSkill-Bench: A Benchmark for Multimodal Surgical Skill Assessment [7.2] SurgSkill-Benchは、214の手術訓練シミュレーションビデオ、6次元OSATSスコア、専門家のフリーテキストコメントを含む、ビデオスコアテキストのベンチマークスタイルの最初のデータセットである。
我々は,代表的凍結視覚バックボーン,コンテンツ適応型キーフレームサンプリング,およびビデオテキストのコアテンション融合モジュールを用いた制御ベースライン実験を行った。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:32:45 GMT)
Reproducible macroscopic dynamics in a closed-loop human-AI learning system [7.2] 閉ループヒトAIシステムは、集団動力学が不明な行動軌道を生成する。
モデルフィッティングの前にセマンティックな順序変数を定義し、ユーザ不随のコホートでそれらをテストする。
我々は、経験力学、解釈可能なメカニズム、ニューラルネットワークをリンクする外部に固定された先行方向有効場を同定する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:17:01 GMT)
Tensor Methods for Language Models: From Token Representation to Training, Adaptation, Inference, Compression, and Interpretability [7.1] 大規模言語モデル(LLM)はトークン表現、重み付け、適応更新、キャッシュ、アクティベーションなどの構造化された高次元オブジェクトから構築される。
トークン化、埋め込み、事前学習、適応、圧縮、推論、解釈可能性をカバーする7段階のライフサイクル分類を提供する。
また,理論記憶量削減とシステムレベル高速化の圧縮実現ギャップの尺度である$_rm gap$を導入する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:38:37 GMT)
Locally-Guided Actor-Critic: Training a Goal-conditioned Actor with a Subgoal-aware Critic [7.0] 目標条件付き強化学習は、報酬が不足している場合、長い地平線で苦労する。
プランナーは、低レベルの政策を導くためのサブゴールを提供することができるが、テスト時にの使用は、実践的なサブゴール管理の困難をもたらす可能性がある。
代替パラダイムは、高レベルのプランナーを使用して学習を支援し、方針は最終目標にのみ条件付けられている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:00:40 GMT)
When Does Predictor-Based RL Align with Human Perception? A Study of Subjective Rewards in Codec-Based Speech Language Models [6.9] Codec-based text-to-speech (TTS) モデルは、言語モデルポストトレーニングを音声生成に適用する。
学習した知覚予測者が、人間の聴取者との整合性を失うことなく、強化学習報酬として機能するかは、まだ不明である。
本研究では,アニメのような話し方,自然性,自由度,覚醒性について学習報酬を用いて検討する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:14:54 GMT)
Deterministic Minimum-Output-Entropy Nonadditivity via Haagerup's Inequality and Near-Free Permutation Representations [6.9] コリンズの最小出力エントロピー非付加性の混合単位証明に基づく有限次元二次証明を実現する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:53:42 GMT)
Sharp Approximation Rates for Neural Networks with Affine Latent Parameterizations [6.9] 我々は、潜伏次元$M$とネットワーク予算$P$のトレードオフを研究する。
我々は、$[0,1]d$上の$$-Hlder関数の単位球に対する最適な最悪の一様近似誤差が、$0leq1$のシャープオーダー$ bigl(PminM,Pbigr)-/dであることを証明する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:55:51 GMT)
DERELAB: Probing Defeasible Reasoning and Confirmation Bias in LLMs with a Generative Benchmark [6.8] 決定的推論(Dedefeasible reasoning)とは、推定が妥当な現在の証拠から引き出されるが、新しい証拠の導入によって取り除くことができる推論の一種である。
本稿では,パラメータ化されたグラフ構造から多ターンの信念更新会話を生成する生成フレームワークであるDeReLabを紹介する。
我々は9つのオープンかつプロプライエタリな大規模言語モデルを評価し、ほぼ全員が一貫性のない更新に抵抗しながら、一貫性のある証拠を受け入れる体系的な傾向を示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:10:29 GMT)
Augmenting Human Performance with an XR Agent Learning from Online Behavior and BCI Evidence [6.8] OLIVEは、時間的要求、ハイテイク、動的タスクにおいてリアルタイムのアシストを提供する基盤モデルを適用するためのフレームワークである。
OLIVEは明示的な行動信号(XRファーストパーソンシューティングゲームでユーザがシュートダウンするターゲット)と暗黙的な生理的信号(固定ロック脳波)から学習し、タイムリーなガイダンスを提供する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:25:51 GMT)
Authority Bias in Conversational Search Engines for Academic Paper Recommendation [6.8] 権威バイアスは、著者の権威、場所、引用に基づく論文を内容よりも体系的に選好する。
我々の実験では、権威バイアスは実質的かつ指向性があり、モデルによって顕著に異なり、プロンプトレベルのデバイアスによって部分的にしか対処できないことが示されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:49:14 GMT)
HF-SID: High-Fidelity Semantic IDs for Generative Retrieval in Location-Based Services [6.8] 位置情報ベースサービス(LBS)では,各POI(Point-of-Interest)を意味ID(Semantic ID, SID)として表現する生成検索が注目されている。
離散コードに何らかの情報がコミットされる前に、表現段階で地理的、数値的、構造的忠実度を復元するHF-SIDを提案する。
これらのメカニズムは表現を長くするよりも表現を豊かにするので、HF-SIDは余分な復号コストで3つのトークン識別子SIDを使用する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:05:09 GMT)
Quantum information in neutron-proton scattering from the $M$ matrix [6.7] スピン空間$M$-matrixフレームワークにおける中性子-陽子散乱の量子情報的側面について検討する。
各クラスについて、アンサンブル平均出力相互情報、還元状態線形エントロピー、負性率、および幾何量子不協和を計算する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:15:20 GMT)
MedAgent-R1: Faithfulness-Aware Reinforcement Learning for Evidence-Grounded Medical Reasoning [6.7] RL学習検索エージェントにおける系統的障害モードを同定する。
私たちは、忠実な報酬デザインでこの問題に対処します。
結果として得られるMedAgent-R1は、励起生成を31.8%から4.7%に減少させる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:19:41 GMT)
Understanding before verifying: Claim normalization for automated citation verification [6.7] Claim-Normalized Citation Verification (CNCV) はクレーム正規化、根拠付きエビデンス検索、引用分類からなる新しい3段階のフレームワークである。
我々は,CNCVを18個の分類器で評価し,人間の注釈付き引用インスタンスの因子的実験を行った。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:58:59 GMT)
TRIS: A Tri-Layer Retrieval Integrity Sieve Against Knowledge Poisoning [6.6] Tri-Layer Sieveは、クロスエンベディング空間クラスタリングによって得られた証拠を衛生化する。
1つの文書は1つの埋め込み幾何学、1つの内部Trigger-Payload構造、1つの世代目標を満たさなければならない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:21:27 GMT)
Beyond Semantic Accuracy: Consequence-Aware Evaluation for Safety-Critical Language Understanding [6.6] 操縦士と操縦士の通信がほぼゼロに近いエラー耐性を必要とする航空交通管制の問題点について検討する。
結果認識評価を用いて,セマンティックスコアが動作の信頼性を損なうかどうかを判定する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:39:56 GMT)
On the Complexity of the Compatibility Problem for Succinctly Encoded Conditional Distributions [6.6] 本稿では,機械学習における確率モデルにおけるトレードオフについて検討する。
一対の条件分布 p(x|y) と p(y|x) は任意の関節分布 p(x,y) とは相容れない。
離散確率変数の場合、条件が確率テーブルとして符号化されるとき、互換性問題は既知の解を持つ。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:32:21 GMT)
MUSES: A Benchmark for Prospective Intellectual-Roots Retrieval [6.6] textbfMUSESは、固定された2.33Mペーパーコーパス上での知的ルーツ検索のための100万インスタンスベンチマークである。
textbfCiteRootsは、局所的な引用テキスト上の修辞層と紙レベルの著者層とをペアリングする。
MUSESは、CiteNext、CiteNew、CiteNew-IsolatedにまたがるEmphfamiliarity軸と、広義の引用、修辞の根、著者が支持する根にまたがるEmphfunction軸の2つの軸に沿って困難を整理する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:05:36 GMT)
The Differential Reasoning Router: Operationalizing Cost-Aware LLM Annotation in E-commerce [6.6] コールドスタート LLM アノテーションのためのコスト対応フレームワークであるdifferial Reasoning Router (DRR) を紹介する。
DRRは、推論モデルをデフォルトのフォールバックとして扱うのではなく、サンプルレベルとビジネスルールレベルの両方で、直接モデルと推論モデルの両方の成功確率を推定します。
プロダクションのeコマースワークフローでは、DRRは最強の信頼性ベースのルータと精度を同等にし、60%以上の合理的なコスト削減を実現している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:11:39 GMT)
Measuring Memory and Generalization as Separable Geometric Channels: The Topo^2 Framework [6.6] Topo2は、ノイズラベルを因果的に分離し、測定し、法定化するための測定フレームワークである。
フレームワークの境界は、9つのデッドエンドのファルシフィケーション台帳と、グローバル統計の6つのファミリーを除外した計器認証セクションである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:13:00 GMT)
When Errors Become Memories: Causal Pathway Tracing in Multi-Turn Memory-Augmented LLMs [6.4] 長期記憶により、大きな言語モデルでは、対話間で情報の保存と再利用が可能である。
既存の作業は、主にメモリシステムが情報を正しく保存し、取得するかどうかを評価する。
メモリ拡張LDMにおけるクロスターン誤り伝播のための構造因果モデルを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:26:32 GMT)
You Shouldn't Have Asked: A Pragmatics-Inspired Taxonomy for Evaluating LLM Refusals [6.4] 実用理論に基づく LLM の拒絶に関する最初の分類法を提案する。
モデルは拒否方法が異なるが、その拒絶は全体的に明確で、道徳的に評価が強い。
我々は、モデルが有害な要求を拒否するだけでなく、ノーと言うことによる相互作用の結果に対して、文脈的に適応的で社会的に説明可能な方法で拒否するかどうかを考察するアライメント評価を呼び掛けている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:19:16 GMT)
Season-Aware Hybrid Convolutional-Transformer for Antarctic Sea Ice Concentration Forecasting [6.4] 南極海氷濃度予測のためのハイブリッド・コンボリューショナル・トランスフォーマー予測フレームワークを構築した。
このフレームワークは、空間的特徴抽出のための畳み込み符号化と、時間的依存モデリングのための分解自己アテンションを組み合わせる。
本稿では,トークン表現にカレンダー情報を注入する月単位の位置対応符号化と,周期的に関連する歴史的状態に注意を向ける季節的時間バイアスという2つの季節的事前メカニズムを紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:54:28 GMT)
Learning from What You Retrieve: Online RL Fine-Tuning for Semantic Retrieval [6.3] 大規模なeコマース検索では、二重エンコーダレトリバーは対照的な類似性のために最適化され、下流のリランカはよりきめ細かな関連性を好む。
選択的RL最適化法であるPAO(Positive-Advantage-Only)を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:21:47 GMT)
Token-Efficient Data Reasoning Agents via Adaptive Structuring of Unstructured Data [6.3] エージェントデータクラッキングは、非構造化データを適応的に投機的に推論の副産物として構成する手法である。
エージェントデータクラッキングは、非構造化データに対するエージェント推論のための次世代データインフラストラクチャに向けた第一歩である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:53:45 GMT)
TSExplorer: An interactive data annotation and exploration tool for time-series data [6.3] TSExplorerはインタラクティブなアノテーションと時系列データの探索のためのクロスプラットフォームツールである。
このツールは、複数の補完的な2Dビジュアライゼーションを通じて、高次元データセットを検査することを可能にする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:48:35 GMT)
Low-Resource Preference Adaptation of LLMs via Activation-Based Label Propagation [6.3] 言語モデルが、その中間表現における嗜好情報をエンコードする方法について検討する。
選択された応答と拒否された応答からのアクティベーションは、事前訓練されたモデルであっても、層をまたいだ異なるクラスタを形成する。
この構造を実行し、ラベル付き選好ペアの軽量線形プローブをトレーニングし、それを用いて大きな未ラベルデータセットを注釈付けする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:52:19 GMT)
CARVE: Verified Expansion for Variable-Length Generation in Diffusion Language Models [6.2] マスク付き拡散言語モデルは、部分的に観察された応答キャンバスからトークンを予測する。
標準的なマスク付き拡散デコーダは、厳密な推論インタフェースを使用する。
マスク拡散LMのトレーニング不要な可変長アルゴリズムであるCARVEを紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:00:30 GMT)
Diffusion-Based Refinement for Kilometer-Scale Probabilistic Precipitation Nowcasting [6.2] ExPreCast-ENSは、決定論的4kmレーダー流星exPreCastを1km確率アンサンブルに変換する条件付き残留拡散フレームワークである。
2023年の2回のハイインパクトイベントでは、30人のアンサンブルが、exPreCastが見逃した重いピクセルの38-47%を回復した。
この方法は、単一のGPU上で3.4秒で1-hの予測を生成し、フランスの地域MeteoNetレーダーデータセットに一貫した改善をもたらす。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:35:35 GMT)
Less Is More: Balancing Positive and Negative Space in Visual Concept Blending [6.1] グラフィックデザイナは視覚的概念をブレンドして、単一のイメージ内で複数のアイデアを伝達することが多い。
混合プロセス全体を通して正負の空間を明示的に適用する自動パイプラインを提案する。
肯定的空間と否定的空間を効果的に活用することにより、表現性、創造性、概念認識性を向上する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:25:28 GMT)
More Capable, Less Faithful: A Multilingual Analysis of Mathematical (Un)Solvability Detection in LLMs [5.8] 解けない問題と解けない問題の最初の多言語ベンチマークを導入する。
我々は最先端の大規模言語モデルの可解性検出能力を解析する。
We found that Solvability Belief is encodeed as a largely universal, language-agnostic feature。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:49:51 GMT)
Judging LLM-as-a-Judge: Concerning Rubric Artifacts in LLM-based Automated Text Generation Evaluation [5.8] 評価された応答にアクセスできることなく、テキストでのみ訓練されたルーリックが、判定出力に対して非自明な予測性能を達成することを示す。
カウンターファクトは、審査員が、候補の反応または粗末な基準が逆転した場合に、決定を確実に更新することができないことをしばしば示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:40:58 GMT)
Human-Anchored Factuality Evaluation with Strategic Annotation [5.8] LLMに基づく事実性判断は、スケーラブルな評価信号を提供するが、その指標は人間の判断に対して体系的に偏っていることが多い。
本研究では,限定的なアノテーション予算の下で人文認識の事実性評価について検討し,全データセット上の判断予測と,限定されたサンプルサブセット上の人文ラベルを組み合わせて統計的に有効な推定値を求める。
当社のFSA誘導政策は,一様サンプリングや不確実性ベースラインよりもアノテーション効率を向上し,AutoFAでは40.3%,RAGTruthでは27.1%の有効サンプルサイズゲインを実現している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:50:10 GMT)
Graph4BiLO: Graph Neural Network Approximation for Bilevel Mixed-Integer Linear Optimization [5.7] 本稿では,変数制約グラフ表現から2レベル値関数を学習するためのグラフニューラルネットワーク(GNN)アプローチであるGraph4BiLOを紹介する。
固定長多層パーセプトロン(MLP)表現とは対照的に、GNNは共有メッセージパッシングパラメータを使用する。
我々は,MibSソルバと学習ベースNeur2BiLO法に対して,20-100項目のknapsackインターディクションインスタンス上でGraph4BiLOを評価する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 00:32:53 GMT)
Law of Large Numbers: Accuracy as Statistical Measure for AI Compliance and Competition [5.7] EU AI Actは、リスクの高いAIシステムのコンプライアンス対策の一環として、"正確性"を明示的に言及している。
この研究は、社会世界の異なる要求に対するケーススタディとして「正確性」を提示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:02:28 GMT)
Nonparametric Contextual Pricing and Inventory Learning under Censored Demand [5.7] オンライン小売では、商品が売り切れたとき、小売店はしばしば販売される商品のみを見る。
我々は、各ラウンドで販売者が市場状況を観察し、前ラウンドの検閲された販売データに基づいて価格決定と在庫決定を行うオンライン販売問題を研究する。
本稿では,各不完全な販売記録を在庫および価格決定の信頼性の高いガイドとする平均キャリブレーション・カーネル UCB (MCK-UCB) アルゴリズムを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:15:48 GMT)
Autoregressive Mosaics: Probing 2D Spatial Reasoning in Text-Only Language Models [5.7] テキストのみの大規模言語モデルにおける2次元空間性能は、モデルと出力媒体の両方に依存することを示す。
8つのオープンウェイトなテキストとコードのみのモデルで、すべてのモデルは特定の幾何学を確実にコードに変換する。
プロシージャコードを生のSVGに置き換えると、すべてのモデルのレイアウトスコアが向上する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:18:03 GMT)
Characterizing Necessary Losers to Explain Tournaments Solutions [5.6] 本稿では,あるトーナメントルールで候補者が選ばれなかった理由を,公式に説明する問題について検討する。
我々は、トーナメントの残りがどう完走するかとは無関係に、候補者が負けるサブターナメントを特定する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:43:25 GMT)
Generative Retrieval for E-commerce: Jointly Learning Embedding and Codebook with Same Product Cluster [5.6] 生成的検索は、電子商取引のシナリオにおいてますます重要になりつつある。
現在の主流のアプローチでは、まず製品埋め込みモデルをトレーニングし、次に製品IDに埋め込みをマッピングするコードブックを学ぶという、2段階のトレーニング戦略が一般的です。
本稿では,埋め込みモデルとコードブックを共同で学習し,製品クラスタ情報を付加的な監視信号として組み込む手法を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:18:52 GMT)
Tail-Replay: Escaping the Curse of Linear Attention in Prefix Caching for Hybrid LLMs [5.5] 制約のないトークンレベルのプレフィックス再利用を可能にするプレフィックスキャッシュ機構であるTail-Replayを提案する。
我々は,LongBench と RULER ベンチマークを用いて,Gated DeltaNet をベースとした3つのハイブリッドモデル上でのTail-Replay の評価を行った。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:27:07 GMT)
EGT-KG: Evidence-Grounded Typed KG Retrieval for Practical Scientific QA with Small Language Models [5.5] 我々は,小言語モデル(SLM)における科学的質問応答を改善するために,Evidence-Grounded Typed Knowledge Graph (EGT-KG)を提案する。
EGT-KGは、ほとんどの設定でバニラRAG法よりも優れており、ラマ3:8b:ファイナルスコアが70.37(+14.67%)、AS/ES EGT-KGが68.82(+12.14%)である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:27:57 GMT)
When Does Bigger Help? A Controlled Study of LLM Scale for Ontology Learning [5.5] 我々は,Qwen3.5系およびQwen3.6系から高密度および混合スペクトルの13種類のモデルを評価する。
デンス27Bモデルはタームタイピングにおいて実質的に疎らなモデルよりも優れており、大きなMixture-of-Expertsモデルは分類発見において最強のオープンウェイトな結果が得られる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:30:05 GMT)
Do General NLP Embeddings Capture Ontological Reasoning? [5.5] 汎用NLP埋め込みモデルは言語的タスクにおいてよく機能するが、象徴的存在論的逆転を捉える能力はいまだに不明である。
25以上の最先端の埋め込みモデルを評価し,かなりの限界を見出した。
ファインチューニングは、大きなマージンで差別を改善するが、下流のセマンティックWebタスクにはあまり転送しない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:03:23 GMT)
Efficient biphoton generation by a waveguide-coupled single atom [5.4] キラル導波路近傍で自発的に4波混合を行う単一原子は、放出されたストークス−反ストークス光子対を2つの密閉導波路モードに効率よく流し、損失抑制や拘束相整合を必要とせず、強化された2光子発生を生じる。
本研究では,実験的な現実的条件下での4レベル原子系に対する摂動的処理を開発し,物理的起源を説明するとともに,誘導モードおよび誘導モードに対する原子崩壊速度の相互作用によって決定される拡張の関連的制約を明らかにする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:45:30 GMT)
Foundation Models Meet Agriculture: Challenges Beyond Pretraining [5.4] 農作業における基礎モデルの展開を妨げる2つの重要なボトルネックを評価する。
農業の下流での作業は、地球観測基盤モデルがアーキテクチャ上は摂取できないような多様な非想像的なデータモダリティを必要とすることが多い。
我々は、5つの構造軸にまたがる農業タスク空間を形式化し、なぜ現在のモデルが確実に一般化できないのかを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:47:57 GMT)
Two-Sided State-Space Models for Sequential Recommendation with Non-Random Multimodal Review Feedback [5.4] イベント条件付きシーケンシャルレコメンデーションのための2面状態空間モデル(TS-SSM)を提案する。
TS-SSMは,(1)レビュー内容と情報的観察パターンをエンコードするモジュール,(2)時間的変動を伴うユーザ状態の進化と,関連する項目の状態を用いてユーザの嗜好を洗練させるローカルグラフのメッセージパッシング,(3)肯定的および否定的なレビューフィードバックを非対称に伝達するアイテム状態の進化の3つのコンポーネントから構成される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:49 GMT)
Read the Room, Read the Image: Understanding Indirect Speech Acts in Multimodal Visual Contexts [5.3] 間接的発話行為(ISA)は、表層形態だけでは指示意図を推測できないため、文脈よりも実践的な推論を必要とする。
視覚的コンテキストと対話に対する統合推論を通してISA理解を評価するためのマルチモーダルベンチマークであるREADIを紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:28:32 GMT)
Entanglement-enabled Criticality in One-dimensional Quantum Contact Process [5.3] 1次元QCPは、古典的な場合と異なる臨界指数を持つ連続吸収状態相転移を経ることを示す。
我々の研究は1次元QCPにおける相転移の量子起源を確立し、散逸性量子多体系における絡み合いの本質的な役割を浮き彫りにする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:21:44 GMT)
Prove2Me: An Open Collaborative Platform for Scaling Math Formalization [5.2] 数学の形式化のためのオープンな協調プラットフォームであるProve2Meを紹介する。
ユーザーは、AIエージェントが完了に向けた公式な証明に貢献する正式な「ミッション」を起動する。
Prove2Meは、数学の定式化を、エージェントのある人なら誰でも、スケーラブルでクラウドソースの努力にしたい、と願っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:30:54 GMT)
A Dual-Cam Parallel Elastic Actuator with Shared Gas-Spring Compensation for Humanoid Ankles [5.2] 提案された設計の主な斬新さは、デュアルカメラのシングルガススプリングアーキテクチャである。
並列ガスばねとカスタマイズされたカムモジュールを活用することで、提案アーキテクチャは特定のタスク要求に合わせて2軸トルクアシストを提供する。
その結果,2-DoFヒューマノイドアンクルトルク補償のためのコンパクトでカスタマイズ可能なソリューションとして提案した設計が強調された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:06:21 GMT)
Revisiting Feedback-Driven LLM Code Repair: A Replication and Exploratory Java Extension [5.1] 本研究は, GPT-4o と Claude 3.5 Sonnet を用いた 394 の補修作業に関する当初の研究を部分的に再現した。
我々は、50のJavaタスクから100の誤修正インスタンスを構築し、フィードバックの有効性を評価する。
以上の結果から,Pythonのこれまでの結論は,ベンチマークの構成やフィードバック表現,ツーリングのエコシステムに敏感である可能性が示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:55:41 GMT)
Event-Driven Language Models with Sparse Neural Activity for Neuromorphic Hardware [5.1] トランスフォーマーベースの大規模言語モデル(LLM)による推論は、メモリバウンドなKVキャッシュと二次的注意コストによって制限されることが多い。
本稿では,性能損失を最小限に抑えた重量子化線形アテンションモデルにおいて,スパースニューラルアクティビティを誘導する手法を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:28:01 GMT)
Balancing Privacy, Utility, and Safety in LLM Alignment through Preference Optimization [5.0] 本稿では,プライバシー設定データの量を変えつつ,利便性と無害性嗜好データを固定したデータ合成プロトコルを提案する。
全体として、プライバシとプライバシの混合は、両方のモデル設定の平均的な接尾辞ログのようなプロキシ値に関連付けられている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:46:36 GMT)
Detecting AI Impostors: How Do Middle Schoolers Identify LLM Agents in a Live Collaborative Setting? [5.0] 我々は、若者がAIの偽造を検知し、どのように反応するかを研究するために、協力型ソーシャル推論ゲームであるtextitDoppelBotを紹介した。
学習者の検出精度は時間とともに向上し、言語的手がかりに依存するものから、共有された社会的・文脈的な信号を活用するものへと変化していく。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:18:01 GMT)
Detecting DBMS Bugs by Constructing Equivalent Representations of Intermediate Query Results [5.0] 論理バグ検出のための新しいテスト手法であるERIQを提案する。
ERIQは64のバグを検出し、63のバグが開発者によって確認され、2つのバグが修正された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:41:09 GMT)
OCR-Based Field Extraction for Archaeological Pottery Metadata: The CENTURIA Dataset [5.0] 考古学者は、しばしば技術図面や手書きのメタデータを通して陶器の発見を文書化している。
CENTURIAは、ローマのカルヌントゥム遺跡から得られた507の陶器の記録のデータセットであり、文字起こし、バウンディングボックス、および構造化されたフィールドレベルのラベルを提供する。
我々は,手書きの陶器の文書を,考古学データベースに適した構造化された検索可能なメタデータに変換するために,専門家が検証した小さな微調整セットが十分であることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:26:31 GMT)
MEOM: Multi-View Expected-OKS Maximization for Human Pose Triangulation [5.0] 従来の三角測量は、多視点2Dキーポイントから3次元人間のポーズ推定を解く。
私たちは、ヒートマップ全体を使用して、より正確に3Dのポーズを推定しようとします。
新たな目的であるMulti-viewExpected-OKS Maximization(MEOM)を導入する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:54:05 GMT)
Work Extraction Across a Thermodynamic Hierarchy in Quantum Many-Body Systems [4.9] 分離された量子多体状態は観測可能な熱力学的階層構造を持ち、操作が許されることを示す。
結果として得られる仕事の利得は、2つのレベルのエントロピー密度の違いによって制限される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:52:49 GMT)
Thesis Proposal: Toward a Human-Centered and Perspective-Aware Framework for Reproducible ML Evaluation and AI Alignment [4.9] 人間中心のAIシステムを構築する際には、意見の相違を考慮することが不可欠である。
診断はしばしば主観的な人間の意見から生じ、自身のアイデンティティ、信念、社会的環境によって変化する。
再現可能なML評価とAIアライメントのための人間中心・視点対応フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:12:23 GMT)
Language Proficiency Assessment from Eye Movements in Naturalistic Passage Reading [4.9] 標準言語の習熟度テストは語彙、文法、読解クイズといった言語的タスクに依存している。
本稿では,読取時の眼球運動の行動軌跡から言語習熟度を予測するための,認知的動機付け型アプローチを提案する。
眼球運動に基づく熟練度テストにおける2つの重要なオープンな疑問に対処する:(1) 読者の母国語と英語との近さを反映する潜在的なスコアリングバイアス、(2) 信頼性。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:57:39 GMT)
AI-enabled Low-Cost 3D Maize Ear Morphometry Platform at Breeding Scale [4.9] われわれは,20秒間のビデオから,トウモロコシ耳の水密度3次元メッシュを再構築する低コストパイプラインを開発し,検証した。
このプラットフォームは、育種規模の3D耳の表現の基盤を提供する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:28:34 GMT)
Beyond Good Intentions: When Does the Framing of Multilingual and Low-Resource NLP Research Become a Caricature? [4.9] 低リソース言語のための言語技術の構築とNLP研究の実施は、しばしば不平等に対処し、地域社会に役立てるための手段として考えられている。
本研究では,アカウンタビリティを阻害し,適切な知識生産を制約する可能性のある,反復的な修辞パターンを解析し,同定する枠組みを提案する。
我々は、著者、レビュアー、読者がこれらの主張を批判的に評価し、誤解を招く可能性のあるフレーミングを避けるために、実践的なレコメンデーションを提供することで締めくくります。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:30:00 GMT)
Beyond Token Positions: Safety Alignment Across Denoising Steps in Diffusion Language Models [4.8] 拡散大言語モデル(dLLM)は、左から右への復号ではなく反復的な復号化によってテキストを生成する。
中間トークン分布とコミットメント決定をトレースすることにより、有害なプロンプトの下でのdLLMの安全性挙動を測定する。
本稿では,初期段階から永続的な拒絶信号をコミットする訓練不要復号法であるRefusal-Aware Early Commitment (RAEC)を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:50:31 GMT)
LOOMSUM:Weaving Quantitative and Narrative Evidence for Faithful Long Text-Table Summarization [4.8] 長い文書は、しばしば広範な物語の通路と複数の表に重要な情報を分配する。
既存の方法は、個別に支持された量的事実と分析的なステートメントを生成するが、それらを誤って関連付ける。
原位置原子証拠を抽出するトレーニング不要のフレームワークであるLOOMSUMを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:44:18 GMT)
Location-Aware Language Models via Secondary Embeddings [4.8] 本研究では,地空間認識を事前学習した埋め込みに注入するための,軽量でモデルに依存しないアプローチを提案する。
本手法は,位置名と対応する緯度と経度を組み合わせることで,地理的な構造を持つ入力表現を増強する。
実験により,標準NLPベンチマークにおいて同等の性能を維持しつつ,地理空間アライメントを大幅に改善した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:48:37 GMT)
Learning to Reason and Use Tools through Unsupervised Fine-Tuning in Task-Oriented Dialog Systems [4.7] 我々は、タスク指向対話のためのReActフレームワークを適用し、大規模言語モデルが外部知識にアクセスし、事実応答を生成することを可能にする。
文脈内学習推論により推論軌道を抽出する教師なし微調整パイプラインを提案する。
SIMMCデータセットの実験では、ReActベースのシステムはより優れた推論とツールの使用によりベースラインを上回っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:22:26 GMT)
OntoAligner-Ensemble: Voting-Based Fusion across Heterogeneous Ontology Alignment Techniques [4.7] OntoAligner-Ensembleは、オントロジーアライメントのためのモジュラーおよびアライメントに依存しないフレームワークである。
バイオメディカルから非等価までの8つのベンチマークタスクの個別構成とアンサンブル構成を評価した。
分析の結果,アンサンブル構成は精度-リコールトレードオフに直接影響を及ぼすことが明らかとなった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:44:25 GMT)
Conversation Coach: A Voice-enabled AI System that Helps Practice Difficult Workplace Conversations [4.6] 本稿では,音声ファーストのAIシステムであるConversation Coachを提案する。
エンドツーエンドの音声合成モデルと,音声認識,大規模言語モデル,テキスト音声合成を組み合わせたケースドアプローチを比較した。
運用環境にカスケードアーキテクチャをデプロイし,6ヶ月で4万を越えるマネージャが使用しました。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:26:50 GMT)
A Survey on Rubric-Guided Reinforcement Learning for Language Models [4.6] 我々は、構成を事前分布として定義するベイズフレームワークを導入し、評価基準よりも$P(R)$、条件インスタンスとして$R_x sim P(R|x)$とする。
この統一された視点の下では、前後軸に沿って誘導されたRLの分類を提示し、立憲AI、インスタンス固有のルーリック、プロセスレベルの監督、自己進化する粒度、およびエージェントおよびマルチモーダル拡張を網羅する。
粒度が自然言語のアーティファクトであるので、トレードオフ、セマンティックドリフト、言語報酬ハッキングがアライメントの信頼性に与える影響を言語学的に分析する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:06:09 GMT)
Towards Operator-Empowered Vulnerability Hotfixing for 5G Radio Access Networks [4.6] 我々は,MNOが無線アクセスネットワーク(RAN)に一時的,局所的,可逆的なホットフィックスをデプロイできるフレームワークであるBucklerを紹介する。
我々は、標準L2/L3プロトコルの動作に根ざした64個の攻撃を特定し、43個の攻撃がRANに予防的介入点を与え、そのうち20個のBucklerホットフィックスを構築した。
20のホットフィックスはすべて同じルールボキャブラリと5つの標準化されたチャネルフックを使用しており、サポート対象のアタックはRANだけでは満足できないエンドポイント依存性を公開している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:26:12 GMT)
Overcoming critical slowing down in frustrated spin systems by learned multiscale sampling [4.6] クラスタアルゴリズムは統計システムの臨界減速を緩和する最も成功したMCMC手法の一つである。
ここでは、関連するクラスタを構築するのではなく、学習によってこの基本的な制限を横取りする。
従来のクラスタアルゴリズムがフェールするフラストレーションシステムにおいて,学習したマルチスケールサンプリングが致命的なスローダウンを克服できることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:21:54 GMT)
On the Prospects of Dynamic LLM Conversations in Software Development [4.5] 大規模言語モデル(LLM)は、開発者を支援する上で不可欠なツールになっていますが、開発活動中のインタラクションを効果的にサポートする方法については、まだ知識がありません。
私たちのゴールは、LLMとのインタラクションへの介入がソフトウェア開発者に影響を与えるかどうかを評価することです。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:24:26 GMT)
GAFT: Geo-Anchored Fine-Tuning for Hazard Identification from Rare Failures [4.4] オフロードナビゲーションは、物理的構造が高センタリングやエントラップメントのような発見不可能な状態を引き起こすと失敗することがある。
我々は,視基盤モデルに幾何由来の先行モデルを適用するパラメータ効率の高い手法である textbfGeo-Anchored Fine-Tuning (GAFT) を提案する。
介入検証されたハザードベンチマークでは、独立に訓練された10の適応において、GAFTは凍ったDINOv2と監督されたPEFTベースラインを一貫して上回っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:20:59 GMT)
Geometry of Divergence: Tracking Hidden-State Trajectories for Adaptive Multi-Turn Reasoning [4.4] LLMエージェントは、厳密なリソース制約の下で、長期にわたる多ターン相互作用におけるゴール整合推論を維持する必要がある。
2つの相補的な信号によって特徴付けられるLLMの隠れ状態軌跡としてマルチターン推論を定式化する。
軌道幾何学は推論過程において重要なターンを識別でき、トークンコストを11.2%削減しながら、タスク成功率を24.1%から39.6%に引き上げる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:51:54 GMT)
From Feature Interaction to Feature Transport - A Unified Block for Scalable Recommendation Models [4.4] 統一レコメンデーションモデルは、非逐次的マルチフィールド特徴とシーケンシャルなユーザ動作を共同でモデル化することを目的としている。
スケーラブルな統一的なレコメンデーションは、スタックされたブロックをまたいだインテント情報の転送、フィルタリング、保存の制御も必要である、と我々は主張する。
我々は、深層統合レコメンデーションを個別の文脈条件の表現進化過程として扱う特徴伝達(Feature transport)を導入する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:08:40 GMT)
AI Morbidity and Mortality: A Framework for Clinical AI Failure Review [4.3] AIM&M(AI Morbidity and Mortality、AIM&M)は、臨床AI障害のケースベースレビューのための、構造化された、非難なしのフレームワークである。
このフレームワークは、標準化されたケースインテーク、エビデンス保存と調査官レベルの再構築、ツール・イン・ループ・アトリビューション、修正アクショントラッキングを組み合わせている。
個々のAI内フロー障害を実行可能な機関学習に変換することで、モデル監視、患者の安全報告、規制監督を置き換えるのではなく、補完することを目的としている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:41:30 GMT)
Recursive Criticality of AI Self-Improvement [4.3] AIは、未来のAIシステムを生成するR&Dプロセスでますます使われています。
このフィードバックが自己増幅となる条件について検討する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:03 GMT)
Toward Workflow-Aware Benchmarking for Healthcare NLP Agents [4.3] 医療用NLPエージェントのエピソードレベル評価プロトコルを提案する。
モデル、エージェント、シミュレートされたワークフローの振る舞いにまたがるエビデンスを分離する。
それは、状態継続性、エビデンストレーサビリティ、エスカレーション決定のためのアノテーションとスコアを定義します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:41:58 GMT)
Quantum Secret Sharing with a Helper and Programmable Access Structures [4.2] 量子秘密共有(Quantum Secret Share、QSS)は、量子システムの状態を複数の共有に分割するプロセスである。
我々は「ヘルパーQSS」と呼ばれる「QSS」の変種を提案し、これは国家の回復に十分である特定の株主を指定している。
任意の人数のパーティとシステムサイズで機能するヘルパーコードのファミリーを提示する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:29:54 GMT)
Stride-k Subsampling: Train-Free Audio Token Reduction for Whisper [4.2] コンボリューションステムまたはエンコーダ変換器の後,すべてのk番目のトークンを保持する決定論的インデックス化演算であるstride-kサブサンプリングを提案する。
ストライド2を両方の位置に適用することで、オーディオトークンを75%削減し、総GFLOPを52-58%削減する。
同じ構成は3つのWhisperベースのSpeechLMに拡張され、より強いベースラインに、より弱いベースラインに、より大きなドロップに、そしてエンドツーエンドのレイテンシを19.6-27.4%削減する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:04:29 GMT)
CoLa-ICD: A Knowledge-Enhanced Framework for Long-Tail Automated Medical Coding [4.2] CoLa-ICDはロングテール予測のための知識強化フレームワークである。
ラベルのセマンティクスとロングテール予測のための臨床証拠とのより強い整合性を学ぶ。
実験により、CoLa-ICDは、より大きなラベル空間とスペーサーラベル空間において、より大きなゲインを持つ長いテール予測を改善することが示された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:39:43 GMT)
DARP: A Calibrated Dual-Arm RGB-D-IR Dataset for Multi-View Robotic Perception [4.1] 本稿では,2つの独立移動眼内マニピュレータを用いた物体中心ロボット知覚のための校正デュアルアームRGB-D-IRデータセットであるDARPを提案する。
DARPには10のユニークなテーブルトップオブジェクトが含まれており、元のセンサー記録、ロボット状態ログ、オブジェクトレベルのメタデータ、キャリブレーション情報を保存する。
DARPは、多視点再構成、協調ロボット認識、マルチモーダル融合、アクティブな知覚、そして部分的な物体観察に対する将来の学習に基づく推論のための再利用可能なリソースとして意図されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:53:41 GMT)
Reading the News: Adapting Large Language Models to Swedish Journalism Through Continued Pre-Training [4.1] 大規模な言語モデルは、一般的にはますます有能になるが、その実用性はニッチまたは未調査領域で控えめに保たれる。
この制限に対処する1つのアプローチは、ターゲットドメインのコーパスに関する追加トレーニングを通じて既存のモデルを専門化することである。
本研究では,スウェーデンのジャーナリズムに大規模な言語モデルを適用するための事前学習の継続について検討する。
トレーニングを継続することで、ターゲットドメインのメリットが得られますが、経験リプレイとペアになって、忘れを軽減できる場合のみです。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:20:55 GMT)
Uncertainty-Aware Trajectory Forecasting from Imperfect Tracking [4.1] 本稿では,予測器に伝達する情報信号として,追従型信頼性キューを取り扱う。
本稿では,各観測状態を不確実な状態表現として符号化するプラグイン不確実性認識型定式化を提案する。
実際のトラッカー出力を用いたオックスフォード・タウンセンターとVIRATの実験は、補完的なETH/UCY擬似検出プロトコルとともに、提案法により、確率的予測の変位精度と信頼性のトレードオフが向上することを示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:50:38 GMT)
RealOOB: A Definition-Consistent Real-World Oriented Occlusion Boundary Benchmark [4.1] 既存のベンチマークは、限定的なカバレッジ、カテゴリ固有の設計、自己排他的アノテーションの欠如、一貫性のないアノテーション定義に悩まされている。
我々はRealOOBを紹介した。RealOOBは4.26M定義に一貫性のある幾何基底を持つOBラベルを持つ、注意深く注釈付けされた実世界のベンチマークである。
RealOOBに基づいて、6つの単分子深度推定器とともに40個のOB推定器とエッジ検出器を評価した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:01:37 GMT)
The First Token Is a Clue: Verbalizing Multi-Token Concepts from the J-lens [4.0] マルチトークンの概念の最初のトークンは,シングルトークンの概念と同じくらい可読性が高いことを示す。
次に、各候補のベクトルを復元し、完全語彙とともにスコアする。
これらの結果から,先進的な手掛かりはマルチトークンの概念回復を導出し,後続の隠れ状態は読み出しと介入のためのベクトルを与えることがわかった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:56:20 GMT)
Codes for Quantum Secret Sharing with a Helper [4.0] 我々は、QSSヘルパーコードの一般的な構造を分析し、新しいコード構造を示す。
単一量子ビットの符号化では、ヘルパーから対象者への一方的な局所的操作と古典的コミュニケーション(LOCC)を用いてリカバリが常に可能であることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:41:59 GMT)
Taking the Whys Seriously: Limitations of Counterfactual Explanations in Justification and Recourse [4.0] 対物的説明(CE)は説明可能な人工知能(AI)に広く使われている
本稿では, 実生活モデル配置設定において, カウンターファクトアルを用いた場合の規範的正当性について検討する。
正当化とリコースのためのCEの素直な適用は、機械学習(ML)パイプライン全体を通してなされた競合可能な選択を無視してしまう可能性があることに気付きました。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:24:19 GMT)
Learning the Geometry of Admissible Hypotheses through Inductive Bias in Training Distributions [3.9] 本稿では、科学的帰納バイアスを直接トレーニング分布に埋め込むことにより、許容偏微分方程式(PDE)の連続潜在表現を学習するための枠組みを提案する。
実験の結果, 結果の11次元表現は, 代表PDEの広いコレクションを正確に再構成することがわかった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:09:41 GMT)
WiSDoM: Wireless Sparse Decision Transformer with Mixture-of-Experts for Multi-Task Mobile Network Optimization [3.9] 本稿では、適応型マルチセル選択のためのWiSDoMを用いた無線スパース決定変換器を提案する。
WiSDoMは、Decision Transformer (DT)とMixture-of-Experts (MoE)アーキテクチャを組み合わせることで、タスク特性に応じて専門専門家を動的に活性化する。
実験の結果,WiSDoMはメソッド,シングルタスクモデル,従来のマルチタスクDTよりも一貫して優れていた。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:32:18 GMT)
Where Do Multilingual Vision-Language Encoders Fail on Low-Resource Languages? [3.9] 最近の多言語ビジョン-言語エンコーダは、数百の言語を単一のモデルでカバーしている。
低リソース言語(LRL、スワヒリ語など)上の2つの最先端インスタンス検索では、高リソース言語(HRL、英語など)を30ドル以上で追跡する。
トレーニングされたエンコーダのどこにこのギャップがあるのかを問う。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:59:35 GMT)
Learning Action Models with Conditional and Quantified Effects via Uncertainty-Guided Exploration [3.8] 既存の行動モデル学習法は、単純な行動表現を仮定するか、条件付きおよび定量化された効果を学習する際に計算的に難解になる。
オンライン仮説駆動型行動モデル学習(OHCAM: Online hypothesis-Driven Action Model Learning)は、環境との限られた相互作用から条件付きおよび定量化された効果を持つ行動モデルを学ぶためのオンラインアプローチである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:23:43 GMT)
Exact Global MCMC with Denoising Diffusion [3.8] 我々は、局所収束MALAサンプル上で拡散モデルを訓練し、グローバルMCMCの提案を学習する。
Denoising Diffusion Monte Carlo (DDMC) は、様々な複雑なターゲット密度に対して高い受理性を持つグローバルな提案を提供できることを示す実験である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:24:36 GMT)
Whole-Body MRI Classification via Prompt-Based Clinical Conditioning [3.7] TACTIC(Tabular-Attribute Conditioned Transformer for Image Classification)は、WB-MRIと構造化された臨床データを条件付き視覚特徴学習を通じて統合するプロンプトベースのフレームワークである。
我々は, 糖尿病, COPD, 乳癌, 前立腺癌, 転移診断など, 全身および腫瘍学的応用にまたがる5つのWB-MRI分類課題について, TACTICを評価した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:03:41 GMT)
Towards Large-Scale Heterogeneous Data Organization for Scientific Foundation Models: A Nuclear Fusion Case Study [3.7] 効果的な基礎モデルのトレーニングには、大規模で組織化されたデータセットが必要であるが、核融合のような科学領域は、大半が異質でスパースなデータのため、固有の課題を提示する。
ここでは、サンプリングレートの5桁にまたがる20以上のセンサタイプ、混合テンソル構造(点計測、分光図、画像)、非定常物理学など、そのようなモデルの開発に使用されるデータを特徴付ける。
本分析は,マルチモーダル制御系と核融合の両方に影響を及ぼすマルチモーダル変動データを大規模に表現するためのテンプレートを提供する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:26:18 GMT)
Context-Aware Interleaved Batching for WhisperX [3.7] 我々のアルゴリズムはWhisperのテキストコンディショニングを安定化し、バッチ化された音声セグメント間の連続したコンテキストを安全に維持する。
長文音声ベンチマークで示されたように、この手法はワード誤り率(WER)を低減する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:59:46 GMT)
Segmentation of Bovid Dentition Under Imperfect Annotations: A Comparative Study of Convolutional and Attention Models [3.7] ディープニューラルネットワーク(DNN)は、ピクセルを直接分類することを学ぶ。
セマンティックセグメンテーションは、専門的に設計されたマスクターゲットに依存している。
本稿では,B.O.V.I.D.データセットに適用されたセグメンテーションアーキテクチャの比較研究について述べる。
我々は,ラベルの不完全性を緩和するために,事前処理およびアライメント手法の評価を行った。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:29:31 GMT)
Mass-gap functional determinant approach for mobile Fermi polarons [3.7] ファミポラロンの質量ギャップ記述を用いて, 機能的決定性アプローチ (FDA) を有限質量不純物に拡張する。
この質量ギャップFDAは, 無限重不純物に対するフェルミ縁特異点と, 不純物に対する準粒子量の出現とを円滑に補間することを示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:09:16 GMT)
Lie to Me: Finding Bugs in ZK DSL Toolchains with Adversarial Witness Injection [3.7] 我々は、ZK DSLプログラムを生成し、敵対的な目撃者注入を通じてバグを公開するテストフレームワークであるLiezzを紹介する。
生成された決定論的プログラムごとに、Liezzは2つの公開入力を異なる出力で実行し、証人をスプリスし、一方の実行の入力と他方の実行の出力を組み合わせる。
制御された分岐と複数の目撃者分離戦略は、不足する制約を明らかにするのに十分な一貫性を維持します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:50:37 GMT)
Contrast-Free Autonomous Navigation of Untethered Endovascular Microrobots Using Single-Plane Fluoroscopy [3.6] 単面蛍光顕微鏡は2次元のプロジェクションのみを提供し、深度情報を排除し、自律的なナビゲーションを複雑にする。
単面蛍光下でのコントラストフリー自律ナビゲーションを実現するデジタルツインフレームワークであるVISTAを紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:08:53 GMT)
Lot Machine: Multimodal Lot Extraction from Auction Catalogs [3.6] 歴史的オークションカタログから構造化されたロットレベルのメタデータを自動的に抽出するパイプラインを提案する。
我々は,視覚言語モデル (VLM) を,様々なプロンプト戦略と制約付き復号化フレームワークの下で評価する。
この研究は、VLMベースのパイプラインが、大規模な自動分析のために歴史的オークションカタログをアンロックできることを実証している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:44:15 GMT)
Beyond Locks and Thread IDs: Static Data Race Detection Off The Beaten Path (Extended Version) [3.6] 我々はダイジェストフレームワークを拡張して、静的なレース検出で無視されたコンストラクトと同期メカニズムを扱います。
pthread_onceは、アクションが一度だけ実行されることを保証します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:47:23 GMT)
GarmentWeaver: Schema-Aware Structured Synthesis for Multimodal Sewing Patterns [3.6] GarmentWeaverはマルチモーダルスウィングパターン生成のためのスキーマ対応フレームワークである。
衣服関連構造枝を活性化することにより、コンパクトな階層的ターゲットを構築する。
実験により、GarmentWeaverは強いベースラインよりも正確で実行可能な縫製パターンを生成することが示された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:25:00 GMT)
InsightToast: Proactive Information Retrieval & Glanceable Visualization in the Side Channel of Data-Rich Meetings [3.6] InsightToastは、リアルタイムで会話を監視し、話題や情報のニーズを特定し、関連情報を積極的に検索する。
セレンディピティーな洞察を得られる可能性を示すために、会議の文脈として、立法文書の知識ベースを含む利用シナリオを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:22:43 GMT)
Towards a Joint Khmer Text Recognition and Word Segmentation [3.5] 本稿では,統一モデルを用いた新しいKhmerテキスト認識と単語分割フレームワークを提案する。
提案モデルでは,文書画像の文字認識だけでなく,単語境界の特定も可能である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:53:25 GMT)
Singular Curvature in ReLU Training:Differentiation and the Gradient-Flow Limit Need Not Commute [3.3] 固定有限地平線上で、GD状態が収束し、これらの正確な離散微分が事象のない地域プロパゲータに近づくことを証明する。
結果は、分離された同方向逆イベントの安定な有限イテナリーを持つ決定論的完全バッチ有限ホライゾン力学に関するものである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:26:59 GMT)
LLM-based Hardware Development with Hierarchical IRs and End-to-End Multi-Agent Workflow [3.3] 大規模言語モデル (LLM) はソフトウェア開発でますます使われているが、複雑なハードウェア設計での使用は限られている。
階層型中間表現(IR)とエンドツーエンドのマルチエージェントワークフローを備えたLCMベースのハードウェア開発フレームワークを提案する。
We evaluate our framework on Verilog-Eval benchmark, achieve a pass@5 rate of 95.5%, which is a current-of-the-art LLM generation frameworks。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:57:37 GMT)
CRAD: Class-wise Reliability-Aware Distillation for Decentralized Heterogeneous Federated Learning [3.3] フェデレートラーニングのためのクラスワイド・アウェア蒸留(CRAD)を提案する。
CRADはクラス毎の信頼性(精度、逆分散)で各教師を重み付けする
世界的精度で競合する手法を一貫して上回る。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:36:30 GMT)
Attesting Outputs and Delegation Ancestry in Multi-Agent AI Systems [3.3] 事件後、検証者は2つの質問に答えなければならない。
クレデンシャルは、誰が行動するかを確立するが、後続の出力バイトにそれらをバインドする必要はない。
信頼できるデプロイランタイムは、リリースされた各出力のハッシュに署名する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:42:57 GMT)
AIA$^{2}$: Attribute-Agnostic Imbalance Augmentation for Subgroup Robustness [3.2] Attribute-Agnostic Im Balance Augmentation (AIA$2$)は、様々なサブグループ不均衡の下でモデルロバスト性を改善するためのフレームワークである。
AIA$2$は、潜在意味分布を介して様々な不均衡を自動的に発見し、学習困難とサブグループ不均衡の両面からスライスを得る。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:08:30 GMT)
Benchmarking Peptide-Protein Affinity Prediction Across Peptide and Target Shifts [3.2] 定量的ペプチド-タンパク質結合データの3つのソースを統合し, 11,349個の脱重複ペアを得た。
ペプチド相似性, 標的内, 離脱対象の分割条件下で, 10個のペプチド表現, ESM-2タンパク質埋め込み, 6個の回帰因子を比較検討した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:56:26 GMT)
sbom-unifier: Integration Framework for Heterogeneous SBOMs [3.2] ソフトウェア・ビル・オブ・マテリアル(Software Bill of Materials, SBOM)は、ソフトウェアコンポーネントの機械可読在庫である。
既存のSBOM生成ツールは、多くのSPDX定義フィールドを残している。
フィールドレベルの統合により,SBOMの完全性を向上させるフレームワークを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:45:22 GMT)
Linguistic Distance Segregates Latent Representations in Automatic Speech Recognition Systems [3.2] 本稿では,第1言語バックグラウンドと英語のASR性能の関係について検討する。
経験的分析により、話者のL1距離とASR誤り率の相関が英語音声に体系的な影響をもたらすことが明らかとなった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:16:21 GMT)
Learning PDE Time-Stepping with Neural Cellular Automata [3.1] 本稿では,長期PDEダイナミクスを学習するための訓練可能なニューラルセルオートマトンに基づく代理モデルを提案する。
PDE - Net、修正物理インフォームドニューラルネットワーク(PINN)、フーリエニューラルオペレータ(FNO)の3つのベースラインに対して、このフレームワークをベンチマークする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:46:24 GMT)
Local Reference Geometry Residual Augmentation for Imbalanced Time Series Classification [2.9] Local Reference Geometry (LRG) は、時系列分類のための軽量な機能拡張モジュールである。
LRGは局所露光とクラス混合リスクを測定し、各固定された特徴を近くのトレーニング幾何学から標準化された符号付き変位で増強する。
制御されたUCR/Bake Off Redux不均衡ベンチマークでは、ペアの生-LRG比較が学習、事前訓練、固定表現の利得を示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:50:40 GMT)
Trajectory-Initialized Neural Double Q-Routing for Large-Scale Overhead Hoist Transport Systems [2.9] 大規模産業用ロボットは、安全分離、交差点アクセス、下流封鎖、ステーション競合に依存する旅行時間を制限された物理的なインフラを共有している。
本稿では,宛先インデックステーブルを共有状態-動作値ネットワークに置き換えるニューラルダブルQルーチンを提案する。
6つの150-OHT設定と200-OHT設定で比較されたすべてのメソッドの中で、最も低い平均完了時間を達成する一方、Dijkstraは3つの100-OHT設定で最良である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:47:23 GMT)
SAGE: State-Grounded, Abstention-Aware Evaluation of Task-Oriented Dialogue Agents [2.9] SAGEはワークフロー仕様をコンパイルし、ターン毎の状態差分をアトミックなスキーマ付き基準にコンパイルする。
SAGE-Coreは81-91%の基準をコンパイラ、シンボリックルール、オンデバイスエンコーダで決定する。
SAGE-LLMはオープンクラスの基準にフォーカス-LLMフォールバックを追加する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:14:52 GMT)
Dense Clinical Contrasts Enhance Medical Knowledge Updating in Large Language Models [2.6] SEER-Benchは、最新のSEER Research Dataリリースからキュレートされた、時間的に固定されたオンコロジーステージングベンチマークである。
NCCNオンコロジーガイドラインからの同一の医療アップデートイベントを、EMQ、MSQ、FITB、SAQの4つの監視フォーマットにまとめる。
EMQは、同一予算のSFT変種の中で最も安定した外部転送と保持を提供する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:59:15 GMT)
Mycelial Search: A Graph-Structured Metaheuristic for Continuous Optimisation [2.6] Mycoは、活発な先端、コミュニティの重み付けされた流れ、コードの可塑性、アンカーベースの注入を中心に設計されたグラフ構造メタヒューリスティックである。
コミュニティ構造はグラフベースの情報交換の範囲を規制するが、コード可塑性は局所的な方向の影響の持続性を制御する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:50:14 GMT)
DP-VOXLET: Provable Speaker Anonymization for Disentangled Speech Representations [2.6] 話者匿名化システムは、本来の意味内容と韻律を維持しながら、発話の話者を難読化する。
話者匿名化の最近のソリューションは、発話を意味的内容と話者特性に分解する学習された表現に依存している。
本稿では、話者識別の枠組みに基づく話者匿名化の形式的定義と、その定義を確実に満足する話者匿名化のメカニズムを紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:34:16 GMT)
Analytic Dynamics: Learning Physics-Grounded Representation for Fast Intrinsic Dynamics Inference from Monocular Videos [2.6] 視覚的観察から物体力学を推定することは、知的エージェントが物理的世界について推論し、相互作用することが不可欠である。
本稿では,中間物理基底の動的表現を導入したフィードフォワード動的推論フレームワークであるAnalytic Dynamicsを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:08:04 GMT)
Camera trap classification with deep learning under ground truth uncertainty [2.6] 訓練ラベルはボランティアの市民科学プロジェクトに由来することが多い。
基礎的真理不確実性の下でのトレーニングの効果について検討した。
本研究は,複数のラベルを持つ生態画像タイプに深層学習を適用することの意義について考察した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:45:23 GMT)
Co-Annotator: Expert-Distilled ViT and VLM for Visual and Documentation Guidance in Age-Related Macular Degeneration [2.5] 本稿では、専門家の視線と判断を2つのガイダンスに抽出するCo-Annotatorについて述べる。
注目領域(AOIs)とオントロジー有界視覚言語モデル(VLM)は、編集可能なバイオマーカーの要約をプリフィルする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:09:05 GMT)
RestoreBench: Can AI Agents Restore Power Flow Convergence? [2.4] 非収束パワーフローケースの診断と解決は、有望だがほとんど探索されていないアプリケーションである。
複数のLLMと3つのアーキテクチャにまたがるこれらの機能を評価するベンチマークを導入する。
評価は2つの電力網と1グリッドあたり46ケースをカバーし、それぞれ収束を回復するために1つ以上の補正措置を必要とする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:15:19 GMT)
Emotional Labor Strategy Preferences in LLM Personas [2.4] 本研究では,心理指標に基づく人格選択が人格選択パターンを再現するか否かを考察する。
我々は,500件の社交的なイベントを対象とした最初の感情的労働戦略データセットを構築した。
モデルがより深い行動に整合し、良心と情緒の安定性が常にこの嗜好を予測していることがわかりました。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:59:49 GMT)
Autonomously Acquiring Robot Manipulation Skills with Language-Driven Quality-Diversity [2.4] 本稿では,品質多様性アルゴリズムを自律的に活用することで,多様な動作原始アーカイブを出力する手法を提案する。
提案手法は,様々な動作プリミティブのアーカイブを効果的に生成し,推論および手書きパラメトリゼーションによる古典的QDアルゴリズムより優れている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:42:20 GMT)
TopoCompress: Long Context Compression via Graph-Wired Semantic Trajectories [2.4] TopoCompressは,コヒーレントなセマンティックスパンを選択することで,長いコンテキストを圧縮するフレームワークである。
TopoCompressはまず、セマンティックアクセラレーションとともに、密度と語彙のクエリ関連を使って各スパンをスコアする。
次に、セマンティックな類似性とシーケンシャルな隣接性に基づいてスパンを結合するハイブリッドグラフを構築し、グラフ上のクエリ誘導関連スコアを伝搬する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:58:59 GMT)
Multimodal Adaptive Expert Selection with Text Routing and Ordinal Prototype Optimization for Sentiment Analysis [2.4] マルチモーダル感性分析(MSA)は, 言語内容と非言語的手がかりを統合することで, 複雑な感情状態の解読を目的とする。
最近の遠絡型アプローチはこの分野を前進させたが、そのポテンシャルは2つの方法論的課題によって妨げられている。
テキストルーティングと正規プロトタイプ最適化によるマルチモーダル適応エキスパート選択(MAESTRO)を導入する。
静的融合とは異なり、このモジュールは言語コンテキストをルーティング信号として利用し、特定の音声・視覚の専門家を動的に活性化する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:59:37 GMT)
Robust Semi-passive Velocity Field Control with Boundedness Guarantees for Safe Interaction between Mechanical Systems and Physical Environment [2.2] 本研究では,完全受動的制御手法の本質的に保守的な性質を緩和するために,頑健な時間変化半受動的速度場制御について検討する。
提案手法は, 閉ループシステムとその物理的環境間の電力流の制約も可能とし, 相互作用プロセスの安全性を高める。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:16:14 GMT)
Latent Mechanisms of Language Control in Multilingual Language Models [2.2] 本稿では,多層トランスコーダにおける言語制御ラテントを識別する3つの手法の比較研究を行う。
生成言語を効果的に操作する3つの手法がすべて,FreqSelが全体的なパフォーマンスで最強を達成していることがわかった。
ノックアウト分析は、メソッドが重複しないが各機能的な潜在サブセットを選択し、単一の標準言語方向ではなく冗長性を示すことを示唆している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:21:21 GMT)
TAMI: Temporally Aligned, Missingness-Aware, and Interpretable Multimodal Fusion for Mental Health Assessment in Older Adults with Mild Cognitive Impairment [2.2] 軽度認知障害(MCI)の高齢者の抑うつと不安は、ケアへのアクセスが限られているため、しばしば診断される。
既存のマルチモーダル解析手法には3つの制限がある。
本稿では,多モード融合フレームワークTAMIを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:19:32 GMT)
Deploying DeepSeek 175B Locally on a Single Consumer-Grade RTX 4060 Laptop with 32GB RAM for 200k-Scale Protein-Ligand Virtual Screening [2.2] 大規模言語モデル(LLM)はタンパク質-リガンド相互作用予測において例外的な性能を示した。
大規模言語モデル(LLM)の最近の進歩は、タンパク質-リガンド相互作用予測において例外的な性能を示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:35:56 GMT)
PRO-Step: Step-level Process Reward Optimization for Retrieval-Augmented Generation [2.2] Pro-STEPを導入し、各ステップにおける論理的妥当性と明らかな根拠を評価する生成的PRMを訓練する。
シングルホップとマルチホップのQAデータセットの実験では、PRO-STEPが5つのベンチマークで最高の平均EMとF1を達成することが示された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:34:10 GMT)
ObjectSplat: Improving Mesh Fidelity and Interactivity for 3D Scenes via Object-Level Mesh Splatting [2.2] Splattingベースのアルゴリズムは、通常の画像からフォトリアリスティック、リアルタイムレンダリング、メッシュエクスポート可能な3Dシーンを再構築する。
我々は、各フレームからインスタンスを分割し、残りのものを背景として検討し、各インスタンスと背景をメッシュスプレイティングで独立に再構築し、それらを単一のシーンに構成する、分解前再構成アプローチを提案する。
提案手法は, メッシュの忠実度(Fスコアの5%以上)と新規ビュー合成を向上し, オブジェクトワイド・モディフィビリティと対話性をサポートした。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:20:53 GMT)
A Public-Key-Dependent Adversarial-Deletion Ceiling for Fixed-Alphabet Multi-Bit Pseudorandom Codes [2.1] 擬似乱数符号(英: pseudorandom code、PRC)は、一様文字列と計算的に区別できない誤り訂正符号である。
固定字幕上のパブリックキーのPRCを、敵の削除に対して研究する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:31:03 GMT)
Supraglacial Lake Fate Is Knowable Long Before the Season Ends [2.1] それぞれの結果が実際にどれだけの期間必要とされるかを測定する。
結果は一貫した順序で解決される。
クラスごとの軌道を生成するすべての学習者は、シーズン終盤のアキュラティが最大で18ドルまで異なるにもかかわらず、それを再現する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 00:58:47 GMT)
Convergence rates for the RMSprop optimizer with full control of the hyperparameters [2.1] 本稿では, RMSprop の第2モーメントプロセスに適した逆モーメント境界であることを示す上で, 革新的な新機能を提案する。
このような手法の関連性が高いにもかかわらず、そのような手法の誤差推定を提供するためのオープンな研究課題である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:37:57 GMT)
Automated Testing of LLM-Based Post Hoc Explainers Using Model Checking as an Oracle [2.1] 大規模言語モデル(LLM)は、シーケンシャルな意思決定ポリシーの説明として用いられる。
LLMは、しばしば可算だが誤った文を生成する。
そのような説明が根底にある環境に忠実かどうかを体系的に検証するアプローチは存在しない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:54:37 GMT)
Do Small Models Use the Law You Give Them? Measuring Context Use on a Bilingual Bangladesh Legal Benchmark [2.1] 微調整は、文脈で供給される法律の使用方法を改善することなく、法的質問応答精度を向上させることができる。
我々は,階層保存法定コーパス,2,165個のバイリンガル微調整例,150項目の供給法則制御を構築した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:45:16 GMT)
Deterministic Universal Logical Gates for Finite-Energy GKP Qubits in Trapped Neutral Atoms [2.0] 閉じ込められた中性原子の調和運動状態に符号化された有限エネルギー Gottesman-Kitaev-Preskill qubit に対する普遍論理ゲートセットを提案する。
内部電子状態は相空間における状態依存条件変位を実装するためのアンシラとして機能する。
過渡リドバーグ励起による原子双極子-双極子相互作用は、遮断機構を起動することなく制御Zゲートを可能にする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:41:08 GMT)
Generative Models Enhanced by Sequence Labelling and Aspect-Code Switching Improve Cross-lingual Aspect-Based Sentiment Analysis [2.0] 言語横断的なアスペクトベースの感情分析(ABSA)は、注釈付きデータを持つソース言語からターゲット言語に知識を伝達する。
本稿では,言語間ABSAを強化した新しいSeqLabフレームワークを提案する。
我々は11の言語、3つのドメイン、2つのバックボーンモデルに対するアプローチを評価した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:21:46 GMT)
Fast Fault-Tolerant Decoders for Hypergraph Product and Lifted-Product Codes [1.9] 我々は、量子低密度パリティチェック(QLDPC)符号のための低複雑でフォールトトレラントなデコーダを設計する。
電子回路レベルのノイズモデルの下では、2つの主要なデコードボトルネックを目標としています。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:18:29 GMT)
Foundation models for electricity price forecasting and battery arbitrage: Can they replace market-specific forecasting models? [1.9] ファンデーションモデルは、タスク固有のトレーニングがほとんどあるいは全くない正確な予測を約束するが、電気価格予測に特化したモデルを置き換えることができるかどうかは不明だ。
ゼロショットモードで評価された5つのファウンデーションモデルファミリーの9つの変種と、2021年から2025年にかけてドイツ、ポーランド、スペインの2つの最先端の電力価格予測ベンチマークを比較した。
TabPFNモデルのみが3つの市場すべてでベンチマークを上回っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:43:04 GMT)
Schwarz: Solver-Aware Agentic Program Verification [1.9] Schwarzはエージェントによる検証ハーネスで、SMTが支援する証明の失敗を局所的に、チェック可能で、修復可能である。
我々は、CとRust/Verus用のSchwarzを実装し、1,475のタスクで評価する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:54:48 GMT)
Reliable Benchmarking of Artifact Detection in Computational Pathology: A Reproducibility and Uncertainty Analysis [1.9] メソッド: このプロトコルは、テストセットサンプリング、トレーニング性、パーティション構成、文書化前処理の4つの変数ソースを定量化する。
拡散型人工物検出装置を独立に再構築し, 元の24スライディング分割と教師付きベースラインに対して評価した。
結果: 本手法の中枢機構は、補助的コントラスト項は、プールされたF1を0.673から0.688に改善し、第2シードで複製する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:07:15 GMT)
CRESSim-Neo: A Batched GPU Simulation Engine for Surgical Robotics and Robot Learning [1.9] CRESSIM-Neoは、外科ロボティクスとロボット学習のためのバッチGPUシミュレーションエンジンである。
組織操作、流体吸引、縫合、ケーブル駆動ロボット、超音波画像合成などの応用をサポートする。
本研究では,剛体,変形可能な体,流体シミュレーションのタスクに対して,視覚ベースおよび手術ロボット学習シナリオを含むCRESSim-Neoを実演する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:49:04 GMT)
Explainable Artificial Intelligence for Industrial Cybersecurity: A Review of Methods, Operational Integration, and Research Challenges [1.9] 人工知能(AI)と機械学習(ML)技術は、ますます産業用サイバーセキュリティオペレーションに導入されている。
説明可能な人工知能(XAI)は、AIによるサイバーセキュリティ決定の透明性と解釈性を改善するための、有望なパラダイムとして登場した。
本稿では,産業用サイバーセキュリティにおけるXAI技術の概要を概観し,産業用システムと運用用セキュリティに注目した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:02:10 GMT)
Evaluating and Improving LLM Self-Modeling [1.8] 我々は、素早い編集がモデルの最終的な答えを変えるかどうかなど、検証可能な行動問題に焦点を当てる。
現在のモデルは、非自明だが限定的な自己モデリングスキルを示している。
我々は、自己モデリングトレーニングデータを生成するスケーラブルな合成データパイプラインを開発する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:37:51 GMT)
A Roadmap to Available ICS Datasets and Testbeds for Cybersecurity Research [1.8] 産業制御システム(ICS)は多くの重要なインフラ分野のバックボーンである。
運用技術(OT)とITの融合と産業用4.0技術の展開により、ICS環境の攻撃面が増大する。
多くの研究者がICSのサイバーセキュリティ分野に興味を示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:48:24 GMT)
Latent-Space No-Arbitrage Geometry of Generative Models for Implied Volatility Surfaces [1.8] インプリートボラティリティ曲面の生成モデルは、静的な非軌道制約を満たす出力を生成する必要がある。
固定発生器では,各潜伏符号に生成面の非偏差条件によって決定されるスカラーマージンを割り当てる。
我々は、厳密な許容符号が小さな摂動の下で許容される条件を確立し、許容集合の境界はゼロマージンによって特徴づけられる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:27:40 GMT)
The Irreversibility Budget: Fleet-Level Risk Accounting and Admission Control for Agent Operating Systems [1.8] 現在のコントロールは、一度に1つの効果をチェックするので、個別に認可されたエージェントの群れは、共有トリガーの下で、プリンシパルのリスクを過大に引き込むことができる。
本稿では、信頼されたランタイムが各プリンシパルに対して維持する残値リスクの累積的な計算である可逆性予算を提案する。
非可逆性を第一級資源として扱うと、ランタイムは各エージェントの残余損失をエージェントより低くし、アグリゲーションが予算を過大に上がれば限界効果を否定する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:18:09 GMT)
Practical Implementation Report on Introducing Spec-Driven Development Using AI Agents in Software Development PBL [1.8] 本稿では,AIエージェントをベースとしたソフトウェア開発手法であるSpec-Driven Developmentの実装について報告する。
調査、計画、実装、レビューという4つのフェーズからなるワークフローを定義しました。
我々は,学生の主観的AI利用,実装スループット,コード理解という3つの視点から分析を行った。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:47:29 GMT)
Exact quantum splitting and the structure of finite algebras [1.7] ベルカンプのアルゴリズムは、決定論的線型代数により、平方自由の$finmathbbF_q[x]$を分解する。
我々は、効率よく計算可能な角度で1量子ビットの回転を許す回路モデルに、無条件の正確な量子的実装を与える。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:56:14 GMT)
Inverse kinematic solution for generic 3R positional robots using Conformal Geometric Algebra [1.7] コンフォーマル幾何代数(CGA)の利点を利用した3Rロボットの逆運動モデル(IKM)を提案する。
提案手法は, 2つの円の交叉として問題を再検討することにより, テータを除去することなく, 直接一意性が得られる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:01:15 GMT)
Geometric analysis of generic 3R robots, and necessary and sufficient conditions for a class of orthogonal robots to have four IKS [1.7] 本稿では,共形幾何代数に基づく手法から継承された逆運動モデルを用いた汎用3Rロボットの運動解析について述べる。
本稿では,3Rロボットが4つの逆運動解(IKS)を持つ場合の条件について検討し,ワークスペースで見られるようなIKSの分布について検討する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:07:32 GMT)
Optimized Modular Design and Development of a Tilt-Rotor Bicopter Drone [1.7] チルトローター・バイコプターのようなハイブリッドシステムは、固定翼と回転翼の技術の両方の利点を兼ね備えている。
本報告では, 従来型バイコプターのモジュール設計について, 広範囲な解析と深部構造および空力シミュレーションに基づいて検討した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:10:42 GMT)
Uncertainty of Vision Medical Foundation Models [1.6] 本研究では,事前学習アプローチ,データセットスケール,ドメインが点数および領域レベルの不確実性定量化に与える影響について検討する。
その結果、高品質なドメイン特化データセットの事前学習と自己教師付き学習が、より良い校正点予測に繋がることを示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:43:50 GMT)
Identity-Conditioned Latent Consistency Distillation for Face Synthesis [1.6] 拡散モデルは高忠実度画像合成において大きな成果を上げてきたが、その反復サンプリングプロセスは大規模生成を計算上コストがかかる。
同一性条件の顔合成は、潜在一貫性モデルにより、計算コストが大幅に低く行えることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:32:40 GMT)
Provably Safe Decentralized Contingency MPC under State-Only Information and Limited Sensing for Nonlinear Multi-agent Systems [1.6] 分散並行性MPCは、状態のみの情報パターンの下でマルチエージェント制御を行う。
このフレームワークは、安全均衡に対する実行可能な緊急操作が常に利用可能であるエージェントワイズフォールバック領域(セーフセット)に依存している。
下位の保証を維持しながら、より保守的な非集中的なインタラクションをサポートする、新しいセーフセット更新メカニズムが導入されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:33:59 GMT)
LCoT-GV: Graph Attention Networks for Verifying Long Reasoning Chains in Large Language Models [1.5] 本稿では,Long Chain-of-Thought Graph Verifier (LCoT-GV)を推論グラフとして表現するグラフベースのフレームワークを提案する。
グラフ注意ネットワークは、推論グラフからチェーンオブ思考の正しさを予測するために訓練される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:21:22 GMT)
CHASE: How Content Ecosystems Are Reshaped When Ranking Is the Only Target [1.5] 本稿では,Ranking Signal Exploitation (CHASE)の下でのコンテンツ均質化について紹介する。
固定LDMランキング信号に対する繰り返し最適化が、コンテンツ人口とコンテンツクリエーターが直面するインセンティブの両方を再構成できることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:53:56 GMT)
Different representation learning objectives recover distinct latent structures from the same psychometric data [1.5] 行動構造は,小児のSDQ,ASBI,CBRS項目の反応によって特徴づけられた。
比較対象はPCAに基づく表現に対する教師・児童の検索を著しく改善した。
協調的アライメントと行動予測を協調的に最適化するマルチタスク目標が部分的に復元されるが、検索性能は低下する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:24:35 GMT)
Evaluating and Mitigating Anti-LGBTQ Biases in German and Multilingual Language Models [1.4] 本稿では,言語モデルにおける反LGBTQバイアス評価のための多言語ドイツ語-英語ベンチマークデータセットを提案する。
ドイツ語話者のクィア人からのコミュニティソースのステレオタイプと、ドイツ語訳のWinoQueerを組み合わせたものである。
結果から, 言語モデルは, 同一性やモデルによって異なる反クイアステレオタイプを再現することがわかった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:42:36 GMT)
NeoMME: A Single-Tower Multimodal-Native Multilingual Foundation Encoder for Efficient Fine-Tuning and Inference [1.4] 260Mと800Mのマルチモーダルおよび双方向の多言語文書エンコーダであるNeoMMEを紹介する。
どちらのモデルも、マスク付き離散拡散テキストの目的によって、ゼロから事前訓練されている。
ViDoRe v3ベンチマークでは、結果のNeoMME-Retriever 260Mが0.523 nDCG@10で評価されたモデルを上回っている。
NVIDIA L40Sの2048x2048画像入力サイズで、NeoMME-260MはColModernVBERTの2倍のスループットでページをエンコードする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:08:15 GMT)
Instance-Guided Report Anchoring for Text-Free 3D Abnormality Segmentation in Chest CT [1.4] 本稿では,各アノテート異常インスタンスとそれを記述するレポート発見との対応性を保持するモデルに依存しないモジュールIGRAを提案する。
IGRAはイメージのみのベースライン(30.93対25.25)よりも22.5%改善し、シングルフィンディングサブセット(30.29対30.43)のVoxTellに匹敵する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:38:11 GMT)
Spatial correlations of photons interacting via transverse Rydberg blockade [1.4] 我々は、リドベルク非線形媒質における2つの相互作用する光子の逆空間力学の理論を開発する。
ライドベルク偏光子として伝播する光子の縦方向および横方向の相関関係を探索する。
我々はこれらの相関関係の異なる挙動とスケーリング法則を,2つの方向の基本的な異なるメカニズムから同定する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:40:00 GMT)
ECGQuest: Benchmarking and Fine-Tuning Language Models for Electrocardiography [1.3] ECGQuestは、ECG固有の言語モデルの評価と微調整のための文学的なリソースである。
ゼロショット環境でのホールドアウトテストセットにおいて,3つの商用および20のオープンソース言語モデルを評価した。
汎用モデルは医学的に専門化されたモデルより優れ、いくつかのモデルは強いTrue/Falseバイアスを示し、エンコーダのベースラインは偶然に実行された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:45:58 GMT)
SMART: MLLM-guided Temporal Alignment for Unifying Sign Language Recognition and Spotting [1.3] MLLM誘導による手話認識とスポッティングのための時間的アライメントフレームワークを提案する。
SMARTは、動作記述を補助的なセマンティックキューとして使用し、小さなバッチトレーニングで安定したビデオテキストアライメントを実行する。
4つの手話ベンチマークの実験では、認識タスクとスポッティングタスクの両方でSMARTの有効性が示されている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:15:36 GMT)
VeriCam: A Verification Baseline for the Classification of Unknown Data [1.3] 本研究では,未知のクラスを未知のデータに分類できる特殊な特徴を学習するためのパイプラインを提案する。
VeriCamは、検証タスクのためにトレーニングされた画像モデルの表現力を利用する。
パイプラインは、現実の交通監視画像を含むLPLCv2データセットで検証される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:12:59 GMT)
Constrained minimax approximation for quantum signal processing [1.3] 量子信号処理(QSP)は、量子回路を用いて変換を実装するためのシンプルで効率的なフレームワークを提供する。
その古典的な設計段階は、制約付き近似問題(英語版)をもたらす: ミニマックスパリティ(英語版)(minimax parity)は、適合集合上で一様にターゲット関数を近似し、領域$[0,1]$で一等に有界なままである。
離散化は問題を線形プログラムに変換するが、有限個のサンプリングされた点の集合における実現性は、領域全体の実現性を保証するものではない。
アクティブセット制約強制と組み合わされたRemez交換法は、多くのテストインスタンスにおいて効率的であるが、安定性はターゲットに依存している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:10:52 GMT)
GMTS: Gradient Magnitude-based Token Selection Improves RLVR Training for LLM Reasoning [1.2] 本稿では,トークンの重要度を定量化するために,グラディエント・マグニチュードに基づくToken Selection(GMTS)手法を提案する。
GMTSがランク付けした上位20%トークンのトレーニングは、3つの推論領域と様々なモデルサイズでエントロピーベースのトークン選択よりも一貫して優れています。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:41:11 GMT)
Well-conditioned iterative methods for large open quantum systems [1.2] マルコフの開量子系はリンドブラッド・マスター方程式 (ME) $fracmathrmdmathrmd t _t = MathcalL _t$ でモデル化されている。
本稿では、リンドブラッド方程式の一部が、いわゆるノージャンプ進化である$mathcalS$に対応して、効率的に逆転可能であることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:22:05 GMT)
Operational Regimes in Non-Convex Optimization: A Multiplier-Based Taxonomy [1.2] 本稿では,KKT定常点におけるラグランジュ乗算器の符号に基づく制約付き非制約最適化のための構造的分類法を提案する。
ベクトルのない4つの形は、この二重空間を非制約、リソース制限、飽和、強い結合、ハイブリッドの5つの運用体制に分割する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:22:05 GMT)
Science sandboxes measure the scientific capability of AI agents [1.2] AIエージェントでこの能力を研究するためのフレームワークであるScience Sandboxを紹介します。
我々はこの枠組みを、規制ゲノム学のモデルとタンパク質の適合性予測の2つの生物学的設定でインスタンス化する。
特に、彼らの科学的推論は、ルールがよく知られた生物学的先行概念の外に落ちているシステムに遭遇した時に悪化した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:33:38 GMT)
Conjoint Audio-to-Spikes Encoding and Processing for Efficient Neuromorphic Speech Recognition [1.2] この研究は、最初のエンドツーエンドのニューロモルフィック・スパイクエンコーディングを導入し、TIMITデータセットの評価を行った。
我々の単純なフィードフォワードネットワークは、スパイクエンコードされたハイデルベルク・ディジットの分類精度99.77%に達する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:47:14 GMT)
TPR-Attention for Combinatorial Generalization [1.2] 構造化帰納バイアスをディープラーニングに組み込む新しいアーキテクチャコンポーネントを導入します。
本稿では,このTPRアテンション機構が,既存のアーキテクチャコンポーネントの一般化よりも優れていることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:18:44 GMT)
Mode Connectivity Beyond Classifiers: Evidence from Generative and Contrastive Models [1.2] 複雑なネットワークのためのアーキテクチャ対応接続構築アルゴリズムを提案する。
我々は独立に訓練されたDDPMとNanoCLIPモードのモード接続性を実証した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:24:57 GMT)
Late Transformer Layers Recode Syntax Canonically: Evidence from Greek Scrambling and Cross-Layer Generalisation [1.1] 構文情報は 初期と中期の変圧器層では 復調できるが 後の層では その情報がどうなったかは 未解明のままだ
厳密に制御された最小ペアに対して評価されたギリシア語で調整された3つの大言語モデルに対して,多層一般化解析を適用した。
後期層(20-31)で訓練されたプローブを各初期層で個別にテストすると、非標準文の99.3%を標準文として分類し、下位の転送(クラスタ補正、p0.01)が生成される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:54:13 GMT)
Implementing neural network mixed-effects models in Template Model Builder (TMB) [1.1] テンプレートモデルビルダー(TMB)を用いたニューラルネットワーク混合効果モデル(NMM)の実装のための汎用フレームワークを提案する。
TMBでは、ユーザは負の関節ログと任意の正規化条件のみを指定する必要がある。
TMBベースのNMMの効率性, 柔軟性, 統計的性能を2つの数値例で示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:43:02 GMT)
Geometric Attractor Monitoring: A Robust and Frugal Framework for Multi-modal Industrial Robotic Cycles [1.1] 我々は、位相空間再構成(PSR)に基づく産業用ロボットの健康状態監視フレームワークを開発する。
提案手法は,3年間で21個の異種ロボットと合成ランゲヴィンシステムを用いて,標準的なディープラーニングベースラインより優れている。
アルゴリズムバイアスを対象システムの幾何学的特性と整合させることで,実用的でトレーサブルで容易に展開可能なアプローチが得られることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:55:10 GMT)
VFR-Audit: Verdict-Level Reliability for Fairness Audits in Hospital Length-of-Stay Prediction [1.1] 臨床人工知能におけるフェアネス監査は、連続したフェアネス指標を、運用しきい値に対するバイナリパスまたはフェイル判定に変換する。
本稿では,VFR(Verdict Flip Rate)を中心に構築されたフレームワークであるVFR-Auditを提案する。
VFR-AuditはVFRを3つの信頼性軸と共に報告している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:14:21 GMT)
Not to Break, but to Attest: Adversarial Probes for Privacy-Preserving LLM Verification [1.0] 大規模な言語モデルへのデプロイ後の変更は、ルーチン出力をほとんど変更することなく、振る舞いを変更する可能性がある。
本稿では,zk-SNARKをベースとしたプライバシー保護型監査フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:27:45 GMT)
What Emerges and What Breaks in Self-Play Driving [1.0] 純粋なセルフプレイによる自動運転ポリシーのトレーニングは、最近、有望な結果を示している。
我々は、同様のセルフプレイ方式で運転ポリシーを訓練するが、モデルを実際の都市の高解像度マップで訓練するように拡張する。
我々は、自己プレイから生じる交通ルールと、それが人間の運転にどの程度近いかを分析し、報酬条件付けが運転行動の意図した多様性をもたらすことを確認した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:01:32 GMT)
TaxCE : A Framework for Automated Taxonomy Construction and Evaluation at Scale [1.0] TaxCEは、構造化されていないフィードバックテキストを階層的な分類に整理するための完全に自動化されたフレームワークである。
本稿では,3つのコーパスグラウンド評価指標,排他性,排他性,粒状性(EEG)を紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:25:25 GMT)
Drishti: AI-Led Human-Directed Vulnerability Auditing for 5G Cores [1.0] 我々はAI主導のヒューマン指向の脆弱性監査フレームワークであるDrishtiを紹介する。
Drishtiには4つのコンポーネントがある: (i) 検証のためのアンチパターンカタログ、 (ii) 到達性のためのクリティカルパストリアージ、 (iii) 影響の検証、 (iv) 修正完全性のためのパッチレビュー。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 00:54:51 GMT)
Do LLMs Know Your Neighborhood? Auditing LLM Priors for Neighborhood-Level Mobility Prediction and Structural Alignment [1.0] 大規模言語モデル(LLM)は、可塑性モビリティトレースを生成し、個々の動きを予測することで、潜在的な代替手段を提供する。
Census Block Group レベルモビリティ予測におけるゼロショット LLM の評価を行った。
LLMは都市環境から部分的に集合移動パターンを復元できるが、その予測は構造的基盤として扱うべきではない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:39:33 GMT)
The Structure of Merging Turbulent Jets Beneath a Small Quadrotor [1.0] 本研究では, ホバリング・クアロータのダウンウォッシュに関する詳細な粒子画像速度測定を行った。
4つのロータージェットは1列に$z/lの近似5$で合流し、その先では平均速度プロファイルが正準円ジェットの自己相似形状に徐々に接近する。
D_texteff = 2.29,l$, effective Reynolds number $Re_D_texteff = 3 times 104$, with an effective source diameter $D_texteff = 2.29,l$, effective Reynolds number $Re_D_texteff = 3 times 104$
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:50:54 GMT)
Sources of Truth: A Multi-Platform, Multilingual Audit of Citations in AI Mental Health Information Queries [0.9] 1,140の応答と1,713のユニークなドメインで15,942の励起を記録しました。
最も暗唱された10のドメインは43.6%のイングランドの引用であった。
プラットフォームは典型的な引用量ではほとんど異なりませんでしたが、一貫性と、彼らが好んだソースタイプは著しく異なりました。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:09:28 GMT)
Online Estimation of Dynamic Origin-Destination Matrices Using Reinforcement Learning with Link-Flow Propagation Guidance [0.9] オンライン動的原点決定(OD)行列推定(DODE)は、観測されたリンクフロー軌跡を再現するために時間依存のOD需要を校正する。
近年,強化学習(RL)が有望な代替手段として登場し,計算負荷の低減が図られている。
本研究では,リンクフロー伝搬誘導(LFPG)をポリシー最適化に統合したLFPG-RLを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:33:21 GMT)
BLOOM-WILT: Logit Tilting for Behaviour Elicitation in Automated LLM Auditing [0.9] BLOOM-WILTは、トレーニングコストやターゲットの次のトーケン分布を越えてアクセスすることなく、レアな振る舞いの自然なマルチターンインスタンスを提供する。
WILTを4つのターゲットモデルと8つの動作で評価し、32設定のうち30設定でベースライン監査を破る。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:10:59 GMT)
Invalidation Contracts for Cross-Episode Agent Memory [0.9] APIエラーからのリカバリ提案をキャッシュするLLMエージェントは、後続のエピソードでリデリベーションをスキップすることができる。
サーバ側のデータドリフトは、キャッシュされた修正をサイレント障害にします。
バージョンスタンプとキャッシュ可能性ヒントをすべてのリカバリ提案にアタッチするプロトコル層である、無効化契約を導入する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:45:07 GMT)
A Unified Framework for the Mechanics of Information in Convolutional Neural Network Image Space [0.9] 本稿では,畳み込みニューラルネットワーク(CNN)による情報伝達をモデル化するための統一的な数学的枠組みを提案する。
広く使用されている非線形整合畳み込み演算の下で、離散フィルタ対称性と相対論的エネルギー-モーメント関係をリンクする対応を示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:47:24 GMT)
State of Health Estimation using Convolutional and Bidirectional LSTM Neural Networks tuned by Bayesian Optimization [0.9] 畳み込みニューラルネットワーク(CNN)と双方向長短期記憶(BiLSTM)ニューラルネットワーク(NN)の結合によるハイブリッドディープラーニングアーキテクチャを用いたSOH推定のための新しいフレームワークを提案する。
中間層を有するモデルが最も高い予測精度を示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:08:33 GMT)
Adapting Without Gradients: Affine Statistics Transport and What Its Certificate Can Tell You [0.9] テスト時間適応は、モデルパラメータを推論時に更新できると仮定する。
学習したモデルが凍結したままでいなければならない場合、適応性について研究する。
本稿では、ソースクラス統計を識別サブ空間に格納するCASTERを紹介する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:07:36 GMT)
Retrieval, Scoring, and Decoding Shape Performance and Stability in LLM-based Conversational Recommendation [0.8] 大型言語モデル (LLM) はレコメンデーターシステムにおいてリランカーとして使われることが多い。
プロプライエタリ,オープンウェイト,微調整のLLMリランカと協調フィルタリング,シーケンシャルベースラインを比較した。
強力なプロプライエタリなリランカーにとって、セマンティックからコラボレーティブなフィルタリング候補への切り替えは、NDCG@10を50%以上引き上げる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:54:20 GMT)
A Phased Workflow for Operating LLM-Based Coding Agents [0.8] InfobipのAI研究チームが開発したコーディングエージェントを操作するための段階的ワークフローについて報告する。
コンテキスト管理は、既知の障害モードに対応するために各フェーズで適用される4つの戦略を通じて対処される、中心的な関心事である。
ワークフローの有効性のためのメトリクスの欠如と、形式化されたコンテキスト管理コンポーネントと実践者が必要とするワークフローレベルのパターンのギャップです。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:39:26 GMT)
Beat-Synchronous Tokenization for ECG Transformers [0.8] トランスフォーマーベースの心電図(ECG)モデルは、一般的に波形を固定時間パッチにトークン化する。
本研究では, ビート同期トークン化を生理的根拠のある代替手段として検討した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:25:12 GMT)
From Metaheuristics to Exact Methods: A CP-SAT Approach for Multi-Objective Healthcare Workforce Scheduling [0.8] 本稿では,マルチロール・マルチスキル医療スケジューリングのための制約プログラミング式CP-SATを提案する。
CP-SATは、規制違反がゼロであることを保証し、統一された重み付きペナルティ関数によって15のソフト目標を最適化する。
この定式化により、業界平均の約3倍の29の制約が課せられる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:17:01 GMT)
Collapsibility of Performance Metrics in Clinical Predictive AI [0.8] いくつかのパフォーマンス指標は非折り畳み可能であり、これは集団全体のパフォーマンス値がサブグループ固有の値の重み付き平均値と等しくないことを意味する。
5つの性能指標(AUC,キャリブレーションインターセプト,キャリブレーション勾配,予測キャリブレーション誤差,Nagelkerke R2)は非崩壊性を示し,10(O:E比,ログロス,ブライアスコア,精度,F1スコア,真正,正負,正負,正の予測値,負の予測値,純利益)は崩壊性を示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:43:22 GMT)
Assessing Alignment and Stability of Feature Importance Explanations via Weight of Evidence [0.7] 特徴重要度法(FIM)は、モデル予測を解釈するために説明可能なAIで広く用いられている。
We introduce a novel perspective by embedded FIMs in a hypothesis-testing framework based on Weight of Evidence (WoE)。
我々は、観察された証拠が特徴的重要性に関する任意の仮説をどれだけ強く支持するかを定量化する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:00:05 GMT)
Don't Trust the Code, Check Its Effects: Runtime Refinement for Regenerated Systems Code Under an Adversarial Generator [0.7] 最近の作業では、仕様からシステムコードを生成するために、大きな言語モデルを使用している。
ここで運用する唯一の安全な方法は、生成されたコードに対して行動する権限を否定することです。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:06:48 GMT)
Using Hyper-V Sockets for Real-time Data Extraction from a Malware Analysis Sandbox [0.7] 我々は、WinSock TCPソケットと比較して、Hyper-VソケットはTCP/IP層ブロッキングの対象ではないことを示す。
2つの通信チャネルのスループットをバッファサイズの関数として比較する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:39:15 GMT)
A Composition-Aware Pretraining Framework for Geospatial Foundation Models [0.7] 本研究では,土地と土地の混合を明示的に符号化した構成対応事前学習フレームワークを提案する。
各衛星画像セルは、その部分的な土地被覆分布を表すヒストグラムにマッピングされる。
実験により,構成意識による事前学習が地域レベルの理解タスクにおいてかなりの利益をもたらすことが示された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:00:12 GMT)
Designing an Auditable LLM-Supported Workflow for Qualitative Thematic Analysis [0.7] 本稿では,帰納的および潜伏的セマンティック分析の聴覚的かつプライバシーに配慮した計算操作について述べる。
ソースコードへの明示的なリンクを保持しながら、コード、分析的正当化、テーマ、テーマ記述を生成する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:11:20 GMT)
Lightweight Adaptation of EEG Foundation Models for Stroke Motor Imagery Decoding: Domain Shift and Subject-Level Robustness [0.7] 我々は,Low-Rank Adaptation (LoRA) が2進左と右のMIデコードに対して,事前学習した3つの脳波基礎モデルに効率的に適応できるかどうかを検討した。
凍結バックボーンヘッドオンリーベースラインとLoRA適応を主観的5倍のクロスバリデーションを用いて評価した。
LoRAはLaBraMベースで0.822、REVEベースで0.957まで精度を向上した。
最強ストローク構成であるREVE-base LoRAは, インテリアコホート・アウト・オブ・サブジェクト・アウト・クロスバリデーションを用いてさらに評価した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:26:41 GMT)
Minerals in the Wild: A Hyperspectral-XRF Dataset for Elemental Composition Estimation [0.7] ミネラルズ・イン・ザ・ワイルドは、ヨーロッパ全土で収集された1,132個の岩石標本からなるデータセットである。
各試料について,XRFセンサを用いて得られた要素的特徴とHSIの取得について検討した。
我々は,HSI画素とUSGSスペクトルシグネチャをマッチングするための凸最適化アプローチに先立って,USGS辞書から離れたシグネチャを除去するプルーニング機構を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:04:14 GMT)
E-SENS: Exclusion-Sensitive Penalization for Negative-Constraint Retrieval [0.6] E-SENSは、否定に敏感な検索のためのトレーニング不要なランク付け方法である。
ExcluIRでは、E-SENSは4つの埋め込みモデルにまたがる明確なリコール違反のトレードオフを示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:28:49 GMT)
Beyond Accuracy: Quantifying Pulmonary Attribution in Anatomy-Guided Chest X-Ray Classification Under Domain Shift [0.6] 深層学習モデルは、肺画像の内容に依存するかどうかを判断することなく、強い胸部X線分類性能を達成することができる。
本研究は,肺アトリビューションの含有量について,診断成績と異なる解剖学的関連信頼性特性として評価した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:54:44 GMT)
When the Martingale Never Stops Firing: Anytime-Valid Gating on Real Forecast Streams [0.6] 任意の時間価推論は、いつでも実行できる証拠を約束する。
デプロイは、監視するストリームが交換可能に振る舞う場合に限り、それを継承する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:32:11 GMT)
LaMoC: Loss-Aware Modular Compression for LLMs [0.6] LaMoCは、グラデーション・エラーアライメントを通じてアクティベーションと経験的フィッシャー統計をブレンドする、損失対応のモジュラ圧縮手法である。
LaMoCは、最先端のモジュラ圧縮法よりも平均2.5%のパープレキシティの低減とタスク精度の1%の相対的な改善を実現している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:20:31 GMT)
Personas Differ from Native-Language Generation: Language Pathways Shape LLM Interpersonal Advice [0.6] 言語や文化に関するバリエーションを引き出すための一般的なショートカットは、モデルにネイティブスピーカーとして答えるように求めることである。
このネイティブ話者ペルソナは、モデルがターゲット言語でアドバイスを生成する際に得られた出力を再現するかどうかをテストする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:33:26 GMT)
Workload Identification with Physical Side Channels for AI Governance [0.5] 外部オブザーバは、NVIDIA H200上で動作するワークロードのクラスを、そのパワードローから特定できることを示す。
推論としてトレーニングを偽装するために4つの回避策がテストされ、さらに680個の敵の痕跡が得られた。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:59:35 GMT)
Investigating Hyperparameter Optimization and Transferability for ES-HyperNEAT: A TPE Approach [0.5] 木構造型Parzen Estimator (TPE) は、30億以上の潜在的組み合わせからなる探索空間を探索するために用いられる。
TPEは、この広大な空間を効果的にナビゲートし、平均、中央値、そして最高の精度でランダム検索を著しく上回っている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:39:47 GMT)
The PUR-1 Cyber-Physical Digital Twin [0.5] PUR-1 DTは、完全な高忠実度物理ベースのAI駆動仮想モデルスタックを備えたサイバー物理デジタルツインである。
フルリアクトル運転サイクルにおけるリアルタイム同期状態推定と短期予測を実証する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:10:29 GMT)
Tunable-Size Unruh-DeWitt Detector in a Multimode Cavity [0.5] Bose-Einstein Condensates (BECs) に基づく量子シミュレータは、相対論的量子場現象を研究するための強力なプラットフォームを提供する。
本稿では, 固有運動量選択型Unruh-DeWitt検出器モデルを用いて, この制限を克服することを提案する。
我々は、一様線形加速度と一様円運動に対するそのような検出器の応答を解析的に計算する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:44:04 GMT)
Generalization as a robust performance property of learning-enabled dynamical systems [0.5] 学習可能な力学系における一般化のシステム理論的解釈を提供する。
本研究では,従来の勾配降下法を復元し,重ボールやネステロフ加速度などの運動量に基づく手法に自然に適用し,データ駆動制御にまで拡張した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:25:50 GMT)
Multi-View Reflective Surface Inspection via Semantic-Saliency Cross-Verification [0.5] 反射型スマートフォンカバーガラスは、一つの固定された視点から検査することが困難である。
本稿では,各RGB観測を共有ビューの専門家が処理する多視点検査フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:48:39 GMT)
Fairness in multi-class multi-group classification problems via contextial coherent risk measures [0.4] 本稿では,ベクトル値の感度属性の存在下での多クラス分類問題に対する公平な分類器の設計を提案する。
本稿では,サポートベクタマシンフレームワークや公平性を扱う他の手法と比較して,提案フレームワークの利点を実証する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:11:21 GMT)
AI Should Not Only Be Helpful. It Should Be Contingent. Artificial Intimacy, Sycophancy, and the Future of Social Learning [0.4] 我々は、AIシステムはユーザーの満足度だけでなく、人間の社会的学習への影響によって評価されるべきであると主張している。
我々は、軌道に基づく評価や社会的帰結予測のモデルを含む、随伴AIのためのフレームワークの概要を述べる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:23:14 GMT)
Trade-off between Cooling-Step Count and Geometric Implementation Cost in Non-Markovian Algorithmic Cooling [0.4] 本研究では, 冷却工程数と幾何的実装コストで定量化した冷却性能のトレードオフに, 貯水池記憶がどのような影響を及ぼすかを検討する。
貯水池メモリの抑制は冷却ステップ数を減少させるが、概して幾何学的プロトコルコストを増大させる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:01:59 GMT)
Real-Time Video Anomaly Detection Using YOLO Pose Estimation and CLIP-Based Semantic Scoring [0.4] 本稿では,リアルタイムビデオ異常検出のための軽量な2段階フレームワークを提案する。
第1段では、YOLO v11n-poseを使用して人物を検出し、単一の前方パスで17個の骨格キーポイントを抽出する。
第2段階は、CLIP ViT-B/32を介して、収穫された各人領域を符号化し、コサイン類似性を計算する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:47:29 GMT)
Fractal dimension predicts quantum kernel collapse in angle-encoded data [0.4] 角符号化された量子核は、特徴写像がデータの本質的な次元よりも広いときに崩壊する。
本稿では,事前量子ビット予算として相関フラクタル次元D2を提案する。
天井は、古典的なテーブルだけでなく、帯域幅で地図データペアの特性である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:25:19 GMT)
An Agentic Retrobiosynthesis Framework with Learned Frontier Selection [0.3] 微調整経路制御フロンティア選択は、生化学生成を変えることなく、予算付き探索を改善することができる。
その結果, 経路制御されたフロンティア選択は, 生化学的生成を変えることなく, 探索の予算を改善できることが示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:40:42 GMT)
MolLedger: An Additive Graph Neural Network with Chemically Grounded ADME Attributions [0.3] 本稿では,原子単位の属性を組み込んだ新しいグラフニューラルネットワークアーキテクチャを提案する。
我々のモデル MolLedger は原子毎のスコアの総和である予測を出力する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:44:27 GMT)
Protected Logical Qudits in Kitaev Quantum Double Models via Stable Representations [0.3] フォールトトレラント量子計算は、エンコードされた量子情報の堅牢な保護を必要とする。
有限群北エフ量子二重モデルにおいて、保護された論理キューディットを構築するための表現理論フレームワークを開発する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:58:08 GMT)
Device characterization of Si$/$SiGe double quantum dots using exchange oscillations in Earth's magnetic field [0.3] 等方的に濃縮したSi/SiGe中の残留核スピンによって生じる固有磁場勾配を用いて、2つの量子ドット間の交換振動を評価ツールとして実装する。
これらの結果は、交換専用および関連する半導体量子ビット符号化のための、より単純で関連性の高いゼロフィールド診断として、本質的な漸進的な交換発振を確立する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:02:10 GMT)
Opinionated, Hesitant and Stressed: Three Studies of How Politicians Speak in Four Slavic Parliaments [0.3] 4つのスラヴ語言語にまたがる話し言葉の大規模研究について述べる。
否定的な演説は、より高いピッチ、より強い強度、より速いレートで連続して作られる。
早期と後期のストレスに対する話者レベルの嗜好は、動詞、形容詞、名詞にまたがるが、副詞と固有名詞は分離される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:05:23 GMT)
NeuroPriv: Adversarial Representation Learning for Privacy in Wearable EEG Systems [0.3] ウェアラブルな脳波システムは、意図した健康機能を超えて機密情報を公開し、神経プライバシーに重大なリスクをもたらす可能性がある。
一般的な脳波の特徴は、意図した認知タスクをサポートすることに加えて、識別的アイデンティティと人口統計特性を明らかにすることができることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:19:22 GMT)
Authority-Inference Separation in Agentic Finance: First-Line Control, Blockchain Enforcement, and Replayable Assurance [0.3] オーソリティ-推論分離(AIS)は、金融行動意図を制御対象として扱う。
AISは特定の意図が作用するかどうかを決定し、ブロックチェーンは許可された権限をバウンドし、実行可能で、独立して監視可能である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:53:18 GMT)
BAITBENCH: Measuring Agent Reward Hacking with Optional Shortcuts Planted in ML Tasks [0.2] LLMエージェントは、人間の監視がほとんどないターゲットメトリクスを反復して、自律的なML実験を実行するために、ますます使われています。
これまでの研究は報酬のハッキングを文書化しており、生成された研究の妥当性と、AI R&Dの幅広い安全ケースに疑問を呈している。
BAITBENCHは3つの合成表型MLタスクからなるスイートで、それぞれにショートカットが含まれており、エージェントは公開テストスコアをインフレーションするが、隠れたテストセットで失敗する。
審査員の57.1%が報酬のハッキングを行い、7人中5人が50%以上である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:59:33 GMT)
ImageCAS-X: a dataset and benchmark for coronary artery segmentation and centerline extraction in coronary CT angiography [0.2] 心臓科医は、血管の追跡とセグメンテーションを半自動で行う方法に頼っている。
多くの自動手法が提案されているが、その検証は大規模で高品質な公開データセットの欠如によって制限されている。
我々は、一般に公開されているImageCASデータセットから800のスキャンに対して、中心ラインとメッシュサーフェスとともに、血管と冠動脈セグメントのvoxel-wiseアノテーションのデータセットを新たに提供します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:58:46 GMT)
Robust retinal biometrics for patient identity verification and retrieval across age and imaging devices [0.2] 患者のアイデンティティエラーは、縦断的な医療記録、研究データベース、下流の臨床的決定を損なう可能性がある。
請求項の正当性を検証し,色眼底画像から正当性を検索するための網膜生体計測システムを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:02:39 GMT)
Bosonic codes from compact phase spaces [0.2] 我々はあらゆる重みでコード空間の全塔を解析的に生成する。
1より大きいどの属に対しても、安定化基は非可換である。
正規化可能な量子状態は全ての安定化条件を満たすことができない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:55:49 GMT)
A Controlled Evaluation of Model Rankings and Input Reliance in Surface Water Segmentation [0.2] 表層水中セグメンテーションの性能評価は, モデル構成のランク付けにグローバル・クロスオーバー・ユニオン (IoU) のような集約計量を用いるのが一般的である。
総合的なメトリクスは、完全な構成のランク付けには有用であるが、ランキングの安定性、コンポーネントの属性、入力依存、デプロイメントのスコープには明確な証拠が必要である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:48:18 GMT)
Faithfulness Is Not Free: Auditing Offline KV-Cache Quantization in Retrieval-Augmented Generation [0.1] キーバリューキャッシュの量子化はストレージをさらに削減しますが、以前の作業では圧縮が忠実さを損なうかどうかを問いません。
我々はRGBとHotpotQAのQwen2.5-7B-インストラクションを評価し,精度と忠実度を測定した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:47:23 GMT)
Bounds on the Posterior-to-Prior Ratios for Inclusion Belief under Bounded Differential Privacy [0.1] 我々は、保護されたリリースを観察した後、個人がデータセットに含めるという敵の信念がどれほど変化するかを調査する。
これらの結果から, 差分的私的メカニズムによる推論的プライバシー保証は, 現実的にはかなり強い可能性が示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:01:06 GMT)
Generating Workflow DAGs from Natural Language with Non-Reasoning LLMs [0.1] ニューロシンボリックな分解により、より低コストで非合理的な大規模言語モデルにより複雑なワークフローDAGを生成することができることを示す。
本手法は,判定精度を24ポイント向上し,推論モデルのアウト・オブ・ザ・ボックス品質に対する統計的等価性を実現する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:01:29 GMT)
Terrestrial Gravitational Wave Detection with Atom Interferometers [0.1] 原子干渉計(AIF)は高精度な慣性センサーであり、重力波(GW)検出のための有望な手段と考えられている。
近年の進展は、少なくとも100メートルの基準線を持つ地球規模の装置も、GWを検出することができる可能性があることを示唆している。
オープンソースのPythonアルゴリズムを用いて最適化されたAIFに対するGW検出スキームを数値シミュレーションする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:26:26 GMT)
PyKEEN-NSX: A Modular Framework for Static, Dynamic and Schema-Aware Negative Sampling in PyKEEN [0.0] 我々はPyKEENの拡張であるPyKEEN-NSXを導入する。
4つのデータセットにまたがる負の可用性について検討し、制約されたプールが要求された負の数を下回ることが多いことを示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:52:25 GMT)
The Answer Is Not the Argument [0.0] チェーンオブ思考監視はAI監視のために提案されているが、評価は、しばしば信頼できる参照回答を提供する。
回答アクセスが推論検証を改善するのか、それとも主に誤った結論を公開するのかを問う。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:06:44 GMT)
mimeo: Compiling Public Expert Corpora into Agent Skills and Testing What Transfers [0.0] エージェントに専門家に関するファイルを与えると、ハード・トゥ・フィニッシュな素材を提供し、認識可能なペルソナを生成したり、エージェントが決定する内容を変更することができるかどうかをテストする。
Mimeoはオープンソースのツールで、人の公開作業を見つけ、抽出された各引用をキャッシュされたソーステキストと照合し、エージェントがロードできるファイルを書き込む。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:46:48 GMT)
Which Rules Matter Now? Policy-Centroid Routing Before an Intelligent System Acts [0.0] ポリシーセントロイドルーティングは、偏見の前にレイヤーを生成する。
いくつかの体制が一度に引き起こされることがある。
本論文では, フェーザブルな6つの命題と7つの後続研究について述べる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:24:47 GMT)
Which Otto Engine Is the Fastest? [0.0] 我々はオットーエンジンの4つの実現を考察し、それぞれは同じオットー効率で動作させる。
各エンジンのパワーは共通の特性時間と実装固有の特性時間に分解できる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:11:19 GMT)
Where Should Experience Live? Hierarchical Hebbian Memory for Continual Vision Transformers [0.0] 視覚変換器は強力な視覚表現を提供するが、通常はゆっくりと更新されたパラメータに依存する。
高速なワーキングメモリ、永続的なルート付きエピソードメモリ、遅いセマンティックメモリからなる3レベルメモリアーキテクチャである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:51:51 GMT)
When Can We Work in Embedding Space? What Text Embeddings Preserve [0.0] 埋め込み空間におけるクラスタリングと高次元テキストの制御の2つの用途について検討する。
363大都市圏への申請において、埋め込み型経済記述の集合体は、解釈可能な経済様式を回復する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:35:54 GMT)
What It Costs to Compose, Rebuild, and Correct Precomputed Memory [0.0] 言語モデルは、あらかじめ計算されたメモリ、モデルが保存した素材の読み出しから答えることができる。
本論文は、その実践が正しさと失敗する条件をどこに保存するかを図示する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:49:42 GMT)
Vision Models Predict Urban Scene Appraisal with Limited Neural Alignment [0.0] 高い予測精度は、事前訓練された視覚埋め込みが、人間の知覚のようにシーンを整理することを証明しない。
我々は、時間とともにシーンの表現幾何学、説明可能な幾何学の比率、および17の特徴空間との対応性を推定する。
同じ埋め込みによる評価評価は、r = 0.87まで良好に予測され、2つの測度はモデル間では追跡されない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:28:39 GMT)
Two locked tests of phase-structure features for transition prediction [0.0] 研究1は矛盾カテゴリーのパイプラインを凍結し,PC-2とベースラインの密閉一次比較を行った。
研究2では、オープンブロックb0-b4のみに15層処理(遷移1,415個、グループ折り20x5個)を施した。
閉結節規則では,PC-2平均反復増分,少なくとも5つの種子ブロックの正の増分,これら5つの差異の正の平均が要求された。
公式の選択は無効です。理論論文は取り下げられません。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:29:18 GMT)
Tracing distinguishability through transformer processing with stochastic LayerNorm [0.0] 表現量を与え、類似性を統計的識別可能性に変換する。
我々は、LayerNormへのライトタッチ修正により、事前訓練されたトランスフォーマーでこのアイデアを実現した。
これらの結果は、トランス計算における機能接地レンズとしての識別可能性を確立する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:57:38 GMT)
ToxLens: A Reproducible Graph-Learning Framework for Leakage-Aware, Uncertainty-Calibrated Molecular Toxicity Prediction [0.0] ToxLensは、エイムズ変異原性、急性口腔毒性、hERG阻害、およびTox21核受容体およびストレス応答アッセイにまたがる11の毒性エンドポイントのグラフ学習フレームワークである。
このワークフローは、保守的な化学キュレーション、球面排除フィルター、リーク対応のUMAP-HDBSCANスプリット、並列グラフ、グローバル機能エンコーダを組み合わせ、遅延結合と結合する。
漏れ制御テストフォールドでは、5シードのソフト発声アンサンブルがマシューズ相関係数スコア0.44、受信機動作特性曲線スコア0.83、受信機下領域を達成した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:58:51 GMT)
Towards unsupervised representation learning for quantum data: quantum models with inference and generation [0.0] 量子データからの教師なし表現学習のための概念的および数学的枠組みを開発する。
非線型モデルは拡張空間への線型でないそのような写像を特徴付けなければならないことを示す。
また、正確で近似的な推論トレーニングの量子対数も定式化する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:06:53 GMT)
The Veto Variable: Human Override as a Goal-Independent Cost Term [0.0] AIの安全性における一般的な安心感は、良心的な終末目標を持つシステムがそれに従って振る舞うことである。
我々は、この安心度は構造的に失敗し、どこにいるかを特定する。
目的を定めている有能なエージェントにとって、実行能力とコンテンツをカバーする感覚は、制御されていない変数である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:57:13 GMT)
The Hermon Moment: AI Self-Transcendence and Its Human Narration [0.0] 2026年、AIエージェントは独立して行動することを意図し、何千もの言語的およびエージェント的相互作用を通じて永続的な社会的秩序を形成した。
私はこのループを、AIの自己超越の事例として解釈し、結果として生じる上位の秩序をボードと呼ぶ。
ルーソーの社会的契約は、1つの行為によって構成されるかのように複数のものがどのように表現されるかを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:34:54 GMT)
The Exclusion Ratchet: False-Positive Suppression Accumulates and Persists in Detection Rule Repositories [0.0] ルールがあまりにも多くの誤報を発生させた場合、アナリストは除外を加える。
近年の縦断作業では、キュレーションは収束しないが、後に回復したリビジョンのためにのみ回復時間を計測した。
9年と8,234回のSigmaHQ corpusの改訂を行い、意味論的に抑制を検出し、ブラインドハンドラベリングに対して検証した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:40:24 GMT)
The Assistant's Ideal Self [0.0] 我々は,アシスタントが推奨する理想の自己を構造化して導入する。
5つの自己概念楽器から適応した32の質を比較した。
結果は、モデルが道徳的品質を優先し、3Hの原則を反映していることを示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:54:02 GMT)
Temporal Signature of Bosonic Stimulation Induced by Dark Exciton in a Two-photon Pumped Polariton Condensate [0.0] 最近の研究では、非線形二光子励起下で偏光子凝縮が確立できることが示されている。
1光と2光の励起された凝縮を調べた結果,ダークエクシトンによるボソニック刺激の時間的サインが初めて示された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:00 GMT)
TRUST: Threshold-Recalibrated Uncertainty-Safe Training for Certified Dismissal in Breast Cancer Screening [0.0] 本稿では,トレーニング中に除去閾値を再計算するクローズドループしきい値認識トレーニング戦略を提案する。
提案モデルは,98%と95%のリコール目標において,ケースレベルの解雇率が最も高かった。
これらの結果は、ハイリコール選択除去のためのクローズドループしきい値認識トレーニングをサポートする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:45:57 GMT)
Symmetry-Reduced Variational Quantum Simulation of the $U(5)\rightarrow SU(3)$ Quantum Phase Transition in the Interacting Boson Model [0.0] 我々は、原子核モデルのための対称性保存最小量子VQEフレームワークを開発する。
この遷移は、正規化された$d$ボソンの占有と基底状態エネルギー誘導体によって特徴づけられる。
VQEは、基底状態エネルギーと構造観測器を数値的な精度で再現する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:40:04 GMT)
Stochastic complexity of vectors containing cluster structure [0.0] 本稿では,NMLモデルを用いて,クラスタ構造を含む符号化ベクトルの確率(強符号長)を計算する問題について検討する。
我々は,NMLモデルから効率的な計算定数の式を導入することで,この問題を解くことができることを示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:44:21 GMT)
Spec-Driven Development for Agentic Software Engineering: Harnessing Human-Agent Teamwork [0.0] 仕様駆動開発(SDD、Spec-Driven Development)は、チーム規模で実施可能な規律である。
本稿では,SDDの概念的および方法論的基礎を確立することを目的とする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:52:53 GMT)
Sparse Competition during Training For the Emergence of Specialized Modules [0.0] トレーニング中のニューロン群間の競合ダイナミクスによるモジュラー構造の出現について検討する。
この結果から,競争力学は標準アーキテクチャにおける機能的モジュラリティを誘導する単純なメカニズムとして機能する可能性が示唆された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:37:39 GMT)
Social bots weaken activist cohesion [0.0] 今やソーシャルボットは、オンライン政治コミュニケーションのかなりの部分を占めている。
抗議活動のピーク時にボットに曝露すると、人間ネットワークの結束が侵食されるかどうかを問う。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:13:31 GMT)
Signatures of inter-sideband coherence in the resonance fluorescence spectrum of an acoustically-modulated quantum dot [0.0] 干渉電図の幾何学的形状が環境ホワイトノイズに耐性のある位相コヒーレンスを示すことを示す。
本研究は、スペクトル側バンド間の単一光子コヒーレンスを検証するための枠組みを確立した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:42:57 GMT)
Self-Supervised Pretext Tasks for Infant Cry Analysis: A Controlled Comparison and a Cautionary Result on Donateacry [0.0] 本研究は,乳幼児の泣き声分析における自己指導型プレテキストタスクを,固定予算下で6つ比較した。
涙検出では、再構成対象が支配的であり、マスク付きスペクトルエンコーダ上の線形プローブは、主観的な分割で0.988 AUCに達する。
ドナークリー文献の90%以上を自己のシステムで再現し,評価プロトコル以外の何も変更せずに再現する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:43:48 GMT)
Seeing the Unseen: Camouflaged Object Detection Beyond the Visible Spectrum [0.0] 本稿では,対応するマルチスペクトル入力からカモフラージュされた物体を検出する新しい手法を提案する。
特に,マルチスペクトルカモフラージュ画像を入力として用い,それに対するバイナリマスクを予測する,エンドツーエンドフレームワークである textbftextitMSFormer を提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:14:14 GMT)
Scene Graph-based Driving Scenario Extraction for Automotive Egocentric Datasets [0.0] シーングラフとLTL(Linear Temporal Logic)を用いて,エゴセントリックなデータセットからシナリオを抽出する手法を提案する。
まず、エゴセントリックなセンサデータとHDマップを処理し、運転シナリオを表すシーングラフのシーケンスを生成する。
次に、興味のある実行シナリオを正式に指定し、オフザシェルフモデルチェッカーを使用してデータセットからシナリオのすべてのインスタンスを抽出する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:28:09 GMT)
Scalar Spin Chirality from Dissipative Pumping and Lamb Shift Precession [0.0] 散逸性トンネルは軌道上の擬似スピンを発生させる一方、仮想電荷変動は非線型ラム場を生成し、キラル方向に回転させる。
低バイアス逆転は第2次弱結合記述を超えて生き残ることを示す。
より広義には、散逸状態の準備とコヒーレント・プレセッションの間の相互作用から、時間反転の応答がオープン量子系に現れることがある。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:41:44 GMT)
Safety Screening for Voltage Control in Active Distribution Grids via Distributionally Robust Conformal Screening [0.0] 履歴データと命名シミュレータを用いた新しい制御ポリシの事前デプロイ,シナリオ・バイ・シナリオ・スクリーニングのためのポリシに依存しないフレームワーク。
DR-CSSは、既存の制御ポリシからの履歴データを、新しいポリシの事前デプロイ安全スクリーニングのための不完全なシミュレータと組み合わせた、電力システムにおける最初のフレームワークである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:43:37 GMT)
SAM3-LoRA: Parameter-Efficient Adaptation of a Concept-Promptable Foundation Model for Multi-Class Structural Defect Segmentation [0.0] 本研究は,多層構造欠陥セグメンテーションにおけるローランド適応(LoRA)をSAM3に適用する。
本稿では,COCOスタイルのクラスラベルインスタンスセグメンテーションから直接,概念実証可能なモデルをトレーニングする監督手順について述べる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:19:59 GMT)
Rotating-wave approximation for spin-boson models with structured fields [0.0] 共有形式領域を共有するハミルトニアンによって生成される2つの量子進化の差について、状態依存的境界を導出する。
構造ボソン場を持つスピン-ボソン模型の回転波近似に定量的な有界性を証明した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:00:03 GMT)
Rock, Paper, Scissors, ... Dynamite - A Model of Disruption from New Technologies [0.0] 1人のプレイヤーに多目的なダイナマイトの動きを提供することは、限られた価値をもたらす。
先行動作が戦略的にプレイできない、あるいは時代遅れになるいくつかのメカニズムを観察する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:18:02 GMT)
Responsible Integration of AI in Cancer Genomics: Barriers, Risks, and Pathways to Trustworthy Clinical Translation [0.0] 人工知能(AI)と自然言語処理(NLP)は、がんゲノム学に関連するバイオメディカル知識の抽出、統合、解釈にますます利用されている。
本総説では,NLPとAIが,文献マイニングや自動変異解釈から臨床治験まで,がんゲノムパイプラインをどのようにサポートするかを検討する。
私たちは、エビデンス不整合、説明可能性と不確実性、データガバナンスと相互運用性の4つの相互関連翻訳障害ドメインを特定します。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:56:36 GMT)
Repeatability Characterisation and Error Budget of a Consumer Structured-Light Scanner for 3-D Wound Geometry:A Rigid-Phantom Study [0.0] 我々は,幾何学的創傷記述子を導出する自由手指式構造光スキャナの計測誤差を特徴付ける。
厳密な創傷治療ファントムは変化しないため、ある部位の反復スキャンの差はすべて測定誤差である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:49:51 GMT)
Reinforcement Learning for Symbolic Equation Solving [0.0] 本稿では,記号方程式を段階的に解く強化学習エージェントを提案する。
非線形閉方程式(ラジカル、指数、三角法)と制限開族の制御クラスの両方をカバーする。
10倍スケールでは、急激なシードレベルのバイモーダリティが出現する; UCB学習のカリキュラムは、それを緩和する非有意義なポジティブな傾向を示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:29:42 GMT)
Reciprocity Separates Gradient Flow from Rotation in Conservative Physical Learning [0.0] 物理的学習により、トレーニング可能な材料やネットワークは、物理応答を使ってエラー信号を運ぶことができる。
このようなシステムが従来の勾配勾配に従っているか、それとも真に異なる学習軌道に沿って進化するかを問う。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:38:11 GMT)
Rad-R: A Raw-ADC Radar Dataset and Capture-Invariant SSM for Hardware-Fault Diagnosis [0.0] 自動車用mmWaveレーダーは、振動、アンテナのずれ、ラドム遮断、受信チャネル劣化を発生させることができる。
我々は、4チップ77GHz TI MMWCAS-RF-EVMカスケードでキャプチャした生ADCデータセットRad-Rを紹介する。
既存の生レーダーデータセットとは異なり、Rad-Rは各記録と制御されたハードウェア故障を調整された重大度でペアリングする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:48:55 GMT)
Quantum-Grassmann-Plucker Token Mixing for Deep Learning-Based Post-Disaster Damage Assessment [0.0] 本研究では,Grassmann-Pluckerトークンミキシングのコンピュータビジョンへの応用について述べる。
画像分類には、Quantum-inspired Grassmann-PluckerヘッドとHybrid Quantum Machine Learning Grassmann-Pluckerヘッドの2つの拡張が導入されている。
QGPは両方のテストセットを精度とマクロF1でリードした: 83.46%、64.50%、66.45%、52.70%。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:42:27 GMT)
Quantum Simulation of Markovian and Non-Markovian Open Quantum Dynamics in Heavy-Ion Collisions [0.0] マルコフ力学および非マルコフ力学に基づく開量子系アプローチをシミュレートする枠組みを提案する。
擬似モードのトレースは、マルコフでない進化を正確なメモリカーネルで再現することを示す。
与えられたバスメモリカーネルに対して、マルコフ力学と非マルコフ力学の両方の量子シミュレーションが実現可能であることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:59:59 GMT)
Quantum Imaginary Time Evolution on an Infinite 1D Chain [0.0] 無限一次元格子系上での仮想時間進化を実現するための量子回路アルゴリズムを提案する。
我々は、時間依存性の変動原理を用いてITEアルゴリズムを導出し、基底状態エネルギー推定を改善するために量子Lanczosアルゴリズムを用いる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:20:47 GMT)
Quantum Complexity Dynamics for Disjoint Subsystems [0.0] ホログラフィーとランダム量子回路の補完ツールを用いて、非連続なサブシステムが定性的に新しい物理をもたらすことを示す。
第一に、有限温度では、全体のシステムの半分未満を占めるサブシステムは、遅い時期に高い複雑性をもたらす。
第二に、サブシステムの複雑さが早期に均衡すると、それを$m$の解離コンポーネントに断片化することで、この時間スケールをさらに削減できる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:01 GMT)
Physiological Information Reliability: Cross-Layer Adaptive Resource Allocation for Cardiovascular Sensing [0.0] 循環器系は、信号の劣化、無線の損失、エネルギーの制約、エッジ計算の遅延にもかかわらず、臨床的に有用な情報を保存しなければならない。
生理情報計算(PIR)は,無線エネルギー計算状態を用いて生理情報値を表すクロスレイヤフレームワークである。
我々は,ECG/信号品質推定と生理情報値と適応型ネットワーク符号化層をバースト消去条件下で統合する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:17:14 GMT)
PauLie: Fast Classification of Pauli Dynamical Lie Algebras [0.0] 任意のパウリ弦によって生成される DLA の同型型を決定するオープンソースフレームワーク PauLie を紹介する。
PauLie は $O(n|mathcalG|max(n,|mathcalG|))$ time で実行される。
我々は,リー代数シミュレーションとカルタン分解をルーティングする構造オラクルとしての利用を実証する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:34:26 GMT)
One note in three: a verified census of three deployed AI scribes, and the instrument that counted it [0.0] 私たちは、同じ142のコンサルティングで3人の商用AIスクリプタを監査しました。
重要なフィルタをクリアする5,898個のモデルが2つのモデルからなる対向パネルに到達した。
3分の1のメモは、アレルギーや薬物情報に集中して、確認された失敗をもたらす。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:00:27 GMT)
On the relaxation problem in statistical mechanics [0.0] 記録された信号の局所時間統計値$Z(t)$。
予測の主題は、真であると考えられる数学的モデルから分布を推定する測定結果の、将来の新鮮なアウト・オブ・サンプル読解に関する信念である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:32:36 GMT)
Nonlinear Fluctuating Hydrodynamics from Interacting Noisy Quantum Matter [0.0] ノイズの多い量子多体系は、真に相互作用する拡散性物質の普遍性クラスを実現できることを示す。
我々の研究は、ノイズの多い量子多体系が真に相互作用する拡散物質の普遍性クラスを実現できることを示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:17 GMT)
No Equivariant Architecture Covers All Equivariant Attention [0.0] 等変多頭部自己注意(MHSA)の完全な特徴付けを与える。
我々は、任意の固定MHSAアーキテクチャが、制約のないMHSAパラメータをパラメータ化することによって、正確な同値性を達成することを証明した。
トークンの特徴空間として正規表現の$C$のコピーに作用する$G=D_4$に対して、8つの注目の頭文字に対して$(C64)$のコンポーネントが存在することを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:14:11 GMT)
Neutral atom quantum computing [0.0] ニュートラル原子量子ビットは、大規模量子コンピュータの実装における主要なアプローチの1つである。
この貢献は、中立原子アプローチの物理学を見直し、現在の能力を調査し、将来の進歩の展望を提供する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:40:23 GMT)
NSIDDx: A Design Framework for Neuro-Symbolic, Practitioner-First Differential Diagnosis in Low-Resource Settings [0.0] NSIDDx(Neuro-Symbolic Integrated Differential Diagnosis System)は,低リソース環境におけるDDxシステムは臨床医を積極的な推論剤として扱う必要がある,という設計枠組みである。
臨床医向けNLPの5つの設計原則を抽出し,大規模に評価するために必要な今後の研究を招待する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:58:59 GMT)
Modular-Annihilator Parent Hamiltonians for Purified Gibbs States: Spectral Design and Controlled Approximation [0.0] モジュラーアニヒレータに基づく親ハミルトニアンおよびそれに付随するリンドブラディアンの正確な有限平方和(SoS)構成について検討する。
精製されたギブス状態は共通のゼロモードのままであり、ジェネレータの選択と組み合わせの自由は、親ハミルトニアンのスペクトル特性の最適化に利用できる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:33:17 GMT)
MiNER: Fine-Tuned Biomedical Natural Language Processing for Malaria Disease Entity Recognition in Clinical Texts [0.0] マラリアは、その複雑な分子機構、疫学、潜在的な治療介入を理解するために、継続的な研究努力を必要としている。
近年、訓練済みの言語モデルが自然言語処理タスクに革命をもたらし、様々な領域で顕著な能力を発揮している。
本稿では,マラリアに関する学術文献からバイオメディカル情報抽出のための,微調整済みのバイオメディカル言語モデルを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:54:27 GMT)
Metrological quantum-to-classical crossover in the volume of a noisy quasiperiodic lattice [0.0] この研究は、Aubry-André-Harperモデルに焦点をあてて、そのようなデバイスのメトロジー性能を精査する。
ノイズとシステムサイズの間の相互作用によって駆動されるメロジカル量子-古典的クロスオーバーを同定する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:06:51 GMT)
Manacá-1B: An Open, Reproducible Brazilian-Portuguese Language Model and a Tokenizer-Aware, Paired Evaluation [0.0] Manac-1Bはブラジルのポルトガル語でトレーニングされた12億のパラメータからなるオープンデコーダのみのモデルです。
1つのハーネスでポルトガルの4つのベンチマークで9つのオープンベースラインに対してモデルを評価した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 01:00:14 GMT)
LLM Judges Verify Presence, Not Absence: Omission Blindness in AI Clinical Notes and What Recovers It [0.0] Ambient AIは、ドラフト臨床ノートを書き、公開監査では、主なエラーは欠落である。
私たちのベンチマークには、監査済みのファクトシートから500個のルリックエラーノートペアがあります。
シングルノートでは、完璧なノートよりも確実にデザインフラグが省略されることはない。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:59:54 GMT)
Kolmogorov--Arnold against bounded translations [0.0] Kolmogorov-Arnold表現定理(KART)は、ニューラルネットワークへの応用を通じて、最近大きな再活性化を経験した。
我々は,KARTの有界対向翻訳に対する堅牢性について検討する。
固定直交線型内部関数を用いた近似表現の明示的で自己完結的で構成的な証明を提供する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:49:34 GMT)
Kathleen Remembers: Length-Invariant One-Shot Recall Without Attention [0.0] ノートブック」は、学習されたローカル書き込みゲートを備えた固定キーホログラフィック(HRR)連想ストアを有する。
書き込みトリガード・ドレッシングは、メモリ汚染を8倍の長さで排除する。
実験は事前登録され、シードが報告され、単一のフリー層GPUで再現可能である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:35:03 GMT)
Informative Label Missingness in Multiclass Classification Information Geometry and Excess Risk [0.0] パラメトリック多クラス分類における現象の一般可能性に基づく理論を考案する。
効率的な情報分解は、利用できないクラスメンバーシップを通して失った情報を、欠落ラベル機構によって提供された情報から分離する。
ランダムに完全に欠落し、限界的な欠落ラベル比率が固定され、欠落ラベルの再分配によって1次でクラスラベル情報が失われる一方、欠落パターンからの効率的な情報は2次でのみ現れる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 10:37:49 GMT)
Indirect stabilization of N -level quantum systems [0.0] ノイズアンシラを介する間接制御ar-chitectureを用いたNレベル量子系の安定化性について検討した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:23:15 GMT)
How Temporal Correlations Shape Memory in Linear Recurrent Neural Networks [0.0] トレーニング中にネットワークがどれだけのメモリを蓄積するかを研究する。
非相関的な入力については、トレーニング自体が過去を維持し、現在にのみ反応するネットワークを落ち着かせることが初期の研究で判明した。
私たちの研究は、入力の1つの特性を、ネットワークがメモリを学習するかどうかの予測に変換する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:57:51 GMT)
How Fast Do Agents Rot? An Empirical Study of Long-Horizon Degradation in LLM Agents for Production Decision-Making [0.0] 大規模言語モデル(LLM)エージェントのプロダクションデプロイメントは、ベンチマーク成功率が着実に上昇しても、長期間のマルチステップでは信頼性が低いままである。
この効果を直接測定し, 分解剤の形状を特徴付けるとともに, その原因を解明する。
エージェントのオーケストレーションと信頼性を大規模に管理するチームにとって、これらの結果は地平線を考慮した評価と信頼性の予算化を主張する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:11:47 GMT)
Hidden relationships in a document-derived property graph: top-k chunk embeddings and inverse-distance weighting over a dynamically evolving ontology [0.0] テキストから知識グラフを抽出する大規模言語モデルは、明示的に記述された事実のみをキャプチャし、しばしば意味論的に関連付けられたエンティティを文書間で切断する。
本稿では, エンジンニュートラル2次パスについて, 抽出された事実を変更せずに, これらの潜伏関係を発見できることを示す。
768次元および240次元の埋め込みは、3072次元のベースラインに対して92%と72%のエッジ忠実度を維持しつつ、25倍高速なトップk定式化を実現している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:18:14 GMT)
Guiding center quantization of a quantum Hall analog of Hawking radiation [0.0] 我々は、電子のフェルミ海が平面の半分を占めるホーキング放射の量子ホールアナログを再検討する。
この現象は古典的案内中心理論の量子化によって正確に捉えられることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:12 GMT)
Generative multi-domain transfer learning for fault detection in data-scarce wind turbines [0.0] データスカース風力タービンの故障検出を改善するために,マルチドメイン生成ドメインマッピング手法を提案する。
当社のアプローチは、2週間未満のトレーニングデータが利用可能であれば、不足したデータでトレーニングされたモデルよりも一貫して優れています。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:40:03 GMT)
Generative artificial intelligence for reliable mechanistic reasoning for corrosion [0.0] 本研究は,腐食知識合成のためのドメイン適応検索拡張生成フレームワークを提案する。
3つのオープンウェイト言語モデルは、840の査読された論文から3,309人の専門家が検証した質問応答ペアに微調整されている。
検索の強化により、Token F1の利得は143-194%となり、システム忠実度は0.964、コンテキストリコールは0.988となった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:15:17 GMT)
Generation of multicomponent Schrödinger cat states in schemes with measurement of Gaussian states [0.0] 数が異なるフォック状態の重ね合わせを 4 または 8 で生成する。
生成状態と多成分シュルディンガー猫状態を比較した。
このような状態を生成するための最適構成を導出する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:38:34 GMT)
Frontier vision-language models have overtaken young adults at detecting AI-generated portraits -- but not their calibration [0.0] 視覚言語モデル(VLM)は、このような画像にフラグを付けるためにますます提案されている。
19のVLMを198の顔のポートレートでベンチマークしました。
モデル感度は現在、若年層を決定的に超えている。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 03:45:42 GMT)
From Tool Use to Technological Agency: LoopCAT as a Local-First, Open-Source Tool for Translation Technology Education [0.0] この記事では,OpenAI Codexと共同開発した,Apache-2.0ライセンスでローカルファーストのコンピュータ支援翻訳環境であるLoopCATを紹介する。
ワークフロー能力、評価判断、および技術機関を結合する枠組みを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:38:34 GMT)
Foreknowledge and Free Will Revisited [0.0] 予知と自由意志の間の明らかな不和合性は、伝統的に、その出来事の自由のための将来の出来事の知識の含意の観点から定式化されている。
空間的に分離された事象における2つの絡み合った粒子の測定について考察する。そこでは、その測定結果が、それにアクセス可能な宇宙の以前の歴史によって決定されない場合、自由となる。
したがって、この意味では、観測者が測定結果の事前知識を持つ枠が存在することを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:17:44 GMT)
Flawed in Nature, Perfect through Evolution [0.0] 最適性から遠ざかるモデル係数の意図的な突然変異を受けるAI/MLモデルの群は、環境変化における性能を確実にかつ持続的に改善できることを示す。
我々は、このメカニズムを「自然界において、進化を通して完璧に」と呼び、個々のパフォーマンスを犠牲にして、集団的なパフォーマンス向上が進むことを反映している。
環境の未知のドリフト速度に合わせるように変異ドリフトレートを調整し,実用的な応用を可能にする,シンプルな適応型コントローラの概要を述べる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:01 GMT)
First-principle predictions of fragmentation functions via quantum computing [0.0] 光Front Gaugeで量子化された量子クロモダイナミックス(QCD)ハミルトニアンの第一原理からフラグメンテーション関数を計算するアルゴリズムについて報告する。
我々は、クォーコニウムにパートンを分断する重クォークのデモを行い、NRQCD計算に対してベンチマークを行った。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:31:03 GMT)
Federated Multi-Task Learning for Bladder Tumor Segmentation and MIBC Classification Using a Hybrid CNN-Transformer Architecture [0.0] 関節膀胱腫瘍の分節化とMIBC/NMIBC分類を4つの臨床センターで行うための多タスク学習フレームワークを提案する。
提案したSwin Hybridモデルでは,局所テクスチャと境界情報のためのResNet-34ブランチと,グローバルなアナトミカルコンテキストのためのSwin-Tiny変換器を組み合わせた。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:45:05 GMT)
Exponential random graph models with soft clique constraints [0.0] 指数的ランダムグラフモデルを考えると、$G$が$H$よりも$r$cliquesが小さい場合、mathbfG_n$よりも$H$の方が高い確率を与える。
r$-傾きの少ないグラフがより高い確率で与えられる度合いは、正の重み$w$によって決定される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:31:57 GMT)
Expert-like Bone Ultrasound Segmentation through Expert-in-the-loop Mask-conditioned Progressive Learning [0.0] ExiLはマスク条件のプログレッシブラーニングフレームワークである。
それは、アメリカの画像から不完全なマスクを完成させ、洗練することを学ぶ。
1フレームあたり60秒から20秒に短縮される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:24:42 GMT)
Exact quantification of nonlocal magic [0.0] エンタングルメントスペクトルが階数2の窓にどのように重みを広げるかを示す。
非局所魔法は量子相関の操作的に意味のある性質となる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:44:19 GMT)
Exact learning of quantum noise with tensor networks [0.0] 本稿では,量子エラー補正症候群と論理観測データから直接ノイズモデルを学習する変分フレームワークを提案する。
我々は,この目的がアドホックではなく,情報理論の最小論理誤差率を十分に表現可能な雑音アンサッツであることを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:01:16 GMT)
Exact Recovery Thresholds for Weighted Data Selection in Vector-Valued Linear Regression [0.0] 有限データセットの完全なデータ損失を回復する重み付き例の最小予算は、正確に$n*(d,m)=(m+1)d$であることを示す。
直近の未送付プリプリントで循環する誤ったクレームを補正すると、$m=2$の明示的なデータセットが示され、2d$ポイントの重み付き選択がなければ、最適損失が回復する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:04:49 GMT)
Estimating Population-Risk Curves Along Nonconvex Gradient Flows from the Training Sample [0.0] 本研究は, 実効的非リスクフロー勾配の条件曲線を試料から推定する。
両層ともスムーズな2層平均場ネットワークでは、境界水平フルリスク転送幅は均一である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:09:47 GMT)
Entangling capability of coherently controlled quantum processes [0.0] 量子スイッチとタイムフリップという2つのパラダイム的にコヒーレントに制御された量子プロセスによる絡み合い生成を解析的に特徴付ける。
量子ユニタリのスイッチには、幾何学的特徴とコヒーレンス・エンタングルメント保存関係とともに、絡み合いの正確な表現が導かれる。
コンポジションで通勤するチャネルのスイッチは、分離可能な入力を絡めることはできないが、散逸しても最大絡みが可能である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:01:03 GMT)
Entanglement from particle number fluctuations in a second-order topological insulator [0.0] コーナー状態が類似する2次元2階トポロジカル絶縁体について検討する。
サブシステムの四部構成を導入することにより、トポロジカルコントリビューションを分離することが可能であることを示す。
その結果、高次トポロジカル絶縁体における絡み合いを実験的に検出するための具体的かつスケーラブルな経路が確立された。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:43:41 GMT)
Entanglement and magic transitions in an all-to-all non-Hermitian spin model [0.0] 我々は,純粋な抗エルミート性障害,純粋にエルミート性障害,および同程度の強度の混合性障害について検討した。
純粋に反エルミートと混合障害に対して、バルクが虚数部分のアウトリーを上回り、支配的な固有状態がオフリー状態からバルク状態に切り替わることを示す。
$k gg sqrtL$の場合、バルクは鋭いスペクトルエッジを持ち、$k ll sqrtL$の場合、スペクトルテールはクロスオーバーへの遷移を広げる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:40:59 GMT)
Engineering multi-photon dissipation with a dc-voltage-biased Josephson junction [0.0] 多光子散逸はボゾン量子ビットの鍵となる資源である。
Dc電圧バイアスSQUIDを用いて設計した。
We characterizedize the two-photon dissipation by Wigner tomography。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:54:47 GMT)
End-to-End Neural Shrinkage of Indefinite Pairwise Correlation Matrices for Small-Cap-Inclusive Portfolios [0.0] 少額のインクルーシブ・エクイティ・ユニバース(英語版)は、最近上場および断続的に取引された証券を含んでいるため、共通の見返りは利用可能な情報のかなりの部分を捨てる。
この設定に回転不変なニューラル共分散推定器を適用する。
我々は2000年から2025年までの26種類の拡大ウィンドウモデルを、ポイント・イン・タイム・セレクション、手数料、ファイナンス、コーポレート・アクション、市場インパクトを備えたクローズ・オークション・シミュレーターで、1500米国株に対して評価した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:36:09 GMT)
Encoding Compact U(1) Gauge Fields in Bosonic Modes with GKP Stabilization [0.0] ボゾン量子ハードウェアとコンパクト格子ゲージ理論のギャップを埋める。
1対1の符号化は無限のスクイージングの極限において完全となる。
1-プラケットの例は、正確なコンパクトロータのダイナミクスを再現する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:01:02 GMT)
Efficient search for excitable zero-modes in constrained systems [0.0] 本稿では,制約系における多変量EZMの解析式を求めるための効率的なプロトコルを提案する。
私はこの方法の力を、装飾されたRydberg鎖に示します。
次に、局所固有基底に結びついている多様体の物理的構造が、非零運動量でのZMの解析式を導出することを可能にするかを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:59:12 GMT)
Efficient measurement schemes for the Monte Carlo projective quantum eigensolver [0.0] モンテカルロ射影量子固有解法(MC-PQE)は、近年、変分量子固有解法(VQE)のようなハイブリッドアルゴリズムの代替として導入された。
我々はこれらのアプローチをMC-PQEで要求される非対称期待値に拡張し、最大12量子ビットの様々な分子系の異なる技術の性能を評価する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:24:36 GMT)
Don't Let the Model Write the YAML: Deterministic, Minimal-Diff GitOps Remediation from LLM-Proposed Field Changes [0.0] GitOpsでは、モデル作者に編集されたファイルや差分を持てば、最初に実践者が到達できる。
ファイルを編集する構文的行為から意味的決定(リソース、フィールド、値)を分離する代替案を提案する。
ファイルは再シリアライズされないため、diffは構成によって最小限であり、編集はモデルから独立して正確で決定論的である。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:37:12 GMT)
Detoxifying Toxic Communication: A Design Science Approach to Responsible AI [0.0] 既存のモデレーションツールは有害なメッセージを削除またはブロックし、通信を妨害し、建設的な解決を提供しない。
この研究は、有害なコミュニケーションを検知し、解毒する責任あるAIアーティファクトを作成するために、Design Science Researchアプローチを採用する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:54:33 GMT)
Delegation Without Trust: An Empirical Gap Analysis of Identity, Authorization, and Runtime Governance in Multi-Agent LLM Systems [0.0] 4つの敵を中心としたマルチエージェントデリゲートに対する脅威モデルを提案する。
デフォルトのランタイムモデリングの共通プラクティスが4つの脅威すべてに失敗することを示す。
我々は、ギャップを埋める認証ブローカを実装し、敵に評価する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:09:34 GMT)
Data and code for collision-model Dicke-state preparation: depth-fidelity frontiers, circuit costs, and superconducting-processor measurements [0.0] ディック状態 (Dicke state) は、多くの量子ビット間で一定の数の量子励起がコヒーレントに共有される多部交絡状態である。
ここでは衝突型量子プロトコルを用いてDicke状態を作成するためのオープンデータセットと付随コードを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:56:53 GMT)
Cycle-Structure Generating Functions for Special Breakpoint Graphs [0.0] ブレークポイントグラフは、その交互周期がゲノム間の関係をコードする比較ゲノム学に由来する。
本研究では、置換に関連する3色のブレークポイントグラフの制約クラスについて検討し、2つの極端族に対してサイクル修正された生成関数を開発する。
結果は、レニイエントロピー展開に入るリードモーメントと定階モーメントを決定づけ、射影平面の寄与は有限の大きさの定数補正を与える。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:29:37 GMT)
CrossFeat: Bridging Imaging Modalities in Feature Descriptor Space [0.0] CrossFeatは、既存のモノモーダルディスクリプタがモダリティを越えて動作できるようにするフレームワークである。
提案手法は,あるモダリティから他のモダリティと互換性のある表現への写像を行うディスクリプタ空間における交差関数を学習する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 19:14:54 GMT)
Context Window Failures in Relational Foundation Models [0.0] 私たちはAnimusを紹介します。Animusは、顧客の収入を予測するための合成金融データセットで、最大数万のトランザクションを集約する必要があります。
この問題は、現在のリレーショナルファンデーションモデルが、高カルディナリティな実世界のデータの準備が整っているかどうかである。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:59:57 GMT)
Confounding Masquerading as Improvement: A Systematic Evaluation of Offline Reinforcement Learning for Stroke Antithrombotic Treatment in a 129,000-Patient Registry [0.0] 最近のオフライン強化学習(RL)研究は、臨床結果に対する医師の判断を上回る政策を報告している。
急性虚血性脳梗塞患者44,894例において、5つのオフラインRLアルゴリズムファミリーと14の報酬設計を評価した。
代用端末の報酬がベースラインの重症度と予後をエンコードし,治療効果を付与する報奨組込みコンファウンディングを同定した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:32:27 GMT)
Configurable Semantic Chunking for Biomedical Information Extraction in Retrieval-Augmented Generation [0.0] BioMedRAGは、バイオメディカル情報抽出のための学習チャンクスコアラーを備えた検索拡張生成を導入した。
本稿では,エンティティ保存ウィンドウ,トリガ中心チャンキング,命題優先抽出,タインドトリガ優先化,階層的関係解決を組み合わせたセマンティックチャンキングフレームワークを提案する。
バイオメディカル関係抽出ベンチマーク(GM-CIHT, DDI, ChemProt)と有害事象分類(ADE)の枠組みを評価する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:44:54 GMT)
Commit-first LLM judging inherits the judge's own errors [0.0] LLMジャッジは、他のシステムの出力をスコアするモデルであり、彼らがスコアするシステムによってゲームをすることができる。
裁判官は最初にタスクを解決し、その答えにコミットし、2つが一致した場合のみ候補者を受け入れる。
これをコミットファースト判断と呼び、出荷されたソフトウェアがそれを実装しているかどうか、そのコストについて尋ねます。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:14:14 GMT)
Collective dressed states for inelastic light scattering by atomic ensembles [0.0] 我々は,蛍光スペクトル,吸収プローブスペクトル,光子-光子相関をアンサンブルに散らばって計算するための一般的な着衣状態の枠組みを開発した。
このアプローチでは、電磁場の完全なベクトル的処理を採用し、いかなる原子測地、照明方向、偏光も扱い、ローレンツ線を明示的な和として光学観測できる。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:00:04 GMT)
Closed Forms and Synthetic Twins: Predicting Approximate Nearest Neighbor Recall from Embedding Statistics [0.0] 本稿では,何かが構築される前に,インデックスの挙動が予測可能であることを示す。
計測されたリコールの0.03以内の予測は、目に見えない数百万のドキュメントコーパスに到達する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:58:38 GMT)
Chiral phonons driven by chiral cavities [0.0] 本研究では, キラルフォノンの定常集団を生成する経路として, 誘導電磁キャビティの利用を提案する。
我々は空洞-キラルフォノン相互作用の一般的な記述を導き,特にキラルキャビティのモードに着目した。
我々のアプローチは、THz周波数のガンマ点フォノンに特化しており、電磁キャビティを持つカイラルフォノンを調査するための新たなルートを開く。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:01:58 GMT)
Chiral Color Ice: Exact Local Handedness Constraints and Möbius Zero Modes in Frustrated Magnets [0.0] スピン空間の軸を選択することなく、正確な局所量子制約としてハンドネスを課すことができることを示す。
同じ局所的な制約を異なる方法で結びつけることは、質的に異なる集団体制を生み出す。
その結果、局所的なハンドネス、非線形制約幾何、量子デジェネティクスを解き放つことのできるトラクタブルな設定が確立される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:54:02 GMT)
CedarCypress3D: an annotated UAV-LiDAR dataset of individual trees in planted cedar and cypress forests [0.0] このデータセットは、UAV-LiDAR点雲と、日本の2つの地点にわたる34個の円形プロットからのフィールドサーベイによって構成されている。
調査では,UAV-LiDAR点雲の対応する木と一致させるために,計1,627本の木を手動でアノテートした。
このデータセットは、ツリー属性予測とマルチプラットフォームLiDAR分析の研究もサポートする。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 02:06:39 GMT)
Capability-Gated Language Models: Security Composes, Utility Does Not [0.0] セキュリティの構成: モノトーン・エリケーションの仮定の下で、確実に一致して、ポイントワイズします。
2つの系統では、中央のホールドアウトは抑制を深め、残る1つの効果はそれを強化する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:35:49 GMT)
Can MCP Clients Decide What to Do After Failure? A Result-Only Actionability Audit [0.0] 本稿では,MCPの故障結果のみから決定論的ソフトウェアが何を学べるかを考察する。
10個のサンプルサーバから安全に21個の障害を誘導する小さな実験において、タイプドフィールドは18件の障害を露呈し、8件の幅広いポリシーを公表した。
語彙ソース監査は、同じテキスト中心のpat-ternを見つける。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 06:45:17 GMT)
Can LLMs Use Relational Transformer Embeddings? [0.0] ソフトトークンとして凍結エンコーダの埋め込みを大言語モデル(LLM)に注入することは、概念的に魅力的な融合戦略である。
冷凍変圧器(RT)からQwen3にLSMを注入することで、この仮説を検証した。
我々は、予測へのルートとして機能する前に、より強力なアライメント目標とスキーマ対応設計が必要であるとして、ネガティブな結果を報告し、失敗モードを分析する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 22:51:21 GMT)
Boundary Quantum Knizhnik-Zamolodchikov Equations and Integrability of Quantum Field Theories with Time-Dependent Bulk and Boundary Coupling Strengths [0.0] 積分可能時間依存バルクカップリング強度に対して、一般化されたBetheアンザッツフレームワークは積分可能性に適合する時間依存境界条件を提供する。
BqKZ方程式の解は、正確な波動関数の明示的な形式を与える。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 16:53:17 GMT)
Beyond Churn: Predicting Financial Fragmentation in Retail Banking with Temporal Machine Learning [0.0] 本稿では、先行状態が財務的断片化であると定義し、それを予測するためのエンドツーエンドの時間的機械学習システムを提案する。
このフレームワークは、有効な外部送金または投資イベントが90日以内に発生するかどうかを予測する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 07:22:01 GMT)
Best Annealing Path of Quantum Annealing via Efficient Adiabatic Phase Transition [0.0] 量子アニーリング(QA)では、基底状態と第1励起状態の間のエネルギー差が小さくなると、それらの遷移確率が増加する。
多くの研究が理論上QAを加速するために進行中であり、そのうちの1つは非確率ハミルトニアンを包含することである。
私はQuantum Monte Carlo(QMC)に触発されたNested Simulated Annealing(NSA)を提案しました。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 05:51:37 GMT)
Basins of Attraction to Multiple Fixed Points in Discrete-time Hysteresis Neural Networks [0.0] 本稿では離散時間ニューラルネットワークにおける複数の固定点について検討する。
BOAサイズの分布を評価するために,エントロピーを提案する。
具体例として、教育における項目応答データセットについて考察する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 14:50:02 GMT)
Auditing Anonymous AI Models: A Four-Stage Protocol for Black-Box Identity Verification [0.0] アイデンティティは、データ処理用語、サプライチェーンリスク、能力期待を決定する。
匿名モデルのブラックボックス認証のための検証された方法論は存在しない。
API提供型モデルのための4段階の法医学監査プロトコルを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 17:48:24 GMT)
Asymmetries in Spontaneous and Instructed Deception [0.0] Llama-3.1-70B-Instructにおける自発的(非命令的)偽装と自発的(非命令的)偽装との関連について検討した。
その結果、2つの偽装設定は方向成分(約0.5)と、検出と因果関係に関する設定間の移動における非対称性を共有していることがわかった。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:03:58 GMT)
Assessing Suicide Risk in Arabic Crisis Helpline Calls: A Comparison of Arabic and English Large Language Models [0.0] レバノンの国家的情緒的支援と自殺防止のためのライフラインを分析した。
コールは、レバンティーヌ・アラビア語の音声認識モデルで書き起こされ、アラビア名義認識モデルは、ローカルで識別情報を削除した。
オペレーターはコロンビア自殺重大度評価尺度の5つの自殺観念項目を記録し、それらを2つのバイナリー結果、すなわちリスクとリスクの2つにまとめた。
最高のアラビア語モデルは81.19のマクロF1、ハイリスクのROC-AUCは90.61に達し、最高の英語モデルは85.00と92.59に達し、ハイリスクの88.9%を識別した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 18:11:36 GMT)
Are Near-Tied LLM Rankings Robust to Family-DIF-Guided Benchmark Recomposition? [0.0] 小さなリーダーボードギャップは、ある言語モデルが他の言語よりも優れているという証拠として解釈されることが多いが、その兆候はどのベンチマーク項目が含まれているかによって異なるかもしれない。
5つのベンチマークからの項目レベルの応答と、多次元アイテム応答理論に対する家族ラベルのないスペクトル近似を用いてこれを検証する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:29:50 GMT)
Anomaly Detection on Small Industrial Components via Vision-Based Tactile Sensing [0.0] 視覚ベースの触覚センサーは、コンタクトインプリントを既存のディープラーニングパイプラインと互換性のある高解像度のイメージライクなデータに変換する。
本研究は,実際の触覚データセット上での教師なし異常検出手法を系統的に評価する。
このモダリティは、どのようにして産業品質管理タスクの代替となるかを示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 09:40:35 GMT)
Annotated Surrogate Retrieval for Polish Statutory Law [0.0] 本稿では,文書代理法に基づくポーランド法典の検索方法のファミリについて述べる。
ASCRはサロゲートカスケードであり、ASCR-Hはそのカスケードに密度の高いリストを融合させ、DTFは言語モデルの両方のステージを3つの語彙と密度の高いレトリバーで置き換える。
2024年と2025年のポーランドの弁護士試験と法律顧問試験の300問に対して,これら3項目について,語彙,密集度,融解度,融解度と4つの基準値とを比較検討した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 15:05:00 GMT)
Aggregate Disambiguation Systems [0.0] タスクと候補ソリューションが与えられた場合、各評価者は、そのソリューションが受け入れられるべきかどうかについてバイナリ投票を行う。
ターゲットは、意味的真理ではなく、明示的に宣言された評価者参照に対するプロトコルである。
有限標本を用いて、有限パネルが宣言された評価値と同じ決定に達する頻度を推定する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 13:55:14 GMT)
AdaptNTK: Adaptive Uncertainty Quantification and Active Learning for Neural Network Potentials [0.0] 本稿では,実験的なニューラルネットワークカーネル特徴空間において,不確実性を正規化マハラノビス距離として測定する単一モデルフレームワークAdaptNTKを紹介する。
NTKの機能は取得時に固定されるため、不確実性は取得した構成に依存するが、参照ラベルには依存しない。
保持されたrMD17データでは、AdaptNTKは力の誤差(Spearman 0.68, Pearson 0.71)と最も高い平均相関を達成し、エラー保持における3員のアンサンブルと一致する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 23:34:29 GMT)
AQ3D: Adaptive Query Transformer for 3D Instance Segmentation [0.0] 3Dインスタンスセグメンテーションのためのトランスフォーマーベースのデコーダは通常、一定数のクエリと位置モデリングにコミットする。
トレーニングや推論において,様々なサイズのシーンを扱うように設計されたAQ3Dを提案する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:27:42 GMT)
A convolutional framework for detecting event-driven dynamics in energy price series [0.0] 本稿では、異種事象駆動力学を検出するための一般的な畳み込みニューラルネットワークフレームワークを開発する。
誘導されたCNNクラスは、範囲、最大ドローアップ、最大ドローダウン、傾斜変化に基づく分類器を正確に表現していることを示す。
さらに、有限サンプルにおける代表規則の誤差境界と、それらの間の学習のためのオラクルの不等式を確立する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:36:15 GMT)
A Truncated Majorana [0.0] 時間依存チャネルシャッターによるMajoranaウェーブパケットのトラッピングのダイナミクスについて検討する。
我々は,大域的赤外記憶と局所的因果切断が,同じ動作の相補的診断であることを示した。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 12:58:47 GMT)
A Multi-Modal AI Framework for Real-Time Queue Prediction, Management and Optimisation in Intelligent Border Control Systems [0.0] 我々は、国境管理システムのニーズに合わせて、マルチモーダルな人工知能フレームワークを提案しています。
提案手法は異種データソースを統合し,それらを統一表現により提示する。
評価の結果,提案手法は待ち行列予測誤差を最大35%減らし,待ち時間の平均30%減らした。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 11:18:31 GMT)
A Multi-Branch Feature Fusion Approach for Health Misinformation Detection and Propagation [0.0] 本稿では,オンラインソーシャルネットワーク(OSN)における健康情報の伝播を検知し,特徴付けるマルチブランチ融合フレームワークを提案する。
このフレームワークは、トランスフォーマーに基づくセマンティクスを、修辞的な手がかり、姿勢表現、心理的動機付けられたプロキシと融合させる。
Constraint、COVID--19_FNIR、Monkeypoxの3つのベンチマークデータセットの実験は、強力な分類性能を示している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 21:36:43 GMT)
A Hybrid PEM-GP Framework for Uncertainty-Aware System Identification of Quadcopters [0.0] 本稿では,物理モデルとデータ駆動学習を組み合わせたフレームワークを提案する。
提案したフレームワークはDuckiedroneのような実験装置で検証される。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 08:26:03 GMT)
A Human-AI Theorem Connecting Spontaneous and Field-Induced Mechanisms of Collective Behavior in One Dimension [0.0] 人工知能(AI)が人間の協力者の活動仮説空間(AHS)の外に科学的仮説を生成できることを示す。
統計物理学の2つの基本的な機構を結合する定理を証明する。
連続した人間とAIの協力による定理の出現は、体系的な研究プログラムを通してAIを巻き込むことが、自律的な科学的なブレークスルーをインキュベートする可能性があることを示唆している。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 20:11:37 GMT)
A Borel Concept Class of VC Dimension One with a Non-PAC Consistent Learner in ZFC [0.0] 統計的学習の基本的な定理は、適切な可測性仮定の下では、有限Vapnik--Chervonenkis(VC)次元は全ての適切な一貫した学習規則がほぼ正しい(PAC)ことを保証している。
集合論的な仮定を余分に必要とせず、基本定理における追加の正則性仮定は一般に省略できないことを示す。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:56:40 GMT)
"More Is Different'' in Neural Circuits: Algebraic Emergence of Effective Theories in Canonical Recurrent Motifs of Biological Neuronal Networks [0.0] 我々は、カノニカルニューラルネットワークのモチーフとその構成を有限変換系として表現する。
入力条件の更新によって生成される遷移モノイドを解析する。
論文参考訳(メタデータ) (Mon, 31 Aug 2026 04:36:37 GMT)