EvTrajGS: Accurate and Efficient 3D Gaussian Splatting from Unposed Event Streams [108.5] EvTrajGSは、未提示のイベントストリームのための正確で効率的な3Dガウススプレイティングフレームワークである。
提案手法は,高コストのSLAM型パイプラインを不要にすることで,粗いポーズ前から確実な継手ポーズシーンの最適化を可能にする。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:00:30 GMT)
BOUND: Brief-Guided Corrective Preference Distillation at Search-Control Boundaries [82.4] BOUNDは、永続的な探索ドリフトのための短いガイド付き修正選好蒸留フレームワークである。
Trajectory SFT は Bamboogle で 5.6 EM 、BrowseComp-Plus で 4.8 の精度で上回っている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:32:16 GMT)
VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling [81.9] VLZipは、純粋なトランスフォーマー内で高忠実性推論のための視覚的およびテキスト的圧縮を統一するフレームワークである。
また、LongVLBenchというビデオナラティブから派生した、全体論的、物語レベルの推論を要求する新しいベンチマークも紹介する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:31:03 GMT)
Fourier Self-Supervision for Fine-Grained Generalized Category Discovery [81.8] Generalized Category Discoveryは、ラベルのないデータの中で新しいカテゴリを識別しながら、既知のカテゴリを認識することを目的としている。
既存の手法は、通常、自己超越と対照的な学習に基づいており、しばしばきめ細かい区別を捉えるのに苦労する。
画像のフーリエ変換を利用して微妙な違いの識別を強化するフーリエ自己スーパービジョンを導入する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:54:22 GMT)
Tevatron-Elastic: A Unified Abstraction for Training Elastic Retrievers and Rerankers [72.0] トランスベースのモデルは、3つの方法で小さくすることができる。
単一のオブジェクトがモデルの実行可能なサイズを指定し、短いスケジュールでトレーニング対象のサイズをリストアップする。
同じ抽象化は、レトリバーとリランカの両方と、エンコーダとデコーダの両方をカバーしている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:45:28 GMT)
Not Worth Another Token: Marginal Value Estimation for Efficient Deep Research Agents [69.6] 深層研究エージェントの文脈管理における限界値推定について検討する。
我々は, 検索前, 検索後, 合成前において, 軽量な基準と学習価値モデルを評価する。
ライトウェイトは、少ない品質劣化でトークンの使用量を最大73%削減し、学習されたプルーニングは、選択されたトレードオフにおいて競争力を持ち、品質、効率、忠実性で1つの方法が支配することはない。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 00:56:37 GMT)
LogiShot: Logically Coherent Cross-Shot Video Generation [68.7] 我々は、映像生成におけるクロスショット論理コヒーレンスの実現には、ショット間の論理的接続を確立し、視覚的一貫性を維持する必要があると論じている。
本稿では,2つの補完経路を通じて情報を組み込むLogiShotを提案する。
実験により、LogiShotは複数のショットにまたがる論理的コヒーレンスの観点から、既存のベースラインを一貫して上回っていることが示された。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:11:57 GMT)
From Speech to Interaction: Analyzing Multimodal Systems in Cocktail-Party Scenarios [68.1] 人間は、近くの会話から競合するスピーチをフィルタリングしながら、個々の話者に選択的に出席する能力を持つ。
この「カクテルパーティー」のシナリオは、音声認識システムに深刻な課題を呈している。
CHiME-9 MCoRecタスクは、システムが話者のグループを認識し、各会話を音声視覚入力から書き起こさなければならないテストベッドを提供する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 06:11:38 GMT)
Vid2WAM: Distilling Video Diffusion Priors into World Action Models [59.3] 世界行動モデル(WAM)は、将来の視覚力学とアクションを共同でモデル化することで、ロボットポリシー学習を改善する。
大規模なビデオ基礎モデルからコンパクトなWAM学生へ視覚拡散を先取りするオフライン蒸留フレームワークであるVid2WAMを提案する。
Vid2WAMは、限られた専門家によるデモンストレーションにおいて、新しいタスクの一般化とデータ効率を向上させる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:02:49 GMT)
CuteTTS: Efficient and High-Quality Speech Synthesis via Autoregressive Modeling of Continuous Latents [53.7] CuteTTSはコンパクトな連続自己回帰型TSシステムである。
意味的に整列した因果性VAE潜伏剤とパッチレベルの自己回帰、明示的な話者条件付け、双方向のフローマッチングヘッドを組み合わせる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:10:20 GMT)
SC-Diff: Semantically Calibrated Diffusion for Visible-to-Infrared Image Translation [52.6] 可視赤外画像変換は、豊富な可視画像を用いて赤外線トレーニングデータを拡張するための実用的な方法を提供する。
既存の拡散に基づくメソッドは、通常、外部条件としてのみセマンティックプリエントを使用する。
SC-Diffは、条件付きガイダンスと内部自己注意校正の両方にセマンティックな事前情報を利用する意味論的潜伏拡散フレームワークである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:57:40 GMT)
Rethinking Attention Locality in Spiking Transformers [50.0] スパイキングトランスフォーマーは、スパイク駆動計算による効率的なビジュアル処理のための有望なパラダイムを提供する。
彼らのSSA(Softmax-free Spiking Self-Attention)は、空間的に局所化されたトークン相互作用を確立するのに苦労している。
境界連続経路(SCLA-BCP)を用いた空間連続的局所的注意法を提案する。
当社のアプローチでは、2017年のCOCOではmAP@50が9.50%、ADE20KではmIoUが3.42%改善しています。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:36:17 GMT)
Visual Token Codec: Unleashing Spatial Redundancy for ViT Feature Coding [49.5] Visual Token Codecは、グローバルトークンとパッチトークンを専用のコーディングパスに分離する。
VTCは, 分類, セグメンテーション, 検出タスクにおいて, 代表的VT特徴量ベースラインを一貫して上回っていることを示す。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:32:04 GMT)
FailForge: Distilling Procedural Competence from Persistent Failures into Code Agents [49.5] FailForgeは、失敗したロールアウトをトレーニングシグナルに変換するエージェントフレームワークである。
FailForgeは、これまで失敗したインスタンスの26%を、限界的な追加コストでリカバリする。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:22:57 GMT)
Independent Patch Verification for Coding Agents with a Bidirectional Reconstruct-and-Verify Framework [49.2] 大規模言語モデルを利用したコーディングエージェントは、バグレポートから直接コードパッチを生成することができる。
報告された問題を真に解決するかどうかを独立に検証するメカニズムは存在しない。
本稿では,RETRACE をトレーニング不要なポストジェネレーション検証フレームワークとして提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 22:59:13 GMT)
$ω$-0: A Latent Predictive World Action Model for Concurrent Humanoid Loco-Manipulation [47.9] 我々は,実世界におけるヒューマノイド同時ロコ操作のための潜在予測全体ワールドアクションモデルである$-0を提示する。
11の家庭用タスクに関する実世界の実験は、1ドル=0のモデルがスムーズな操作と動作の振る舞いを生み出すことを実証している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:34:38 GMT)
On-Policy Self-Distillation without Any Supervision [47.3] 我々は、内部整合性を通して、モデル自身の世代のみを用いて、政治上の自己蒸留を実現することができることを示す。
教師なしの政治自己蒸留(U-OPSD)を提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:07:45 GMT)
Three Generations of Healthcare IT: From the Digital Record to the Computable Care Process [47.0] 対象が患者固有の臨床目的である計算層について述べる。
我々は第3層の原子オブジェクトとしてActionable Clinical Recordを定式化する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:44:28 GMT)
Forgotten History or Test-of-Time? Retrospect and Prospect on RAG from an IR Perspective [46.8] 我々は、RAGの根底にある中核的なアイデアは、新しいものではないと論じる。
本稿では,現代のRAGとエージェントRAGの知的系譜を,従来のIRやQAの先駆者に体系的に遡って追跡する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:29:46 GMT)
Yesterday's Shield, Today's Spear: A Self-Evolving Safety Guardrail in Production [46.7] 本報告では,SESG(Self-Evolving Safety Guardrails)を運用中のマルチエージェントシステムとして紹介する。
SESGは配置されたガードレールの背後にあるライブトラフィックを監視し、障害の2つのクラスをサーフェスする。
1.7Bガードレールは16時間から24時間で新たな脅威に適応し、約2時間の人的努力と、それに代わる40~90時間の手作業に適応する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 04:31:05 GMT)
EndoMD-SLAM: Endoscopic Gaussian Splatting SLAM under Optical Degradation with Memory and Static-Transient Decomposition [46.2] EndoMD-SLAMは光学劣化下での安定性を維持するために設計されたフレームワークである。
トラッキング側では、メモリ駆動のゲーティング機構が信頼性の低い観測を検出してマップ更新を停止する。
マッピング側では、自己教師付き静的-過渡分解により、視覚汚染物質を専用の過渡場に分離する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 22:59:01 GMT)
Small Foundation Models of Human Cognition and Behaviour [45.9] 135Mから14Bパラメータの14モデルを、Psych-101の4つのアーキテクチャファミリでトレーニングしています。
Psych-101は160の実験から1070万の試行レベルの選択のデータセットである。
認知的に微調整された小さなモデルは、心理的実験のためのノイズ天井推定器として有望であることを示す。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:16:05 GMT)
OpenVisTool: An Open Recipe for Synthesizing Instructive Visual Tool-Use Trajectories [44.8] OpenVisToolは、視覚的ツール使用軌跡を構築するためのオープンなフレームワークである。
このフレームワークは、ツールなしでは確実に答えられないクエリを選択するのが難しいこと、ドメイン固有の軌道合成、そして監督検証の3段階で機能する。
このフレームワークを用いて、5つの視覚的推論領域にまたがるデータセットであるOpenVisTool-42Kと、同じドメインをカバーするベンチマークであるOpenVisTool-Benchを構築した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:01:05 GMT)
Improving Generalization Robustness of Multimodal RLVR [44.4] Reinforcement Learning with Verifiable Rewardsは、大きな言語モデルをより正確にするが、利益は不安定である。
動的三項報酬と整合正則化器からなるPIRL(Prompt-Invariant RLVR)を提案する。
ストレステストでは、ベンチマークにおけるPIRLの平均精度はわずか$le 1%ほど低下し、GRPOは3%低下した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:36:42 GMT)
Findings of the First Teaching Monster Challenge: A Benchmark of Pedagogical Content Knowledge in AI Agents [44.3] 我々は,学習者のペルソナを明示的な評価基準として扱う最初のベンチマークである「教示モンスターチャレンジ」を紹介した。
各システムはトピックと学習者ペルソナが与えられ、完全な指導ビデオを生成する必要がある。
第1版では、今日のシステムがコンテンツをうまく扱っているが、それを提示し、学習者に適応させることがはるかに弱いことを示している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 18:28:01 GMT)
360CityArena: A Realistic Virtual Urban Navigation Benchmark for Embodied Agents [44.1] 我々は,360度ビデオから構築した光現実的環境下でのエンボディエージェントの都市探査能力を評価するベンチマークである360CityArenaを提案する。
360CityArenaは、東京の秋葉原地区を、85の街路をカバーする602の360度ビデオセグメントを使って、リアルに再現したものだ。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:03:15 GMT)
LASA: Language-and-Source-Anchored Alignment for Domain Generalized Semantic Segmentation [43.6] ドメイン一般化セマンティック(DGSS)は、ラベル付きソースドメインから見えないターゲットドメインへの知識の一般化に焦点を当てている。
スタイルのランダム化は、その粗い粒度の性質のために、基礎となる特徴多様体を歪ませる。
特徴正規化は、その厳密な設計のため、非ネイティブでドメインに敏感なセマンティックディテールを抑制する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:43:04 GMT)
From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability [42.0] 視覚言語モデル(VLM)の理解は、視覚言語アクションモデル(VLA)を構築するための行動訓練プロセスの後に残っている。
VLMは各層において深度を低下させ,空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間
モジュールレベルの分解では、次のように説明されている。 ベースVLMは、蓄積された書き込みにおいて最も深いアクセスを担います。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 20:31:52 GMT)
Tangent: An Empirical Study of Testing Practices for LLM-Based Agent Applications [41.6] エージェントアプリケーションのテストレベル、目的、データパターン、テストの複雑さ、バリデーション戦略は未検討のままです。
エージェントアプリケーション,ツール,テストの大規模データセットを構築し,240モジュールから2,572のテストメソッドを手作業でラベル付けする。
テストフィクスチャ、データ、目的、アサーションにまたがる23のテストパターンの分類を導き、レベル(ユニット、モジュール、統合)によるテストの特徴付けを行います。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 02:08:34 GMT)
Hermite Curves as Trajectory Priors for Vision-Language-Action Models [41.5] 本稿では,Hermite trajectory priorsを導入し,チャンク軌道を終点位置と速度で定義される3次Hermite曲線としてパラメータ化する。
我々は、この固定作用素を離散自己回帰および連続生成パラダイムでインスタンス化する。
シミュレーションベンチマークと実ロボットプラットフォーム全体で、Hermite Regularizationは優れたパフォーマンスを実現している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:46:24 GMT)
Branch2Skill: Efficient Skill Evolution Through Reasoning Trees [41.1] Branch2Skillは、単一の推論ツリーを、スキル進化のための密集した監視に変換する、効率的なフレームワークである。
スキル進化効率を高めながら、タスクパフォーマンスを継続的に改善する。
例えば、GPT 5.5をターゲットモデルとして、Branch2SkillはSkillOptよりも73.2%少ないトークンを使用し、優れたパフォーマンスを実現している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:48:10 GMT)
EnergyBridge: Benchmarking Household Energy Management, User Participation, and Grid Flexibility [39.9] 家庭用仮想発電所(VPP)は、家庭の需要をシフトさせることでグリッドの柔軟性を提供することができる。
既存のベンチマークは制御を評価するが、イベント固有の認証を省略する。
本稿では,キャパシティレポート,家事認可,身体的実行を結合するベンチマークおよびエージェントフレームワークであるEnergyBridgeを紹介する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:12:33 GMT)
Toward CT-Equivalent Image Quality in Low-Dose Radiotherapy Planning: Conditional Diffusion-Based CBCT-to-CT Synthesis and the Impact of CBCT Input Representation [38.6] 本研究では,条件付き denoising diffusion probabilistic model (DDPM) を用いた教師付き深層学習に基づくCBCT-CT合成フレームワークを開発した。
本研究の目的は,標準臨床用DICOM CBCT画像とフィルタバックプロジェクション(FDK)再構成のCBCT入力データの表現が拡散型CT合成の性能に与える影響を検討することである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 21:15:08 GMT)
UniSpace: Unified Visual Representation and Scalable Multimodal Modeling [38.4] 事前学習されたセマンティックViTから構築された単一の視覚的表現空間において、理解、生成、編集がモデル化可能であるかを検討する。
emphPatch Reパラメータ化を導入し、リコンストラクション対応パッチの埋め込みを追加しながら、元のセマンティックパスを保存する。
その結果得られた統一表現は、高忠実度画像再構成と好適な再構成世代トレードオフを実現しつつ、マルチモーダル理解を保存する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:46:56 GMT)
ERF-GS: Reconstructing Fast Motion from Disjoint Event-RGB Viewpoints [37.1] Event-RGB fusion Gaussian splatting (ERF-GS) フレームワークは、イベント情報を最適化と密度化の両方の段階に統合する。
ERF-GSはリアルなシミュレーション設定を用いて開発され、RGB入力から切り離されたイベントベースの学習を実現する。
ERF-GSは,Neu3DデータセットとNvidiaデータセットの異なるバリエーションにおいて,4DGSベースラインと同時E-D3DGSの両方より優れていることを示す。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:00:27 GMT)
MRI super-resolution in ten sampling steps using a diffusion bridge model [36.9] 拡散に基づく超解像は、低分解能(LR)入力から高分解能(HR)画像を再構成する。
我々は、LRデータから直接HR MRIを再構成する効率的な拡散フレームワークを開発した。
超高磁場7T脳T1 MP2RAGEマップと骨盤T2強調前立腺画像を用いたSR-DBMの評価を行った。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:09:21 GMT)
AnchorFold: A Focus-Then-Fold Framework via Recursive Attention Propagation for Efficient Multi-Vector Visual Document Retrieval [36.8] マルチベクタビジョン言語レトリバーは、遅延インタラクションを通じて細粒度のVisual Document Retrieval(VDR)を可能にする。
既存のトレーニングフリーメソッドは、プルーニングやマージに依存している。
AnchorFoldは、文書側インデックス圧縮のためのトレーニング不要のフォーカステーマフォールドフレームワークである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:23:08 GMT)
OccAnyScene: Towards Unified Indoor-Outdoor 3D Occupancy Predictio [36.6] クロスシーン3Dセマンティック占領予測は、異種シーンを扱うために単一のモデルを必要とする。
OccAnySceneは,予め訓練された深度基礎モデルに基づいて構築された画素フラストム中心のガウスフレームワークである。
OccAnySceneは、室内のOcc-ScanNetで59.92% mIoU、屋外のSurroundOcc-nuScenesで23.06% mIoUを達成した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:19:53 GMT)
OmnilingualGAIA2: Evaluating the Multilingual Gap in Frontier AI Agents [32.2] 我々は,GAIA2エージェントベンチマークの機械翻訳拡張であるOmnilingualGAIA2を紹介する。
我々は8.8-18.4 pass@3の普遍的な言語間ギャップを見つけ、これは大きさがエージェント非対称であり、量的推論よりもツール整合に集中し、モデルスケールに近づかない。
人間の専門的な言語分析は、非ラテン文字言語の主要な失敗メカニズムとして、形態的キューの喪失と曖昧さの増幅をさらに特定する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:49:00 GMT)
Optimal Learning Under Tsybakov Noise [31.7] 高い確率で$h*$と競合する低い誤差の仮説を出力する学習アルゴリズムを設計する。
本手法は,非実現可能学習における近年の進歩と共通する概念基盤である。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 02:20:51 GMT)
VADER: Adaptive Debiasing for Hallucination Mitigation in Video Large Language Models [30.8] Video-Adaptive Debiasing via Evidence Reweighting (VADER)は、2つの補完モジュールを持つトレーニング不要のフレームワークである。
Visual Focus Reallocation (VFR)は、ビデオ検索の各入力に対する介入ポリシーを自動的にインスタンス化する。
SEE(Selective Evidence Erasure)は、フレーム毎に高重要性の視覚トークンを隠蔽する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:09:11 GMT)
Agentic Visual Reasoning in Whole-Slide Pathology Images via Active Perception [30.7] 全スライディングの視覚的推論は、ギガピクセルスライドでスパース診断の証拠を特定する必要がある。
本稿では、WSIの証拠取得をシーケンシャルな意思決定として定式化するアクティブパーセプションフレームワークであるAdaptivePathを紹介する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:45:12 GMT)
Human-Guided Causal Knowledge Injection for Virtual Cells [30.0] 仮想細胞に因果グラフを注入すると解釈性が向上するが、そのようなグラフは通常現実世界のアプリケーションでは利用できない。
仮想細胞に対するヒューマンガイド型因果知識注入法を提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:00:36 GMT)
Differentiate the Solver, Not the Equation: Reverse-Sweep Adjoints for Block Implicit Simulation [28.8] 微分可能シミュレーションは学習、制御、逆問題において重要な要素である。
本稿では,実行されたソルバ自体を識別するソルバレベルの微分法を提案する。
この研究は、効率的な微分可能シミュレーションのための実践的な組織原理として、ソルバ構造を強調している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:03:02 GMT)
Kernel Methods for Refined Prophet Inequalities [27.4] 単選択預言不等式は、独立した非負の値が逐次現れる標準的なオンライン選択問題である。
単項預言不等式に対する一般的なカーネル法を開発した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:08:57 GMT)
Population-Scalable Multi-Agent World Modeling [27.1] Khoraはスケーラブルなマルチエージェントの世界モデルであり、再トレーニングせずに任意の数のエージェントへの推論時間拡張をサポートする。
我々のフレームワークは、視覚的レンダリングから世界状態の進化を分離し、他のエージェント情報を組み込むための集団に依存しないレンダリング機構を導入する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:26:15 GMT)
Reading is not Reasoning: Bridging the Agentic Policy Gap in Vision-Text Compression [26.3] 多段階の言語モデルエージェントは、成長する相互作用履歴を繰り返し処理し、かなりのコンテキストコストをもたらす。
視覚-テキスト圧縮は、履歴を画像としてレンダリングすることでこれらのコストを削減するが、その結果、大きな能力ギャップが生じる。
ビジュアル・ヒストリー・エージェントは、行動選択、クエリの定式化、停止、エビデンスの使用において体系的なドリフトを示し、エージェントポリシーのギャップを明らかにしている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:38:12 GMT)
SymDiag: Explainable Diagnosis for LLM Reasoning via Neuro-Symbolic Verification [26.0] 大規模言語モデル(LLM)は、データ駆動推論としてますます機能するが、最終的な答えが正しい場合でも、そのチェーン・オブ・シント(CoT)は不誠実である。
textbfSymDiagは,構造的故障診断として検証を推し進めるニューロシンボリックなフレームワークである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:05:16 GMT)
Zero-shot 2D Grounding with Novel Affordance Types [25.7] 2Dの空き地は、人間が対話できる物体の領域を見つけることを目的としている。
本研究では,NATを用いたゼロショット2Dグラウンドリングを提案し,NATベンチマークを導入する。
次に,AffordAnythingを提案する。AffordAnythingは,アベイランス領域とオブジェクトサブパート間の強い相関によって動機付けられたセグメンテーションキューを利用する,トレーニング不要な手法である。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 21:44:34 GMT)
REVEAL: A Rubric-Guided Agent for Explicit Evidence Sufficiency Verificationin Long-Video Question Answering [25.5] REVEALは、長いビデオ質問応答のためのルーリック誘導エージェントフレームワークである。
本稿では,視覚的コヒーレントな隣接フレームを自然なイベント単位にグループ化する適応型視覚類似性に基づく前処理パイプラインを提案する。
この構造化メモリ上に構築されたREVEALは、自動的に構築されたルーリックライブラリを使用して、検索された証拠が満足度基準を満たすかどうかを明示的に検証する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:55:42 GMT)
UniMoMo: Expert Merging-Based MoE Acceleration for Large Recommendation Models [25.1] 制約付きグラフ粗大化問題として定式化された後処理圧縮フレームワークUniMoを紹介する。
UniMoMoは、専門家が共有レコメンデーションステートにどのように反応するかを測定するために、ラベルなしのキャリブレーションセットを使用して、機能的な類似性に基づいて専門家をグループ化する。
性能劣化を防止するため,高信頼度専門家の合併を制限する層適応型保護機構を導入する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:20:20 GMT)
End-to-End Neural Decomposition with Koopman Operators for Time-Series Forecasting [25.0] 我々はニューラル・コンプリケーション・クープマン(NDクープ)と呼ばれる新しいアプローチを提案する。
NDKoopは、シーケンス予測のための周波数非依存ネットワークと周波数依存ネットワークの両方に学習可能な信号分解モジュールを統合する。
周波数非依存の傾向成分と周波数依存の周期成分に信号を分解すると、それぞれ対応するクープマン演算子によって制御され、完全線形化が不可能な場合には予測精度が向上することを示した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:08:54 GMT)
Whose Refusal Is It? The Unmeasured Contribution of Black-Box Multimodal Guardrails [24.8] ガードレールの実際の安全のシェアは、そのすべてから本質的には、どれにも及ばない。
ガードブロックがモデルの応答を置き換えるため、スプリットは余分なコストでリカバリ可能である。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:19:30 GMT)
Transfer Learning-Enabled Distortion Compensation for Amplitude-Phase-Time Block Modulation-Based Nonlinear Single-Carrier Wireless Communications [24.5] 振幅位相時間ブロック変調(APTBM)に基づく非線形単キャリア伝送のための完全ディジタルトランスシーバ協調手法を提案する。
送信機では、繰り返しクリッピングとフィルタリング(ICAF)と静的ディジタル事前歪み(SDPD)が協調して動作し、信号ピークの低減とスペクトルの増大を抑制する。
提案手法はオンライントレーニング時間と計算オーバーヘッドを大幅に削減し,従来の学習ベースDPoD方式と比較して2dB以上の性能向上を実現した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:55:23 GMT)
RayLift: Lifting Complementary Ray-Wise Evidence with 3D Geometry Priors for Semantic Scene Completion [23.7] カメラベースの3Dセマンティックシーン補完(SSC)は、自律走行とロボット工学のための総合的なシーン理解を提供する。
既存の方法は、しばしば立体深さ推定を決定論的幾何学的制約として扱い、深さの不確かさと局所対応誤差が直接ボクセル表現に伝播する。
ステレオ幾何をメートル法基準として用いるフレームワークであるRayLiftを提案し, 補的光線証拠を組み込んで信頼性の高い3次元構造を適応的に復元する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 04:41:34 GMT)
Teaching Foundation Models to Read mmWave: Pose-Guided Kinematic Representation for Human Behavior Understanding [23.7] ミリ波(mmWave)レーダーは、プライバシーに優しく、接触のない知覚モダリティを提供する。
既存のレーダー言語法は、しばしば合成データに依存するか、人体構造や運動力学の明確な監督を欠いている。
同期3ポーズトレーニングモデルを用いたレーダ言語モデルmmMindを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:08:29 GMT)
Keep the Needle, Prune the Haystack: Defect-Preserving Token Pruning for Efficient Zero-Shot Anomaly Detection [23.6] トケンプルーニングは有望な解決策を提供するが、異常検出において非対称プルーニングリスクを導入する。
本稿では,トークン選択をハイリコール・異常対応ルーティングとして定式化する欠陥保存型トークンプルーニングフレームワークであるKeepADを提案する。
実験によると、KeepADはトークン保持率を20%以下に下げ、画像レベルとピクセルレベルのAUROCの平均劣化を2.7ドルの範囲に制限している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:55:13 GMT)
ML-Based Hierarchical Prediction for Practical Energy Scheduling in Dynamic NTN-WPT Systems [22.8] 次世代無線ネットワークにおいて,長距離無線電力伝送(WPT)が有望なアプローチとして浮上している。
本稿では,エネルギー効率,タスク完了率,タスク待ち時間を共同で最適化するエネルギースケジューリング手法を提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:41:13 GMT)
Difficulty-Gated Fusion of Reasoning Views for Temporal Retrieval [22.8] 推論集約的な時間的検索は、共有時間的推論に依存している文書とクエリをマッチングする必要がある。
そこで本研究では,問合せに難渋した推論ビューの融合を提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 22:31:49 GMT)
CAP: A Scalable Benchmark for Evaluating Cross-Site Browser Agents with Complex Actions and Perception [22.6] 大規模な言語モデルは、ブラウザを介してWebと対話する自律的なエージェントとして、ますます多くデプロイされている。
我々は、クロスサイト、ヒューマンライクなWebタスク上でブラウザエージェントを評価するためのスケーラブルなベンチマークであるCAPを紹介した。
108の現実世界のWebサイトと24のドメインに420のタスクを構築し、注意深く品質管理します。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 01:08:19 GMT)
Efficient Test-Time Scaling for LLM-based Time Series Forecasting [21.7] 長期の時系列予測は、トレンドや季節といったグローバルな構造を保存することの恩恵を受ける。
最近のLSMベースの予測器は、テストタイムスケーリングによって精度を向上することが多い。
しかし、これらの手法は計算コストが高く、予測の地平線が延びるにつれて、グローバルな形状のミスマッチが生じる傾向にある。
本稿では,未来力学の粗い表現を予測するために,長期形状モデリングに適した軽量トランスフォーマーを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:45:08 GMT)
Loss-Resilient Wireless Video Token Communication over Block Fading Channels [20.9] 損失耐性のある無線ビデオトークン通信フレームワークを提案する。
WVTCはビデオトークンの固有の予測構造からトークンの重要性を評価する。
数値計算の結果,パケット誤り率の増加により知覚品質が向上し,優雅な劣化が見られた。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:23:45 GMT)
DoRF++: Spherical Representation Learning over Doppler Radiance Fields for Robust Wi-Fi Sensing [20.9] Wi-Fi Channel State Information (CSI) から抽出したドップラー速度予測のドップラー放射場(DoRF)モデル
DoRF++は球面変換器をアクティビティ分類に応用した球面学習設計である。
収集したハンドジェスチャデータセットを用いて実験したところ,DoRF++はユーザ間の一般化精度において,最先端のWi-FiベースのHAR法よりも大幅に優れていた。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 00:23:55 GMT)
Epistemic Trustworthiness in Generative AI: A Normative Framework for Warranted Reliance in High-Stakes Workflows [20.5] ジェネレーティブAIシステムは、高度な専門的なコンテキストにますますデプロイされている。
既存のフレームワークでは、AI出力が正確か、公正か、説明可能か、安全か、あるいはユーザによって信頼されているかを問う。
システムに信頼に値するものにするためには,信頼の欠如が不可欠だ,と私たちは主張する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 22:23:05 GMT)
IDATA: Scalable Invertible Diffusion for Unrestricted Adversarial Transfer Attack [20.5] 深部視覚モデルのブラックボックスロバスト性を評価するためには,非制限逆転攻撃が重要である。
Invertible Diffusion Module (IDM) と Low-Frequency Constraint Module (LFCM) を提案する。
IDMは、拡散軌道上の逆最適化を可逆過程として再構成し、定数メモリのバックプロパゲーションを可能にする。
LFCMは潜伏変数を低周波成分と高周波成分に分解し、摂動を意味的に安定な低周波部分空間に制限する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:26:42 GMT)
Protection Levels for Vision-Based Pose Estimation [20.2] 本稿では,航空機設定に適用される非線形パースペクティブ-n$-Point問題に対する保護レベルを計算するためのアルゴリズムを提案する。
我々は,測定冗長性,画素レベルの予測不確実性,滑走路距離が結果の保護レベルに与える影響を解析した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:37:39 GMT)
Conversation as Measurement in Clinical Encounters: Observable Phase Structure, Partially Observable Patient State [20.2] 多くの現代のAIシステムは、人間のインタラクションと状態の側面を推測するために会話の痕跡を分析し、そのような情報が会話から回復可能であることを暗黙的に仮定している。
134時間にわたる実世界439件の臨床診断書を用いた患者状態と会話相構造の観察可能性について検討した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:16:10 GMT)
Minute-Scale Training for Microrobot Navigation [19.6] 本稿では,効率的なマイクロロボットナビゲーションポリシーを数分でトレーニングできる学習フレームワークを提案する。
高速トレーニングにおける有効性を実現するために,タスク形成・正規化(TSR)報酬フレームワークを提案する。
提案した学習フレームワークは,ゼロショットデプロイメントをサポートしながら,トレーニング時間を10分未満に短縮する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 05:14:56 GMT)
Depth-Aware Implicit Neural Representation Priors for 3D Gravity Inversion [19.4] 本稿では3次元重力インバージョンのための教師なし深度認識型暗黙的ニューラル表現を提案する。
実験の結果,提案手法はRMSE,PSNR,SSIMの総合性能が向上することがわかった。
地上構造密度モデルが得られなかったフィールド実験では、この手法はコンパクトで分離され、垂直にコヒーレントな異常を発生させた。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:34:32 GMT)
Where Is the Bee? Detecting Tiny Pollinators with a Single Collaborative-Head Transformer [19.2] CVPPA@ECCV 2026 BuzzSpot Challengeでは、19201080xフィールドラベルでミツバチ、バンブルビー、ホバーフライ、ハチを検知します。
小箱に対処するため,保持ラベル上で記録された10個の検出器構成を比較した。
FinalTestで最初にランク付けするのは0.5062 mAP@[.5:.95]で、推論時のアンサンブルやテスト時の拡張は不要です。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:49:32 GMT)
MotionCraft: Latent World Modeling with Sparse Attention for Visual Upscaling [17.6] ビデオ超解像(VSR)は、高精細度高精細度映像を低精細度入力から回収することを目的としている。
制御可能なVSRフレームワークであるMotionCraftについて述べる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:54:43 GMT)
ForestBench: A Unified Graph Framework for Evaluating Multi-Agent Collaboration [17.2] 大規模言語モデル(LLM)上に構築されたマルチエージェントシステム(MAS)は急速に普及している。
それらの不均一な実行トレースは、メソッド間の評価の共通基盤を提供しない。
我々は、ネイティブMASトレースを統一協調グラフの共有空間にマッピングする一般化可能な評価フレームワークを導入する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:38:52 GMT)
Learning from Consensus and Disagreement: Unsupervised On-Policy Self-Distillation with Minority-Trajectory Contrast [15.3] オンライン自己蒸留は、実際に学生が訪れた州について教師に質問することで、言語モデル推論を改善する。
近年の手法は、教師を特権的文脈に露出させることにより、強力な情報非対称性を生み出す。
我々は、モデル自身のロールアウトの潜在的不確実性構造から完全に信頼性の高い特権情報を生成する、完全に教師なしのフレームワークであるCoDAを紹介します。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:23:25 GMT)
Linguistically-Aligned and Visually-Grounded Preference Optimization for Clinically-Augmented Medical Report Generation [15.3] DPO-Clinは,臨床所見とクロスモーダルアライメントを優先的に最適化する,新しいポストトレーニングフレームワークである。
細粒度のクロスモーダルアライメントを実現するため,M$2$DPOを開発した。
DPO-Clinは臨床用メトリクスのSFTベースラインを大幅に改善する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 05:29:42 GMT)
Safety Cost of Steering Vectors Is Separable and Reducible [15.1] ステアリングベクターは、意図せずにモデルの安全メカニズムを妥協し、有害な要求に対するコンプライアンスを高めることができる。
この安全劣化は, モデルの安全機構を乱すベクトルの分離可能な成分から生じるが, 操舵目標にはほとんど寄与しないことを示す。
本手法は, 操舵時の安全劣化を著しく低減し, 元の操舵効果を抑えながら, 誤操作を最小限に抑える。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 00:29:54 GMT)
Degradation-Guided Underwater Image Restoration with Task-Oriented Latent Control [15.0] 本稿では,劣化誘導型特徴適応とタスク指向潜在制御を併用したProteusを提案する。
5つのペアと4つの非参照水中ベンチマークの実験は、Proteusが高度に競争力のある復元性能を発揮することを示した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:08:34 GMT)
Calling the Bluff: Detecting Ever-Shifting Harmful Chat Dialogue via Ordered Reasoning Chain Regularization [15.0] 有害なチャット対話は、タイプシフトと語彙回避を通じて、常にシフトしている。
本稿では、繰り返しトピックの順序付き推論連鎖(ORC)を符号化するBRACEを提案する。
BRACEは0.934の調和型マクロF1を達成し、デコーダバックボーン(Qwen3-1.7B LoRA)は0.949に達する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:41:39 GMT)
LibraSpec: Dynamic Diffusion-Based Speculative Decoding via Marginal-Gain-Driven Optimization [14.9] 投機的復号化は、並列検証のために複数のトークンを起草することで、大きな言語モデル推論を加速する。
トレーニング不要でプラグアンドプレイのアルゴリズムである textitLibraSpec を開発した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:15:14 GMT)
Business Arena: Benchmarking LLM Agents in a Realistic Marketplace [14.6] Business Arenaは、AIエージェントが国境を越えた店を経営し、サプライヤーから購入し、長期にわたって購入者に販売する管理環境である。
15のフロンティアモデルを評価し,9倍の差が得られた。
最高のモデルでさえ、人間設計の戦略に遅れをとっており、LLMエージェントにとってビジネス運用は依然として困難であることを示している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:08:21 GMT)
Discovering Diverse Planning Policies for Multimodal Embodied Agents with Quality-Diversity Optimization [14.3] マルチモーダルエンボディエージェントの多様な計画方針を発見するための品質多様性フレームワークを提案する。
提案手法は,計画型テンプレートを進化可能な個人として扱い,行動インデクシングしたアーカイブとして整理する。
オフラインの段階では、ロールアウトの軌跡は構造化された成功と失敗の経験にまとめられ、ポリシーの変化を導く。
オンラインの段階では、システムは最新のチェックポイントにロールバックし、動作的に異なるアーカイブポリシーに切り替えて実行を再開する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 06:41:53 GMT)
Unaccountable Delegation, Fading Skills: Mapping the Risks of Workplace AI Agents [14.1] 既存のAIリスクは幅広いリスクに焦点を当てており、AIエージェントが導入するジョブ固有のリスクを捉えない。
我々は、AIエージェントの文献レビューから多層フレームワークを開発し、2,078のジョブタスクの記述に適用する。
我々は既存の分類を拡張し、職場AIエージェントのリスクを15カテゴリに分類する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:28:51 GMT)
ViSR-KGC: Visual Subgraph Reasoning with Vision-Language Models for Multimodal Knowledge Graph Completion [13.9] 知識グラフ補完のためのビジュアルサブグラフ推論手法ViSR-KGCを提案する。
セマンティックな相関を捉えるために3つの補完機能を統合する。
学習したマルチモーダル埋め込みに基づいて,本フレームワークはまず,コンパクトでクエリ対応のサブグラフを抽出する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:28:01 GMT)
Optimal strategies for shadow tomography with limited resources [13.6] シャドウトモグラフィーは、比較的少数のコピーのランダム化測定から未知の量子状態の期待値を効率的に予測するタスクに対処する。
既存の分析は大規模なスケーリングの利点を約束するが、これらの保証を実現する最適な戦略は必ずしも分かっていない。
このギャップを,実資源制約下での最適試料複雑度パラメータの計算と最適測定戦略の構築により解決する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 02:59:36 GMT)
A Distribution Mapping Approach to Counterfactually Fair Reinforcement Learning [13.6] 強化学習(Reinforcement Learning, RL)は、人口レベルのメリットを時間とともに最大化するために、シーケンシャルな決定を最適化することを目指している。
カウンターファクトフェアネス(CF)は因果推論に基づいてこの問題に対処するための有望なフレームワークを提供する。
本稿では、ポリシー学習と組み合わせて使用した場合、RLにおけるCFを可能にするデータ前処理アルゴリズムを開発する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:42:47 GMT)
MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning [13.5] 知識誘導型ハイブリッド報酬フレームワーク(textscMedCalc-R1)を提案する。
計算式を明示的に生成する知識検証報酬機構を導入する。
臨床安全閾値とソフトで精度の高い報酬に基づいて、ハード制約を併用したハイブリッドソフトハード報酬方式を設計する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:13:20 GMT)
SkillReason: Reasoning-Enhanced Agent Skill Retrieval for Implicit User Requests [13.4] SkillReason-Benchは3,729のクエリと9つのドメインにまたがる61,228スキルの検索コーパスを含む大規模クロスドメインベンチマークである。
SkillRea sonという2段階のフレームワークを提案する。
SkillReason-Bench、SkillRet、SRA-Benchの実験は、Skill-Reasonが3つのベンチマークすべてで最先端のパフォーマンスを達成したことを示している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:19:20 GMT)
Multi-Agent Reinforcement Learning via Agent-Specific Preference [13.4] マルチエージェント強化学習は、明確に定義されたグローバル報酬関数に大きく依存する。
我々はエージェント固有の選好モデルを用いてこれらの課題に対処するMulti-AGent Preference-Integrated lEarning(MAGPIE)を紹介する。
我々は,MAGPIEが報酬工学的ベースラインに匹敵する性能を達成することを示す。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:38:41 GMT)
Deferred Audio Pruning with Local Audio-Visual Dynamics for Omni-LLMs [13.2] A-Packは、クエリ条件のマルチモーダルインタラクションが出現するまで、オーディオプルーニングを無効にするフレームワークである。
A-Packは評価済みのメソッドの中で最も高い平均性能を達成する。
FLOPを最大78%削減し、復号スループットを最大2.21倍改善する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:18:41 GMT)
MGMCL: Multi-Granularity Manifold Contrastive Learning With Neural ODEs for Cross-Subject EEG Emotion Recognition [13.0] クロスオブジェクト脳波(EEG)に基づく感情認識は依然として困難である。
既存の手法はユークリッド空間で運用され、限界分布アライメントに焦点を当てている。
本稿では、感情認識を学習連続表現として再認識するMGMCLを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:13:51 GMT)
Explicit Boundary Markers for Subword Vocabularies [12.9] サブワードトークン化器は、スペース用途の書き込みシステムにおいて、多くの一般的な単語を2回表現する。
明示的な単語境界マーカーを用いた標準ホワイトスペース規則の代替を提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 18:16:51 GMT)
FitAQA: A Benchmark of Fitness Action Quality Assessment for Multimodal Large Language Models [12.8] 本稿では、フィットネスAQAにおけるマルチモーダル言語モデル(MLLM)の評価のための体系的なベンチマークであるFitAQAを紹介する。
6つの相補的な品質次元内で38の繰り返しフォームエラーを定義する統一型形式誤り分類法を開発した。
FitAQAはさらに、関連する視覚的証拠を認識するための認識、その証拠をドメイン知識と組み合わせて実行の正確さを評価する判断、時間とともにフォームエラーをローカライズするための時間的根拠の3つの評価タスクを定式化している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:28:17 GMT)
Exact Rank and Convex Calibration Dimension Lower Bounds for the Multi-Label F1 Loss [12.8] 我々は、$F_$のベイズ幾何学を直接解析する。
対応するアクティブな損失列は、証人サポートに限定され、アフィン次元が$hn$であることを示します。
凸次元のキャリブレーションのために実現可能な部分空間の下限を適用すると、[演算子nameCCdim(LF_) ge left(frac23sqrt3-o(1)right.] 二次上界と共に$operatornameCCdim(LF_)=が成立する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 01:26:56 GMT)
LLMVisor: A Real-Time Latency Attribution Model for Multi-Tenant LLM Serving [12.7] 共バッチはスループットを向上するが、テナント単位の使用量やコントロール制限は曖昧になる。
本稿では、メモリバウンドおよび計算バウンドフェーズをキャプチャするルーフライン誘導遅延モデルであるLLMVisorを提案する。
トークンカウントベースラインと比較して、LLMVisorは、ほぼ完全なR-二乗を実現し、相対誤差を最大2.5倍まで削減する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 00:28:05 GMT)
What Keeps Agent Skills from Being Reusable? Evidence from 138K SKILL.md Files [12.5] 多くの公開SKILL.mdファイルは単一のタスク、リポジトリ、会話に由来する。
20,556リポジトリから138,133の公開SKILL.mdファイル間でのこのギャップを分析する。
91.8%のスキルには少なくとも1つの検出された欠陥が含まれており、厳密な閾値と厳密な閾値で安定した見積もりがある。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:49:30 GMT)
SkillsMetric: Mapping the Detection Boundary of Static Analysis for Malicious Agent Skills [12.5] textscSkillsMetricは5段階の静的解析フレームワークで、パターン密度、統計異常、データフローのテナント、インポート異常、能力ミスマッチの次元に沿ってスキルパッケージをスコアする。
我々は、コードレベル、システムレベル、セマンティックレベルの脅威にまたがる16の攻撃型にまたがる2266のスキルの逆評価データセットを構築し、SkillMD-138Kコーパスの完全な評価を行う。
我々のフレームワークは AUC の 0.93 と 5 倍のクロスバリデーション F1 の 73.4%$pm$0.5% を達成する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 04:19:10 GMT)
Not an A11y: How Android Accessibility Exposes Mobile AI Agents to Indirect Prompt Injection [12.4] 敵のプロンプトは、自律エージェントが元の目的を放棄し、コンテキスト境界に違反し、不正なデバイスアクションを実行させる可能性があることを示す。
本稿では,これらの攻撃を分類し,ゼロトラスト入力検証,専用セキュリティエージェント,モバイルエージェントアーキテクチャにおける厳密なコンテキスト分離の必要性について論じる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 22:13:55 GMT)
Enhancing Scientific Named Entity Recognition via Large Language Models: A Type-driven Multi-task Learning Approach [12.4] 科学名実体認識(SciNER)は、科学文献からの情報抽出と知識発見において重要な役割を担っている。
近年,大規模言語モデル (LLM) は,人間の努力を最小限に抑えて,競争力のあるSciNERの性能を実現する能力を示した。
本稿では,エンティティ型情報を効果的に活用し,SciNERの性能を向上させる型駆動型アプローチTdSciNERを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:59:37 GMT)
RenderMatte: Exact-Alpha Rendering and Group-Relative Alignment for Image Matting [11.7] RenderMatteは、FLUX.1 Kontextをフルパラメータの微調整により適応する、トリマップ誘導型マットフレームワークである。
アルファエッジの目的は、画素空間境界監督を強化しつつ、潜時フローマッチング信号を保存する。
実験では、すべてのベンチマークで最先端のパフォーマンスを示し、オープンワールドのシーンで高忠実なマッティングへのスケーラブルなパスを示している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 05:07:56 GMT)
SHRIMP: Iterative Refinement of Robot Task Plans [11.6] 本稿では,自然言語を用いた階層型ロボットプリミティブプラン作成システムであるSHRIMPを紹介する。
SHRIMPを使えば、ユーザーはシミュレーションで自分の計画を検証でき、一度満足すれば、それを物理ロボット上で実行することができる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:47:16 GMT)
Agentic AI-powered flexible fiber-bundle endoscopy for high-resolution NIR-II fluorescence imaging in vivo [11.5] 我々は,光学-計算共設計による制約を克服する,AIを利用したフレキシブル内視鏡プラットフォームを提案する。
我々は,ハニカムアーティファクト除去と画像復元のためのエージェントガイド混合(GAME)パイプラインを開発した。
GAMEは、我々の内視鏡で取得した多様な生体画像、細胞、マウス、およびヒトのサンプルに単一のエントリポイントを提供する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 01:43:29 GMT)
CDGC-Net: 3D Medical Image Segmentation with Cooperative Dual-Scale Self-Attention and Grouped Channel Modeling [11.1] CDGC-Netは、協調的な2次元空間的注意とグループ化された階層チャネルモデリングを組み合わせた3次元医用画像セグメンテーションネットワークである。
Synapse、ACDC、BraTS、LAのデータセットでは、CDGC-Netはそれぞれ86.96%、92.91%、82.56%、93.52%の平均値を達成した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:29:46 GMT)
PluginEval: A Diagnostic Benchmark for Fine-Grained Error Attribution in Function Calling [11.1] 大規模言語モデルは、ますます自律的なエージェントとして機能している。
現在のベンチマークには3つの制限がある。
Evalは、2段階のフレームワークで構築されたベンチマークである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:25:54 GMT)
PEEL: Parallel Extraction for Long-Horizon Disassembly Planning via Scale-Invariant Sampling [11.1] 本研究では,オブジェクト集合体の分解動作を効率よく計算し,ロボットマニピュレータに供給するアルゴリズムを提案する。
その結果,MAB-RRTは76組の組立で100%成功率の単一部品分解を効率よく解くことができることがわかった。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:44:26 GMT)
Physics-Informed Learning for Robust Acoustic Localization with Calibrated Uncertainty [10.9] 本稿では,理想的な運転条件以外の堅牢性を向上する手法を提案する。
物理インフォームド音響特徴を用いた学習モデルは高速双曲解法を補正する。
提案手法はロバストで不確実性を考慮した局所化を実現する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 20:55:17 GMT)
Idea Search: Guiding Tree Search with Ideas to Explore Diverse Scientific Methods [10.8] Idea Search は動的 "Idea Bank" をツリー検索に体系的に統合するフレームワークである。
シングルセルRNAシークエンシング(scRNA-seq)バッチ統合では、Idean Searchは強力な純粋なTree Searchベースラインの台地を確実に破壊する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:31:57 GMT)
Personalized Communication Skills for Agentic Recommender Systems [10.5] AgentComはエージェント推奨システムのためのパーソナライズされたコミュニケーションスキルフレームワークである。
再利用可能なコミュニケーションスキルを、スキルバンク(スキルバンク)の共有の理由にまとめる。
AgentComは、伝統的、社会的、エージェント的な推奨者間でのレコメンデーションパフォーマンスを継続的に改善する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 02:23:45 GMT)
Estimating Uncertainty in Galaxy Morphology Classification [10.2] UEGMCは、銀河形態分類のための不確実性推定のポストホックフレームワークである。
GMCにおける不確実性は、モデルパラメータ、天文学的データ、参照標準、または本質的な物理的曖昧さによって異なるタイプに分類される。
本フレームワークは,基礎モデルの凍結バックボーンから抽出した表現から不確実性を直接予測することができる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 01:25:27 GMT)
Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information [10.1] 我々は、DeepMORSE(DeepMORSE)と呼ばれる原理的アプローチを提案する。
DeepMORSEは、モダリティ共有自己表現モデルを通じて、クロスモーダル構造を発見し、同時にモダリティ固有の部分空間の結合に対応する構造化表現を学習する。
広く使用されている6つの画像クラスタリングベンチマークでDeepMORSEを評価し、3%を超えるパフォーマンス改善を観察した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 02:23:49 GMT)
Generics-Aware Fuzz Target Generation for Rust Libraries via Structured API Analysis [10.0] 我々は,Rustドキュメントから構造化API情報を抽出するGRAFTを提案する。
ジェネリクス対応の型マッチングを通じてAPI依存性グラフを構築し、トポロジ誘導合成とコンパイラエラーフィードバックを使用して、コンパイル可能なファズターゲットを生成する。
crates.ioの13のクレートにおいて、GRAFTは、96.19%のコンパイル成功で80.75%のマクロ平均APIカバレッジを達成し、RULFとRPGを4.76倍と2.43倍で上回り、安全でないAPIを持つクレート上でのDeepSURFの平均APIカバレッジは1.41倍に達した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:05:15 GMT)
FiRe: Fixed-Noise Refinement for Visual Counterfactual Explanations [10.0] 本稿では,視覚的対実的説明のための固定ノイズ補充フレームワークFiReを提案する。
FiReは入力を固定ノイズレベルにマッピングし、そのレベルのノイズ状態を反復的に洗練する。
FiReは約3$times$高速オンライン推論と8$times$より少ないFLOPを実現し、同等または最先端の対物品質を得る。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:15:37 GMT)
Point-gap topology in amorphous non-Hermitian quantum systems [9.7] 熱力学限界におけるエネルギースペクトルの安定なゼロモード特異状態と中ギャップ状態の対応を導入する。
特異値スペクトルは小さな摂動と大きさの変動に対して非常に堅牢であるため、位相的エッジ状態は有限の大きさのシステムでも特異値によって確実に探索することができる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:09:36 GMT)
ToolVision: Learning When and How to Use Visual Tools with Capability-Aligned Supervision [9.6] イメージで考えることで、コードを通じて視覚ツールを呼び出すことで、限られた知覚を補うマルチモーダルモデルが可能になる。
SFTはツールの使い方を教えることが期待されているが、より強い教師の軌跡は、小学生が確実に再現または活用できない知覚能力によって成功する可能性がある。
RLはいつツールを使うかを教えることが期待されているが、結果のみの報奨は、ツールの実行が失敗し、ツールの使用が抑制される。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 20:39:16 GMT)
A Structural Dynamics Graph World Model: Unified Modeling, Constrained Rollout, and Interpretable Calibration [9.4] バックボーン契約として構造ダイナミクスグラフ世界モデルを提案する。
任意の有界残差 R は学習可能性に集中し、大域射影は実現可能性を示す。
半合成洪水とUSGSストリームフローでは、SD-GWMは浮動小数点耐性に対する制約違反を低減する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:11:40 GMT)
SRE-FER: Regional residual evidence learning for mitigating local evidence dilution in fine-grained facial expression recognition [9.3] SRE-FERは、読み出しレベルの地域的残留証拠学習フレームワークである。
そのコアモジュールであるRERAは、バックボーンのグローバルな予測を保ちながらクラス境界を洗練させるゼロd残留ロジットを追加する。
3つのベンチマークで、SRE-FERはRAF-DBで92.76%、FERPlusで91.32%、AffectNet-7で67.78%に達した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:33:26 GMT)
Can We Optimize the Performance-Carbon Emission Break-Even Point?: The Quest for Greener LLMs [8.8] キャリブレーションされた微分可能なエネルギーを微調整対象に折り畳むことで、タスクの精度をゼロまたはほぼゼロの炭素コストで向上させる推論挙動が得られるかどうかを問う。
我々は,カーボンアウェアファインチューニングを,空でないモデルとタスク依存のブレークエクイティ領域を備えた軽量でドロップイン型正規化器として位置付ける。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:47:35 GMT)
Conditionally Resampled Sliding-Window Count Kernels: Spectral-Gap Bounds and Poincaré Inequalities [8.4] 定常有限状態可逆マルコフ連鎖の窓の長さn$窓の実験的数について検討する。
有限状態空間上のすべての固定された正の可逆核 (P) に対して、誘導されたカウント核 $tP_n$ of length $n$ に対してポアンカレ不等式を示す。
結果として得られる数空間のポアンカレ不等式は、有限ウィンドウ数統計量に対して局所-グロバル分散をもたらす。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:48:30 GMT)
PROSLEX: A Novel Dataset for Expert-Annotated Legal Statute Prediction for Indian Judiciary [8.0] インドにおける専門家による1,623の法的文書からなる包括的データセット PROSLEX について述べる。
我々は,ゼロショット,少数ショット,チェーン・オブ・シント,およびツリー・オブ・シントなど,様々なプロンプト戦略を評価し,法定予測とそれに対応する法的根拠の両方を生成する。
評価フレームワークは, 性能だけでなく, 生成した説明の一貫性と法的な妥当性も測定し, PROSLEX を説明可能なAIシステム開発のためのベンチマークとして位置づける。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:24:09 GMT)
Decoy Images Amplify Caption-Mediated Defenses Against Encoded Jailbreaks [7.8] 画像入力と既存のブラックボックス防御との直感的相互作用を視覚-言語モデル上で報告する。
テキストのみのエンコード入力にASRをそのまま残したキャプション経由のディフェンス(ECSO)は、コンテンツフリーのデコイが添付されると最大7,3$ppまで低下する。
私たちはこれを、堅牢な防御ではなく、パイプラインの相互作用に関する観察として捉えています。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:46:18 GMT)
ARC: Augmented-Rank Conformalization for Changepoint Localization --- Finite-Sample Validity and Distribution-Robust Efficiency [7.6] ARCは、データに依存するスコアのファミリーであり、インターセグメントのランクのみである。
各ARCスコアは、凍結重量構成ごとに有限サンプルカバレッジを継承する。
ARC信頼集合全体は、厳密に増大する辺変換の下でほぼ確実に不変である。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 02:44:08 GMT)
LLM Reasoning for Subjective Tasks: Failure Modes, Mitigation, and Dynamic Reasoning Routing [7.6] 明示的推論が主観的で人間中心の産業ごみに一般化するか否かを考察する。
検証精度が0.38マクロF1に近いのは, 採用した推論ペルソナにのみ依存することを示す。
この作業は、スケーラブルなアルゴリズムパッチと、推論モデルと現実の主観的制約を整合させる長期的なアーキテクチャの青写真の両方を提供する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 20:02:44 GMT)
Unsure but Certain: Uncovering the Representation-Confidence Gap in Diffusion Language Models [7.5] ノイズによって精度が低下するにつれて、信頼性はその最大値に近づき、答えを正しくランク付けする能力はランダムな確率に低下する。
このランキングの赤字は、ノイズの多い条件下での標準モデルを支持し、一般的な治療に抵抗する。
軽量抽出ツールは、この信号を使用してランキングを改善する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:13:46 GMT)
FSTC-Encoder: Feature--Spatial--Temporal Correlation Learning for Generalizable RF Sensing [7.4] 特徴,空間,時間的相関モデリングによる異種RF表現学習を統一するFSTCエンコーダを提案する。
Widar3.0、CSI-Bench、XRF55の他、FSTC-Encoderは92.15%の精度を実現している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:10:40 GMT)
Treating Statewide CORS Networks as Spatially Distributed Sensors for GNSS Integrity Monitoring under Unintentional and Deliberate Threats [7.2] 本研究では,州全体のCORSネットワークを地域保全観測所として紹介する。
グラフベースの空間整合性監視のためのネットワーク整合性フレームワーク(NCF)とネットワーク整合性指数(NCI)を提供する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:30:28 GMT)
RMR-Net: Degradation-Evidence-Guided Road-Image Restoration for Defect Detection [7.1] 車両に搭載された道路カメラは、動きのぼやけ、デフォーカス、照明の悪さ、騒音に弱い。
本稿では、画像から劣化証拠を推定するコンパクトなタスク対応復元フロントエンドRMR-Netを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:29:35 GMT)
Resolution Meets Reduction: Efficient Visual Context for 3D Radiology Report Generation [7.1] ビジョン言語モデルは、放射線学レポート生成を自動化するための有望な経路を提供するが、それをフル3次元CTに適用することは、かなりの計算上の課題をもたらす。
現代のファンデーション・ビジョン・エンコーダ(VE)はスキャン毎に何万もの視覚トークンを生成することができる。
このビジョン・トーケンの予算を、入力された視野、空間分解能、およびビジョン・ツー・ランゲージ・プロジェクションにどのように割り当てるべきかは、オープンデザインの問題のままである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:57:50 GMT)
Out-of-Distribution Federated Distillation with Domain-Aware Proxy [6.8] フェデレート蒸留(Federated Distillation, FD)は、知識蒸留を利用した分散機械学習パラダイムに基づいて、プロキシデータ上でのソフトな予測を交換する。
In-Distributionデータに基づいてトレーニングされたFDモデルは、out-of-Distribution (OOD)のシナリオにはほとんど適応しない。
OOD問題にプロキシデータを採用するためのドメイン対応プロキシ選択フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 06:53:35 GMT)
Two-copy distillability of one-copy-undistillable negative-partial-transpose states in every dimension [6.8] 我々は、この家系の卓越した1つのコピー不能な状態が、すべての局所次元$dgeq 3$で既に2つのコピー蒸留可能であることを証明した。
単一の対称性が還元された族は、反対の2つのコピーの振る舞いを持つ厳格に証明された状態を含み、有限個のコピーの蒸留性が未解決の領域によって分離される。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:50:01 GMT)
LLM within MCP Matters: Measuring Inefficient Resource Utilization Driven by LLMs [6.7] Model Context Protocol (MCP)は、サーバが大規模言語モデル(LLM)にデータを公開する方法を標準化する。
一般的なサーバ設計では、識別子のルックアップテーブルなどの頻繁に使用される参照データをサーバ命令に直接埋め込む。
プロダクション法定情報MPPサーバ上で,24 LLMの54,000件の試験結果について報告する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 04:17:12 GMT)
Gaming Without an Attacker: Benchmark Fingerprinting in LLM-Driven Search Under Selection Pressure [6.6] 評価信号に対して最適化されたシステムのベンチマークは、彼らが主張するものとは異なるものを測定する。
我々はこれを2つのGPUカーネル最適化スイートで具体的に記述する。
我々は、構成指紋からゲート漏れまで、これらの障害の4つのモード分類を提示する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:16:11 GMT)
Oh Deer, How Should I Handle This? Seasonal Priors for Selective Wildlife Annotation and Classification [6.5] 低高度UAV調査では、7,295RGBのみ、熱のみ、およびRGB+熱的作物セットが使用されている。
その結果,季節構造リンク (I) アノテーションの品質, (II) 下流分類, (III) 選択予測が得られた。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:11:26 GMT)
RippleKV: Cross-Layer KV Cache Allocation via Perturbation Propagation [6.3] 本稿では,各レイヤの値キャッシュに対する摂動が最終予測分布に与える影響を推定し,層間キャッシュを割り当てるRippleKVを提案する。
RippleKVは、キャッシュ予算に適合した評価KVキャッシュ圧縮手法の中で、最も高い平均性能を達成する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:01:11 GMT)
InstructionCrafter: Generating Consistent and High-Fidelity Visual Instructions [6.2] 既存のテキスト画像生成アプローチは、ステップ忠実性、クロスイメージ一貫性、フレーム単位の視覚的品質を満たすことは滅多にない。
InstructionCrafterは、時間的および命令的アライメントの最適化を分離する鍵となるアイデアを持つ拡散ベースのフレームワークである。
私たちのコードとトレーニングされたモデルは公開されます。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 04:01:21 GMT)
Walking through Discussions: A Mobile Visual Analytics System for In-Situ Group Discussion Analysis [6.0] グループディスカッションに基づく教育は、協調学習を促進するために広く使われている。
MobileGroupVisは、教室での議論をその場で分析するモバイルビジュアル分析システムである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:05:46 GMT)
Scale-to-Dialogue: Low-Burden Elicitation of Daily Premenstrual Symptom Ratings with Small Language Models [6.0] 日常的なラベル回復問題として会話管理を定式化する。
システムは、少数の症状クラスタを積極的に引き起こし、それぞれの応答を元の重度ラベルにマッピングする。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:50:28 GMT)
Hidden Language Consistency Phenomena in Reasoning LLMs [5.9] 8言語でPolyMathベンチマークを用いた推論モデルを用いて,タスクの難易度,タスク精度,思考言語整合性(TC),回答言語整合性(AC)について検討した。
出力言語による一貫性は入力と整合性を維持し、不整合性を維持し、徐々に劣化し、突然崩壊する。
この分解効果により、モデルが内部支配言語に移行するにつれて、精度を保存したり、より困難なレベルで改善したりすることができる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:30:14 GMT)
JSGS: JPEG State-Guided Supervision for 3D Gaussian Splatting from Mixed-Quality Views [5.9] 混合品質ビュー(JSGS)を用いた3次元ガウス平滑化のためのJPEG State-Guided Supervisionを提案する。
JSGSは、対応するデコードされた入力画像とドメインマッチングの比較のために、各レンダリングビューをエンコードし、デコードする。
JSGSは最低平均LPIPSと最高平均SSIMを各スケジュールで達成し、レンダリングはおよそ150FPSである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:05:34 GMT)
AeroReformer2: Spoken-Query Referring Segmentation for Aerial Images [5.8] Spoken言語は、密集したリモートセンシング画像において任意のターゲットを指定するための自然なハンズフリーインターフェースを提供する。
我々は,アクセントと音声の異なる音声を付加し,元の画像,マスク,データを保存した音声クエリ・ベンチマークであるデータセットを紹介する。
また,境界保存型ビジュアルパスとトークン保存型音声符号化を組み合わせた,効率的な双方向ネットワークモデルを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:28:49 GMT)
Lasso Universality Under Linearly Dependent Covariates in the Sparse Regime [5.7] 我々はスパース体制における普遍性に対する普遍性定理を証明する。
我々の設定は、以前の文献の多くで扱われたものよりも広い行と列依存構造を許容する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 00:59:25 GMT)
TRACE-Memory: Public-Conditioned Retrieval and Utility-Aware Evidence Admission for Personalized Generation [5.6] パーソナライズされたメモリは、公開のみの応答を超えてユーティリティを追加する場合にのみ使用されるべきだ、と私たちは主張する。
選択的パーソナライズのための2段階フレームワークであるTRACE-Memoryを提案する。
Goodreads、Amazon Reviews、Redditの4500以上のコントロール済みおよびNaturalタスクにおいて、TRACE-Memoryはランダムなメモリ使用と語彙的メモリ使用を一貫して上回っている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:30:02 GMT)
No Unique Minimizer, No Problem: On the Consistency of Robust Neural Classifiers [5.3] S-分母族に基づく頑健なニューラルネットワーク分類器の整合性理論を考案する。
実験的なS偏差最小化器は, 緩やかな規則性条件下で, 個体群-最適同値類に収束することが証明された。
ビジョンと言語ベンチマークデータセットの実験では、S-diversergenceトレーニングが、既存の堅牢なメソッドと競合するパフォーマンスを示しながら、クリーンなデータの正確性を維持することが確認されている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 05:21:08 GMT)
Federated Attention Autoencoders with a Stochastic Aggregation Scheme for Anomaly Detection [5.1] 本稿では,アテンションベースオートエンコーダに適した2つの新しいアグリゲーション関数を提案する。
提案手法はF1スコアとAUC ROCでそれぞれ2.9%,5.1%向上した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 20:34:14 GMT)
A Comprehensive Survey of Wireless Foundation Models for AI-Native 6G Networks [5.1] AIネイティブの第6世代(6G)無線ネットワークのトランスフォーメーションパラダイムとして、ファンデーションモデルが登場している。
WFMは、大規模な異種無線データから一般化された表現を学習する。
WFMは通信、センシング、ローカライゼーション、ネットワーク最適化のタスクに効率的に適応できる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:24:26 GMT)
Gradient Under Microscope: Benchmarking Resource Utilization of Memory-Efficient Gradient Computation Methods [5.1] AIトレーニングのリソース強度の上昇は、電力供給と炭素予算を圧迫し、制約のあるハードウェア上でのメモリ効率のトレーニングの体系的な研究を動機付けている。
4つのトランスアーキテクチャで5つの勾配エンコーダ(SGD,Adam,Adagrad,Adadelta,Conjugate Gradient Descent)をベンチマークする。
グラディエント蓄積は最も信頼性の高い戦略として現れ、視覚言語モデル上でのトレーニング損失をおよそ1桁削減する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:41:09 GMT)
WA-SpecDec: World-Aware Speculative Decoding for Vision-Language-Action Models [5.1] 視覚言語アクション(VLA)ポリシーは、ロボット制御を自動回帰的に生成し、繰り返しターゲットモデルフォワードパスに支配されるクローズドループレイテンシを実現する。
最近のVLA法はトークンレベルの受け入れをさらに緩和している。
WA-SpecDecは、VLAプリフィルの段階で、世界モデル由来の物理的シーン認識を注入する、ワールドアウェアな投機的デコーディングフレームワークである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:17:46 GMT)
Task-to-Model Optimization for Enterprise LLM Coding Assistants: A Data-Driven Framework for Cost-Optimal Routing [5.0] エンタープライズAIコーディングアシスタントは、相当な推論費用を発生させ、トークンコストの最小化は、再試行、エスカレーション、開発者待ち時間を含むと、エンドツーエンドコストの削減に失敗することが多い。
実運用におけるモデル選択を最適化するためのデータ駆動手法であるタスク・ツー・モデル最適化(T2MO)を提案する。
私たちは、各開発者セッションを、発見、分類、難易度を評価、プロダクション風のハーネスでベンチマークし、品質とレイテンシの制約の中でそれを完了できる最も安価なモデルにルーティングできるタスクとして扱います。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 06:57:53 GMT)
Damage Classification for 3D Point Cloud Data via 3D Data Analysis and Vision Foundation Model-based 2D Projections [5.0] 本研究は3次元PCDによる損傷評価(3PDA)アルゴリズムと2次元予測損傷評価(2PDA)の2つの手法について検討する。
3PDA解析アルゴリズムでは,TDAを用いてポイントネットで分割した3次元PCDのコンパクト表現を導出する。
2次元プロジェクション解析アルゴリズムでは、3次元PCDを2次元ビューに投影することで、大きなVFMを用いてきめ細かな損傷検出を行う。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:18:42 GMT)
Investigating Multimodal Informativity under Different Partner Visibility Conditions in Video-Mediated Dialogue [4.9] マルチモーダル対話における参照情報ジェスチャと音声の組み合わせについて検討する。
我々は,ビデオによる参照通信ゲームにおいて,意図した参照を識別するモデルを構築した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 21:08:22 GMT)
Parcel2Progression: An Anatomy-aware Longitudinal Framework for Alzheimer's Disease Diagnosis [4.7] アルツハイマー病(英語: Alzheimer's disease, AD)は、早期に微妙な病態を呈する縦断過程である。
Parcel2Progression(P2P)は、3Dスキャンをよりリッチな基底表現にトークン化するAtlas-Guided Parcelを使ってこの問題に対処する縦型トランスフォーマーフレームワークである。
このシナジーは,(1) パーセル特異的解釈可能性,(2) 長期解析における計算的トラクタビリティの2つの大きな利点をもたらす。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:06:39 GMT)
Integrated Multimodal AI System for Retrieval-Augmented Reasoning, Object Sensing, and Damage Analysis [4.6] 本研究では,損傷評価のための統合型マルチモーダルAIシステムを提案する。
検索強化生成(RAG)モデル、熱スペクトル知覚、ビジョン基礎モデルパイプライン、探索無線信号センシングを統合している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 21:53:37 GMT)
From Noise to Meaning: Meaningful Secret Sharing with Tamper Detection for Facial Recognition [4.6] 本稿では,ノイズ様の秘密共有を視覚的に魅力的な隠蔽画像に変換し,追加の暗号タンパ検出を行う新しい手法を提案する。
強いデジタル透かしと暗号ハッシュを用いた2層認証は、共有の整合性を保護するために用いられる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 21:36:17 GMT)
Position Bias in Ordinal Classification: A Systematic Evaluation [4.6] ラベル順、デモ順、デモ配置から位置バイアスを特徴付ける。
位置の堅牢性は、モデルのみではなく、システム全体の構成に依存する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:19:08 GMT)
Levitated Milligram-scale Ferromagnetic Magnetometer at Room Temperature [4.5] 室温で作動するミリグラム規模の磁気浮上強磁性体を実演する。
我々は、100Hzの周波数で23fT$/sqrttextHz$の磁気感度を実現する。
このプラットフォームは、生体磁場検出および標準モデル力探索のための高性能磁気センサを確立する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:44:54 GMT)
When Skills Meet Safety: Benchmarking and Characterizing the Adaptive Jailbreak Robustness of Skill-Merged LLMs [4.5] モデルマージは、トレーニングをすることなく、整合した言語モデルに新しいスキルを与えるデフォルトの方法となっている。
ほぼすべての証拠は、静的な拒絶テストにかかっている。
SkillSafe-Benchは、静的リフレクション、適応的ジェイルブレイク堅牢性、能力維持に関するスキルマージされたモデルをスコアするベンチマークである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:41:06 GMT)
Beyond Tables: Doc2DB-Bench for Relationally Faithful Document-to-Database Construction [4.1] 本稿ではDoc2DB-Benchについて紹介する。
42のスキーマと7つのドメイングループにまたがる203の長いドキュメントインスタンスがあり、117のエンティティテーブル、132のリレーションテーブル、7,341の行、41,935のセルがある。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:58:39 GMT)
Can Graph Learning Learn Circuits? [4.1] グラフ機械学習問題として回路ローカライゼーションの枠組みを定めている。
グラフ回路学習(GCL)は,複数のモデルペアにまたがってGNNをトレーニングし,未知のケースに適用するフレームワークである。
予備的な結果は、グラフ機械学習が回路ローカライゼーションに自然かつ潜在的に強力な視点をもたらすことを示唆している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:14:13 GMT)
Domain-Aware Pruning: Sparsity and Domain Generalization via Regularized Probabilistic Masking [3.8] ドメイン・アウェア・プルーニング(ドメイン・アウェア・プルーニング、Domain-Aware Pruning、DAP)は、ネットワーク・スペシャリティを、目に見えない領域への一般化を暗黙的に強化するメカニズムとして活用するフレームワークである。
DAPは、その密度の高いOOD性能を一貫して一致または超越しながら、かなりの幅を達成している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:18:17 GMT)
Anatomically Consistent Cross-Contrast Super-Resolution of Anisotropic Brain T2w MRI [3.6] VIPP-SRはクロスコントラストガイド付き超高解像度フレームワークである。
これは異方性T2w体積の平面間分解能を等方性接地T2wなしで復元する。
その結果、VIPP-SRは真の異方性T2wベースラインよりも下流のセグメンテーションを改善することが確認された。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 01:38:14 GMT)
Deep Holes in the Clifford Hierarchy [3.5] 単量子クリフォード階層の位相閉包の被覆半径を$SU(2)cong S3$で決定する。
この閉包は、クリフォード-パウリ円(Clifford--Pauli circles)の18ドル大円の合併であり、その被覆半径が$arccossqrt5/6$であることを証明する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 01:43:41 GMT)
Goal-oriented Navigation Instruction Generation with Tour Video Priors [3.4] ナビゲーション命令生成(NIG)は、ナビゲーションガイダンスのためのステップバイステップの自然言語命令を生成することを目的としている。
我々は,エゴ中心のツアービデオからナビゲーション命令を生成する,ゴール指向のビデオグラウンドNIGタスクであるVideoNIGを紹介する。
本稿では,学習を基本動作知覚と長距離ナビゲーション推論に分解する2段階のカリキュラム学習フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:21:47 GMT)
Structure-Preserving Projection for Mitigating Modality Bias in LLM-Based Sequential Recommendation [3.4] 本稿では,協調埋め込みのリレーショナル幾何を維持する構造保存プロジェクション手法を提案する。
提案手法はレコメンデーション性能を継続的に改善し,LLMベースのレコメンデーションに信頼性の高いパスを提供する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:56:54 GMT)
The Evolution of Mixture-of-Experts Architectures in Large Language Models: Routing, Topology, Load Balancing, and Expert Parallelism [3.4] この調査は、主要な論文、公式な技術報告、および現代のMixture-of-Expertsシステムを組織化するための以前の調査を合成する。
アーキテクチャ上のマイルストーンを,8世代ではなく,6つのメインライン開発と2つのブランチを持つ依存性グラフとして記述する。
我々は、等予算事前学習実験、品質とシステムメトリクス、オープンリサーチの質問で締めくくります。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:46:29 GMT)
Position Encoding in Transformers: From Absolute and Relative Methods to Rotary Position Embeddings and Long-Context Scaling [3.4] 我々は,正弦波および学習された絶対位置埋め込み,ショースタイルの相対位置表現,トランスフォーマーXL,T5相対位置バイアス,ALiBi,ロータリー位置埋め込み(RoPE)を統一的に記述する。
次に、位置補間、RoPEスケーリング法、NTK対応スケーリング、動的NTK、NTK-by-parts、Yarn、LongRoPE、LongRoPE2などの長文拡張について検討する。
中心的な結論は、トレーニング長を超える位置特徴を計算できることは、長期コンテキストの一般化を重要視しないということである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:15:49 GMT)
Time Present and Time Past: Benchmarking Large Language Models on Temporally Evolving Document Understanding [3.3] 法律、税法、ソフトウェア文書などの進化した文書は、修正され、置き換えられ、時には時間とともに復活する。
我々は、バングラデシュ政府によって発行された644の公式税関の計3,050対のQAに関する専門家が検証したベンチマークであるTIDEを提示する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 06:17:41 GMT)
A Mean-Field Framework for Inference-Time Distributional Control of Diffusion Models [3.2] 平均場枠組みの下で傾いた測度を対象とする推定時間分布制御を定式化する。
原理的に対象とする重み付き相互作用粒子スキームを導出する。
提案手法は, トラクタブルな低次元設定において, 所定の分布を的確に目標とすることを実証する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:41:01 GMT)
HaloMark: A Spectral Threshold for Embedding-Vector Watermarking under C2PA [3.0] 暗号的にC2PAマニフェストに結び付けられたベクトルを埋め込むための透かしであるHaloMarkを提示する。
検証は、ベクトルあたり284usと24バイトのサイドカーで実行され、3つのC2PA参照SDKバインディングに対してエンドツーエンドで検証される。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:36:59 GMT)
CUPA-T2*: Covariance-Aware Uncertainty Propagation and Alignment for T2* Mapping in Accelerated MRI [2.9] CUPA-T2*はモンテカルロ液滴から下流T2*へのボクセル間不確実性を伝播するフレームワークである。
総合的なT2*フィッティング性能を実現し、より高い加速度でホワイトマター性能を向上させる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:13:54 GMT)
OnEvoMemory: Evolving Memory through Online Robot Rollouts for Pretrained Robot Policies [2.9] ロングホライズンロボットの操作は、完了したサブタスクと重要な相互作用イベントを追跡するポリシーを必要とする。
本研究では,事前学習型ロボットポリシーのための値誘導型メモリモジュールOnEvoMemoryを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:53:19 GMT)
AquiLLM: An Architecture for Supporting Tacit Knowledge Capture in Research Groups [2.9] AquiLLM はオープンウェイトモデルを用いたオープンソースのモジュール RAG-LLM フレームワークとして開発された。
我々は、AquiLLMに一連のアーキテクチャ改善と機能拡張を提示する。
これらの拡張は、宇宙物理学者や環境研究者を含むドメインの専門家との議論によって知らされた。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:45:35 GMT)
Quantum discord of Ganssian states in an expanding universe [2.8] 量子不協和は、膨張量よりも時空膨張率に強い感度を示す。
膨張速度と膨張体積の両方が増加するにつれて、2つのボゾンモードで共有される最初の量子不協和は崩壊する。
誘導された不協和は、クロスオブザーバのボソニック対-反ボソニック対、続いて同じオブザーバのボソニック対-反ボソニック対で最大である。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:33:44 GMT)
Beyond Best Response: Quantal Stackelberg Deception as Insurance Against Attacker Misspecification [2.7] 定量応答は、意思決定におけるノイズとミスを表現する一般的な方法である。
ここでは、完全ベストレスポンスを、合理性パラメータ$$でロジット選択に置き換える。
2つのネットワークと実際の脆弱性を用いたサイバーセキュリティケーススタディにおいて、実証的な評価を行う。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:03:18 GMT)
RAG-Based Auto-Configuration for Industrial Fieldbus Devices [2.6] 工業機器のコミッショニングでは、技術者がPDFマニュアルから数百のプロトコル固有のパラメータを手作業で抽出する必要がある。
本稿では,OPC-UA,Profibus DP,CANopenのデバイス構成をエンドツーエンドで自動化する生産指向パイプラインを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:07:13 GMT)
Constrained Learning with Universally Learnable Concept Classes [2.6] 双対アルゴリズムの解の解の普遍的な PACC 学習性を確立する。
最適性は、凸性によって支配される普遍性と強ラグランジアン双対性の間に捕えられる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 02:13:57 GMT)
SLAP: Selective Local Vision-Language Alignment for Fish Re-Identification via Partial Optimal Transport [2.6] 個々の魚の再識別(ReID)は、身元識別の手がかりが特定の身体領域に局所化されることの多い、きめ細かい認識問題である。
本稿では,視覚パッチと即時埋め込みの局所的対応性を確立するための局所視覚言語アライメントフレームワークを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 18:04:41 GMT)
When Can Fraud Operations Authorize Automation? A Decision-Support Framework for Fresh Audit Evidence and Review Workload [2.5] 不正操作は、イベントを自動承認、アナリストレビュー、自動ブロッキングに割り当てなければならない。
我々は、自動化を行動リスク、証拠の鮮度、共有レビュー能力に制約された認可決定として扱う、新鮮度に制約された監査能力を開発する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:41:08 GMT)
Hierarchical Topology-Aware Planning and Control of Underwater Vehicle-Manipulator Systems in Confined Environments [2.5] 不適切な操作性、狭い通路、不確実な実行により、ロボットは回復不能な領域に入る。
本稿では,パスアクセシビリティ,操作実現性,クローズドループ実行を両立させる3層階層型階層型計画制御フレームワークMANTAを提案する。
MANTAは、限定的なUVMS計画と閉ループ追跡実験で評価されている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:22:51 GMT)
Clustered Attractor Manifolds and Dynamical Condensation in Self-Attention [2.5] トランスフォーマー層は状態依存の相互作用ネットワークを生成する。
トークン表現はアテンション行列を決定し、それが表現を更新する。
我々は、このフィードバックを最小限の正規化された自己注意力学で研究する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 21:28:01 GMT)
A QUBO-Inspired Computational Framework for Airport Landside Bottleneck Diagnosis and Dynamic Dispatch Optimization [2.3] 本研究では、ボトルネック診断と動的ディスパッチのためのQUBOにインスパイアされた計算フレームワークを提案する。
ケース空港は上海府東国際空港と杭州西山国際空港である。
2つのディスパッチスキームを一貫した需要入力でテストする。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:38:25 GMT)
FreCast: Refining Radar Echo Intensity via Phase-Preserving Amplitude Residual Diffusion for Precipitation Nowcasting [2.3] 本稿では,レーダエコー予測のための2段階フレームワークFreCastを提案する。
第1段階は、将来のレーダーエコーの最初の予測を生成する。
第2段階では、初期予測の空間構造を、さらなる強度バイアスの補正の制約として用いる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:08:25 GMT)
Bona: Automatic Management of Dirty Ancilla Borrowing in Quantum Circuits [2.1] bonaは、新しいディープ・アウェア・アルゴリズムに基づいて構築された、ダーティ・キュービット・レンタルのための最初のスケジューラである。
その結果,ボナは平均して99%の汚いアンシラを減らし,水深を制御していることがわかった。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:28:10 GMT)
Deep Learning-Based Statistical Downscaling of Sea Surface Temperature Using a Residual Corrective Neural Network [1.9] 本研究では,U-Netを用いた新しい深層学習フレームワークを提案する。
この枠組みはオーストラリア西海岸沿いのSSTを効率的にダウンスケールさせる。
この計算効率と精度のバランスは、沿岸影響評価や海洋生態系研究の応用に役立つ。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:30:16 GMT)
Anchor-Based AI Approach for Pre-Crash Object Detection Utilizing Micro-Doppler Signatures in Automotive Radar [1.8] アンカーベースのAIモデルは、マイクロドップラーシグネチャに明示的にフォーカスした高解像度レーダデータを処理するために提示される。
このモデルは、動的なシナリオでオブジェクトパラメータを推定し、異なるデータセットを効果的に処理する能力を強調します。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:32:45 GMT)
SuperNeuroMAT: An Efficient Matrix-based Simulator for Spiking Neural Networks [1.8] スパイキングニューラルネットワーク(SNN)は、エネルギー効率の高いAIと脳にインスパイアされたコンピューティングへの有望な経路を提供する。
我々は,オープンソースのスケーラブルで高効率なPythonベースのSNNシミュレータであるSuperNeuroMATを紹介する。
SuperNeuroMATは4つのSNNシミュレータを一貫して上回っている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 04:54:36 GMT)
Towards Adaptive Super-Resolution and Quality Assessment via Test-Time Adaptation [1.8] 本稿では,実環境下での適応型ビデオ超解像と知覚的品質モデリングについて述べる。
テストタイム適応(TTA)は、リトレーニングや高品質の監視を伴わずに、堅牢性と知覚品質を改善する統一パラダイムである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 06:10:20 GMT)
Distilling Vision-Language Models for Robust Traffic Sign Perception in Autonomous Vehicles [1.6] LAMDAは、言語基底構造をTSRモデルに変換するトレーニングフレームワークである。
シャドーアタックでは+12.5pp、ナチュラル-ライトアタックでは+13.2ppとなる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:05:00 GMT)
Automated Generation of Complexity-Validated Decision Scenarios Using Large Language Models [1.6] 意思決定の研究は、注意深く制御された複雑さを持つ多様なシナリオに依存します。
LLmsを使って構造化決定シナリオを生成する自動パイプラインを開発した。
我々は、複数のドメインと複雑性層にわたる4,238のシナリオを評価した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:12:48 GMT)
Topology-Aware Global-Local Mamba Networks for Palm Vein Biometrics [1.5] パームベイン認識(Palm-vein recognition)は、局所的な血管のテクスチャと血管のグローバルな配置の両方が識別情報を伝達する微視的生体計測タスクである。
マルチスケールな局所的特徴を組み込んだトポロジ対応のグローバルローカルバックボーン,固定されたソベル粒度のエッジ上に構築された構造化方向ストリーム,および4方向状態空間走査グローバルパスを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:04:23 GMT)
Quantum-Classical Physics-Informed Kolmogorov-Arnold Networks for Solving Fuzzy Differential Equations [1.5] ファジィ偏微分方程式に対する量子古典型ハイブリッド計算フレームワークを提案する。
QCPIKANは、溶液間隔が増加するにつれて、全体の収縮を捉える。
しかし、どちらのモデルも境界付近、高次領域、および波面付近で局所的なファジィ構造違反を呈している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:01:03 GMT)
Neural Message Passing on Structural Interaction Graphs for Fully-Inductive Graph Neural Networks [1.5] SIGILは任意の属性グラフを固定次元の統一表現空間にマッピングするフレームワークである。
リレーショナルメッセージパッシングネットワークは、各特徴次元を共有空間に埋め込む。
1つのグラフで事前訓練された単一のSIGILモデルは、強い完全帰納的リンク予測を提供する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:14:35 GMT)
EsaacSim: A Multimodal Event Camera Add-on for NVIDIA Isaac Sim [1.4] EsaacSimはNVIDIA Isaac Simのマルチモーダルイベントカメラアドオンである。
グレースケールとBayer RGGBイベント生成によるイベントカメラのオンラインシミュレーションを可能にする。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 06:41:39 GMT)
UPolarSQ: Polar Representation Learning for Optic Disc and Peripapillary Atrophy Segmentation and Quantification in Fundus Photographs [1.4] 視神経円板(OD)変形と乳頭周囲萎縮(PPA)をともなう近視性後極リモデリングの1例
本稿では,OD/PPAセグメンテーションとバイオマーカー定量化のための統一極域フレームワークであるUPolarSQを提案する。
内部および外部コホートの実験により、UPolarSQはOD/PPAセグメンテーションを改善し、解析のための信頼できる極性生物マーカー推定をサポートすることが示された。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:41:06 GMT)
AI Evaluation Should Measure Verification Cost, Not Correctness Alone [1.3] 私たちは、現在の評価指標が重大な障害モードを見落としていると論じています。
VCEは、出力自体のいかなる特性よりも、予算内での正確な識別の失敗によって、運用的に定義される。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:44:26 GMT)
State preparation via measurement and feedback: pushing relations, state structures, and non-invertible symmetries [1.3] 押し出し可能な欠陥と押し上げ関係が有限深度MF調整可能な状態を規定していることが示される。
プッシュ可能な欠陥とプッシュ関係は、測定とフィードバックによる量子状態の準備の統一原則として現れる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:12:14 GMT)
Hierarchical Self-Improvement: A Framework for Task-Specific Evolvable Agent Harnesses [1.2] この研究は、ハーネスがエンフタスク特有のもので連続的に進化可能な代替手段を研究する:各タスクファミリーは独自のハーネスを維持している。
思考/オフ設計は、タスク実行中に推論を無効にすることで、ハーネス進化の寄与を分離する。
HSIは、中等微分タスクの初期ハーネスよりも一貫した利得を達成する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 04:17:11 GMT)
Biomedical Knowledge Composition: A Software Engineering Perspective [1.2] 本稿では,バイオメディカル知識基盤の2つの側面について述べる。
第一に、バイオメディカルドメインをソフトウェアエンジニアに紹介する。
第二に、なぜ工学的なバイオメディカル知識基盤がそんなに難しいのかを問う。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 21:42:18 GMT)
PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation [1.1] On-policy Self-distillation (OPSD) は、特権教師を用いて、自身のロールアウトからサンプリングされたプレフィックスの推論モデルを監督する。
PAST(Privleged Adaptation from Students Trajectories)を紹介する。
PASTは、学生の蒸留プレフィックスをそのまま残しながら、各学生軌跡をOPSD教師に追加の特権情報として扱う。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:20:12 GMT)
The Cost of Adaptivity: Matching Lower Bounds Across Learning Problems [1.1] 我々はスライス正規化ミニマックス比を用いてニュアンス適応を定式化する。
また、事前発表された1つのガウスクエリから任意のポストホックインスペクションへ拡張するコストを定義する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:19:11 GMT)
The Scaffolding Matters More Than the Interface: A Controlled Comparison of MCP and CLI Tool Use Across Seven Agent Scaffoldings, Five Language Models, and One Software Task [1.0] AIコーディングエージェントの実行コストは、ツールに到達したインターフェースよりも、それを駆動するエージェントの足場に依存する可能性がある。
私たちは、通常のコマンドラインインターフェース(CLI)上でのツール使用に対して、モデルコンテキストプロトコル(MCP)上でのツール使用コストを測定することにしました。
私たちは7つのエージェントの足場と5つの言語モデルで1つの固定されたソフトウェアタスクを実行しました。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:54:09 GMT)
Interaction between Rydberg Excitons in Cuprous Oxide Revealed through Resonant Second Harmonic Generation [1.0] 第2高調波発生(SHG)による酸化銅(Cu$O)と主量子数との相互作用の実験的および理論的研究を報告する。
スペクトル線の絶対強度はポンプパワーの2乗で低出力でスケールするが、高出力で飽和する。
これらの結果を定量的に説明するために、SHGの過程が完全に整合である共振SHGの半古典理論を開発した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:39:05 GMT)
Sparse Attention to Emotion: Efficient Facial Emotion Recognition via Token Reduction [1.0] 顔の感情認識(FER)は、バイオメトリックス、健康、人間とコンピュータの相互作用など、様々な分野において重要な意味を持つ重要なタスクである。
現在のVision Transformerベースのアプローチでは、2次複雑性$mathcalO(N2)$を示し、Nは入力シーケンス長である。
本研究では,情緒的文脈に付加価値のない画像トークンを廃棄するモデルであるSparse Attention to Emotion (SAE)を提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:28:27 GMT)
Technical Report: A Formal Semantics for Java Symbolic Evaluation using Large-Block Encoding [1.0] シンボリック実行はバグを見つけ、テストケースを生成し、正確性を保証するために使用される。
Java Rangerは、命令型Javaコードを形式論理の言語に段階的に変換するJavaプログラムのためのパスマージツールである。
これらの変換を形式化し、Javaの具体的セマンティクスの簡易バージョンに関して、それらの健全性を証明します。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:41:13 GMT)
Quantum-Device Simulation of Optical Decoherence of Hole-Spin Qubits in Self-Assembled Quantum Dots [1.0] 半導体自己集合量子ドット(SAQD)のホールスピンラビ振動を減衰するバンド間光励起
本稿では,リアルなSAQD幾何とマルチバンド電子構造解析を統合したデバイスレベルのモデリングワークフローについて報告する。
その結果, 半導体スピン光子デバイスでは, 形状, スピン制御条件, 照明スペクトルが共最適化されることが示唆された。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 04:38:15 GMT)
Temperature-Driven Sequential Modeling for the Prediction of Annual Power Conversion Efficiency Profiles of Organic Photovoltaic Materials: Douala Case Study [0.9] 有機太陽電池(OPV)材料は、熱帯地域での分散型太陽エネルギーの候補として期待されている。
ここでは,OPVドナー分子のPCEプロファイルを年次予測するClimate-Native計算フレームワークを紹介する。
また, 熱帯性条件下での性能整合性により, OPV候補を再現する季節安定性スコアも導入した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:24:18 GMT)
Qualifying and Quantifying Risk under the EU AI Act [0.9] EU AI Actは、リスクベースのアプローチを使用してAIシステムを規制している。
AI法は「リスク」の定義は定量化を意味するが、AI法は基本的権利に対するリスクに焦点を当てている。
我々は,基本的権利とリスク定量化の保護を,提案枠組みに整合させることを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:08:12 GMT)
Toward Mask Annotation-Free Surgical Instrument Segmentation from Endoscopic Images Using Text-Prompted Segment Anything Model 3 (SAM3) [0.9] そこで本研究では,実情マスクや手動操作を必要とせず,インスタンスレベルのセグメンテーションを実現するための2段階フレームワークを提案する。
最初の段階では、自然言語対応のジェネリックプロンプト "tool" を利用してSAM3のゼロショット機能を使ってバイナリマスクを生成する。
第2段階では、これらのマスクはSAM3の生成したマスキング領域に微調整された視覚言語モデル(Qwen)を統合することで、インスタンスレベルに拡張される。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 18:11:09 GMT)
A New Approach to Characterising Optimisation Problems Using Programmatic Representation and Complexity Measures [0.8] 本稿では,プログラムとして実装されたインスタンスの表現に基づく問題特徴化手法を提案する。
我々はHalsteadボリュームを,プログラムのエントロピーを単純化したバージョンと見なすことのできる,コードの複雑さの尺度とみなす。
提案手法は,アルゴリズム性能と負の相関性を示し,アルゴリズム選択や他の問題解析のための予測メタ機能としての可能性を示す。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 20:19:51 GMT)
Exact Rank-Space KL Projection for Shared-Marginal Low-Rank Factors: Application to Doubly Stochastic Clustering [0.8] 等しい全質量の任意の正の行辺に対して、合同KL射影はちょうど$r-1の有効変数のみを持つ厳密な凸ゲージ固定双対に還元される。
この幾何学を専門とし、$W=UnameDiag(g)-1Vtop$で2倍グラフ学習を誘導する。
観察されたスパースフィッティング、アンカーエッジ多様体正規化器、ブレグマンのバックトラックと組み合わせることで、ミラー・ディフレッシュ法は受け入れられたステップごとに正確な実現可能性を維持する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:29:05 GMT)
Understanding Calibration and Truncation Error Propagation in Training-Free Low-Rank Compression for LLMs [0.8] 既存のSOTAフレームワークには2つの重要な制限がある。
既存のフレームワークと互換性のあるトレーニング不要な方法論を提案する。
提案手法は,ゼロショットタスクにおける重み付きおよび関節分解ベースラインに対する最大1-2.5精度ポイントの改善を示す。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 06:03:48 GMT)
Rethinking Higher Education: From Fixed Curricula to Learnity Graphs [0.7] 高等教育は転換点にある。
知識がますますアクセスしやすくなり、さらに多くの場合、高度な人工知能(AI)が介在する時代において、伝統的なカリキュラムモデルの価値は再考を保証している。
これは、徹底的な学術研究に取って代わるべきという意味ではない。
課題は、創造性、学際的な統合、ハンズオン体験、特に長期的な開発を促進する学習環境にこれらの教育的側面を拡張することである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:42:58 GMT)
Mitigating Gender Bias in English to Romanian Machine Translation [0.6] 機械翻訳(MT)システムは、しばしば性別の正しい翻訳に失敗する。
大規模言語モデル(LLM)に基づく性別分類とニューラルマシン翻訳(NMT)を組み合わせたハイブリッドパイプラインを提案する。
提案手法は,WinoMT と WinoGender のベンチマークにおける性別の精度を,ベースラインの MT システムと比較して40 ポイント以上向上する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:38:59 GMT)
Same Question, Different Answer? Measuring and Mitigating Prompt Privilege for Equitable AI Access [0.6] 大規模言語モデル(LLM)は、医療、教育、公共サービス、日々の意思決定にますます統合されている。
迅速な堅牢性に関する既存の研究は、主に敵の攻撃、迅速な注入、迅速な最適化に焦点を当てている。
LLMインタラクションにおけるアクセシビリティの格差を計測・緩和するための統一的なフレームワークを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 22:38:54 GMT)
From Product Search to Preference Articulation: The Economics of Agentic Commerce [0.6] Generative AIは、消費者が製品発見をAIエージェントに委譲する、デジタルコマースをブラウジングからエージェント検索にシフトしている。
嗜好複雑性は, 探索前に明瞭化が難しいが, 検査時に容易に評価できる満足度関連次元の数である。
消費者は限定的な注意を払って検索強度を選択する:手動で検査された製品やエージェントによる好みの抑止深度を選択する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 01:09:24 GMT)
Symmetry Constraints Regularize Neural Quantum State Learning [0.6] ハミルトン対称性を変分パラメータ化に直接埋め込むことは、この学習問題を幾何学的に正則化することを示す。
ボルツマン族 NQS に対して、局所パウリ-$Z$ジェネレータを物理幾何学軌道に沿って結び付けることで対称性を強制する。
この枠組みは、高品質で低エネルギーの解に対応する物理的にアクセス可能な状態空間の分数を評価する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:23:06 GMT)
IoXT: The Internet of Explainable Things. Why Explainability in IoT Requires a New System-Level Paradigm and Protocol Design [0.5] IoT(Internet of Things)は、センサー、コミュニケーション、人工知能(AI)、意思決定、アクティベーションをますます組み合わせている。
既存の説明可能なAI(XAI)メソッドは、モデル予測を説明することができるが、知覚された証拠から物理的な行動へのエンドツーエンドのパスを、彼ら自身で説明することはできない。
本稿では,知的IoTのアーキテクチャ特性として説明可能性を実現するシステムレベルのパラダイムであるInternet of Explainable Things (IoXT)を紹介する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:57:46 GMT)
Backward Compatibility in Tree-Based Explanations and Enhanced CART Algorithm [0.5] モデル更新による説明の変更は、ユーザにとって有害な結果をもたらす可能性がある。
本稿では,木に基づくeXplanations(BCLTX)における後方互換性損失について提案する。
BCLTXにおける決定木更新問題に対して,CARTを改良した軽量アルゴリズムであるCART-BCTXを,木ベースのeXplanations(CART-BCTX)の後方互換性で設計する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:44:47 GMT)
Population-Level Generative Modeling for Ranking Data [0.5] ランキングデータは、リコメンデーションシステム、情報検索、投票、マーケティング、AIによる人間のフィードバックからの選好ランキングなど、科学的および機械学習のアプリケーションに現れる。
本稿では,集団レベルの生成モデル構築のためのフレームワークを提案する。
確率に基づくランキングモデルを用いて低次元の潜伏選好を推定し、フローマッチングを利用して潜伏選好の人口分布を学習し、適合した確率的ランキングモデルにより新しいランキングを生成する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 02:36:49 GMT)
Abstracted Away: Resisting Alienation and Ungrounded Abstraction in AI Research Communities [0.5] 計算AI研究における抽象化の論理は、知識とリフレクションの重要な形態を押し上げます。
アーリーケアのクリティカルAI研究者3人として、私たちはこのことを異端と捉えました。
我々は、我々の研究コミュニティでどのようにして異星に遭遇し抵抗したかを説明する3つのヴィグネットをナレーションした。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 01:51:18 GMT)
Data Findability, Governance, and Community Engagement for Māori Research Data Sovereignty [0.5] モリのデータ主権(MDSov)は、モリの権利とデータへの関心を認識する重要な原則を確立している。
これらの原則が研究機関内でどのように運用されるのかについては,比較的注目されていない。
本稿では,森研究データソブリンティ(MRDSov)の概念を紹介する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 20:32:25 GMT)
MathShikkha: A Controlled Study of Answer-Only and Chain-of-Thought Supervision for Bangla Mathematical Reasoning in Small Language Models [0.5] 教師が生み出したCoT(Bangla Chain-of-Thought)の監督が,通常の微調整以上の利益をもたらすかどうかを検討した。
GPT-5.4生成論理と4B--7B学生モデルを用いたバングラ数理推論データセットを構築した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 05:50:30 GMT)
Approximation Rates for Metaplectic Neural Networks [0.4] ニューラルメタプレクティック辞書を用いて構築した浅層ニューラルネットワークの定量的近似結果を開発した。
我々は,辞書の原子をブロックする深層ニューラルネットワークアーキテクチャを考案し,ニューラルメタプレクティック辞書の導入を検証した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:27:43 GMT)
Do AI Forecast Ensembles Sample the Correct Conditional Distribution? [0.4] 我々は,米国東海岸の干潟8地点で,確率的海底海水準予測のための拡散モデルを訓練した。
その結果,各駅における正の技量とリードタイムの正の技量と,共同空間構造が気候学的なドローよりも悪いことが判明した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:16:10 GMT)
Instability of LLM Pre-Pretraining: It Doesn't Always Help. An Investigation on Multiple Languages [0.3] 人工言語("pre-pretraining")でのLLMの事前トレーニングは、トークン効率を33%向上させる可能性があると報告されているテクニックである。
4つの語族にまたがるより大きな自然言語集合に対して、英語の事前結果を検証した。
また、トークン効率の観測値(または損失)を言語の言語特性の定量化に関連づける。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:26:29 GMT)
Tied Trit-Planes: Constraining PTQTP to a Uniform Nine-Level Quantizer, with a Persistent Folded Format for Disk-Streamed Mixture-of-Experts Serving [0.3] この研究はPTQTPの解法に制約としてそのアイデンティティを課した最初のものである。
我々は、284B-A13B混合エキスパートモデルであるDeepSeek-V4-Flash-0731のルートエキスパートに適用する。
すべてのコード、フォーマット、評価アーティファクトは、fucina推論スタックでオープンソースである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 20:53:47 GMT)
On-Device Multi-Species Malaria Detection with Uncertainty-Calibrated Slide-Level Aggregation [0.2] マラリアは、専門家のマイクロスコピストが不足している資源制限設定において、依然として主要な死因である。
本研究は,医療センターが指定する重要な要件に対処するマラリア診断パイプラインを開発した。
本稿では,これらの臨床的制約を強調し,対処方法を提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:09:25 GMT)
Deployable Per-Instance Multi-Layer Activation Steering for Large Language Models [0.2] アクティベーションステアリングは凍結した言語モデルの振る舞いを編集する。
インスタンスごとの多層選択をよく理解し、デプロイ可能にします。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:23:00 GMT)
Theory-Guided Deception Detection: A RAG-Based Artificial Intelligence Exploration [0.1] 研究は7つのレトリーバル拡張世代(RAG)モデルを開発した。
ベースラインモデルと比較して偽装判断がどのように行われたかを分析した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:39:19 GMT)
From Operational Design Domain to Action: A Systematic Behavioral Taxonomy for Autonomous Driving [0.1] オペレーションデザインドメイン(ODD)仕様は、自動運転システム(ADS)の動作が許可されている場所を記述している。
彼らは、ADSがそのドメイン内に一度デプロイされた時に明らかにすべきことを規定していない。
本稿では,3つの運用領域にまたがる21の行動能力の,構造化された標準的分類法を提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 22:35:01 GMT)
Promise and Challenges of Distimation [0.1] 生の絡み合い状態の品質を推定し、高忠実な絡み合いを蒸留するには、伝統的に量子ネットワークスタック内の2つの異なるリンク層プロトコルが必要である。
最近導入されたディティベーションの概念は、絡み込み蒸留時に発生する古典的症候群から状態推定データを直接抽出することによって、これら2つのプロトコルをマージする。
本稿では,ディモーテーションの中核となる原理を調査し,現実的なアーキテクチャの期待される利益を定量化し,今後の量子ネットワークにおけるディモーテーションを標準ビルディングブロックにすることに向けた研究ロードマップを概説する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:49:02 GMT)
Zero-Shot Traffic Accident Detection via a Coarse-to-Fine VLM-Tracking Pipeline [0.1] ACCIDENT @ CVPRベンチマークは、厳密な制約の下で、この共同予測を正確に評価する。
我々は,凍結したQwen3-VL-32B-インストラクション視覚言語モデルとYOLO11xオブジェクト検出とBoT-SORTトラッキングを組み合わせた,トレーニングフリーで2パスの粗いパイプラインを提案する。
公式の2,027クリップの実CCTVテストセットにおいて,本システムは0.504の3方向高調波平均スコアを達成した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:08:56 GMT)
City Sentinel: A Unified AI-Based Smart Surveillance Framework for Real-Time Multi-Threat Detection Using Deep Learning [0.1] City Sentinelは、AIベースの統合監視フレームワークで、6つの検出機能をひとつのスケーラブルプラットフォームに統合する。
システムは、743msの中央値のエンドツーエンドレイテンシを実現し、4つの同時RTSPストリームをサポートする。
91.2%の顔照合率、85.7%のプレート読み取り精度、mAP@0.5スコアは火器、ナイフ、兵器検出モジュール全体で0.846から0.889である。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:59:31 GMT)
Effect of Strong Field Space-time Features on Vacuum Pair [0.0] 我々は、相対論的効果が量子真空崩壊過程を支配する枠組みを開発する。
CQFTの開発により、相対論的効果が量子真空崩壊過程を支配する包括的な枠組みを確立する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 04:15:01 GMT)
What Would Fix This RAG Failure? Auditing Counterfactual Response with Paired Evidence Interventions [0.0] 我々はPair-IDを紹介した。Pair-IDは1つのクエリ、検索状態、読み取り定数を格納し、次に2つの操作を横断する。
19,981のベンチマーククエリで11,105のQwen障害が特定され、SHA-256オーダーが1200を選択して、サンプリングされた応答を生成する。
その結果,ハッシュ選択された有資格障害サンプルにおいて有意な速度でエビデンスが発生し,観察された故障から部分的に予測可能であり,読者に条件付きであることが示唆された。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 22:43:27 GMT)
VectraYX-Vision-1B: A Sub-2B Spanish/LATAM Cybersecurity Vision-Language Model with Structured Visual Reasoning and Native Tool Use [0.0] VectraYX-Vision-1Bはスペイン語/LATAM0:画像のためのサブ2B視覚言語モデルである。
スペイン語で回答し、ネイティブ|think|>トークンを通じて構造化推論を出力し、Model Protocol (|tool_call|>)を介してツールを起動し、ラマのLLaVA mmprojフォーマットにエクスポートして、空輸デプロイメントを行う。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 04:46:58 GMT)
Trajectory Design and Budgeted Querying for Digital Twin Calibration [0.0] デジタルツインキャリブレーションは、収集するのに高価なインタラクションデータを必要とする。
本研究では,どのトラジェクトリを生成するか,いつ限られた予算を特権パラメータ測定に費やすか,という2つの買収決定について検討する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:36:24 GMT)
Towards an LLM-based method for quantifying the sexual content in song lyrics [0.0] 本稿では,大規模言語モデルを用いて歌詞の主題内容の定量化を行う手法を提案する。
2002年から2025年にかけて12人のレゲトンアーティストによる1,259曲のコーパスに適用した。
この分析は、データセットのキャラクタリゼーション、アーティストごとの比較、時間とともに寸法がどのように変化するかの分析、そして我々の性差スコアとSpotify自身の明示的なフラグの比較の4つのトピックをカバーしている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:51:56 GMT)
TomaMMU: A Comprehensive Multimodal Understanding Benchmark for Tomato Leaf Diseases [0.0] このギャップに対処するために,大規模トマト葉病のマルチモーダル理解データセットであるTomaMMUを紹介する。
TomaMMUは15のカテゴリにまたがる28,808の高品質な画像と213,119の視覚的質問応答対で構成されている。
トマベンチは7つの農業タスクを基本認識、病理理解、専門家診断にまたがる階層的な3段階の分類に分類している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:20:49 GMT)
The Thermodynamic Cost of Computing with Heat [0.0] 目標平均誤差確率の達成に必要な最小散逸を$langle rungle$が分岐し、$langle rangle$が有限貯留層熱ゆらぎによって課される基本的な最小誤差フロア$epsMin$に近づくことを証明した。
我々のフレームワークは熱力学、有限時間情報理論、自律計算を橋渡しし、エネルギー効率の良いハードウェアに厳密な設計原理を提供する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:51:57 GMT)
The Logic of Partitions and Partition Logics: Ore's Correspondence, Contextual Pasting, and Direct-Sum Decompositions [0.0] 分割論理は異なるレベルで2つの構成を示す。
エルラーマンの直和分解はベクトル空間を与える。
Gleason と Kochen--Specker のアプリケーションは、グローバルなコンテキスト一貫性のバリュエーションを必要とする。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 21:45:34 GMT)
The Input Problem: A Permanent Bottleneck for Quantum Machine Learning [0.0] 量子アルゴリズムは、その入力状態を無償で提供する。
本稿では,ベースエンコーディング,振幅エンコーディング,Grover-Rudolph分布ロードという3つの標準エンコーディングについて述べる。
結果として生じる$(N)$バウンドは、改良されたハードウェアが取り除く工学的制限ではなく数え上げ定理であると主張する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:04:03 GMT)
The Impact of Operational-Data Fidelity when Assessing Safety-Critical Autonomous-Vehicle Software [0.0] 安全クリティカルなソフトウェアでは、ソフトウェア運用過去のデータは、過去のソフトウェア障害イベントを十分に詳細に記述していないかもしれない。
運用データの不十分な詳細が、ソフトウェア信頼性の要求を損なう可能性があることを実証する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:02:31 GMT)
The Deontic Gap: Large Language Models and the Modal Language of Obligation [0.0] 大規模言語モデルが現代人文パターンを再現するかどうかを考察する。
3つの主要なコーパスの中で、AI生成されたテキストは、常に正のデオンモーダルを過小評価する。
LLMのモーダル使用法は、これらのモデルが訓練された公式な資料を反映していることが示唆されている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 21:36:15 GMT)
Semi-Dense Matching Uncertainty Is Not Just Local Confidence [0.0] 本稿では,学習可能なパラメータが9つしかない2成分ラプラス混合モデルを導入する,軽量でポストホックな全体不確実性推定フレームワークを提案する。
目的は、シャープな局所的な精細化ノイズと、粗い割り当て障害の広い尾の両方を明示的に捕捉することである。
提案手法は,計算オーバーヘッドが最小限に抑えられた種々の事前学習済みのマッチング器とロバストな推定器の下流の幾何精度を一貫して改善する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:01:20 GMT)
RobustDefect-LLM: Explainable and Robustness-Aware Industrial Surface Defect Classification with Decision Support and AI-Assisted Reporting [0.0] RobustDefect-LLMフレームワークは、ディープラーニングの分類、オペレーターによる視覚的エビデンス、信頼を意識した意思決定サポート、AI支援レポートのコントロールを統合している。
MobileNetV3-Large は最高数値テスト精度 (99.26%) とマクロF1スコア (0.9926) を達成し、95%精度は 0.9815-1.0000 である。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:08:13 GMT)
Reproducing and Stress-Testing Two Approaches to LLM Reasoning Reliability: Test-Time Probability Aggregation and Logic-Representation Editing [0.0] 大規模言語モデル(LLM)をより信頼性の高い推論を行うための2つの手法を独立に再現し、それらをドメインやモデル間でストレステストする。
第1のRPCは、推論時のトークン確率と自己整合性を集約する。第2のLCFは、隠れた状態を"content"と"logic"に分割するプロジェクタを訓練し、論理部分を有効な領域に向けて編集する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 06:22:02 GMT)
Quantum Gouy phase singularities in a propagating biphoton state [0.0] 量子グーイ相は、絡み合った光子対の長手伝播空間において非局所位相特異点を生成することを示す。
蓄積したラジアルモード依存のグーイ相は、双光子空間モード成分の破壊的干渉を引き起こす。
この結果は,非局所特異光を横方向の空間相関から縦方向の伝搬ダイナミクスまで拡張する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:53:05 GMT)
Private Etymology: Designing Relational Reuse of Shared Symbols in Long-Term Human-AI Interaction [0.0] プライベートエティモロジー(Private Etymology)は、機械表現可能なリレーショナル前駆体である。
ダイアド固有の象徴的表現が、どのように提案され、解釈され、交渉され、修復され、再利用され、修正され、安定化され、争われ、忘れられ、または引退されたかを記録する。
リレーショナル・マイクロカルチャーの変更に会話エージェントが参加するための基盤として,プライベート・エティモロジーが提案されている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 03:23:08 GMT)
Preview-Based Relative-Motion Control of an Insertion Tool for Neural-Thread Placement in Pulsating Tissue [0.0] 本稿では,プレビューベースの相対移動制御器を開発する。
遅延遅延周期面の動きを推定し、短い水平線上で予測し、オフセットフリーモデル予測制御を用いて相対配置を調節する。
12.0um自由空間と1.9um接触RMS相対配置誤差、遅延フィードバックインピーダンスは18.3/176.8um、ラボフレームPDは286.1/275.5um、ピーク接触力は286.1/275.5umである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 18:53:32 GMT)
North Africa's Missing Framework: NLP-Driven Mental Healthcare in Algeria and Implications for Low-resource Settings [0.0] アルジェリアの精神医療システムにおけるNLPの役割について検討した最初の概念的枠組みを提示する。
ケアの言語ギャップ、アクセスにおける地理的不平等、援助のためのスティグマ関連障壁、研究とデジタルインフラの欠如の4つの構造的障壁を特定した。
本稿では,データ資源,多言語技術,評価フレームワーク,規制容量を優先する研究・政策ロードマップを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:39:12 GMT)
Memory-Efficient Activation Checkpointing with Sliding Window and Hirschberg's Algorithm for 0/1 Knapsack Solving in PyTorch [0.0] アクティベーションチェックポイントは、所定のメモリ予算下でのニューラルネットワークの実行を最小化する。
本稿では,スライディングウインドウトリックとHirschbergのアルゴリズムを組み合わせてピークメモリの削減を行うdp_knapsack_sliding_hirschbergを紹介する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:36:19 GMT)
Measuring and Reducing WebGPU Dispatch Overhead for LLM Inference [0.0] シーケンシャル・ディスパッチ測定手法を導入し, 単一動作単体計測がディスパッチ当たりのコストを過大に見積もっていることを示す。
カーネルの品質ではなく、ディスパッチのオーバーヘッドがバッチサイズ1のボトルネックであることを示し、ディスパッチ数を原因として分離する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:21:55 GMT)
Math-Vision Diagrams: A Comprehensive Benchmark for Evaluating LLM Mathematical Diagram Generation Capabilities [0.0] 大規模言語モデル(LLM)を評価するために特別に設計された最初のベンチマークであるMath-Vision Diagramsを紹介する。
3040のうち2920枚の画像のサブセットを,本質的な視覚的コンテキストを持つ高品質な競合問題から選択する。
すべてのコード、データ、キュレーションパイプライン、評価スクリプトが完全にオープンソースになる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:58:01 GMT)
LegoLM: Structured Weight Sharing for Large Language Models [0.0] 大規模言語モデルのための構造付き重み共有圧縮フレームワークであるLegoLMを提案する。
LegoLMは2つの障害モードを解決している。
GPT-2 の小型(124M) と Mistral-7B 全体で、LegoLM は Mistral-7B 上の 4.41X 圧縮で +0.03% PPL の劣化を達成する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 11:51:14 GMT)
LazyHMC: Hamiltonian Monte Carlo Simulation for Lazy, Infinite Dimensional Probabilistic Programs [0.0] Hamiltonian Monte Carlo (HMC) は確率計画における一般的な推論法である。
Haskellでは、遅延評価により、プログラムは暗黙の無限次元空間上でプロセスを表現することができる。
本稿では、この無限次元設定のための勾配型HMCの新しい定式化を開発する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:05:51 GMT)
Inductive Graph Layout with Implicit Neural Fields [0.0] フォース指向アルゴリズムは、グラフ描画の標準的なツールのままである。
我々は,各ノードの距離をランドマークの集合にマッピングする小さなニューラルネットワークであるFlingを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:31:12 GMT)
IDRAAK: From Multi-Agent NLP to Few-Shot Prompting for Semantic Drift Detection in Technical Requirements [0.0] 言語間での技術的要件の翻訳はセマンティックドリフトを導入することができる。
IDRAAKは言語に依存しない意味的要求表現を用いてそのようなドリフトを検出するための解釈可能なフレームワークとして提示される。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:34:38 GMT)
Hybrid Neural-Classical Correction for Frozen Time Series Foundation Models: A Comprehensive Ablation Study on High-Frequency Stock Prediction [0.0] 本研究では, 凍結したTimesFM(200Mパラメータ)を揮発性オープニングトレーディング時間中のストックリターン予測に適応させるハイブリッドニューラル古典補正法について包括的な研究を行った。
AttnCorrect(複数頭自己注意,約471Kパラメータ)とGatedLinear(ゲーティング,約49Kパラメータ)の2つのニューラル補正を比較した。
10の主要技術株の体系的なアブレーションを通じて、私たちは重要な洞察を明らかにします。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 17:15:20 GMT)
How to Test Bell Nonlocality for Gravity? [0.0] エンタングルスピンが埋め込まれた2つの質量は、互いの光円錐の外側によく配置される。
スピンはそれぞれの質量の運動に結合され、空間的重ね合わせを生成する。
局所的な測定は2つの質量の重力場のみで行われる。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:52:53 GMT)
From Manuals to Maintenance: Fine-Tuning MedGemma for Multi-Modal Imaging System Support in Low-Resource Settings [0.0] 低所得国と中所得国(LMICs)の医療提供にとって、イメージングデバイスダウンタイムは大きな障壁である
マルチモーダル医療機器保守質問応答(QA)フレームワークを提案する。
InGENZI_DatasetV1 を生成するため,MRI および 超音波 システムから技術マニュアルを収集した。
QLoRAに基づくパラメータ効率の微調整を用いて,システムエラーログの解釈にMedGemma-4b-itモデルを適用し,ステップバイステップの機器修理手順を生成する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 20:16:51 GMT)
Evidence-Calibrated Runtime Reconstruction for Agent Skills Across Heterogeneous Coding Agents [0.0] 我々は、異種ハーネス間のスキルライフサイクルステージを再構築するパッシブランタイムインテリジェンスシステムであるスキルインテリジェンスを提案する。
事象の存在は境界忠実性ではなく、複合的正確なスコアは異なる誤りを隠蔽し、モデル説明は決定論的事実を上書きしてはならないことを示す。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:18:13 GMT)
Estimation of Spacecraft Inertia Tensor Using Attitude-Only Data from Torque-Free Motion [0.0] 宇宙船の正常化慣性テンソルを回転運動から推定するための姿勢のみの枠組みを提案する。
500秒のアークを用いた試験では、拡張カルマンフィルタと比較して、慣性テンソル誤差を約1桁削減した。
3つの100秒弧からの合同推定は、同様の精度の向上をもたらし、1桁以上も高速に維持された。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:59:02 GMT)
Epistemic Transfer in AI-Assisted Verification: A Framework and Evaluation Protocol [0.0] エピステマティック・トランスファー(英: epistemic transfer)とは、AIによる事前の検証が、後の新規クレームに対する非支援のパフォーマンスに与える影響をいう。
これらのアイデアを,オンライン実験やフィールドスタディで使用可能な,実践的な評価プロトコルに変換する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:42:14 GMT)
Eco-SoC: A Sustainable VLSI Architecture for Energy-Proportional Artificial Intelligence [0.0] 本稿では,持続可能人工知能に特化して設計された,スケーラブルなVLSIアーキテクチャであるEco-SoCを紹介する。
本稿では,ビット幅精度を適応的に変調するハードウェアレベルの動的精度スケーリング論理(DPSL)フレームワークを提案する。
Eco-SoCは、熱を意識したパワーゲーティング機構を導入することで、シリコンの予測平均時間障害(MTTF)を2倍にする。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:21:07 GMT)
Domain Agnostic Text Redaction from Natural Language Rules using Instruction Tuning [0.0] 本稿では、ドメインに依存しない自然言語規則を用いた、説明可能な、ドメインに依存しないテキスト・リアクション・ソリューションを提案する。
従来のテキスト・サニタイズとは異なり、この方法は利用者が便利にセンシティブな情報を定義できるようにする。
この解は、高い再構成誤差と高いリアクション精度を示し、自動テキスト衛生に適している。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 14:20:13 GMT)
Does a Toehold Make a Bidder Bolder? Preemption and Multiplicity in Multi-Round Takeover Auctions [0.0] 入札者は、その提案を行う前に、静かに会社の株式を購入することができる。
その持ち株は、額が2倍になるはずである。
しかし、手足の持ち主は現実には稀で、立証パズルだ。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 01:48:53 GMT)
DistillCache: KL-Guided Adaptive KV-Cache Eviction for Memory-Efficient LLM Inference [0.0] トランスフォーマーベースの大規模言語モデル(LLM)は多くのタスクで高いパフォーマンスを達成するが、キーバリュー(KV)キャッシュはシーケンス長とともに線形に増大する。
逐次決定問題としてKV-cache消去を定式化する強化学習フレームワークであるDistillCacheを提案する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 19:33:43 GMT)
Deep probabilistic logic programming for diagnostic reasoning from incomplete information: A case study in stroke detection [0.0] DeepProbLogは、透明で厳格なフレームワーク内で患者の画像を分析するための、ニューロシンボリックなアプローチを可能にする。
マルチモーダルデータからの脳卒中検出のケーススタディとして、文献で利用可能な要約統計からDeepProbLogベースの診断システムへの経路を考察した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 08:04:14 GMT)
Curriculum Generation under Structured Parametric Environments for Robust Navigation Policies [0.0] 本稿では,一方向勾配最適化を用いた構造化連続環境パラメータのカリキュラム生成フレームワークを提案する。
提案手法は,2つの連続制御OpenAI Gym環境にまたがって評価される。
提案手法は,5つのランダムシードに対して,バニラポリシートレーニング,ランダムパラメータサンプリング,手動カリキュラム,フロンティアベース手法,自己更新強化学習(SPRL),ガウス混合モデルを用いた絶対学習進歩(ALP-GMM),リバースカリキュラム学習ベースラインを常に上回っている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 07:45:21 GMT)
Certified Misty-State Rewriting (A Question-and-Answer Guide) [0.0] 量子力学は概念的内容と数学的表記は通常一致しているため、教えることが難しい。
ルドルフの国語はこれらの負担を分離するために設計された。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:38:09 GMT)
Catastrophic Forgetting in Continual Reinforcement Learning [0.0] 破滅的な忘れは継続的な学習にとって重要な障害である。
本研究の目的は,新しいタスクの類似性が前のタスクのパフォーマンスにどの程度影響するかを理解することである。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:39:07 GMT)
Can Webcam Gaze Constrain Mesa-Objectives in Driving Models? An Instrument Precision Analysis [0.0] ウェブカメラによる視線追跡によって捉えた人間の視線パターンが、メザ・オブジェクト形成を制限する特権情報として機能するかどうかを検討する。
危険アノテーションと同期した137,663個のフレームレベルの視線サンプルを実ダッシュカムクリップ388本で収集した。
実験では視線から統計的に有意な改善が得られない。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 22:55:28 GMT)
Can Open-Weight Models Compete on Financial Text Comprehension? [0.0] 中国のAI研究所のオープンウェイトな言語モデルは、ここ数カ月でプロプライエタリなフロンティアモデルと比較してベンチマークに上がった。
しかし、実際の金融業務に対する信頼性はほとんど証明されていない。
本誌はFinancial Touchstoneのベンチマークをアップデートした。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 10:51:52 GMT)
Born-Oppenheimer, Born-Huang, and exact factorization: quantum geometry and error in analytically transparent benchmark models [0.0] ポテンシャルエネルギー面」はいくつかの異なる物体を指す。
我々は、許容質量比と結合度毎にこれらのエネルギーの基底状態順序を証明した。
励起状態まで均一に拡張しない理由を示す。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:22:10 GMT)
Beyond Routing: Decoupling Expert Dispatch and Aggregation in Sparse Mixture-of-Experts [0.0] これら2つの役割,ディスパッチとアグリゲーションが結合されるべきかどうかを検討する。
構造化されたオラクルは、3つの種に対して0.0160 +/- 0.0039 の完全水平交叉エントロピーを改善する。
FDAAは3つの種に対して Delta CE = -0.1523 +/- 0.0031 で WikiText-103 テストを改善する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 18:31:16 GMT)
Automating Freshman Course Placement and Registration: A Case Study [0.0] 本報告では, ローワン大学における新入生の配置と登録のプロセスを自動化する取り組みについて考察する。
このシステムは3500人以上の入学者を処理し、年間350時間以上を節約した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:51:27 GMT)
Analytical Nuclear Gradients and Hessians on Quantum Hardware via Orbital-Optimized VQE with Error Mitigation [0.0] 核勾配とヘッセンは計算化学の基本的な量である。
量子ハードウェアにおける解析的実装について述べる。
この手法は軌道最適化と線形応答理論を組み合わせた活性空間の枠組みで定式化されている。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 15:18:23 GMT)
Agentic Anomaly Detection with ORCA-Style Dynamic Inductive Bias Adaptation in Multimodal Wearable Time Series Data [0.0] エージェント制御型異常検出フレームワークORCAを提案する。
カスタムのWBANデータセット全体で、ORCAは最強の固定コンテキストベースラインに匹敵するパフォーマンスを達成する。
これらの結果は,資源制約,非定常的時系列における異常検出のための実用的かつ堅牢な設計原理として,適応的時間的帰納バイアス制御を強調した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 18:49:13 GMT)
AdapterMoE: A Two-Stage Hard-Routing Mixture-of-Experts Architecture for Multi-Crop Disease Recognition with Calibrated Rejection and Incremental Learning [0.0] マルチクロップ認識は、Mixture-of-Experts (MoE) に適合するが、従来のソフトルーティングMoEは、作物の割り当てをエンドツーエンドで自由に学習する。
本稿ではAdapterMoEを提案する: RouterHeadが作物を分類し、最大ソフトマックス確率閾値で非ターゲット作物を拒絶する。
専門家はデータレベルで厳格にアイソレーションされているため、設計は専門家の崩壊を回避し、ローカル、クラスタごとのアップデートのための add_crop インターフェースを公開する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 16:45:21 GMT)
ADEx-FNO: A Unified Ambient-Domain Framework for Fourier Neural Operators on Varying Geometries [0.0] フーリエニューラル演算子(FNO)は効率的な非局所スペクトル学習を提供するが、異なる測地と独立に選択された離散化は対応し難いままである。
定義FNO層を変更せずに幾何学を組み込む決定論的フレームワークである、環境領域拡張フーリエニューラル演算子(ADEx-FNO)を導入する。
ADEx-FNOは2次元および3次元の保持された滑らかな非線形ポアソンと対流-反動-拡散問題に対して0.32%-0.77%の相対的なl2誤差を達成し、非滑らかな地平線上でも評価される。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 09:41:25 GMT)
A Symmetric Layer-Union Audit of Component Collapse in Hierarchical Procedural Corpora [0.0] コンポーネント非結合の漏洩制御は、コンテンツ類似性、階層的メンバシップ、あるいはその両方でコーパス単位をグループ化することができる。
Guvenilir氏とDogan氏は以前、マージ関係型は分割を妨げる巨大なコンポーネントを作ることができることを示した。
本研究では,6つの階層的手続きコーパスの固定パネルにおいて,コンテント近傍の二重層,共通コンテナ層,およびそれらの結合の対称監査を通して検討した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 20:13:17 GMT)
A Resource-Efficient Quantum Framework for Graph Coloring and Chromatic Number Estimation [0.0] 量子符号化では、色数で対数的にスケールし、頂点で線形にスケールする量子ビットを必要とする。
制約付きトラックの負荷問題を解くことにより,ロバスト性を実証する。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 13:15:12 GMT)
A Low-Cost IoT Device for Environmental Monitoring and Embedded Solar Forecasting with On-Device Incremental Learning [0.0] この研究は、温度、湿度、光度、および太陽光をIP68レベルの囲いの中で統合するESP32に基づく、モノのモジュラーインターネット(IoT)デバイスを提示する。
ネットワークは、サイト収集データ上でオフラインでトレーニングされ、クラウド接続なしで静的な重量行列としてマイクロコントローラ上にデプロイされる。
このシステムは、ドイツのウルムで短期間のハードウェアとファームウェアの検証と、メキシコのザポパンで115日間の配備という2つのフィールド展開を通じて評価された。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 23:41:42 GMT)
A Dynamic-Semantics Framework for Grounding Human Referring Expressions in Visual Perceptual Data [0.0] 本稿では,パクト状態を3つの明示的で検査可能な参照オブジェクトバインディングに外部化するフレームワークを提案する。
スタンフォード・リピート・レファレンス・ゲーム・コーパス(Stanford Repeated Reference Game corpus)のフレームワークについて検討した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 12:14:10 GMT)
A Domain-Structured Ensemble Framework for Perioperative Outcome Prediction Using Electronic Health Record Data [0.0] 周術期のリスク予測モデルは、狭い外科的人口、不完全なデータ、限られた解釈可能性によって制限されることが多い。
日常的に収集された電子健康記録(EHR)データを用いた結果予測のためのドメイン構造化アンサンブルフレームワークを提案する。
全国の保健情報交換所で行った5,386件の症例管理サンプルにおいて,術後デリリウムを用いた枠組みを実証した。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 21:15:12 GMT)
A Combined Feature-Based Framework for Disguise and Spoofing Detection in Face Recognition Systems [0.0] 顔認識システムは2つの異なる分離された障害モードに直面している。
本稿では,1つのフレームワーク内の2つの問題に対処する5つの機能抽出と分類パイプラインを提案し,比較する。
これらの手法は、FEI、Disguised Faces Database、NUAAデータベースから抽出された115の被験者で訓練された。
論文参考訳(メタデータ) (Sun, 09 Aug 2026 06:40:34 GMT)