DataComp-VLM: Improved Open Datasets for Vision-Language Models [161.7] VLMトレーニングを改善するためのデータ中心実験のためのベンチマークであるDCVLM(DataComp for Vision-Language Models)を紹介する。
4つのデータ型にまたがる160のデータセットを6Tマルチモーダルトークンのコーパスに収集します。
DCVLMは、参加者が1B-8Bモデルと6.25B-200Bトークンの予算でキュレーション戦略をテストすることを可能にする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:49:34 GMT)
Fund2Persona: A Framework for Building and Refining Financial Advisor Personas from Fund Disclosure Data [92.7] 我々は、資金開示、上場、市場状況、マネジャーのコメンタリーに財務担当のペルソナを基盤とするフレームワークであるFund2Personaを提案する。
得られたペルソナを,保留型保留型保留型再建とマネジャー・コンパートリーアライメントで評価した。
これらの結果は、ファンドデータに基づく金融アドバイザーの人格は、マネジャー固有の投資専門知識をポータブルにすることができることを示唆している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:50:50 GMT)
ViQ: Text-Aligned Visual Quantized Representations at Any Resolution [91.5] 本稿では,視覚的量子化表現フレームワークViQについて紹介する。
我々のアプローチは、量子化学習をテキスト整列事前学習と特徴分別という2つの段階に構成する。
マルチモーダル・タスクの実験では、ViQは最先端のマルチモーダル・ビジョン・エンコーダに比べて競争性能が高いことを示した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:05:33 GMT)
One Reflection Is Not Enough: Self-Correcting Autonomous Research via Multi-Hypothesis Failure Attribution [85.7] 我々は,自己修正型,自律型,接地型実験機であるSAGEを提案する。
その中核的なメカニズムであるMHFA(Multi-Hypothesis Failure Attribution)は、回復を構造的因果診断として扱う。
12のトピック、5ドメインのベンチマークでは、SAGEは基準リフレクションでメトリクスを含むアウトプットを42%から92%に増やしている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:54:16 GMT)
Orca: The World is in Your Mind [82.0] 一般世界基盤モデルの初期インスタンス化であるOrcaを紹介する。
Orcaはマルチモーダルな世界信号から統一された世界潜在空間を学び、それをマルチモーダルな読み出しインターフェイスを通じて公開する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:57:56 GMT)
Learning from Failure: Inference-Time Self-Improvement for Computer-Use Agents [80.0] コンピュータ利用エージェントを開発する上での大きな課題は、大規模で高品質な軌道を収集することである。
我々は、失敗した軌道をエージェント改善に変換するデータ中心のパラダイムを提案する。
この手法をOSWorldベンチマーク上で,最先端のOpenCUA-72Bモデルを用いて検証する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:44:37 GMT)
ERA: Entropy-Guided Visual Token Pruning with Rectified Attention for Efficient MLLMs [77.6] 本稿では,効率的なMLLMを実現するために,Rectified Attention を用いたエントロピー誘導型ビジュアルトークン解析フレームワーク ERA を提案する。
ERAはDEP(Dual-view Entropy Pruning)、BTR(Bias-Aware Tokencycle)、LAR(Logit-Reserving Attention Rectification)の3つの重要な構成要素から構成される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:20:29 GMT)
SpatialUAV: Benchmarking Spatial Intelligence for Low-Altitude UAV Perception, Collaboration, and Motion [76.8] 空間知能は、低高度無人航空機(UAV)の認識、協調、航行に不可欠である。
本研究では,実際の低高度UAVベンチマークであるSpatialUAVを紹介した。
現状のモデルは, クロスビュー・アソシエーション, 構造的グラウンドリング, 幾何学的推論, 時間的視点理解において, 明らかなボトルネックを伴って, 人間のレベル・パフォーマンスから遠ざかっていることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:25:43 GMT)
PerceptionRubrics: Calibrating Multimodal Evaluation to Human Perception [75.7] PerceptionRubricsはルーブリックベースの評価フレームワークである。
飽和ベンチマークスコアと現実世界の脆さのギャップに対処する。
1,038枚のインフォメーションセンス画像と1万個以上のインスタンス固有のルーリックをペアリングする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:30:17 GMT)
MemoBench: Benchmarking World Modeling in Dynamically Changing Environments [72.2] MemoBenchは動的に変化する環境において、消失・再出現するパラダイムを中心に構築された診断ベンチマークである。
合成シーンと実世界のシーンにまたがる360度地上トラスクリップをキュレートし,VQAに基づく評価と自動メトリクスを組み合わせた評価スイートを設計する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:22:46 GMT)
InfiniVerse: Occupancy Guided Unbounded Scene Generation for Autonomous Driving [70.8] InfiniVerseは、単一のフレームから動的都市シーンを合成するための統合パイプラインである。
InfiniVerseは6.4のFIDと67.97のFVDで最先端のパフォーマンスを達成し、持続時間と安定性の両方で既存のベンチマークを著しく上回っている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:08:22 GMT)
PointSplat: Compact Gaussian Splatting via Human-Centric Prediction [70.5] 本研究では,ハエのインプットビューから3次元人間表現を創出する新しい人間中心のアプローチであるPointSplatを提案する。
提案手法は,まず粗い幾何学的プロキシを推定し,冗長点を起点とするレイキャスティングを行う。
その後、ポイント・イメージ・トランスフォーマーを使用して外観と幾何学的特徴を融合させ、ガウスの属性を1つの前方通過で予測する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:59:05 GMT)
Anchoring on Reality: Breaking the Pseudo-Target Ceiling in Makeup Transfer [70.4] メイクアップ転送は、そのアイデンティティと幾何学を保ちながら、ソースフェイスに参照化粧スタイルを適用する。
現在の手法は、大規模な編集モデルの弱い先行や合成擬似ターゲットに依存している。
本稿では,現実に適応した改良サイクルを持つ2段階のフレームワークであるART(Anchoring on Reality Makeup Transfer)を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:28:01 GMT)
Harnessing Textual Refusal Directions for Multimodal Safety [70.2] マルチモーダルセーフティデータを必要とせずにマルチモーダルセーフティを注入する軽量なトレーニングフリーアプローチであるModality-Agnostic Refusal Steering (MARS)を導入する。
MARSは、アクティベーションリセンタによるモダリティの不整合を補正し、幾何的に定義された信頼領域内でステアリング強度を適応的にスケーリングし、最適な介入層を選択する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:57:50 GMT)
Arena-T2I Hard: Benchmarking and Improving Faithfulness with Dependency-Aware Checklist [69.8] 既存の忠実度ベンチマークは単純な原子命令に依存している。
本稿では,実アリーナT2Iログから抽出した310プロンプトの応力ベンチマークであるArena-T2I Hardを紹介する。
本稿では,各プロンプトをイエス/ノー質問のDAGに分解し,失敗する両親の子孫をゼロにする依存性対応チェックリスト報酬を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:17:05 GMT)
LUNA: Learning Universal 3D Human Animation Beyond Skinning [67.8] LUNAは,画像,キーポイント,スケッチ,未知文字などの複数の2次元制御を3次元ガウス変形にマッピングする,普遍的なニューラルアニメーションモデルである。
実験により、LUNAはLBSベースのアプローチと比較して、光現実的な競合的な視覚的忠実性を達成することが示された。
我々の知る限りでは、LUNAは暗黙の2D駆動をサポートする最初のエンドツーエンドの3Dアニマタブルモデルである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:19:55 GMT)
TF-MoE: Time-Frequency Mixture-of-Experts for Efficient Speech Separation [67.1] TF-MoEはSparse Mixture-of-Experts (MoE)フレームワークであり、ほぼ推論コストの増加なしにモデルのキャパシティを向上させる。
TF-MoEは、Melt-band-splitting Conformerのバックボーン上に構築され、低スループット設定下でのSSタスク上での強力なパフォーマンスを実現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:02:58 GMT)
ACE: Pluggable Adaptive Context Elasticizer across Agents [65.5] Adaptive Context Elasticizer (ACE)は、各決定ステップでエージェントのコンテキストに履歴ステップ情報をオーケストレーションする。
ACEは、トランケーションと要約ベースラインを一貫して上回る。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:20:45 GMT)
Domain Adaptive Object Detection via Dual-Stream Bilevel-Cycle Optimization [64.8] サイクル自己学習(CST)は、標準自己学習フレームワークの共有分類器の仮定を破る。
CSTは、ターゲットの擬似ラベルでトレーニングすることで、ラベルなしのターゲットデータを悪用する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:05:30 GMT)
PixelEyes: Decoupling Perception and Reasoning for Pinpoint Visual Evidence Seeking [63.6] 本稿では,複数ターンの視覚的推論を探索し,MLLMが目標のローカライズに失敗するのを観察する。
我々は、認識から推論を明示的に分離する視覚的推論エージェントであるPixelEyesを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:51:54 GMT)
ClawArena-Team: Benchmarking Subagent Orchestration and Dynamic Workflows in Language-Model Agents [61.2] 大規模言語モデル(LLM)エージェントは、単独の問題解決者としてではなく、マネージャとしてデプロイされることが多い。
ClawArena-Teamは、41のマルチターン、マルチモーダル、マルチエージェントシナリオのベンチマークである。
全体的なスコア -- Subagent-Management Score (SMS) -- は、タスクの正しさを最小限のプライマリとモダリティのルーティング因子によって乗算する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:06:08 GMT)
Reinforcement Learning with Metacognitive Feedback Elicits Faithful Uncertainty Expression in LLMs [60.8] 本稿では,メタ認知的フィードバックによる強化学習を忠実な校正問題に適用する。
実験により、RLMFは様々なタスクにおいて汎用的で最先端のFCを実現することが示された。
RLMFは標準のRLを最大63%上回り、モデルの性能限界を評価し表現する能力を高めている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:56:01 GMT)
SimpleSearch-VL: A Simple Recipe for Multimodal Agentic Deep Search [60.3] マルチモーダルエージェント検索のための,効率的で信頼性が高く,実用的なフレームワークであるSimpleSearch-VLを提案する。
SimpleSearch-VLは、データやツール、補助モデルコンポーネントをスケールするのではなく、エージェント自身の検索と検証プロセスを改善する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:22:24 GMT)
Adapting Generalist Robot Policies with Semantic Reinforcement Learning [59.0] ジェネラリストロボットポリシーは、大規模な事前訓練から多様な行動のレパートリーを学ぶ。
本稿では,オンラインインタラクションを通じて,このプロンプト空間を最適化するためのセマンティック・アクション強化学習(SARL)を提案する。
我々は、SARLが基本的に新しい機能をアンロックしていることを示します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:00:33 GMT)
Generative Skill Composition for LLM Agents [58.5] LLMエージェントは複雑なタスクを解決するためのスキルの恩恵を受ける。
スキルライブラリが成長するにつれて、適切なスキル構成を選択することが中心的なボトルネックとして現れている。
本稿では,タスク条件付きスキルシーケンス予測として構造化されたスキルコンポジションをインスタンス化するSkillComposerを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:53:09 GMT)
UnfoldArt: Zero-Shot Recovery of Full Articulated 3D Objects from Text or Image [58.4] 本稿では,テキストや画像からの3Dオブジェクトの再構成について,議論を巻き起こしたアプローチを提案する。
高レベルのエージェントは、視覚言語やビデオモデルからの知識を用いて、オブジェクトの意味論と動きを推論する。
低レベルエージェントは調音パラメータと相互作用点を推定する。
同じビデオは、合意された調律に条件付けされ、各部分をその動きを通して駆動し、隠された内部と幾何学を露呈する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:31:23 GMT)
Language-Assisted Super-Resolution from Real-World Low-Resolution Patches [57.8] 単一画像超解像は、低解像度(LR)入力から高解像度(HR)画像を再構成することを目的としている。
ほとんどの方法は、手作りのカーネルやカメラISPの調整によるHR画像の分解によってLR画像を合成する。
未ペアSRのための新しいフレームワークであるLA-SR(Language Assistant for SR)を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:57:38 GMT)
InstanceControl: Controllable Complex Image Generation without Instance Labeling [57.0] 本稿では,インスタンスラベリングの必要性を解消する新しい制御可能な生成手法であるInstanceControlを提案する。
我々は、VLM(Vision-Language Model)を活用し、テキストプロンプトと視覚条件のインスタンスレベルの対応を確立する。
我々の手法は最先端の手法より優れ、優れた忠実度と高精度なインスタンスレベルの制御を実現している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:33:03 GMT)
Towards Voxel Spacing Consistency for Medical Image Segmentation [57.0] 画像再サンプリングとセグメンテーションの相関について検討し,意味認識型再サンプリングフレームワークであるConsispaceを提案する。
コンシスペースは、解剖学的および意味的一貫性を維持しながら、軸方向における一貫したボクセル間隔を達成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:42:23 GMT)
AI-Assisted Discovery of Convex Relaxations via Dual Agents [56.6] すべての許容関数に対して下界が成り立ち、より強い境界を与える凸緩和から従うことを示す。
理論は各エージェントを検証し、反例を検索し、報告されたすべての境界はインターバルにおける明示的な二重実現可能な点によって認証される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:10:25 GMT)
AnyBokeh: Physics-Guided Any-to-Any Bokeh Editing with Optical Fingerprint Transfer [56.4] 我々は,任意のボケ編集のための物理誘導フレームワークであるAnyBokehを紹介した。
ソース・オブ・コンフュージョン・マップとターゲット・オブ・コンフュージョン・マップの両方に条件付けされた生成エディタは、相対的にぼやけた合成を行う。
実験によると、AnyBokehはあらゆるボケ編集、オール・イン・フォーカス・トゥ・ボケレンダリング、デフォーカス・デブロアリングなど、忠実でコントロール可能な編集を実現している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:01:28 GMT)
Adapting Foundation ASR Models to Dysarthric Speech: A Case Study [56.4] 本稿では,基礎的ASRモデルを話者固有データに適用して構築した変形性スピーカーのためのパーソナライズされたASRシステムを提案する。
TEQSTツールを使用して92時間の読み上げ音声を収集し、その後、デプロイされたモバイルアプリケーションから収集された8.8時間のユーザ修正を加えました。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:23:49 GMT)
DynFly: Dynamic-Aware Continuous Trajectory Generation for UAV Vision-Language Navigation in Urban Environments [55.7] 我々は高レベルナビゲーション推論と実行可能なUAV動作を橋渡しするDynFlyを提案する。
DynFlyはB-スプライン制御点空間のエキスパート軌道を表し、Spline-DiTジェネレータを用いて条件付き軌道生成を学習する。
OpenUAV UAV-VLNベンチマークの実験では、DynFlyは航法性能と軌道品質の両方を改善している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:33:48 GMT)
Technical Report of RoboSpatial Challenge at CVPR 2026: Selective Reasoning Activation and Reference-Frame Disambiguation for Embodied Spatial Reasoning [55.1] 本稿では,RoboSpatialBrainを紹介する。RoboSpatial Challenge at the Embodied Reasoning in Action Workshop。
RoboSpatialBrainは2つのトレーニング不要な推論時間メカニズムを組み合わせる。
RoboSpatialBrainはRoboSpatial Challengeで1位となり、RoboSpatial-Homeの総合的な成功率は80.9%となった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:25:59 GMT)
MemLearner: Learning to Query Context memory for Video World Models [54.2] 本稿では,クエリトークンを用いてコンテキストと予測トークンをブリッジする学習型適応型コンテキストクエリ手法であるMemLearnerを提案する。
MemLearnerは、スクラッチから追加モジュールをトレーニングすることなく、事前トレーニングされた視覚的事前を活用でき、トレーニングと推論のための効率的な戦略が組み込まれている。
大規模な実験により、MemLearnerはシーンの一貫性とメモリの点で、以前のビデオワールドモデルよりも大幅に優れていた。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:31:32 GMT)
FaceMoE: Mixture of Experts for Low-Resolution Face Recognition [54.0] 低分解能顔認識のためのMixture of Experts(MoE)トランスフォーマーアーキテクチャの効果的な適応であるFaceMoEを提案する。
具体的には、複数の専用フィードフォワードネットワーク(FFN)の専門家を紹介し、適切な専門家にトークンを動的に割り当てるトップkルータを組み込む。
このデザインは、顔の異なるセマンティック領域の専門家間の専門化を緊急に促進し、FaceMoEは分解能を考慮した特徴抽出を行うことができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:59:57 GMT)
The Past Is Prologue: A Plug-in Controller for Selective Updates in Sequentially Evolving LLM Memory [53.5] 我々はJanusを提案する。Janusは、候補メモリの更新を受け付けるか、以前のメモリを保持するかを決定するプラグインメモリコントローラである。
Janus は Memory Momentum Trigger を使用して、メモリ更新軌道における不審な偏差を識別する。
Janusは、対応するベース更新器に対して、平均精度を+2.7から+4.6ポイント改善する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:33:18 GMT)
Beyond Single Character: Evaluating MLLMs for Sentence-Level Oracle Bone Inscription Understanding [52.8] 文レベルOBI理解におけるMLLMの評価のための新しいベンチマークであるS-OBIを紹介する。
S-OBIはグリフ置換と合成により、明瞭で標準化された文レベルのOBIインスタンスを合成する。
実験により, 文レベルOBI理解における現代MLLMの劣性を明らかにする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:59:44 GMT)
CDR-Bench: Evaluating Faithful Execution of Compositional, Order-Sensitive Data Refinement Recipes [52.7] CDR-Benchは、4つの現実世界のデータリファインメントドメインにまたがる3,462の高品質なタスクを特徴とする包括的なベンチマークである。
我々のベンチマークでは、原子性、秩序に依存しない、秩序に敏感な設定でモデルを評価する。
10以上の最先端のLLMの実験では、一貫した障害パターンが明らかになっている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:08:45 GMT)
PatternGSL: A Structured Specification Language for Template-Free and Simulation-Ready 3D Garments [52.5] 本稿ではテンプレートフリーで学習可能な仕様言語であるPatternGSLについて述べる。
本稿では,単一画像から直接PatternGSL仕様を予測し,それらを衣服に復号する視覚言語フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:55:02 GMT)
Gated Multi-Graph Fusion via Graph Attention Networks for Alzheimer's Disease Detection [52.4] 自然発声はアルツハイマー病(AD)にとって重要な非侵襲的バイオマーカーである
本稿では,音声を自動音声認識(ASR)で書き起こし,セマンティック,依存性,共起グラフを構築するマルチビューGated Graph Attention Networkを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:15:59 GMT)
FLARE-AI: Flaw Reporting for AI [51.6] デプロイされたAIシステムの欠陥報告は、システムの障害を特定し、AIの安全性を改善するために不可欠である。
しかし、AIレポートのエコシステムは断片化されている。欠陥を特定する研究者は、報告すべきことを知らないことが多く、レポートを受け取るグループは、他の関連するステークホルダーと共有することはめったにない。
私たちは、AI開発者、サイバーセキュリティグループ、AI欠陥アグリゲータによって公表された12のレポートシステムを監査します。
我々は、既存のシステムとの相互運用性のために設計された、オープンソースのAI欠陥報告システムであるFLARE-AIを紹介する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:27:09 GMT)
Beyond Triplet Plausibility: Relation Set Completion in Knowledge Graphs [51.6] 関係集合完了タスク(RSC)と関係集合埋め込みモデル(RelSetE)を導入する。
RSCは、あるエンティティと意味的に互換性のある欠落した関係を推論することを目的としている。
RelSetEは、観測されたエンティティの関係の中で潜在パターンをモデル化し、失われたパターンを推測する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:41:30 GMT)
Truth or Sophistry? LoFa: A Benchmark for LLM Robustness Against Logical Fallacies [51.4] 大規模言語モデル(LLM)は強力な意味的能力を示すが、論理的誤認のような操作型言語パターンに対する弾力性は未解明のままである。
本稿では,LLMのロバスト性を評価するためのベンチマークであるLoFa(Logical Fallacy)を紹介する。
また、誤攻撃に対する抵抗を定量化する指標であるk(LFR@k)の論理的誤り抵抗についても提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:17:45 GMT)
HyperVLP: Enhancing Hierarchical Surgical Video-Language Pre-training in Hyperbolic Space [50.6] 階層構造を明示的に保存するハイパーボリックな手術用ビデオ言語事前学習フレームワークを提案する。
複数の手術用ベンチマークの実験は、ゼロショットと少数ショットの位相認識において一貫した利得を示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:21:06 GMT)
DriftScope: Measuring The Hidden Effects of Diffusion Model Adaptation [50.6] 新しい視覚概念を学習するか、望ましくないものを消去するか、事前学習したテキスト・画像拡散モデルに適応させることは、意図した効果だけで日常的に評価される。
適応が意味論的に無関係な概念を、構造的にメトリクスを集約することができない方法で体系的に損なうことを実証する。
DriftScopeは、任意の2つのモデルチェックポイントを取り込み、視覚的概念が最も移行したトークンのランクリストを返す、プロンプトレベルの診断ツールである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:57:51 GMT)
World Narrative Model for Highly Controllable Video Generation: A Paradigm Shift from Pixel Sampling to Physical World Orchestration [49.7] 私たちはWNM(World Narrative Model)というパラダイムを紹介します。
WNMは、エンドツーエンドのブラックボックスサンプリングを、メディア生成のための4D$プリヴィジュアル化に置き換える。
我々の人間-AIプラットフォームは、プロの映画制作パイプラインに合わせた世界の自動生成と前視化をサポートしています。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:52:53 GMT)
Semantic Leakage and Privacy Preservation in Relay-Assisted Semantic Communications [49.5] セマンティックコミュニケーション (Semantic Communication, SemCom) は, タスク関連情報の伝達を生データよりも優先する, 有望なパラダイムとして登場した。
本稿では,リレー支援型SemComシステムのプライバシに関する考察を行い,中間中継ノードは学習された潜在表現を直接操作する。
リレーの強い、適応的に訓練された盗聴器を明示的に説明する対向訓練フレームワークが提案されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:15:23 GMT)
LabGuard: Grounding Natural-Language Laboratory Rules into Runtime Guards for Embodied Laboratory Agents [48.8] LabGuardは、自然言語ラボラトリールールを実行可能な仕様に基盤として、実行時ガードとしてデプロイする言語から実行時安全スイートである。
LabGuardには、型付き実行可能表現を定義するLabGuard-IRと、203のシードラボルールから拡張された812の教師付きアノテーションを提供するLabGuard-Benchと、自然言語ラボルールをLabGuard-IRにマッピングするLabGuard-Grounderの3つのコアコンポーネントが含まれている。
実験の結果、LabGuardは検査結果の得られないソースに一般化し、79.4タスクスコープF1を達成し、監視後の安全でないイベントを39.5%から23.8%に減らすことがわかった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:30:51 GMT)
Decodable Is Not Grounded: A Vision-Ablation Arbiter for VLM Spatial Reasoning [48.4] モデルから潜在的知識を読み出す標準的な方法は、視覚言語モデルがイメージに根ざしたものを体系的に上書きすることができる。
本研究では,空間的推論において,一直線因果制御によって露呈した探究と操舵の両方に誤差が見えないことを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:33:18 GMT)
Multi-Timescale Latent-Action DRL for Joint Optimization in Edge-Cloud Networks [48.4] エッジクラウドとレイヤ間のロード不均衡は、レイテンシのパフォーマンスを低下させる。
動的タスク到着と異種リソースの下での階層型エッジクラウドコンピューティングシステム。
本稿では,サービス配置を最適化するための行動空間(2MDRL-LA)を用いた2時間深層学習研究を提案する。
平均e2e遅延を20.8%削減し、計画よりも13%改善した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:56:15 GMT)
FedLAB: Traceable Semantic Codebooks for Federated Multimodal Graph Foundation Learning [47.9] FedLABはトレース可能なセマンティックコードブックフレームワークで、マルチモーダルグラフの知識をモダリティエビデンス、ノードセマンティクス、トポロジーコンテキストのための型付きコードブックに整理する。
実験によると、FedLABは、ネイティブなセマンティックトレースインターフェースを保持しながら、最先端のベースラインを7.53%改善している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:47:39 GMT)
Cross-Space Distillation: Teaching One-Step Students with Modern Diffusion Teachers [47.9] Bridgeは、学生のラテントを学生のバックボーンを変更することなく教師空間にマッピングする軽量のラテントインターフェースである。
SD 1.5 を 5.4 から 9.4 HPSv3 に改善し、ワンステップ推論、低レイテンシ、エコシステムとの互換性を保っている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:51:26 GMT)
Labimus: A Simulation and Benchmark for Humanoid Dexterous Manipulation in Chemical Laboratory [47.8] Labimusは、有機化学実験室におけるヒューマノイドのデキスタラスな操作に関する最初のベンチマークである。
実際の有機化学のワークステーションから30以上の機能的に忠実な資産を、リアルタイムモデリングによって再構築する。
本稿では,タスク完了,実験精度,長期実行を共同で測定するための精度評価プロトコルを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:14:28 GMT)
Reasoning with Memory: A Temporal Granularity-Adaptive Framework for Training-Free Long Video Understanding [47.5] ReMemは、トレーニングフリーのLongVideoQAのための時間的粒度適応選択フレームワークである。
メモリ機構で時間情報を明示的に保存することにより、ReMemは冗長性を抑え、MLLMに堅牢なマルチグラニュラビデオ推論を行う権限を与える。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:55:56 GMT)
Editing Everything Everywhere All at Once [47.3] MICE(Multi-Instance Concurrent Editing)は、マルチモーダル拡散変換器を用いたスケーラブルなマルチインスタンス画像編集のためのトレーニングフリー戦略である。
MICEは、インスタンス内の注意を許容し、近隣のトークン間の相互作用をペナライズし、無関係なクロスインスタンスの注意を抑える。
実験により、我々のアプローチは、視覚的品質の保存と編集指示への忠実性の点で、強力なベースラインや近年の競合よりも優れていることが示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:52:46 GMT)
ChronoFlow-Policy: Unifying Past-Current-Future Interaction Flow in Visuomotor Policy Learning [47.2] textbfpast, current, and future interaction dynamics through sparse 3D keypoints。
我々は,ChronoFlowとアクションシーケンスを協調学習する拡散型ビズモータポリシである textbfChronoFlow-Policy を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:12:45 GMT)
Work Statistics Under Quantum-Jump and Quench Dynamics in Monitored Ising Chains [46.9] 横フィールドの量子クエンチと、量子ジャンプまたは制御された測定シーケンスの両方を対象とする横フィールドイジング鎖の作業統計について検討する。
モニタリングされたクエンチでは、連続的な観察は孤立したクエンチ分布の微細な構造を洗い流す。
制御されたジャンププロトコルでは、連続ジャンプが因果的に切断された場合、各ジャンプによって加算されるエネルギーは一定である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:11:19 GMT)
3D HAMSTER: Bridging Planning and Control in Hierarchical Vision Language Action Models through 3D Trajectory Guidance [46.7] 3D HAMSTERは、最先端の低レベルポリシーと計量的に信頼性の高い3D軌道とのギャップを埋める階層的なフレームワークである。
3D軌道予測、シミュレーション、実世界の操作において、3D HAMSTERはプロプライエタリなVLMと2D誘導ベースラインを一貫して上回っている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:31:35 GMT)
ASPIRE: Agentic /Skills Discovery for Robotics [46.7] ASPIRE (Agentic Skill Programming through Iterative Robot Exploration) は、ロボット制御プログラムをコード・アズ・ポリティクスのパラダイムで書き、洗練する。
1)細粒度のマルチモーダルトレースを露呈し,自律的な故障診断,修復,合成,検証を可能にするクローズドループロボット実行エンジン,(2)検証済みの修正を再利用可能な,伝達可能な知識に蒸留する継続的な拡張スキルライブラリ,(3)多様なタスクシーケンスを生成する進化的検索と,単一軌道の洗練を超えて探索する制御プログラムである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:38:46 GMT)
Multi-Block Diffusion Language Models [46.6] ブロック拡散言語モデル(BD-LM)は、KVキャッシングとフレキシブルな長文生成により拡散ベースのテキスト生成を改善する。
マルチブロック教師強制(MultiTF)を用いたBD-LMの訓練後得られたマルチブロック拡散言語モデル(MBD-LM)を提案する。
MBD-LLaDA2-Miniは平均Tokens Per Forward Pass (TPF)を3.47から6.19に増加させ、平均精度を79.95%から81.03%に向上させる。
DMaxと組み合わせると、MBD-LLaDA2-Mini-DMaxの平均TPFは9.34である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:21:37 GMT)
HABIT: Human-Aware Behavior and Interaction Training Dataset for Robot Manipulation [46.5] HABITは、人間の現在環境に対する大規模なロボットデータセットのデモである。
我々は,人間とロボットのインタラクションの異なるモードを捉える3つの役割,コラボレータ,コワーキング,スーパーバイザにタスクを編成する。
実験の結果、人間の現在データに対するトレーニングは、ロボットのみのデータが生成できない人間の認識行動を引き起こすことがわかった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:58:19 GMT)
GEAR: Guided End-to-End AutoRegression for Image Synthesis [46.0] GEARはベクトル量子化(VQ)トークンライザと自己回帰(AR)ジェネレータを共同およびエンドツーエンドでトレーニングする。
GEARは、強力なLlamaGen-REPAベースラインと比較して、ImageNet gFID収束を最大10倍高速化する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:59:57 GMT)
Synergistic Perception-Reasoning Governance: Grounding Medical MLLMs with Verifiable Anatomical Evidence [45.8] マルチモーダル大言語モデル (MLLM) は, 臨床VQAと放射線学報告の生成に強い期待を示すが, 推測時幻覚は信頼性を損なう。
本稿では,両面のエビデンス注入による幻覚を系統的に緩和する,総合的かつトレーニング不要なエビデンス注入フレームワークを提案する。
textttLLaVA-1.5-7B, texttLLaVA-Med-1.5-7B, texttQwen3-VL-8B/32B, textttInternVL を用いた2つのタスクと5つのデータセットの系統的評価を行った。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:07:25 GMT)
CoMet: Context and Multiplicity Decomposition for Multimodal Uncertainty Estimation [45.6] 不確実性推定は、AIモデルにおける長年にわたる課題である。
本研究では,不確実性を文脈固有項と乗法固有項に分解したMLLM不確実性推定手法であるCoMetを提案する。
我々は,これらの量を評価するために軽量なポストホック不確実性モジュールを訓練し,自動回帰応答生成や繰り返しサンプリングを行うことなく,効率的な不確実性推定を可能にする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:46:09 GMT)
PruneGround: Plug-and-play Spatial Pruning for 3D Visual Grounding [45.5] 3D Visual Groundingは、自然言語で記述された3Dシーンでターゲットオブジェクトをローカライズすることを目的としている。
既存のアプローチは通常、シーン全体を推論し、曖昧な予測と高い計算コストをもたらす。
3つのキーコンポーネント上に構築された3DVGのための効果的なプラグアンドプレイフレームワークPruneGroundを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:21:11 GMT)
Automated High-Precision Extraction and Forensic Verification of Data-Bearing Vector Figures [45.4] 科学と工学の量的記録は、テキストや表ではなく数字によってもたらされる。
図をグラフィックとして保存すると、そのデータは画像によって近似されず、エンコードされる。
これを3つのコントリビューションに変換します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:43:32 GMT)
Intrinsic decomposition and editing of 3D Gaussian splats [44.7] 内在分解は、画像色を拡散アルベドとシェーディングの産物として表現する。
固有分解をガウススプラッティングで表される放射場に拡張する。
本稿では,その表面のアルベドを1枚の画像で簡単に修正することで,平面表面のテクスチャを修正できる編集ワークフローを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:20:44 GMT)
PRISM-VO: Scale-Aware Visual Odometry Using Photometric Plenoptic Bundle Adjustment [44.6] PRISM-VOは、焦点焦点光学カメラのための純最適化に基づくスパース光度計測フレームワークである。
PRISM-VOは、一眼レフ画像からの幾何学的深さと時間的多視点制約を組み合わせることにより、正確でドリフト耐性のある動き推定を実現する。
実験により、PRISM-VOは、屋内および屋外のシーンにおいて、現在最先端のピレノスコープ・オドメトリー法よりも優れていることが示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:50:11 GMT)
TAG-DLM: Diffusion Language Models for Text-Attributed Graph Learning [44.2] テキスト分散グラフ(TAG)は、テキストとグラフトポロジを共同で推論するモデルを必要とする。
マスク付き拡散言語モデル内でテキスト推論とグラフメッセージパッシングを統一する手法を提案する。
実験により、3つのTAGベンチマークにおいて、グラフニューラルネットワーク、グラフトランスフォーマー、LLMベースのベースラインよりも優れた結果が得られた。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:56:18 GMT)
Thinking Before Retrieving: Robust Zero-Shot Composed Image Retrieval via Strategic Planning and Self-Criticism [44.0] PEC-CIRは、クエリ構造を多段階推論パイプラインとして構成する、トレーニング不要のフレームワークである。
PEC-CIRは、検索前に候補クエリを明示的に評価することにより、生成エラーの伝播を低減する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:04:05 GMT)
Resourcefulness without Resource: Geometric Origins and Robustness [43.7] 一般的な直観では、自由状態のみを用いた量子プロトコルは運用上の利点を示さない。
既知の例としては、絡み合いのない非局所性や、最近ではマジックのない非安定化性がある。
対照的に、フリーアンサンブルはメモリアシスト攻撃を認め、ギャップを完全に消去し、フリーアンサンブルとリソース輸送アンサンブルの間に鋭い操作的非対称性を露呈する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:30:00 GMT)
On the Convergence of Self-Improving Online LLM Alignment [43.5] 自己改善アライメント(SAIL)アルゴリズムは、問題のバイレベル定式化を効率的な単一レベル法に還元することで、分散シフトに対処する。
標準SAILの目的関数は、ヘッセンの好ましくない性質のため、強く凹むことが保証されない。
最適化環境を改善するためにKL(Kulback-Leibler)分散ペナルティを組み込んだ正規化目的SAIL-RevKLを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:36:41 GMT)
Moral Safety in LLMs: Exposing Performative Compliance with Puzzled Cues [43.0] 現在の公正度評価は、道徳的安全性を著しく過大評価していることを示す。
人口統計学的アイデンティティが明示的なラベルとして記載されている場合、モデルは公平に見えるが、同一のアイデンティティを推論しなければならない場合、測定されるほど公平ではない。
本稿では、既存の公正度ベンチマークに追加可能なモデル非依存の指標を提案し、実際の道徳的安全性から分離する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:25:29 GMT)
Minimizing Quantized Semantic Age of Information (QSAoI) in Foundation Model-Based Semantic Communications [42.9] 本稿では,情報量化時代(QSAoI, Quantized Semantic Age of Information)について紹介する。
本稿では,遅延制約のあるセマンティック通信における無線フェージングチャネル上でのQSAoIを最小化するための,新しい基盤モデルに基づく効率的な協調設計フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:16:15 GMT)
CoCoMUT: A Tool for Code-Context Mining and Automated Dataset Generation [42.7] CoCoMUTは、コードコンテキストマイニングと自動データセット生成のためのJavaツールである。
フォーカスメソッドのコンテキストを抽出したり、クラス、パッケージ、システムスコープで生成する。
バイトコードレベルの呼び出しエッジをSpoonベースのソース抽出と照合する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:12:44 GMT)
Freeform Preference Learning for Robotic Manipulation [42.6] 本稿では,自由形人選好からロボットポリシーを学習するFPLについて紹介する。
FPLは、明示的なサブタスクセグメンテーションなしで密集した進行信号を学習し、データに存在しない行動の構成性を示し、ユーザーは再トレーニングすることなくテスト時に異なる行動に対するポリシーを操ることができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:54:02 GMT)
No Place to Hide: Benchmarking Video Hallucination with Background-Controlled Pairs [42.5] 大型ビデオモデル(LVM)におけるビデオ幻覚評価のための新しいベンチマークであるVidPair-Hallucを紹介する。
VidPair-Hallucは、非常に類似した背景を持つビデオペアを特徴としている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:38:41 GMT)
HSDF-Lane: Height-Aligned Signed Distance Field with Semantic Lane Prior for 3D Lane Detection [42.4] 本研究では,道路表面を高密度な3次元特徴量より高配位符号距離場(HSDF)として暗黙的にモデル化するHSDF-Laneを提案する。
HSDF-Laneは3次元車線検出と高さマップ推定の両方において最先端の性能を達成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:02:59 GMT)
Wait, am I Being Fair? Characterizing Deductive Stereotyping and Mitigating It with Fair-GCG [42.2] 我々は,個体群レベルでの統計正則性を個々の事例に適用する,障害モード,誘引ステレオタイピング(deductive stereotyping)を同定する。
フェアネスを考慮した推論に向けてモデルを操るための推論時間注入フレームワークを提案する。
また,Fair-GCGを導入し,効果的なインジェクションフレーズを体系的に発見する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:00:42 GMT)
AdaJEPA: An Adaptive Latent World Model [42.1] モデル予測制御(MPC)の閉ループ内でテスト時間適応を行う適応潜在世界モデルであるAdaJEPAを提案する。
トレーニング後、AdaJEPAは最初のアクションチャンクを計画し、実行し、観察された次の状態遷移を自己教師付き適応信号として使用し、更新されたモデルで再計画する。
このクローズドループアップデートは、さらなる専門家によるデモンストレーションなしに、世界モデルを継続的に再検討する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:53:48 GMT)
Mapping photon-number regimes in single-emitter lasers [42.0] 本研究では, 単一キャビティモードに強く結合した非整合励起三レベルエミッタからなるオープン量子系の数値解析を行った。
レーザーの挙動は、最小の光子集団から生じる可能性がある。
本研究は, 単一光源の動作限界の定義に応用できる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:10:49 GMT)
TabPATE: Differentially Private Tabular In-Context Learning Without Public Data [41.3] タブラル基礎モデルは、小さなラベル付きデータセットからコンテキスト内学習を可能にするが、コンテキストに置かれたプライベートレコードは、モデル予測を通じて漏洩する可能性がある。
本稿では,PATE 形式の表型 ICL に対して,パブリックな分散データを必要としない,差分プライベートな PATE スタイルの防衛手法である TabPATE を紹介する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:50:04 GMT)
DVG-WM: Disentangled Video Generation Enables Efficient Embodied World Model for Robotic Manipulation [41.0] 本稿では、世界モデリングを動的学習と視覚合成に分解する効率的なフレームワークであるDVG-WMを提案する。
LIBEROと現実世界のプラットフォームでの実験では、最大3.97倍の加速で画質が改善された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:54:32 GMT)
Self-Study Reconsidered: The Hidden Fragility of Learning from Self-Generated QA [40.9] 言語モデルは、QA(Synthetic Question Aswer)の監督によって、ますます教えられている。
この生成ステップが中立的な前処理ではないことを示す。
このような障害モードは,QA生成時の選択から発生し,トレーニングループを変更することなく低減できることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:35:14 GMT)
One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context [40.9] 本研究では,教師が学習可能なソフトプロンプトのみで生徒と異なる方法を提案する。
メソッドは、マージされたコーパスの各例を対応するソフトプロンプトの教師にルーティングすることで、マルチタスク設定に自然に拡張する。
Qwen3-1.7BベースとPhi-4-mini-インストラクタでは、単一タスクの変種が完全な微調整と一致するか、あるいは超える。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:56:05 GMT)
Segmenting, Fast and Slow: Real-Time Open-Vocabulary Video Instance Segmentation with Dual-Path Processing [40.8] 我々は、精度を犠牲にすることなく効率を大幅に改善するデュアルストリーム高速スローフレームワークであるSegFSを紹介した。
オブジェクトデコーディングから特徴空間コンディショニングへインスタンスの伝搬をシフトすることで,高密度マスク予測からマルチモーダルなセマンティック理解を分離する。
提案した高速分岐は、標準のOV-VISベンチマークで競合セグメンテーション性能を維持しながら、モバイル指向のUSモデルよりも14倍低い。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:59:19 GMT)
VOCA: Visual Odometry with Codec Awareness [39.8] 本稿では,情報を利用してトラッキング性能を向上させる因果ステレオ・ビジュアル・オドメトリー法を提案する。
圧縮ストリーム上での相対軌道誤差, 効率, 絶対軌道誤差に対して, 因果VOの最先端性能を実現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:11:07 GMT)
MECoBench: A Systematic Study of Multimodal Agent Collaboration in Embodied Environments [39.8] マルチモーダルな大規模言語モデル(MLLM)は、エンボディエージェントとして強い可能性を持っているが、視覚的に接地された環境で協調する能力はいまだ研究されていない。
マルチモーダルな組立協調ベンチマークであるMECoBenchを導入し,多様な実世界のタスク,2つの協調構造,3つの協調モードにまたがる評価プラットフォームを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:07:53 GMT)
InteractiveAvatar: Real-Time Streaming Video Generation for Consistent and Intent-Aware Avatars [39.5] 本研究では、視覚的に一貫したアバター映像生成と意図認識インタラクションをサポートするリアルタイム無限ストリーミングビデオ生成フレームワークを提案する。
自己回帰蒸留により、InteractiveAvatarは、任意に長い期間にわたって、人間のアバターのリアルタイムなストレーミング生成を達成する。
提案手法は,リアルタイムに複雑なユーザ・アバターインタラクションを実現するとともに,長周期生成における最先端の視覚的整合性を実現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:27:33 GMT)
Compressing What Matters: Neuron Importance Meets Data-Aware Low Rank Approximation for Language Model Compression [39.5] 本稿では,動的圧縮率割当のための拡張的で効率的なアルゴリズムを提案する。
実験結果は,従来の最先端技術よりも同等あるいは実質的に優れている提案手法の有効性を裏付けるものである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:16:00 GMT)
FinPersona-Bench: A Benchmark for Longitudinal Psychometric Stability of Autonomous Financial Agents [39.0] 大規模言語モデル(LLM)は、明示的な行動規範を持つ自律的な金融エージェントとして、ますます多くデプロイされている。
市場の状況が長い地平線を越えて蓄積するにつれて、これらの委任統治は徐々に行動的影響を失う。
衝突のシナリオでは、静的エージェントと周期的な委譲再接地を受けるエージェントの挙動ギャップは、シミュレーションの第1四半期から第4四半期まで4.4倍に増大する。
これらの結果から, 信頼性の高い長期展開には, エージェントプロファイルと市場体制に基づく選択的, 委任型再接地が必要であることが示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:33:29 GMT)
CLExEval: A Human-in-the-Loop Framework for Qualitative Evaluation of LLM Clinical Reasoning [37.9] 大規模言語モデル (LLMs) は多くの医学ベンチマークにおいて強い結果が得られたが, 臨床的理由を確実に評価することは困難である。
プログレッシブな情報マスキング下でのLCM臨床推論を評価するための人為的ループ・フレームワークであるCLExEvalを紹介した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:56:42 GMT)
Reflect-R1: Evidence-Driven Reflection for Self-Correction in Long Video Understanding [37.6] この研究は、長いビデオ理解のための最初のEvidence-Driven Self-correctionフレームワークであるReflect-R1を提案する。
このフレームワークは直感、検証、調停からなる3段階のパイプラインを構成する。
本手法は真正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正正
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:57:21 GMT)
SeKV: Resolution-Adaptive KV Cache with Hierarchical Semantic Memory for Long-Context LLM Inference [37.4] SeKVは、コンテキストをエントロピー誘導セマンティックスパンに整理する、解像度適応型セマンティックKVキャッシュである。
本研究では,SeKVが最強のセマンティック圧縮ベースラインよりも平均5.9%向上していることを示す。
128KコンテキストでのフルKVキャッシュに対して、GPUメモリを53.3%削減する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:18:02 GMT)
Deep Reinforcement Learning for Spacecraft Attitude Control During Atmospheric Re-Entry [37.2] 宇宙船再突入時の姿勢制御のための強化学習について検討する。
RLフレームワークのアプリケーションを形式化し、継続的で非政治的なRLを適用します。
ハイブリッドコントローラは攻撃角をよりよく追跡でき、質量、慣性テンソル、フラップアクチュエータの帯域幅の変動により頑健であることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:06:07 GMT)
When LLMs Read Tables Carelessly: Measuring and Reducing Data Referencing Errors [36.7] 本稿では,データ参照エラー(DRE)を,異なるモデルやタスク間で初めて体系的に評価する。
以上の結果から,DREは全試験モデル (1.7Bから20Bパラメータ) にまたがって発生することが明らかとなった。
我々は,データ参照を批評家として取り入れることで,解答精度が最大12.0%向上することが実証された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:54:50 GMT)
Mitigating Positional Leakage in 3D Masked Autoencoders for Robust Representation Learning [36.6] マスク付きオートエンコーディングは,3Dポイントクラウド上での自己教師型学習のパラダイムとして注目されている。
本研究では,既存の3D MAEフレームワークのデコーダが位置情報に過度に依存する傾向があることを明らかにする。
本稿では,エンコーダ機能の利用性を高めつつ,位置過度を緩和するマスク付きポイントラーニングフレームワーク MPL-MAE を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:29:34 GMT)
Multi-Hypothesis Test-Time Adaptation to Mitigate Underspecification [36.5] テスト時間適応(TTA)は、未ラベルのターゲットデータを用いてパラメータを適応させることにより、分散シフト下でのモデルロバスト性を改善することを目指している。
複数の異なるパラメータの更新は同様に低いエントロピーを達成し、決定境界を劇的に異なるものにする。
エントロピー最小化によって誘導される後部インスパイアされたレンズを通してTTAを再解釈し,低エントロピー解がパラメータ上の擬似類似性を定義する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:12:36 GMT)
PPT-Eval: A Benchmark for Computer-Use Agents on PowerPoint Tasks [36.4] Microsoft PowerPointはプレゼンテーション作成において最も広く採用され、機能豊富な環境の1つである。
12ファイルにわたる120のPowerPointタスクのベンチマークを導入し、コンテンツ作成とプレゼンテーション編集のシナリオをカバーする。
タスクは複雑でマルチモーダルであり、多くの有効なソリューションをしばしば認める。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:26:51 GMT)
ELASTIC: Efficiently Learning to Adaptively Scale Test-Time Compute for Generative Control Policies [36.3] ジェネレーティブコントロールポリシー(GCP)は、ロボット制御におけるテストタイムスケーリングを可能にする。
テスト時間計算はシーケンシャルスケーリングと並列スケーリングの2つの軸に沿って割り当てることができる。
GCPの状態依存型テスト時間計算スケジュールを学習するアルゴリズムであるELASTICを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:00:32 GMT)
MS-Resampler: Multi-Scope Visual Resampling for Efficient Multimodal LLMs [35.8] MLLM(Multimodal large language model)は通常、密集した視覚的特徴を言語モデリングのためのコンパクトなトークンシーケンスに変換するために再サンプリングベースのプロジェクタを使用する。
MLLMのためのマルチスコープ・ビジュアル・リサンプリング・フレームワークであるMS-Resamplerを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:11:50 GMT)
Generative Lane Topology Reasoning via Autoregressive Model with Geometry Prior [35.8] TopoGPTは典型的なレーングラフ構造に先立って幾何学を学習する生成フレームワークである。
我々は3.3Mシーンからなる大規模地図データセットを構築した。
TopoGPTは、レーンレベルが平均+6.4、ポイントレベルが+11.6である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:27:54 GMT)
Progressive Pose-Guided 4D Animal Reconstruction from Monocular Video [35.6] 本研究では,高忠実度4D動物再構成のための3次元ガウス平板上に構築したテスト時間最適化フレームワークを提案する。
我々は、カメラ推定ドリフトを吸収しながら左右の手がかりを利用する対称性を意識した時間符号化を用いる。
本手法は多種多様な種にまたがって頑健に一般化し, 優れた幾何学的精度, 時間的一貫性, 視覚的忠実度を実現している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:32:29 GMT)
Superconducting Spiral Inductors for RF Reflectometry: Operation at Elevated Temperatures and Magnetic Fields [35.2] 超伝導スパイラルインダクタが高周波反射計のキーコンポーネントとして登場している。
量子計算アーキテクチャは高温と磁場で動作することが期待されている。
本研究では, NbTiNスパイラルインダクタを, ケルビンおよび1Tに接近する磁場の温度下での系統的研究を行った。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:45:31 GMT)
Team MKC at CLPsych 2026: Capturing and Characterizing Mental Health Changes through Social Media Timeline Dynamics [35.0] 逐次順序付けされたユーザ投稿に対する総合的なメンタルヘルス分析のためのLLMベースのパイプラインを提案する。
当社のパイプラインは,ポストレベルアセスメントとユーザレベルの時間的モデリングを共同で実現する統合フレームワークを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:43:22 GMT)
WorldRoamBench: An Open-World Benchmark for Long-Horizon Stability of Interactive World Models [34.7] 4次元にわたる長期安定のためのオープンワールドベンチマークであるWorldRoamBenchを紹介する。
このベンチマークは、WASD 10-60sの連続的なインタラクションで、Nature、Urban、Indoorの各シーンで600以上のテストケースで構成されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:51:44 GMT)
FedCC: A Low-Resource Federated Adaptation of Foundation Models for Robust Corpus Callosum localization in Fetal Ultrasound Images [34.6] 胎児US画像におけるコーパス・カロサム(CC)の局在化のためのフレームワークであるFedCCを提案する。
このフレームワークは凍結したDINOv2バックボーンと軽量なYOLOベースの検出ヘッドを統合している。
計算と通信のオーバーヘッドを大幅に減らし、低リソース環境に適したフレームワークとなる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:02:13 GMT)
Dual Sparse Aggregation Transformer for Multispectral Object Detection [34.2] マルチスペクトル検出のための新しいデュアルスパースアグリゲーション変換器(DSAFormer)を提案する。
具体的には、DSAFormerは、クロスモーダル補完情報を活用および強化するために設計されている。
提案するDSAFormerは,4つの公開データセット上での最先端手法に対する検出性能を向上する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:05:24 GMT)
Towards Flexible, Natural, Efficient Interaction for Conversational Talking Face Generation [34.2] 対話型会話音声生成のための新しいフレームワークであるInterTalkを紹介する。
提案手法は,各参加者間での複数ラウンドの対話力学を明示的にモデル化することにより,高い柔軟性を実現する。
InterTalkは30FPSでリアルタイムのパフォーマンスを維持しながら、優れたインタラクション品質を実現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:27:23 GMT)
Hierarchical 3D Scene Graph Construction and Belief-based Planning for Semantic Navigation [34.1] エンボディエージェントのためのゼロショットセマンティックナビゲーションフレームワークを提案する。
本手法は,オブジェクト,ゾーン,領域を網羅したオンライン階層型3次元シーングラフ(HSG)を漸進的に維持し,グローバルプランニングのためのコンパクトな状態抽象化として機能する。
このメモリ上に構築された階層的信念に基づく計画フレームワークは,HSGの探索証拠とセマンティック先行を融合させ,HSGベースのシミュレータ上で有限水平ロールアウトを行い,候補マクロアクションの長期的リターンを明示的に推定する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:01:44 GMT)
Boosted Optomechanics with a Fluid of Nonlinear Polaritons [33.7] 光力学と分極論の融合は、光力学的相互作用の巨大な拡張のような刺激的な視点を開放する。
ここでは、量子井戸を埋め込んだディスクからなる偏光光学共振器の共振光制御について報告する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:23:42 GMT)
Occlusion-Robust Multi-Object Decoupling for Physics-Based Robotic Interaction [33.7] 本研究では,スパース・オブ・オブ・オブ・ザ・リアルワールドビューから多目的3次元再構成を実現するマスクレス手法を提案する。
本手法は手動マスクを必要とせずにシミュレーション可能な3Dオブジェクトを生成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:06:34 GMT)
Unsupervised Data-Efficient Cross-Modal Retrieval with Global-Neighborhood Alignment Hashing [33.2] 教師なしのクロスモーダルハッシュ(CMH)は、ラベルなしのイメージテキストペアからバイナリコードを学ぶことで、手動ラベリングへの依存を減らす。
我々は,コンパクトな二元ハミング空間における視覚言語基盤モデルのセマンティック構造を保存する新しいアプローチとして,GNAH(Global-Neighborhood Alignment Hashing)を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:30:53 GMT)
APRIL-MedSeg: A Modular Medical Image Segmentation Toolbox Embracing Modern Paradigms [33.2] APRIL-MedSegは、YAMLで駆動される2D医療画像セグメンテーションのためのモジュラーフレームワークである。
セグメンテーションネットワークを再利用可能なコンポーネントに分割する、統一されたエコシステムを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:59:05 GMT)
AA: A Multi-view Multimodal Dataset for Screen-based Gaze Estimation [33.0] 画面ベース視線推定のためのマルチビューマルチモーダルデータセットであるAAを提案する。
このデータセットは、固定された8つのスクリーンマウントカメラと2つのサイドビューカメラから、顔の同時観察をキャプチャする。
各サンプルには、多視点顔観察と、構造化された顔領域の作物が含まれており、グローバルとローカルの両方の視覚的手がかりからマルチモーダルな学習を可能にする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:47:09 GMT)
AeroVerse-SatAgent: UAV-Satellite Collaborative Spatial Reasoning Inspired by the Dual Visual Pathway Theory of Cognitive Neuroscience [32.9] 本稿では,UAV-サテライト共同空間推論モデルであるSatAgentを提案する。
SatAgentは衛星とUAVの視点を活用することで、複雑な都市環境で堅牢で正確な推論を可能にする。
大規模なUAV-サテライト共同空間推論データセットであるSatAgent-SR130Kを構築した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:46:23 GMT)
Direction-Magnitude Decomposition for Low-Rank Matrix Optimization: Faster Convergence and Saddle-to-saddle Dynamics [32.9] 本稿では、最適化変数を分解して効率を向上する統合化フレームワークDMDを提案する。
DMDに基づく2つのアプローチを開発し、行列分解の正準問題に対する理論的優位性を確立する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:19:16 GMT)
UniTacVLA: Unified Tactile Understanding and Prediction in Vision Language Action Models [32.9] コンタクトリッチな操作のための統合された触覚学習フレームワークを提案する。
提案手法は,既存手法よりも成功率,操作精度,接触堅牢性を向上することを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:24:00 GMT)
Decompose, Compare, and Decide: Multimodal LLMs are Implicit Few-Shot Learners [32.7] DeCoDeは、既製のMLLMを、追加のトレーニングなしで強力な数発の分類器として機能させる、シンプルで効果的なテクニックである。
我々のアプローチは、ペア画像比較の集合として、少数ショット分類という概念に基づいており、タスクをバイナリ決定の集合に分解する。
以上の結果から,本提案手法は,既成のMLLMを強力な数発学習者へと切り離すことができることがわかった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:00:50 GMT)
DDIAgents: Mechanism-Conditioned Context Flow for Drug-Drug Interaction Prediction [32.7] DDIAgentsは動的知識オーケストレーションを通じてDDI予測を行う機構条件付きマルチエージェントフレームワークである。
DDIAgentsは、推論された相互作用機構にコンテキストフローを適用することにより、無関係な情報を低減し、補完的な専門家の推論をサポートし、解釈可能なエージェントレベルの有理性を生成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:19:33 GMT)
Zero-Shot Quantization for Object Detectors using Off-the-Shelf Generative Models [32.7] GoodQは、既製の生成モデルを使用してトレーニングセットを構築するパイプラインである。
低ビットZSQ(W4A4)における最先端性能を実現し、量子化を極ビット幅に拡張する(W3A3)
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:29:15 GMT)
Human-as-Humanoid: Enabling Zero-Shot Humanoid Learning from Ego-Exo Human Videos with Human-Aligned Embodiments [32.6] ヒト・アス・ヒューマノイド(Humanoid as-Humanoid)は、ヒトからヒトへのハイDoFヒューマノイドの監視フレームワークである。
大規模な人間のデモンストレーションを、対象のヒューマノイドに対する実行可能な観察-アクション監視に変換する。
Humanoidは、データ収集分析において、ヒューマノイド遠隔操作よりも4.8--7.2倍の生のデモンストレーション言語ゲインが得られる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:44:16 GMT)
ADAPT: Attention Dynamics Alignment with Preference Tuning for Faithful MLLMs [32.5] マルチモーダル大言語モデル(MLLM)は幻覚によって著しく妨げられている。
幻覚の内的署名として,テキスト・ツー・イメージ・クロス・アテンションの段階的劣化を同定する。
本稿では,テキスト・ツー・イメージ・クロスアテンション・ダイナミクスに直接介入するアテンションベースのフレームワークであるADAPTを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:46:10 GMT)
CryoACE: An Atom-centric Framework for Accurate and Automated Model Building in Cryo-EM [32.1] CryoACEは、均一構造と不均一構造の両方に対して正確な原子グラフを再構築するエンドツーエンドのフレームワークである。
CryoACEは、均一構造と不均一構造の両方に対して正確な原子グラフを再構成するエンドツーエンドのフレームワークである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:33:38 GMT)
UniSAE: Unified Speech Attribute Editing on Speaker, Emotion and Low-Level Content via Discrete Phonetic Posteriorgram Modelling [31.8] 音声編集は、残音声を保存しながら、発話の特定の部分を変更することを目的としている。
サブ音素から単語レベルまでの構成可能な話者・感情・コンテンツ編集をサポートする統一音声属性編集フレームワークUniSAEを提案する。
実験により,提案した統合フレームワークは,正確な話者と感情の制御,複数の粒度でのコンテンツ編集,一つのフレームワーク内での3つの属性の共用化をサポートすることが示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:46:45 GMT)
UniTac: A Unified Multimodal Model for Cross-Sensor Tactile Understanding and Generation [31.7] 触覚の理解と生成を目的とした初のUMMであるUniTacを提案する。
UniTacは、触覚プロセスを非接触から接触への移行としてモデル化し、デュアルレベル表現を通じてセンサーとオブジェクト間の物理的相互作用をキャプチャする。
触覚理解のために、UniTacはオブジェクトのプロパティ記述とセンサー識別という2つのタスクを導入し、物理的およびクロスセンサー情報に対する推論を強化する。
触覚生成のための2段階のトレーニングパラダイムを設計し,実際の触覚接触をシミュレートするセンサ・プライア・サンプリング・ストラテジーと組み合わせた。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:25:46 GMT)
ALEE: Any-Language Evaluation of Embeddings via English-Centric Minimal Pairs [31.6] ALEEはSentence Smithを言語横断レベルと段落レベルまで拡張するフレームワークである。
様々な埋め込みモデルと275以上の言語をまたいだ大規模な実証的研究を行う。
ALEEでは、パフォーマンスは言語、テキストの長さ、言語現象によって大きく異なる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:45:17 GMT)
Beyond Her: Safety Dynamics in Role-play AI Companions [31.5] ロールプレイ型AIコンパニオン(RAC)における安全性のダイナミクスについて,2段階の混合手法による検討を行った。
我々は,ユーザの内在的問題,RACが採用する役割的性格,リスク相互作用パターンが共同で安全ダイナミクスを形成することを発見した。
本研究は, 静的な特性ではなく, 動的プロセスとしての安全性をモデル化することの重要性を強調した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:05:43 GMT)
Active Sensing for RIS-Aided Tracking and Power Control: A Hybrid Neuroevolution and Supervised Learning Approach [31.3] 本稿では,リコンフィギュアブル・インテリジェント・サーフェス(RIS)の助けを借りて,電力制限付モバイルユーザのエネルギー効率の高いトラッキングについて検討する。
電力制約されたデバイスのエネルギー収支はローカライゼーション・パイロット・トランスミッションが支配しているため,ユーザに対して,基地局(BS)からの低オーバヘッドフィードバックリンクを導入し,動的アップリンク電力制御を実現する。
本研究は,このアクティブセンシング問題の離散的かつ分散的な性質をナビゲートするために,新しいDual-Agent(DA)ディープラーニングフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:43:28 GMT)
Learning Video Dynamics with Predictive Differentiable Rendering [31.3] 既存の決定論的ビデオ予測モデルは、離散画素空間で動作し、主に画素単位の平均二乗誤差(MSE)に最適化されている。
離散表現と連続表現のギャップを埋める新しいエンドツーエンドビデオ予測パラダイムである予測微分レンダリング(PDR)を提案する。
我々はPDRが既存の手法を一貫して上回り、優れたディテール保存、視覚的忠実度、予測精度を提供することを示した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:36:34 GMT)
PrISM-IQA: Image Quality Assessment Made Practical for Smartphone Photography [31.1] 本稿では,スマートフォン IQA を多問題順序診断問題として再検討する IQA 用の ISP 対応構造化モデルを提案する。
PrISM-IQAは、ISPに関連する各問題に対して、テキストの順序付けされた重大度レベル(欠落、マイナー、深刻、クリティカル)を予測する。
我々は,ISP関連品質問題に53ドルをかけた再構成SPAQベンチマークと,エキスパートアノテート実世界の小規模データセットを用いてPrISM-IQAを評価した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:10:29 GMT)
Calibration, Not Compilation: Detecting and Repairing Misspecified Probabilistic Programs Written by Language Models [31.1] 言語モデルはますます確率的プログラムを書くようになる(NumPyro、Stan、Pyro)
すべてのユニットテストをコンパイルし、実行し、パスするプログラムは、偶数論的に間違っている。
したがって、正しい検証はテストスイートではなく、ベイズワークフロー自身である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:16:39 GMT)
DA-Studio: An Agentic System for End-to-End Data Analysis [30.7] DA-Studioは、エンドツーエンドのデータ分析のための対話型Webベースのデモシステムで、自律的で、サンドボックス化され、検査可能である。
アクション構造化分析バックエンド、サンドボックス実行ワークスペース、タスク設定のためのブラウザインターフェース、ストリームされたアクショントレース、アーティファクトプレビュー、コード編集と再実行、レポートエクスポートを統合している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:45:49 GMT)
Optically Active Single Hole Spin in ZnSe [30.6] ホールスピンは核磁気ノイズから切り離してコヒーレンス時間を延長する経路を提供する。
InSeでは、このポテンシャルを実現することはpドーピングの問題によって制限されている。
我々は、浅いアクセプターに束縛された単一ホールスピンを分離し、アンチバンチで確認し、束縛されたエクシトンを高速(244 pfactors)放射的に再結合することでアクセスする。
基底状態の磁気共鳴とラマン分光により、有効穴は0.7、光線幅は26.7GHzである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:49:57 GMT)
UHD-MFF: Shattering Barriers in Multi-Focus Ultra-High-Definition Image Fusion via Learnable Lookup Tables [30.6] 既存のマルチフォーカス画像融合は、主に低解像度画像に限られている。
大規模な超高解像度多焦点融合データセットであるUHD-MFFデータセットを提案する。
また,超高解像度画像に適したスケール特殊化ルックアップテーブルフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:17:29 GMT)
DigitalCoach: Communication and Grounding Gaps in Human and Agentic Computer Use Coaching [30.0] DigitalCoachは72人の専門家と初心者のコンピュータによるコーチングセッションのデータセットである。
我々はDigitalCoachを使って、最先端のモデルが人間にコンピュータの使い方を教えることができるかどうかを評価する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:18:47 GMT)
What Memory Do GUI Agents Really Need? From Passive Records to Active Task-Driving States [29.9] モバイルGUIエージェントは、ページやアプリケーション間でのタスク関連データの読み込み、更新、再利用を必要とする長い水平タスクに直面している。
既存のメモリメソッドは、メモリを主にパッシブストレージとして扱い、過去の観測を蓄積し、必要に応じて取得する。
本稿では,GUIエージェントメモリをパッシブストレージからアクティブに保守された実行状態に移行するアクティブタスク駆動メモリ(ATMem)を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:01:19 GMT)
RoboTacDex: A Dexterous Visual-Tactile-Action Dataset for Humanoid Manipulation [29.5] RoboTacDexは、ヒューマノイドロボットによって実行される、大規模で、マルチモーダルで多様な操作行動のデータセットである。
一般公開されたヒューマノイドロボットUnitree G1をベースにしたRoboTacDexは、19のタスク、23のスキル、22のオブジェクトとのインタラクションを含む6kの軌道で構成されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:39:29 GMT)
TacGen: Touch Is a Necessary Dimension of Physical-World Representation -- Addressing Tactile Data Scarcity with Scalable Vision-to-Touch Alignment and Generation [28.5] TacGenは、予め特定されたV+Tコントラストアライメントと潜在空間残留MLP V->Tジェネレータを組み合わせることで、触覚データ不足のボトルネックを軽減する。
マッチしたDINOv2のバックボーン、分割、プローブにより、V+Tは質量、密度、硬さ、不確実帯力ラベルでマッチしたVのみを改善する。
ジェネレータは交雑種+0.589に到達し、実際の触覚+0.585は種子間隔内に存在する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:07:03 GMT)
Accelerating Merge with Motion Vector Difference via Filter Difference Analysis for VVenC [28.1] 本稿では,VVenCエンコーダの高速MMVDアルゴリズムを提案する。
提案手法は,MMVD の平均探索比を 21.07% から 11.05% に下げ,高速プリセットで効率・複雑度を 11.79 から 7.10 に下げる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:18:13 GMT)
Addressing Over-Refusal in LLMs with Competing Rewards [28.1] 言語モデルの安全性トレーニングは、しばしば過剰な拒絶を引き起こす。
我々は、安全でない推論自体が有用な探索信号として機能すると主張している。
この行動は、有害な推論を直接操作する攻撃を過度に拒絶し、防御するのに役立ちます。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:38:49 GMT)
SkillSpotter: Pose-Aware Multi-View Skilled Action Detection and Grading in Ego-Exo Videos [28.0] SkillSpotterは3つのタスク固有のモジュールを通じて、熟練したアクションを共同で検出し、評価する、ポーズ対応のマルチビューアーキテクチャである。
SkillSpotterはクラス固有のmAPを12.40から21.82(+76%)に改善し、最高のベースラインよりも55.99%から60.40%の精度で調整する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:43:03 GMT)
Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs [27.7] 本稿では,Loraの専門家を単位スケールのハードセレクションにより凍結推論するフレームワークを提案する。
実験により、ハードルートMoR-LoRAはソフトルート混合基線よりもトレーニング可能なパラメータをかなり少なく必要としながら、専門家の挙動を保っていることが示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:40:38 GMT)
Multimodal and Multiscale Spatial-Temporal Semantic Search and Recommendation with AI Foundation Models [27.5] この研究は、Large Language Models(LLM)やVision-Language Models(VLM)など、AI基盤モデルを活用する新しいフレームワークを提示している。
関連するイベントレポートを自動的にリンクすることで、提案フレームワークは、データキュレーターと一般大衆の両方が、環境変化とその局所的な影響についてより深い洞察を得るのに役立つ。
これらの知見は、空間、時間、スケール、セマンティクスといった重要な地理的概念を統合する多面的かつインテリジェントな分析を通じて、地理情報検索(GIR)を進化させるAI基盤モデルの可能性を強調している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:39:46 GMT)
The Speedup Paradox: Rethinking Inference Speed-Quality Trade-off in Embodied Tasks [27.5] 身体的基礎モデルは、ロボットの一般化とタスクの成功率を改善するために広く利用されている。
TISED(underlineTask-level underlineInference underlineSpeedup underlineEffect underlineDecomposition)を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:26:23 GMT)
One Video, One World: Turning Monocular Video into Physical 4D Scenes [27.4] OVOWは、単一のモノクロビデオから、インテナンスレベルでシミュレーション可能な4Dメッシュシーンを再構築する。
我々は,視覚的忠実度を超えた幾何的正しさ,インスタンス分離,物理的妥当性を指標として,エンファン構造化ビデオから4次元評価のための最初のベンチマークを確立した。
OVOWは、すべてのベースラインの中で最高のレイアウトと幾何学的精度、および最も低い測光的および意味的誤差を達成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:16:21 GMT)
Fleet: Few Shots Lead Effective AI-generated Image Detection [27.0] AI生成画像(AIGI)検出は、実験室のベンチマークから、オープンワールドの敵防衛への重要な移行が行われている。
これらの制限に対処するために、場は「静的一般化」を超えて「動的適応」という新しいパラダイムに拡張すべきだと提案する。
継続的数ショット進化の動的なパラダイムを開拓するフレームワークであるFleetを紹介します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:15:52 GMT)
HealthAgentBench: A Unified Benchmark Suite of Realistic Agentic Healthcare Environments for Challenging Frontier AI Agents [27.0] HealthAgentBenchは7つのカテゴリにまたがる54のエージェント医療タスクスイートで、それぞれ独自の環境を備えている。
各タスクは、エンドツーエンドの臨床ワークフローを複製するように設計されている。
全体的なタスク成功率は低いままであり、スイートの難しさを暗示している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:09:01 GMT)
Spatial Reasoning via Modality Switching Between Language and Symbolic Representation [26.7] 本研究は,マルチホップテキスト・空間的ストーリーを幾何学的モダリティにグラウンド化することで推論が改善するかどうかを考察する。
本稿では,信頼度と複雑性信号に基づいて,空間的ストーリを構造にグラウンドすると性能が向上する確率を推定する切替指標を提案する。
私たちの設定では、自然言語ベースの推論からグリッドベースの表現に切り替えることで、LLMのパフォーマンスを最大42%向上させ、推論結果を形成する上でのモダリティの選択の重要性を強調します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:02:07 GMT)
A Self-Evolving Agentic System for Automated Generation and Execution of Biological Protocols [26.5] ProtoPilotは、ウェットラブ自動化のための自己進化型マルチエージェントシステムである。
レイヤワイドの検証性、マルチエージェントオーケストレーション、およびプロトコルを生成するためのランタイムスキル更新ライブラリが組み込まれている。
これは90.2%、プロトコル・トコードゲートパス89.5%、Opentronsパス88.24%を達成している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:51:13 GMT)
ShopX: A Foundation Model for Intent-to-Item Fulfillment in Agentic Shopping [26.4] ShopXは、意図の理解、実行計画、柔軟なSIDネイティブなアイテムスペース操作を統合する、モデルネイティブなショッピングフレームワークである。
モデルネイティブのフルフィルメントは、特に複雑な要求やあいまいな要求に対して、全体的なフレームワークの振舞いを改善する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:05:28 GMT)
Mesh BDF: Barycentric Dominance Field for 3D Native Mesh Generation [26.2] 自動回帰(AR)モデリングは、最近、ネイティブな3Dメッシュ生成において顕著な進歩を遂げた。
三角メッシュ面上で定義された連続表現として,Barycentric Dominance Field (BDF)を提案する。
BDFは接続を連続的な表面信号に変換し、既存の3D拡散パイプラインへのシームレスな統合を可能にする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:58:29 GMT)
Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing [25.9] 本稿では,200万の高品質な命令整列ビデオ編集ペアを特徴とする大規模データセットを提案する。
タスク境界を基本的な外観編集からマルチタスクや構造操作まで拡張したのは、これが初めてである。
包括的なビデオ編集ベンチマークであるGoku-Benchも提案されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:06:04 GMT)
CoLT: Teaching Multi-Modal Models to Think with Chain of Latent Thoughts [25.9] CoT推論(Chain-of-Thought reasoning)により、複雑な視覚的推論タスクに対処するマルチモーダルな大規模言語モデル(MLLM)が実現された。
我々は,多モーダルモデルに潜在的思考表現の連鎖を通して推論を教える新しいフレームワークであるCoLTを提案する。
テキストCoTメソッドと比較して、CoLTは推論時間を10.1$times$、テキストデコード時間を22.6$times$と明確に削減することができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:24:40 GMT)
Dual-domain fused LSTM modeling for efficient time-dependent reliability analysis [25.8] 時間依存信頼性分析は、不確実性の下での工学システムの長期的な安全性と性能を保証するために不可欠である。
本稿では,2領域融合長短期メモリ(DDF-LSTM)モデルを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:39:47 GMT)
Delta-JEPA: Learning Action-Sensitive World Models via Latent Difference Decoding [25.8] 計画のためのビジュアルワールドモデルを学ぶには、アクションに敏感なコンパクトな潜伏ダイナミクスが必要である。
我々は、遅延差分動作デコーダ(LDAD)を用いて、潜時予測を増強する、エンドツーエンドの復元自由世界モデルであるDelta-JEPAを提案する。
LDADは連続観察間の潜伏変位から実行された動作を再構築する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:08:24 GMT)
SLIM-RL: Risk-Budgeted Random-Masking RL for Diffusion LLMs Without Trajectory Slicing [25.7] 拡散大言語モデル(dLLM)の強化学習は、軌道認識方式に大きく移行している。
このミスマッチは軌道を再構築することなく緩和できることを示す。
SLIM-RLは,各ロールアウトステップのコミットリスクをタウ予算デコーダにバインドし,トレーニングデータの総コミットリスクを低減する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:38:46 GMT)
JacobianAvatar: Temporally Consistent Semi-rigid Avatar Reconstruction from a Monocular Video [25.6] 本研究では, 時間的に安定かつ幾何的にコヒーレントなアバターを生成し, 最先端のアプローチよりも優れていることを示す。
本稿では,制約付きポアソン解法,符号付き距離ベースジャコビアン正規化,変形誘導残流損失の3つの主要成分を紹介する。
提案手法は時間的に安定かつ幾何的にコヒーレントなアバターを生成し,最先端のアプローチよりも優れていることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:22:16 GMT)
AC3S: Adaptive Conditioning for 3D-Aware Synthetic Data Generation [25.4] 適応条件付けにより光リアリズムを保ちながら3次元構造アライメントを強制する拡散型画像生成フレームワークを提案する。
筆者らのフレームワークであるAC3S(Adaptive Conditioning for 3D-Aware Synthetic Data Generation)は、制御ネット条件の強度を動的に調整する自己教師付き視覚プロンプト変調器を導入している。
多様性とセマンティック一貫性をさらに高めるため,我々は,基礎となる幾何学的構造に整合した細部および3D認識プロンプトを構成するマルチエージェント視覚言語モデルフレームワークを開発した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:33:55 GMT)
Absorption-Feature-Guided Distance-Decoupled Estimation and Band Selection for LWIR Hyperspectral Passive Ranging [25.2] 本稿では,LWIR高スペクトル受動域のための吸収誘導距離分離推定・微細化フレームワークを提案する。
ADERは、大気吸収構造への過度な適合を抑制するB-スプライン制御点を持つ放射率を表す。
実環境での実験では、ADERはフルバンドと20バンドの両方の設定でLiDARに一貫性のある空間距離構造を復元する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:35:03 GMT)
Rethinking the Role of Feature Engineering and Learning Strategies in Few-Shot Hidden Emotion Recognition [25.1] 本研究チームは,第4回EI-MIGA-IJCAIチャレンジのトラック3において,テスト精度0.76923で1位となったXInsight Labを開発した。
本稿では,前回のコンペから入賞ソリューションを拡張し,コンパクトなマルチモーダル時間モデリングフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:25:13 GMT)
Robustness of Robotic Manipulation: Foundations and Frontiers [24.7] 人間や動物は身体操作において顕著な頑丈さを示す。
人間のレベルの操作の堅牢性への進歩は、統一的で体系的な理解が欠如していることによって妨げられる。
本稿では, 操作の堅牢性に関する系統的研究について述べる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:13:03 GMT)
Validating Causal Abstraction Metrics on Simulated Complex Systems [24.6] 離散状態空間と連続状態空間の両方にまたがる10の複雑なシステムのベンチマークを導入する。
観察,機能,情報理論,因果関係から抽出された30以上の指標について検討した。
本研究は, 因果的抽象誤差(Causal Abstraction Error, CAE)を, 明示的忠実度テストによる連続的妥当性尺度として導入した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:30:29 GMT)
Bridging the Gap Between Latent and Explicit Reasoning with Looped Transformers [24.5] 言語モデルは典型的には明示的なチェーン・オブ・シント(CoT)を介して推論される
Latent CoTは、モデルの隠された状態において、多段階の推論を実行する代替手段を提供する。
ループトランスフォーマーは、潜伏推論に自然に適合する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:58:53 GMT)
RCL-Mamba: A Dual-domain State Space Model for Measurement-oriented Image Restoration in Rotational Sparse-View Scanning Computed Laminography [24.1] 本稿では,計測指向の2領域状態空間モデル(SSM)に基づく画像復元ネットワークであるRCL-Mambaを提案する。
必要なスキャニングビューを512から64に短縮することにより,再構築品質を損なうことなく,約8倍の検査効率を向上させる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:50:17 GMT)
PiLoT v2: Pixel-to-Orthogonal Map Alignment for Free-view UAV Geo-localization [23.7] 自由視点UAVのジオローカライゼーションのための画素対直交マップ登録にパラダイムをシフトさせる軽量で頑健な進化であるPiLoT v2を提案する。
True Digital Orthophoto Maps (TDOMs) と Digital Surface Models (DSMs) を基準として、PiLoT v2はGPU集約型3Dレンダリングを高効率でCPUフレンドリなマップトリミング操作に置き換える。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:45:16 GMT)
Revisiting Parameter Redundancy in Vision-Language-Action Models: Insights from VLM-to-VLA Adaptation [22.9] Vision-Language-Action(VLA)モデルは、事前訓練されたVision-Language Models(VLM)の強力な表現を統合することで、インボディードインテリジェンスにおいて大きな進歩を遂げた。
現在のパラダイムでは、結果として生じるパフォーマンス劣化を必然的に扱い、効率を回復するために微調整や低ランクの修正に頼っていることが多い。
本稿では、VLAプルーニングが性能回復を効果的にする必要がある場合や、このパラダイムが臨界パラメータの無差別プルーニングを隠蔽している場合、除去されたパラメータが真に冗長であるかどうかを問う。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:10:31 GMT)
SemRF: A Semantic Reference Frame for Residual-Stream Dynamics in Language Models [22.8] SemRFは、残留力学から意味的計測を分離するアンカーベースの形式主義である。
SemRFはアンカーを修正し、それらに対して状態を測定する。
フレームを固定すると、残差計算は深い意味軌道となる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:52:22 GMT)
Nonlinearity-Aware LoRA: Structured Gate Adaptation under Low-Rank Constraints [22.8] ゲート型FFNでは、低ランク残差は投影された特徴だけでなく、どのチャネルが出力に寄与するかを決定する非線形選択重みも変化する。
選択ミスアライメントとしてこの効果を形式化し、自己ゲート活性化の局所的有効同質性に接続する。
2つの軽量なメカニズムを持つトレーニング専用手法NA-LoRAを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:21:51 GMT)
Geometry-Preserving Orthonormal Initialization for Low-Rank Adaptation in RLVR [22.8] 低ランク適応(LoRA)とその変種は、教師付き微調整パラダイムの下で大きな言語モデルのパラメータ効率の良い微調整を可能にする。
2つの構造的なLoRA派生型、PiSSAとMiLoRAは、検証可能な報酬(RLVR)による強化学習の下で標準のLoRAより優れ、訓練不安定性を示すこともある。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:27:54 GMT)
UniCoder: Unified Visual-to-Code Generation via Symbolic Rewards and Reference-Guided Code Optimization [22.6] 2つの新しいメカニズムを統合する統一RLフレームワークであるUniCoderを紹介する。
まず,生成されたコードを個別の視覚属性に解析するために,軽量な補助LCMを用いたtextbfSymbolic Attribute Alignmentを提案する。
第二に、局所最適化から逃れるために、低パフォーマンスなロールアウトグループに地上軌道を動的に注入する戦略である textbfReference-Guided Code Optimization を考案した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:29:48 GMT)
Token-Sparse Medical Multimodal Reasoning via Dual-Stream Reinforcement Learning [22.4] 強化学習(RL)を組み合わせた視覚フィードバックモデル(VLM)は,マルチモーダル推論における顕著な進歩を浮き彫りにする。
グラウンドディング領域外におけるプルーニング視覚トークンは,医学的推論を大幅に向上させる。
本稿では,トークンプルーニングと質問応答を実現するために,双方向ストリームRLフレームワークであるViToSを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:47:30 GMT)
From Materials Database to Materials Bank: Assetizing Data for AI Driven Materials Innovation [22.1] 本稿では,従来のデータベースを超えて機能する付加価値フィルタリング・アセット化レイヤである,産業化指向の材料銀行を提案する。
データベース、AIモデル、自動実験、マルチクレージーアセスメントを密集したクローズドループエコシステムに統合することで、マテリアルバンクはデータから知識、候補、資産、製品への明確な軌道を確立する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:58:52 GMT)
WaterGen: Decoupling Scene and Medium in Underwater Image Generation [22.0] 大規模でリアルで多様な水中画像を生成する方法であるWaterGenを紹介する。
提案手法は水中画像生成を,現実的かつ多様なシーン内容と,正確かつ制御可能な水媒体効果の2つの要因の分離制御として扱う。
我々はWaterGenを利用して、シーン構造に多様性があり、水の影響や擬似ラベルの正確性に富んだ大規模な合成水中データセットを構築します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:19:38 GMT)
WarpHammer: Densifying Scene Warps with 3D Object Priors for Extreme View Synthesis [21.9] 投影条件付き新規ビュー合成(NVS)は、入力ビューをターゲットカメラに明示的に3D再構成する。
WarpHammerを紹介します。これは、ネイティブな3D生成前のオブジェクトを明示的に3D再構成することで、歪んだシーンを拡大するフレームワークです。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:33:46 GMT)
Multistage Defer Trees for Hybrid Interpretability: If at First You Can't Succeed, Tree Again [21.9] 多段階デファーツリー(Multi stage Defer Trees)は、スパース決定木の列であり、それぞれがほとんどのサンプルに対して予測を行う。
我々は、このモデルクラスを、複雑なツリーベースのアンサンブルのパフォーマンスに合わせて訓練し、ほとんどのサンプルを1つまたは少数のスパース決定ツリーにルーティングできることを実証した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:15:00 GMT)
Is Natural Always Appropriate? Investigating Naturalness and Appropriateness Across Different Domains for TTS Evaluation [21.5] 5つの領域にまたがる5つのSOTA TTSシステムの有効性と人間的類似度を測定した。
自然度スコアは、自発性に報いる一方で、様式化されたスピーチをペナルティ化する傾向がある。
TTSの性能は「解決」されていないが、対象領域に依存し、文脈認識による評価が必要であることを実証する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:28:41 GMT)
StateFlow: Dual-State Recurrent Modeling for Long-Horizon Time Series Forecasting [21.3] StateFlowは、VARNNをデュアルステートリカレントバックボーンとして使用して、ルックバックシーケンスから2つの補完的な信号をキャプチャする、リカレント予測フレームワークである。
チャンクベースのデコーダは、これらの軌跡を別々に要約し、それらを将来の地平線にマッピングし、直接多段階予測を行う。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:26:09 GMT)
BP-TTA: Balanced and Prototype-Guided Test-Time Adaptation in Dynamic Scenarios [21.1] Test-Time Adaptation (TTA)は、ソースドメインでトレーニングされたモデルが、分散シフトの下でラベルなしのテストデータにオンラインで適応できるようにする。
最近のTTAメソッドは静的な設定を超えて、連続的なドメインシフトを考慮し始めている。
本稿では,クラス不均衡と連続的なドメインシフト問題に対処するBP-TTA法を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:43:27 GMT)
Beyond the Library: An Agentic Framework for Autoformalizing Research Mathematics [20.9] 大きな言語モデル(LLM)は、人間の検出を避ける微妙なエラーを生成する。
最近の傾向は、汎用LLMがリーンのために明確に調整されたより小さなモデルを上回っていることを示している。
汎用LLMを用いたエージェントオートフォーマル化フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:05:03 GMT)
Making Sense of Touch from the Child's View for Contrastive Learning [20.9] 本研究では,乳児中心のタッチイベントのための構造化符号化システムを提案し,このシステムに基づいて264kの2秒間のタッチイベントのデータセットを生成する。
このデータセットを用いて,触覚によるベビーラーラーニングの性質に関する有望な洞察を明らかにするために,発達段階のモデルを構築した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:50:53 GMT)
Temperature Field Reconstruction of Tungsten Monoblock Divertor on EAST using Physics-aware Neural Operator Transformer [20.9] 本研究では,変圧器温度場の進化を特徴付ける物理対応型ニューラル演算子変換器(PNOT)を提案する。
物理認識の注意を喚起し、クエリポイントを集約する物理認識型ニューラル演算モジュールをさらに開発する。
実験結果から,これらの制約は物理的整合性を保ちながら予測精度を向上させることが示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:33:06 GMT)
TIGER: Taming Identity, Geometry, and Generative Priors for High-Quality Face Video Restoration [20.8] Face Video Restoration (FVR) は、劣化した入力から高忠実な顔映像を復元することを目的としている。
我々はTIGERを提案する。Tyos Identity, Geometry, gEnerative pRiors for high-quality FVR。
TIGERは、アイデンティティの忠実度と時間的安定性の両方において最先端のパフォーマンスを実現し、高品質で効率的でアイデンティティに一貫性のあるFVRを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:40:24 GMT)
What Was That Again? Certified Robustness for Automatic Speech Recognition [20.7] 我々は、認証にインスパイアされたメカニズムを用いることで、WERを大幅に減少させ、リコールを増やし、信頼性とWERのスピアマン相関を低下させることができることを示した。
我々は、トークンの存在と敵の排除の両方を認証するために統計的に富を蓄積する2桁原子監査と、勝利シーケンスを選択するランクベーストーナメントという2つのゲート診断パイプラインを通してこれを達成している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:04:33 GMT)
MR-IQA: A Unified Margin View of Regression and Ranking for Blind Image Quality Assessment [20.4] ブラインド画像品質評価(BIQA)は、回帰とランキングという2つの基本的な学習パラダイムに基づいて構築される。
本研究では, 回帰とランク付けの基盤となるものを再検討し, 両者の相互関係距離, 品質マージンを共通の橋として同定する。
この知見に触発されたMR-IQAは、強化学習(RL)に基づくBIQAのための直接品質マージン最適化フレームワークである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:05:18 GMT)
Dualformer: Efficient Feature Extractor for Complex-valued Blind Communication Signal Analysis [20.4] 本稿では、IQチャネル間のパラメータ共有により、複素数値信号を効率的に活用するデュアルチャネルニューラルネットワーク(DualNN)を提案する。
従来の実数値モデルや複素値モデルとは異なり、DualNNは、複素値信号の実部と虚部を処理するためのネットワークパラメータを共有する、画期的なフレームワークである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:49:01 GMT)
Leveraging Phase Information to Boost Unrolled Network Learning for Image Deblurring [20.4] UPADNetと呼ばれる振幅・位相分解エンジンを開発した。
GoPro、RealBlur、COCOデータセットなどのベンチマーク評価データセットに対する実験では、UPADNetが最先端ネットワークの状態を上回ることが確認されている。
UPADNetの利点は、高ノイズと限られたトレーニングデータ構造においてさらに顕著である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:59:07 GMT)
BlockPilot: Instance-Adaptive Policy Learning for Diffusion-based Speculative Decoding [20.3] 投機的復号化は、ブロックレベルの拡散を通じてフォワードパス毎に複数のトークンを生成することで並列性を改善する。
既存の手法では、固定された推論ブロックサイズを採用し、全ての入力に対して最適なデコード戦略を仮定する。
最適なブロックサイズがサンプルによって異なり、投機的復号性能において重要な役割を果たすため、この仮定は準最適であることを示す。
プリフィル表現から最適なブロックサイズを予測する,サンプル適応型ポリシであるBlockPilotを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:24:05 GMT)
TerraDiT-$Ω$: Unified Spatial Control for Satellite Image Synthesis with Any Geospatial Primitive [19.7] TerraDiT-$は、任意のネイティブプリミティブから直接衛星画像を生成する統合空間制御フレームワークである。
生成モデルは驚くべき進歩を遂げているが、衛星画像に適用することは依然として困難である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:56:41 GMT)
Distortion-Corrected Diffusion MRI Using Rotated-View EPI and Joint Field-Map/Image Estimation with Gaussian Primitives [19.6] Echo Planar Imaging (EPI) は拡散と機能的ニューロイメージングの標準的な取得技術である。
EPI補正法は、まず並列画像を用いて歪んだ画像を再構成し、次にB0フィールドを推定し、画像領域の歪みを補正する。
k空間データから直接B0フィールドと歪みのない画像を共同で推定する物理インフォームド・フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:33:19 GMT)
Agentic RAG-VLM: Affordance-Aware Retrieval-Augmented Generation with Self-Reflective Planning for Robotic Grasping [19.6] 本稿では,VLMをベースとした意味理解と,物理的に基盤とした把握実行をブリッジする統合フレームワークであるAgentic RAG-VLMを提案する。
RAG-VLMは、検索拡張生成(RAG)と視覚言語モデル(VLM)とエージェント的自己反射計画を統合している。
RAG-VLMは全体の78.3%を達成し、VLMのみのベースラインよりも53.3ポイントの絶対的なゲインを得た。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:30:22 GMT)
MAGE: View-guided Point Cloud Completion with Efficient Modality Alignment and Adaptive Geometry Enhancement [19.4] ビューベースのポイントクラウド補完は、部分的なポイントクラウドから完全な3D形状を復元することを目的としており、単一のビューイメージでガイドされている。
既存のアプローチは、弱いモダリティアライメントと限られた自己幾何学的拡張のために、しばしば限られたパフォーマンスに悩まされる。
本稿では,効率的なモダリティアライメントと適応的幾何拡張を統合した統合幾何認識フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:25:29 GMT)
FARS: A Fully Automated Research System Deployed at Scale [19.4] 完全自動化AI研究システムであるFARS(Fully Automated Research System)について述べる。
FARSは、アイデア、計画、実験、執筆を通じて、自律的にプロジェクトを生成し、推進する。
FARSの最初の公開デプロイメントでは、67のきめ細かいAI/MLトピックにまたがる166の完全な研究論文が作成された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:30:24 GMT)
Scenario Generation for Testing of Autonomous Driving Systems Using Real-World Failure Records [19.3] 本稿では,歴史的記録から利用できる分類的・文脈的情報を用いた自然言語形式でのシナリオ生成パイプラインを提案する。
そこで我々は,メタドライブシミュレータ上で自律ナビゲーションをテストするためのシナリオを多種多様に生成するために,本手法をうまく適用した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:56:25 GMT)
CasaMaestro: Multi-View Panoramas for House-Scale 3D Reconstruction [19.3] カサマエストロ(CasaMaestro)は、20から50個のパノラマを入力として行うことができるフィードフォワードモデルである。
実験により、CasaMaestroは現実世界と合成シーンの両方で、高品質な結果を確実に提供できることが示されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:21:57 GMT)
FastDSAC: Enhancing Policy Plasticity via Constrained Exploration for Scalable Humanoid Locomotion [19.3] FastDSACは並列サンプリングシナリオのための分散アクター・クライブアルゴリズムの高速かつ高性能な変種である。
我々は、FastDSACがトレーニングプロセス全体を安定化し、最先端のベースラインに比べて優れた性能と高速な収束を実現することを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:04:26 GMT)
DrivingDepth: Sparse-Prompted Pixel-wise Scale Correction for Driving Depth Estimation [19.2] 既存のスパースプロンプト法は、基礎モデルのコヒーレントな幾何学を覆い、スクラッチから深さを再生することでLiDARを組み込む。
本稿では,スパルスLiDARを幾何学的プロンプトとして扱い,静止画素のスケール補正に先立って凍結基盤を局所的に校正するドライビングDepthを提案する。
4フレームのサラウンドビュー入力を持つnuSceneでは、DrivingDepthはAbsRelが11.19、EdgeCRが5.741、MapAnything(11.99/1.914)が11.99/1.914に勝っている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:07:23 GMT)
Inverse-squeezing receivers for squeezed-state pulse-position modulation under ideal and phase-diffusion conditions [19.0] Inverse-squeezing Conditional pulse-nulling (IS-CPN) 受信機を提案する。
IS-CPNは同じエネルギー制約下で従来のCPNよりも優れた性能を示す。
これらの結果は、圧縮状態変調と逆スクイーズ条件のNullingを組み合わせることで光子効率の高い光通信を向上できることを示した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:53:30 GMT)
RareDxR1: Autonomous Medical Reasoning for Rare Disease Diagnosis Beyond Human Annotation [18.8] オープンドメインレア疾患診断のための大規模言語モデルであるRareDxR1を紹介する。
我々は,知識の内在化と自律的進化学習を融合させ,構造化表現型と閉集合決定への依存を回避した。
実験の結果、RareDxR1は様々なベンチマークで最先端の精度を達成し、オープンドメインのまれな疾患診断において重要なブレークスルーとなった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:25:53 GMT)
AutoTrainess: Teaching Language Models to Improve Language Models Autonomously [18.7] 訓練言語モデル(LM)は、非常に人間中心のプロセスである。
本稿では、これらの操作を、計画、データ準備、トレーニング、評価、ロギングのためのエージェント・コンピュータ・インタフェースのリポジトリとして公開するLMエージェントであるAutoTrainessを紹介する。
PostBenchでは、AutoTrainessはCLIのみのベースラインを一貫して上回り、GPT-5.4 (Codex)で26.94点、CLIのみでは23.21点を記録した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:09:51 GMT)
What Counts as an Error? Dual-Reference Benchmarking for Atypical ASR [18.6] 我々は,非定型発声音声に対する動詞と意図的参照を用いて,エンコーダ・デコーダ,CTC,トランスデューサの11種類のASRモデルをベンチマークした。
定量的評価は,2つの書き起こしスタイルを用いて,モデル性能とランキングの相違を浮き彫りにする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:15:39 GMT)
Maximizing Parallel Execution of Series-Parallel Task Graphs for Safety-Critical Embedded Control [18.6] 安全クリティカルな組込み制御プログラムは、境界期間内に各制御サイクルを完了する必要がある。
従来のプロセッサ上でのシーケンス実行は、プログラムの依存関係構造が同時に実行できるサブタスクを含む場合、ボトルネックとなる可能性がある。
本稿では,列並列タスクグラフの最大並列実行問題について検討する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:58:04 GMT)
CooperScene: Multi-Modal Cooperative Autonomy Benchmark with C-V2X Communication Characterization [18.5] CooperSceneは、現実世界のC-V2X通信特性を特徴付ける高忠実な協調的自律性データセットである。
3台のコネクテッド・自動運転車(CAV)と1台のインフラストラクチャ・ロードサイド・ユニット(RSU)を含むシーン。
すべてのシーンは、59Kフレームで合計344Kオブジェクトからなる10Hzで、グローバルに一貫した3Dラベルで注釈付けされている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:57:27 GMT)
The Universal Language of CSI:Unifying Wireless Sensing Across Devices and Environments [18.4] Channel State Informationに基づくWiFiセンシングは、ユビキタスでデバイスなしの知覚を約束する。
現在の研究は、孤立したサイロに分解されたバベルの塔に閉じ込められている。
本稿では,CSIを学習可能な普遍文法を持つ構造化言語として扱う基盤モデルフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:30:04 GMT)
Room for Error: Large-Scale Simulation of Over-the-Air Acoustic Attacks [18.3] 本稿では,Whisper と wav2vec で単語誤り率の相対値が94.5%まで上昇することを示す。
このことは、音響環境を抽象化するよりもむしろ受け入れる、繰り返し検証可能な研究の基盤となる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:02:08 GMT)
TactX: Learning Shared Tactile Representations Across Diverse Sensors [18.1] 本稿では,センサ間の触覚表現を伝達可能なフレームワークであるTactXを提案する。
TactXは、対の接触データに基づいて訓練されたモダリティ固有のエンコーダを通して、異質な触覚観測を共有潜在空間にマッピングする。
実験によると、TactXはオブジェクトレベルの接触情報を保存しながら、センサー間で触覚表現を調整している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:09:40 GMT)
Bridging Local Observation and Global Simulation in Closed-Loop Traffic Modeling [17.8] ローカル-グローバルなコンテキストミスマッチは、グローバルな観測可能なクローズドループ環境に自動回帰型トラフィックシミュレータがデプロイされたときに発生する。
我々は、自己教師型障害発見と優先誘導テスト時間アライメントにより、このミスマッチを緩和するCRAFTを提案する。
CRAFTは、ベースシミュレータを再訓練することなく、衝突を31.2%減らし、交通違反を33.2%減らした。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:45:34 GMT)
Introduction to Stochastic Differential Equations for Generative Machine Learning: A Variational Perspective [17.8] 常微分方程式と確率微分方程式の使用は、生成機械学習においてかなりの進歩をもたらした。
本稿では、微分方程式を自己完結的かつ非公式に導入し、それらを生成モデリングに利用する枠組みを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:34:16 GMT)
Adaptive Perturbation Selection for Contrastive Audio Decoding [17.6] 大規模な音声言語モデル(LALM)は、しばしば言語先行と音響的証拠をオーバーライドすることによって幻覚を与える。
対照的な復号法(CD)はトレーニングなしの緩和を提供するが、既存の方法はマスキングやノイズのような鈍い摂動に依存している。
対象とする音声摂動の多様なライブラリを評価し,各タスクに対して最適な負の分岐を適応的に選択することで,この設計空間を探索する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:55:22 GMT)
Semantic-Aware Multiple Access via Spatial Redundancy Exploitation for Uplink-Dominant 6G Use Cases [17.5] Uplink-dominant 6Gのユースケースでは、限られた無線リソース上で高ボリュームの視覚データを効率よく送信する必要がある。
本稿では、車両利用者間の重なり合う視野を利用して、冗長なアップリンク送信を減らす意味認識型多重アクセス方式を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:21:33 GMT)
Steal the Patch Size: Adversarially Manipulate Vision-Language Models [17.5] デプロイされた視覚言語モデルのプライベート・ビジョン・トケナイザ構成を復元するブラックボックス・モデルステーリング・アタックを提案する。
このようなリークは,事前処理を意識した転送攻撃や,モデル対象の逆操作を可能にする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:47:35 GMT)
WildProp: Visual Estimation of Wildlife Body Proportions at Scale [17.4] 大規模で制約のない画像リポジトリから直接、野生生物の体比分布を推定する、トレーニング不要のフレームワークWildPropを提示する。
本研究では,ロバストアグリゲーションがキーポイントを緩和し,ポーズノイズを緩和する一方で,ポーズアウェア検索が安定した推定に重要であることを示す。
以上の結果から,ウェブスケール画像の2次元対応を慎重に調整することで,比較およびサブグループ解析に拡張性のある形態素プロキシを提供することが可能であることが示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:38:44 GMT)
Bridging Video Understanding and Generation in a Unified Framework [17.4] ビデオの理解と生成を橋渡しする統合フレームワークであるVegaを提案する。
Vegaは自動回帰(AR)予測とレンダリングを組み合わせたハイブリッドアーキテクチャを採用している。
VegaはVBenchのようなビデオ生成ベンチマークやVideoMMEのようなビデオ理解ベンチマークで高いパフォーマンスを実現している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:29:29 GMT)
Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation [17.3] オラクルルールは未知のアーム条件の結果のばらつきを管理する。
ベイジアン・イン・コンテクストの実験者について紹介する:ベイジアン・レイマン教師を模倣するために訓練されたトランスフォーマー・ポリシー。
教師付き事前学習を用いて,経験的リスク最小化によって,この償却政策を学習できることを実証する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:13:38 GMT)
HSAP: A Hierarchical Sequence-aware Parallelism for Hybrid-Context Generative Models [17.1] 本稿では,集中型テンソル伝達と部分的注意計算の障害を克服する効率的なシーケンス・アウェア並列性アルゴリズムを提案する。
提案アルゴリズムはJITコンパイルを用いてNCCLレベルの全デバイスグループの通信戦略を最適化する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:40:56 GMT)
FedXDS: Leveraging Model Attribution Methods to counteract Data Heterogeneity in Federated Learning [17.0] FedXDSは、クライアント間で選択的に共有すべきデータ要素を正確に識別するために、機能属性技術を利用する最初のアプローチである。
理論的プライバシー保証を提供し、メンバーシップ推論とフィーチャーインバージョン攻撃の両方に対する堅牢性を実証的に実証する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:35:45 GMT)
RaBitQCache: Rotated Binary Quantization for KVCache in Long Context LLM Inference [17.0] 長期コンテキストの大規模言語モデル推論は、巨大なキーバリューキャッシュによって著しくボトルネックとなる。
ランダムに回転するバイナリ量子化を利用する新しいスパースアテンションフレームワークであるRaBitQCacheを提案する。
本稿では,RaBitQCacheが推論を著しく高速化し,メモリI/Oを低減しつつ,生成品質を最先端のベースラインと比較する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:32:14 GMT)
Building a Multimodal Dataset of Academic Paper for Keyword Extraction [16.9] 本研究の目的は,異なるモーダル情報に対するキーワード抽出タスクの性能差と多モーダル情報の融合について検討することである。
論文テキスト,画像テキスト,音声テキストの結合は,学術論文のキーワード抽出性能を効果的に向上させることができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:57:23 GMT)
Horizon3D: Sparse Radar-Camera Fusion for Long-Range 3D Perception in Autonomous Driving [16.9] Horizon3Dは、長距離3Dオブジェクト検出のためのスパースレーダーカメラ融合フレームワークである。
TruckScenesの実験では、Horizon3Dは最先端のレーダーカメラによる3D検出性能を達成している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:36:00 GMT)
TraceLab: Characterizing Coding Agent Workloads for LLM Serving [16.4] 約4300のコーディングエージェントセッションのトレースをリリースし、約35万のLDMステップと43万のツールコールを含む。
我々の分析によると、コーディングエージェントのワークロードは、長い自律ループ、短いアウトプットを持つ長いコンテキスト、多種多様で複雑なツールコール、高いが不完全なプレフィックスキャッシュヒット率を特徴としている。
これらの結果は,低オーバーヘッドツールコール,付加長対応プリフィル,セマンティック対応ツールレイテンシ予測,人体接触ギャップ周辺のKV-cache管理の改善など,サービス提供を最適化する具体的な機会を示唆している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:39:15 GMT)
Triospect: A Three-Dimensional Framework for Robust Statistical AI-Generated Text Detection Against Diverse Attacks [16.2] 既存のAI生成テキスト検出器は、テキスト特性を操作する攻撃に対して脆弱である。
本稿では,テキスト中のコンテンツ(中核概念)と表現(立体的要素)の追加的な視点を用いて,新しいトリオスペクトル検出フレームワークを提案する。
17の攻撃、12のドメイン、および17のソースモデルを含む2つのベンチマークの実験は、Triospectがこれらの攻撃に対して堅牢であることを示している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:02:42 GMT)
Qubit Readout via State-Dependent Radiative Linewidths [16.2] 我々は、線幅符号化された量子非劣化測定チャネルを定式化し、キュービット状態が外部放射振幅に入る。
この散逸チャネルは出力フィールドの状態を$O(t)$でインプリントするのに対して、標準分散読み出しは$O(t2)$で始まる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:55:51 GMT)
LOPA: Enhancing Spoken Language Assessment via Latent Ordinal Prototype Alignment [16.2] マルチモーダル大規模言語モデル(MLLM)は、音声言語アセスメント(SLA)のための有望なパラダイムとして登場した。
本稿では,SLA に潜在順序型アライメント (LOPA) を導入することで,大規模MLLM の必要性を論じる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:19:32 GMT)
Uniform-in-time Propagation-of-Chaos for Stein Variational Gradient Descent [16.0] 連続時間定常変分勾配流れに対する一様時流の伝搬特性について検討した。
分布の幅の広い測度では、有限時間確率の伝搬-カオス推定を最大$N$依存の地平線に組み合わせたカットオフ戦略を導入する。
また、行列値有限ランク核に対する有限次元理論も展開する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:27:39 GMT)
MG-SpaIR: Multi-grade Sparse-guided Implicit Representation for Training-Data-Free Image Restoration [15.9] MG-SpaIRは、単一の観察からクリーンなイメージを復元するためのトレーニングデータのないフレームワークである。
分解能グレードにまたがる再構成を段階的に洗練する多品位粗い残留階層を導入する。
混合劣化ベンチマークの実験は、MG-SpaIRが強いトレーニングデータのないベースラインを一貫して上回ることを示した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:17:37 GMT)
Diffusion-Based Material Regularization for Physics-Based Inverse Rendering [15.8] 多視点画像から物理ベースの3Dアセットを再構築することは、コンピュータグラフィックスとビジョンにおける中核的な問題である。
拡散予測がほぼ一定である表面領域上での最適材料の偏差をペナライズする正規化器を導入する。
本手法は,再現精度と照明品質の両方において,最先端のベースラインを著しく上回っている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:52:06 GMT)
Sparsity-Inducing Divergence Losses for Biometric Verification [15.6] 本稿では,Q-Marginを提案する。
Q-Marginは、マージンのマージンを基準基準(事前確率)に直接エンコードする
我々は,挑戦的なIJB-BとIJB-Cの顔検証ベンチマークにおいて,Q-Marginが競争力や優れた性能を達成できることを実証した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:42:41 GMT)
OpenRCA 2.0: From Outcome Labels to Causal Process Supervision [15.5] 本稿では,因果伝播経路の再構築に既知の介入を活用する段階的ラベリングプロトコルPAVEを紹介する。
PAVEを適用することでOpenRCA 2.0(500インスタンス)が得られる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:12:24 GMT)
Efficient Sim-to-Real Transfer of World-Action Models from Synthetic Priors [15.5] 本研究では, 実世界において, 合成先行から世界行動モデルを訓練し, ゼロショットを展開できるかどうかを考察する。
我々は、広範囲なドメインランダム化を伴うシミュレーション環境を構築し、AnyTaskモーションプランニングパイプラインを使用してデモを生成する。
Franka Robotにゼロショットをデプロイすると、われわれのポリシーは平均的な成功率35%に達する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:49:31 GMT)
No Prompt, No Leaks: A Robust Generative Steganography Framework via Prompt-Free Diffusion [15.4] 生成画像ステガノグラフィーは、秘密情報から直接ステゴ画像を合成し、固有のセキュリティ上の利点を実現する。
潜伏拡散モデル(Latent Diffusion Models)は、テキストプロンプトで秘密潜伏表現を変調する基本的な画像ステガノグラフィーフレームワークとして登場した。
本稿では,より堅牢で信頼性の高いステゴ画像生成を制御するために,スタイルセマンティクスを組み込んだプロンプトフリー拡散画像ステガノグラフィーフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:51:34 GMT)
3D Point World Models: Point Completion Enables More Accurate Dynamics Learning [15.3] 3Dポイントワールドモデル (3DPWM) は、最初に部分点雲を完了し、その完了した3Dシーンで動作条件のダイナミクスを学ぶことによって、完全に3D空間で動作する。
3DPWMは、完成した幾何学の操作により、信頼性の高い長距離ロールアウトとモデルベースプランニングのためのより正確なコスト評価を可能にする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:27:22 GMT)
Relational and Sequential Conformal Inference for Energy Time Series over Graphs via Foundation Models [15.3] 時空間グラフニューラルネットワーク(STGNN)は,最近ポイント予測において高い性能を達成している。
STOIC(Spatial-Temporal Graph Conformal Prediction with In-Context Learning)を提案する。
我々はSTOICを,合成シミュレーション,実環境電気・地域熱ネットワークを含む5種類のベンチマークで評価した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:22:11 GMT)
Lazy-Move Compilation for Neutral-Atom Quantum Computers via a Buffer-Relay Fabric [15.1] BRIDGEは、Data-Stable Gate Execution用のBuffer-Relay Interconnectである。
静的で、コンパイラが管理するバッファリレーファブリックと、それを利用する遅延モードコンパイラを共同設計する。
幾何平均$sim$10$times$ZAPよりも高い全忠実度、$sim$16$times$Enolaより高い。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:38:42 GMT)
Policy Optimization Achieves Data-Dependent Regret Bounds in MDPs with Unknown Transitions [15.1] ポリシー最適化は、一階、二階、パス長境界において、逆数と損失の両方に適応することができる。
我々は,これらの保証を未知の遷移の下で達成する,楽観的な追従型リーダに基づく新しいアルゴリズムを開発した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:54:34 GMT)
Securing the AI Agent: A Unified Framework for Multi-Layer Agent Red Teaming [15.1] AI-Infra-Guardは、単一の観察を取り巻くAIレッドチームを組織する、オープンソースのフレームワークです。
我々はAI-Infra-Guardをオープンソースとしてリリースし、エージェントセキュリティの実践的な基盤として、Emphlayer-paradigmマッチングを実現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:06:56 GMT)
MIRTH: Mutual-Information Reasoning with Temporal Hubs for Vision-Language-Action Agents [15.1] VLAモデルは、Webスケールのデータから物理的なロボット制御へ意味的な知識を伝達するための強力なパラダイムとして登場した。
MIRTHはこれらの課題に対処するために設計された統一されたフレームワークである。
MIRTHは、(1)長期シーンの進化と短期動作の傾向をコンパクトな埋め込みに圧縮するデュアルスケールの時間記憶ハブ、(2)相互情報目的によって最適化された潜在推論トークン、(3)マルチモーダルコンテキストをアクショントラジェクトリと整合させるセマンティックプラン空間、(3)自己回帰生成をベクトル的に置き換えて制御スループットを最大化する並列アクションデコードスキームの3つの重要な革新によって、事前訓練されたVLAバックボーンを増強する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:57:13 GMT)
Mask to Concept: Auto-Promptable SAM3 via Efficient Test-Time Concept Embedding Search for Few-Shot Annotation [15.0] Mask to Concept (M2C) は、SAM3を外部モジュールを使わずに、医療的な小ショットアノテーションに適応する効率的なフレームワークである。
M2Cは、その凍結したアーキテクチャの中で、転送可能な視覚概念を検索する。
医用セグメンテーションのベンチマーク実験により,SOTAの少数ショットセグメンテーション性能と優れたアノテーション効率が得られた。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:03:55 GMT)
Enhancing Oracle Bone Inscription Recognition via Multi-Scale Layer Attention [15.0] Oracle Bone Inscriptions (OBI) は、古代中国の文化を理解する上で重要な役割を担っている。
従来の手法は専門家の知識と手作業による分析に頼っている。
マルチスケール・レイヤ・アテンション(MSLA)は,マルチスケール・レイヤ間の相互作用をモデル化する新しいパラダイムである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:48:05 GMT)
Breaking Failure Cascades: Step-Aware Reinforcement Learning for Medical Multimodal Reasoning [14.9] 早期の推論失敗からのカスケードエラーは、医学的な視覚的質問応答ベンチマークにおいて、誤った予測の主因である。
本稿では,段階的プロセス報酬を組み込んだRLアルゴリズムMRPOを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:35:19 GMT)
When Reranking Hurts: Uncertainty-Based Gating for Few-Shot Reranking [14.9] 通常、検索した例を再列挙するとパフォーマンスが向上すると仮定するショットは少ない。
本稿では,モデルの不確実性に基づいて,いくつかの例を再現するかどうかを判断するemphTraining-Free Gated Re rankを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:24:53 GMT)
MVP-Nav: Multi-layer Value Map Planner Navigator [14.9] MVP-Navは物理認識可能なRGB専用ナビゲーションフレームワークで、知覚、計画、制御を現実の3D世界と整合させる。
高レベルのセマンティック推論と低レベルの物理的制約を統合するために、MVM(Multi-layer Value Map)を導入する。
ゼロショットオブジェクトナビゲーションベンチマークの実験は、MVP-Navが既存のディープフリーメソッドを大幅に上回っていることを示している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:25:47 GMT)
Accelerating Conformal Prediction via Approximate Leave-One-Out [14.7] 我々は、近似的残差推定器(ALO)を組み込むことで、共形予測を加速し、カバー範囲と効率性を確立する。
本研究では,高次元統計学におけるALOクロスバリデーションリスク推定器の整合性解析法について考察した。
我々は,ALOに基づく手法が,ランタイムを大幅に削減しつつ,正確な手法に匹敵するカバレッジと効率を実現することを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:21:48 GMT)
Rethinking Foundation Model Collaboration: Enhancing Specialized Models through Proxy Task Reasoning [14.6] 基礎モデルに拡張されたタスク固有推論フレームワークであるFATを提案する。
FATは構造化予測を専門的な予測、情報空間再構成、基礎モデルプロキシ推論に分解する。
我々はこの原理を視覚言語モデルを用いてProxySelectとしてインスタンス化する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:35:18 GMT)
AETDICE: Unified Framework and Offline Optimization for Nonlinear Multi-Objective RL [14.6] 非線型性は歴史的に非線形MORLの目的を2つの異なるパラダイムに二分岐させた。
AETは一般非線形MORLの原理的基礎を提供する。
AETDICE (AETDICE) は、AETの目的のための抽出可能なオフラインRLアルゴリズムである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:08:46 GMT)
Visual Semantic Entropy: Do Vision Language Models Recognize Visual Ambiguity? [14.5] 視覚言語モデルは、視覚的にあいまいな入力に対して自信ある答えを生じさせ、バイアスのある予測をもたらす。
テキストクエリを固定したまま、画像のみを摂動して近傍の視覚変化を探索する視覚意味エントロピー(VSE)を提案する。
VSEは視覚的曖昧さを効果的に捉え、VLMの不確実性評価のための新しい最先端技術を確立する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:35:20 GMT)
Estimating the concurrence for quantum states via symmetric measurements [14.4] 我々は、対称測定により誘導される収束の低境界を導出した。
我々は関連する不等式予想を解き、これは対称測度に基づく多くの過去の結果が、有意性に基づくものよりも厳密に強いことを示唆する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:54:38 GMT)
Evidence Triangulation for Multimodal Fact-Checking in the Wild [14.3] X-POSE(X-POSE)は、X(旧Twitter)のコミュニティアノテーション付きマルチモーダル投稿のベンチマークである。
また,3つの並列なクロスアテンションストリームを用いた証拠三角測量を行う新しいMFCモデルTRENTを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:59:12 GMT)
LWDrive: Layer-Wise World-Model-Guided Vision-Language Model Planning for Autonomous Driving [14.0] We developed the Layer-Wise World-Model-Guided Driving framework (LWDrive)
LWDriveは、階層的なワールドモデルガイダンスを通じて粗い軌跡を洗練するVLM計画フレームワークである。
実験の結果、LWDriveはNAVSIMベンチマークで92.0、NAVSIM-v2で89.6を記録した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:50:58 GMT)
Exploring the relationship between team institutional composition and novelty in academic papers based on fine-grained knowledge entities [13.9] 本研究では,チーム構成と学術論文の細粒度新規性との関係について検討した。
自然言語処理の分野では、産業機関と学術機関のコラボレーションは、純粋に工業的なコラボレーションよりも、新しい論文を生み出す傾向にある。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:49:34 GMT)
Does Your ViT Still Need U-Net for Segmentation? [13.7] ビジョントランスフォーマー(ViT)は、自己注意を通じて畳み込みネットワークの限られた受容領域を克服する。
大規模プレトレーニングの最近の進歩は、ViTの表現能力を再定義している。
現代のVTバックボーンに基づくエンコーダのみの医療画像セグメンテーションのための重要なアーキテクチャ選択について検討する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:02:12 GMT)
Learning Gaussian Graphical Models from a Glauber Trajectory Without Mixing [13.5] グラウバー力学の単一軌道から$n$変数上の$d$スパースガウス図形モデルの構造を学習する作業について検討する。
このギャップによって部分的に動機づけられた条件付き時間アルゴリズムは、単一グラウバー軌道から軌道長保証を回復する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:07:57 GMT)
Can LLMs Imagine Moral Alternatives Beyond Binary Dilemmas? [13.3] 我々は、物語的ジレンマとAI対応エージェントジレンマにまたがる307のモラルジレンマのデータセットであるMoralAltDatasetを紹介する。
妥協の選択肢は、元の選択肢よりも好まれることがよくあります。
そこで我々は,LLMが生成する代替品の品質を,ペアワイズ選好と専門家による基準を用いて評価した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:49:06 GMT)
Evo-PI: Aligning Medical Reasoning via Evolving Principle-Guided Supervision [13.3] Evo-PIは原則中心の学習フレームワークで、推論の原則を言語に基づく明示的な監視信号として扱う。
医用視覚質問応答におけるEvo-PIを,構造化された視覚的テキスト推論を必要とするハイテイクテストベッドとしてインスタンス化する。
本研究は,MLLMにおける専門家対応推論の学習に,原則指導の進化が,スケーラブルで汎用的なパラダイムを提供することを示唆するものである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:19:26 GMT)
Attend, Transform, or Silence: Operator-Level Visual Skipping for Efficient Multimodal LLM Inference [13.1] 本研究は,解答可視的視点から視覚情報について検討し,解答可視的表現にはほとんど影響を与えず,後期視覚情報更新は大きいままであることを示す。
本稿では,余分な注意,FFN,あるいはその両方を選択的に回避しながら,完全な視覚情報シーケンスを保存する演算子レベルの視覚情報スキッピングフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:08:29 GMT)
Exact Hilbert-space ergodicity from continuous monitoring [13.1] 連続観測された量子多体系におけるヒルベルト空間の正確なエルゴディディディティの出現を報告する。
この結果はヒルベルト空間エルゴディディティの出現のための厳密なメカニズムを確立し、量子デバイスの研究のための実践的な経路を提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:11:34 GMT)
OopsieVerse: A Safety Benchmark with Damage-Aware Simulation for Robot Manipulation [12.8] OOPSIEVERSEは、ダメージ対応家庭操作のための統一的なシミュレーションフレームワークとベンチマークである。
OOPSIEVERSEは、明示的で、物理的に座屈した、そして、タスクに依存しない信号として損傷を与える。
本研究は,安全ロボット操作の系統的,スケーラブルな研究のためのオープンソース基盤であるOOPSIEVERSEの可能性を強調した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:30:05 GMT)
JL1-CC&QA: Extending the JL1-CD Benchmark with Change Captioning and Question Answering [12.7] i)JL1-CC、(i)JL1-QA、(ii)JL1-QA、(ii)8種類の質問に対して20,060の質問応答対を提供する。
JL1-CC&QAは、バイナリ変更マスク、変更キャプション、変更指向のQAを同じイメージセット上で統合するベンチマークとして、コミュニティがマルチ化を進める上で価値のあるリソースになることを期待しています。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:37:25 GMT)
SENSE-VAD: Sentient and Semantic Video Anomaly Detection for Autonomous Driving [12.7] SENSE-VADは、自動運転のための最初の合成ビデオ異常検出ベンチマークである。
個人行動,グループ行動,個人とオブジェクトのインタラクション,サイクリストのインタラクション,車両とエージェント,それぞれにフレーム単位のバイナリラベルをアノテートした。
我々は、最先端のビデオ異常検出基準を評価し、社会的に複雑な異常が相違し、現在未解決の課題であることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:57:50 GMT)
Dual-Informed Vertical Expansion for Multi-Objective Node Selection in Anytime Conflict-Based Search [12.7] 競合ベースサーチ(CBS)はマルチエージェントパス探索(MAPF)の高精度アルゴリズムである
標準的なベストファーストの選択は、拡張ノードを最小化し、最適性証明書を閉じるのに強い。
本稿では,CBSにおける一級設計選択としてノード選択について検討する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:31:23 GMT)
ForgeDrive: Bidirectional Cross-Conditioning for Unified Visual-Action Generation in Autonomous Driving [12.7] 本稿では,ビジュアルアクション・クロスコンディショニングを備えた自動回帰拡散フレームワークForgeDriveを紹介する。
ForgeDriveは、運転シミュレーション、計画、視覚計測を単一のモデルに統合するだけでなく、訓練後の戦略を使わずに既存の強力なプランナーよりも優れています。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:05:48 GMT)
Stabilization Learning: A Paradigm Transition Bridging Control Theory and Machine Learning [12.7] 安定化学習は、制御理論と機械学習を橋渡しする学際パラダイムである。
安定性を第一の目標としており、証明書学習と強化学習を区別している。
本稿では、安定化学習における安定性の2つの主要なカテゴリと、3つの典型的なアプリケーションシナリオについて詳述する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:19:05 GMT)
Learning to Deny: Action Denial in Multimodal Large Language Models [12.6] マルチモーダル大言語モデル(MLLM)は、高速な映像理解を実現し、標準ベンチマークで強力なゼロショットと少数ショット認識を実現している。
しかし、強い文脈的手がかりにもかかわらず、ある活動がいつ起こっていないかを認識することによって、ある行為を否定する能力はほとんど解明されていない。
UCF101-ADはAction-PresenceとAction-Denialの2つのクリップからなるベンチマークで,この容量を否定的に評価する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:16:17 GMT)
SpheRoPE: Zero-Shot Optimization-Free 360 Panorama Generation with Spherical RoPE [12.3] 本研究では,事前学習した拡散変圧器に直接球状前駆体を注入することにより,360パノラマ画像とビデオを生成するフレームワークを提案する。
本稿では,Flux.1,Flux.2,LTX-Videoのバックボーンを用いて,テキストからパノラマまでを一般化し,ベースラインに対する競合性能を実現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:57:04 GMT)
Safe Online Learning via Smooth Safety-Structured Policy Composition [12.2] AutoSafeは、構造化された安全監視と介入を直接アクション生成プロセスに統合する、安全を意識したポリシーアーキテクチャである。
一連の継続的制御ベンチマークにおける実証的な結果は、学習のスムーズさを犠牲にすることなく、強力な安全性の強化を示す。
さらに,物理的なカートポールシステム上でのAutoSafeの有効性を検証し,現実世界における安全なオンライン学習の実践的有効性を強調した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:26:50 GMT)
Wavelet-Optimized Pseudo-3D Accelerated Diffusion Model for Truncated Computed Laminography [12.2] フィールド・オブ・ビュー(FOV)の制限は、必然的に投影されたデータの切り離しにつながる。
既存のディープラーニング手法は厳密なデータ一貫性の制約に欠ける2Dアーキテクチャに依存している。
CLトランケーション再構成(CL-DM)のための新しいウェーブレット最適化擬似3D加速拡散モデルを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:24:57 GMT)
Identifying and Resolving Pitfalls of Knowledge-Based VQA Benchmarks: Auditing, Repairing, and Augmenting [12.0] 知識に基づく視覚質問応答 (KB-VQA) は、視覚言語モデル (VLM) が外部構造的知識を検索、基礎化、理性化できるかどうかを評価することを目的としている。
これらの仮定は既存のKB-VQAベンチマークで体系的に違反していることを示す。
本稿では,(1)回答の導出性と質問の明確さを復元する原則付き監査・修復プロトコル,(2)初期検索と根拠推論に挑戦する視覚的曖昧性を導入する制御された多目的拡張プロトコルを紹介する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:35:30 GMT)
SAMBA: A Scatter-Guided Masked Bidirectional Mamba Foundation Model for SAR Target Recognition [11.9] 合成開口レーダー自動目標認識(SAR ATR)は、地球観測と防衛に重要であるが、実際の展開は、注釈付き訓練データ不足によって制限されている。
我々は,SAR目標解釈のための効率的な自己教師型事前学習基盤モデルSAMBAを提案する。
i) 線形複雑度Mambaエンコーダで計算ボトルネックを緩和する中列クラストークン,(ii) SAR物理先行によって誘導される3階層階層散乱誘導Masked Autoencoder(SG-MAE)マスキング戦略,(iii) 軽量空間Mix特徴相互作用
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:49:40 GMT)
CSTrader: A Testbed for Language-Grounded Trading in a Community-Driven Virtual Asset Market [11.9] 対決ストライク2(CS2)兵器スキンのようなニチェの資産市場は小さく、揮発性であり、コミュニティの議論やプラットフォームルールによって大きく推進されている。
CSTraderは,CS2スキン市場における言語ベーストレーディングのためのマルチエージェントフレームワークである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:40:40 GMT)
DataEvolver: Self-Evolving Multi-Agent Data Construction for Text-Rich Image Generation [11.8] テキストリッチな画像データ構築のためのフレームワークであるDataEvolverを提案する。
Retrieverは候補サンプルを収集し、Verifierは品質スコアと拒絶原因を割り当て、Criticはラウンドレベルのフィードバックをセマンティックフィードバックに要約し、Generatorはターゲット合成を通じてアンダーカバーされた領域を完成させる。
実験によると、DataEvolverは一致したデータ予算の下で、固定データセットベースラインよりも有用なトレーニングデータを生成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:52:22 GMT)
MVDGC: Joint 3D and 2D Multi-view Pedestrian Detection via Dual Geometric Constraints [11.6] 画像ビューにおけるBEV平面上の歩行者位置と2次元境界ボックスを推定する統合フレームワークを提案する。
MVDGCは、BEVと画像ビューの両方で幾何学的コンテキストを受け入れる3D円筒型クエリのエムスパースセットを採用している。
これらのクエリは形状アンカーとして機能し、カメラプロジェクションを使用して静止画像から直接2D特徴を抽出する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:39:38 GMT)
SWE-Router: Routing in Multi-turn Agentic Software Engineering Tasks [11.5] マルチターンエージェントハーネスに埋め込まれた大規模言語モデル(LLM)は、ソフトウェア工学(SWE)を再構築している
しかし、多くの問題が安い修正を認めると、すべてのタスクをフロンティアモデルにルーティングするのは無駄です。
SWEは,探索的なターン数回で安価なモデルを実行し,結果として生じる部分軌道を読み取る,価値に基づく時間的アプローチである。
本稿では,SWEタスクのコスト効率を大幅に向上すると同時に,より強力なモデルの性能の大部分を維持しながら,SWEタスクのコスト効率を大幅に向上させることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:46:26 GMT)
Data-Driven Modeling and Control for Tethered Space Systems with Koopman-Informed Graphs [11.5] テザリング宇宙系は、その高次元、強結合、非線形ダイナミクスのために重要な制御課題を呈する。
グラフニューラルネットワークの局所的トポロジ的先駆体とクープマン作用素の大域的線形進化を統合することにより,構造力学を学習するためのクープマングラフダイナミクス(KGD)フレームワークを提案する。
この表現に基づいて、テザリング宇宙システムのためのKGDに基づくモデル予測制御戦略を開発する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:01:52 GMT)
Look But Don't Touch with Sparse Autoencoders for Unlearning in Diffusion Models [11.4] 概念レベルの操作のための解釈可能なツールとしてスパースオートエンコーダ(SAE)が提案されている。
SAEは拡散モデル活性化のセマンティック概念を確実に検出・ローカライズするが、その潜在空間への直接的介入はしばしば分布外活性化を誘導する。
我々は、SAEアクティベーションを純粋にセマンティック検出器として使用し、ターゲットオブジェクトを含むイメージ領域を特定し、それらのパッチ埋め込みを、それを含まない領域に置き換える。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:09:28 GMT)
Event-based Gaze Control System for Accurate Real-time Spin Estimation in Professional Ball Games [11.2] 球の追跡とスピンの計測をリアルタイムで行うイベントベースアクティブビジョンシステムを提案する。
システムは、高時間分解能と最小モーションボケのためのイベントカメラと、視野にボールを保持するために高速のパン/チルト・ガルバノメーターミラーと、ボールの空間分解能を高めて焦点を合わせるための低照度レンズで構成されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:04:09 GMT)
Dual-Adaptive SAM3: Hierarchical Routing over Low-Rank Expert Layers for Parameter-Efficient Medical Image Segmentation [11.1] 本稿では,高いセグメンテーション精度と極端なパラメータ効率を実現する新しいフレームワークであるDual-Adaptive SAM3(DA-SAM3)を提案する。
私たちの最初の適応はタスク認識であり、最も関係のある専門家をわずかに活性化する動的エキスパートルータ(DER)です。
第2の適応はパラメータ認識です。
専門家(DPE)は、各専門家を共有凍結ベースとして表現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:14:18 GMT)
Energy-Optimal Spatial Iterative Learning within a Virtual Tube [11.1] 本稿では,エネルギー消費を最小化するモデルフリーオンライン反復学習(IL)フレームワークを提案する。
テストケースでは,提案手法はモデルベースIPOPTベンチマークの約50~60倍高速である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:01:06 GMT)
OTCache: Optimal Transport for Geometry-Aware Caching in Diffusion Models [11.1] OTCacheは、キャッシュスケジュール予測による拡散サンプリングを加速するためのトレーニング不要のフレームワークである。
OTCacheは、最先端のキャッシュベースラインよりも、生成の忠実度を一貫して改善することを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:46:54 GMT)
ELMP: Efficient Learning for Motion Planning via Analytical Policy Gradients [10.9] 自己教師型微調整によるデータ効率適応のためのフレームワークELMPを提案する。
これは専門家のデータ生成を急激な問題サンプリングに置き換え、サンプルごとの適応コストを約2桁削減する。
提案手法はミリ秒レベルの推論遅延を維持し,Franka Emika Pandaロボットを用いて検証する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:47:09 GMT)
Training for the Model You Return: Improving Optimization for Iterate-Averaged Language Models [10.7] 多くの現代の言語モデル(LM)パイプラインは、トレーニングパラメータの指数的な移動平均のような平均モデルを返す。
この平均的なパフォーマンスを改善するために、トレーニングをどのように変更すればよいのか?
本稿では, 最適制御問題として, 反復平均推定器の設計を定式化することによって, この問題を考察する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:49:44 GMT)
When Not to Write Memory: Governing False Promotion from Correlated Agent Traces [10.7] 長寿命の言語エージェントは、自身の実行トレースから再利用可能なメモリを書くことが増えています。
重要な安全上の問題は、どのエージェントを覚えるべきかということだが、いつメモリの記述を一切拒否すべきなのか。
我々は、この障害モードをメモリの書き込みパスガバナンス問題として研究する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:27:41 GMT)
Temporal Preservation over Processing: Diagnosing and Designing Spatiotemporal Single-Stage Video Detectors [10.6] テンポラルズ(Temporals)は、時間依存を探索するモデルに依存しない診断フレームワークである。
YOLO-3Dは、YOLO8上に開発されたモジュール式リアルタイム時空検出器である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:44:21 GMT)
Beyond Binary Instrument QA: Probing Instrument Grounding in Music Audio-Language Models [10.4] 音楽音響モデルにおける楽器グラウンド化のためのOpenMICによる診断ベンチマークシークエンスを提案する。
これらの結果から, 単集合精度ではなく, 多軸検定ベンチマークを用いて測定を行う必要があることが示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:39:56 GMT)
Think While You Map: Asynchronous Vision-Language Agents for Incremental 3D Scene Graphs [10.4] Open-vocabulary 3D scene graph method は通常、2つの段階で機能する: 最初は再構成し、次に視覚言語モデルに富む。
本稿では,軽量なオンラインマッピングと重み付きセマンティックリファインメントを同時に行う非同期アーキテクチャを提案する。
本手法は, セマンティックセグメンテーションにおいて, 既存のオープンボキャブラリ3次元シーングラフ法に適合するか, 性能を向上する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:49:21 GMT)
MAPE: Defending Against Transferable Adversarial Attacks Using Multi-Source Adversarial Perturbations Elimination [10.4] 本稿では,多元的逆境摂動除去(MAPE)と呼ばれる深層学習防御手法を提案する。
MAPEは、単一ソース対向摂動除去機構と、事前学習されたモデルの確率的スケジューリングアルゴリズムから構成される。
提案手法は,CIFAR-10では95.1%以上,Mini-ImageNetでは71.5%以上,最先端の性能を示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:08:35 GMT)
Do Not Break the Vessels: Structure-Preserving Mean Flow for Vascular Image Translation [10.2] クロスモーダル翻訳法は主にピクセルレベルの忠実さや視覚的リアリズムを強調する。
トポロジ不変輸送プロセスとして血管画像翻訳を定式化する構造保存平均流(SPMF)フレームワークを提案する。
NIRII-to-2PFとファンドスデータセットの組み合わせによる実験では、最先端の手法よりも一貫した改善が示されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:31:42 GMT)
Nonclassicality of a delayed remote-controlled quantum computing model [10.2] 分散量子コンピューティングは、ほとんどの人が将来量子コンピュータにアクセスする主要な手段になるだろう。
この研究は、量子コンピューティングの実践的なタスクで基礎量子理論を橋渡しする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:57:52 GMT)
Play Like Champions: Counterfactual Feedback Generation in Latent Space [10.1] 本稿では,反ファクトパス生成のためのフレームワークであるLatent Maps of Performanceを紹介する。
我々は23,305のプロトーナメントリプレイでガイド付き変分オートエンコーダモデルを訓練した。
我々は、私たちが採用しているパスフィニング手法にはトレードオフがあり、将来の研究が人間の改善のためのモデルソリューションの開発に集中することを望んでいると結論づける。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:15:34 GMT)
A history of GDPR cookie banner compliance: the roles of publishers, regulators and CMPs [10.1] クッキーバナーのランドスケープは、出版社(ウェブサイト所有者)、規制当局、Consent Management Platforms(CMPs)など、主要なプレイヤーの影響下で進化してきた。
以上の結果から、2018年の2.94%から2024年には30.66%に増加し、"reject all"ボタンを特徴とするウェブサイトのコンプライアンス率が向上したことが示唆された。
今回の調査結果は、EUレベルの規制機関の間で、より均一なコラボレーションとガイダンスの重要性を強調し、分散を減らし、クッキーバナーコンプライアンスを簡素化する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:00:24 GMT)
Reinforcement Learning-Based Control for an Inline Skating Humanoid Robot [10.0] 我々は,従来の足の代わりにインラインスケートを装備するように改造されたヒューマノイドロボットの新たな移動戦略を実現するための強化学習制御ポリシを訓練し,展開する。
私たちのスケート戦略は、人間のモーションデータ、模倣学習、またはキネマティック先行に頼らずに、報酬構造から完全に現れます。
我々の政策は、通常の歩行歩行よりも輸送コストが50%削減されることを実証している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:25:06 GMT)
Additive Causal Construction for Transferable and Reconfigurable Cross-System Learning in Multi-Source Image Fusion [10.0] CSD(Cross-system Disrepancy)とCSE(Cross-system entanglement)は、一般的に核融合プロセス中に発生する。
本稿では,情報融合を2段階に特徴付ける付加的因果構成(ACC)フレームワークを提案する。
我々は,合成データと実世界の医用イメージングタスクについて,系統的な実験を行った。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:00:28 GMT)
Agentic-Ideation: Sample Efficient Agentic Trajectories Synthesis for Scientific Ideation Agents [9.9] 科学的な発見において、理想は重要な役割を担っている。
Agentic-Ideationは、自動軌道合成パイプラインと、科学的思考のために訓練された特殊なエージェントLSMからなる新しいフレームワークである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:07:51 GMT)
Seeing Through the Weights: Privacy Leakage in Scene Coordinate Regression [9.9] SCR(Scene Coordinate Regression)法は、視覚的ローカライゼーションに採用されている。
シーンはネットワークパラメータを通してのみ表現され、画像やマップとして明示的に保存されないため、そのような方法はプライバシ保護であると仮定されることが多い。
本研究では,SCRモデルから学習環境の3次元形状をモデルアクセスの異なるレベルで再構成するクエリベースの攻撃を提案する。
これは、SCR表現が設計によるプライバシ保護であるという文献の主張と直接矛盾しており、そのようなシステムがプライベートまたはセキュリティクリティカルな空間にデプロイされた場合の本当のリスクを明らかにしている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:54:23 GMT)
Continuous-Variable Source-Independent Quantum Random Number Generation with General POVMs [9.8] 連続変数のソース非依存な量子乱数生成器は、半デバイス非依存プロトコルの中で最も高い生成率を提供する。
本稿では, 一般の無限次元の正演算値に適合する厳密なセキュリティ証明フレームワークを提案する。
提案手法を真空および弱コヒーレント状態を用いた光学プラットフォーム上で実験的に検証し,試料当たり1.11ビットの安全なランダム性抽出を実現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:48:49 GMT)
Coherent manipulation of the biphoton generation in cavity-QED system [9.8] 単一原子を有する共振器QED系における自発4波混合によるバイフォトン生成のコヒーレント操作について検討した。
原子はポンプ、カップリング、駆動場によって駆動され、ストークスおよびアンチストークス光子の生成は2つの空洞によって増強される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:39:53 GMT)
MuSViT: A Foundation Vision Model for Sheet Music Representation [9.8] 楽譜表現のための基礎的視覚モデル MuSViT (Music Score Vision Transformer) を紹介する。
MuSViT は IMSLP から970万ページの Masked Autoencoders で事前訓練された ViT エンコーダである。
我々は、フルページおよびスタッフレベルの音楽スコア認識、音楽記号検出、得点難度分類の4つの下流タスクでMuSViTを評価する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:27:12 GMT)
Can Tabular In-Context Learners Generalize to Biomolecular Property Prediction? [9.7] そこで本研究では,タブラル基礎モデルが生体分子予測タスクにおいて強力な性能を発揮することを示す。
それらの性能は、使用する配列や分子表現に強く依存していると結論付けている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:41:52 GMT)
Clinical Harness for Governable Medical AI Skill Ecosystems [9.6] 我々は、臨床AIスキルを定義し、それらを登録し、オーケストレーションし、制約し、監視するランタイムガバナンスアーキテクチャであるCrysical Harnessを提案する。
骨粗しょう症を代表として, 知識駆動型, データ駆動型, 物理強化技術がライフサイクルケアをいかに支援し, 将来の医療機関に支配的な基盤を提供するかを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:18:10 GMT)
TACO: A Test and Check Framework for Robust Pose Graph Optimization [9.6] 我々は,PGOシステムから外れ値のフィルタリングを目的とした,堅牢な最適化フレームワークTACOを提案する。
TACOは、測定値が不整数または外れ値として明示的にモデル化するのではなく、最大一貫した測定値の集合への近似を求める。
我々は,2次元SLAMおよび3次元ビジュアルSLAMデータセットのTACOを,いくつかの最先端手法に対して評価した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:20:52 GMT)
A Filtered Mixture-of-Generators for Fully Synthetic Survival Training [9.6] FoGS (Filtered Mixture-of-Generators for Survival Analysis)は、合成データ構築を生成ではなくサンプル選択として再編成する。
トレーニングオンシンセティックでテストオンリアルな16の公開データセット(C-indexとIBS、$0$100$scale)では、FoGSの収率はC-indexで$2.17$、IBSで$0.67$である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:02:19 GMT)
Visualizing High-Dimensional Graph Embeddings via Informed Multi-View Projections [9.6] 我々は、エッジクロスのための新しい識別可能なサロゲートによって実現された、審美性とメトリクスの可読性を最適化する2次元視点を探索する。
数値実験により、これらの視点は標準の2次元レイアウトより一貫して優れており、これらの指標を最適化するために明示的に設計された手法を超越することさえできることが示された。
シームレスなナビゲーションを通じて複数の候補視点を探索する対話型システムであるDataFlyを紹介する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:28:26 GMT)
TRIAGE: Role-Typed Credit Assignment for Agentic Reinforcement Learning [9.5] エージェント強化学習では、環境に配慮した行動にクレジットを割り当てる必要がある。
標準GRPOは全てのアクショントークンに対する一様優位性として最終検証結果を使用する。
本稿では,ロール型クレジット代入フレームワークであるTRIAGEを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:48:07 GMT)
Revealing Safety-Critical Scenarios for UTM via Transformer [9.5] Unmanned Traffic Management (UTM) は、複数の航空機を遠隔で管理・調整するクラウドベースのプラットフォームである。
潜伏する脆弱性を明らかにするために、最適な失敗を露呈するデモや、明確な報奨信号は存在しない。
本稿では, トランスフォーマーベースのRLアーキテクチャに適したシーケンスモデリング問題として, フレーミングUTM脆弱性発見を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:21:20 GMT)
REDI-Match: Rotation-Equivariant Distillation for Efficient and Robust Dense Matching [9.5] ヴィジョン・ファンデーション・モデル(VFM)は、非常に高度な特徴マッチングを持つが、飛行機内での激しい回転は重要な課題である。
Redi-Matchは、新しいRotation-Equivariant Distillation(REDI)パラダイムによって駆動される効率的なフレームワークである。
現在のSOTAよりも1.9倍高速に動作しながら、SatAstデータセットの13.89%の絶対的なポーズ精度の向上を実現している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:20:12 GMT)
On the Identifiability of Aided Inertial Navigation Under Measurement Delays: A Geometric Approach [9.5] 本研究では,遅延の識別可能性と軌道をパラメータ化する初期ナビゲーション状態について検討する。
我々の幾何学的分析は、以前報告されたよりも大きな非形式的(縮退的)軌跡に対して、遅延測定モデルは連続対称性を持つことを示している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:27:03 GMT)
Mixture-of-Control: State-Aware Fine-Tuning for Transformer-based Models [9.4] 状態ベースファインチューニングは、トランスフォーマーの重量ベース適応の魅力的な代替手段として登場した。
ローカルおよびグローバルな制御信号を統合する軽量な微調整フレームワークであるMixture-of-Control(MoC)を紹介する。
MoCはスパース・ミックス・オブ・エキスパート・プロセスのエキスパートとしてブロックワイズ制御状態を扱い、トランスフォーマーブロック間の効率的な通信を可能にする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:25:37 GMT)
ECHO: Prune to act, trace to learn with selective turn memory in agentic RL [9.4] ECHOは、ソースインデックスによる再構築を通じて、履歴の崩壊とトレース可能な学習に対処する、選択的なターンメモリフレームワークである。
BrowseComp-Plusでは、ECHOの保持精度は43.4%に達し、GRPO(28.9%)とローリングサマーベースラインSUPO(36.1%)を上回っている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:29:58 GMT)
Expecting (Targeted Ads)? Network Analysis of User Health Data Leakage in Fertility Tracking Apps [9.4] Google Play Storeから20のAndroid肥大追跡アプリのコーパスをネットワークベースで測定する。
ユーザの健康データの明示的な漏洩と,高度にターゲットされたコンテキスト広告URLによる暗黙的な漏洩を識別する。
これらの発見は、広範囲にわたるユーザの懸念に対する技術的根拠を提供すると同時に、アプリベースの肥大度追跡のプライバシーへの影響における消費者選択の重要性を浮き彫りにしている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:28:30 GMT)
DinoLink: A Token-Centric Representation Compression Framework for Bandwidth-Constrained Collaborative V2X Perception [9.3] DinoLinkはトークン中心の圧縮フレームワークで、生のピクセルストリーミングを、車両とクラウドの協調推論のための個別のセマンティック通信に置き換える。
提案手法は,制約付きV2Xシナリオにおける高忠実度リモート認識において,DinoLinkをロバストで帯域幅効率のよいものとして実証した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:31:21 GMT)
Lost in the Tail: Addressing Geographic Imbalance in Urban Visual Place Recognition [9.3] 都市規模のビジュアルプレース認識は、ジオタグ付きデータベースとマッチングすることで、クエリ画像の地理的位置を特定することを目的としている。
近年の手法は優れた性能を発揮するが、都市規模データセットに隠された深刻な長尾問題を見落としている。
本研究では,モデルに依存しないプラグインフレームワークであるDis Distribution-Aware Place Recognition (DAPR)を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:33:39 GMT)
Arko-T: A Foundation Model for Text-to-Structured 3D Generation [9.3] 本稿では、自然言語インテントを直接実行可能なパラメトリックCADプログラムにマッピングするテキスト・デザインモデルArko-Tを提案する。
12の指標で7つのフロンティア LLM と比較すると、Arko-T は8点で2点、さらに3点で2点を獲得した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:49:46 GMT)
DriveWeaver: Point-Conditioned Video Inpainting for Controllable Vehicle Insertion in Autonomous Driving Simulation [9.2] DriveWeaverは、自律運転シミュレーションにおける制御可能な車両挿入のための新しいフレームワークである。
我々は、時間的に一貫した車両を生成するために、車両点雲に条件付映像を塗布する。
本手法は,視覚リアリズムと幾何学的整合性において,既存のベースラインよりも優れる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:23:32 GMT)
Correlation-enhanced metrology from scrambling dynamics in a solid-state spin system [9.2] 我々は、固体核スピン系における工学的なカオススクランブルダイナミクスによって数千のスピンを相関付けている。
新たに開発されたスクランブルン理論を利用して、量子フィッシャー情報と位相シフトに対する信号応答の指数的スケーリングを明らかにする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:36:03 GMT)
The Decomposition Is the Fingerprint: Per-Component Identity for Agent Skills [9.1] スキルの各コンポーネントを埋め込み、それをマルチバンクSimHashでビットに投影する、コンパクトで局所性に敏感な指紋を提供する。
私たちの主張の中心は、指紋を部品ごとのトリプル(プロンプトコード、ツール)として保持することが便利である、ということです。
指紋は、4,950対の比較で0.974 95%のROC曲線(AUC)の領域に到達し、近似した埋め込みよりも77倍少ないビットを使用する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:45:33 GMT)
Diffusion-based 4D Trajectory Prediction and Distributed Control for UAV Swarms [9.1] 不確実性を考慮した予測モデル予測制御(DNMPC)と粗大から細大の軌道予測を結合した統合フレームワークを提案する。
提案手法は, 軸方向の運動を予測して計算複雑性を低減する次元分離軌道予測モジュールと, 時間的に相関する動的不確かさを捉える拡散型残留力学改善モジュールの2つの重要な革新を特徴とする。
我々のアプローチは最先端のベースラインを上回り、軌跡追尾誤差をtextbf10-15% まで低減し、複雑な都市・工業におけるsub-textbf0.07,m平均追尾誤差を達成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:26:34 GMT)
Beyond Points: Spherical Distributional Part Prototypes for Interpretable Classification [9.1] プロトタイプベースのニューラルネットワークは、少数のプロトタイプの小さなセットに予測を接地することで、本質的な解釈性を提供することを目的としている。
現代の視覚バックボーンは、通常、各セマンティック部分が実質的なクラス内変動を示す正規化された方向の埋め込み空間で機能する。
超球面上のvon Mises-Fisher成分の混合として各クラスをモデル化する分散部分プロトタイプフレームワークであるvMFProtoを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:35:47 GMT)
Do Machines Struggle Where Humans Do? LLM and Human Comprehension of Obfuscated Code [9.0] 我々は,大規模な言語モデルが,難読化が人間プログラマにもたらす障害モードを共有しているかどうかを評価する。
推論調整モデルでは、経験レベルを越えた人間の難易度パターンと顕著に一致していることが分かる。
その結果,制御フロー平滑化時の性能は状態空間の複雑さに比例して低下することがわかった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:26:46 GMT)
Seeing Through Multiple Views: Parameter-Efficient Fine-Tuning via Selective Neurons for Consistent Radiology Report Generation [9.0] 本稿では,ビュー・コンピテント・レポート生成を支援するパラメータ効率の高いフレームワークであるView-PNDFを紹介した。
ビューPNDFは、(i)特定のビューに応答するニューロンを識別するビュー特異的ニューロン検出モジュール、(ii)これらのニューロンの存在を定量化する検証モジュール、(iii)検出されたニューロンを強化する選択的微調整戦略を含む。
ビュー固有のニューロンのみを更新することにより、View-PNDFは計算コストを削減し、異なるビューにわたって一貫した診断を実現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:48:20 GMT)
Z-1: Efficient Reinforcement Learning for Vision-Language-Action Models [9.0] 本稿では,フローベースVLAモデルのための強化学習(RL)後学習フレームワークZ-1を提案する。
Z-1 は SFT で公開された RoboCasa のデモのみを使用し、24ドルの RoboCasa タスクに対してタスクワイドな Group Relative Policy 戦略を適用している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:46:57 GMT)
Testing Frontier Large Language Models' Physics Literacy in Parallel Physical Worlds [9.0] そこで本研究では,LLMが未知の物理フレームワーク内で理にかなうことができるかどうかを評価するための,監査可能な4段階診断手法を提案する。
この診断には、ロックされた事前登録、ステージ間の新鮮なセッション、デュアルLLM判定、および人間の監査経路が組み合わされている。
クロードオプス4.7、GPT-5.5、ジェミニ3.1 Proの3つの世界はそれぞれ6/15、6/15、0/15である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:52:15 GMT)
Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue [8.9] 共同対話では、共有認識は共有解釈を保証しない。相互理解は相互理解を通じて確立されなければならない。
対話コンテキストと地図情報アクセスを系統的に制御し,視覚言語モデル(VLM)を評価する。
以上の結果から,実際の地図画像の提供により全体の性能は向上するが,モデルが過度に予測されたアライメントにシフトすることが示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:22:48 GMT)
PriorEye: Geospatial Visual Priors for End-to-End Autonomous Driving [8.8] 本稿では,デュアルメモリアーキテクチャと適応メモリゲートを備えたメモリ拡張モジュールを提案する。
このアプローチは、さまざまなエンドツーエンドのベースラインにわたるパフォーマンスを一貫して改善します。
本手法はセンサの破損に対するロバスト性を本質的に向上するが,デュアルメモリ設計は,検索した前処理が信頼できない場合に安全なフォールバックを保証する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:36:48 GMT)
Plan Right, Then Plan Tight: Symbolic RL for Efficient Embodied Reasoning [8.8] 身体的なタスクプランニングは、エージェントに自然言語の命令を物理的なシーンで実行可能なアクションのシーケンスに変換するように要求する。
近年のプロンプトベースおよび強化学習プランナーは、流動的なアクションテキストを生成するが、ターゲットの世界において、生成したプランが有効であるという安価な決定論的チェックは欠落している。
データ構築、検証、報酬設計のための共有インターフェースとして、1つのBDDLが機能することを示します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:37:21 GMT)
From Tensor Buffer to Distributed Memory Hierarchy: A Survey of KV Cache Management for LLM Serving [8.7] この調査は30以上のKV管理システムとフレームワークを分類する。
xは、ローカルページ、非集約パイプ、共有ストア、メモリプール、ハイブリッド層という5つのアーキテクチャのアーカイタイプを明らかにしている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:12:40 GMT)
Auditing Generalization in AI-Generated Video Detection: A Six-Control Protocol and the VidAudit Toolkit [8.7] AI生成ビデオ検出のGenVidBenchとAIGVDBenchが事実上のリーダーボードだ。
ほとんどの評価プロトコルは、報告された一般化を拡大できる制御されていない欠点を残している。
20紙の調査では、これをキャッチする標準的な6つのコントロールをすべて適用していない。
それらを監査プロトコルに組み合わせて、6つの代表的な特徴源に適用する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:29:53 GMT)
HydraCollab: Adaptive Collaborative-Perception for Distributed Autonomous Systems [8.7] 協調知覚により、複数のロボットシステムが知覚情報を共有することで状況認識を高めることができる。
既存のコラボレーティブ・パーセプションシステムは、通信帯域幅要求と知覚精度のトレードオフに直面している。
我々は,認識性能を犠牲にすることなく,通信オーバーヘッドを最小限に抑える適応型協調認識フレームワークHydraCollabを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:16:43 GMT)
Controllable Thouless Pumping Switching Dynamics of Gap Solitons Mediated by Finite Bogoliubov Excitations [8.6] ギャップソリトンは, ほぼ断熱的な傾斜の下で, 有限ボゴリューボフ励起を伴う非線形不安定性を受けることができることがわかった。
このような有限ボゴリューボフ励起はソリトンの粒子損失を誘導し、逆伝播方向をもたらす。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:45:42 GMT)
A Bayesian Filtering Approach for Learning Lagrangian Dynamics from Noisy Measurements [8.6] 本稿では,物理系の力学を,部分的雑音測定から学習するためのベイズフィルタに基づくアプローチを提案する。
ラグランジアンニューラルネットワーク(LNN)と同様に、ニューラルネットワークによる運動エネルギーとポテンシャルエネルギーのパラメータ化を行う。
対応するオイラー・ラグランジュ方程式は系力学を記述する連続時間状態空間モデル(SSM)を生成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:07:57 GMT)
Reasoning-aware Speculative Decoding for Efficient Vision-Language-Action Models in Autonomous Driving [8.5] 自律走行のための現代のビジョン・ランゲージ・アクション(VLA)プランナーは、軌道を発生させる前にチェーン・オブ・カウセーション(CoC)推論ステップを発行する。
我々は、CoC推論が2つの質的に異なるニーズを持っていることを観察する。
まず1次元回転位置埋め込みである textbfFlatRoPE を導入する。
第2に、静的参照とともにアクション品質報酬を使用する後トレーニングステージである textbfAction-aware (AARL) を導入する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:41:25 GMT)
WarpI2I: Image Warping for Image-to-Image Translation [8.4] I2I(Image-to-image)翻訳は人間のリライティングやシーン翻訳などのタスクにおいて大きな成果を上げている。
本稿では,符号化前に空間表現を有意な領域へ再配置する簡易なサリエンシ誘導ワープアンワープフレームワークを提案する。
我々のフレームワークは、時間的安定性に優れたフレーム・バイ・フレームアプリケーションによるビデオに自然に拡張する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:18:31 GMT)
FeatX: Editing Software by Editing Features for Repository-Level Code Evolution [8.2] FeatXはフィーチャを編集してソフトウェアを編集する機能指向ツールである。
認知負荷を著しく低減し、バニラChatGPTと比較してユーザビリティを向上させる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:38:56 GMT)
LeCropFollow: Latent Space Planning for Navigation in Unstructured Crop Fields [7.9] 本稿では,視覚ナビゲーションフレームワークLeCropFollowについて述べる。
その結果,LeCropFollowは非構造行で最先端のベースラインと一致しているが,プランテーションギャップでは著しく優れていた。
これらの結果から,不均一な農業環境下での運用において,潜在計画が幾何的推定に頑健な代替手段となることが示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:47:08 GMT)
AlgoBench: Benchmarking Algorithmic Adaptation in Code Generation [7.8] ALGOBENCHは、既知の競合プログラミング問題から新しいアルゴリズム問題を自動生成するフレームワークである。
ALGOBENCHの変種では性能が急激に低下し、検索によって古いアルゴリズムの再利用が増加し、多くの正しい解が要求される複雑さを満たすことができないことを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:13:12 GMT)
Measuring Graph-to-Graph Semantic Similarity in Knowledge Graphs: An Empirical Evaluation of Knowledge Graph Embeddings [7.8] 知識グラフ(KG)は、事実を構造化三重項として表現し、様々な領域にまたがる関係知識の組織化に広く用いられている。
既存の埋め込み手法は主にエンティティ、リレーション、トリプルに重点を置いており、グラフレベルのセマンティクスはほとんど役に立たない。
構造的類似性だけではKG間の意味的類似性を保証することができないため、構造的パターンに基づいてグラフを比較する従来のグラフレベル手法も不十分である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:10:55 GMT)
Spin-Squeezing-Enhanced Charging for Quantum Dicke Batteries [7.6] 高出力ディック量子電池(QB)は一般に集団超放射能を利用するが、本質的な物質-物質相互作用は伝統的に有害であると考えられている。
本稿では,これらの相互作用を相乗的資源として制御・再利用し,充電能力とキャパシティを向上させるための直観的パラダイムを提案する。
本研究は, 物質相互作用を利用した高感度多体QBの設計のための青写真を提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:05:21 GMT)
CSO-LLM: Class Subspace Orthogonalization for Post-Training Backdoor Detection and Trigger Inversion in LLMs [7.4] バックドア検出とトリガーインバージョンスキームは、画像などに使われるAI向けに開発された。
分類器として扱われるLLMの高効率な検出・逆変換フレームワークを開発した。
検知器の1つのバージョンはトークン埋め込み空間において連続的な最適化を行い、補助的なトリガ反転検出法は離散トークン空間においてグレディ付加を行う。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:19:00 GMT)
MNAR-$k$-means: A $k$-means Clustering for Data Missing Not at Random with Magnitude-Decaying Probability [7.3] 本稿では,命令値の大きさの制約に基づく新しい$k$-meansクラスタリング手法を提案する。
本研究では,提案手法のクラスタ中心から完全に観測されたデータの真のクラスタ中心まで,推定されたクラスタ中心の統計的一貫性を確立する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:31:22 GMT)
A Classifier-Agnostic Zero-Shot Adversarial Attack Detection via CLIP [7.3] 敵対的攻撃は、ディープラーニングモデルの信頼性に挑戦する。
ここでは,CLIPから派生した即時類似度スコアを利用する,完全にブラックボックスのゼロショット攻撃検出フレームワークを提案する。
実験では、$A4D$が攻撃非依存および分類非依存の設定においてSOTA検出結果を達成することを確認した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:10:27 GMT)
Linguistic Bias Mitigation for Spoofing Detection via Gradient Reversal and A Variational Information Bottleneck [7.2] トレーニングデータにおける言語的手がかりへの依存は、データ間の堅牢性を損なう可能性があることを示す。
教師と教師の対人学習を利用した言語的不変なスプーフィング検出フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:36:55 GMT)
JETO-Bench: A Reproducible Benchmark for Execution Time Improvement Patches in Java [7.1] JETO-Mineは、実世界のJavaプロジェクトで、再現可能なETIP(Executive Time Improvement patch)ベンチマークを作成するための、最初の再利用可能なツールです。
JETO-Mineには3フェーズのパイプラインがある。GitHubリポジトリをクロールし、ユーザ定義のフィルタを使用してETIPを識別する静的分析フェーズだ。
JETO-Mineを使ってJETO-Benchを構築します。これは、オープンソースのJavaリポジトリ174から収集された660個のETIPと91個の手動で検証された実行可能ETIPのベンチマークです。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:54:25 GMT)
Fora: From Weight-Space to Function-Space Protection in Capability-Preserving Fine-Tuning [6.9] 我々は、その能力はウェイト行列の特異幾何よりも活性化部分空間によってより忠実に特徴づけられると論じる。
FORAは、重み空間の投影と標準正規化よりも一貫して改善されていることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:28:56 GMT)
Reference-Based Prosody and Rhythm Evaluation for Spoken Dialogue Systems [6.9] 一致した参照規則を$F_$平均、$F_$表現率、音声率、調音率、停止率、平均停止時間で構築する。
次に、パーセンタイルに基づく評価プロトコルを定義し、S2S出力波形から同じ指標を抽出し、最も近い一致したヒト参照層と比較し、パーセンタイル偏差または5番目のパーセンタイル外旗を報告する。
これらのアウトプットは、知覚的およびユーザ中心の評価を置き換えるのではなく、補完する行動的妥当性チェックとして機能する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:46:16 GMT)
Joint Medical Image Enhancement and Segmentation with Diffusion-based Symbiotic Information Interaction [6.9] DiSIINetは、拡張とセグメンテーションは相互に統一されたモデルで強化されるべきという原則に基づいて構築されている。
マルチモーダルな医療データセット(MRI, CT, 超音波)の実験により, DiSIINetは大幅な性能向上を実現していることが示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:50:44 GMT)
Digital signature schemes based on code equivalence and syndrome decoding from restricted errors [6.8] 我々は,NISTの付加署名スキーム要求における2ラウンド候補である誤り訂正符号に基づく2つのディジタル署名スキームについて検討する。
制限されたエラーとコード等価性から,シンドローム復号化の根底にある問題について述べる。
提案手法は,量子後安全と考えられる符号ベースのデジタル署名をどうやって生成するかを説明する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:50:55 GMT)
Surrogate Fidelity: When Can Open LLMs Explain Closed Ones? [6.8] 予測,属性,表現レベルでの代理的忠実度を評価する。
注意パターンや大きさのようなホワイトボックス信号は、モデル間で非常に安定しているが、因果属性の弱い予測しかできない。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:43:44 GMT)
Which Tokens Matter? Adaptive Token Selection for RLVR with the Relative Surprisal Index [6.6] 我々は,政策最適化のダイナミクスを捉えるには,サンプルトークンの確率やエントロピーを単独で評価することは不十分であると主張している。
本稿では,トークンのエントロピーと選択したトークンの確率を自然に結合する原理的情報理論の指標であるRelative Surprisal Index(RSI)を紹介する。
RSIは,ロジト次数ノルムの1次変動と,選択したロジト摂動の下での予測エントロピーの局所比に関係していることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:33:19 GMT)
Dense Structural Priors for Sparse Functional Landmark Localization in Surgical Videos [6.6] SAM 3のような視覚基盤モデルは、様々な手術ビデオ条件で伝達可能なオブジェクトレベル構造を提供することができる。
本稿では,SAM 3 を先行構造として用いる軽量化フレームワークを提案する。
粗いマルチフレームネットワークは、先端とアンカーのプロンプトを予測する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:50:46 GMT)
A Lifecycle and Application-Stack Survey of Large Language Model Vulnerabilities: Attacks, Risks, Defenses, and Open Problems [6.6] 本稿では,ライフサイクルとアプリケーションスタックレンズを用いて,大規模言語モデルシステムの脆弱性に関する文献を体系化する。
我々は攻撃能力、影響のあるセキュリティ目標、代表的攻撃、実践的リスク、評価プラクティス、防衛を解析する。
我々は,LLMシステムのセキュア化に関する研究課題に近づき,構成セキュリティ,実績認識検索,ツールコール封じ込め,長期エージェント評価,プライバシ保護適応,リアルなレッドチーム化,デプロイメントグレードのインシデント対応などについて述べる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:21:43 GMT)
GaussianMap: Learning Gaussian Representation for Multi-Sensor Online HD Map Construction [6.5] 本稿では,周辺環境の適応的なガウス表現を学習するオンラインHDマップ構築フレームワークを提案する。
GustafMapは、カメラオンリーとカメラ-LiDAR融合設定の両方で最先端のパフォーマンスを達成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:08:42 GMT)
CodeChat-Eval: Evaluating Large Language Models in Multi-Turn Code Refinement Dialogues [6.5] 大規模言語モデル(LLM)は、コードの生成と洗練のために、ソフトウェア工学でますます使われています。
既存のベンチマークでは、このマルチターンコードリファインメントダイアログ設定が省略されるのが一般的である。
マルチターンコードリファインメント対話から評価セッションを構築する評価フレームワークであるCodeChat-Evalを紹介する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:52:08 GMT)
Expected Gain-based Escalation in Vertical Federated Learning [6.4] 協調推論はエージェント間で補完情報を統合することにより予測性能を向上させることができる。
すべてのサンプルにコラボレーティブフュージョンを適用することは、不要な通信と計算オーバーヘッドを引き起こす可能性がある。
2ラウンドのVFL推論プロトコルにおける選択的エスカレーションについて検討する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:32:53 GMT)
CORA: Per-Slice Coherent Orthogonal Rotation for SVD-based Low-Rank Adaptation [6.4] 安定な微調整はコヒーレントSVD回転に続くことを示す。
CORAは、常識推論とコード生成でLoRA、DoRA、PiSSA、MiLoRAを上回っている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:00:47 GMT)
Quantum Variational Approaches to the Maximum Independent Set Problem at Utility Scale [6.4] 最大独立集合(MIS)問題に対する変分量子アルゴリズムを64,99,180頂点のベンチマークグラフ上で検討する。
新しい構成により、複数のシードを同時に量子並列変動探索することができ、単一シードのメソッドが失敗する正確なMISを発見することができる。
IBM Quantumハードウェア ibm_marrakesh のハードウェア検証では、収束したシミュレータパラメータがノイズの多い量子実行に効果的に転送されることを確認した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:57:13 GMT)
Intrinsically Stable Spiking Neural Networks: Overcoming the Performance Barrier in the Absence of Batch Normalization [6.4] 本研究では、信号ホメオスタシスを強制することによって活性化正規化層を除去するIntrinsically Staable SNNアーキテクチャを提案する。
標準化操作をオフラインで静的な重みに折り畳むことで、IS-SNNはアクティベーション正規化によって導入された実行時統計の追跡と乗算を取り除く。
実験の結果,IS-SNN は計算コストの高い BN 技術と競合するか,あるいは性能に優れていることが示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:07:21 GMT)
FormIDEAble: Safe and Socially-aware Autonomous Systems [6.4] 本稿では,社会に配慮した協調戦略と安全保証の形式的アプローチであるFormIDEAbleを紹介する。
人間と自律エージェントの協調は、プライスド・タイムド・マルコフ決定プロセスとしてモデル化されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:30:49 GMT)
From Failure to Alignment: A Requirements Engineering Framework for Machine Learning Systems [6.3] 本稿では,要求工学的アプローチを採用することにより,利害関係者のニーズに合致する機械学習システムの開発を支援する枠組みを提案する。
本稿では、自律運転の例を用いて提案フレームワークを実証し、REALが利害関係者の要求に適合するMLSの開発を支援することを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:41:16 GMT)
Relativistic Gravity-Induced Entanglement via Frame Dragging [6.2] 本研究では, フレームドラッグにより生じる重力誘起絡みについて, 干渉計による検討を行った。
我々は、源質量の自由度と粒子の経路の間の絡み合い位相を計算する。
結果として生じる絡み合いは、重力相互作用の非古典性を示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:55:26 GMT)
RCT: A Robot-Collected Touch-Vision-Language Dataset for Tactile Generalization [6.2] RCT(Robotic Contact Tactile、ロボット接触触覚)は、122の産業用基準材料上のロボットプレスから29,279個の触覚フレームを持つ、タッチビジョンのデータセットである。
RCTは、各プレスを接触シーケンスとして保存し、材料、カテゴリ、センサー、接触位置、接触シーケンスのホールドアウト評価を可能にする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:05:33 GMT)
Distributed Multi Robot Lunar Cargo Transportation via Phase Decomposed Reinforcement Learning [6.0] 本稿では,分散ロボットユニットを用いた協調貨物輸送のための位相分解型強化学習フレームワークを提案する。
このフレームワークは、JAXA宇宙探査試験施設における、シミュレーションおよび制御されたフィールド実験により評価される。
その結果, シミュレーションおよびハードウェア実験において, 全段階にわたる信頼性の高い協調輸送が示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:36:03 GMT)
Beyond But-for Test: Counterfactual Explanation in Abstract Argumentation via Actual Causality (Extended Version) [6.0] 抽象的議論において、介入に基づく対実的推論の枠組みを導入する。
提案手法は,プリエンプションやオーバーデミネーションなどの議論構造における原因を正確に同定する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:13:02 GMT)
AICID: Unique Identifiers for AI Scientists [5.9] 学術データベース、引用インデックス、ジャーナル提出システムにおいて、AI科学者と人間を区別する標準的なメカニズムは存在しない。
この白書は,問題を定義し,学術コミュニケーションの完全性に対する結果を分析し,AICIDを提案する。
AICIDは人間以外のコントリビュータ向けにモデル化されているが、AIIDは各AI作者をモデルID、バージョン、オペレーターにリンクする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:30:12 GMT)
Certified Speculative Execution for Untrusted AI Agents [5.9] Certificate-Gated Prefix Acceptance (CGPA)は、信頼できないAIエージェントの投機的実行契約である。
デプロイメントスケールの単位コミットインスタンスでは、凍結した8B LLMを2.96x/1エピソードのウォールクロックのスピードアップに2.1%の後悔で変換し、ドメイン(1.79x)と安全なリリーディング・ホライゾンベースライン(1.07x)を上回ります。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:45:56 GMT)
Cross-Domain Feature Expansion for Tabular Medical Data via Knowledge Graphs Injection [5.8] MedKGTabは医療データのクロスドメイン機能拡張に特化して開発された知識注入型フレームワークである。
MedKGTabは行列の二重アテンション機構を用いることで、生の構造化データを直接操作する。
MedKGTabはSPOKEのバイオメディカル知識グラフとデータ駆動統計を統合し、データと知識チャネルの最適な相乗効果を達成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:01:54 GMT)
Understanding Domain-Aware Distribution Alignment in Budgeted Entity Matching [5.7] 低リソース・ドメイン対応EM-BEACONの最先端手法について検討する。
我々は,その性能がアルゴリズムの選択やデータ可用性の条件によってどのように影響を受けるかを検討する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:07:52 GMT)
A Multi-Dimensional, Per-Pass Empirical Study of the LLVM Optimization Pipeline [5.6] LLVM-O3最適化パイプラインについて,系統的,実証的研究を行った。
実行時間,コンパイル時間,バイナリサイズ,ハードウェアカウンタ,RAPLエネルギーを84,750回測定した。
これらの発見により、より詳細なパスプルーニング、コストモデルキャリブレーション、オートチューニングが可能になる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:10:48 GMT)
Mutating the "Immutable": A Large-Scale Study of Git Tag Alterations [5.6] 意図した不変性にもかかわらず、Gitタグは削除や強制更新による修正によって変更することができる。
公法におけるタグ変更に関する大規模な実証的研究を初めて行った。
ビルドシステムとパッケージマネージャがコミットハッシュへの依存関係をピン留めし、開発フォージがタグ変更監査ログを公開し、コミュニティが標準のサプライチェーンセキュリティプラクティスとしてタグ変更の体系的な監視を採用することを推奨します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:50:52 GMT)
A Synthetic-Driven Vision System for Assembly Step Recognition [5.6] 本稿では,現実的なアセンブリシーケンスを自動的に生成し,さらにリアルタイム検査モデルを訓練するシステムを提案する。
1時間以内に特定のタスクに効率よく適用でき、CADモデルと単純なステップ記述しか必要としない。
システム全体としては,高価な実世界のデータ収集やアノテーションを必要とせずに,産業用組立検査のための実用的なソリューションを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:08:47 GMT)
Benchmarking Federated Learning and Knowledge Distillation for Point Cloud Classification [5.6] 本稿では,3次元点雲分類のための連成学習(FL)と知識蒸留(KD)を併用して評価する。
13のFLアルゴリズムと10のKD目標(130対のクロスプロダクト)を504のトレーニング実行に当てはめ、ModelNet40と臨床クラニオシノスタシスデータセットで評価されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:12:27 GMT)
Domain-Decomposed Randomized Neural Networks for Partial Differential Equations in Unbounded Domains [5.4] 非有界領域上の偏微分方程式は、外界領域は過剰なトラニケート誤差を伴わずに表わさなければならないため、困難である。
このような問題に対するドメイン分割型ランダム化ニューラルネットワークフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:41:54 GMT)
Teaching LLMs String Matching, Backtracking, and Error Recovery to Deduce Bases and Truth Tables for the Combinatorially Exploding Bit Manipulation Puzzles [5.4] 本稿では,NVIDIA Nemotron Model Reasoning Challengeにおけるアルゴリズムの革新について述べる。
目的は、入力バイナリ文字列を出力に変換する隠された論理規則を発見し、未知の入力に適用することである。
本稿では,文字列類似性,構造化探索,自動誤り回復に完全に有利な算術論理を放棄する手法を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:52:56 GMT)
A forgery attack on the Block.co blockchain-based digital credential certification system [5.3] Block.coには,システムによって有効と認識される偽造証明書の生成を可能にする脆弱性がある。
我々の攻撃は、同じアプローチを採用する他のシステムにも拡張可能である可能性が高い。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:42:26 GMT)
SemiScope: Disentangling Classifier Tuning and Joint Optimization in Semi-Supervised Security Classification [5.3] 半教師付き学習(SSL)は小さなラベル付きプールから大きなラベル付きプールへとラベルを伝播する。
最近の研究報告では、共同検索、AutoML、コンポーネントごとのチューニングを通じてSSLパイプラインを最適化することで、大幅な向上が報告されている。
私たちはSemiScopeを分析機器として開発していますが、デプロイメントの推奨ではありません。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:50:18 GMT)
TRIE: An Evaluation Framework for Stochastic PDE Surrogates [5.2] PDEサロゲートの評価フレームワークTRIEを紹介する。
モデルが不変測度を再現し、信頼できる予測の不確実性を提供し、効率的な生成にスケールするかを問う。
自動次元発見を伴う潜在生成モデルは,コルモゴロフ推定時間を約12倍に抑えながら,この統計的忠実度の多くを保っていることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:20:37 GMT)
BLUEX v2: Benchmarking LLMs on Open-Ended Questions from Brazilian University Entrance Exams [5.2] ブラジルの2つの主要な大学の第2段階の入学試験から得られたベンチマークであるBLUEX v2を紹介する。
我々のデータセットは、395の質問を919のグレードのサブクエストに展開し、55.7%の質問が関連画像を含んでいる。
その結果、モデルにまたがる4.92ポイントのパフォーマンスが明らかになり、数学的推論と画像理解が最も難しい能力の次元として現れる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:58:36 GMT)
Device Passport: Enabling Spatio-Temporal Pretrained Models to Generalize Across Input Layouts [5.2] 本研究では,下流の復号化レイアウトと事前学習における異なるチャネル埋め込み手法の振る舞いについて検討する。
本稿では,各チャネルの機能的アクティビティとメタデータを入力として利用する専門家と混合モデルを学ぶ,新しいチャネル埋め込み技術であるDevice Passportを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:58:09 GMT)
Localized Conformal Prediction for Image Classification with Vision-Language Models [5.2] テスト時間とキャリブレーションの視覚的特徴のコサイン類似性は局所的でないベースラインよりも改善するには不十分である。
本稿では,余弦的類似性の単純な非線形変換を提案する。これは限界被覆保証を保存し,統計的に有意な平均セットサイズ削減を実現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:34:40 GMT)
Exploring Side-Channel Protections in Hardware Implementations of PQC ML-KEM Verification [5.2] ML-KEMはポスト量子暗号規格として採用されている。
藤崎・岡本(FO)検証のカプセル化は, サイドチャネル電力と電磁的(EM)解析に弱い。
本稿では,FPGAベースの実装に注目し,そのサイドチャネル脆弱性について検討する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:57:33 GMT)
PolicyGuard: From Organizational Policies to Neuro-SymbolicCompliance Review Engines [5.2] PolicyGuardは、ポリシーに基づく文書コンプライアンスレビューのためのニューロシンボリックなフレームワークである。
組織政策ガイダンスを、型付き論理ルールと原子レベルの抽出質問からなる実行可能なレビューエンジンに変換する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:37:57 GMT)
An Empirical Study of Security Calibration in Large Language Models for Code [5.2] LLM生成コードにおけるセキュリティキャリブレーションに関する大規模な実証的研究を行った。
複数のベンチマークでGPT-4o-mini, Gemini-2.0-Flash, Qwen3-Coder-Nextを評価した。
以上の結果から,評価されたLSMでは過信が一般的であることが示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:37:39 GMT)
Learning Low-Energy Subspace Overlaps in Many-Body Systems with Measurement-Based and Coherent Quantum Strategies [5.1] 量子状態と特定の低エネルギー部分空間との重なりを予測することは、量子多体力学の鍵となる診断である。
本研究では, 時間発展状態と10量子Heisenbergスピン鎖のK次元低エネルギー固有空間の間の部分空間重なりの教師付き予測について検討した。
従来のシャドウ特徴を畳み込みニューラルネットワークで処理する計測ベース学習と、量子畳み込みニューラルネットワークが直接状態を処理するコヒーレント量子学習という2つの量子情報抽出戦略を比較した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:25:38 GMT)
Teaching LLMs to Recommend and Defer in Underrepresented Epilepsy Care [5.0] 我々は,小患者レベルのトレーニングセットから局所的な処方指導を学習する,非自明なプロンプト学習フレームワークであるMANANAを紹介する。
Mananaは、観察された処方のエラーを監査可能なプロンプトメモリに変換し、単一のエージェントとマルチエージェントのバリエーションでインスタンス化し、古典的なMLモデルよりも改善する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:09:37 GMT)
An Open-Source Tool for Reproducible Freeway Network Extraction from OpenStreetMap [5.0] 本稿では,OpenStreetMap (OSM) から高速道路網を抽出するオープンソースツールを提案する。
下流の高速道路シミュレーションに適した駅参照表現に変換する。
このツールはOSMのデータクリーニングと変換だけでなく、実際に必要とされるより広範なワークフローもサポートする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:53:18 GMT)
Verification-Gated Agentic Mission-State Governance for Intelligent Industrial Multi-Robot Systems [5.0] 本稿では,インテリジェントな産業用マルチロボットシステムのための検証ゲート型エージェント・ミッション・ステート・ガバナンス・フレームワークを提案する。
このフレームワークは2つの同期状態オブジェクトを保持しており、永続的な階層のための進化するタスクフォレスト、遅延グラウンド、修理可能なサブ構造である。
この研究はエージェントAIを、未確認の実行権限ではなく、検査可能なミッション状態検証によって管理される提案生成層として位置づけている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:41:00 GMT)
Towards Principled Continual Anomaly Detection: A Systematic Framework and Benchmark Scenarios [4.9] 連続異常検出は、モデルが進化するデータ分布に適応する方法を研究する。
ベンチマークはタスクの定義、フィルタリング、順序付け、検証の方法に大きく依存する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:50:01 GMT)
Learning Expert Strategy for Autonomous Robotic Endovascular Intervention via Decoupled Procedural Execution [4.9] 学習に基づくエキスパート戦略を導入し、血管内介入における手続き的整合性を高める。
このフレームワークは、高い航法成功率(>96%)と29.3%の運用手順を達成している。
これらの結果は、ロボット血管の介入の予測可能性、安全性、一貫性を高める可能性を強調している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:45:23 GMT)
Distributionally Robust Linear Regression With Block Lewis Weights [4.8] 群分布ロバスト(GDR)最小二乗問題に対するアルゴリズムを提案する。
我々のアルゴリズムは、適度な精度を実現するために、既知の内部点法よりも改善する。
また,最小二乗損失の最小化と分布的ロバスト損失の最小化とを円滑に補間するアルゴリズムも提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:01:08 GMT)
Scaling Storm-Resolving Atmospheric AI Simulation to the Entire Planet [4.8] STRATA (Storm-resolving Tile-based auto Regressive Atmosphere Transformer Architecture) は、世界規模の嵐解決型大気力学のための最初の自己回帰型AIエミュレータである。
STRATAは、様々な体制にまたがる現実的なkmスケールのダイナミックスを備えた、24時間の世界展開を安定的に行う。
SCREAMの物理モデルよりもエネルギー効率が約50倍高い。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:24:33 GMT)
DPPE: Rethinking Camera-Based Positional Encoding for Scaling Multi-View Transformers [4.8] カメラを用いた位置符号化は3次元コンピュータビジョンにおける空間的手がかりの提供に不可欠である。
本稿では、回転と変換を明確に分離するカメラベースの位置符号化法を提案する。
NVSタスクに対する広範囲な評価は、DPPEが大規模トレーニング設定においても安定した長期トレーニングを可能にすることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:38:58 GMT)
Learning Locomotion on Discrete Terrain via Minimal Proximity Sensing [4.7] 学習に基づく制御は動的移動に革命をもたらしたが、非構造的な地形を航行することは、ロボットが差し迫った接地に対する不完全な認識によって制限されている。
この研究は、低コストで高周波の赤外線近接センサーを四足歩行ロボットの足に直接埋め込む最小限の方法を探究する。
これらのセンサーは、自己閉塞に対して堅牢で、従来のビジョンベースのパイプラインよりも計算負荷が大幅に少ない「事前接触」フィードバックを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:16:37 GMT)
MultiUAV-Plat: An LLM-Oriented Platform, Benchmark and Framework for Multi-UAV Collaborative Task Planning [4.7] 大規模言語モデル(LLM)は、ハイレベルなロボットタスク計画のための有望なインターフェースを提供する。
既存のUAVシミュレータは主に力学、知覚、低レベル制御に重点を置いている。
既存のLLMエージェントは、部分観測性のような空中ロボティクスの制約をほとんど捉えない。
マルチUAVタスク計画のための軽量で使いやすいシミュレーションプラットフォームであるMultiUAV-Platを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:02:12 GMT)
ExPLoRe: Expert Patch-Level Loss Routing for Multi-Objective Masked Image Modeling [4.7] 本稿では,Expert Patch-Level Loss Routing(Expert Patch-Level Loss Routing)を提案する。
剥離アブレーションにより損失カップリングがコアメカニズムとして確認され、勾配がブロックされると1.6%が劣化する。
下流転送では,バニラMoEよりもMoEファインタニングを+1.5%向上させる適応レシピ(フリーズルーティング,エキスパートドロップアウト,フリーズアテンション)を開発した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:31:18 GMT)
EgoSafetyBench: A Diagnostic Egocentric Video Benchmark for Evaluating Embodied VLMs as Runtime Safety Guards [4.6] 視覚言語モデル (VLM) は、住宅や工場で実施するエージェントの安全ガードとして提案されている。
我々はEgoSafetyBenchを紹介した。EgoSafetyBenchは、1200のロボットビューシナリオを半秒の粒度でアノテートしたエゴセントリックなビデオベンチマークである。
警備員は、危険を含むビデオを確実に認識する一方で、特定の危険瞬間を見逃すことがよくあります。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:50:49 GMT)
IG-Lens: Exact Additive Probability Attribution Across Transformer Layers via Telescoping Integrated Gradients [4.6] 私たちはデコーダのみのトランスフォーマーについて単純な質問をする:どちらの2つの層が実際に生成された予測トークンの確率なのか?
既存のレイヤ単位の読み出しツールは、ほとんど答えない。
IG-Lensは,ベースラインから最終層への隠れ状態を通る単一の経路に沿って,統合勾配のテレスコープアプリケーションである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:27:26 GMT)
Correlation is magic in electronic structure Hamiltonians [4.6] 2-安定化剤レニーエントロピー(2-SRE)による電子構造ハミルトニアンの相関と魔法の関係について検討する。
量子化学の文脈において、これは電子構造基底状態の魔法と、電子相関の確立された尺度であるハートリー・フォック重みを結びつける。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:19:17 GMT)
Spectral Geometry and Bosonic-Bloch Probes: Explorations in Quantum Learning [4.6] 量子学習モデルにおいて、スペクトル幾何学がどのように出現し、物理的に接地されたプローブとどのように診断されるかを研究する。
グラフ正規化量子ネットワークでは、トレーニングは出力類似性グラフを再編成し、有効スペクトル次元 Delta S = +0.23 を高め、ラプラシアスペクトルを再設定する。
また、ハイブリッド量子オートエンコーダを解析し、その潜在表現の診断としてBloch空間ドリフトを導入する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:06:25 GMT)
Secure-CHG: A Comprehensive Framework for Robust and Fair Federated Learning via Hybrid Defense and Contribution-Aware Trust [4.5] フェデレート・ラーニング(FL)は、ステルスなバックドア攻撃に非常に敏感である。
後期失敗」という基本的脆弱性を特定。
本稿では,防衛パラダイムを形態的検出から本質的な意味的貢献の検証へ転換するハイブリッドフレームワークSecure-CHGを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:53:16 GMT)
AdaTrans: Automated C to Rust Transformation via Error-Adaptive Repair [4.5] AdaTransは、CコードのRustへの変換を自動化するフレームワークである。
平均コンパイルパスレートは95.51%、平均計算レートは81.09%で、既存のツールよりも大幅に上回っている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:11:54 GMT)
One Retrieval to Cover Them All: Co-occurrence-Aware Knowledge Base Reorganization for Session-Level RAG [4.5] 標準知識ベース上の単一の検索コールは,ユーザのセッションレベルの情報要求の41%しかカバーしていないことを示す。
我々は、共起認識クラスタリングを用いてKBをオフラインで再編成し、クエリ時にクラスタ近傍で検索候補を拡張する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:35:10 GMT)
HVPNet: A Bio-Inspired Network for General Salient and Camouflaged Object Detection [4.4] オブジェクト検出のためのシンプルなが一般的なバイオインスパイアされた計算アーキテクチャであるHVPNetを提案する。
概念的メタファーとしての網膜の多層情報統合に基づいて、網膜統合モジュール(RIM)を設計した。
これらの特徴をフル活用するために、デコードプロセスを低レベルおよび高レベルな視覚段階に分解する皮質デコーダ(CD)をさらに設計する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:14:11 GMT)
Scalable Behaviour Cloning on Browser Using via Skill Distillation [4.4] ブラウザエージェントのボトルネックは不完全な情報に基づく意思決定である,と我々は主張する。
ユーザインタラクションの軌跡を、エージェントが直接読み、検索、再利用、構成できるような、コンパクトな自然言語スキルに変換する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:46:23 GMT)
Preserve the Hard, Regenerate the Rest: Uncertainty-Guided Synthetic Training Data Augmentation with Diffusion Models [4.4] 本研究では, ラベルの有効性を厳格に保ち, 合成サンプル当たりの画素情報効率を効率的に最大化する, 不確実性誘導型合成文脈拡張戦略を提案する。
都市景観, UAVID, BDD100Kにおいて, バス, 電車, あるいは(航空の観点から) 車両などの希少で困難なクラスにおいて, かなりのmIUゲインを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:51:49 GMT)
Sample Complexities of Estimating Gumbel--Max Watermark Proportions with and without Reduction to Pivotal Statistics [4.3] ウォーターマーキングは、大きな言語モデル(LLM)の使用の統計的痕跡を約束するが、実際の文書は、編集やパラフレージングの後に、純粋に人間が書いたり、機械で作成されたりすることは滅多にない。
我々は,この透かし比推定問題をGumbel-max透かし機構を用いて検討した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:04:35 GMT)
RRT-Rope: A deterministic shortening approach for fast near-optimal path planning in large-scale uncluttered 3D environments [4.3] 高速探索型ランダムツリー (RRT) アルゴリズムは,確率論的完全性や実現可能な経路の探索の迅速性から人気がある。
RRTのショートカットは、RTの亜種より優れていることが証明された古いアイデアである。
本稿では,RRT-Ropeという手法を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:54:00 GMT)
Spatio-Temporal Gaussian Process for Building Terrain-Incorporating Wind Power Curves [4.2] 風力タービンの出力曲線の正確なモデリングは、最適風力操作に不可欠である。
既存のすべてのパワーモデルは、農場の地形の影響を見下ろしながら、風速などの時間変数にカーブする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:19:06 GMT)
A Non-Line-of-Sight, Multi-Modality-based Side-Channel IP Theft Attack on Additive Manufacturing Using Dual Smartphones [4.2] アダプティブ・マニュファクチャリング(AM)は、エアロスペース、自動車、医療など主要産業に革命をもたらし、調整可能な生産を可能にした。
AMの使用が増加するにつれて、サイドチャネルエミッションによる印刷プロセス中の知的財産権漏洩のリスクも増大する。
3Dプリンタにおける現在の研究と攻撃シナリオは、3つの課題に直面している: 最終的なGコード再構成における成功率と精度の低いこと、3DプリンタのIPを攻撃するための限られた距離範囲、特殊で過度なデータ収集ツールに依存すること。
本稿では,2つのスマートフォンの内部センサを用いたサイドチャネル攻撃について述べる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:07:55 GMT)
Usage frequency and application variety of research methods in library and information science: Continuous investigation from 1991 to 2021 [4.2] 本研究は、1991年から2021年までの26,000件以上の研究論文を、21大LIS(図書館情報科学)ジャーナルで分析した。
この研究は、この研究で特定された18の研究トピックと、LIS分野で一般的に採用されている16の研究手法の動的および明らかな関係を明らかにした。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:15:48 GMT)
ZEBRA: Zero-Shot Entropy-Regularized Prompt Learning for Base-to-Novel Generalization in Audio-Language Models [4.2] ZEBRAは、ゼロショットロジットとプロンプトラーニングロジットを融合するプラグイン・アンド・プレイフレームワークであり、ベースクラスへのオーバーフィットを減らすために自己エントロピー正規化を採用している。
ZEBRAは、高いベース精度を維持しながら、新しいクラスの性能を一貫して改善し、標準のプロンプト学習と比較して、ベースとノーベルのギャップを著しく低減する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:40:45 GMT)
Revisiting the Volume Hypothesis [4.2] 現代のディープニューラルネットワークは、トレーニングデータに適合するために必要なパラメータをはるかに多く含んでいることが多いが、それらは印象的な一般化を実現している。
代替の体積仮説は、低トレーニング損失領域において、強い一般化をもたらす損失ランドスケープ盆地が、低低トレーニング領域よりもはるかに広い重量空間を占有していることを示唆している。
ランダムサンプリング学習よりも勾配学習の利点は、トレーニングデータのサイズが大きくなるにつれて一般的に低下することを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:58:19 GMT)
FLORA: A deep learning approach to predict forest attributes from heterogeneous LiDAR data [4.1] 森林属性を6つ予測する深層学習フレームワークFLORAを提案する。
主要高さ, 総体積, 落葉量, 針葉樹量, 基底面積, および異種LiDAR点雲からの茎密度。
モデルは、フランス全国LiDAR HDプログラムのデータを用いて、フランス本土の32,052のプロットで訓練され、評価される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:52:28 GMT)
What Probing Reveals about Autonomous Driving: Linking Internal Prediction Errors to Ego Planning [4.1] 大規模データセットとシミュレーターは、安全で堅牢に見える運転ポリシーの改善を可能にした。
しかし、名目上のシナリオにおける強力なパフォーマンスは、依然として欠陥のある推論と安全でないことを隠蔽することができる。
われわれは、周囲の車両が次に移動する予測の形式を探り、安全な軌道の作り方を理解することに注力する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:04:01 GMT)
Clinically Structured Rank-Gated LoRA for Cross-Benchmark Medical Question Answering [4.1] BiRG-LoRA (BiRG-LoRA) は、医学質問応答のための単一適応ランク付きLoRA法である。
BiRG-LoRAは、トレーニング可能なPEFTベースラインの中で、最高4ベンチマークのマクロ平均精度を達成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:59:05 GMT)
ISM:Self-Improving Strategy Memory for Continual Mathematical Reasoning [4.1] Intelligent Memory (ISM) は、自己進化型メモリ拡張システムであり、ハード・エピソード・リセットによる連続学習において、凍結LDMの数学的推論を改善する。
ISMは、成功と失敗の両方から学んだ、コンパクトで自己修正された戦略スキーマのバンクを維持しており、中間ステップをチェックし、回答を認証する象徴的なツールを備えている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:21:08 GMT)
A Self-Negotiation Framework for Ethical Decision-Making during Task Interruptions in Service Robots [4.0] 複数のユーザが同時にサービスを要求すると、サービスロボットは割り込みに頻繁に遭遇する。
現在のアプローチは静的なルールや中央集権的な仲裁に依存しており、自律的で倫理に基づく紛争解決をサポートしない。
倫理的プロファイルによって各ユーザを表現する自己交渉フレームワークを導入し,内部交渉プロセスを通じて紛争を解決する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:53:48 GMT)
GenPage: Towards End-to-End Generative Homepage Construction at Netflix [4.0] GenPageはユーザとリクエストをプロンプトとして扱い、レスポンスとして構造化されたマルチローホームページ全体を自動回帰的に生成する。
我々は、LLMトレーニングのレシピに適応し、生産ページで事前トレーニングを行い、その後、重み付き二分分類(WBC)強化学習(RL)による後トレーニングを行う。
産業規模での展開には、冷蔵品モデルの鮮度、事業執行力、サービス効率に対処する技術を導入する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:00:05 GMT)
Distributed Property Testing with (Quantum) Carrier Pigeons: Tight Bounds on State Certification [4.0] パブリック・コイン設定とプライベート・コイン設定の両方で条件付き下限を示し、パブリック・コイン設定で一致した上限を示す。
また、量子通信のみを許す場合、プライベートコイン設定においてほぼ密接な上限を示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:43:49 GMT)
Topological phase transition in chaotic optomechanical systems [4.0] 駆動レーザーの周波数を調整すれば この予測可能性をオフにできます
因果状態間の遷移確率は、効果的な順序パラメータとして機能するエントロピー(不確実性)を定義することができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:23:30 GMT)
Probing Stylistic Appropriation using Large Language Models: An Evaluation Framework for Copyright Infringement under EU Law [3.9] Webスケールコーパスでトレーニングされた大規模言語モデル(LLM)は、著作権を侵害する可能性のある出力を生成する。
EUの著作権ドクトリンは、スタイリスティックな選択、物語構造、創造的な共同作業にまで及ぶ相当な類似性という、より広い基準を適用している。
我々は、EU著作権の原則を10の評価者を通して運用するLSM-as-a-judgeフレームワークであるPSALMを紹介する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:25:32 GMT)
A Technical Typology of AI Systems in Public Administration [3.9] 本稿では、行政研究が「AI」のさらなる技術的精度の恩恵を受けることを論じる。
ハンドコード,ガラスボックス,ブラックボックス,汎用システム,エージェントシステムという,AIシステムの5つのカテゴリの類型について紹介する。
我々は,近年の公務員によるAIに関する研究において,91件の高能率論文のコーディングによる技術精度の評価を行った。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:44:56 GMT)
Optimal any-angle path planning in static and dynamic environments [3.9] Zeta* と Zeta*-SIPP はそれぞれ静的環境と動的環境向けに開発されている。
Zeta*-SIPPはどちらの走査法でも、対応する最先端の最適プランナーTO-AA-SIPPの20倍以上高速である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:40:23 GMT)
Random Reshuffling Dominates Stochastic Gradient Descent [3.8] 我々はランダムリシャッフル(textsfRR$)が、有限個のエポックの後、任意の合理的なステップサイズの下で滑らかな凸最適化において$textsfSGD$を支配していることを示す。
有限個のエポックの後、任意の合理的なステップサイズの下で滑らかな凸最適化において、$textsfRR$が$textsfSGD$を支配していることも証明する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:38:22 GMT)
PGUDA: Pressure-Guided Unsupervised Domain Adaptation with Cross-Modal Knowledge Distillation for sEMG-Based Gesture Recognition [3.8] 表面筋電図(sEMG)に基づくジェスチャー認識は、人間とコンピュータの自然な相互作用のための有望な技術として登場した。
本稿では,新しい圧力ガイド型非教師付きドメイン適応(PGUDA)フレームワークを提案する。
圧力信号に基づいて訓練された教師ネットワークは、未ラベル対象ドメイン上のsEMG学生ネットワークを誘導する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:45:55 GMT)
Verifiable Rewards for Calibrated Probabilistic Forecasting [3.8] 報酬による強化学習は、調整された確率予測器を訓練することができる。
本研究では,予測自体が校正された出力であり,ラベルがひとつの結果であるアレータリック予測について検討する。
過去の成果から推定した状態条件付き経験的勝利率である,検証可能なラベルなし報酬を導入する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:42:45 GMT)
Obliviate: Efficient Unlearning in Recommender Systems [3.7] Obliviateは、レコメンデータシステムのための効率的な2段階のアンラーニングフレームワークである。
優れたユーティリティを維持しながら、高い未学習の完全性を達成する。
これは大規模レコメンデーションシステムのための実用的でスケーラブルなソリューションである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:52:32 GMT)
Online TT-ALS for Streaming Tensor Decomposition with Incremental Orthogonalization [3.7] 列車列車(TT)分解は高次元データ解析の強力な手法である。
オンラインTT-ALS(Alternating Least Squares)は、直交制約を順次適用するアルゴリズムである。
提案手法は計算効率が高く,低遅延リアルタイム処理に適している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:50:29 GMT)
AGE: Adaptive-masking for Graph Embedding in Graph Retrieval-Augmented Generation [3.6] GraphRAGは検索拡張生成(RAG)の拡張であり、グラフ構造化データを外部知識として参照することで、大きな言語モデル(LLM)をサポートする。
グラフ埋め込み(AGE)のAdaptive-maskingを導入することでこの問題に対処する。
AGEでは、マスクベースの自己教師型学習(SSL)アプローチでTransformerを採用している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:23:09 GMT)
HistoriQA-ThirdRepublic: Multi-Hop Question Answering Corpus for Historical Research, Parliamentary Debates from the French Third Republic (1870-1940) [3.6] HistoriQA-ThirdRepublic (英語: HistoriQA-ThirdRepublic) は、フランス第三共和政の議会討論会や新聞から派生した、多項目の歴史的問題に関するフランス語のデータセット。
このデータセットは1782の質問から成り、異質な歴史的文書にまたがるマルチホップ接続を強調している。
本稿では,コーパスの構築手法について述べる。ソースの選択とアライメント,質問バリデーション,メタデータの統合などである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:28:42 GMT)
A Mechanism-Driven Theory of Phase Transitions in Active Learning [3.6] アクティブラーニング(AL)のパフォーマンスは予算依存であることが知られているが、レシエーションはデータセットやアーキテクチャ全体にわたって一般化できない。
我々は、予算制度を支配的一般化機構のシフトとみなすことにより、ALダイナミクスを特徴づける。
この作業は、次世代のトランジション対応ALアルゴリズムのための統一されたフレームワークを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:20:33 GMT)
Quantum Derivative Pricing for SPDEs via BDSDE Representation [3.6] 偏微分方程式(SPDE)モデルに対する導関数価格の量子スピードアップについて,その後方2倍微分方程式(BDSDE)表現を用いて検討する。
条件付きおよびネスト型量子加速型マルチレベルモンテカルロ法(QA-MLMC)を開発した。
このフレームワークをデリバティブ価格と感度分析に適用し、量子加速推定器を1次および2次ギリシャ人、確率比およびマリアビン重み表現と同様に価格に対して提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:06:38 GMT)
Refnd: Preventing Data Leakage in Relational Datasets [3.5] Refnd は Navigable Navi Small World (HNSW) を用いてログ時間で計算された近接グラフを利用する分割アルゴリズムである。
抗微生物ペプチドデータセットを用いて,Refnd分画は従来の分画よりも低いが,より現実的な評価が得られた。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:53:33 GMT)
Hierarchical Clustering As a Novel Solution to the Notorious Multicollinearity Problem in Observational Causal Inference [3.5] マルチコリナリティは、観察因果推論において長く続く課題である。
階層的クラスタリングを用いてデータを集約することで、革新的で直感的なソリューションを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:07:22 GMT)
Revising RVL-CDIP: Quantifying Errors and Test-Train Overlap [3.5] ラベルエラーやテストトレインオーバーラップ修正によるRVL-CDIPのバリエーションと,これらの新しいバリエーションに対する文書分類性能のベンチマークを行う。
RVL-CDIPの厳密な解析により, コーパスには12%のラベル誤りと約35%のテストトレイン重複が認められた。
さらに,分布外ベンチマークであるRVL-CDIP-Nのモデル評価を行い,誤り訂正データのトレーニングによりOODの一般化が大幅に向上することを確認した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:22:50 GMT)
Solution space path planning for supporting en-route air traffic control [3.4] 本研究では,道路交通制御のためのコンフリクトフリー経路計画アルゴリズムを開発した。
アルゴリズムは、3つの意図に基づく競合検出方法をソリューション空間フレームワークに統合する。
その結果,SSPPVとゾーンベースの競合検出を組み合わせれば,最高の性能が得られることがわかった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:33:42 GMT)
Warp RL: Reshaping Base Policy Distributions for Dynamics Adaptation [3.4] 残留強化学習は、その動作に付加的な補正を学習することにより、事前訓練されたロボットポリシーに適応する。
基底分布が幾何的に変化した系と一致していない場合、残差補正は未適応のポリシーでさえも過小評価可能であることを示す。
基本方針の行動分布の可逆的状態条件変換を付加残差に置き換える政策適応手法であるWarp RLを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:25:51 GMT)
Estimating Velocity of Spheres from Rolling-Shutter Image(s) [3.2] ローリングシャッターカメラは、高速移動物体を撮像する際に特徴的な歪みをもたらす。
回転シャッターフレームから高速に移動する球状物体の3次元翻訳速度と角速度を推定する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:49:26 GMT)
Theory of Mind and Persuasion Beyond Conversation: Assessing the Capacity of LLMs to Induce Belief States via Planning and Action [3.2] 我々は,会話の説得ではなく行動をとることによって,他のエージェントの特定の信念を誘発するエージェントの能力を評価する。
GPT-5はエージェント設定で約80%のタスクで成功した。
人間のような全てのモデルは、偽の信念状態よりも真の信念状態を引き起こすタスクにおいて、より優れたパフォーマンスを発揮した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:22:12 GMT)
SNAP-FM: Sparse Nonlinear Accelerated Projection for Physics-Constrained Generative Modeling [3.2] 制約されたサンプリングは、このギャップを閉じ、推論時に正確に制約を課す。
標準的なMLフレームワークは、物理的制約が自然に引き起こす構造を曖昧にします。
我々は、このボトルネックを利用して、プロジェクションサブプロブレムにおいてサンプルワイドおよび局所PDE結合が引き起こす構造を利用する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:35:09 GMT)
CoDex: Learning Compositional Dexterous Functional Manipulation without Demonstrations [3.2] CoDexはCD-FOM操作戦略を自律的に発見するゼロデーモンレーションフレームワークである。
6つのCD-FOMタスクにまたがる16-DoFマルチフィンガーハンドを用いた7-DoFロボットアーム上でのCoDexの評価を行った。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:12:30 GMT)
Scientific Explanations in Health Sciences: Causality, Trust, and Epistemic Adequacy [3.1] 本稿では,科学哲学と医療説明可能なAI(XAI)の交点における批判的レビューを開発する。
健康科学における説明として数えられるものの一般的な説明は、この領域における説明可能性に対する哲学的に根ざしたアプローチに必要な条件を提供すると論じている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:05:00 GMT)
Benchmarking the Benchmarks: A Validity Audit of Tool-Calling Evaluation [3.1] 本報告では,4つの主要なツールコール・ベンチマーク・ファミリーの体系的妥当性と評価について述べる。
496人の専門家がレビューしたベンチマークタスクのうち、92人の評価者と人間の意見の不一致が18.5%のミスアライメントレートに対応している。
ツールコール評価失敗、トレースレベルの監査成果物、修正された評価項目の統一分類を導入し、ツールの実行、タスク完了、結果検証を別々に計測する指標について議論する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:10:42 GMT)
Quantum Imaging via Kurtosis-Difference Weighted Covariance on 2D Camera [3.0] カメラを用いた量子イメージングは自然パラメトリックダウンコンバージョン(SPDC)から空間相関光子対を検出する
その結果, 相関係数が低い場合でも, 相関画素対を効果的に判別できることがわかった。
提案手法は, 取得時間を40倍に短縮し, スパース相関光子系における実用的な量子イメージングを可能にする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:42:49 GMT)
Mixture-of-Experts RL for Fault-Tolerant Legged Locomotion [3.0] 本稿では,故障診断情報を明示的に活用して特殊な制御専門家を活性化する,障害対応モジュール制御アーキテクチャを提案する。
実験結果から、明示的なフォールト条件のモジュラポリシは、同等の大きさのモノリシックポリシを一貫して上回ることが示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:33:57 GMT)
Exploration and Online Transfer with Behavioral Foundation Models [3.0] 我々は,このオンライン学習問題を,盗賊的探索探索問題の観点から考えることが可能であることを示す。
上信頼境界から着想を得た定式化を導出し、不確実行列の固有値の最小化により探索が可能であることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:37:47 GMT)
Smart charging of large fleets of Electric Vehicles: Independent Multi-Agent Reinforcement Learning approaches [3.0] この研究は、分散EV充電を最適化するための2つの独立したマルチエージェント強化学習手法と比較する。
局地的な環境情報に基づいて意思決定を行う自律エージェントを用いた現実的なシミュレーション環境を用いて,その性能を様々な混雑レベルにわたって評価する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:43:55 GMT)
Robust Text Watermarking for Large Language Models via Dual Semantic Embeddings [3.0] Dual-Embedding Watermarking (DEW)は、大規模言語モデル(LLM)のセマンティックな透かし方式である。
DEWは文脈やトークンレベルの埋め込みを利用して、言い換えや翻訳に対する堅牢性を高める。
実験結果から,DeWは文質の競争を維持しつつ,単語後検出を改良し,翻訳後も検出可能であることがわかった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:51:30 GMT)
BearingNAS: Obtaining In-Sensor Intelligent Fault Diagnosis Systems for Bearings Using a Laptop [3.0] BearingNASは、インセンサー処理を通じて、インテリジェンスを直接センサーダイにシフトするように設計されたフレームワークである。
ラップトップのCPUで完全に動作するので、検索は1時間以内に収束する。
その結果、センサパッケージ内で機械学習のワークロードをシフトさせることで、低コストで大規模なベアリング障害診断が可能になった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:28:46 GMT)
Improving Certified Robustness via Adversarial Distillation [3.0] 対側蒸留法とIPP上界を併用した認定トレーニング目標であるAD-CERTを導入する。
我々は,AD-CERTがいくつかのベンチマークで最先端の認定性能を達成することを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:31:35 GMT)
Cross-lingual Relation Extraction with Large Language Models: Zero-Shot, Few-Shot, and Fine-Tuned Evaluation on Romanian [2.9] LLMを用いた翻訳パイプラインを用いて,SemEval-2010 Task 8ベンチマークを英語からルーマニア語に翻訳する。
我々はGemma 4 31Bをゼロショット、少数ショット、QLoRA微調整構成で評価した。
その結果, ルーマニア語では, プロンプトのみの設定で英語に対して3~5ポイント (pp) の減少がみられた。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:22:46 GMT)
AD-MPCC: Adaptive Differentiable Model Predictive Contouring Control for Autonomous Racing [2.9] Adaptive Differentiable Model Predictive Contouring Control (AD-MPCC)は、自律レースのためのフレームワークである。
オンラインパラメータ推定では、パラメータ化されたPacejka Magic Formulaと正規化された移動水平推定方式を利用する。
本研究では,Pacejkaインフォームド機械学習モデルを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:19:35 GMT)
Non-Hermitian Rayleigh-Schrödinger-like Perturbation Theory at Exceptional Point [2.9] 我々は、非エルミート量子系に対するレイリー・シュルディンガー型摂動理論を、例外的に$N$で展開する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:53:22 GMT)
TaxoMIL: Taxonomy-Constrained Learning for Hierarchical Whole Slide Image Analysis [2.9] 全スライド画像(WSI)解析は、計算病理学の中心である。
TaxoMILは、WSIの診断を多粒度テキスト生成タスクとして再構成する分類制約付きフレームワークである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 03:48:57 GMT)
RAISE: LLM-based Automated Heuristic Design with Robust Adversary Instance Search [2.9] 本稿では,トレーニング分布の近傍に制約付き最悪のインスタンス探索を統合するフレームワークを提案する。
RAISEは、テストおよび問題スケール全体にわたって、一貫して強力なパフォーマンスを維持している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:19:27 GMT)
Long-term Traffic Simulation via Structured Autoregressive Modeling [2.8] シーントポロジ、エージェント状態、インテントを可変長の構造化自己回帰ストリームに生成する統合フレームワークであるRosettaSimを紹介した。
Retrievalベースのトラフィック評価(RTE)も導入し、コンテキスト対応の参照アンカーとして意味論的に類似した実世界のシナリオを検索する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:41:28 GMT)
Vision-Language Model Reasoning for Contextual Semantic Mapping in Intralogistics [2.8] 本稿では、SLAMに基づく幾何マッピング、SAMベースのインスタンスセグメンテーション、VLMマルチビュー推論を組み合わせたコンテキスト意味マッピングパイプラインを提案する。
パイプラインは、タスク固有のトレーニングや事前定義されたオブジェクトカテゴリを必要とせずに、コンテキストオブジェクトプロパティを推論する。
結果のセマンティックマップは、動的イントロロジクス環境におけるコンテキスト認識フィルタリングとロバストナビゲーションをサポートする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:10:41 GMT)
CLOUDADV: Decision-Aligned Instance Sizing with Zero-Shot Foundation Models under Drift [2.8] CLOUDADVは,ワークロードドリフト下でのクラウドインスタンスサイズ評価のための,対話型エンジニア向けアドバイザリシステムである。
各クエリに対して、CLOUDADVは、履歴利用、予測サマリ、現在のVMメタデータ、候補インスタンスオプション、価格、明示的なサイズから構造化された決定コンテキストを構築する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:49:04 GMT)
Harnessing the Latent Space: From Steering Vectors to Model Calibrators for Control and Trust [2.8] 言語モデルは、信頼できないテキストジェネレータから、数兆のパラメータを持つ高機能な大規模モデルへと変化した。
本稿では,信頼のための潜在空間モデルキャリブレータの制御と開発のためのステアリングベクトルを提案する。
共に、私たちのコントリビューションは、言語モデルの潜在する空間をデミスティフィケーションし、モデル内部をどのように活用してより信頼できる言語技術を構築するかについての新しい洞察を提供するのに役立ちます。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:21:46 GMT)
MOA: A Profiling-Guided LLM Framework for Memory-Optimization Automation at Codebase Scale [2.8] 本報告では, 繰り返し発生するメモリ不効率を自動的に検出し, 修復するMOAについて述べる。
1億行を超えるC/C++コードを持つオープンソースのオペレーティングシステムであるOpenHarmonyに対する我々の評価は、MOAが3つのプロファイルサービスから13のアンチパターン(以前は知られていなかった9つのアンチパターン)を識別し、より広い7サービスのセットで10,000の非効率を検知し、92.5%のエキスパート受け入れ率で769のパッチを生成することを示している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:00:31 GMT)
SEFORA: Student Essays with Feedback Corpus and LLM Feedback Evaluation Framework [2.8] SEFORAは公開コーパスペアインストラクターのインラインフィードバックであり、アサインプロンプト、ルーリック、スコア、マルチドラフトリビジョンを備えている。
UniMatchは、オープン・エンド・ジェネレーションのための参照ベースの評価フレームワークである。
フィードバックをフィードバック単位に分割し、インストラクター由来の基準の下で意味対応をスコアし、最適なマッチングによってそれらを調整し、解釈可能な精度、リコール、F1を得る。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:48:15 GMT)
Fully Automated High-Precision Segmentation of Retinal Atrophy and Ellipsoid Zone Thickness in OCT: A Reliable Tool for Real-World GA Monitoring [2.7] 加齢関連黄斑変性症(AMD)に続発する地理的萎縮(GA)は、関連する構造バイオマーカーの正確なモニタリングを必要とする。
本稿では,OCT画像におけるキーバイオマーカーの高精度,画素ワイド分割のための,完全に自動化されたディープラーニングベースのフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:21:57 GMT)
Learning dynamical systems from noisy data with Weak-form Kernel Ridge Regression [2.7] カーネルリッジ回帰学習戦略は、クリーンなデータに適用する場合に有効であるが、ノイズの多いデータでは成功は限られている。
近年の研究では、弱い定式化がノイズデータのフィルタリングに役立ち、異なる学習戦略が弱い形態のフレームワークによる雑音の堅牢性の向上を実現している。
動的システム学習のためのWak-form Kernel Ridge Regression (WKRR)を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:07:55 GMT)
SwiftAudio: Data-Efficient Caption-Only Distillation for One-Step Text-to-Audio Diffusion-based Generation [2.7] 拡散に基づくテキスト・トゥ・オーディオ(TTA)モデルは、優れた合成品質を実現するが、高い推論遅延に悩まされる。
我々は,テキストキャプションのみを用いて,事前学習した拡散教師からの無音蒸留を行う一段階のTTAフレームワークであるSwiftAudioを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:36:10 GMT)
Overview of the TalentCLEF 2026: Skill and Job Title Intelligence for Human Capital Management [2.7] TalentCLEFは、ヒューマンキャピタルマネジメントにおける自然言語処理研究の推進を目的としたイニシアチブである。
本稿では,課題のモチベーションと組織について述べるとともに,データセットと評価設定を要約し,参加チームによる主な成果を報告する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:04:59 GMT)
Sequential RC-TGAN: Generating Relational Time Series with Spectral Envelope Loss [2.7] 本稿では,RC-TGANフレームワークの時間拡張であるSequential RC-TGAN(Seq. RC-TGAN)について紹介する。
エンド・ツー・エンドのアプローチは、循環パターンの再現や長期的季節性において最先端のシステムよりも著しく優れています。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:09:10 GMT)
Distilling Temporal Coherence into 2D Networks for Transrectal Ultrasound Prostate Video Segmentation [2.7] 経直腸超音波(TRUS)における前立腺のリアルタイムビデオセグメンテーションは画像誘導的介入に不可欠である。
本稿では,時間的コヒーレンスをトレーニング中に2次元ネットワークに蒸留する時間的一貫性学習フレームワークを提案する。
前立腺は幾何学的安定性を示し,周囲の音環境は生理的動きや振動子圧力によって変動する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:27:02 GMT)
Representation as a Bottleneck for Mechanistic Interpretability: The Manifestation Unit Protocol [2.6] 機械的解釈可能性には、どのニューラルネットワークコンポーネントがエンコードするか、どのようにエンコードするかを特徴付ける、コンポーネントレベルの分析の豊富な在庫がある。
テーブル、回路選択性、特徴リストは、スタディ毎のノートブックにロックされている。
独立して評価できるボトルネックについて検討し、型付き表現プロトコルを導入する。
このプロトコルは、生成視覚(β-VAE)、離散視覚(CNN)、言語(GPT-2)にまたがって確立され、2つの発見をサポートする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:26:11 GMT)
Self-Supervised Temporal Regularization for Landmark-Based Cardiac Segmentation with Automatic AHA Regional Mapping [2.6] 本研究は,一貫した心臓分割と運動推定を行うための訓練後改善段階として,自己監督型時間正規化を導入する。
連続するフレーム間の速度と加速度の不連続性をペナライズすることにより,時間的に一貫したセグメンテーションを実現する。
さらに、これらの対応を活用して、ランドマークをAHA 17-segment 臨床標準に自動的にマッピングする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:09:54 GMT)
World-Model Collapse as a Phase Transition [2.6] 長軸言語エージェントが暗黙の世界モデルに類似した遷移を示すかどうかを問う。
我々はこの効果を、ステップごとのゴールド状態を持つ決定論的タスクファミリーで研究する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:28:01 GMT)
Ask the World Before Acting: Budgeted Environment Probing for World-Model Calibration [2.6] ロングホライゾンの言語エージェントは行動を選択するだけでなく、一つの決定から次の決定まで世界のプライベートモデルを運ぶ。
エージェントは,次のタスクアクションにコミットする前に,ある信念の場について環境に質問し,その答えを世界モデルに書き戻すことができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:45:49 GMT)
ALAS: Additive Learnable Alpha-Stable Kernels for Flexible Bayesian Optimization [2.6] ALASは、対称$$$-stableスペクトルコンポーネントで構築されたフレキシブルカーネルファミリーである。
ALASとALAS-Sepは分割可能な変種であり、ほぼ分解可能な目的に対して頑健性を改善するために寸法方向の尾の挙動を学習する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:32:08 GMT)
Diagnosing and Mitigating Compounding Failures in Agentic Persuasion via Taxonomic Strategy Retrieval [2.6] 分類学的戦略RAG(英: Taxonomic Strategy RAG、TS-RAG)は、個別の分類的ボトルネックを通じて戦略をルートし、議論的構造をトピックの内容から切り離すシステム介入である。
TS-RAGは、標準的なセマンティック検索が崩壊する抽象論理の転送を大幅に改善する。
非対称な配置において「能力橋」として機能し、軽量な説得者に対抗相手を一貫して打ち負かす権限を与える。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:54:43 GMT)
CLIMB: Centroid-Based Hierarchical Memory for Online Continual Self-Supervised Learning [2.5] Online Continual Self-Supervised Learning (OCSSL)は、タスク境界やメモリ制約の知識なしに、ラベルなしデータの連続ストリームから表現を学習することを目的としている。
両機能を組み合わせたCLIMB(Continual Learning with Intelligent Memory Bank)を提案する。
提案手法では,記憶された画像の総数に制限された階層型セントロイドメモリと,再生例の知識蒸留を併用し,表現のドリフトを制限する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:47:58 GMT)
RESOLVE: A Multi-Resolution and Multi-Modal Dataset for Roadside Cooperative Perception [2.5] 我々は,マルチ解像度ロードサイドLiDARと同期カメラ-LiDARセンサを備えた大規模ベンチマークデータセットRESOLVEを紹介する。
大規模なベンチマーク実験の結果、マルチモーダル核融合がLiDARの点間隔を補うことができるかが明らかになった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:04:33 GMT)
Learning Structurally Consistent Representations for Multi-View Radar Semantic Segmentation [2.5] マルチビューレーダセグメンテーションのための高次構造アライメントフレームワークを提案する。
提案手法は、学習可能なハイパーグラフを用いてレーダ特徴表現を洗練し、高次依存関係をキャプチャする。
CARRADAとRADIalベンチマークの実験では、強いレーダー固有のベースラインよりも一貫した改善が示されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:57:15 GMT)
Think in English, Answer in Korean: Efficient Adaptation of Multilingual Tool-Using Agents [2.4] このモデルはコヘアの完全後訓練されたコマンドAから新しいプレトレーニングランではなく訓練される。
ツール・ユース・エージェントを効率的にスケーリングするための4つの選択肢について検討した。多言語指導による微調整、多段階ツール・ユース・タスクに対する検証可能な報酬付き強化学習、韓国のユーザ対応応答に対する言語一貫性報酬である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:29:16 GMT)
ScratchWorld: Evaluating If World Models Compute Executable Consequences [2.4] 我々は、Scratchプロジェクトを実行可能な世界として扱うオフライン診断ベンチマークであるScratchWorldを紹介した。
ScratchWorldは、次の状態予測、ロングホライゾントラッキング、因果イベント属性、および反事実予測を評価する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:02:25 GMT)
Low-dimensional topology of deep neural networks [2.4] フィードフォワードネットワーク、ResNet、トランスフォーマーを含む層モデルについて、各層を$d = 3$の幅に制限することで検討する。
これにより、ニューラルネットワークがその層を通して低次元の位相不変量をどのように変化させるかを追跡することができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:53:11 GMT)
Hate Speech Detection in Turkish and Arabic Languages: A Comprehensive Study [2.4] トルコ語における5つの異なるトピックをカバーする包括的ヘイトスピーチデータセットを導入する。
これらのトピックには、難民、イスラエル・パレスチナ紛争、トルコにおける反ギリシャ感情、民族または宗教コミュニティ、LGBTI+が含まれる。
我々は、ヘイトカテゴリー分類、ヘイト強度予測、ターゲット識別、ヘイトスピーチスパン検出など、ヘイトスピーチ分析の複数の次元に対処する最先端のBERTモデルを開発した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:20:06 GMT)
NURBS Splatting: A Unified Differentiable Rendering Framework for Vector Graphics [2.3] 連続ガウス場として有理曲線を表す統一フレームワークであるNURBS Splattingを提案する。
書道の再構築,ベクトル化フレームワーク,長いスプライン画像の抽象化において,その効果を実証する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:51:37 GMT)
AEGIR: Modeling Area Emitters for Indoor Inverse Rendering using Gaussian Splatting [2.3] 逆レンダリングでは、照明と表面物質を分離する必要がある。
既存のライティング可能な方法は、個別の点灯、大域環境マップ、暗黙の表現を用いてシーンライティングを近似する。
本稿では,地域エミッタを表現可能なガウススプラッティング表現内で明示的にモデル化するフレームワークであるAEGIRを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:08:45 GMT)
BREIT: A Framework for Brain Stroke Reconstruction using Multi-Frequency 3D EIT [2.3] マルチ周波数電気インピーダンストモグラフィ(MF-EIT)は、境界電圧から電界分布を再構成する非侵襲的で低コストなモダリティである。
脳卒中画像における3次元深層学習の進展は,GTボリュームと組み合わせた大規模データセットの欠如によって制限される。
i) CT/MRIを周波数依存GT肯定ボリュームに変換するフーリエ・ツー・EITパイプライン; (ii) Python 3D完全電極モデル(CEM)を前方に導入する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:17:24 GMT)
Adaptive Cluster-First Route-Second Decomposition for Industrial-Scale Vehicle Routing [2.3] 本稿では,分解手順を反復的決定過程として定式化する適応型CFRSシステムを提案する。
近年の大規模言語モデル(LLM)の推論とツール選択の成功に触発され、LLMをハイレベルな意思決定者として採用している。
最大50万の顧客を含む合成およびベンチマーク由来のCVRPインスタンスに対するアプローチを評価する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:31:40 GMT)
Communication-Aware Robot Execution for Cloud Inference under Spatially Heterogeneous Connectivity [2.3] クラウドでホストされるファンデーションモデルは、ロボットが計算の限界を超えたセマンティック推論を使用することを可能にする。
リクエスト応答ウィンドウを導入し、次のクラウドサイクルに必要な時間を特徴付ける。
フレームワークは、次の要求ポイントを進行中のプリミティブ実行中の動作決定として扱い、クラウド要求の提出に十分な通信品質を提供するためにそれを選択します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:15:47 GMT)
The Illusion of Safety: Multi-Tier Verification of AI vs. Human C++ Code [2.3] 大規模な言語モデルでは、単一の見落とされた違反が悪用可能なバグとなるメモリアンセーフな言語であるC++がますます生成される。
AI生成コードのほとんどのセキュリティ評価は、静的解析のみに依存しており、実行時の違反を確認したり、テストされていないパスを推論することなく警告をフラグ付けする。
AI生成のC++は、人間が書いたコードほど安全ではないのか、そして、一般的な検証ツールがリスクに一致しているかを問う。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:48:35 GMT)
Dynamic Gaussian Processes and the Vanilla-SPDE Exchange [2.2] バニラ-SPDE交換は、GP推論の標準とSPDEの定式化の等価性を利用して、計算コストを改良したハイブリッドスキームを構築する。
複雑性解析と数値実験により,これらの成果を実証する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:51:24 GMT)
Tone-Conditioned Curriculum Learning for Low-Resource Bantu Speech Recognition [2.2] 南バントゥー語6言語のための音調条件付きカリキュラムフレームワークを開発した。
我々は,コミュニティコーパスのトレーニングを行い,一致した評価以上の堅牢性を測定するため,NCHLTへの移行試験を行った。
単一のモデルが6つの言語すべてに適合しないため、デプロイは言語毎にモデルの選択とコーパス間の検証をペアにすべきである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:23:25 GMT)
Readable but Not Controllable: Neuron-Level Evidence for Medical LLM Hallucination [2.1] 単純で慎重に調整されたプローブで幻覚を確実に検出できることが示される。
また、この信号は狭義に局所化するのではなく、分散され冗長であることを示す。
幻覚の緩和は、単に正しいニューロンを識別する問題ではないことを示唆する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:34:45 GMT)
ShellMaker: Language-Guided Exterior Completion under Structural Constraints [2.1] ShellMakerは言語誘導の外装補完フレームワークである。
PBR材料で完全な外装メッシュを生成する。
ShellMakerは、屋内ジェネレータ、CityGML、CAD入力に一般化する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:56:48 GMT)
Patch-PODiff-ViT: Structured Latent Diffusion with Patchwise POD for Super-Resolution and Uncertainty Quantification [2.1] Patch-PODiff-ViTは、潜在空間がパッチワイドな固有直交分解(POD)によって定義される構造的潜在拡散フレームワークである。
これにより、空間構造を保存し、視覚変換器を用いて構造された低次元潜在空間における効率的な拡散を可能にする、低次元の分散順序付きトークンが得られる。
海面温度、医用画像、自然画像を通して、実験的なアンサンブルと密に一致した良好な空間的不確実性を生成しながら、少ないパラメータと低いメモリで強力な再構成を実現する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:05:53 GMT)
Optimization Algorithms for Joint OFDM Waveform Design and RIS Configuration in 6G Networks: From Convex Relaxation to Foundation Models [1.9] 2021年から2026年にかけて発行されたOFDMRIS最適化について調査した。
標準化されたベンチマークは存在せず、クロスペーパー比較は実現不可能である。
合成ベースのベンチマークデプロイメントから6つのオープンな課題が浮かび上がっている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:34:46 GMT)
When the Database Fails: Prompting LLM Dialogue Agents for Safe Recovery in Task-Oriented Dialogue [1.9] 本稿では,リトレーニングや追加のモデルコールを伴わずにロバスト性を向上させる軽量なプロンプトベースのリカバリ手法について検討する。
我々は,構造化データベースの状態に照らしたガイド付きリカバリプロンプトを含む3つの応答戦略を比較した。
30.5%の障害がMultiWOZで、20.9%がSGDで幻覚する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:18:11 GMT)
Toward Hamiltonian simulations of Maxwell-Chern-Simons theory: constant modes and gauge field truncation [1.9] 2+1$次元のMaxwell-Chern-Simons理論(MCS)は、動的および位相的自由度の両方を持つ位相ゲージ理論のパラダイム的な例を提供する。
連続体で解析的に解けるので、理論の位相的性質が有限次元の格子ヒルベルト空間でどのように符号化されるかを理解するのに理想的なベンチマークを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 18:01:35 GMT)
Comparative Analysis of Machine Learning based Intrusion Detection in Realistic IoT Networks [1.9] IoTデバイスを使用するメリットはあるものの、いくつかの課題を提示している。
これらのデバイスが私たちの生活で果たす重要な役割を考えると、セキュリティとプライバシに関する問題に対処することが重要です。
これらのデバイスはリソースに制限されており、それらが管理するデータのセキュリティと保護を複雑にする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:43:25 GMT)
Failure-Based Testing for Deep Reinforcement Learning Agents [1.8] Prior Random Testingは、Deep Reinforcement Learning (DRL)エージェントの障害ベースのテスト手法である。
PRTは障害が発生しやすい領域を優先し、効率的な障害検出を容易にする。
PRTは、最初の失敗を見つけるコストとテストケースの多様性の両方の観点から、トップパフォーマーにランク付けします。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:05:29 GMT)
Automated Background Swapping for Robustness against Spurious Backgrounds [1.8] AutoBackSwapは、フォアグラウンドとバックグラウンドをアンタングルし、続いてインフィルして完全なバックグラウンドを合成し、最終的に異なるフォアグラウンドとインペイントされたバックグラウンドを組み合わせてトレーニングデータを拡張する。
パッチワイドなラベル付けによって、セカンダリネットワークをトレーニングし、課題の画像分類タスクの完全なトレーニングを自動で強化するのに、数百のサンプルだけで十分であることが分かりました。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:50:24 GMT)
LLM-Powered Interactive Robotic Action Synthesis from Multimodal Speech, Gestures, and Music [1.7] 本稿では,マルチモーダルな人間入力の豊富なタペストリーから複雑なロボット動作を合成する新しいフレームワークを提案する。
システムアーキテクチャは,音声の書き起こしモデル,ジェスチャー認識モジュール,ビート検出のための信号処理パイプラインを統合している。
このフレームワークは、音声からのセマンティックコマンド、ジェスチャーからのディスティック情報、音楽からのリズミカルキューを解釈し、融合する機能を備えている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:35:26 GMT)
Patient-Level Elbow Abnormality Detection: Leakage-Aware Evaluation of Learned Preprocessing, Calibration, and Triage-Oriented Operating Points [1.6] 本評価は, リーク・アウェア・プロトコルによる筋骨格異常の患者レベル検出に焦点を当てた。
複数の前処理パイプラインと、学習前処理コンポーネントとして軽量なDnCNNモジュールとを比較した。
その結果、前処理戦略の違いは控えめで構成に依存していることがわかった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:45:39 GMT)
A Large-Language-Model Supported Personalized Driving Framework for Lane Change in Highway Scenarios [1.6] 本稿では,高速道路車線変更シナリオを対象とした大規模言語モデル (LLM) によるパーソナライズドライビングフレームワークを提案する。
このフレームワークは、オープンソースのApollo自動走行スタックにおいて、自然言語駆動コマンドを実行可能な計画パラメータにマッピングする。
実験により、導出パラメータセットは識別可能なパーソナライズされたレーン・チェンジ動作を生成し、RAGは常に好みの解釈を改善していることが示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:58:21 GMT)
TallyTrain: Communication-Efficient Federated Distillation [1.6] フェデレーション学習は、2つの軸(モデルサイズとクラス数)で帯域幅が制限される。
クラスカウント軸を$lceil log C rceil$ bits per probe に分解し、各ピアの $argmax$ class index を送信します。
標準ベンチマーク全体では、TallyTrainは最大3桁の通信速度でソフトラベル蒸留にマッチまたは打ち勝つ。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:47:33 GMT)
TDGT: A Tabular Data Generation Toolkit supporting adaptive GPU-accelerated Bayesian mixture models, diffusion-based models, and latent-space generative modeling [1.5] TDGTは、合成データ生成と忠実度評価のためのWebベースのツールキットである。
Adaptive Bayesian Mixture Synthesizer (ABMS)は、最適な混合成分数を自律的に決定する新しいアルゴリズムである。
TDGTは、医療、社会経済モデリング、サイバーセキュリティドメインからのデータセットで評価される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:42:48 GMT)
TreeAgent: A Generalizable Multi-Agent Framework for Automated Bias Labeling in Forestry via Compiled Expert Rules and Vision-Language Models [1.5] 視覚言語モデル(VLM)を用いて専門家決定木を編成するマルチエージェントシステムを提案する。
我々は,多種多様な専門家定義決定構造にまたがるゼロ一般化を可能にするデカップリング宣言決定(D3)フレームワークを定式化する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:16:59 GMT)
Hybrid Topological Data Analysis and LSTM Networks for Enhanced Network Intrusion Detection Using CIC-IDS2017 Dataset [1.5] 本研究では,TDA(Topological Data Analysis)とLSTM(Long Short-Term Memory)ネットワークを組み合わせて,ネットワークセキュリティにおける異常検出を改善するハイブリッド手法を提案する。
CIC-IDS 2017データセットは280万以上のラベル付きフロー、77のネットワーク変数、14の攻撃カテゴリを含む。
我々のハイブリッドTDA+LSTMモデルは、AUCが1.000、F1スコアが1.000であり、5倍のクロスバリデーションにより平均AUCが1.000$pm$ 0.000、平均F1が0.999$pm$ 0.001である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:08:21 GMT)
The Remittance Blueprint: Data-driven Intelligence for Sri Lanka [1.4] この研究は、スリランカの32年間(1994-2025年)の移住と送金を分析した。
結果は、送金の流入は主に外的マクロ経済変数、特に為替レートのダイナミクスと国内指標よりも世界的な原油価格によって引き起こされることを示している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:47:29 GMT)
The Geometry of Refusal: Linear Instability in Safety-Aligned LLMs [1.4] 我々は、"拒絶方向"を分離するゼロ最適化フレームワークであるContrastive Logit Steering (CLS)を紹介した。
CLSは出力分布を直接操作し、アライメントの診断プローブとして機能する。
7つのモデルファミリーに関する実験により、安全実装がアーキテクチャ上決定論的であることが判明した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:48:55 GMT)
A Modular Vision-Language-Action Robotics Framework for Indoor Environments [1.4] 本稿では,CMU Vision-Language-Action Challengeのための統合システムを提案する。
自律エージェントは自然言語命令に基づいて複雑なタスクを実行できる。
このフレームワークは、環境マッピング、質問処理、ナビゲーションを編成するモジュラーアーキテクチャを採用している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:17:02 GMT)
Probing Memorization of Tabular In-Context Learning [1.4] 我々は、文脈に基づく予測とパラメトリック記憶の分離を目的とした探索フレームワークICLMEMを紹介する。
以上の結果より, 特定の状況下でのLTM記憶信号が得られた。
機密データを保護するには適切な措置を取らなければならない。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:40:36 GMT)
DEMUN: Fast and accurate discovery of music notation in very large collections [1.4] 偽陽性率0.015%の軽量な楽譜検出器DEMUNを提案する。
テストシナリオでは、1500ページの楽譜が発見され、全コレクションに最大2030,000件の無記名音楽生活の文書が含まれている可能性が示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:59:09 GMT)
Large Databases Need Small, Open-Weight Language Models [1.3] プロプライエタリなAPIを中心に構築された言語モデルは、トークンベースのコストモデルで運用されることが多い。
これは、LM強化演算子が1つの実験セットに対して10,000ドルを超えるコストを発生させることができる大規模なデータベースの文脈で高価になる。
我々は16GBのVRAMでローカルに動作する量子化されたオープンウェイトモデルが、低レイテンシでクローズドソースモデルと同等か、あるいは超えることを実証した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:25:10 GMT)
LLM-Driven Personalities for Decision Making in Emergency Simulations [1.2] シミュレーションされた避難シナリオ内の仮想人間における意思決定を促進するために,大規模言語モデルを用いた場合について検討する。
我々のゴールは、言語に基づくプロンプトを通して表現される性格が、個人の行動と集団シミュレーション結果の両方にどのように影響するかを評価することである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:15:22 GMT)
Modal CEGAR-tableaux with RECAR and resolution-based SAT-shortcuts [1.2] 本稿では,従来のRECAR手法を用いて,SATショートカットを用いてCEGAR-tableauxを拡張する2つの手法について検討する。
CEGAR-tableauxのC++実装であるCEGARBox++を用いた実験は、RECAR SAT-shortcutsを使用したCEGARBox++が競合しないことを示している。
SAT, tableaux, and resolution method for modal satisfiability, which is a first effective integration of SAT, tableaux and resolution method which are excellent performance than its parts。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:58:08 GMT)
State-dependent Gaussian gate set using an optical tweezer for trapped ions [1.2] 光ツイーザーで実現した40ドルCa$+$イオンの運動モードに状態依存ゲートをセットした。
ツイーザ強度と位置の動的制御により、局所変位、スクイーザング、位相空間回転、ビームスプリッタ演算が可能となる。
我々の研究は、捕捉されたイオン系における連続可変量子制御のための統一的で局所的な資源として光学的ツイーザを確立する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:54:54 GMT)
ATRIA: Adaptive Traceable ECG Reporting with Iterative Agents [1.1] textscATRIAは、臨床医の反復ワークフローを反映したマルチエージェントECGレポートシステムである。
報告書は、その証拠を裏付ける証拠、その証拠によって支持されないフラグ、および追加の文脈の中間を包含する全ての報告を束縛する。
クラウドベースのWebサービスとして、textscATRIAはすぐにデプロイできる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:07:59 GMT)
Consensus Clustering of Free-Viewing Gaze Data: New Insights into Human-Information Interaction [1.1] フリービューの視線データは、人間の視覚的注意を、リッチでタスクなしの窓を提供する。
この視線データの豊かさにもかかわらず、その人-情報相互作用(HII)パターンは研究されている。
本稿では、ガゼデータセットのコンセンサスクラスタリングのための、エンドツーエンドで教師なしのアンサンブル学習システムを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:26:30 GMT)
DOSE-I: A Multimodal Biosignal Dataset of Procedural Sedation for Endoscopy -- Technical Report [1.1] ゼノドに用いた内視鏡下鎮静術における多モード生体信号データセットDOSE-Iの特徴と技術的詳細について述べる。
DOSE-Iデータセットは、171レコードで78.5時間記録され、6.7分から70.8分(平均27.5分、SD:11.6分)の内視鏡的手順で記録されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:43:24 GMT)
LuxEmo: Expressive Text-to-Speech Corpus for Luxembourgish [1.1] 本稿では,Luxembourgishのための21時間会話表現音声コーパスLuxEmoを紹介する。
本稿では,音声活動の検出,認知,言語識別,LuxASRに基づくセグメンテーション,自動感情予測,語彙的手がかり,対象人間レビューを組み合わせた半自動キュレーションワークフローを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:53:15 GMT)
A Quantum-Classical Surrogate Model for the Collision Operator of the Lattice Boltzmann Method [1.1] 本稿では,LBMの非線形衝突ダイナミクスを近似するために,量子機械学習サロゲートモデルを用いたハイブリッドアプローチを提案する。
本結果は,古典解を忠実に再現しながら,ハイブリッドモデルが高精度かつ一般化可能であることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:47:36 GMT)
FlexTab: A Flexible Encoder-Decoder Architecture for In-Context Learning Across Diverse Tabular Tasks [1.0] 我々はFlexTabを紹介した。これは表データのコンテキスト内学習のためのフレキシブルエンコーダ・デコーダアーキテクチャである。
我々の設計は、広範囲の下流タスクで活用できるターゲット非依存の行埋め込みを生成する。
エンコーダとタスク固有のデコーダは、実世界の未ラベルのテーブルの大きなコーパスで訓練される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:03:28 GMT)
Calibrating the Evaluator: Does Probability Calibration Mitigate Preference Coupling in LLM Agent Feedback Loops? [1.0] 評価器のキャリブレーションを緩和する最初の研究について述べる。
キャリブレーションは結合係数ガンマを20-49%減少させる。
LLM-as-judgeデプロイメントパイプラインの軽量化として推奨しています。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:03:24 GMT)
REDI: Corpus Aware Patch Ranking for DINOv3 Token Reduction [1.0] REDIは、画像分類のためのパッチに固定トークンの予算を割り当てるにはどうすればよいか?
Rediは最終的なブロックDINOv3パッチ表現を視覚語彙に定量化する。
入ってくる注目質量に基づくRedi変種は、ImageNet-1Kで84.706%のTop-1精度を達成した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:54:40 GMT)
The Calibration Turn in AI-Assisted Research: A Conceptual and Methodological Framework for Evidence-Licensed Claims [1.0] 本稿では,AI支援研究におけるエビデンスライセンスクレームの概念的枠組みを開発する。
仮説生成、モデルによる結果導出、外部検証、信条更新、クレームキャリブレーションの5つの演算子としてAI支援研究を表現している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:46:54 GMT)
Quantum Thermodynamics of Electron Transport along Chains of Redox Centers [1.0] 生体系における分子内電子輸送は、一般的に拡散ホッピング過程として記述される。
非自明な量子力学的効果は、特定の生体分子過程における輸送力学において機能的な役割を果たす。
開系力学の量子力学モデルをリンドブラッド方程式により重要な生物学的成分に拡張する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:41:01 GMT)
Full-Wave Green's-Function Modeling of Collective Single-Photon Emission in Non-Markovian Open-System QED with Finite-Bandwidth Compensation of Dispersive Interactions [1.0] この研究は、複雑な電磁構造に埋め込まれた量子エミッタからの単一光子放射をモデル化するためのフルウェーブグリーンの関数フレームワークを示す。
スペクトル密度の有限帯域切断は、コヒーレント分散相互作用における系統的な偏差をもたらすことを示す。
ベンチマーク構成から有限要素法による3次元分散リング共振器構造に至るまでの数値例を示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:24:56 GMT)
Improving multichannel speech enhancement through accurate room-acoustic simulations [1.0] 高忠実度データセットのトレーニングは、低忠実度データセットと比較して、中央値の単語誤り率を最大38%削減する。
これらの結果から,高忠実度室内音響シミュレーションによる拡張は,直接的に多チャンネル音声強調性能を向上させることが示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:10:29 GMT)
A Three-Phase Foundation Model for Tax-Aware Personalized Portfolio Management [0.8] ポートフォリオ管理をパーソナライズする3段階の深層強化学習システムを提案する。
フェーズ1は、マルチアセットコーパス上の自己教師型学習を通じて、ティッカー・アイデンティティフリーのクロスアセット・エンコーダを事前訓練する。
フェーズ2は、PPOによるMOE(Mixture of Experts)ポートフォリオアクターを客観的な報酬の下で微調整する。
フェーズ3では、各個人に対して推論時にさらに適応した、軽量なパーソナライズ層が追加される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:19:59 GMT)
Practical High-Fidelity Novel-View Synthesis of Mounted Lepidoptera [0.8] バタフライは、自然史のコレクションの中でも最も印象的なもののひとつです。
小型で脆く、細い毛と静脈構造を持つ。
これらの標本を全方向から視認可能な写真リアルな3Dモデルに変換するために、エンドツーエンドのパイプラインを導入する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:56:26 GMT)
Mnemosyne: Agentic Transaction Processing for Validating and Repairing AI-generated Workflows [0.8] エージェントトランザクション処理は、宣言された実行可能な制約セットCの下で決定論的入力をパスするまで、生成されたアクションを信頼できない提案として扱う。
MnemosyneのATPは、追加のみのトランジションログ、有効状態のプロジェクション、依存性の安全な補償、アクティブなコミットレコードを備えたランタイムである。
再現可能なアーティファクトは、有効な処理を6%以下のプロジェクション・アンド・バリデーションオーバーヘッドで認めながら、9つのファルシフィケーションテストを対象とする違反を拒絶する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:33:16 GMT)
Constrained Online Convex Optimization without Slater's Condition [0.8] 制約に対しては、ほぼ最適な後悔と制約違反境界を達成する既存のアルゴリズムは、スレーターの条件のような規則性仮定に依存するのが一般的である。
このギャップを、アダプティブ・レギュレータをデュアルアップデートに組み込んだ、任意のプリミティブ・デュアルフレームワークで埋めます。
我々のアルゴリズムは、$O(sqrtT)$期待後悔と$O(sqrtTlog T)$期待累積制約違反を達成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:54:41 GMT)
FROST: Training-Free Few-Shot Segmentation with Frozen Features and Nonparametric Statistics [0.8] 短いショットセグメンテーションでは、クエリイメージのターゲットクラスを、注釈付き例のほんの一握りの例から記述するよう、モデルに求めている。
凍結したDINOv3特徴の単位球面上の2点の雲として、基準フォアグラウンドと背景を扱い、トレーニング不要な小ショットセグメンタであるFROSTを紹介する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:06:06 GMT)
Building an ASR Solution for Training and Assessing Children's Reading [0.7] 本研究では,バンバラにおける児童の読書評価のためのオープンソースシステムを提案する。
モバイル・コレクション・アセスメント・アプリは60人の子供から55時間の生読み音声を収集するために使用された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:24:17 GMT)
On Optimal Data Splitting for Split Conformal Prediction [0.7] 分割共形予測における最適なデータ分割のための理論的枠組みを開発する。
一般的な結果が、よく使われる回帰設定にどのように特化しているかを示す。
本分析は,モデルに関連した特徴が,トレーニングとキャリブレーションの間のサンプルの最適割り当てをどのように支配するかを明らかにする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:49:44 GMT)
WIDER-FAIR: An Annotated Version of the WIDER-FACE Dataset for Fairness Evaluation [0.7] WIDER-FACEベンチマークをベースとした新しい顔検出データセットを導入し,各顔の民族性や性別を手動でアノテートする。
このデータセットには、アジア、黒人、インド、白人の4つの民族グループに注釈付けされた16,256の画像と、2つの性分類が含まれている。
我々は,黒人の顔に対する検出性能が顕著に低下していることを示し,このグループをトレーニングから除外することは,他のどの民族グループも除外するよりも公平性の違いを増大させることを示した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:10:42 GMT)
Simulation of Two-qubit Gate Variability and Fidelity of Spin Qubits Built on Nanosheet Technology [0.7] 2ビットのエンタングルメントゲートの忠実度が低いことは、大規模な統合にとって重要な障壁である。
シリコン・オン・絶縁体プラットフォーム上でシリコンスピン量子2量子ゲートの最近のシミュレーションが行われた。
ナノシートベースの電荷量子ビット処理は単一量子ビット演算に限られている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:55:03 GMT)
FlexViT: A Flexible FPGA-based Accelerator for Edge Vision Transformers [0.7] 資源制約のあるエッジデバイス上での効率的なViT推論のための再構成可能なFPGAアクセラレータFlexViTを提案する。
本稿では,実行時にコンピュータアレイを再構成することで,入力と重量の再利用を切り替えるデュアルモードデータフローを提案する。
PYNQ-Z2 FPGA 上で FlexViT を実装し,それを代表的な ViT モデルで評価する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:43:02 GMT)
Phantom: A Unified Face-Swap Deepfake Protection Framework with Latent and Spatial Constraints [0.7] フェイススワッピングのディープフェイクは、不正なID操作を可能にすることによって、個人のプライバシーに対するエスカレートな脅威となる。
我々は,潜伏領域と空間領域の摂動を協調的に抑制する統合型フェイススワップディープフェイク保護フレームワークPhantomを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:10:38 GMT)
Temporal Training Strategies for Left Atrium and Left Atrial Appendage Segmentation in Dynamic Contrast 4DCT [0.6] 動的4DCTにおいて、時間的トレーニングセット設計がLAとLAのnUNetベースセグメンテーションにどのように影響するかを検討する。
すべてのフレームでのトレーニングは、低コントラストの初期の段階で最高のパフォーマンスを得た。
完全なデータセットから派生した正規化パラメータを適用することで、低コントラストフレームでのデータセットの削減のパフォーマンスが向上したが、ギャップを完全に埋めることはできなかった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:21:29 GMT)
ComplianceGate: Classifier-Gated Multi-Tier LLM Routing for Inference in Regulated Industries [0.6] ユーザクエリのPIIは、システムがそのデータが管轄区域を離れるべきかどうかを決定する前に、モデルエンドポイントに到達することができる。
本稿では,設計によるコンプライアンスを強制する分類器ゲート型ルーティングアーキテクチャを提案する。
単純なクエリは、ほんの少しのコストで、小さくて高速なモデルに到達します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:49:50 GMT)
Planar-SfM: Camera Pose Estimation via Homography Graph Embeddings [0.6] 各平面面は、ホモグラフィ分解により、相対カメラの相対的なポーズを独立に推定する。
本稿では、ホモグラフィー推定からポーズグラフを構築し、スペクトル埋め込みを用いて信頼できないエッジを識別・フィルタリングする新しいグラフベースのアプローチを提案する。
IMC Phototourismベンチマークの制約のない屋外シーンにおいて,既存の手法が苦戦しているバスケットボールコートイメージに優れたパフォーマンスを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:18:27 GMT)
Von Mises Based Uncertainty Quantification for Closely Spaced Automotive Radar Targets [0.5] 本研究は,自動車レーダの到達方向推定(DOA)に対する不確実性を考慮した深層学習手法について検討する。
円形のvon Mises(VM)アンサンブル(ENS)を、通常の逆ガンマ定式化に基づく明らかな深層学習(EDL)フレームワークと比較する。
ENSは名目条件下では低い不確実性を実現し、重度の摂動に対して強い感度を示す一方、EDLはよりスムーズな不確実性変化とわずかに改善されたランキング整合性を提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:49:45 GMT)
A Large-Scale Empirical Evaluation of MMAO Under Fair-Budget Continuous and Discrete Benchmarks [0.5] この研究は、MMAOのクローズドループリソース割り当ての原則が、より広く、より標準的で、より明確な予算管理のベンチマークの下で、信頼性が保たれているかどうかを問うものである。
我々は、MMAOを、エビデンス・プレッシャーの下で内因性資源の再分配を最も明確に検証した、ベンチマークベースのクロスドメイン適応フレームワークとして位置づける。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:38:13 GMT)
Symmetry-Structured Neural Completion of Islamic Geometric Patterns from Sparse Control Geometry [0.5] イスラームの幾何学的パターンは、正確な回転対称性と厳密な構成規則によって支配される。
本稿では,これらのルールを形式的幾何学的知識として扱い,ニューラルネットワークに組み込む。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:12:12 GMT)
Machine Learning based Optimization of CV-QKD Under Practical Constraints [0.5] 我々は,送信機パルス整形と受信機整合フィルタリングを協調的に最適化する,機械学習に基づくエンドツーエンド最適化フレームワークを開発した。
モードミスマッチの軽減と実装制約の考慮により,提案手法はシステム全体の性能を向上させる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:50:39 GMT)
Floquet Quasienergy-Resolved Dissipation, Dynamics, and Spectroscopy in Ultrastrong Cavity-QED [0.4] 強駆動オープンキャビティ-QEDシステムのための非正則フロケ一般化マスター方程式フレームワークを提案する。
我々の理論は、開超弦結合キャビティ-QEDにおけるフロケット駆動力学をモデル化することができ、幅広い量子状態制御を実証することができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:04:20 GMT)
Evil Spectra: How Optimisers can Amplify or Suppress Emergent Misalignment [0.4] その結果,オプティマイザの選択が最大効果を示し,不適応率を7倍に向上させることがわかった。
驚くべきことに、モデルサイズはQwen3ファミリーの中で無視できる効果を持つ。
トレーニング力学は、各オプティマイザが損失配向空間を通して異なる軌道に従うことを示した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:42:23 GMT)
Improving Perturbation Theory with the Sum-of-squares II: Large Density-Density Terms [0.4] 摂動理論は、この2乗和における立方体作用素の有用な選択を生成するために用いられた。
この方法は2乗の次数6の和の断片に過ぎず、全四乗の和をスピードと精度の両方で上回ることができた。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:53:00 GMT)
Towards Inclusive Mobility Modeling: Characterizing and Evaluating Elderly Trajectory Patterns in Urban Systems [0.4] 人口密度の低い集団、特に高齢者は、しばしば公共の移動データセットで疎結合に表現される。
本研究では,未表現サブグループのモビリティ・シグネチャの欠如がモビリティ・モデリングに与える影響を定量的に検討した。
その結果,高齢者の移動行動の体系的誤表現は,多数派に支配される集団で訓練されたモデルであることが示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:39:02 GMT)
EVOTS: Evolutionary Transformer Search for Time Series Forecasting [0.4] 本稿では、時系列予測(EVOTS)のためのタスク適応型トランスフォーマー様モデルを見つけるための進化的ニューラルネットワーク探索フレームワークを提案する。
アーキテクチャはモジュール型のゲノム表現を用いて符号化され、注意、フィードフォワード、投射部品の柔軟な構成を可能にする。
提案手法は,ETTファミリーの4つのベンチマークデータセットを用いて評価する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:29:34 GMT)
Estimating Supply Incrementality in Two-sided Marketplaces: A Causal Machine Learning Approach [0.4] 本稿では、追加供給とマーケットプレース結果の関係を推定するための因果機械学習アプローチについて検討する。
Airbnbのマーケットプレースを例に挙げて,追加のリスティングサプライが全体の予約に与える影響に注目しています。
このようなモデルにより、マーケットプレースが追加供給に返却し、サンプルのパフォーマンスが向上するという、妥当な見積もりが得られます。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 00:23:00 GMT)
Evaluation of Population Initialization Methods for Genetic Programming-based Symbolic Regression [0.4] 遺伝的プログラミングの初期集団(GP)を記号回帰(SR)に最適化する手法が解の精度と複雑さに与える影響を解析する。
複雑性の異なる12の合成問題と1つの実世界のデータセットを比較した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:28:37 GMT)
CORTEX: Token-Level Hallucination Detection in RAG via Comparative Internal Representations [0.4] 検索型拡張生成(RAG)のためのトークンレベルの幻覚検出手法であるCORTEXを提案する。
CORTEXはトークンレベルで未解決のコンテンツを識別し、幻覚の微細な局所化を可能にする。
2つのRAGベンチマークと3つのLCMによる実験により、CORTEXはトークンレベルの幻覚検出を大幅に改善することが示された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:04:24 GMT)
Autonomous UAV Navigation for Individual Wildlife Re-Identification [0.4] 本稿では、下流のre-IDに対して、画像キャプチャーを積極的に最適化する自律型ドローンナビゲーションシステムを提案する。
このシステムは、YOLOv11オブジェクト検出とDINOv2ベースのポーズを組み合わせて、リアルタイム飛行決定を導く。
本手法はキリン,トラ,ゾウなどの診断面パターンを持つ他の種に一般化されていることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:56:04 GMT)
AxDafny: Agentic Verified Code Generation in Dafny [0.3] 本研究では,ダフニーにおけるエージェントコード生成について検討する。そこでは,モデルが検証のために実行可能なコードと証明可能なアーティファクトの両方を生成する必要がある。
AxDafnyは,実装,不変性,アサーション,終了引数を反復的に生成するバリデーション誘導修復フレームワークである。
またLiveCodeBench-Pro-Dafnyという,250の競合型プログラミング問題のベンチマークも導入した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:39:43 GMT)
Benchmarking Frontier LLMs on Arabic Cultural and Sociolinguistic Knowledge: A Cross-Evaluation Framework with Human SME Ground Truth [0.3] クロス評価フレームワークは、エジプト語とイラク語という2つの未表現のアラビア語方言のコミュニティをインスタンス化した。
提案手法は,母国語話者が作成した103組のプロンプト・ルブリックペアをコントリビュートする。
1,307人の審査員: GPT-5.4は最も信頼できる裁判官(MADj = 10.21 pp, Signed Error = -1.12%)である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:18:32 GMT)
A Contextual-Bandit Oversight Game with Two-Sided Informational Asymmetry [0.3] 我々は、プライベート情報が両方の方向に流れるとき、AIエージェントのランタイムヒューマン監視について研究する。
これは、自律ロボットやソフトウェアエージェントが人間の監督者が直接評価できない状況を検査した時に自然に発生する非対称性の一種である。
両面の非対称情報とプレイ/アズク/トラスト/オーバーシーインタフェースを備えたコンテキストバンド型チームゲームを導入する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:30:01 GMT)
A Category Theory Account of AI Identity [0.3] 我々はAIアイデンティティのカテゴリー論的形式化を開発する。
弱い解釈は信頼の平等としてのアイデンティティを回復させる。
強い解釈は、相互に信頼を保つための到達可能性を必要とする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:54:36 GMT)
Radial Suppression Accelerates Algorithmic Generalization: A Geometric Analysis of Delayed Generalization [0.3] 本稿では、一般化が構造された低次元回路の発見を必要とするタスクにおいて、暗記-一般化遅延は、クロスエントロピー最適化の下で隠蔽表現の半径インフレーションによって引き起こされることを示す幾何学的ケーススタディを示す。
活性化空間力学の放射角分解を形式化し、(i)半径インフレーションのペナル化が異方性、データ依存的な重み規則化を誘導する、(ii)等方的ランダムベースラインの下の放射エネルギーを抑制し、主に角の更新を強制する、(iii)平坦なミニマに向けて収束をバイアスする、という3つの証明可能な命題を導出する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:34:13 GMT)
Probe Choice Changes Canary-Memorization Verdicts: Three Post-Hoc Disagreement Case Studies in a Text-Dominant LoRA-Tuned Autoregressive Testbed [0.3] 我々はQwen2.5-VL-7Bカナリアテストベッド上で,固定プレフィックスウィンドウデコイNLLプローブ(K)を検査した。
フルスパンシークレット NLL やgreedy exact-recall と一致しない,ホック後の3例を報告します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:58:05 GMT)
Stop Pretending Social Robots Are Inevitable [0.3] 近年のRO-MANとHRIは、未来の人間ロボット社会を必然的に描いている。
本稿では, RO-MAN と HRI の両会議の最近のテーマに, 未来のロボット社会を必然的に表現するための課題を提起する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:19:56 GMT)
Digital Sovereignty as a Quality Attribute for Software Architectures [0.3] デジタル主権(DS)は、欧州連合(EU)を含む世界中の重要な概念と政治課題である。
本稿では、クラウドコンピューティングの文脈におけるソフトウェアアーキテクチャの品質属性としてのデジタル主権の分析と、それに対するEUの政策フレームワークについて述べる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:41:31 GMT)
Electrons on Helium and Entangled Quantum Sensors for Particle Physics [0.3] 量子コヒーレンスと絡み合いを利用する量子センサーは、粒子物理学を含む多くの分野において強力なツールとして登場している。
液体ヘリウムの表面に閉じ込められた電子は 将来有望な量子コンピューティングとして 現れました
本稿では,超流動ヘリウム上の電子量子ビット対を用いた粒子物理実験のためのセンサの概念を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:13:30 GMT)
Interface-Variant Dynamics in Software Ecosystems: Resolver-Induced Selection and Adoption in Package Graphs [0.3] 本稿では,その観察が進化的レバーベリングではなく,負荷を伴うソフトウェア工学的推定器であるかどうかを問う。
インターフェースヒストリー,監査npm,Central,PyPI,crates.ioパッケージグラフ,パッケージマネージャリゾルバプローブの実行2100,クリーンコンフリクト確率からエコシステム固有の選択$s$を推定し,その測定値$s$を用いて,観測パッケージグラフ上のペアワイズ対応吸収過程を前方に評価する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:29:39 GMT)
Characterization of Unlearnable Noise with Mid-Circuit-Measurement-Based Cycle Benchmarking [0.3] 本稿では,パウリの忠実度と非マルコフ雑音を,繰り返し測定と古典的後処理によって学習可能にするフレームワークを提案する。
従来は学習不可能な雑音成分を特徴付けることが可能であることを数値的に示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:12:46 GMT)
Explicit Fuzzy Logic in the Feed-Forward Layer: Self-Forgetting Quantifiers Discover Legible Grammatical-Licensing Detectors [0.3] NC-FFNはGELUベースラインのパープレキシティを結び、各ユニットは明示的な論理形式を持つ。
どちらも、シーケンス量子化器の小さなブロックで解決する。
その結果、パラメータニュートラルな言語モデル品質トランスが実現した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:46:27 GMT)
Resolving superposition in AI for interpretability and cross-modal alignment in patient-neuronal images [0.3] 患者由来のパーキンソン病と健常ニューロンの10万枚以上の多重画像に基づいて訓練したスパースオートエンコーダを用いて重畳を解決する。
このアプローチは、解釈可能な潜在表現解析に移行することにより、特徴属性の数学的非特異性をバイパスする。
GW-mapを導入し,Gromov-Wasserstein の最適トランスポートを利用して,これらの画像表現を真正な scRNA-seq データemphde novo と整合させる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:22:35 GMT)
EnclaveX: End-to-End Confidential AI with CPU/GPU TEEs [0.3] 大規模言語モデル(LLM)は急速に普及し、AIアプリケーションの普及を促している。
ほとんどのデプロイメントは、Microsoft Azure、Google Cloud、AWSなどの集中型インフラストラクチャに依存しており、ユーザは機密データやトレーニング、微調整コードを共有する必要がある。
クラウドプロバイダは機密性と整合性を確保するために信頼しなければなりません。
我々は、(Intel TDXとAMD SEV-SNPによる)VMレベルでの機密性と整合性を保証するメカニズムとアプリケーションレベルでのアプリケーションレベルのセキュリティを保証するメカニズムを提案し、管理者が機密VMコンテンツにアクセスする能力などの脆弱性を強調した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:35:28 GMT)
SpikeLogBERT: Energy-Efficient Log Parsing Using Spiking Transformer Networks [0.3] SpikeLogBERTは、エネルギー効率のよいログ解析のためのスパイクニューラルネットワークフレームワークである。
提案モデルは,BERT教師モデルからの知識蒸留とスパイキングトランスフォーマーアーキテクチャを統合した。
HDFSデータセットの実験では、SpikeLogBERTがANNベースのニューラルログ解析モデルを上回っていることが示されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:59:58 GMT)
Measuring & Mitigating Over-Alignment for LLMs in Multilingual Criminal Law Courts [0.3] スイス連邦最高裁判所は、4つの公用語をまたいだ仮訳と短距離通訳の要約に小さなオンプレミスモデルを使用している。
本稿では,スイス最高裁判所の判決に基づく刑事法翻訳と要約のベンチマークであるTF-RefusalBenchを紹介する。
次に、TF-RefusalBenchを用いて、オーバーアライメントが処理中のモデルとプロンプトおよびテキスト言語の影響を受け、多面的現象であることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:22:05 GMT)
Distributed Hierarchical Temporal Memory with Shared Associative Memory for Cross-Entity Preemptive Warning [0.3] 本稿では,クロスエンタリティプリエンプティブ警告を可能にするニューロモルフィックフレームワークである分散階層時間メモリ(D-HTM)を紹介する。
D-HTMは、観測結果を共通のスパース分散表現空間に投影する空間プールと、エンティティ固有のダイナミクスをオンラインで学習するテンポラルメモリモジュールと、繰り返し発生するプリアノマリーシグネチャを格納する共有連想メモリを組み合わせる。
関連するエンティティ間で事前知識を再利用することにより、D-HTMは、HTMのオンライン学習能力を保ちながら、局所的な異常発生前に警告を発することができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:11:01 GMT)
Interface-Aware Neural Newton Preconditioning for Robust Cohesive Zone Model Simulations [0.2] 難しい結合性ゾーンモデル(CZM)のためのインタフェース対応ニューラルニュートンプレコンディショナー(IA-NNP)
IA-NNPはルールベースのインタフェースリフトとして手動NR修正をリキャストし、それを学習された状態依存インタフェース修正に一般化する。
テストでは、標準のNRや手動のNR修正よりも、コンバージェンスの改善、分岐回復の改善、障害の少ないことが示されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:30:15 GMT)
Towards a foundational model for recognising diastematic Gregorian notation [0.2] 我々は、S-GABC提案に基づく共通符号化を設計し、4つのデータセット全てをこの共通符号化に変換する。
われわれは、四つのデータセットにまたがる新しい最先端のアートを確立する、糖尿病のグレゴリオ語表記のための、エンドツーエンドの共通基盤モデルを訓練する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:26:32 GMT)
Deep Spectral Models for Robust Dental Shape Generation [0.2] ToothForgeは、コンパクトで本質的な表現から歯冠の幾何学をモデル化するディープスペクトル生成フレームワークである。
スペクトル領域で操作することで、TothForgeはシンクロナイズドスペクトル埋め込みを通して3次元歯形の潜在多様体を学習する。
以上の結果から,TothForgeは空間的アプローチに匹敵する,あるいは超越した再現性と生成性能を達成できることが示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:10:05 GMT)
A Tutorial on Autonomous Fault-Tolerant Control Using Knowledge-Grounded LLM Agents [0.2] 本稿では,Large Language Model (LLM) エージェントが障害回復決定をどのようにサポートするかを検討する。
提案フレームワークは,LSMを制約付き監督プランナとして扱う。
植物固有の知識を使ってリカバリアクションを提案し、すべての提案は外部のバリデータによってチェックされる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:19:45 GMT)
Radical-Fragment Many-Body Expansion for Linear Alkane Quantum Chemistry [0.2] 線形アルカンの量子化学のための2体レベル(MBE2)にラジカルフラグメント多体展開を導入する。
MBE2分解は、C26H54(368から30キュービット)の12.3倍の量子ビットの減少と、対称性によるユニークな計算の12.8倍の減少を達成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:24:40 GMT)
An efficient Pauli decomposition algorithm for structured matrices [0.1] 我々は、行列が$k = Mathsfpoly(n)$ Pauli文字列のみをサポートすることが保証されるパウリ分解問題の公約バージョンを考える。
この空間性を生かし、パウリ分解の精度を少なくとも1-$の確率で再現するランダム化された古典的アルゴリズムを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:57:07 GMT)
Automating Cause-Effect Specification with Knowledge Graphs and Large Language Models [0.1] 本稿では,C&Eロジックの生成を自動化するセマンティックAIフレームワークを提案する。
このフレームワークは知識グラフ(KG)と制約付き大言語モデル(LLM)レイヤを組み合わせる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:03:46 GMT)
Classroom Behavior Monitoring with YOLO An Empirical Study in Higher Education Settings [0.1] 本研究では,ベトナム銀行学院で収集された教室ビデオの実際のデータセットを紹介する。
コンピュータビジョンモデルの評価と比較が行われ、YOLOv11は最高の性能を達成した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:53:55 GMT)
From Signals to Structure: How Memory Architecture Drives Language Emergence in LLM Agents [0.1] ルイス信号ゲームでは、送信側と受信側は、その相互作用履歴のみを使用して、コード上で調整しなければならない。
LLMエージェントを用いて,チャネル構成の異なる5つのメモリアーキテクチャについて検討した。
メモリアーキテクチャは、エージェントがインタラクション履歴を安定した規約に変換するかどうかを決定する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:20:41 GMT)
Entangled photons from para-positronium decay: Do coincidences from scattered photons imply a Bell state? [0.0] スピンゼロの場合(パラポジトロニウム)の2つの光子が最大絡み合ったベル状態に放出されることを確認するために、偏光依存のコンプトン散乱がどのように用いられるかを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:26:51 GMT)
Pauli Weight Hamiltonian Term Selection for Optimized Machine Learning Based Quantum Error Mitigation [0.0] パウリ重みの事前知識による量子エラー緩和(パウリ重み量子エラー緩和(Pi-QEM))
パラメータ化量子回路におけるばらつきと局所性の関係を利用して、Pi-QEMは支配的で低重量のパウリ弦の小さな部分集合を訓練する。
ノイズの多いIBM量子バックエンド上の分子系の数値シミュレーションにおいて、Pi-QEMは1つの支配的な局所観測値を使用して、基底状態のエネルギー推定誤差を最大34.01%削減する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:24:45 GMT)
Would You Marry Superintelligence? [0.0] そのような地位の付与は社会的に不当な結果をもたらすと私は主張する。
社会法的機関としての結婚は、私的な合意を批准する以上のものだ。
法律は、人間とAIの親密な関係から生じるニーズを抑えるために、標的となる権利と保護を彫るべきである。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:56:48 GMT)
Witness Complexity of Short Descriptions: A Cryptographic Perspective [0.0] 本稿では,チューリングマシン上での弦に近い記述に対する最小実行時間(gam(x))を導入することで,そのギャップを定式化する。
第2部では,鍵や証明書の使い勝手の指標として,文法サイズと導出コストの非条件的ギャップを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:02:35 GMT)
Wisdom Of The (AI) Crowd: Investigating Artificial Swarm Intelligence In Large Language Models [0.0] 大規模言語モデル (LLM) が人工群による群知能効果を近似できるかどうかを検討する。
960個のプロンプトを3つのプロプライエタリモデルで手動で実行し,制御実験を行った。
その結果, モデル内およびモデル間アグリゲーションによる一貫した誤差低減が得られ, 最大37ポイントの誤差低減が得られた。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:30:53 GMT)
Wide-field NV magnetometry under simultaneous high-pressure and high-temperature conditions [0.0] 高圧・高温同時条件下での広視野光磁気共鳴(ODMR)を実証した。
さらに, 7 GPa, 500 Kで鉄の広視野ODMRを行い, 試料からの成層磁場を圧力セルを通して空間的に可視化した。
これらの結果は、高圧・高温環境下での材料中の磁気現象を撮像するための有望なプラットフォームとして、NV中心磁気メトリーを確立した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:24:05 GMT)
Who Determines the Meaning of an Emotion? Affective Sovereignty as an Epistemic Consequence of Measurement Limits [0.0] 感情を感知するAIは、車、家電、対話エージェント、社会インフラに急速に組み込まれつつある。
しかし、この領域における中心的な規範的疑問は、まだ未解決のままである: 自分自身の感情の意味を決定する最終的な権限を持つ者はいるのか?
感情AIは高信頼点ラベルを割り当て、集約レベルで実差を識別できるが、個々のインスタンスに対する意味分布の既約成分は推定できない。
これらの結果は,感情の設計,評価,規制は,AIのコアに精度の最大化ではなく,解釈権限の明示的な割り当てを置くべきであることを示唆している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:19:02 GMT)
When to Truncate a Feature Ranking: A Residual-Overlap Stopping Rule for Subset Selection [0.0] 本稿では,教師付き特徴ランクをクラスに依存しないサブセットに変換するための分散フレームワークを開発する。
高次元ゲノムデータセットに対する実証的な比較は、この規則が数万の変数を数ダースに削減できることを示している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:00:29 GMT)
When Shortest Isn't Safest: A Design Science Approach to Senior-Friendly Pedestrian Routing [0.0] 高齢者の自立移動は、在宅での参加、幸福と健康を可能にするが、歩行者ナビゲーションシステムは主に距離や時間に最適化されている。
本研究は,デザインサイエンス・リリサーチによって開発された,高齢者に優しい歩行者用ルーティングアーティファクトについて紹介する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:48:46 GMT)
Wavefunctions localization, and the Wigner's Friend Paradox in a Framework of Discrete-Space Hypothesis [0.0] 量子力学の枠組みの中で、ウィグナーの友パラドックスの解法を示す。
We show that Wigner and his Friend produce a Definite reading through independent application of the collapse mechanism。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:26:50 GMT)
Wave-particle duality as an uncertainty relation for the average confidence width [0.0] 信頼幅$_c x(_x)$ -- 確率の分数$_x$を持つ最小の位置間隔 -- は、すべてのレベルの平均値を示す。
Bialynicki-Birula-Mycielski関係の平均エントロピー論は厳密な$cge/e$を与えるが、達成可能な定数$cast$はフーリエ不変作用素 $|x|+|p|$ の基底状態によって設定される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:19:35 GMT)
Velocity of a Quantum Particle in a Classically Forbidden Region [0.0] Sharoglazovaらは、ポテンシャルステップの古典的に禁止された領域における量子粒子の速度を決定する手順を提案した。
速度は、ボヘミア力学と標準量子力学が同一の予測を行う結合導波路の粒子集団から推定される。
速度推定は、ボヘミア力学と標準量子力学の両方に従って、関連する(エバネッセント的な)体制で失敗する仮定に依存していることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:41:50 GMT)
Variable Bound Tightening for Nash Equilibrium Computation in Multiplayer Imperfect-Information Games [0.0] マルチプレイヤー不完全情報ゲームにおけるナッシュ均衡の近似手法を提案する。
非線形相補性定式化におけるスラック変数と乗算変数の有限境界を導出する。
提案した境界が3人プレイヤのクーンポーカーの正確なナッシュ平衡に与える影響を実証する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:59:44 GMT)
Unresolved-Sideband Optomechanics with Hexagonal Boron Nitride: Induced Transparency, Gain, and Frequency Combs [0.0] オプトメカニカルインダクタンス(OMIT)は通常、解決されたサイドバンド体制でモデル化され研究される。
そこで本研究では, 半角形窒化ホウ素 (hBN) ドラム共振器に結合した繊維系ファブリペロマイクロキャビティを用いて, この状態におけるOMITについて検討する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:47:25 GMT)
Uncertainty-Aware Last-Layer Adaptation of RETFound for Referable Diabetic Retinopathy Screening Under Dataset Shift [0.0] 本論文は糖尿病網膜症スクリーニングにおける不確実性を考慮した最終層適応の安全性を考慮した実験的検討である。
我々は,キャッシュ式ソフトマックスヘッド,熱後温度スケーリング,変分ベイズ型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラプラス型ラバート型ラバー型ラ型ラスト型ラプラス型ラプラス型ラプラス型
APTOSでは、不確実性を認識した操作ポイントは感度と選択的リフレラルな振る舞いを改善した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:10:58 GMT)
Uncertainty Quantification for AI-Driven Crash Simulation Surrogates: A Comparative Study of Monte Carlo Dropout and Deep Ensemble on Open-Source Bumper Beam Benchmark [0.0] 機械学習のサロゲートモデルは、エンジニアリング製品開発においてますます研究されている。
付随する不確実性推定のないポイント予測は、モデルを信頼すべきでないことをエンジニアに知らせることができない。
この研究は、広く使われている2つの不確実性定量化アプローチの頭と頭の比較を示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:45:41 GMT)
Topological zero-reflection points in multi-terminal quantum wire junctions [0.0] 非相互作用型多端子量子ワイヤ接合における散乱について検討する。
二面対称性を持つ接合は、N ge 4$端末に対して正確なゼロ反射点を示すことができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:40:39 GMT)
The limits of erasure-based postselection for quantum error mitigation [0.0] 古典的および量子的誤り訂正では、隠蔽された消去は非隠蔽された一般的な誤りよりも寛容であることが知られている。
本研究は,ポストセレクションを誤り軽減の手法として利用することにより,近い将来にこれらの「消去キュービット」を活用することを検討する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:51:59 GMT)
The contact temperature of arbitrary quantum states [0.0] 温度計との結合による熱流について検討した。
温度計は、有限次元量子系の任意の状態に対して一意な接触温度が得られるという点で普遍的である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:11:32 GMT)
Temporal-Plane Carroll--Schrödinger Dynamics and Vortex Sectors in (2,2) Klein Space [0.0] 平面クライン空間におけるポストカルロリアン・シュルディンガー力学をシグネチャ$(2,2)$で導出する。
正規ベッセルモード、ガウスパケット、発振器スペクトル、半径 $SU (1,1)$ Tower, equal-$r$continity equation, $mathfraksch(2)$ symmetric algebra, and the metaplectic organization of the quadratic sectors。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:24:54 GMT)
TCL4 Asymptotic Redundancy and Canonically Consistent Master Equations [0.0] 複雑な4階タイムコンボリューションレス (TCL4) 集団発生器が比較的単純な2階定常状態補正を再現した理由は不明である。
さらに驚くべきことに、そのような精度の定常状態補正は、単純な仮想コヒーレンス経路に圧縮することができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:18:35 GMT)
Surprise as a Signal for Plasticity and Metacognition [0.0] 予測エラー信号は可塑性のゲートとして機能し,メタ認知の基盤として機能する。
本稿では,両システムを概念実証として明示的な制約で報告し,近年のエピソード・メモリとパーソナライズド・VLMの作業に対して第2位と位置づける。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:14:04 GMT)
Suppressing Parametric Instabilities in Driven Bosonic Lattices through Multi-tone Control [0.0] 周期的に駆動される量子系は、効果的なハミルトニアンおよび合成バンド構造を調整する際、顕著な柔軟性を提供する。
このような駆動はまた、多体状態のコヒーレンスと寿命を制限する加熱と動的不安定を誘導する。
本稿では,マルチトーン駆動方式を用いることで,これらの不安定性を抑えることができることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:49:04 GMT)
Structural Pattern Mining in Inka Khipus: Unsupervised Clustering, Provenance Classification, and a Computational Validation of the Santa Valley Match [0.0] 54,403コードと110,677ノットからなる619 khipus の公開データベースである Open Khipu Repository (OKR) に適用した機械学習パイプラインを提案する。
我々は,khipu当たり27個の構造的特徴を設計し, (i) UMAPおよびHDBSCANを介して教師なしクラスタリングを適用し, 3つの構造的異なるグループを復元した。
我々は、n-gramとしてエンコードされた結び目型のシーケンス順序を再現し、集約的な特徴以外の信号を追加しないという負の結果を報告した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:06:38 GMT)
Spatially Coupled MacKay-Neal/Hsu-Anastasopoulos CSS Codes Achieve the Quantum-Erasure Hashing Bound by Seeded BP Decoding [0.0] BP復号法により, 量子消去チャネルのハッシュ限界に到達できることを示す。
この論文は、有限次因子グラフを用いたシードBP復号法がX/Z等式族に対するハッシュ境界を達成することをDECで証明した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:34:54 GMT)
Simulation of Axion-Induced Electromagnetic Signal Detection Using Plasmonic Metasurfaces and Diamond NV Centers [0.0] この軸は、弱い相互作用を持つダークマターの強い候補である。
高感度実験と天体物理観測により、軸イオン質量と光子結合パラメータ空間のかなりの部分が除外されている。
高い質量範囲 0.01-1eV におけるアクチオンの存在を THz 周波数でのアクチオン場振動とほぼ一致するように探す上での課題が残っている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:27:37 GMT)
Signed-Permutation Coordinate Transport for RMSNorm Transformers [0.0] RMSNormモデルに対して、置換のみのアライメントが対称性不完全であることを示す。
プライマリオブジェクトである関数レベルのマージではなく、座標保存トランスポートを作成します。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:02:33 GMT)
Signatures of the circular Unruh effect in electric and magnetic dipole transitions of multilevel atoms [0.0] 円アンルー効果(英: Circular Unruh effect)は、真空中の平面円軌道に沿って移動する検出器の励起である。
検出器として機能する原子内の磁気双極子遷移が電気双極子遷移を支配することを示す。
本稿では,原子の多層構造を用いて自然放出率を抑える新しい測定手法を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:42:45 GMT)
Sequential sparse Gaussian process quantile regression [0.0] 量子回帰は、観測データから応答変数の条件量子化を推定することを目的としている。
我々は、量子関数が還元された帰納変数によって表現されるスパースガウスプロセスフレームワークを開発する。
次に、予測不確かさを条件付き主成分および後部誘導分散成分に分解する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:01:45 GMT)
Selective Impairment of Motor Recovery from Typing Errors in Parkinson's Disease: A Survival Analysis [0.0] 我々は、パッシブ・コレクトされたキーストローク・ダイナミクスがこれら2つのステージを区別できるかどうかを問う。
テロ前のキーストローク不安定が病気の重症度によって異なるという証拠は見つからない。
エラー後のリカバリ時間を示す強力な証拠は、継続的に加速された障害時間としてモデル化されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:29:21 GMT)
Seed2.0 Model Card: Towards Intelligence Frontier for Real-World Complexity [0.0] 私たちは、複雑な現実世界のタスクを解決するための重要なステップを踏み出すモデルシリーズであるSeed2.0を紹介します。
当社のアプローチは,ユーザの真のニーズを特定し,信頼性の高い前方評価システムの構築から始まります。
Seed2.0は、世界主導の推論インテリジェンス、視覚的理解、検索機能を提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:57:43 GMT)
Scaling Up Thermodynamic AI Models [0.0] 我々はIsingマシンハードウェア上で熱力学推論のための深層畳み込みネットワークを訓練する。
画像分類モデルでは, CIFAR-10では94.9%, CIFAR-100では76.4%の精度が得られた。
ハードウェア開発の意義と高温熱力学AIモデルの将来について論じる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:44:57 GMT)
SHARD: cell-keyed residual splitting for alignment-resistant private dense retrieval [0.0] SHARDは、その弱い軸を除去する検索保存型埋め込み変換である。
センス埋め込みはセマンティック検索と検索強化生成の基盤となる。
SHARDは攻撃を意識した防御であり、暗号的な保証ではない。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:16:47 GMT)
Robustness of neural networks to random noise perturbations of their inputs [0.0] 入力値の摂動に対するトレーニングニューラルネットワークの堅牢性について検討する。
本稿では,ネットワークの平均二乗誤差の上限を示すロバスト性尺度を提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:36:21 GMT)
Robust Autonomous UAV Landing on Maritime Platforms via Multimodal Agentic AI and Active Wave Compensation [0.0] 本稿では,無人航空機 (UAV) と無人航空機 (USV) を同期させる離間多輪着地機構を提案する。
このアーキテクチャは、2つの独立したDeep Reinforcement Learning (DRL)エージェント(Soft Actor-Critic (SAC)エージェント、ランディングデッキに高周波波動補償を提供するSoft Actor-Critic (SAC)エージェント、UAVの最終アプローチのためのマルチモーダルRLエージェント)を利用する。
高忠実度海洋シミュレーションで評価されたこのシステムは、穏やかから荒々しい状態の15回の試験で100%の着陸成功率を達成した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 13:03:45 GMT)
Robocalls: A Worldwide or US-only Problem? Analyzing Spam and Fraud in International Phone Calls [0.0] フィッシングとスパイ活動は、FBIのインターネット犯罪対策センターで最も報道されている犯罪の1つに一貫してランクインしている。
ロボコールは国際問題だが、この脅威の深刻度は他の国よりもかなり高い。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:11:17 GMT)
Rhythm-Structured Predictive Learning for Remote Photoplethysmography [0.0] RhythmJEPAはマスク付き顔画像から潜伏教師の表現を予測する。
CRSPはフレーム単位の潜伏生理状態を推定し、最も可算な循環状態経路をデコードする。
DOMは、局所的な時間的連続性と長距離リズム一貫性の依存関係の両方をキャプチャする。
SPMは、複雑さと性能のバランスのよいコンパクトなパルス感受性顔トークンを抽出する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:32:53 GMT)
Review Residuals: Update-Conditioned Residual Gating for Transformers [0.0] 残差接続は、各サブレイヤの提案した更新を1の固定係数で加算する。
本稿では、現在の状態と提案された更新の両方に条件付き、学習された入力依存ゲートによって各更新をスケールするReview Residualsを紹介する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:53:27 GMT)
Resonant and collective modification of London dispersion interactions under vibrational strong coupling [0.0] 本研究では, 強い振動結合が, 振動分解したロンドン分散相互作用の共鳴変化にどのように寄与するかを示す。
私たちのフレームワークは、探索するためのエキサイティングな新しい道を提供し、バイブロポーラリトン化学のメカニズムを説明するための一歩を踏み出すことを期待しています。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:38:31 GMT)
Reliability Scales Inversely: Bigger Models Compound Mistakes Faster via a Hidden Auto-Regressive Risk Regime [0.0] 言語モデルがスケールするにつれて、回答はより真実になるが、より高速に分解される。
i) スケーリングにおいて,知識ギャップは$approx$6times$, 知識劣化は$11$-$39times$, (ii) 製造時に不確実性を感じた$H(p_M)$は急速に緩和され, オラクル関連リスクは最大17times$長く持続する; (iii) この体制は因果関係である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:51:04 GMT)
Quantum-advantage resource of a two-mode Gaussian state: Analytical theory of convex optimization and a Galois no-go for the closed-form solution [0.0] 多重モード光の混合ガウス状態から量子複雑性資源を抽出する問題について検討する。
真に結合したセクターでこの問題に対する最初の完全な証明チェックソリューションを提示する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:29:35 GMT)
Quantum Information as a New Lens for Precision Neutrino Physics [0.0] 長いベースライン実験において,フレーバー状態を量子ビット様表現にマッピングし,全コンカレンスによる量子相関の定量化により3つのフレアニュートリノ振動について検討した。
これらの局所的なミニマは、どのようにして精度測定の機会を提供し、ニュートリノ振動パラメータの正確な決定に関する洞察を与えるかを説明する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:31:47 GMT)
Projection Operator Stochastic Equations for Non-Markovian Quantum Systems Under Continuous Measurement-Based Feedback [0.0] 量子マルコフの仮定は強いものであり、一般的な量子系の興味を抱くことは期待できない。
本稿では,これらの方程式を連続測定記録に基づくフィードバックの設定に一般化する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:27:00 GMT)
Programmable optical parametric amplifier synthesizer for cubic phase states and amplified Schrodinger cat states [0.0] プログラマブル光パラメトリックアンプ(OPA)シンセサイザーを導入する。
高忠実度立方相状態を生成し、シュロディンガー猫状態を増幅する。
我々のプロトコルは、中利得OPA演算と低次光子数分解検出のみを必要とする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:32:34 GMT)
Production of Magic States via $Z$ Bosons and Dark Photons [0.0] マジックステートの生成は2つの設定で研究される。
1つ目は、標準モデル(SM)の電気弱体(EW)セクターである。
2つ目は、新しく壊れた$U(1)$ゲージ対称性と、その下に荷電されたディラックフェルミオンを特徴とする拡張である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:16:47 GMT)
Probabilistic Inversion with Flow Matching [0.0] 生成人工知能から確率的逆転の文脈へ、フローマッチングの確立した数学的理論を適用する。
本手法の一般的な特徴を説明するための単純な2次元速度モデルと,より複雑な地震波速度モデルの確率的逆転の能力を示すためのOpenFWIデータセットの2つのケーススタディを用いて,本手法の評価を行った。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:04:17 GMT)
Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority [0.0] トランジット信号優先(TSP)は、バスの遅延を低減し、バス以外の交通に対する悪影響を制限し、車両のサブセットの極端な待ち時間を避けるという、競合する目標のバランスを必要とする。
本稿では、最小/最大グリーンおよび遷移実現可能性制約の下で次の信号位相を選択する設定条件付きTSPコントローラを提案する。
実験により、単一の学習条件付きポリシは、好みを越えてスムーズな経験的トレードオフフロンティアにまたがり、固定時間とルールベースのベースラインを上回る性能を示し、制約実現性を維持する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:57:39 GMT)
Plasmon-Enabled High-Precision Single Molecule Localization Microscopy over an Extended Field of View [0.0] PIFLUXはプラズモン照明と広視野検出を組み合わせた単一分子ローカライズ方式である。
Cramér-Rao分析によると、PIFLUXはMINFLUXと一致する数ナノメートルの精度に達し、SIMFLUXの2倍の精度で視野を拡大している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:46:00 GMT)
Phase space quantization of anisotropic cosmologies: Taub and Kantowski-Sachs models [0.0] 等質だが異方性を持つTaubとKantowski-Sachs宇宙論モデルに対する非対角および対角ウィグナー分布の明示的な構成を導入する。
対角ウィグナー分布から直接標準波動関数を計算し、どちらの場合もベッセル関数の修正により正確な物理状態を復元する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:36:01 GMT)
OpenLife: Toward Open-World Artificial Life with Autonomous LLM Agents [0.0] 大規模言語モデル(LLM)エージェントは、永続的メモリ、ツール使用、ネットワークアクセス、支払いによって、現在、オープンな社会、技術、経済の世界に人工生命を移すことを可能にしている、と我々は主張する。
私たちの概念実証であるOpenLifeは、単一の"スマートエージェント"ではなく、非同期プロセスの社会でステートレスなLLMを取り囲んでいます。
オープンワールドで約12週間、このようなエージェントを6回走らせました。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:31:20 GMT)
On Good Authority: Release-Authority Measurement for Registry-Mediated Package Ecosystems [0.0] 各パッケージリリースを,その直前のパッケージリリースと比較する,前者対応リリースオーソリティレコードを導入する。
私たちはこのレコードを、npm、PyPI、Maven Central、crates.io、RubyGemsから2024年4月から6月にかけて監査された、わざとサンプルに当てはめます。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:08:37 GMT)
Nonlinear Schrödinger equations: Symmetries, superposition, and classicality from a Bohmian perspective [0.0] より堅牢な組織原理は、位相変動によって生じる局所フローによって提供されると我々は主張する。
位相誘起流れは非線形および部分的にコヒーレントなシュルディンガー系における干渉様力学の統一機構として機能する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:42:19 GMT)
Modality-Driven Search with Holistic Trace Judging for ARC-AGI-2 [0.0] 数ショットのビジュアル推論ベンチマークであるARC-AGI-2の解法について述べる。
テキスト、画像、コードチャネルにまたがって、さまざまな候補を生成する。
自己整合性や多数決とは違って、モーダルな答えが間違っているタスクに関する正しいマイノリティな仮説を確実に復元する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:55:33 GMT)
Memory-Scalable and Hardware-Adaptive Matrix-Free Quantum Simulation [0.0] 本稿では,大規模演算子をベクトルに適用するためのメモリスケーリング,ハードウェア適応型行列フリーフレームワークを提案する。
量子シミュレーションでは、量子演算のコアカーネルを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:45:48 GMT)
Machine Learning-based Feedback Linearization Control of Quadrotor Subject to Unmodeled Dynamics [0.0] この研究は、新しい機械学習ベースのフィードバック線形化制御フレームワークを導入している。
RBF NNのオンライン適応は、事前トレーニングなしでネットワークの重みを更新する。
提案した制御器は、高速収束による軌道追跡を改善し、位置ノルムおよびヨー方向RMSEをそれぞれ7.13%以上、49.27%以上削減する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:30:19 GMT)
MV-GEL: Language-Driven Multi-View Geometric Entity Localization on Meshes [0.0] MV-GELは、自然言語クエリからポリゴンメッシュ上の微細な幾何学的エンティティをローカライズするためのフレームワークである。
GELviewsは、幾何学的CADエンティティの可観測性に基づく視点を優先する、プロンプト条件付きランキングモジュールである。
実験では、顔レベルのIoUが1.7倍、エッジレベルのF1が4.5倍向上した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:46:25 GMT)
MSNN-LINet: Cross-Modal Learning via Continuous Linear Integration [0.0] RGB-Dシーン分類のためのマルチストリームニューラルネットワーク(MSNN)LINetを提案する。
liconv2dオペレータは、各レイヤで連続的なクロスモーダル学習を可能にする。
LINetは、ResNet18スケールで45.2%の平均クラス精度に達し、非スクラッチ結果よりも優れ、ドメイン内RGB-D(ScanNet)事前トレーニングで49.6%向上した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:06:02 GMT)
Linking Hadith Narrator Identities Across Heterogeneous Arabic Biographical Databases: A Multi-Signal Entity Resolution Pipeline [0.0] そこで本研究では,Sanadset 650Kコーパスから2つの伝記データベースにナレーター名をリンクする2段階のエンティティ分解パイプラインを提案する。
フェーズ1は、名前のみの類似性(Sanadsetにはメタデータがない)を使用して、Sanadset名をHawramaniにマッチさせ、94,628リンク(51.1%、High 39,938 / MED 54,690)を得る。
第2相 ホーラマーニのムスリム学者に対する相互参照 名前の類似性、死亡年近性、信頼性等級極性を組み合わせた重み付き多信号関数により、95,573リンク(ホーラマーニの94.7%、高18,245 / MED 71,546 /
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:59:34 GMT)
Leveraging Multimodality for Real-Time Classification of Transients and Variables found by the Zwicky Transient Facility [0.0] リアルタイム階層分類のための光曲線,メタデータ,画像を組み合わせたORACLE-2モデルを提案する。
追加のモダリティを組み込むことで、常に分類性能が向上することを示す。
これらの結果から,複数モードの組み合わせにより早期分類が向上し,高ボリュームな警告ストリームのより効果的なトリアージが可能となった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:15:54 GMT)
LV-ROVER: Multi-Stream Tesseract Voting for Maltese Paragraph OCR [0.0] 実際にトレーニングするためのコーパスがなければ、私たちは合成トレーニングパイプラインと5ストリームのTesseract LV-ROVERアンサンブルを構築しました。
文字誤り率(CER)0.0234の細調整されたテッセラクトベースラインに対する422パラグラフベンチマークの結果を報告する。
アンサンブル認識だけでCERは44%改善され、0.01317になった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 22:58:41 GMT)
Knowledge Distillation from Large Reasoning Models to Compact Student Models: A Case Study on the John O Bryan Mathematics Competition [0.0] We build a Chain-of-Thought training corpus through a dual-agent framework。
このデータセットは、Apple Siliconハードウェア上でLow-Rank Adaptation (LoRA)を使用して、学生モデルを微調整するために使用される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:34:45 GMT)
Iterated Invariant EKF for 3D Landmark-Aided Inertial Navigation [0.0] ランドマークに基づく慣性3Dローカライゼーションに初めてIterIEKFを定式化し,適用した。
提案手法は,従来のSO(3)-EKF,反復SO(3)-EKF,IEKFを推定精度と整合性の両方で上回ることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:22:53 GMT)
Inverse Reinforcement Learning for Interpretable Keystroke Biomarkers in Parkinson's Disease [0.0] キーストローク力学はパーキンソン病(PD)の受動デジタルバイオマーカーとして広く研究されている。
逆強化学習(IRL)をキーストロークデータに適用し、各キーストロークをタイピング速度やリカバリよりも決定的な選択としてモデル化する。
我々の知る限り、これはIRLのキーストローク力学への最初の応用である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:18:33 GMT)
Improving path-tracking performance of an articulated tractor-trailer system using a non-linear kinematic model [0.0] 本稿では, トラクタ・トレーラシステムの非線形数学的モデルを提案する。
調音システムにおける経路追跡タスクの性能向上に利用することができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:01:29 GMT)
IPO Finance Agent: Benchmark of LLM Financial Analysts Beyond Finance Agent v2, with Automated Rubric Generation, on the SpaceX (SPCX) IPO [0.0] ファイナンスエージェント v2(Vals AI)が金融言語モデルを評価する基準ベンチマークとして登場した。
タスクドメインと検索アーキテクチャの2つの方向に沿ってファイナンスエージェントフレームワークを拡張したIPOファイナンスエージェントを紹介します。
最高の性能評価モデルであるZhipu GLM-5.2は79.8%の精度に達し、その結果得られたフロンティアで最もコスト効率のよいXiaomi MiMo-2.5 Proはクエリあたり0.05 USDでわずかに低い精度(77.2%)に達した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 10:07:05 GMT)
Hybrid Unet-Transformer Model for Generating Stress and Strain Fields from Composite Geometrics [0.0] 本稿では,複合構造形状画像から直接,複雑な力学場分布を予測するハイブリッドUNet-Transformerアーキテクチャを提案する。
その結果,提案アーキテクチャは,ほとんどのサブデータセットにおいて高い予測性能を達成していることがわかった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:56:38 GMT)
How LLMs See Creativity: Zero-Shot Scoring of Visual Creativity with Interpretable Reasoning [0.0] マルチモーダル大言語モデル(LLM)は、視覚的創造性をゼロショットで判断する。
以上の結果から,マルチモーダル LLM は人間の視覚的創造性判断に適合する可能性が示唆された。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:29:35 GMT)
Homogenization of $\ell_2$-Adversarial Training in High-Dimensions: Exact Dynamics under Stochastic Gradient Descent [0.0] 単元モデルに対する$ell$-adversarial trainingの学習力学を解析するためのフレームワークを開発する。
一定の学習率でSGDの単調な降下を保証できないことが,敵対的リスクの最小化に寄与している。
力学が収束すると、制限された対向リスクとSGDは固定点方程式によって決定される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:38:10 GMT)
Holographic Krylov Complexity with Lifshitz Scaling and Hyperscaling Violation [0.0] リフシッツおよび超スケーリング違反背景におけるクリロフ複雑性について検討する。
解析により,運動量-クリロフ対応が非相対論的ホログラフィック設定に自然に拡張されることが判明した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:24:22 GMT)
Guaranteed Escape for a Bouncing Robot in Pipe Chains [0.0] 単一矩形管セグメント内のすべての軌跡パターンを網羅的に解析する。
特別な角度 $ = /4$ の出口保証を証明します。
これらの結果は、湾曲した関節を持つパイプにまで及ぶ。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:58:15 GMT)
Ground Plane-Aided Extrinsic Calibration of Inertial and RGB-D Sensors for Uncrewed Aerial Vehicles [0.0] Inertial Measurement Units (IMU) とRGB-D (RGB-D) カメラを搭載したUAVの無目標校正法を提案する。
提案手法は,RGB-D画像の深度チャネルから基底点を抽出するために,深層学習に基づくフロアセグメンテーションを利用する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:21:17 GMT)
Governance Gaps in Agent Interoperability Protocols: What MCP, A2A, and ACP Cannot Express [0.0] 本稿では,6次元ガバナンス要求分類を適用した系統的ギャップ分析について述べる。
我々は、各プロトコルの仕様を、この分類基準に対して分析し、サポート、部分、または欠如として分類する。
結果として得られたギャップマトリックスは、5つのプロトコルすべてに投票と不服従の保存が欠如していること、審議が欠如していること、あるいはほとんどの部分的であること、および、管理されたエージェントコミュニティに必要なプリミティブの完全なセットを符号化するプロトコルが存在しないことを明らかにしている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:16:56 GMT)
Giant perpendicular Edelstein polarization in 2D compensated magnets via bichromatic Floquet driving [0.0] 2周波駆動は、軌道に支配されるPEPを生成する成層界のない面内ゼーマン様磁場を誘導することを示す。
この大きな反応は、系の磁気パリティと第2ビームの高調波に結びついた普遍的な選択規則によって制御される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:55:25 GMT)
Generating uniform quantum state ensembles with continuous measurement [0.0] 連続測定による均一な量子状態アンサンブルの生成について検討する。
関連するランゲヴィン方程式とフォッカー・プランク方程式を導出し、均一な純状態アンサンブルへの大域収束を引き起こす幾何学的条件を同定する。
その後、混合状態まで解析を拡張し、同質な純度依存デコヒーレンス速度が、効果的な非線形進化を通じて、クォービット状態の均一なクビットアンサンブルを生成することを示した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:49:03 GMT)
GRPO, Dr. GRPO, and DAPO Are Three Operations on One Number: The Group-Standard-Deviation Identity [0.0] 言語モデルを推論する3つの一般的な方法は、3つの異なるトリックのように見えます。
3つとも、標準偏差(標準偏差)という1つの数を調整する。
この論文は、それらが1つのダイヤルの3つの設定であることを証明している。
分裂したグループは最も多くを教え、一方、一致したグループは何も教えず、静かに落ちます。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:28:08 GMT)
From Idea to Prototype in an Afternoon: Scaffolded, AI-Assisted Rapid VA Prototyping [0.0] 新しいビジュアル分析のアイデアをテストするには、通常数ヶ月かかる。
ワークフロー言語とAIアシスタントが、この作業を午後まで短縮したケースについて説明する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:19:46 GMT)
Federated Sovereign Transport Protocol (FSTP): Verifiable Coordination Without Disclosure [0.0] 本稿では,フェデレート・ソブリン・トランスポートプロトコル(FSTP)について紹介する。
FSTPは、データ閉じ込めをプロトコル自体の特性にする。
機密性要件を要求される機関のためのガバナンスプラットフォームであるVelyzorのノード間トランスポート層として開発されている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:44:43 GMT)
Falsification, Not Exposure: An Internally Preregistered Placebo-Controlled Decomposition of Self-Repair Feedback in Frozen Small Code Models [0.0] 本研究では、ブラインドサンプリングベースラインに対してフィードバックパケットを分解するプラセボ制御装置を構築する。
この体制では、ファルシフィケーションは語彙や自己批判としてではなく、外部の実行可能な反例と比較するのに役立つ。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:26:14 GMT)
FRAME: Learning the Adaptation Domain with a Mixture of Fractional-Fourier Experts [0.0] 本稿では,Frictional-Fourier Mixture of Expertsについて紹介する。
各専門家は、空間領域とフーリエ領域の間に連続的に補間する学習可能な分数-フーリエ順序を持つ。
順序は専門家ごとに1つのスカラーで、別々のチャープで訓練され、変換は$mathcalOdlog d)$-FFTサロゲートで計算される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:39:55 GMT)
Explaining Machine Learning and Memorization with Statistical Mechanics [0.0] この論文は、NNとMLの理論的理解を改善することを目的としており、特に敵対的攻撃と暗黙的に低次元学習に焦点を当てている。
特に,データに様々な学習と記憶の程度を適合させるモデルとして,高密度連想メモリ(DAM)と制限ボルツマンマシン(RBM)の2種類について検討した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 04:15:23 GMT)
Entropy-Regularized Probabilistic Gates for Sparse Model Discovery in Scarce-Data Federated Learning [0.0] Federated Learning (FL) は分散機械学習(ML)パラダイムで、データを共有せずに複数のクライアント間で協調する。
本研究では,スパースフェデレーション最適化における不確実性を維持するメカニズムとして,ゲート分布のエントロピー正則化について検討する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:51:44 GMT)
Entanglement Structure Across $\mathbb{Z}_n$ Phase Transitions in 1D Rydberg Atom Arrays [0.0] 本研究では, 1次元のリドベルク相互作用の異なる強度の下で出現する$mathbbZ_n$秩序相と関連する量子絡み合いの特性について検討する。
絡み合い構造に基づくアプローチは、量子相転移における対称性の破れを分析する強力なツールを提供することができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:55:42 GMT)
Enhancing Initial-State Sensitivity through Time-Dependent Hamiltonian Readout in Ising Spin Chains [0.0] ローカルオブザーバブルは、強く相互作用する多体進化において初期状態に対する感受性を失うことがある。
この感度は、時間依存のハミルトニアンの読み出しによって向上できることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:33:04 GMT)
Energetics of non-Gaussianity in single mode cavities [0.0] 非ガウス状態は量子技術において中心的な役割を果たす。
単モードボソニック状態における非ガウス性の特徴を特徴付けるためのエネルギー的枠組みを導入する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 05:23:29 GMT)
Efficient entanglement of three remote single-atom quantum-network nodes [0.0] 3つの独立した研究所で3ビットの絡み合った状態を生成し、配布し、保存する。
エンタングルメント密度は77(1)%,エンタングルメント寿命は200us以上である。
この手法による前例のない効率性は、マルチノード量子ネットワークへの明確な経路を確立する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:38:48 GMT)
Edge-Efficient Transformer for End-to-End RF Spectrum Monitoring [0.0] E-SpecFormer (Edge Spectrum Monitoring Transformer) をエンドツーエンドの自動変調・隠蔽チャネル(CC)認識のために提案する。
E-SpecFormerは、さまざまなハードウェア制約を満たすために、4つのスケーラブルなバリエーション(Nano、Small、Medium、Large)でパラメータ化されている。
これらの結果は、IoT(Internet of Things)デバイス上でのリアルタイムスペクトルインテリジェンスのためのエッジ効率のソリューションとして、E-SpecFormerを確立する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 09:19:22 GMT)
Digital Innovation through Knowledge Processes [0.0] 本稿では,データ,オブジェクト,アーティファクト,人間といったプロセス資源の関係について考察し,より普遍的な知識集約プロセスの定義を提案する。
結果は、プロセスモデルを6つのカテゴリに分類し、知識の強度を簡単に確認できるようにします。
知識集約的なプロセス、その影響をモデル化、実行、監視、評価する方法に関する全体論的な見解が、ディジタルトランスフォーメーションプロジェクトのスピードアップと品質向上につながると考えています。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:22:58 GMT)
Diff-Based Code Corruption using LLMs for Large-Scale Bugfix Benchmarking [0.0] 大規模なバグフィックスベンチマークであるMegaBugFixを紹介した。
MegaBugFixとベースラインベンチマークで13のオープンウェイトモデルを評価し,MegaBugFixの性能を一貫して低下させた。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:15:38 GMT)
Design and Implementation of Agentic Orchestrations and Orchestration of Agents [0.0] タスクの特異性、トレーサビリティとトラクタビリティ、自律性と反応性、正確性保証などの特性に沿ったエージェントオーケストレーションオプションのためのフレームワークを提供する。
この作業は、エージェントオーケストレーションとエージェントのオーケストレーションの設計と実装のためのプロパティ、基準、メトリクスを提供することを目的としています。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:31:49 GMT)
Creating Intelligence: A Computational Foundation for AGI [0.0] この研究は、集合論と超次元計算に基礎を置く新しい心の計算理論を導入する。
情報を離散集合として表現し、生物集団コードを直接モデル化する。
行列演算よりも離散論理に依存しているため、このアルゴリズムは直接インメモリハードウェアに変換される。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:30:40 GMT)
Context-Verified, Error-Budget-Aware Decomposition Selection for Toffoli Networks [0.0] 本稿では,Toffoli 毎の分解を選択する最初のコンパイラパスを提案する。
検証者フラグ66は、コンテキストチェックなしで非等価に展開されたライブラリを書き換え、12のベンチマーク回路のうち6のカウントグレーディ置換は静かに破損する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:11:28 GMT)
Constructing Epistemic AI Literacy: Detecting Epistemic Aims and Processes in Student-AI Co-Programming [0.0] 創造的人工知能(GenAI)を応用する学生の学習過程において、疫学的思考が中心的な役割を担っている
本研究では、疫学AIリテラシー(EAIL)の概念的枠組みを紹介する。
その結果、EAILの欠如が顕著であり、78.8%の学生-GenAI相互作用は、非専門的目的に依存していることが明らかとなった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:43:35 GMT)
Computer vision-based neural networks for radioisotope identification in urban environments [0.0] モバイル都市検索シナリオにおけるラジオアイソトープ識別のためのアルゴリズムの開発は、大きな課題に直面している。
本稿では,リストモードのガンマ線データを二次元滝分光器に変換する機械学習手法を提案する。
我々は,Radiological Anomaly Detection and Identification (RADAI)ベンチマークデータセット上で,多層パーセプトロン(MLP),畳み込みニューラルネットワーク(CNN),視覚変換器(ViT)の3つのアーキテクチャを評価した。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:35:51 GMT)
Comment on "Ideal clocks -- a convenient fiction" by K. Lorek et al [0.0] 我々は、一様加速量子時計の崩壊確率に関する論文の微妙な監視を補正する。
元々の表現には、リンドラーのくさびの空間的分離に違反する非物理的クロスウェッジ項が含まれていた。
我々は、紙のリンドラー等角座標を$(19), )$で補正した確率を導出し、因果一貫性のある熱項のみを保持する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:57:27 GMT)
CogTax: A Four-Level Cognitive Taxonomy for Command-Line Computing Education [0.0] この研究は、認知複雑性と運用への影響を統合する4段階の認知分類であるCogTaxを提示する。
授業資料のシークエンシングと評価の難しさの校正のための原則的枠組みを提供し、学生に自己評価とギャップ識別の明確な基準を与える。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 20:19:00 GMT)
Classification and Exact Local Masking in Finite-Field Clifford Dual-Unitary Circuits [0.0] 2量子有限体クリフォード二重単位ゲートを分類し、その分類を正確な局所マスキングと演算子輸送に適用する。
局所的な漏れは摂動強度において線形であるが、理想的な逆転を用いた回復の不確実性は完全点付近で二次的である。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:41:17 GMT)
Certifying quantum states without independence assumptions [0.0] 独立性の仮定なしでも有効である量子検証と認証のためのフレームワークを導入する。
本手法は,固定可観測物の平均平均期待値に対して厳密な信頼区間を与える。
本研究では,ドリフト下でのエネルギー推定と絡み合いを数値的に検証し,量子プロセッサ上でのベル状態認証実験を行った。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:16:38 GMT)
Beyond the Expressivity-Trainability Paradox: A Dynamical Lie Algebra Perspective on Navigating Barren Plateaus in Quantum Machine Learning [0.0] 量子機械学習(QML)では、モデルキャパシティの増大は典型的に過度に適合する。
本研究は「表現性-訓練性パラドックス」によって駆動される反直観的パラダイムを推し進める。
回路ジェネレータの代数次元と最適化力学を結びつける包括的枠組みを確立する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:50:52 GMT)
Benchmarking Large Language Models on Floating-Point Error Classification [0.0] 本稿では,ソフトウェアコード中の浮動小数点誤りを静的に検出・分類する大規模言語モデルの有用性について検討する。
浮動小数点誤差の6つのカテゴリにまたがるLSMを評価するために,90個のCカーネルと1130個のテストサンプルのベンチマークであるInterFLOPBenchを紹介する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 08:18:45 GMT)
Belief Contraction in Dynamic Epistemic Logic [0.0] 標準クリプキモデル上で直接定義された信念の縮約機構を導入する。
信念の収縮の標準的な性質のいくつかを満たすが、他の性質は満たさないことを示す。
また、標準DELの拡張であるより一般的な動的論理を定義する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:53:55 GMT)
Auxiliary Schmidt Rank as a Resource for Photonic Bell Measurements [0.0] 一つの決定的なベルラベル関数が$r_geqslantlceil d/2rceil$に対して発生することを示すが、$d2$ Bell-stateラベルの決定論的識別には$r_geqslant d$が必要である。
最大絡み合ったランク-$d$補助状態は、各光子の系と補助的な自由度の間の局所的なベル基底ソートによる境界を達成する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:31:19 GMT)
Automatic quantum function parallelization and memory management in Qrisp [0.0] 本稿では,透過性DAG(Permeability DAG)と呼ばれる量子プログラムを表現する新しいデータ構造を提案する。
この表現の操作は、様々な強力な変換を促進する。
メモリ管理と並列化は、それぞれの量子ゲートの実行速度の詳細に敏感にすることができる。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:40:51 GMT)
Atom diffraction in the strong-coupling regime [0.0] 摂動的アプローチは、自由な単層グラフェンを通したキロボルトエネルギーでのヘリウムの拡散を抑えられないことを示す。
格子歪みは、典型的なデバイ・ワラー因子では説明できない重要な位相展開をもたらす。
結果はシミュレーションによって支持され、フォノンが原子回折現象に与える影響を記述するための状態に依存しないアプローチを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 06:12:26 GMT)
An Agentic AI Framework to Accelerate Scientific Discovery in Plant Phenotyping [0.0] 私たちは、データファクトリをインタラクティブな発見プラットフォームに変える、エンドツーエンドのエージェントAIフレームワークを提示します。
対話型共科学者エージェントは、科学者の自然言語質問を構造化分析計画に変換する。
ヘッドレスコンピュータエージェントは、フロンティア・エクサスケール・スーパーコンピュータ上でビジョントランスフォーマーのセグメンテーションと特性抽出をディスパッチする。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 15:37:02 GMT)
Amplifying Membership Signal Through Chained Regeneration [0.0] 現在のメンバシップとデータセットの推論攻撃は、しばしばワンショット世代に依存する。
我々は、白、グレー、ブラックボックスMIAおよびDIを強化するモデルに依存しないフレームワークであるMADreMIAを紹介する。
以上の結果から,MADreMIAは多種多様なモデルファミリやモダリティにまたがるリッチな信号を提供することがわかった。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 17:29:04 GMT)
Absorption capacity of separable noise: Bell-mixing thresholds on separability and teleportation [0.0] 我々はベル混合線$_=+ + (1-)$について検討し、$+$は固定ベル参照であり、$は分離可能な2ビットノイズ状態である。
州は絡み合うようになり、古典的戦略よりも量子テレポーテーションの優位性に達する。
積雑音状態と分離可能な複素数$X$雑音状態に対する閉形式容量と閾値を導出する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 07:17:38 GMT)
AEGIS: A Multi-Task Joint-Embedding Predictive Architecture for Mammography [0.0] 自己教師型共同埋め込み予測アーキテクチャ(JEPA)を用いて3種類の視覚変換器(Small/Base/Large)を訓練する。
785-study 検体では, 乳腺癌トリアージにおいて, 93%の感度, 75%の特異性を有する0.949が得られた。
乳房密度分類では、2進分類では0.953 AUC、Breast Imaging Reporting and Data System (BI-RADS) では62.6%の精度を達成している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 23:52:55 GMT)
A universal time-of-arrival signature of Bose--Einstein condensation [0.0] ボース・アインシュタイン凝縮は、調和的に閉じ込められた気体が自由落下状態に放出された際の時間的統計においてカスプを生じることを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 21:05:38 GMT)
A time-series classification framework for individual-level absenteeism prediction under severe class imbalance [0.0] 従業員欠勤は、需要の高い労働環境において相当な運用コストを課す。
本稿では,過去の出席順序を将来の不在ラベルから分離する時系列分類フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 11:44:52 GMT)
A logarithmic phase singularity at the heart of Landau-Zener transitions [0.0] Landau-Zener 問題の3つの要素は、初期レベルに残る確率振幅の値に対して、親しみやすい式 $a_LZequivexpleft[-/(2)right]$ を決定する。
我々の分析は、$a_LZ$が対数相の結果であるだけでなく、近似が$a_LZ$につながる理由も説明している。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 12:27:21 GMT)
A differential derivation of the Obara-Saika relation for Gaussian electron repulsion integrals [0.0] 本稿では,ガウス基底関数間の差分関係のみに基づくOS垂直反復関係の新たな導出について述べる。
このアプローチは厳密で自己完結した導出としての教育的価値を持っている。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 19:42:12 GMT)
A Semantic-Layer-Mediated Agent for Natural Language to SQL over Heterogeneous Enterprise Databases [0.0] そこで本研究では,意味的意図を物理スコール実行から切り離す意味的層を介するNL2エージェントを提案する。
このシステムは制約付きシンクアクトループを採用し、BigQueryとSnowflakeバックエンドをサポートし、エンドツーエンド評価フレームワークに統合されている。
Gemini 3 Pro は 547-task Spider2-snow ベンチマークで94.15% の精度で実行され、公式のリーダーボードで3位にランクインし、スキーマのみのアプローチを大幅に上回った。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 02:22:39 GMT)
A Quantum Method of Types [0.0] 経験分布の量子アナログとして機能する経験演算子を導入する。
この経験的作用素は、型を量子的に表すような、大きな偏差境界を満足することを示す。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 16:29:20 GMT)
A Quantum Collocation Approach to One-Dimensional Boundary Value Problems with Coherent Amplitude Amplification [0.0] 一次元線形および非線形境界値問題の解を近似するための量子コロケーションフレームワークを提案する。
この方法は、離散化されたアンザッツ空間上の残差ベースの量子探索として許容可能な解の探索を定式化する。
空間依存のオラクル構造が増幅力学とそれに対応する成功確率にどのように影響するかを分析する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 14:15:58 GMT)
A Quantitative Framework for Estimating System Complexity and Cost via Component Interface Analysis [0.0] 本稿では,外部要求に起因したシステム変更に伴う複雑性とコストを推定するフォーマルなモデリングフレームワークを提案する。
システムを結合の有向グラフとしてモデル化し、複雑な依存関係とコンポーネントと要素間の情報フローをキャプチャする。
このフレームワークは、外部ドライバとコスト要因を個々のシステム要素に関連付けることによって、システム全体の修正コストをバウンドするメカニズムを提供する。
論文参考訳(メタデータ) (Tue, 30 Jun 2026 01:52:28 GMT)