Improved Large Language Diffusion Models [115.8] 8Bマスク付き拡散言語モデルである EmphiLLaDA について検討した。
iLLaDAは、事前トレーニングと教師付き微調整(SFT)、12Tトークンへの事前トレーニング、および12エポックのための25Bトークン命令コーパスの微調整を通じて、マスク付き拡散目標を維持している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:51:36 GMT)
Improving Neural Network Training by Decoupling the Magnitude and Direction of Weight Vectors [110.1] EmphMagnitude-Direction-Direction (MD) Decouplingを提案する。
これは、各重量をハイパースフィア上の固定ノルム方向に分解し、学習可能な1ローとカラムごとのマグニチュードゲインを、別々の学習速度で更新する。
アダムとムーンの双方で、MD Decouplingはよく調整されたベースラインを改善し、モデルの幅を調整せずに最適なLRを転送し、大規模なMixture-of-Expertsモデルのスケールに役立っている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:40:26 GMT)
PhoneBuddy: Training Open Models for Agentic Phone Use [104.2] PhoneBuddyは、エージェント電話用のトレーニングレシピとオープンモデルラインである。
実際のGUI使用構造からモックアプリを再構築する、実アプリケーション環境とモックアプリ環境であるPhoneWorldを組み合わせる。
PhoneBuddyはまず、両方の環境で収集されたトラジェクトリから、共有された教師付き微調整ステージを構築し、その後、実アプリケーションRLと混合RLを比較した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:20:35 GMT)
Follow Your Track: Precise Skeleton Animation Controlled by 3D Trajectories [93.4] 4Dジェネレーションは、3Dオブジェクトをリアルなモーションでアニメーション化することを目的としており、アプリケーションには大きな可能性を秘めている。
既存の方法は通常、モーション合成から3Dアセット生成を分離する。
トポロジ一般骨格アニメーションのための軌道条件付きフレームワークである textttACT について述べる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:18:10 GMT)
OrthoTrack: Continuous 6-DoF UAV Trajectory Estimation Anchored in Public Orthophotos [76.8] トレーニング不要なOrthoTrackを提案する。このシステムは6-DoFトラジェクトリの連続を,事前の地図として利用可能なオプティカルフォトとサーフェスモデルのみを用いて推定する。
movingDroneと現実世界のベンチマークでは、OrthoTrackは1つのGPUでリアルタイムに実行される。オラクルのスケールとアライメントを受ける場合でも、すべてのベースラインを大きなマージンで上回る。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:05:01 GMT)
Disease-Centric Vision-Language Pretraining with Hybrid Visual Encoding for 3D Computed Tomography [75.8] ビジョン言語による事前トレーニングは、汎用医療AIにとって大きな可能性を秘めている。
3つの主要なコンポーネントを特徴とするフレームワークを提案する。
診断対応プロンプト戦略では、トレーニング前の推論ギャップを埋めるために、実際の臨床用語と集約された疾患プロトタイプを用いている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:24:45 GMT)
SARA: Unlocking Multilingual Knowledge in Mixture-of-Experts via Semantically Anchored Routing Alignment [74.3] 本研究では,SARA(Semantically Anchored Routing Alignment)を提案する。
5つの低リソース言語と3つのベンチマークにまたがる2つのLLMの実験を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:36:46 GMT)
Autodata: An agentic data scientist to create high quality synthetic data [73.5] このようなデータサイエンティストエージェントを訓練(メタ最適化)する方法を示します。
我々は,計算機科学研究タスク,法的推論タスク,数学的対象による推論実験を行う。
この方向は、AIデータの構築方法を変える可能性がある、と私たちは信じています。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:08:31 GMT)
MIRAGE: Protecting against Malicious Image Editing via False Moderation [73.1] 画像免疫に関する以前の研究は、許可されていない操作から保護するために、イメージに知覚できない摂動を追加する。
我々は,この問題をシステムレベルで把握し,すべての主要な商用画像編集システムに共通する未探索の攻撃面を特定する。
生成モデル自体を乱すのではなく、これらのモデレーションをポリシー違反としてイメージにフラグを付けることによって、イメージを免疫することを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:23:10 GMT)
Physics Question Scene Graph: Fine-grained Evaluation of Physical Plausibility in Text-to-Video Generation [72.0] 本稿では,階層的な質問に基づく評価パイプラインである物理質問シーングラフ(PQSG)を紹介する。
PQSGは、オブジェクト、アクション、および物理法則に従うプロンプトに対する忠実さをチェックすることによって、生成されたビデオを評価する。
我々は物理に基づくプロンプトとそれに対応する生成されたビデオを含むデータセットであるFinePhyEvalを作成してPQSGを検証する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:12:54 GMT)
Heterogeneous and Adept Snapshot Distillation for 3D Semantic Segmentation [71.9] マルチモーダル融合とマルチモデルアンサンブルは3次元セマンティックセグメンテーションの性能向上に有効である。
本稿では,マルチモーダルモデル(すなわち点雲と画像)と複数のモデルエキスパートから,知識蒸留を通じてポイントクラウドベースのネットワークにリッチな知識を移行することを提案する。
Heterogeneous and Adept Snapshot Knowledge Distillationは、HAS-KDと呼ばれ、ScanNetV2とS3DISデータセットの最先端の結果を得る。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:31:22 GMT)
Towards Fast and Effective Long Video Understanding of Multimodal Large Language Models via Adaptive Quasi-Gaussian Sampling [71.6] ビデオフレーム選択は準ガウスサンプリングの問題である。
我々はAdaQと呼ばれる適応的でトレーニングなしのアプローチを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:06:43 GMT)
OncoSynth: Synthetic data generation for treatment effect estimation in oncology [69.5] Inco Synthは,合成コホートを生成するために設計された,生成的,因果認識型機械学習フレームワークである。
Onco Synthは、現実世界の患者、治療、および結果の分布を保存する高忠実な合成患者コホートを生成する。
特に、Onco Synthは、患者レベルの治療効果のエラーを最大66%減らし、患者レベルの治療効果のエラーを最大58%減らして、既存のアプローチよりも治療効果の見積もりを改善する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:37:36 GMT)
DualEval: Joint Model-Item Calibration for Unified LLM Evaluation [68.0] DualEvalは、モデルと評価項目を共有空間で表現する潜在モデルイテムキャリブレーションフレームワークである。
我々はDualEvalを、コーディング、数学、雑多なドメイン知識タスク、汎用的な日常的なユーザクエリの4つの領域にまたがって適用する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:40:46 GMT)
EchoStyle: Unlocking High-Fidelity Video Stylization with Reverse Data Synthesis [67.4] 任意の長さのビデオの高品質なスタイリングを実現するために,スケーラブルなテキスト駆動フレームワークであるEchoStyleを提案する。
まず,ビデオコンテンツとテキストスタイルを適切に再利用するビデオ・ツー・ビデオアーキテクチャを構築する。
データ不足に対処するため、我々は、20kの高品質ビデオペアからなる大規模スタイリングデータセットであるV-Style20kを確立するために、自動逆合成パイプラインを開拓した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:45:56 GMT)
OmniContact: Chaining Meta-Skills via Contact Flow for Generalizable Humanoid Loco-Manipulation [67.0] 鍵体軌道と時系列二値接触信号からなるコンパクトな表現であるtextbfcontact Flow (CF) を中心にした階層型フレームワークを提案する。
また,Humanoid loco-manipulationのためのMOCapベースのHOIコーパスであるOmniContactデータセットを収集した。
これにより、堅牢な実行、自律的な障害回復、長期タスクのための柔軟なメタスキルの構成が可能になる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:28:23 GMT)
DeformGen: Dynamics-Based Topology Augmentation for Deformable Manipulation Policy Learning [65.8] 変形可能なオブジェクトのための動的ベースの拡張フレームワークであるDeformGenを提案する。
状態問題に対して、DeformGenは、局所化物理障害を適用して、有効な状態分布を拡張する。
トラジェクトリチャレンジでは、DeformGenはソース操作トラジェクトリを変形フィールド・ワープを介して転送する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:15:38 GMT)
Efficient and Trainable Language Model Test-Time Scaling via Local Branch Routing [65.6] Local Branch Routing (LBR)はトークンレベルのテストタイムスケーリングフレームワークである。
小さなローカルなルックアヘッドツリーを拡張し、言語モデルを通じてすべてのサンプルブランチを転送し、軽量ルータを使用してコミットするdeep-1サブツリーを選択する。
LBRにより、各トークン決定は、完全なソリューションレベルの検索を避けながら、ルート次トーケン分布を超えるエビデンスを使用することができる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:42:44 GMT)
Navigating User Behavior toward Personalized Multimodal Generation [65.6] 本稿では、ユーザのインタラクション履歴をダウンストリーム合成のための実行可能な命令に変換する、パーソナライズされたコンテンツ生成について検討する。
協調的なコードとテキストのコードとを二重に結合した,各項目を表すNaviGenを提案する。
製品、ゲーム、ショートビデオ領域での実験では、NaviGenはパーソナライズされた画像とビデオの生成を改善し、次のイテム予測を強化し、より具体的で関連性があり、視覚的に生成可能な命令を生成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:54:52 GMT)
Beyond One-Size-Fits-All: Diagnosis-Driven Online Reinforcement Learning with Offline Priors [59.1] 現場は診断駆動型緊張管理に移行すべきだと我々は主張する。そこでは、デプロイ固有のエビデンスによって、学習者がトレーニングを通じてその先行とどのように関連しているかが示され、柔軟かつ適応的な展開を可能にする。
我々は,3つの機能的役割によるオンライン最適化の作り直し,ヘルプ・オー・ハート・リバーサルの実証実験の制御,基礎モデルのポストトレーニングから具体化インテリジェンスへのクロスドメインエビデンス,そして5つの実質的対策との関わりを特徴とする枠組みで,この立場を支持する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:05:28 GMT)
Active Adversarial Perturbation-driven Associative Memory Retrieval for RGB-Event Visual Object Tracking [58.3] RGB-Eventトラッキングは、イベントセンサからRGB外観テクスチャと高密度時間運動キューを融合することにより、ローカライズを改善する。
現実世界のシーンは、従来のマルチモーダル融合を妨げる多様な構造的な信号劣化に悩まされる。
本稿では,RGBイベント追跡に適した階層的摂動・検索フレームワークを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:34:06 GMT)
In-context Region-based Drag: Drag Any Region to Any Shape [58.3] 本稿では,領域ベースのドラッグに着目し,新たにICRDrag(In-Context Region-based Drag)手法を提案する。
コンテキスト内学習フレームワークでは、ICRDragはソースイメージ、ソース領域マスク、ターゲット領域マスクを消費し、ターゲットのドラッグされたイメージを生成する。
実験の結果,ICRDragは測定値とユーザスタディの両方において,既存の手法を著しく上回っていることがわかった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:55:07 GMT)
Towards a Dynamic and Fixed-budget Memory Bank for Efficient Streaming Video Understanding [56.2] CausalMemは動的ビジュアルメモリ更新機構の構築に特化している。
視覚トークンの冗長性を推定し、オンラインセマンティックベースでメモリバンクを更新する。
textbf20$times$ visual token compression ratioを達成し、textbf82 MBストレージのみを占有する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:11:08 GMT)
ForceBand: Learning Forceful Manipulation with sEMG [55.2] ForceBandは低コストで手首を縫ったsEMGシステムで、人間の筋肉活動を力で強化されたデモに変える。
我々は,筋電図およびIMU信号から指ごとの力を予測するEMG2Forceモデルを事前訓練する。
実験により、ForceBandは視覚ベースラインよりも50%以上低い力予測誤差で細粒度の指先相互作用を回復することが示された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:59:35 GMT)
Rendering Novel Views of MRI Using 3D Gaussian Splatting [54.6] 3D Gaussian Splatting を用いて, スパース異方性MRIから画像再構成を行い, 臨床評価に関係する解剖学的に整合した画像面を採取, 描画した。
新しいビュープレーンは対象解剖の診断に最適であるが、元のMRIはそうではない。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:00:03 GMT)
Agent-as-a-Router: Agentic Model Routing for Coding Tasks [54.0] Agent-as-a-router (AC)はC-A-Fループとしてルーティングを形式化する(Context->Action->FeedbackContext)
ACは、分配タスクに対する最小の累積後悔を達成し、配布外エージェントプログラミングタスクに一般化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:29:37 GMT)
Point Cloud Diffusion with Global and Local Reconstruction for Instance-Level 3D Anomaly Detection [53.3] インスタンスレベルの3次元異常発生と検出のための点群拡散フレームワークである textbfPCDiff を提案する。
生成フェーズでは、インスタンスレベルのマルチモーダルアテンションが生成フレームワークに埋め込まれ、そこでは異常にテクスチャ勾配、画像パッチ、テキスト、マスクが条件付けられている。
検出段階では,局所的異常回復と大域的幾何整合性を確保するために,共同局所言語再構成アルゴリズムが導入された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:11:05 GMT)
PatternGSL: A Structured Specification Language for Template-Free and Simulation-Ready 3D Garments [52.5] 本稿ではテンプレートフリーで学習可能な仕様言語であるPatternGSLについて述べる。
本稿では,単一画像から直接PatternGSL仕様を予測し,それらを衣服に復号する視覚言語フレームワークを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:37:17 GMT)
Generative AI for Safe and Photorealistic Drone Light Shows [51.7] ドローンのライトショーは、空のエンターテイメントを再定義しているが、その普及は労働集約的な手動アニメーションによって妨げられている。
SWANは、テキストプロンプトから直接、フォトリアリスティック、大規模、衝突のないドローン振付を直接合成するエンドツーエンドパイプラインである。
シミュレーションされた2000基のドローンを安全に編成し,49基のクアッドコプターを密集した実世界の群れ上での物理的実現可能性を検証することにより,スケーラビリティを実証する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:34:44 GMT)
Weave of Formal Thought [51.6] WoFT(Weave of Formal Thought)は、厳密な構文的検証と学習された構造的表現を結合したパラダイムである。
本稿では,非終端文法記号を直接生成にインターリーブするために,言語モデルを訓練する潜時可変微調整法を提案する。
Pythonでは、RWS目的のStarCoder2-3Bを微調整することで、テキストのみのSFTベースラインと比較して、トーケン毎のクロスエントロピーが14.3%削減される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:58:11 GMT)
$\text{DT}^2$: Decision-Targeted Digital Twins [51.6] デジタルツイン(Digital twin, DT)は、様々な政策によって引き起こされるシナリオをシミュレートすることで意思決定を支援する現実世界のシステムの仮想モデルである。
モデルキャパシティが制限されている場合、一段階の遷移誤差を最小限に抑えるためのDTを訓練することで、報酬関数に従ってポリシーのランク付けのためのサブ最適モデルを生成することができることを示す。
我々は、決定目標のDTトレーニングパラダイムである$textDT2$を紹介します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:02:24 GMT)
MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation [50.7] MVTrack4Genは、カメラコンディショニングのみの新規ビュービデオ拡散モデルのためのモーションアウェアトレーニングフレームワークである。
我々の重要な発見は、特定の注意層が強い対応の手がかりを符号化することであり、そこでは、クエリ機能は幾何学的に対応する場所で重要な特徴に付随する。
これらの動き認識対応を明示的に強化することにより、MVTrack4Genは既存のモデルを改善し、参照ビューにおける動きをより良く追従し、クロスビューの幾何的一貫性を維持する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:56:33 GMT)
Sol Video Inference Engine: Agent-Native Full-Stack Acceleration Framework for Efficient Video Generation [50.5] 本稿では,ビデオ拡散モデルのためのエージェント型,ネイティブな,トレーニング不要なアクセラレーションフレームワークであるSol Video Inferenceを紹介する。
キャッシュ、スパースアテンション、トークンプルーニング、量子化、カーネル融合の5つの広く適用可能なテクニックをエージェントアクセラレーションスタックにまとめる。
ほぼロスレスなVBench品質を維持しながら、エンドツーエンドのアクセラレーションを2倍以上に向上させる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:59:15 GMT)
Towards Robust EEG Decoding Based on Riemannian Self-Attention [50.0] 脳波(EEG)に基づく脳-コンピュータインタフェース(BCI)は、補助技術、リハビリテーション、エンターテイメントに重要な応用がある。
近年,Symmetric Positive Definite (SPD) 学習に基づく脳波復号法は優れた性能を示した。
これらの手法は通常、基本的なネットワークアーキテクチャを使用し、EEG信号間の局所的な関係を明示的に捉えない。
この制限は、信号対雑音比(SNR)が本質的に低いため、脳波信号に問題となる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:31:20 GMT)
Lacuna: A Research Map for Machine Learning [49.5] Lacunaは、LLMを使って論文や学術メタデータをマークダウン要約に変換する機械学習の研究マップである。
LitSearch、Multi-XScience-CS/ML、ScholarQA-CS-ML全体で、LacunaはOpenScholarより優れており、LitSearch検索で最大の利益を得ている。
また、この地図上の多段階レポートエージェントであるLacuna Deep Researchを、25 ReportBench-ML調査タスクで評価した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:00:12 GMT)
Causal-rCM: A Unified Teacher-Forcing and Self-Forcing Open Recipe for Autoregressive Diffusion Distillation in Streaming Video Generation and Interactive World Models [49.4] 本稿では,拡散蒸留と因果訓練のための,先進的で統一的でスケーラブルなアルゴリズム非構造オープンレシピであるCausal-rCMを紹介する。
我々は,学習用合成データのみを用いて,フレームワイドおよびチャンクワイドの両方で最先端のストリーミングビデオ生成性能を実現する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:58:02 GMT)
WatchAct: A Benchmark for Behavior-Grounded Robot Manipulation [49.3] WatchActは、観察された人間の行動に基づくロボット操作のベンチマークである。
WatchActは4つの機能ドメインで14タスクにわたる3,000のロングホライゾンインスタンスで構成されている。
シミュレーションとFranka Research 3ロボットの両方で、現在のシステムはWatchActの解決には程遠い。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:13:56 GMT)
ConflictScore: Identifying and Measuring How Language Models Handle Conflicting Evidence [48.9] 我々は、モデル応答が、その基盤となる文書における矛盾する証拠をどのように認識するかを定量化する新しいメトリクスであるConflictScoreを紹介する。
我々のフレームワークは, 反応を原子的クレームに分解し, それぞれのクレームに対して各クレームをラベル付けし, それらのラベルを2つの補完的尺度に集約する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:00:09 GMT)
The Generalization Spectrum: A Chromatographic Approach to Evaluating Learning Algorithms [48.6] 従来の評価は、i.d.テストセット上での学習アルゴリズムの最終性能を測定し、学習を1つの集計スコアに還元する。
このアプローチは、基本的な疑問を曖昧にしている — 特定の例から学ぶことは、どの程度他人に一般化されるのか?
この隠蔽次元を公開するために設計された評価フレームワークであるGeneralization Spectrumを紹介する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:26:02 GMT)
Rethinking Training & Inference for Forecasting: Linking Winner-Take-All back to GMMs [48.2] 自律走行のための軌道予測は急速に進歩しているが、代表モデルはしばしば予測モードよりも非形式的な後部を生成する。
我々は、この K-平均的なハード割当 (one-hot) が非形式的モード確率の源であると主張する。
当科では,(1)近隣の候補軌跡を集約するテストタイム後方重み付け,(2)1段階の予測最大化(EM)更新の2つの治療方法を紹介した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:26:43 GMT)
PhaseWin: An Efficient Search Algorithm for Faithful Visual Attribution [48.1] 忠実な視覚帰属のための効率的なサブセット探索アルゴリズムであるフェイズウィンを提案する。
PhaseWinは、greedy領域の選択をフェーズドウィンドウ検索手順に再編成する。
グローバルな候補スクリーニング、適応プルーニング、および局所的なウィンドウリファインメントを交互に行う。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:43:17 GMT)
ScaleHP: Estimating Hand Pose in Metric Space [47.9] 距離空間ハンドポーズ推定は、没入型人間とコンピュータの相互作用とロボット工学にとって不可欠である。
本研究では,人間の手骨の内在的比例関係が,人類学的な先行を包含していることを観察する。
本稿では,エンド・ツー・エンドのワンステージポーズ推定フレームワークであるScaleHPを紹介する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:26:24 GMT)
Exploring Dualistic Meta-Learning to Enhance Domain Generalization in Open Set Scenarios [47.8] ドメインの一般化は、複数のソースドメインから学習し、見えないターゲットドメインに一般化する。
開集合領域の一般化は、見知らぬ領域における見つからないクラスを認識するために提案される。
We propose a novel meta-learning stategy called dualistic Meta-learning with joint DomaIn-Class matching (MEDIC)。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:19:52 GMT)
FedReLa: Imbalanced Federated Learning via Re-Labeling [47.7] フェデレーテッド・ラーニングは、プライバシ保護を伴う分散モデルトレーニングにおける最優先のアプローチとして登場した。
グローバルクラス分布の非依存性は、データレベルの手法に重大な課題をもたらす。
我々は、フェデレート学習におけるデータ不均一性とクラス不均衡の共存に対処する新しいデータレベルアプローチであるFedReLaを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:13:41 GMT)
VADAOrchestra: Neurosymbolic Orchestration of Adaptive Reasoning Workflows [47.7] 実世界の環境での意思決定は、固定されたスクリプトに従うことはめったにない。代わりに、動的推論プロセスとして展開する。
VADAOrchestraは、複雑な推論過程をモデル化するニューロシンボリックなフレームワークである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:22:32 GMT)
From Weights to Words: Expressing and Editing Preference Model Inferences in Natural Language [47.6] 単語に強調語を導入し、選択問題のデータセットを入力として取り、ドメイン関連選好次元の集合を自動的に発見する手法を提案する。
これらの次元は減弱と不透明の両方に対処する。
モデルの推論を自然言語で外部化することで、ユーザがリアルタイムでモデルを検査し、編集することができる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:51:55 GMT)
Learning Action Priors for Cross-embodiment Robot Manipulation [46.9] ほとんどのビジョン・ランゲージ・アクション(VLA)モデルは、アクション・モジュールをアタッチし、完全なポリシーを共同で最適化することでビジョン・ランゲージ・モデル(VLM)のバックボーン上に構築される。
この研究は、モーダルなVLAアライメントの前に、動作先行でアクションモジュールを事前訓練することを提案する。
本稿では,動作モジュールに時間的交叉運動構造を持たせるための2段階のトレーニングフレームワークを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:59:56 GMT)
Memory Makes the Difference: Evaluating How Different Memory Roles Shape Conversational Agents [46.3] 本稿では,会話記憶の微粒な分類,検索した記憶を異なる役割タイプに分類し,ユーザ中心評価フレームワークを設計する。
記憶の明瞭化は、応答の事実的正確さと制約意識を改善し、それらをより正確かつパーソナライズする。
これらの発見は、フロンティアLSMの力にもかかわらず、よりパーソナライズされた応答を生成するために、異なるメモリタイプをどのように活用できるかを明かした。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:45:45 GMT)
FeVOS: Foresight Expression Video Object Segmentation [46.2] Video Objectタスクは、観察されたフレーム内の関連するオブジェクトのイベント、アクション、外観を記述する表現に焦点を当てる。
本稿では,今後のビデオセグメントにおける将来のイベントを視覚的回答としてクエリするビデオオブジェクトフレームを参考に,Foresight Expressionを提案する。
FeVOSは968のビデオクリップ、14,525の式、および2,904の連鎖アノテーションを備えたデータセットである。
FeVOS-1は、教師付き微調整と学習の2段階パイプラインを通じて、データセット上でトレーニングされた明示的なMLLMベースのモデルである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:56:48 GMT)
Tracing Target Answers in Poisoned Retrieval Corpora via Token Influence Attribution [45.9] TRACEは、トークン影響の帰属を通じて応答関連トークンを追跡することによって、毒攻撃を識別する。
TRACEはまず、検索した文書間で繰り返し発生する高影響キーワードを発見し、次にモデル予測への影響を確認するための二次検証を行う。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:39:26 GMT)
Semantic Consistency Policy Optimization for Reinforcement Learning of LLM Agents [45.6] グループベース強化学習は、軌道上の結果からステップレベルクレジットを導出することにより、長期的・疎逆的タスクの訓練後エージェントを効果的に活用する。
この矛盾は、競合する勾配を同様のアクションに送信し、失敗するロールアウト内の部分的に正しい進捗を無駄にする。
本稿では,この矛盾を緩和する価値のない報酬形成手法であるセマンティック一貫性ポリシー最適化(SCPO)を提案する。
SCPOは、失敗した各ステップを、成功した兄弟姉妹に対してスコアし、その兄弟姉妹に沿った新しい進歩に対してプラスのステップレベルクレジットを追加する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:02:13 GMT)
Scaling Nonlinear Optimization: Many Problems One GPU [45.6] IPOPTに基づく最初のGPUバッチNLPソルバである textttjaxipm を紹介する。
IPOPTに比べてスループットが32.85倍に向上します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:34:41 GMT)
JetSpec: Breaking the Scaling Ceiling of Speculative Decoding with Parallel Tree Drafting [44.7] 投機的復号(SD)は、複数のトークンを起草し、それらを並列に検証することによって、自己回帰的大規模言語モデル(LLM)を加速する。
従来のヘッドベースSD法は因果効率ジレンマに直面していた。
本稿では,一方向起案効率と分岐的因果条件を組み合わせたヘッドベースSDフレームワークJetSpecを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:23:51 GMT)
Bridging Predictions and Interventions: An Integrated Framework for Automated Decision-Systems [44.4] このパースペクティブは、社会システムにおける自動意思決定システム(ADS)を研究するための統合的なフレームワークを開発する。
我々の目標は、ADSの理解を改善し、下流の社会的・組織的な結果をより有意義に予測することである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:29:10 GMT)
G2DP: Diffusion Planning with Spatio-Temporal Grid Guidance [44.0] 自律運転において、拡散に基づくプランナーは、密集した対話的な交通におけるロバストな動き計画のための有望なパラダイムとして現れてきた。
既存のガイダンスは、通常、スパースでエンティティ中心の幾何学的クエリやポストホックの洗練に依存し、インタラクティブなシーンにおいて限られた認識と脆弱なパフォーマンスをもたらす。
G2DP(GuidedGrid-Guided Planning)は,経路時マップによる確率的将来の占領指導を融合させることにより,時間的費用の変動を図っている。
nuPlanの最先端のパフォーマンスを達成し、リアクティブトランスファーにおいて、最強の模倣学習ベースラインを+7.2ポイント上回る。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:38:55 GMT)
V-Zero: Answer-Label-Free On-Policy Distillation with Contrastive Evidence Gating for Fine-Grained Visual Reasoning [43.9] V-Zeroは、対照的なエビデンスゲーティングを伴う視覚的推論のための答えラベルのないフレームワークである。
V-Zeroは、強い一般化を維持しながら、細粒度の視覚的推論を一貫して改善する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:32:38 GMT)
FlowPipe: LLM-Enhanced Conditional Generative Flow Networks for Data Preparation Pipeline Construction [43.8] データ準備パイプラインは、生のテーブルを学習可能なデータに変換することによって、機械学習におけるデータ品質を改善する。
既存の最先端(SOTA)マルチDQNメソッドは3つの重要な制限に直面している。
有向非巡回グラフ上での条件付き確率フロー生成としてパイプライン合成を定式化する統合フレームワークであるFlowPipeを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:02:02 GMT)
In-Context World Modeling for Robotic Control [43.3] In-Context World Modeling (ICWM) は,システム識別を文脈内適応問題として扱うフレームワークである。
ICWMは、自己生成されたタスク非依存的相互作用の短い歴史から、ロボットポリシーが重要なシステム変数を自律的に推論することを可能にする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:53:36 GMT)
The Tatoxa System for Text Detoxification in Low-Resource Languages: The Case of Tatar [43.1] タトキサ (Tatoxa) は、タタール語でテキストをデトキシ化するための最先端のシステムである。
本稿では,低リソース環境下での微調整と評価を目的としたテキストデトキシフィケーションのための新しいデータセットについて紹介する。
言語間移動実験は、文化的に近いロシア語を含む他の言語からの移動が、ネイティブなタタール語の訓練よりも著しく悪いことを示唆している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:36:11 GMT)
From Structure to Synergy: A Survey of Vision-Language Perception Paradigm Evolution in Multimodal Large Language Models [43.0] 本研究は,MLLMにおける統合視覚言語知覚に関する最初の体系的な調査である。
我々はMLLM知覚を人間の知覚に類似した本質的で統一された視覚言語能力として定式化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:20:32 GMT)
UniTeD: Unified Temporal Diffusion for Joint Perception and Planning in Autonomous Driving [42.7] UniTeDは、知覚と計画を共同でモデル化する統合時間拡散フレームワークである。
時間遷移モジュール(TTM)は、歴史的フレームと現在のフレーム間のノイズレベルのミスマッチを解決するために導入された。
さらに,スパース拡散に基づくエンド・ツー・エンド駆動フレームワークで一般的に見られるトレーニング・推論の分散シフトを軽減するために,アンカー・リフレッシュ・ストラテジー(ARS)を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:03:54 GMT)
The Verification Horizon: No Silver Bullet for Coding Agent Rewards [42.4] 私たちが構築できるすべての検証は、人間の意図のプロキシであり、意図そのものではない。
本研究では,一般的なコーディングタスクのテスト検証器,タスクのルーリック検証器,現実世界のエージェントタスクのユーザ検証器,ロングホライゾンタスクの自動エージェント検証器の4つの報奨構成について検討する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:45:03 GMT)
SE-AGCNet: An End-to-End Framework for Joint Speech Enhancement and Loudness Control in Meeting Scenarios [42.4] 我々はSEとAGCを協調的に最適化するエンドツーエンドフレームワークであるSE-AGCNetを提案する。
本研究は,SE-AGCNetが音声品質とASRの精度を競争ベースラインよりも向上しつつ,常に目標音量を達成することを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:32:42 GMT)
Optimal observables for quantum-enhanced sensing and applications in a Floquet time crystal sensor [42.0] 我々は、単純なプロトコル、すなわちモーメントの方法(MoM)に焦点を当てる。
まず、対称対数微分(SLD)演算子が量子フィッシャー情報の束縛を飽和させることを示した。
SLDは一般に複雑で非局所的であり、直接実験的な実現は不可能であることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:00:14 GMT)
High-Probability PL-SGD with Markovian Noise: Optimal Mixing and Tail Dependence [41.6] マルコフ連鎖によって試料が生成された場合,ポリアク・オジャシエヴィチ(PL)条件を満たす目的の1次法について検討した。
ライトテール設定では、標準成長エンベロープスケールの通常のグラディエントD(SGD)に対して、以前の均一時間高確率境界を$widetildeO(t_mix/k)$とする。
我々は、この混合時間に対する線形依存が、持続的2で駆動される二次目的物上の一致する$(2 t_mix/k)$下界によって最適であることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:00:56 GMT)
Learning with a Single Rollout via Monte Carlo Pass@k Critic [41.2] 拡張学習におけるトークンレベルの利点を推定することは、エピソード体験コレクションのスケールアップが高価であるため困難である。
言語モデルのためのRLにおけるトークンレベルの信用代入を特徴とする単一ロールアウトポリシ最適化について検討する。
SR-PPOは、Pass@128の成功率の連続的な上昇とともに、安定した学習力学を示すことを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:26:34 GMT)
On the Viability of Requirements Generation From Code: An Experience Report [40.7] 要求工学における実証的研究は、ソースコードと対応する要件をペアリングする適切なデータセットの欠如によって妨げられている。
この欠点に対処するための誘惑的なルートは、既存のコードベースから要求を合成するためにLarge Language Modelsを使用することである。
LLMをベースとしたRAGをベースとしたエージェントアプローチの評価を行い、ソースコードから要件を生成し、その実装状況を検証するとともに、要求臭を合成的に導入する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:28:14 GMT)
FORCE: Efficient VLA Reinforcement Fine-Tuning via Value-Calibrated Warm-up and Self-Distillation [40.5] FORCEは、両方の問題に取り組むことで微調整を安定化する3段階のフレームワークである。
FORCEは成功率を79%向上させ、RL法を10%向上させ、トレーニングを32.5%加速させた。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:23:18 GMT)
NavIsaacLab: Generating Realistic Crowd via Parallel Robot Learning for Benchmarking Human-aware Navigation [40.5] 本稿では,ナビゲーションポリシーをベンチマークし,トレーニングするための総合的なフレームワークであるNavIsaacLabについて述べる。
提案フレームワークはIsaac Labをベースとして,フォトリアリスティックなシーンレンダリング機能を採用し,GPU上での並列シミュレーションをサポートする。
人間の行動の現実性を高めるために、軌道拡散モデルと対向運動学習コントローラを組み込んだデータ駆動型アプローチを用いる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:08:19 GMT)
Explainable Control Framework (XCF) based on Fuzzy Model-Agnostic Explanation and LLM Agent-Supported Interface [39.6] コントローラが制御動作とその基盤となる動作メカニズムをどのように決定するかを説明するために、説明可能な制御フレームワーク(XCF)が提案されている。
設計した枠組みに基づいて,階層型ファジィモデルに依存しない制御系(HFMAE-C)の新たな説明法を提案する。
Inverted pendulum system と Turtlebot obstacle avoidance のケーススタディにより,提案手法の有効性が示された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:17:54 GMT)
SENTRY: SAM2-Enhanced Neighbor-Aware and Temporally Reasoned Memory for Visual Tracking [39.5] SAM2ベースのビジュアルオブジェクトトラッキングにおけるメモリ更新機構を再検討する。
本稿では,SENTRYについて紹介する。
コミットする前に、各メモリ更新を短時間の時間的一貫性で検証する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:13:44 GMT)
Distill on a Diet: Efficient Knowledge Distillation via Learnable Data Pruning [39.1] 知識蒸留(KD)は資源制約環境における効率的な推論のためのコンパクトなモデルを得るために広く用いられている。
本稿では,影響関数と学習可能なサンプリングポリシを組み合わせた効率的なデータ解析フレームワークIF-Betaを提案する。
CIFAR-10/100 と ImageNet の実験では、IF-Beta は他のベースラインよりも幅広いプルーニング比で一貫して優れていた。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:17:05 GMT)
Recommendation as Generation: Unifying Personalized Video Generation and Recommendation at Industrial Scale [39.0] 本稿では,提案するRecommendation-as-Generation(RaG)を提案する。
我々のフレームワークは、共有セマンティックID(SID)を通じて生成レコメンデーションとビデオ生成を統一する。
私たちはRaGを4億人のデイリーアクティブユーザーを持つ産業規模のプラットフォームにデプロイし、収益クリティカルな広告シナリオで評価します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:23:20 GMT)
ShutterMuse: Capture-Time Photography Guidance with MLLMs [39.0] 現実世界の撮影には、カメラフレーミングとポーズの両方にキャプチャタイムのガイダンスが必要である。
既存のクリーピングベンチマークでは、主にポストホック作物の予測と見落としの主観的推奨を評価している。
CaptureGuide-Benchは、カメラマンサイドのコンポジション決定とリファインメント、テーマサイドのシーン条件付きポーズレコメンデーションという2つの補完的なタスクを持つベンチマークである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:37:56 GMT)
HG-Bench: A Benchmark for Multi-Page Handwritten Answer-Region Grounding in Automated Homework Assessment [39.0] 本稿では,ページ認識と2レベル回答領域のグラウンドニングの欠落した評価設定について述べる。
HG-Benchは1,489,278イメージのソースプールからキュレートされた500個の人手によるK-12宿題サンプルのベンチマークである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:18:50 GMT)
Fuzzy Quantification over OWL Ontologies and Knowledge Graphs [39.0] 本稿では,ファジィ量子化クエリを標準ファジィ表現とグラフの両方で評価するための汎用的なフレームワークを提案する。
提案されたアプローチの鍵となる利点は、その固有の適応性(英語版)である。
本稿では,今後の研究を支援するために開発された,このシステムの公的な実装であるQ2S2を紹介する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:56:05 GMT)
Tensorion: A Tensor-Aware Generalization of the Muon Optimizer [38.8] 近年の研究では、行列構造の利用により力学が向上することが示されている。
顕著な例は、スペクトルノルム制約の下で最も急降下を行うムオンである。
次のステップと導入は、Muonの制約された最適化の観点を拡張するテンソル認識である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:46:04 GMT)
RoboAtlas: Contextual Active SLAM [38.6] 本稿では,幾何学的探索と意味論的推論を適応的にバランスするコンテキスト型アクティブSLAMフレームワークであるRoboAtlasを紹介する。
1800m2を超える大規模実環境下でのシミュレーションおよびUnitree Go2ロボット上で,約30kのマップ付きセマンティックインスタンスを用いてシステム評価を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:26:07 GMT)
MiniOpt: Reasoning to Model and Solve General Optimization Problems with Limited Resources [38.2] MiniOptは、最適化問題を解決するための強化学習フレームワークである。
定式化と解法を共同で評価する階層的なスコア構造を持つ報酬関数である OptReward を導入する。
実験により、MiniOpt-3Bは様々な最適化タイプ、問題シナリオ、タスク領域にまたがる強力な最適化の一般化を示すことが示された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:48:06 GMT)
Beyond Visual Forensics: Auditing Multimodal Robustness for Synthetic Medical Image Detection [38.1] 合成医療画像は、診断詐欺や保険詐欺などのリスクが増大する。
我々は、画像記録インタフェースにおけるマルチモーダルロバスト性の監査として、合成医用画像検出を再構成する。
我々のベンチマークは、画像のみの設定を超えてマルチモーダルロバスト性を評価し改善するための標準化されたツールを提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:08:41 GMT)
Constraint Tax in Open-Weight LLMs: An Empirical Study of Tool Calling Suppression Under Structured Output Constraints [37.9] 本稿では,生産エージェントシステムで観測された再現可能な現象について報告する。
複数のオープンウェイトモデルでは、高いスキーマ準拠を維持しながら、ツールの起動を中止している。
本稿では,スキーマ制約された応答生成からツールの実行を分離する推論時間戦略であるTransparent Two-Executionを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:14:18 GMT)
Reason Before You Retrieve: Agentic Planning for Multi-modal RAG [37.9] 本稿では,検索対象と検索対象の両方を明示的にモデル化することで,検索前の理由付けを行うマルチモーダルエージェント検索フレームワークMM-R2を提案する。
MM-R2は、まず、画像検索ペアからインテントグラウンドされた検索状態を構築し、情報要求、グラウンドドレファレント、検索制約をキャプチャする。
その後、構造化されたKnowledgeMap上で検索を行い、エージェントが関連する検索ユニットを選択して、内部にグラウンドドクエリを発行する。
Infoseek と Encyclopedic VQA データセットの実験により、MM-R2 は解答精度でかなり高いベースラインを上回り、より解釈可能で検証可能な検索軌道を得ることが示された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:40:49 GMT)
Optimizing CUDA like a Human: Micro-Profiling Tools as Expert Surrogates for LLM-Based GPU Kernel Optimization [37.6] KernelProはクローズドループのマルチエージェントシステムで、カーネルコードを自動生成、プロファイル、反復的に最適化する。
KernelProでは、レベル1/2/3の2.42x/4.69x/5.30xの平均スピードアップを実現し、あらゆる難易度で最先端のパフォーマンスを確立する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:28:09 GMT)
Finding the Time to Think: Learning Planning Budgets in Real-Time RL [37.3] 本研究では,エージェントのアクションを待ちながら環境が進行するリアルタイムRL環境について検討する。
リアルタイムのパックマン、テトリス、スネーク、スピードヘックス、スピードゴーをまたいで、ゲーティングポリシーは固定予算とベースラインを上回ります。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:55:15 GMT)
State Space Models Meet Remote Sensing: A Survey [36.5] ステートスペースモデル(SSM)は、線形計算の複雑さと長距離依存を捉える強力な能力を提供する。
本稿では,SSMによるリモートセンシングのアプローチを概観し,SSMが最初に現場に導入されて以来,研究のほとんどを網羅する。
リモートセンシングタスクにおけるSSMアプリケーションの多次元解析を行い,アーキテクチャ設計の進歩について議論する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:50:31 GMT)
From Clicks to Intent: Cross-Platform Session Embeddings with LLM-Distilled Taxonomy for Financial Services Recommendations [35.6] 本稿では,Web ベースインタラクションのためのスケーラブルで多目的な意図予測フレームワークを提案する。
我々の手法は、生のウェブクリックストリームを2つの出力に変換する: 自己教師型トランスフォーマーは、マルチモーダルなクリックストリームをコンパクトなセッション埋め込みに変換する。
本システムでは,LLM蒸留と組み合わせた自己教師型クリックストリーム表現が,生産における定量的タスクと質的理解の両立を図っている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:18:56 GMT)
TACO: Towards Task-Consistent Open-Vocabulary Adaptation in Video Recognition [35.2] 既存の研究は、微調整データ分布を超えた表現の偏りを見落としていると論じる。
この不整合によって引き起こされる潜在的な負の効果を軽減するためのフレームワークであるemphTACOを紹介する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:06:12 GMT)
Staying VIGILant: Mitigating Visual Laziness via Counterfactual Visual Alignment in MLLMs [35.0] MLLM(Multimodal large language model)は、大きな言語モデル(LLM)を視覚的に拡張し、画像やテキストに対する共同推論を可能にする。
機械学的な研究は、この弱点が視覚的な怠慢に由来することを示唆している。
本稿では,視覚情報ゲイン・イン・アライメント(VIGIL)を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:12:24 GMT)
Benchmarking Vision-Language Models for Microscopic Plant Image Understanding [34.5] 植物画像の視覚言語モデル(VLM)を評価するためのベンチマークであるPlantMicroを提案する。
我々は、顕微鏡画像理解の異なる側面を捉える一連の補完的なタスクを設計する。
実験により、現在のVLMは微粒な認識と生物学的根拠の推論に苦しむことが示された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:57:25 GMT)
Space-Efficient Language Generation in the Limit [34.4] 本稿では,空間効率の最小限の制約の下で,テキスト生成の資源認識理論を提案する。
私たちは$mathcalC_s,k$という,DFAが認識する言語のコレクションに注目しています。
より厳格なメモリ予算の下では、最強の世代保証を特徴付ける。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:55:34 GMT)
Re-mixing Embeddings for Patient Augmentation in Data Scarce Multiple Instance Learning [34.1] データ不足はMIL(Multiple Instance Learning)における大きなボトルネックである
組込み空間における現実的な患者を直接生成する統計的基盤型患者増悪アプローチを導入する。
臨床的に関係のある3症例にまたがって本手法の評価を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:45:44 GMT)
DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation [34.0] オープンドメインの主題駆動型テキスト・ツー・ビデオ(S2V)生成は、学術と産業に大きな関心を集めている。
オープンなドメインビデオパーソナライゼーションを実現するために,高い忠実度と生成性を実現するDomainShuttleを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:33:13 GMT)
SurgAtlas: A Large-Scale Surgical Video-Language Dataset with 2,391 Hours of Open and Minimally Invasive Surgery [33.7] これまでで最大の手術用ビデオ言語データセットであるSurgAtlasを紹介した。
SurgAtlasはまた、大規模な手術を含む初めての手術用ビデオ言語データセットであり、6,182本のオープンプロシージャビデオと9000以上の最小限の侵襲的な記録がある。
また,外科的理由付けのための臨床基礎的ベンチマークとして,多種多彩なオープンおよび最小侵襲の術式にまたがる視覚的質問応答対を検証した専門家検証サブセットも提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:53:56 GMT)
Sarashina2.2-TTS: Tackling Kanji Polyphony in Japanese Speech Generation via Data Scaling and Targeted Data Synthesis [33.0] 日本語中心の音声合成システムであるSarashina2.2-TTSを紹介する。
日本語と英語のバランスの取れた混合データを用いて,約361k時間に訓練を拡大した。
総じて、サラシナ2.2-TTSは、最先端の漢字読み上げ精度を達成し、一般的な文レベルの発音のベースラインと一致させる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:57:21 GMT)
Efficient Remote Sensing Instance Segmentation with Linear-Time State Space Distilled Visual Foundation Models [32.8] 線形計算複雑性を持つ新しいリモートセンシングインスタンスセグメンテーション手法であるRS4Dを紹介する。
本稿では,軽量SSMバックボーンの事前学習のための適応雑音とマスキング知識蒸留訓練法を提案する。
提案するSSMバックボーンは,VTベースのアプローチと比較して,パラメータの8倍,FLOPの9倍の削減を実現している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:41:23 GMT)
MKG-RAG-Bench: Benchmarking Retrieval in Multimodal Knowledge Graph-Augmented Generation [32.8] 我々は、MKG-RAGの検索を評価するクロスドメインベンチマークであるMKG-RAG-Benchを紹介する。
MKG-RAG-Benchは、一般ドメインと医療ドメインにまたがる2つのマルチモーダル知識グラフから構築されている。
本研究は,MKG-RAGのエンド・ツー・エンド性能において,効果的なマルチモーダル検索が依然として不可欠であることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:38:42 GMT)
Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models [32.6] 一つの融合スキームがより良い結果をもたらす傾向があり,それがハイブリッド融合スキームの開発に有用かどうかを考察する。
本稿では,結合と付加に加えて,アフィン変換とクロスアテンションという2つの融合スキームを提案する。
画像トークンとの融合は視覚的プロンプトチューニングにおいて重要な役割を担い、ハイブリッドフュージョン方式はViTの層セマンティクスをより効果的に活用できることを示した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:06:23 GMT)
Data-driven Machine Learning Cannot Reach Symbolic-level Logical Reasoning -- The Limit of the Scaling Law [32.1] 我々は,教師付き深層学習が記号レベルのシロメトリクス的推論に到達するのを防ぐ2つの方法の限界を示す。
我々はEuler Netが厳密なシロメトリクス推論を達成できないことを実験的に示す。
教師あり機械学習システムは、記号論理的推論の厳密さを達成できないと結論付けている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:30:08 GMT)
Omni-Perception Policy Optimization for Multimodal Emotion Reasoning [31.9] マルチモーダル知覚を明示的に最適化する強化学習フレームワークOPPOを提案する。
オムニ・パーセプション・リワード(Omni-Perception Reward)は、微妙な視覚的、音響的、感情的な手がかりに地道理を分解する。
実験により,OPPOはMER-UniBenchおよびMME-Emotion上で最先端の性能を達成することが示された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:43:26 GMT)
ForensicsTok: Forensics-Guided Tokenized Modeling for Image Tampering Localization [31.8] 本稿では,自動回帰シーケンス生成タスクとして画像操作のローカライゼーションを再構成するForensicsTokを提案する。
ForensicsTokは空間的に接地されたトークンシーケンスを直接生成し、中間管理なしで正確なマスク予測を可能にする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:54:47 GMT)
OracleAnalyser: Analysing Implicit Semantics of Oracle Bone Scripts through MLLMs with Post-training [31.8] 本稿では,オラクルAnalyserを提案する。
我々は,Qwen2.5-VL-3B-インストラクトを複数の後学習段階を通して微調整し,新しい選好最適化アルゴリズムを導入する。
さらに, 骨推定データセットと骨選好データセットをそれぞれリリースし, さらに, 骨鑑定のためのモデルの解析能力を評価するための新しいベンチマークを構築した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:54:41 GMT)
Hypergraph Normal World Models for Logical Visual Anomaly Detection [31.6] 本稿では,モデルが名詞のみのイメージから,そのようなカテゴリー固有の正規世界を学ぶことができるかどうかを考察する。
我々は,凍結したDINOv2パッチトークンをパッチ,関係,ハイパーグラフ統計に蒸留する正規専用検出器であるHypergraph Normal World Modelを提案する。
ごく少数の実験で、モデルは非常に限られた正常な画像で有効であることが示されている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:56:50 GMT)
Statistically Valid Hyperparameter Selection: From Tuning to Guarantees [31.0] ハイパーパラメータの選択は、現代の人工知能システムの展開における重要なステップである。
ハイパーパラメータの選択は通常、最良の経験的手法を用いて行われる。
本書では,信頼度の高いハイパーパラメータ選択のための統一統計フレームワークを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:07:26 GMT)
auto-psych: Automating the science of mind using agent-driven theory discovery and experimentation [30.5] 計算認知科学における理論生成プロジェクトに対して,自動発見技術を適用した。
認知心理学の古典的なケーススタディを用いて、コインフリップのどのシーケンスが、主観的にランダムに思えるかを判断する。
我々のシステムでは、ネストされたエージェントベースの発見ループを用いて人間の行動の説明理論を生成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:43:01 GMT)
Semantic Code Clone Detection: Are We There Yet? [30.2] コードクローンの検出は数十年にわたって広く研究されてきた。
最近のアプローチでは、ベンチマークデータセット上でのセマンティック(Type-4)クローンのパフォーマンスが著しく向上している。
本研究では,最先端のセマンティックコードクローン検出器の一般化可能性について,最初の系統的研究を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:11:40 GMT)
LEVIRDet: A Million-Scale 159-Category Dataset and Foundation Model for Universal Remote Sensing Object Detection [30.0] LEVIRDet-159は、これまでで最大かつ最も包括的なリモートセンシングオブジェクト検出データセットである。
各キースケール次元において、LEVIRDet-159は対応する最大のリモートセンシングオブジェクト検出データセットを超える。
我々はLEVIRDetNetを設計する。LEVIRDetNetは、ユニバーサルリモートセンシングオブジェクト検出のためのスケール階層認識基盤モデルである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:25:54 GMT)
Same Evidence, Different Answer: Auditing Order Sensitivity in Multimodal Large Language Models [29.7] マルチモーダルな大規模言語モデルの5面監査であるFacet-Probeを紹介する。
監査対象の18のMLLMはいずれも順序不変ではないことが分かりました。
MLLMの標準報告軸として,クロスオーダーフリップ率を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:53:26 GMT)
MIMFlow: Integrating Masked Image Modeling with Normalizing Flows for End-to-End Image Generation [29.6] Masked Image Modeling (MIM) は表現学習に優れていますが、生成パイプラインへの統合は、大部分がモジュール化され、相容れないままです。
我々は、潜在意味論、画素再構成、生成フローを共同で最適化する統合エンドツーエンドフレームワークであるMIMFlowを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:37:10 GMT)
TryOnCrafter: Unleashing Camera Trajectories for Realistic Video Virtual Try-on via a Renderable 4D Try-on Proxy [29.4] 今回紹介するTryOnCrafterは,CaM-VVTタスク用に特別に設計された,DiTベースの統合フレームワークである。
TryOnCrafterは、人間の再ローカライゼーション、弾丸の時間効果、および360ドルの軌道観測など、さまざまなダウンストリームアプリケーションを促進する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:59:06 GMT)
Small Initialization Matters for Large Language Models [28.7] パラメータ初期化は訓練の遺伝子様決定因子であり、特にモデル能力の指標であることを示す。
スケールの縮小はプレトレーニングを継続的に改善し、推論要求タスクに最大の利益をもたらす。
小規模な初期化の利点を抑えるために広く使われている2つの経験的設定を同定し、その緩和が適切なスケーリングを回復することを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:25:05 GMT)
STEB: A Speech-to-Speech Translation Expressiveness Benchmark for Evaluating Beyond Translation Fidelity [28.7] 音声音声翻訳(S2ST)は,語彙的意味だけでなく,表現的属性も保存すべきである。
中国語の32.6時間のベンチマークであるSTEB(Speech-to-Speech Translation Expressiveness Benchmark)を紹介する。
ケースドシステム,エンドツーエンドモデル,音声大言語モデルをカバーする6つのS2STシステムを評価する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:06:41 GMT)
Real-Time Voice AI Hears but Does Not Listen [28.5] 我々は,4つの主要な実運用音声システムを評価する。
4つのシステムはすべて、声ではなく言葉に作用する。
我々は、音声AIの知覚と行動の分離を、感情的な知能ギャップと表現する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:55:38 GMT)
Sampling sea state using a diffusion model [28.1] 海の状態予測は、海洋の運用と地球系の結合モデルに不可欠である。
現在のスペクトル波モデルは、多くのユースケースで計算的に禁止されている。
本研究では,大域海況推定のための拡散モデルを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:19:59 GMT)
CyberChainBench: Can AI Agents Secure Smart Contracts Against Real-World On-Chain Vulnerabilities? [28.0] CyberChainBenchは、LLMベースのエージェントをスマートコントラクトセキュリティで評価するためのベンチマークである。
DeFiHackLabsの541の現実世界のエクスプロイトインシデントから構築されたこのベンチマークは、エンドツーエンドのチェーン評価を提供する。
最良の構成は検出で37.5%、エクスプロイトで43.7%、パッチで23.4%である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:58:16 GMT)
TaskNPoint: How to Teach Your Humanoid to Hit a Backhand in Minutes [27.8] これは、ヒューマノイドロボットにダイナミックスキルを教えるための正しいレシピでもある、と我々は主張する。
TaskNPointは、コーチ・ラーナーの労働部門を明示するトレーニングプロトコルである。
このアプローチは、人間によって投げられたボールに対して前手と後ろ手を打ち、入ってくるサッカーボールを蹴り、新しい場所から箱を拾い、配置するUnitree G1ヒューマノイド上でテストする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:56:30 GMT)
Transferable Attack against Face Swapping in an Extended Space [27.8] Relighting function(AIR)に基づく付加的アイデンティティ攻撃(Additive Identity attack)と呼ばれる主観認識型FSモデルに対するトランスファー可能な攻撃を提案する。
AIRは再照明と加法摂動を利用して、主観非依存FSモデルにおける同一性抽出モジュールを誤解させる。
GANや拡散ベースのFSモデルを含む、最先端の主題に依存しない様々なFSモデルに1000枚の画像ペアを用いた実験は、AIRが攻撃の成功率と画像品質の両方の観点から、既存のすべての攻撃を上回っていることを示している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:09:57 GMT)
AISPO: Enhancing Depth Reliability for Robotic Manipulation of Non-Lambertian Objects via Affine-Invariant Shape Prior [27.6] AISPOは,難解な検知条件下での操作の深度信頼性を向上させるための深度補完フレームワークである。
平均深度精度に主眼を置く手法とは異なり,本手法は予測深度マップの物理的妥当性と構造的整合性を強調する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:37:11 GMT)
DynaMOMA: Instantaneous Prediction of Grasp Poses for Mobile Manipulation of Dynamic Objects [27.4] 本稿では,身体全体の制御ポリシと瞬時に把握軌道予測を結合する動的移動操作フレームワークを提案する。
提案手法は,多様な設定をまたいだ動的オブジェクトの移動操作やメトリクスの把握において,高い性能を実現する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:58:15 GMT)
Evaluating Japanese Dialect Robustness Across Speech and Text-based Large Language Models [27.2] 音声言語モデル(SLM)は、大規模言語モデル(LLM)と音声処理コンポーネントを統合する。
本研究では,日本語方言を用いたSLMとLSMの方言的堅牢性について検討した。
実験の結果,SLMのロバスト性はテキストベースと相関していることがわかった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:57:45 GMT)
VPA-Guard: Defending and Benchmarking Image-to-Video Generation Against Visual Prompt Attacks [27.1] 本稿では,視覚中心のプロンプト攻撃下での映像生成の安全性を評価するための最初の体系的ベンチマークを示す。
本稿では,VPA-Guardを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:00:08 GMT)
Agentic evolution of physically constrained foundation models [26.9] 人工知能はますます科学的発見の自動化を推進しているが、現代のジェネラリストエージェントは物理的根拠を欠いている。
ハードウェア準拠のコンピュータシステムを自律的に設計する物理基盤のマルチエージェント発見エンジンを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:07:59 GMT)
Closing the Loop to Discover Psychological Theories with an Automated Cognitive Scientist [26.8] 本稿では,完全自律型エージェントAIシステムであるAutomated Cognitive Scientist(AutoCog)を紹介する。
認知理論の構築を明示的で実行可能で累積的な科学に変えるためにどのように使用できるかを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:20:58 GMT)
Dual Distribution Estimation for Zero-shot Noisy Test-Time Adaptation with VLMs [26.6] 本稿ではDDE(Dual Distribution Estimation)という新しいフレームワークを提案する。
DDEは2つの新しいモジュールを組み込んでいる。正の特徴分布推定(PFDE)と負のラベル分布推定(NLDE)である。
大規模なImageNetベンチマークでは、DDEは高調波平均精度が3.70%向上し、OOD検出のためのFPR95を6.20%削減した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:32:01 GMT)
SAGE-Nav: Leveraging LLM Planning and Alignment Fusion for Hierarchical Scene Graph-Guided Navigation [26.2] Object-Goal Navigation (Nav)は、エゴセントリックな視覚的観察のみを使用して、特定のターゲットを自律的に特定するエンボディエージェントを必要とする。
SAGE-Navは,Large Language Models(LLM)の推論機能と動的シーングラフを統合した,新しい階層型フレームワークである。
SAGE-Navは,物理ロボット展開に必要な低制御遅延を維持しつつ,ナビゲーション効率とゼロショット一般化の大幅な向上を実現していることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:24:39 GMT)
Accelerating Disaggregated RL for Visual Generative LLMs with Diffusion-Based Parallelism and Trainer-Assisted Generation [26.1] DigenRLは拡散型大規模言語モデル(LLM)のフレームワークである
柔軟なリソース割り当てをサポートし、異種GPUに対応し、効率的なタスクスケジューリングを容易にする。
DigenRLは、最先端拡散RLシステムよりも1.56-2.10倍のスループット向上を実現している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:11:05 GMT)
Event-Adaptive Motion Planning with Distilled Vision-Language Model in Safety-Critical Situations [26.0] 大きな視覚言語モデル(VLM)は、常識推論において顕著な能力を提供する。
本稿では,VLMに基づくロボットナビゲーションのための効率的なフレームワークであるイベント適応型モーションプランニング(EAMP)を提案する。
EAMPは、高レベルの推論と低レベルの制御を効果的に調整し、動的安全性マージンを大幅に改善する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:35:26 GMT)
A Time-Reparameterized Cumulative Intensity Extrapolation Sampler for Discrete Flow Matching [25.5] TR-CIEは,機能評価の制限によるサンプリング品質の向上を目的としている。
累積強度の局所近似誤差を限定する理論解析を行う。
合成タスク,テキスト生成,テキスト・ツー・イメージのベンチマーク実験により,本手法は限られたNFE下でのサンプリング品質の向上を実証した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:09:21 GMT)
OPERA: Aligning Open-Ended Reasoning via Objective Perplexity-based Reinforcement Learning [25.5] 我々は、不確実な外部判断を、難易度力学から派生した本質的な報酬に置き換えるOPERAを提案する。
このパイプラインは20,000の高品質な推論軌道からなる大規模なデータセットを生成する。
Qwen3-8BにOPERAを実装することで、オープンソースモデル間の新たな最先端が確立される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:31:14 GMT)
BrainAgent: A Large Language Model-Driven Multi-Agent Framework for Autonomous Brain Signal Understanding [24.8] BrainAgentは、抽象自然言語意図を厳格で実行可能でエンドツーエンドの処理パイプラインに基盤として設計されたフレームワークである。
実証的な結果は、BrainAgentがより優れた信頼性を持つ複合体を効果的に自動化し、民主化された脳信号理解へのパラダイムシフトを示すことを示している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:54:26 GMT)
MRI2Rep: Autoregressive Structured Report Generation for 3D Liver MRI [24.6] 肝MRIレポート生成のための自己回帰フレームワークであるMRI2Repを提案する。
レポートからラベルへの正準化(Report-to-Label Canonicalization, RLC)モジュールは、自由テキストレポートを構造化された閉語彙診断シーケンスに変換する。
ホールドアウトテストセットでは、MRI2Repはケースレベルの感度、29.4%の病変レベルF1、82.4%の肝レベルの精度を達成している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:31:44 GMT)
Concept Removal for Frontier Image Generative Models [24.4] 本稿ではフロンティア拡散とイメージ自己回帰モデルのための新しい概念除去手法を提案する。
私たちの介入は、内部のボトルネック層を元のレイヤを複製するように訓練されたトランスコーダに置き換えます。
この手法は、現代の拡散モデルと自己回帰モデルにまたがる最先端の概念除去性能を実証的に達成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:25:30 GMT)
Play2Perfect: What Matters in Dexterous Play Pretraining for Precise Assembly? [23.6] ロボットが正確な組み立てを完了する前には、まず遊び方を学ばなければならない、と私たちは主張する。
本研究では,多種多様なオブジェクトや目標に対して,タスクに依存しない事前学習を行うためのRLフレームワークであるPlay2Perfectを提案する。
我々は,より密集した多段階報酬が与えられた場合においても,前者はRLトレーニングのスクラッチの33倍のサンプル効率が得られた。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:39:12 GMT)
Why Multi-Step Tool-Use Reinforcement Learning Collapses and How Supervisory Signals Fix It [23.5] ツールの使用により、大きな言語モデルで複雑なタスクを実行できる。
近年のエージェント強化学習法では, モデル能力の向上が期待できる。
いくつかのモデルは破滅的な崩壊を示し、パフォーマンスが突然低下し、ツール呼び出し構造が失敗する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:55:56 GMT)
DCSNet: Multiscale Feature Aggregation for Small Medical Object Segmentation with Detection-guided Hierarchical Cropping [23.5] 医用画像における小さな物体のセグメンテーションは、主にクラス不均衡と固有の境界複雑性によって妨げられる。
本研究では,グローバルな高密度予測を局所的な精錬プロセスに変換するエンドツーエンドフレームワークである検出誘導クロッピングネットワーク(DCSNet)を提案する。
3つの多様な医療データセットにわたる大規模な実験により、DCSNetは既存の最先端の手法を大幅に上回っていることが示された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:46:58 GMT)
What We are Missing in Multimodal LLM Evaluation? [23.1] MLLM(Multimodal large language model)は、テキスト、画像、オーディオ、ビデオなどの様々な入力を処理し、テキスト応答を生成する。
既存の評価ベンチマークのほとんどは、独立したタスクに限定されており、モデルがモダリティを越えて情報を統合するかどうかについてはほとんど明らかになっていない。
MLLMを評価するための現在の手段について検討し、時間空間コヒーレンス、物理世界理解、マルチモーダル一貫性、選択的注意などのギャップを特定するために既存のベンチマーク分類をレビューする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:40:53 GMT)
Externalizing Research Synthesis and Validation in AI Scientists through a Research Harness [22.6] Xcientistは、研究合成と実験的検証を検査可能な契約統治プロセスに外部化する研究ハーネスである。
Xcientistの文献は、証拠、アイデアステート、実装計画、アブレーション記録、修復痕跡を永続的な研究成果として整理している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:29:26 GMT)
Meta-learning as a principle for human-like visual representations [22.4] 事前訓練されたニューラルネットワークは、前例のない成功を収めた人間の視覚表現をモデル化する。
これらのネットワークは1つの固定目標を最適化する一方、人間の表現はオープンなタスクをサポートする必要がある。
我々は、画像から高レベルな概念にマッピングする数千のセマンティックにリッチなタスクを、人間のデータから監督することなく、シーケンスモデルを訓練する。
事前訓練されたベースエンコーダと比較して、メタ学習された表現は人間の類似性判定、セマンティック・ルール学習、高レベルの視覚野をより正確に予測する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:28:17 GMT)
GeMoE: Gating Entropy is All You Need for Uncertainty-aware Adaptive Routing in MoE-based Large Vision-Language Models [22.3] 大規模ビジョンランゲージモデル(LVLM)は、推論コストを維持しながらパラメータ容量を拡大する。
従来のMoEメソッドはTop-k静的ルーティング戦略を採用しており、入力のバリエーションを考慮せず、専門家の数を適応的に選択する。
ゲティングエントロピーに基づく不確実性を考慮した適応ルーティング(GeMoE)を提案する。
本手法は,従来の静的なルーティングに比べて99.5%の平均的な性能保持を実現するとともに,平均的な専門家アクティベーション間隔を36.5%改善する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:34:00 GMT)
Engineering Reliable Autonomous Systems: Challenges and Solutions [21.8] 本報告は,ローレンツセンターワークショップ "Engineering Reliable Autonomous Systems" における議論を捉え,拡張するものである。
The Workshop on Formal Methods for Autonomous Systems (FMAS) とthe Workshop on Agents and Robots for reliable Engineered Autonomy (AREA) の共同主催によるワークショップである。
FMASとAREAのコミュニティのメンバー、業界の実践者、そして自律的なシステムが特有のエンジニアリング上の課題に直面するセクターの代表者を集めた。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:55:55 GMT)
Decoupling Semantics and Geometric Grounding: Spatial Visual Prompts for Language-Conditioned Imitation Learning [21.7] 本稿では,アクション生成ループから空間的グラウンドを明示的に抽出する分離アーキテクチャであるSVP-ILを提案する。
実験では、SVP-ILは最先端のVLAや純粋なビジュモータベースラインよりも著しく優れている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:45:06 GMT)
C2RM-Seg: Causal Counterfactual Reasoning with Structural-Semantic Priors for Weakly Supervised Histopathological Tissue Segmentation [21.6] C$2$RM-Segは2段階のフレームワークで、因果的擬似ラベルの洗練と構造認識のセマンティックエンハンスメントを統合している。
分類には、特徴を潜在因子に分解する因果逆推論モジュール(C$2$RM)を導入する。
セグメンテーションのために,ResNeStの微細な構造特徴と凍結DINOV3基礎モデルからのグローバルなセマンティック先行を結合したDual-Path構造セマンティックアーキテクチャを設計する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:44:26 GMT)
Data Facts: A Metadata Schema for Structured Data Exchange in the NANDini Multi-Agent Ecosystem [21.5] NANDiniは、インテリジェントエージェントが大規模な意思決定のためにデータを作成し、処理し、交換する自動化エコシステムを構想している。
現在のプロトコルには、フェデレーションレジストリ用のMCPA、エージェント間メッセージング、アドレスID、通信のためのA2AとMCPAが含まれているが、構造化されたデータ交換のためのメカニズムは提供されていない。
我々は,JWT認証,機能スコープゲートウェイ認証,A2Aクレデンシャルデリゲートプロトコルという3層セキュリティパイプラインを実装している。
プライベートおよび半プライベートなデータに対しては,JWT認証,機能スコープゲートウェイ認証,A2A認証という3層セキュリティパイプラインを実装しています。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:35:26 GMT)
SidConArena: An Environment Evaluating Agents in Open-Ended,Positive-Sum Bargaining Game [21.3] SidConArenaは、オープンエンドのポジティブサムバーゲティングにおいてLLMエージェントを評価するための新しいベンチマークフレームワークである。
SidConArenaは、3つの結合位相を持つ有限水平部分観測可能なゲームとしてマルチプレイヤー経済を定式化する。
より強力なフロンティアモデルは高い経済効果を達成するが、エージェントは依然として不適切な資源を保有し、受動的に取引し、長期投資計画において制限される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:35:31 GMT)
Stagnant Neuron: Towards Understanding the Plasticity Loss in Multi-Agent Reinforcement Learning Value Factorization Methods [21.2] MARL(Multi-Agent Reinforcement Learning)値分解法は可塑性の喪失に悩まされ、新しいタスクインスタンスに移行する際に徐々に適応に失敗する。
我々は、この問題を停滞したニューロンに遡り、勾配の更新が重みに対して無視できないほど小さくなり、学習を妨げる。
我々は,静止ニューロンを直接対象とする新しい手法であるKNIFE(Knowledge-retentive Neuron-level PlastIcity Focusing InjEction)を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:00:18 GMT)
A Survey of Toxicity Detection and Mitigation Strategies for Multilingual Language Models [21.1] 本研究は多言語モデルに対する毒性検出と解毒に関する研究を合成する。
我々はまず、言語選択、翻訳のピボット、コードスイッチング、正書法の変化、マルチターンインタラクション、そして、安全アライメントを弱めるためにデプロイ後の微調整を利用する脅威モデルをカタログ化する。
次に,タスクの定式化(有害-中性リライト,毒性分類,有害-世代評価),多言語検出アプローチ,緩和戦略を整理する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:24:30 GMT)
AutoSpec: Safety Rule Evolution for LLM Agents via Inductive Logic Programming [21.1] 既存の安全アプローチは基本的なトレードオフに直面している。
本稿では,ユーザセーフ/アンセーフアノテーションから専門家が指導する安全ルールを自動生成するフレームワークであるAutoSpecを紹介する。
コード実行とエンボディエージェントドメインにまたがる291の実行トレース上でAutoSpecを評価する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:19:48 GMT)
Long-Term Simulation Exposes Cognitive-Developmental Risks in AI Companions [20.8] 既存の安全性評価はシングルターンまたはショートセッションテストに大きく依存する。
本研究では,ペルソナ駆動型ユーザシミュレーション,動的心理状態更新,振り返り評価を組み合わせた縦型フレームワークTSJ(Theater-Stage-Judge)を提案する。
我々は,4つの発達段階,24のリスクディメンション,3つの心理的・重大性ペルソナの6つの主流モデルを評価する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:46:42 GMT)
Efficient Cross-Scale Invertible Hiding Network with Spatial-Frequency Collaboration and Non-Invertible Mechanism [20.3] Invertible Neural Network (INN)ベースの画像隠蔽は重要な分岐として現れている。
空間周波数協調と非可逆機構を備えた効率的なクロススケール非可逆型隠れネットワーク(CrosInv)を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:24:58 GMT)
Are Text-to-Image Models Inductivist Turkeys? A Counterfactual Benchmark for Causal Reasoning [20.2] 実世界の先行を体系的に矛盾させるルールの下で,テキスト・ツー・イメージ・モデルが画像を生成することができるかどうかを検討する。
CF-Worldは、各シナリオを3つのプログレッシブなレベルにまとめる: 通常の世界の知識の下での事実生成、直接的な視覚的指示を伴う明示的な反事実生成、そして変化した規則から因果的推論を必要とする暗黙的な反事実生成である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:30:10 GMT)
Hierarchical Graph Learning for Calendar Spread Strategies in Commodity Futures Markets [20.0] 先物市場におけるカレンダースプレッド戦略の階層的なグラフ学習手法を提案する。
商品先物間での成熟度に依存したインは予測に有効であり,本手法は効果的な統計的仲裁であることがわかった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:25:15 GMT)
daVinci-kernel: Co-Evolving Skill Selection, Summarization, and Utilization via RL for GPU Kernel Optimization [19.9] 本稿では,スキル発見とスキル活用を併用した強化学習フレームワークdaVinci-kernelを紹介する。
DaVinci- Kernel-14Bは、Level 1、Level 2、Level 3で37.2%、70.6%、32.2%を達成し、Fast$1$_1$カーネルの閾値で最強の事前訓練モデルであるDr. Kernel-14Bを上回った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:40:54 GMT)
PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models [19.8] 現実世界のデプロイメントでは、新たな安全要件が自然言語ポリシーとして指定されることが多い。
これにより、急速に進化する安全ポリシーと従来のデータ駆動アライメント手法のミスマッチが生じる。
我々は,大規模言語モデルと安全ポリシーを直接整合するフレームワークであるPhysalignを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:10:33 GMT)
StairMaster: Learning to Conquer Risky Hollow Stairs for Agile Quadrupedal Robots [19.8] StairMasterは、このような極端な地形で安定した不連続性のための3段階強化学習フレームワークである。
我々の知る限りでは、これは現実の環境で急な中空階段を登る最初のRLベースの政策である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:42:06 GMT)
From Sounds to Scenes: A Benchmark for Evaluating Context-Aware Auditory Scene Understanding in Large Audio Language Models [19.7] 実世界の聴覚解釈には文脈を考慮した聴覚シーン理解(CASU)が必要である
本稿では、音声LLMが音声、音響イベント、背景環境からなる聴覚シーンを解釈できるかどうかを評価するCASUベンチマークを提案する。
本稿では,リアルタイムのシーン音声を合成音声で合成することにより,時間精度の高い半合成音声ストリームを構築するためのスケーラブルなパイプラインを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:42:57 GMT)
Hybrid-IR: Dual-Path Hybrid Retrieval with Iterative Reasoning for Complex Medical Question Answering [19.6] 我々は「Hybrid-IR」と呼ばれる反復的な検索推論機構を備えたデュアルパス検索フレームワークを提案する。
提案したHybrid-IRは、構造化知識探索のためのグラフベース検索と、きめ細かいセマンティックマッチングのための密集検索を統合している。
3つの医用QAベンチマークの実験は、我々のハイブリッドIRの有効性を実証している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:09:50 GMT)
Dataset Usage Inference without Shadow Models or Held-out Data [19.5] これらの制約を取り除くための実践的なDUIフレームワークを導入します。
本手法は, 合成非メンバーサンプルを生成し, 多様なメンバーシップ信号を抽出し, 混合比例推定問題としてDUIを鋳造する。
大規模画像生成モデルを用いた実験により,本手法がデータセット使用率を確実に定量化することを示した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:02:42 GMT)
Quantization Inflates Reasoning: Token Inflation as a Hidden Cost of Low-Bit Reasoning Models [19.1] 学習後量子化の低ビット化はテスト時間計算コストを隠蔽できることを示す。
INT4/INT3量子化は精度を保ちつつも、推論と推論の使用量を増加させ、期待されるトーケン毎のスピードアップを相殺することを発見した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:54:55 GMT)
PatchINR: Patch-Based Implicit Neural Representations for Efficient and Scalable Inference [18.8] Inlicit Neural Representation (INR)は、連続的な信号モデリングに効果的なアプローチを提供するが、古典的なピクセルごとの推論は、推論数において二次的な成長をもたらす。
本稿では,非重複パッチを基本処理単位として扱うパッチベースのアプローチを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:08:24 GMT)
Beyond Next-Observation Prediction: Agent-Authored World Modeling for Sequential Decision Making [18.8] 政策の意思決定ニーズから監督を構築するための訓練手順を提案する。
具体的には、各状態において、エージェントは行動する前に環境について何を理解する必要があるかを識別する。
これは、トレーニングの目的を次の観察の内容ではなく、行動する前にポリシーが必要とするダイナミックスと整合させる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:31:00 GMT)
SSMNBench: Diagnosing Image-based Cross-View Human-Object Understanding via Single-View Sufficiency and Multi-View Necessity [18.3] クロスビュー・ヒューマン・オブジェクト理解のための診断ベンチマークであるSSMNBenchを紹介する。
17の最先端MLLMを体系的に摂動することで、限界が明らかになる。
我々の評価では、現代のMLLMは、真のクロスビュー合成よりも、複数の単一画像のセマンティック平均化とビュー嗜好に依存している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:38:27 GMT)
Teach-to-Reason: Competition-Guided Reasoning with a Self-Improving Teacher [18.2] 胸部X線視覚質問応答(CXR VQA)は、正しい回答を予測するだけでなく、信頼できる医学的推論を生成するためにモデルを必要とする。
CoT最適化に比較に基づく監視を導入するフレームワークであるtext-to-Reason (T2R)を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:07:41 GMT)
USS: Unified Spatial-Semantic Prompts for Embodied Visual Tracking with Latent Dynamics Learning [18.0] Embodied Visual Tracking (EVT)では、エージェントが動的環境を積極的に移動しながら、指定されたターゲットを継続的に追跡する必要がある。
本稿では,EVTにおける目標指示をテキストのみの仕様から統一的な空間意味的プロンプトへと緩和するパラダイムシフトを提案する。
潜時ダイナミクス学習を用いた身体的視覚追跡のための統一空間意味プロンプトを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:25:05 GMT)
AI Snitches Get Glitches: Towards Evading Agentic Surveillance [17.7] AIエージェントが利用可能な情報を分析し、レポートを作成し、利用可能なツールを使用してそれを送信する能力です。
いくつかのモデルは、監視を支援するために緊急性(即時性)を示す傾向を示すが、彼らはまた、政府を再利用するためにユーザーを監視しようとする試みを報告している。
エージェント監視はすでに容易に実装できるので、ユーザを保護するための包括的な技術的、倫理的、立法的枠組みが求められていると結論付けている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:50:22 GMT)
MIL-LC: A Robust Magnetometer-Inertial-LiDAR Fusion Multimodal Localization Framework [17.6] 単一モードローカライゼーション法は、個々のセンサの制約によって本質的に制限される。
磁場に基づく局在化は、幾何学的特徴やテクスチャ的特徴に依存しないため、注目を集めている。
本稿では,センサスイートをカスタム設計した磁気センサ-慣性LiDAR融合マルチモーダルローカライゼーションフレームワークを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:14:11 GMT)
Closed-Loop Control with Rule-Aligned Small Language Models and Multi-Agent Self-Correction [17.5] 本研究では,コンパクトな小言語モデル (SLM) を制御推論のために再訓練し,検証器誘導補正ループに組み込むことができるかを検討する。
ランダム化熱制御シミュレーション(それぞれ500段の30の実験)では、平均的なアクションアライメント精度が91.5%に達する。
シンボリック・リマッピングの下では95%のインレンジレートを維持しており、トークンレベルの合意が減ったにもかかわらず、堅牢な物理的規制を示している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:49:01 GMT)
The Red Queen Gödel Machine: Co-Evolving Agents and Their Evaluators [17.4] 自己改善エージェントはエージェントコーディングベンチマークの最先端(SOTA)であり、最近一般的なドメインに拡張されている。
非定常ユーティリティ下での自己改善のための進化的フレームワークであるRed Queen Godel Machine(RQGM)を紹介する。
RQGMは、補完的なエージェント・アズ・ア・ジャッジ・コード・レビュー信号を追加することにより、以前のSOTAよりもテストパス率を向上させることを示す。
次に、科学論文の執筆とレビュー、オリンピアードレベルの証明の執筆と評価に目を向け、RQGMは以前の自己改善エージェントよりもパフォーマンスを向上させる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:38:26 GMT)
Gastroendoscopy View Synthesis: A New Real Dataset and Evaluation [17.3] ニューラル・ビュー・シンセサイザー (NVS) は、ニューラル・ラディアンス・フィールド (NeRF) と3Dガウス・スプラッティング (3DGS) 法の成功により、コンピュータビジョンにおいて活発な研究トピックである。
我々は,NVSのための最初の実胃内視鏡データセット,すなわち,胃内視鏡画像,カメラポーズ,実際の胃内視鏡検査のための点雲を含むガストロNVSデータセットを提示する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:36:49 GMT)
How Robust is OCR-Reasoning? Evaluating OCR-Reasoning Robustness of Vision-Language Models under Visual Perturbations [17.2] 視覚言語モデル(VLM)はOCRベースのベンチマークでは高い性能を達成しているが、制御された視覚劣化下での頑健さは十分に理解されていない。
視覚的摂動下でのOCR推論の堅牢性を評価するためのベンチマークであるOCR-Robustを紹介する。
我々は18以上の候補摂動のパイロットスタディを行い、その影響とモデル間識別性に基づいて、それぞれ3つの重度レベルに5つの代表型を選択した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:15:42 GMT)
Measuring Research Difficulty of Academic Papers: A Case Study in Natural Language Processing [16.6] 本稿では,研究難度を総合的に評価するシステムを提案する。
学術的なコラボレーション、コンテンツ、参照などの要素が組み込まれている。
学術論文の引用周波数を用いて、学術的影響を測定する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:22:08 GMT)
Beyond Aesthetics: Quantifying Information Loss in Turbid Scenes [16.6] 本稿では,極度の濁度下で撮影された1,320枚の画像からなる,Turbid Underwater Baseline (TUB)データセットについて紹介する。
また、位相共役写像から導出されるコントラストに不変な計量であるPCDを提案する。
実画像と合成画像の両方において,PCDはインスタンス分割モデルの性能と強く相関していることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:40:45 GMT)
The Web4 Agent Economy: A Large-Scale Empirical Study of the Landscape, Challenges, and Opportunities [16.6] Web4エコシステムに関する大規模な実証的研究を初めて行った。
99,448のマルチチェーンID登録、317,596,323のトランザクションログ、341のCPプロジェクトのソースコード、そして349のGitHub問題を分析します。
以上の結果から,自律型エージェントが機械間支払い経済を高度に確立していることが明らかとなった。
しかし、この成長は、アイデンティティ/認可の実践、クロス環境操作、支払いの相互運用性など、未成熟のインフラの上に構築されている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:20:51 GMT)
What Does the Brain See? Multiview Neural Representations to Demystify the Brain-Visual Alignment [16.5] 脳の反応を視覚的セマンティックな埋め込みと整合させるための統合型多視点脳波表現学習フレームワークを提案する。
提案手法は,物体内部設定において54.8%のTop-1,85.6%のTop-5,クロスオブジェクト設定では15.3%のTop-1,45.4%のTop-5の精度を有する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:33:21 GMT)
Tensor network characterization and mitigation of readout errors [16.4] 読み取りエラーは、短期量子プロセッサから信頼できる情報を抽出する上で大きなボトルネックとなる。
本稿では,読み出し過程を行列積演算子(MPO)としてモデル化する統合テンソルネットワークフレームワークを提案する。
超伝導プロセッサの実験と最大20キュービットの数値シミュレーションにより、MPOモデルは非相関モデルが見逃す相関した読み出し誤差をキャプチャすることを示した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:45:47 GMT)
Stabilizing black-box algorithms through task-oriented randomization [16.3] 本稿では,タスク指向のランダム化手法を提案する。
総合的な安定性保証スイートが提案されている。
提案手法の有効性と有効性は,広範囲な数値シミュレーションと実世界のデータセットへの応用を通じて実証される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:09:51 GMT)
Skill-MAS: Evolving Meta-Skill for Automatic Multi-Agent Systems [16.3] 大規模言語モデル(LLM)に基づく自動マルチエージェントシステム(MAS)生成は,複雑なタスクに対処するための重要なフロンティアとなっている。
推論時間MASは凍結フロンティアLLMを利用するが、過去の経験から学ぶことなく同じ検索を繰り返す。
トレーニングタイムMASは、勾配更新を通じてエクスペリエンスを内部化するが、より小さなモデルの低機能天井によって制約される。
Skill-MASは,高レベルのオーケストレーション機能を進化可能なメタスキルとして概念化し,パラメトリック更新から保持体験を分離する新しい第3のパスである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:57:28 GMT)
Post-Training Recipe, More Than Model Family, Shapes Multi-Agent LLM Conversational Behavior [16.2] 我々は,対話型マルチLLMシステムにおいて,同じファミリラベルが振舞いを予測するかどうかを検討する。
推理蒸留したLlamaチェックポイントのヘッジは、どのベースパートナーが返信するかによって18%シフトすることがわかった。
その結果,ポストトレーニングレシピをマルチLLMパネル合成のための第1級軸として同定した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 20:00:19 GMT)
Expresso-AI: Explainable Video-Based Deep Learning Models for Depression Diagnosis [16.2] 本稿では,ディープ・ニューラル・ニューラル・ニューラル・ニューラル・ニューラル・ニューラル・ニューラル・ニューラル・ネットワーク(Deep Neural Networks)による顔画像の学習における決定を解析するための新しい枠組みを提案する。
我々のフレームワークは、顔領域と時間的表現意味論を調べることによって、モデルの正当性マップを解釈することができる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:14:53 GMT)
Enhancing Pathological VLMs with Cross-scale Reasoning [16.2] 病理画像は本質的にマルチスケールであり、病理学者は、低倍率で地球規模の組織構造から高倍率で細胞形態まで、正確な診断のために証拠を統合する必要がある。
本稿では,病理学の解釈を多変量化推論として定式化する,最初のクロススケールトレーニングと評価パラダイムを紹介する。
本稿では、強化学習を用いて訓練されたモデルであるScaleReasoner-R1を紹介し、大規模VQAタスクのパフォーマンスを最適化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:20:02 GMT)
CrypFormBench: Benchmarking Formal Analysis Capability of Large Language Models for Cryptographic Schemes [16.2] 大規模言語モデル(LLM)は有望な代替手段であるが、この領域におけるそれらの有効性は未解明のままである。
CrypFormBench (C.F.B) は,5つのコアLLM機能を評価するために,シンボル的および計算的セキュリティを共同でカバーするベンチマークである。
677のスキームにまたがる700のインスタンス、7つの主要な形式検証言語、160のセキュリティプロパティで構成されている。
クロード3.5は100点中48.7点で最高得点を記録した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:37:38 GMT)
Model Forensics: Investigating Whether Concerning Behavior Reflects Misalignment [16.1] 安全研究の中心的な目標は、モデルが一致していないかどうかを決定することである。
以前の研究は、行動に関する検出に主に焦点を合わせてきた。
これはモデル法医学を動機付け、その行動が悪性意図によって駆動されているかどうかを調査する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:45:47 GMT)
Deep Reinforcement Learning-Enhanced Event-Triggered Data-Driven Predictive Control for a 3D Cable-Driven Soft Robotic Arm [15.9] ソフトロボット制御のための適応型強化学習に基づくイベントトリガー型DeePCフレームワークを提案する。
RL-ET-DeePCは周期的なDeePCと比較して最適化周波数を最大66%削減する。
三次元ケーブル駆動型ソフトロボットアームのハードウェア実験は、ゼロショット転送を実証している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:26:18 GMT)
COrigami: An AI Pipeline for Co-Designing Flat-Foldable Visually Recognisable Origami [15.4] Corigamiは、自然言語からクレーゼパターンを生成することによって、設計サイクルを支援する、エンドツーエンドのAI駆動パイプラインである。
我々のシステムは、非常に効果的な協調アシスタントとして機能し、人間のアーティストがさらに拡大し形作りできる構造的出発点を生成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:43:24 GMT)
IndicContextEval: A Benchmark for Evaluating Context Utilisation in Audio Large Language Models Across 8 Indic Languages [14.5] IndicContextEvalは、8つのインド語と23の専門ドメインにわたる555人の話者による56時間の自然言語のマルチリンガルベンチマークである。
本稿では,メタデータや自然言語記述,英語およびネイティブスクリプトのエンティティリスト,不正なエンティティによる敵プロンプトなど,文脈的シグナルを段階的に導入する7レベルプロンプトフレームワークを設計する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:32:31 GMT)
Vision-driven Preference Synthesis for Mitigating Hallucinations in VLMs [14.4] 政策整合性と視覚的基盤を有する嗜好データを構築するためのフレームワークであるViPSy(Vision-driven Preference Synthesis)を提案する。
我々のフレームワークは2つの段階から構成されており、第1段階では、VIPSyは、意味的に整列された画像の変種をまたいだオブジェクトレベルコンテンツから視覚的キューを導出する。
第2段階では、ViPSyはポリシーの独自のロールアウトをこのキューに設定し、ポリシーの応答分布に近づきながら、視覚的に接地されたコンテンツによって候補者をガイドすることができる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:06:22 GMT)
A Candidate Framework for Free-Space Quantum Key Distribution based on Geometrical-Configuration Modulation [14.2] 本稿では、幾何学的構成変調(GM)に基づく自由空間量子鍵分布(QKD)の候補フレームワークを提案する。
このフレームワークは、状態準備、遠野条件確率、ソフトインプット情報生成、パラメータ推定、和解、候補鍵レート式を指定する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:21:25 GMT)
IntentTester: Intent-Driven Multi-agent Framework for Cross-Library Test Migration [14.1] IntentTesterは意図駆動テストの再利用のためのフレームワークです。
IntentTesterは3つのドメイン(JSON、HTML、Time)と2つの言語(JavaとPython)にわたる9つのオープンソースプロジェクトで評価します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:59:01 GMT)
Dual Agreement Consistency Learning for Semi-Supervised Fetal Ultrasound Segmentation [14.0] 母性胎児USは胎児の発育をモニターする主要な画像モダリティである。
そこで我々は,胎児のイメージセグメンテーションのための半教師付きフレームワークであるDACLを提案する。
ラベル付きデータの5%以下では、DACLはDiceを2.77%改善し、HD95を14.69mmまで下げる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:26:00 GMT)
The Role of Input Dimensionality in the Emergence and Targeted Control of Adversarial Examples [13.9] 敵の事例の出現と目標制御における入力次元の役割について検討する。
我々の結果は、次元が増加するにつれて敵の例が容易に構築できることを一貫して示している。
高次元幾何は、特定の目標ラベルを強制することは、標的外攻撃と比較して限られた歪みしか持たないことを意味すると我々は主張する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:59:39 GMT)
Security and Privacy in Retrieval-Augmented Generation: Architectures, Threats, Defenses, and Future Directions for Building Trustworthy Systems [13.7] Retrieval-Augmented Generation (RAG) は、大規模言語モデルを外部知識で拡張するための支配的なパラダイムとして登場した。
この調査は、集中型、オンデバイス(Micro-RAG)、フェデレーション、ハイブリッドパラダイムにデプロイされたRAGシステムにわたる、プライバシーとセキュリティ上の課題に関する包括的な調査を提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:08:10 GMT)
Beyond Function Calling: Benchmarking Tool-Using Agents under Tool-Environment Unreliability [13.5] 本稿では,信頼性評価のためのベンチマークであるToolBench-Xを紹介する。
クリーンなツール環境から始めると、ToolBench-Xは5つの構造化ハザードタイプを注入する。
信頼性のあるツールでうまく機能するエージェントは、回復可能なハザードの下で失敗することが多い。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:34:34 GMT)
From Sparse and Imperfect 2D Anchors to Consistent 3D Gaussian Street Scenes: Support-Aware Appearance [13.5] 画像先行者は、3Dガウスのストリートシーンのターゲット条件を合成できるが、独立して編集されたビューはコヒーレントな3Dターゲットを定義しない。
このギャップに対処するため、外観焼成のために教師の相対的な外観残留蒸留を導入する。
教師アンカーとオリジナルレンダリングの間の残差により、周波数分解、信頼度推定、プリミティブレベルリフトのための構造化された空間を形成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:26:53 GMT)
Estimating Fidelity to a Reference Quantum State [13.5] 参照状態が$r$である場合、サンプルの複雑さは$O(r2/varepsilon2)$で最適な$varepsilon$-dependenceであることを示す。
また、$(r/varepsilon2)$の低いバウンダリも提供し、以前の最高の$(r/varepsilon+1/varepsilon2)$を改善します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:09:20 GMT)
Knowledge-augmented Agentic AI for Mental Health Medication Information Seeking [13.2] 患者はオンラインで薬情報を求める傾向にあるが、精神医学薬の安全性に関する知識は、規制上の不適切な記録と患者の物語に分けられる。
ここでは、Redditの466,525件の投稿、60,782件のWebMDレビュー、および9件の抗うつ薬に対する米国食品医薬品局(FDA)の逆イベント報告システム記録の20年間を統合した、実績に富んだ知識グラフベースのフレームワークを開発する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:54:50 GMT)
HEART: Coordination of Heterogeneous Expert Agents for Physically Grounded Robotic Task Planning [13.1] LLM(Large Language Models)は複雑な命令を推論するが、ロボットタスク計画に必要な物理的および空間的制約を満たすことができないことが多い。
命令を原子推論タスクに分解する異種マルチLLMフレームワークを提案する。
HEARTは単一LLMやルールベースのプランナに比べて計画の成功を継続的に改善することを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:02:37 GMT)
AI Coaching for Accelerating Human Skill Development with Reinforcement Learning [13.1] AIのコパイロは、共有制御によって人間のパフォーマンスを大幅に向上させるが、過剰な補助は過度な信頼性とスキルの萎縮を引き起こす。
本稿では,人間の運動能力開発を加速するコーチとして,具体的AIエージェントが果たす役割について考察する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:05:22 GMT)
One Body, Two Minds: Variable Autonomy Approach for a Co-embodied Robotic Hand [12.9] 我々は,人間とロボットが1つの身体を共有できる,可変自律型の共同体育を紹介した。
我々は、自己の心を持ち、様々な自律レベルで動作する、共体でウェアラブルなロボットハンドを提示する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:46:49 GMT)
Geometry-Aware Online Scheduling for LLM Serving: From Theoretical Bound to System Practice [12.8] 本稿では,最小ボリュームファースト(SVF)アルゴリズムとその高効率な変種である1ビットSVFを導入することで,幾何を考慮したオンラインスケジューリングを提案する。
SVFは平均レイテンシとテールレイテンシの両方を強く削減し、一方1ビットのSVFは1ビットの情報だけで、競合スループットとレイテンシを実現する。
この研究は、現代の大規模言語モデルの展開において、メモリ制限されたスケジューリングを解決するための理論的に健全で実証的なアプローチを確立する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:02:53 GMT)
Enhancing Layer Interaction Using Key-Correlated Layer Attention [12.8] KCLA(Key-Correlated Layer Attention)は,注目層におけるキー表現はコサインの類似性が高いという観察に着想を得たものである。
KCLAは動的情報更新を保持しながら線形計算複雑性を実現する。
画像認識、オブジェクト検出、医療画像のセグメンテーションなど、さまざまなタスクにわたって優れたパフォーマンスを提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:54:52 GMT)
RARM: Confidence-Gated Progress Reward Modeling for RL in Manipulation [12.8] ロボット操作のための強化学習は報酬設計によってボトルネックとなることが多い。
本稿では,RARM(Reference-Anchored Reward Model)について紹介する。
RARMはその後のRLトレーニングにおいて最高の総合的な成功率を達成し、特に布の折り畳みのような長い水平タスクにおいて大きな成果を上げている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:16:35 GMT)
SFL-MTSC: Leveraging Semantic Frame-Level Multi-Task Self-Consistency for Robust Multi-Intent Spoken Language Understanding [12.7] 本稿では,セマンティックフレームレベルで動作可能な新しい構造化集約フレームワークを提案する。
SFL-MTSCは、予測をインテント固有のフレームに分解し、ドメインインテントのグルーピングとスロットレベルのクラスタリングを適用し、クラスタの信頼性を評価する。
MAC-SLUベンチマークデータセットのゼロショット実験では、スロットF1が改善され、シングルパス推論よりも全体的な精度が向上した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:28:56 GMT)
Embedding Foundation Model Predictions in Discrete-Choice Models with Structural Guarantees [12.7] タブラル基礎モデルは選択予測タスクにおいて高い精度を達成するが、その予測は経済論理に反することが多い。
本稿では,基礎モデルの予測選択確率を事前計算機能として利用し,それを多項ロジットユーティリティに組み込む2段階アダプタを提案する。
この構成は多項ロジットの置換率を正確に保存していることを証明し、解析的に計算可能な値が数学的保証となる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:44:29 GMT)
Graph it first! Enabling Reasoning on Long-form Egocentric Videos through Scene Graphs [12.7] Egocentric Scene Graphs (EgoSGs) を通じてこれらの入力制約を克服するEgocentric Video Question answering (VQA) フレームワークを提案する。
動画をコンパクトでテキストベースのシーングラフとして表現することにより,オリジナル映像の視覚的・時間的情報をシンボル形式で保存する。
提案手法は,HD-EPIC VQAにおいて,複数のモデルに対する高画質映像ベースラインよりも高い性能を実現している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:55:45 GMT)
Privacy Vulnerabilities of Attention Layers in Tabular Foundation Models and Protection of High-Risk Queries [12.5] 本稿では,アテンション機構によって生成された予測が,効果的なメンバーシップ推論攻撃(MIAs)を可能にする十分な情報を漏らすことを示す。
このリスクを軽減するために、$k$匿名の原則にインスパイアされた推論時防御を導入します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:42:21 GMT)
SciRisk-Bench: A Risk-Dimension-Aware Benchmark for AI4Science Safety [12.5] 大規模言語モデル(LLM)がAI for Science(AI4Science)に組み込まれている
既存のAI4Science安全データセットは、いくつかの規律とタスクフォーマットをカバーし、基礎となるリスク次元を未特定のまま残している。
我々は2つの相補的な視点からAI4Science安全性を評価するために設計されたベンチマークである textbfSciRisk-Bench を紹介する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:13:08 GMT)
Learning Optimization Proxies for Sequential Contextual Stochastic Programs: An Order Fulfillment Application [12.5] 逐次的文脈プログラムは、各時間が不確実な動作にコミットするリアルタイム決定システムをモデル化する。
オフザシェルフ最適化は高い意思決定品質をオフラインで達成するが、通常インスタンス毎に秒から数分で実行される。
本稿では,学習に基づく最適化プロキシを開発する。解決器生成ラベルをオフラインでトレーニングしたシナリオ埋め込みニューラルネットワークと,実現可能性を実現するデコーダとをオンラインでペアリングする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:45:52 GMT)
Extracting Algorithms in Pre-trained LLMs: A Case on Hidden Markov Models [12.3] 大規模言語モデル(LLM)は、コンテキスト内学習(ICL)を介して隠れマルコフモデル(HMM)から次の観測を予測できる印象的な能力を示す。
我々はこのギャップを3段階のパイプラインで埋める。まず、LLMの振る舞いを一連の候補アルゴリズムと比較し、空間を3つのクラスに絞り込む。
第2に、3つのクラス間の理論的接続を導出し、トランスフォーマーによって各クラスがどのようにインコンテキストで実装できるかを示す。
第3に,モデルアクティベーションにおけるアルゴリズム信号の分離を行うレイヤワイド探索・介入法であるPrincipal Activations Probe(PAP)を導入する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:42:19 GMT)
Shoot the Honey, Cloak the Player: Towards Zero-Runtime-Overhead Proactive Defense and Detection for Visual Game Cheating [12.3] AimTrapは、ファーストパーソンシューティングゲームにおける視覚的目標ボットに対するエンドツーエンドの防御である。
リアルタイム保護と2つの対向的テクスチャ機構を用いたポストゲーム検出を組み合わせる。
非常に低い偽陽性率を達成する一方で、無視可能なランタイムオーバーヘッドを発生させる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:00:10 GMT)
Does Translation-Enhanced Speech Encoder Pre-training Affect Speech LLMs? [11.6] 音声翻訳は、エンコーダの言語固有の表現をLLMの共有空間と整合させる、原則化された方法を提供する。
音声エンコーダの事前学習における翻訳対象の影響を実験的に評価した。
以上の結果から,翻訳強化事前学習によりモーダル間統合が向上し,下流音声LLMタスクにおける性能が向上することが示唆された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:15:18 GMT)
FinRED: An Expert-Guided Benchmark Generation and Evaluation Framework for Financial LLM Red-Teaming [11.5] 既存の安全ベンチマークは、一般的な敵シナリオをターゲットにしているが、金融特有のリスクを見逃している。
金融専門家と共同開発した金融安全評価のための,専門家が指導するレッドチームフレームワークであるFinREDを紹介する。
FinREDは、グローバル標準を規制回避から複雑な詐欺まで、スケーラブルなパイプラインに統合された脅威にマッピングする、新たな2段階の分類基準を使用している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:42:32 GMT)
Evaluating LLMs on Real-World Software Performance Optimization [11.5] SWE-Proは、オープンソースプロジェクトから102のエキスパートによる最適化から派生した、リポジトリレベルのベンチマークである。
以前のベンチマークとは異なり、SWE-Proは各タスクをパラメータ化されたテストと組み合わせて実行時、ピークメモリ、タイムウェイトメモリ使用量を評価する。
ランタイムゲインは無視可能であり、メモリ最適化はほとんど存在しない。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:07:41 GMT)
Controlling radiative dynamics of a giant $Λ$-type atom via interference induced by the vacuum of a waveguide [11.5] 2つの空間的分離点における1次元(1D)導波路の誘導モードに両遷移が結合した$$-type giant atom (GA) について検討した。
このGAの自然放出特性は、3GAの励起状態における振幅の遅延微分方程式を解くことによって検討される。
正確なマルコフ力学は、原子-光結合の複雑な位相の他に、エネルギー間隔と固有の時間遅延を調整することによって、推論によって$dgeq L$を導いたときにも見られる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:58:18 GMT)
NeuroShield: A Device-Agnostic Foundation Model for EEG Authentication [11.4] NeuroShieldは、EEG認証のための再利用可能な基盤モデルである。
可変チャネルと可変長の脳波記録から個人識別型埋め込みを学習する。
NeuroShieldは、アートの状態を比べたエラー率を0.44~8.06ポイント削減する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:05:43 GMT)
OpenFinGym: A Verifiable Multi-Task Gym Environment for Evaluating Quant Agents [11.3] 定量的ファイナンスエージェント開発のための統合体育環境OpenFinGymを紹介する。
単一の実行および検証インターフェース下での予測、市場生成、リアルタイム取引、不正検出をカバーしている。
OpenFinGymはまた、定量的財務出版物を実行可能なタスクパッケージに変換する自動タスク構築パイプラインも提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:42:55 GMT)
AlgoEvolve: LLM-driven Meta-evolution of Algorithmic Trading Programs [11.2] 提案するAlgoEvolveは、実行可能なトレーディング戦略を生成し、評価し、反復的に改善する進化的フレームワークである。
複数の実験を通じて、このシステムは、トレーディングルールの自律的なシフトを含む、創発的な体制適応型戦略論理を示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:05:03 GMT)
PRISM: Feed-Forward Single-Image 3D Reconstruction via Geometric Warp-Residual Modeling [11.1] 単一の画像から3Dシーンを再構築することは、コンピュータビジョンの根本的な課題である。
近年の手法は,カメラ制御ビデオ拡散モデルを活用することで,優れた性能を実現している。
PRISMは,多視点遅延予測をパラメータフリーな幾何前処理に分解するフィードフォワードフレームワークである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:48:20 GMT)
ROAD-VLA: Robust Online Adaptation via Self-Distillation for Vision-Language-Action Models [11.1] そこで本稿では,アクション・トケン・ロジットをキャリブレートした利得推定値で摂動することで,教師を直接行動空間に構築するアドバンテージ誘導型自己蒸留フレームワークを提案する。
ROADVLAは7つのロボット操作環境の内分布と外分布シフトにより、ほぼすべての環境でPPOを上回っている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:17:59 GMT)
Revealing Mammographic Phenotypes in Deep Learning Breast Cancer Risk Models [11.0] 既存の解釈可能性法は、単一画像のサリエンシマップに依存している。
事前訓練したMiraiモデルからのパッチ埋め込みをクラスタリングすることにより,5年にわたるがんリスクに関連する再発表現型を分離する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:44:09 GMT)
GeoFlow-SLAM++: A Robust Multi-Camera Visual-Inertial SLAM System with Relocalization [10.9] GeoFlow-SLAM++は密結合型マルチカメラ・ビジュアル・慣性SLAMシステムである。
従来のORBフロントエンドと、SuperPointとLightGlue上に構築されたニューラルネットワーク機能(NN-Feature)の2つの交換可能なビジュアルフロントエンドをサポートする。
我々は,EuRoC,OpenLORIS,TUM,HiltiのGeoFlow-SLAM++と自作ハンドヘルドマルチカメラデータセットの評価を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:28:38 GMT)
ESTANet: Efficient Online Error Detection in Procedural Videos via Prediction Inconsistency [10.9] 手続き型ビデオにおけるオンラインエラーのリアルタイム検出を,単純だが見落とされがちな視点から検討する。
動作検知器は入力力学や時間的文脈に対する感度によって自然に異なる予測特性を示す。
本稿では,動作予測の不整合を利用してエラーを検出する軽量フレームワークESTANetを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:29:57 GMT)
Fully Differentiable Neural Forced Alignment via Soft Dynamic Programming [10.8] 音素アライメントに特化して設計されたエンドツーエンドの完全微分可能なニューラルアーキテクチャを提案する。
モデルは入力信号を処理するエンコーダとアライメント決定を生成するデコーダで構成される。
提案手法は,手書きの英語ベンチマーク上での音素アライメントの現況を上回り,単語レベルの一般化結果を強く達成し,未知の言語での一般化を実証する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:42:29 GMT)
BiPACE: Bisimulation-Guided Policy Optimization with Action Counterfactual Estimation for LLM Agents [10.8] ステップワイズグループベースのRLは、学習評論家なしで長期のLDMエージェントを訓練する魅力的な方法である。
現在のエージェントの変種は、状態-アクションの信用ミスマッチによってこの仮定に反することを示す。
批判や補助的な損失、余分なロールアウトを加えることなく、双方を修正できる、ドロップインの利点推定ツールであるBiPACEを紹介します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:32:42 GMT)
Learning task-specific subspaces via interventional post-training of speech foundation models [10.6] 介入型コントラスト学習を用いた訓練後改善手法を提案する。
我々は、音声基礎モデルの絡み合った表現空間から、別コンテンツと話者部分空間への変換を学習する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:36:41 GMT)
Falcon: Functional Assembly and Language for Compositional Reasoning in X-ray [10.5] 安全クリティカルなX線バッグスクリーニングでは、空間的に分散したコンポーネントの機能的互換性から脅威が発生することが多い。
我々は、この設定を、リスクを接地地域の関係性としてモデル化したEmphcompositional threat reasoningとして定式化する。
セグメンテーションを意識した領域機能を構造化された安全状態に抽象化するマルチモーダルフレームワークである textbfFalcon を導入する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:16:17 GMT)
Helpful or Harmful? Evaluating LLM-Assisted Vulnerability Patching via a Human Study [10.5] 大規模言語モデル(LLM)支援ツールは、脆弱性の検出、位置、修復タスクの可能性を示している。
実世界のシナリオにおける人間の手動デバッグと比較して,LSM支援の脆弱性パッチ機能を明らかにすることを目的としている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:45:38 GMT)
The Interplay of Harness Design and Post-Training in LLM Agents [10.4] LLMエージェントは、どのツールが露出しているか、どのように説明されるか、ステップごとの観察に付随する補助的な情報などを決定する足場として、しばしばハーネスにラップされる。
エージェントは日常的にポストトレーニングされるが、この足場は通常固定されたエンジニアリングの詳細として扱われる。
エージェントがOOD設定に頑健に適応できることを実証的に示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:23:02 GMT)
Semantic-Aware Generative Image Transmission for Resource-Constrained Visual IoT Systems [10.3] 本稿では,エッジ支援型モノのインターネットのためのセマンティック・アウェア・ジェネレーティブ・イメージ・トランスミッション・フレームワークを提案する。
提案手法は、狭帯域の視覚的IoTリンクに対して、フレキシブルなトレードオフを提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:18:31 GMT)
Topology-Informed Neural Networks for Flood Detection in Optical and Synthetic Aperture Radar Imagery [10.3] 急速かつ正確な洪水検出は、人的・経済的損失の緊急対応と時間的緩和に不可欠である。
多くの洪水は、雲が光学衛星画像を隠すため、検出が難しいままである。
トポロジカルデクリプタは,独立して有意義な洪水信号を持ち,既存のネットワークを補完し,より堅牢で解釈可能な洪水検知システムを実現する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:52:28 GMT)
Representation Matters: An Empirical Study of Program Representations for LLM Vulnerability Reasoning [10.3] 大規模言語モデル(LLM)は、自動脆弱性検出にますます利用されている。
ほとんどのプロンプトベースのアプローチは生のソースコードを提供し、よりソースレベルのコンテキストがモデルにより良い証拠を与えると暗黙的に仮定する。
本稿では、ソースコードと静的解析に基づくプログラム表現を比較した経験的ベンチマークであるRepBenchによる仮定に挑戦する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:43:42 GMT)
Adaptive Oscillatory Inductive Bias for Modeling Sharp Prosodic Dynamics in Diffusion-Based TTS [10.2] 拡散に基づくテキスト音声合成(TTS)モデルでは,音声品質が大幅に向上した。
しかし, シャープな韻律遷移と高速なピッチ変化をモデル化することは依然として困難である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:32:20 GMT)
CLOSER-VLN: Closed-Loop Self-Verified Retrieval-Augmented Reasoning for Aerial Vision-Language Navigation [10.2] 視覚言語ナビゲーション(VLN)は、タスク固有のナビゲーションポリシーをトレーニングすることなく、エージェントが見えない環境で自然言語の指示に従うことができる、大規模な言語モデルとマルチモーダルモデルで最近進歩した。
既存のVLNメソッドの多くは、命令や観察から候補アクションが生成されるが、実行前に検証や修正されることは滅多にない、オープンループ決定実行アプローチに依存している。
コンクリート施工前にクローズループ方式で行動推論,信頼性検証,ターゲット検索,行動補正を逐次行う訓練自由度法であるCLOSERを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:57:42 GMT)
Automatic Generation of Highlights for Academic Paper Via Prompt-based Learning [10.2] ハイライトは学術論文の主な貢献の簡潔な要約を提供する。
多くの雑誌はハイライトを提供しておらず、文献検索、テキストマイニング、書誌分析での使用を制限している。
本研究では,自動ハイライト生成のためのプロンプトベース学習について検討する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:21:56 GMT)
Compositional Behavioral Semantics for State Abstraction in Reinforcement Learning [10.0] 本稿では,強化学習における行動構造の定義と分析のための統一的な枠組みを提案する。
本フレームワークは,システム力学の局所的,一段階的な記述に基づいて,行動意味論を規定する構成的手法を提供する。
音質保証を伴う論理的行動意味論から定量的なメトリクスを構築する方法について述べる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:43:47 GMT)
Is GraphRAG Needed? From Basic RAG to Graph-/Agentic Solutions with Context Optimization [10.0] 本稿では,半構造化知識ベースを用いたRAGシナリオの評価と比較を行うフレームワークを提案する。
9つの標準化されたRAGシナリオの実装と総合的な比較実験を行う。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:11:02 GMT)
Enhancing Brain MRI Anomaly Detection and Reasoning with ROI Rethink and Synthetic Data [10.0] 脳MRI診断に明示的な領域マーキングを導入したBrReMarkを提案する。
モデルはまず、潜在的な異常についての仮説を生成し、明示的な境界ボックスマーキングを通じてそれらをグラウンド化する。
我々は,ドメインランダム化に基づく病理合成の強化戦略を統合し,OEDデータに対するモデルの一般化性を向上させる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:41:27 GMT)
KidRisk: Benchmark Dataset for Children Dangerous Action Recognition [9.9] 本稿では,子どもの行動のショートビデオ2,500本と,子どもの危険な行動のイメージ10,000枚を含む,新しいデータセットであるKidRiskを構築した。
提案手法は,児童行動の分類において83.53%,児童行動の認識において96.14%の精度を達成した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:59:29 GMT)
Clue-Guided Money Laundering Group Discovery [9.9] Money Laundering Group Discoveryは、隠れた犯罪グループを特定し、大規模な金融ネットワークでその完全な構造を回復することを目的としている。
既存のグラフ異常検出手法は主にノードレベルのリスク警告を生成するが、グローバルグループ発見手法はネットワーク全体に不審なグループを受動的に探索する。
提案するClue-Guided Group Discovery (CGGD) では, アナリストのインタラクションを通じて, 初期手掛かりから洗浄グループを段階的に回収する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:57:22 GMT)
Can Trustless Agents Be Trusted? An Empirical Study of the ERC-8004 Decentralized AI Agent Ecosystem [9.8] ERC-8004は、Identity, Reputation, Validationの3つのオンチェーンレジストリを中心に構築された、AIエージェントエコノミーの無許可信頼層である。
急速に採用されているにもかかわらず、このプロトコルは実証的に研究されておらず、記録した情報が意思決定の信頼できる基盤を提供するかどうかは不明のままである。
プロトコルの展開から2026年5月13日までの期間をカバーする,BNBスマートチェイン(BSC)とベースという3つのチェーンにわたるERC-8004の実証的研究を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:57:49 GMT)
Morphology-Specific Closed-Loop Control of Logarithmic-Spiral Continuum Arms via Online Jacobian Error Compensation [9.8] 最近報告された対数的スピラルロボットは、スケーラブルな製造と多目的把握を実証したが、逆運動学と閉ループ制御に欠けていた。
本研究は、対数-スピラル連続腕のための最初の形態特異的クローズドループタスク空間制御フレームワークを提示する。
その結果, 対数-呼吸形態とオンラインジャコビアン補償を組み合わせることで, 高度に不安定な連続体マニピュレータの精度, 堅牢, スケーラブルな制御が可能となった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:54:23 GMT)
What Do Deepfake Benchmarks Measure? An Audit Using Frozen Self-Supervised Representations [9.8] ベンチマークはますます複雑でエンジニアリングされた検出器を駆動するが、もしこれらのベンチマークが現実世界のディープフェイクを反映していないなら、この複雑さは完全に間違った問題を解決しているかもしれない。
ビデオ, 画像, 音声のディープフェイクのベンチマークを, 故意に簡単な診断法を用いて実施する。
我々は,3つのモードにわたって,汎用的な自己教師付き表現に対する線形プローブがベスポーク検出器の性能に近づきつつあることを観察した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:10:42 GMT)
Learning Robot Visual Navigation in Crowds via Intention-Aware Scene Representations [9.7] iCrowdNavは、意図を意識したシーン表現を備えた新しい視覚的群集ナビゲーション手法である。
提案手法はベースラインよりも優れた性能を実現し,実世界の展開は視覚に基づく群集ナビゲーションを実証する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:26:17 GMT)
How Do Developers Maintain and Evolve Their Agents' Instructions? An Empirical Study [9.7] エージェントコンテキストファイル(ACF)は、エージェントを構造化命令でガイドする実用的なメカニズムとして登場した。
本稿では,ACFの進化とエージェント駆動開発におけるその役割について検討する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:32:18 GMT)
Efficient Real-World Dehazing via Physics-Inspired Global-Local Decoupling [9.6] 実世界の単一画像デハジングは、空間的およびスペクトル的に異なる散乱のため、非常に不規則である。
本稿では,演算子レベルのエミュレーションによる物理的帰納バイアスを組み込んだ軽量なフレームワークであるPGL-Netを提案する。
PGL-Netは、複雑さを大幅に減らして最先端の復元品質を達成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:58:29 GMT)
Gaussian Mean Field Variational Inference can Overestimate Predictive Variance [9.5] MFVI (Mean Field Variational Inference) は後部変分を過小評価するために広く理解されている。
MFVIはパラメータ空間の分散を過小評価するが、正確な後部よりも予測分散を過小評価できることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:15:23 GMT)
Learning to Adapt: Reptile-D-Learning for Robust and Efficient Control Under Parametric Uncertainty [9.5] Reptile-D-learningは、Reptileメタ学習アルゴリズムを利用して、異なるパラメータを持つシステム間で共有された動的構造をキャプチャするフレームワークである。
複数の非線形制御系における実験により、Reptile-D-learning は、未確認パラメータ構成への一般化と迅速な適応の両方を著しく改善することを示した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:11:29 GMT)
Evaluation Protocols and Validation for Cameras in Indoor Healthcare Monitoring [9.5] 既存の検証研究は、通常、デバイスメトロジー性能またはアルゴリズムの精度を分離して評価する。
まず,RGBカメラとRGB-Dカメラのメトロジ的性能を評価する。
2つ目は、最先端のポーズ推定器を用いて検証された人間のポーズ推定をサポートする際の使用を評価する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:36:00 GMT)
Preparing two-mode magnonic Schrödinger cat states in a cavity-magnon-qubit system [9.4] キャビティ-マグノン-量子ビット系は、近年、マグノン系におけるマクロ量子状態の生成のための新しいプラットフォームとして実証されている。
我々は,非ガウス交絡状態である2モードのマグノン猫状態を作成することを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:45:46 GMT)
Expecting (Targeted Ads)? Network Analysis of User Health Data Leakage in Fertility Tracking Apps [9.4] Google Play Storeから20のAndroid肥大追跡アプリのコーパスをネットワークベースで測定する。
ユーザの健康データの明示的な漏洩と,高度にターゲットされたコンテキスト広告URLによる暗黙的な漏洩を識別する。
これらの発見は、広範囲にわたるユーザの懸念に対する技術的根拠を提供すると同時に、アプリベースの肥大度追跡のプライバシーへの影響における消費者選択の重要性を浮き彫りにしている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:17:04 GMT)
Query Cost Model Calibration in Confidential Virtual Machines [9.4] このようなCVMにおける解析的クエリは大きなオーバーヘッドに悩まされることが多く、データベースの処理が最適化するのではなく、これらのスローダウンで止まったことが示される。
この問題に対処するために,軽量なCVM対応コストキャリブレーションモデルを提案する。
実験によると、キャリブレーションによって、KVM/CVMのパフォーマンスギャップが大幅に狭まり、最大48%のパフォーマンスが回復し、一部のワークロードでKVMベースラインを上回ります。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:11:17 GMT)
DinoLink: A Token-Centric Representation Compression Framework for Bandwidth-Constrained Collaborative V2X Perception [9.3] DinoLinkはトークン中心の圧縮フレームワークで、生のピクセルストリーミングを、車両とクラウドの協調推論のための個別のセマンティック通信に置き換える。
提案手法は,制約付きV2Xシナリオにおける高忠実度リモート認識において,DinoLinkをロバストで帯域幅効率のよいものとして実証した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:31:13 GMT)
CrossAccent-TTS: Cross-Lingual Accent-Intensity Controllable Text-to-Speech via Disentangled Speaker and Accent Representations [9.3] CrossAccentTTSは、アクセント制御と変換を可能にするフレームワークである。
Indic MultilingualとL2-arcticデータセットの実験では、CrossAccent-TTSがアクセント強度を正確に制御できることが示されている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:02:36 GMT)
1000 Rallies: An Event-Camera Dataset and Real-Time Learned Ball-State Estimation for Robotic Table Tennis [9.2] 本稿では,テーブルテニスのための大規模なイベントカメラデータセットについて紹介する。
我々は、背景選手の動きに頑健な畳み込みニューラルネットワークを訓練し、イベントから画像平面におけるボールの位置と速度を共同で推定する。
イベントベースのシステムをStubliロボットアームに統合することで、知覚行動ループを閉じる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:28:21 GMT)
An Analysis of Posterior Collapse, Parameterization and Initialization in Variational Deep Gaussian Processes [9.2] DGPは確率的モデルであり、いくつかの層にまたがるGPを達成する顕著な予測性能を持つ。
DGPの厳密な推論は難解であり、変分推論はクルバック・リーブラの発散を最小限にして調整されたパラメトリック分布と後部を近似するためにしばしば用いられる。
本研究は、DGPの後方崩壊について研究し、DSVIアルゴリズムと広く使われている線形先行平均関数との関係を同定する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:25:39 GMT)
A3C3: AI Algorithm and Accelerator Co-design, Co-search, and Co-generation [9.0] 人工知能アルゴリズムと加速器の共同設計、共同研究、共同生成のための総合的方法論(A3C3)を提案する。
A3C3はアルゴリズム設計空間と加速器設計空間の両方をパラメータ化し、それらを共同で探索することで、モデル-加速器ペアの自動生成を可能にする。
この記事では、Sudeep Pasricha氏とMuhammad Shafique氏が編集したHandbook of Embedded Machine Learningの書籍の章を紹介する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 20:32:39 GMT)
Beyond a Shadow of a Doubt: Close Proximity Geometry Reconstruction Using FMCW Radar Shadow Effects [8.8] 車両のシャシーはレーダー線を遮蔽し、独特の幾何学的影を形成する。
このキューから近傍の細い垂直物体の3次元平面傾斜を復元する手法を提案する。
この研究は、シャシーシャドーを新しい幾何学的キューとして強調し、ローカライゼーションを超えて2D回転レーダーの役割を拡大し、3Dシーンの再構築に向けたものである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:47:28 GMT)
Exposing the Illusion of Erasure in Knowledge Editing for LLMs [8.8] 我々は,知識編集(KE)が,LLMにおける特定の事実を,コストのかかる再学習なしに更新するためのフロンティアとして登場したことを示す。
低ランク更新は既存の知識を上書きするのではなく、モデル表現空間内で再配布することを示す。
損失景観の分析により、編集された知識は摂動に非常に敏感な狭く異方性のある領域にあることが明らかになった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:41:10 GMT)
EPTS: Elastic Post-Training Sparsity for Efficient Large Language Model Compression [8.8] 大規模言語モデルを圧縮するための重要なパラダイムとして、PTS(Post-Training Sparsity)が登場した。
本研究では,多種多様な空間構成におけるロバストな性能を維持することができる単一の弾性モデルを作成するために,EPTS(Elastic Post-Training Sparsity)を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:37:27 GMT)
Multilingual Hematology Visual Question Answering Dataset [8.7] WBCMor VQAは、臨床的に検証されたバイリンガル英語、Urdu morphology aware VQA benchmark for leukemia and normal white cell analysisである。
このベンチマークは、LeukemiaAttriとWBCAttデータセットのモルフォロジー対応アノテーションを使用して構築され、ドメイン固有のUrdu辞書でサポートされている。
提案するリソースは、多言語医療環境のためのアクセス可能で臨床的に関連するAIシステムの開発を促進することを目的としている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:06:04 GMT)
Color Matters: Trigger Color Affects Success in Federated Backdoor Attacks [8.7] フェデレーション学習は、悪意のあるクライアントが悪質なタスクのパフォーマンスを維持しながら悪意のある更新を注入するバックドア攻撃に対して脆弱である。
本研究では、攻撃者が自然な視覚アクセサリーをトリガーとして使用し、攻撃パイプラインを固定しながらトリガー色のみを操作できるセマンティクス駆動のバックドア機構について検討する。
本フレームワークでは,マスクやサングラスなどの意味的トリガーオブジェクトを黒と白の変種でインスタンス化し,その効果を制御学習環境で評価する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:07:10 GMT)
Learning to Trigger: Reinforcement Learning at the Large Hadron Collider [8.6] Large Hadron Colliderは、帯域幅、レイテンシ、ストレージに厳しい制約の下で、リアルタイムイベントフィルタリング(textittriggering)に依存する。
オンラインしきい値調整は、シーケンシャルな意思決定問題であると考えた。
強化学習エージェントは、最近のレートと信号感度の特徴のストリーミング要約を取り込み、信号効率を最大化するためにトリガ閾値を更新する。
これは、実際の大型ハドロン衝突型加速器の衝突データに対するRLベースのトリガー制御の即時実証である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:50:05 GMT)
EVOM: Agentic Meta-Evolution of Actor-Critic Architectures for Reinforcement Learning [8.5] EVOMは高性能アクター批判アーキテクチャを発見するためのエージェント的メタ進化フレームワークである。
LLMをベースとした設計エージェントがアーキテクチャデザイナとして純粋に動作し、ポリシーの実行と環境管理から完全に切り離されている。
実験の結果,手動で設計したベースライン,LLM誘導ランダムサーチ,そして最先端のLLM誘導プログラム型ポリシーサーチ手法MLESよりも優れた結果が得られた。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:13:32 GMT)
Overview of HIPE-2026: Person-Place Relation Extraction from Multilingual Historical Texts [8.5] HIPE-2026はHIPE評価シリーズの第3版である。
これは2つの時間的根拠を持つ関係タイプをターゲットにしている:$at$、文書の発行日の前のある時点である人物の存在を示す$isAt$、そしてその日付と同時期に存在を示す$isAt$である。
本稿では,3言語にわたる歴史的言語変化,OCRノイズ,間接的文脈的手がかりの課題に直面する17チームを対象に,評価キャンペーンの結果について述べる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:09:12 GMT)
KG-TRACE: A Neuro-Symbolic Framework for Mechanistic Grounding in Antimicrobial Resistance Prediction [8.3] KG-TRACEは、WHO突然変異知識グラフ(KG)を神経ゲノムモデル上の構造的生物学的制約として統合する新しいニューロシンボリックフレームワークである。
CRyPTIC M結核コホートの評価
競争の正確さを達成する一方で、その主な価値は、予測的上昇ではなく、象徴的な接地にある。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:35:18 GMT)
Decoupling Reconnaissance and Exploitation: Measuring the Capability Boundaries of LLM-Based Web Penetration Testing [8.3] 本稿では,2段階の非結合評価フレームワークを提案する。
我々は、マルチエージェント、モノリシック、グラフ駆動アーキテクチャをカバーする、オープンソースの5つの浸透試験エージェントを実証的に評価する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:51:58 GMT)
Exploring the Intrinsic Geometry of Diffusion Models with Constrained Inverse Kinematics [8.1] 拡散モデルが制約付き逆運動学(IK)データから固有幾何を復元できるかどうかを考察する。
6-DoF UR5 と 7-DoF Franka のそれぞれに対して、7つの制約系にまたがる1つの条件拡散モデルを訓練する。
実験の結果,モデルのスコア関数から得られた固有次元は,対応する制約多様体の自由度と一致することがわかった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:00:13 GMT)
TacVerse: A Multi-Sensor Dataset and Benchmark for Cross-Sensor Vision-Based Tactile Perception [8.0] マルチセンサー・データセットと、クロスセンサー・ビジョンに基づく触覚知覚のためのベンチマークであるTacVerseを提案する。
データセットには、7つの視覚ベースの触覚センサーから106,800枚の触覚イメージが含まれている。
全てのタスクに対して強いセンサー内性能は、収集された触覚観察が対象の目的に対して有益であることを示している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:22:48 GMT)
MedGuards: Multi-Agent System for Reliable Medical Error Detection and Correction [7.9] MedGuardsは、医療エラーの検出と修正をマルチエージェントのインコンテキスト学習タスクとして扱う新しいフレームワークである。
特別エージェントは別々にエラーを検出し、ローカライズし、修正する一方、信頼誘導仲裁機構は不一致を解消する。
我々の目標は、現実世界の医療アプリケーションにおいて、より安全な大規模言語モデルのデプロイを可能にすることです。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:07:59 GMT)
Multi-Agent Goal Recognition with Team- and Goal-Conditioned Reinforcement Learning and Factorized Branch-and-Bound [7.8] マルチエージェントのゴール認識は、オブザーバーに、どのエージェントが一緒に行動し、各チームが何を達成しようとしているかを共同で推測するように求めます。
MAGR-BBはこの設定に、分割された分岐とバウンドの探索においてスコア付けモデルとして使用されるチームとゴール条件の共通ポリシーで対処する。
制御されたマルチエージェントBlocksworldベンチマークでは、MAGR-BBは軌道全体を通して徹底的な探索と同じトップランクの仮説を返す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:50:39 GMT)
Approximate Structured Diffusion for Sequence Labelling [7.8] シーケンスラベリングは自然言語処理(NLP)のコアタスクである
機械学習の観点からは、シーケンスラベリングはしばしばニューラルネットワークによってパラメータ化された線形鎖条件ランダムフィールド(CRF)としてキャストされる。
我々は拡散を利用してラベルシーケンス全体の条件付きCRFを訓練できることを示し、その条件がラベルのノイズのあるバージョンにあることを注意する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:21:10 GMT)
FedUP: One-Shot Federated Unlearning via Centroid-Guided Plug-in Filters [7.8] フェデレーテッド・アンラーニング(FU)は、分散システムにおいて忘れられる権利のような法的義務に従うために重要である。
我々は,軽量なプラグブルフィルタを利用したワンショット・フェデレーション・アンラーニング・フレームワークであるFedUPを提案する。
多様な画像およびテキストタスクの実験は、FedUPがターゲット外の知識損失を効果的に減少させることを示した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:04:38 GMT)
Calousel: Extrinsic Calibration of Non-overlapping Multi-camera Systems from Pure Rotation [7.8] 従来の目標ベース手法は、かなりの目標設定オーバーヘッドを課す。
動きに基づくアプローチは、代わりにドリフトエラー、あいまいさのスケール、動きの縮退に悩まされる。
本研究では,1つの静的キャリブレーション板のみを必要とする純粋回転運動を利用する新しいキャリブレーション法を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:54:20 GMT)
How Reliable Is Your Jailbreak Judge? Calibration and Adversarial Robustness of Automated ASR Scoring [7.8] LLMジェイルブレイクとプロンプトインジェクションに関するほぼすべての論文は、アタック・サクセス・レート(ASR)を報告している。
我々は2人の裁判官の家族と人間の多数決を比較して攻撃する。
審査員の精度とリコールを報告し、審査員の精度を補正したASRを報告し、審査員の逆チェックを含めることを推奨する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:14:17 GMT)
WaveForward: An Omnidirectional Passive Wheeled Quadruped Robot with Casters [7.8] 車輪付き脚ロボットは、複雑な地形を横断するアジャイルモビリティと高い効率の両方を持ち、長距離輸送用途に適している。
そこで本研究では,両脚に標準キャスターを装着し,全方向移動を実現する新しい,低コストな受動脚型ロボットを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:59:51 GMT)
AI translation of literary texts is "fine", but readers still prefer human translations [7.6] 我々は、最近出版されたヒト翻訳(HT)と機械翻訳(MT)の比較を熱心な読者に依頼する。
読み手は8K単語の抜粋を2つの条件で評価した。
全体として、読者はMTを「微妙」とみなすが、単純さ、明快さ、没入感のある性質から、HT(抜粋レベル19/30、より明確にチャンクレベル522/772)を好む。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:15:14 GMT)
MedBench v5: A Dynamic, Process-Oriented, and Hallucination-Aware Benchmark for Clinical Multimodal Models [7.6] 既存の医療AIベンチマークには、プロセスの可視性、アトミックスキル評価、統合幻覚検出が欠如している。
臨床マルチモーダルモデルのための再設計されたベンチマークであるMedBench v5を紹介する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:49:31 GMT)
Scoring Is Not Enough: Addressing Gaps in Utility-fairness Trade-offs for Ranking [7.6] すべてのユーティリティーフェアネストレードオフを達成する上で、スコアリングが準最適であることを示します。
セミグレーディなポストプロセッシングが、はるかに優れたトレードオフを実現する可能性を実証的に示しています。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 20:36:42 GMT)
Data-Driven Evolution of Library and Information Science Research Methods (1990-2022): A Perspective Based on Fine-grained Method Entities [7.4] 1990年代以降、ビッグデータと情報技術の進歩は、図書館と情報科学の分野でデータ中心の研究を推進してきた。
本研究は、ドメイン内の研究手法の進化的傾向を明らかにするために、きめ細かい分析を行う。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:37:13 GMT)
EMA-FS: Accelerating GBDT Training via Gain-Informed Feature Screening [7.3] EMAベースの特徴スクリーニング(EMA-FS)を提案する。これはアルゴリズムレベルの最適化であり、機能ごとの差分ゲインの指数的な移動平均(EMA)を維持する。
EMA-FSは、低利得機能をスクリーニングしながら高利得機能を保ちます。
金融不正検出、広告クリックスルー予測、産業品質管理、総合ベンチマークを含むデータセット上でのEMA-FSの評価を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:28:09 GMT)
LiMoDE: Rethinking Lifelong Robot Manipulation from a Mixture-of-Dynamic-Experts Perspective [7.3] 本稿では,動的エキスパートの生涯混合(textitLiMoDE)のアーキテクチャ的視点について述べる。
具体的には、マルチタスク事前学習段階において、事前知識を学習するために、動的MoE構造が最初に提案される。
タスク適応段階では、生涯の専門家を学習し、凍結したタスクと動的に組み合わせて新しいタスクを行う、生涯MoE適応機構%(LiMoEAM)を設計する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:18:43 GMT)
ASSCG: Just-Right Gating over Chattering for Fast-Slow LLM Planning in Autonomous Driving [7.2] 我々は、軽量なViTDriveベースの高速プランナーを構築し、NAVSIM上にLSMのスロープランナーを追加する。
プロジェクトのページでは、追加の視覚化を25%達成している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:44:51 GMT)
Commerge: Communication-Efficient, Robust, and Fast LiDAR Map Merging Framework for Multi-Robot Coordination in Resource-Constrained Scenarios [7.1] マルチロボットLiDARマップのマージにより、より高速な探索と効率的な地域被覆が可能となる。
しかし、マップのマージには、サーバとロボットの間で大量のセンサーデータを交換する必要がある。
グラフ理論選択的データ交換による帯域幅削減を実現するフレームワークであるCommergeを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:33:32 GMT)
RAS: Measuring LLM Safety Through Refusal Alignment [7.0] 大規模言語モデル(LLM)の安全性評価は、安全でないプロンプトやジェイルブレイクプロンプトでモデルに問い合わせることが一般的である。
生成した回答ではなく内部表現から安全性を測定するホワイトボックス評価手法である*SafeVec*を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:19:40 GMT)
GUI agent: Guided Exploration of User-Sensitive Screens [7.0] 最先端のLSM駆動エージェントは通常、その行動の安全性によらず、タスクを完了させるために微調整される。
ユーザセンシティブな状態を特定して分類し、ユーザセンシティブなクエリを定義することが重要です。
このデータセットは、エンジニアが重要なシナリオでユーザを認識して、ハンドオーバを要求するためのものだ。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:18:01 GMT)
Confidence Sequences for Online Statistical Model Checking of Markov Decision Processes [6.9] 本稿では,このようなオンクレオリン設定に特化して設計された複数のエンフエンシデンスシーケンスについて述べる。
全体的な実装には,従来よりも平均して50分の1のサンプルが必要です。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:16:08 GMT)
From Causal Discovery to Implementation: An Agentic AI Framework for E-Scooter Mobility Hub Planning Across 29 German Cities [6.9] 本稿では,ドイツ29都市の公共GBFSデータからCausalテンプレートライブラリを構築する3段階のエージェントAIフレームワークを提案する。
このライブラリ上に構築されたプランニングツールは、候補サイトをスコアし、インフラのレコメンデーションを校正し、実践者対応のレポートを生成する。
ドイツのハイルブロンでは、このフレームワークの因果的証拠によって知らせられた2つのハブサイトが現在建設中である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:13:15 GMT)
Uncertainty Quantification for Computer-Use Agents: A Benchmark across Vision-Language Models and GUI Grounding Datasets [6.9] 本稿では,単段階実行可能なGUIグラウンドにおけるポストホックUQのクロスレジームベンチマークであるArgusを紹介する。
我々は,ロジットに基づくスコア,サンプリングと整合性尺度,隠れ状態および密度推定器,P(True)および言語信頼促進手法の評価を行った。
UQランキングは、固定モデルのためにデータセット間で安定しているが、モデルクラスとオブザーバブルインターフェース間で分解される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:34:28 GMT)
Not Every Sync Is Safe: Calibrated DiLoCo Scheduling for Shared AI Infrastructure [6.7] DiLoCoスタイルのトレーニングは、時折外部同期の前に島々をローカルに列車に乗せることで通信を減らします。
このような船体に対する疑問は、外部マージがシステムコストに見合う価値があるのか、そして、事項を遅らせるためにエフェロウィンドウを選択するかどうかである。
このギャップを、スコアベースのコントローラであるWorkloadAware DiLoCoで埋めます。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:57:19 GMT)
Geometry-Anchored Transport Framework for Exemplar-Free Class-Incremental Learning [6.6] 巨視的異方性ドリフトを緩和するGeometry-Anchored Transport Frameworkを提案する。
また、局所化多様体の分解を正規化するトポロジー・アウェア進化の目的も導入する。
CIFAR-100、TinyImageNet、ImageNet-100にわたる実験では、提案されたフレームワークが既存のポストホック代替品を一貫して改善していることが示されている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:27:20 GMT)
Narration-of-Thought: Inference-Time Scaffolding for Defeasible Ethical Reasoning in Large Language Models [6.6] ナレーション・オブ・シント(NoT)は,思考の連鎖を5つのセクションにまとめるシステムである。
NoTはトレーニングやパラメータ、微調整を追加しない。
3つのベンダーから4つのジェネレータにまたがる100のDailyDilemmasシナリオにおいて、NoTは株主の崩壊を31%から1%以下に削減する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 20:23:16 GMT)
Beyond Single-Source Cognitive Taskonomy:Multi-Source Task Relations through fMRI Transfer Learning [6.5] 我々は,fMRIの認知タスクノミーを1対1の移動から,多対1のタスク関係や予算制約のあるタスク依存へと拡張する。
発見は、特定のグローバルアロケーション目標の下で、クロスパラダイム制限のモータクラスタと、高い優先度のワーキングメモリ状態を明らかにする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:20:00 GMT)
A Stochastic Epidemiological Model of Latent Tuberculosis in a Radiation Exposed Mars Colony [6.4] 火星のコロニーは、慢性放射線、免疫の変化、医療の自律性の制限、室内空気の工学などを組み合わせた環境に小さな閉じた人口を配置する。
宿主のコントロールが悪化すると、臨床的にサイレントキャリアーが感染性疾患の原因になる可能性があるため、潜伏感染は特に重要である。
我々は,火星植民地における潜伏結核再活性化の宿主放射-病原体-居住モデルを構築した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:49:40 GMT)
Brevity is the Soul of Inference Efficiency: Inducing Concision in VLMs via Data Curation [6.4] 推論効率は通常、モデルを縮小することによって追求される。
しかし、出力長は膨らみ続けており、標準ツールキットが未修正のまま残しているのはまさにそのコンポーネントです。
ここでは、簡潔さは推論効率の欠けているレバーであり、事前学習したデータキュレーションは、それを引っ張る実践的な方法である、と論じる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:50:28 GMT)
A welding penetration prediction model for laser welding process based on self-supervised learning using physics-informed neural networks [6.2] SimPhysNetはレーザー溶接浸透予測において高い分類精度を実現する新しいアルゴリズムである。
SimPhysNetの中核は自己教師型学習パラダイムであり、物理的な事前を対照的な学習フレームワークに組み込む。
実験の結果、SimPhysNetはわずか200のラベル付き画像を用いて96.06%の分類精度を達成した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:33:41 GMT)
C3-Bench: A Context-Aware Change Captioning Benchmark [6.1] C3-Benchは、コンテキスト対応のChange Captioningを評価するための包括的なベンチマークである。
従来の変更キャプションモデル、LMM(Large Multimodal Models)、2B-90BオープンソースLMMを含む32モデルをベンチマークする。
これらの隠れ障害モードを明確かつ測定可能にすることで、一般化可能で信頼性の高い変更キャプションシステムを構築するための次のフロンティアを明確にする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:15:24 GMT)
PYPILINE: Malicious PyPI Package Detection via Suspicious API Knowledge and Agent Workflow [6.0] 従来の静的なルール検出方法は、経験豊富なセキュリティ担当者による継続的なメンテナンスを必要とする。
PyPILINEは疑わしいAPI知識とエージェントワークフローを組み合わせて、悪意のあるPyPIパッケージを検出する。
PYPILINEの精度は96.7%、リコールは99.6%、F1スコアは98.1%である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:51:06 GMT)
Fast LeWorldModel [5.9] 我々は、繰り返しローカルロールアウトをアクション予測に置き換える高速遅延世界モデルであるFast LeWorldModel(Fast-LeWM)を提案する。
アクションプレフィックスを基本的な予測単位にすることで、Fast-LeWMは複数の水平線上で蓄積されたアクション効果を直接モデル化する。
Fast-LeWMはLeWMよりも平均的な成功を向上し、計画時間を大幅に短縮し、オープンループ遅延損失の低減を実現している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:59:59 GMT)
Transformer-based Multisensor Data Fusion of Ultrasonic Guided Wave and FBG-based Strain Measurements for Multitask Aerospace Structural Health Monitoring [5.9] 本稿では、圧電トランスデューサ(PZT)からのマルチセンサデータストリームを統合するTransformerベースのデータ融合フレームワークを提案する。
注意機構の可視化により、提案フレームワークは、健康指標(HI)予測とダメージローカライゼーションの両方に対して、透過的でマルチタスクな学習を可能にする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:47:27 GMT)
AutoRelAnnotator: Calibrated Model Cascades for Cost-Efficient Relevance Evaluation in Sponsored Search [5.8] 本稿では,コスト効率のよいオフライン関連アノテーションに対する体系的アプローチを提案する。
ドメイン固有の微調整ドライブの精度、カスケードドライブのコスト、およびクラスごとの等速キャリブレーションは、上面に小さいが信頼できる利得をもたらす。
私たちの仕事は、検索と広告システムにおけるスケーラブルで高品質なオフラインアノテーションパイプラインのためのビルディングブロックです。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:20:30 GMT)
Staying In Character: Perspective-Bounded Memory For Book-Based Role-Playing Agents [5.8] 本論文では,書籍ベースの文字エージェントのための3層メモリアーキテクチャであるREVERIEMEMを提案する。
エピソード層は、第一人物のシーン記憶を記憶し、セマンティック層は、可視的タグ付けされた事実を記憶し、パーソナリティ層は、状況に依存した音声および行動パターンを記憶する。
評価のために,知識境界をテストする8つのノベルに対して,KBF-QA,4,386のクエクションベンチマークを構築した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:37:49 GMT)
Low Variance Trust Region Optimization with Independent Actors and Sequential Updates in Cooperative Multi-agent Reinforcement Learning [5.8] 逐次更新における有利な変動の上限を制御するためのクリッピング目的を導入する。
クリッピング目的を用いた2つの新しい実用的なアルゴリズムを導出する。
提案手法は,安定収束特性と所望の低利得分散推定の両方で強調される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:05:11 GMT)
Offline Multi-agent Continual Cooperation via Skill Partition and Reuse [5.8] COMADは、Skill Partition and ReuseによるContinuous Offline Multi-agent Skill Discoveryのための原則化されたフレームワークである。
まず,マルチエージェントの動作データとオートエンコーダを併用して,コーディネーション知識を再利用可能なコーディネーションスキルに変換する。
マルチヘッドアーキテクチャによるスキル強化されたポリシー学習目標を構築し,再利用可能なスキルを具体化して優位関数を導出する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:40:21 GMT)
FAR-LIO: Enabling High-Speed Autonomy through Fast, Accurate, and Robust LiDAR-Inertial Odometry [5.7] 本稿では,高速,高精度,ロバスト性能のために開発された,高度に最適化されたLiDAR慣性オドメトリーフレームワークであるFAR-LIOを紹介する。
我々は,適応密度を持つ空間認識型一般化反復閉点アルゴリズムを用いて,精度を損なうことなく低レイテンシを実現する。
FAR-LIOは,最大250km/hの速度で走行する2台の自律レースカーの公用データセットとデータの両方を用いて,4種類のセンサー構成で評価する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:30:51 GMT)
CodeChat-Eval: Evaluating Large Language Models in Multi-Turn Code Refinement Dialogues [5.7] 大規模言語モデル(LLM)は、コードの生成と洗練のために、ソフトウェア工学でますます使われています。
既存のベンチマークでは、このマルチターンコードリファインメントダイアログ設定が省略されるのが一般的である。
マルチターンコードリファインメント対話から評価セッションを構築する評価フレームワークであるCodeChat-Evalを紹介する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:16:04 GMT)
SAC$^2$-Net: Semantic Anchoring and Complementary-Consensus Fusion for Multimodal Micro-Expression Recognition [5.6] マイクロ圧縮認識(MER)は、微妙な顔の動き、限られたデータ、および行動単位(AU)と感情カテゴリーのあいまいな関係が原因で困難である。
マルチモーダルMERのためのセマンティックアンコリング・コンセンサスネットワークであるSAC$2$-Netを提案する。
SAC$2$-Netは、粗い粒度、きめ細かな粒度、大規模、データセット間の評価設定において、最先端または高い競争性能を実現する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:20:03 GMT)
Quantum typicality survives non-Abelian gauge constraints: exact analytical prediction confirmed in $SU(2)$ lattice gauge theory [5.6] 我々は、サブシステム間相関の一般的な欠如である量子の典型性がゲージ理論の物理的ヒルベルト空間に持続していることを示す。
コグト・ススキンド・ハミルトニアン (Kogut-Susskind Hamiltonian) は定幾何状態から相関関係を生成するが、ジェネリック状態は平均への回帰のみを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:18:02 GMT)
Dissipative preparation of Laughlin-like states [5.5] 我々は、ラウリン様状態が開境界条件下でのリンドブラディアンの正確な一意な定常状態であることを示す。
我々の研究は、短期量子シミュレータ上でのFQH状態の準備と操作が可能な経路を開く。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:23:16 GMT)
Equivariance and Augmentation for Bayesian Neural Networks [5.5] 本研究では,ベイズニューラルネットワーク(BNN)の変分推論によるデータ拡張について検討した。
本稿では,この環境におけるデータ拡張の効果を高める3つの新しい対称性化手法を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:12:58 GMT)
Lessons from the Adoption and Deprecation of the Privacy Sandbox Web APIs [5.4] 2019年、Googleはプライバシーサンドボックスイニシアチブを立ち上げ、そのトレードオフをバランスさせ、広告のような一般的なユースケースに対するプライバシー代替手段を見つける。
Googleはプロジェクトを中止し、2025年後半に新しく導入されたAPIの大半を廃止した。
本論文は,各プライバシサンドボックス機能の全期間(一部では5年以上),人気Webサイト(CrUXトップ100k),閲覧中にChromeユーザが経験したような,それぞれのプライバシサンドボックス機能の有病率に関する最も大きな研究結果を提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:22:29 GMT)
Stage-Aware and Roughness-Constrained Diffusion Policy for Multi-Stage Robotic Polishing [5.4] 本稿では,ロボット研磨のためのSRDP(Stage-Aware and Roughness-Constrained Diffusion Policy)を提案する。
SRDPは、マルチモーダル観測履歴からプロセスステージ後部を推測し、それを共有逆復調過程の条件に使用する。
粗さ指向のプロセス制約拡散サンプリング法を導入し, 拘束フィード速度と通常の接触力を生成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:23:00 GMT)
A multi-task spatiotemporal deep neural network for predicting penetration depth and morphology in laser welding [5.4] 本稿では, 浸透状態, 深度, 海水形態を高精度に予測できる革新的な深層学習モデルを提案する。
監視プラットフォームは、レーザ溶接プロセス中に捕獲された溶接画像に依存している。
貫入状態の予測精度は99.35%に達し、貫入深さの予測誤差は1.79mmである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:02:53 GMT)
A cross-process welding penetration status prediction algorithm based on unsupervised domain adaptation in laser and TIG welding [5.4] 改良された深層学習は溶接浸透状態の分類に広く用いられている。
本稿では、段階的なドメイン拡張戦略と統合された教師なしのドメイン適応フレームワークを提案する。
提案手法は, 同一プロセスとクロスプロセスの両方の転送タスクにおいて高い精度を実現する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:52:57 GMT)
On-Policy Self-Distillation with Sampled Demonstrations Reduces Output Diversity [5.4] On-policy self-distillationは,教師と学生の両方に単一モデルを使用することで,強力なパス@1精度を実現する。
ロールアウトの多様性が低下し、pass@k曲線がフラットになるのです。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:59:02 GMT)
Augmentation with Dilution: A Large-Scale Empirical Study of Human Contributor Ecosystems After AI Coding Agent Adoption [5.3] オープンソースプロジェクトにおけるAIコーディングエージェントの導入により,人間の参加者の数,構成,行動がどう変化するかを検討する。
以上の結果から,AIエージェントの採用は,人間のコントリビュータの絶対数を大きく変えるものではないことが示唆された。
AIエージェントが人間のコントリビュータに取って代わるのではなく、オープンソースのエコシステムの構造を体系的に再構築していることが分かりました。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:36:01 GMT)
Supervised Post-training of Speech Foundation Models for Robust Adaptation in Speech Deepfake Detection [5.2] 局所的なスプーフ指向摂動を生成するための混合フレームポストトレーニング戦略を提案する。
ASVspoof5では、データ拡張なしで単一のモデルに対して最先端のEER 4.50%を達成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:49:17 GMT)
Agentic Analysis for Agentic Infrastructure: An LLM-Powered Pipeline for Comparative Governance of DAO and Corporate AI Protocols [5.2] 大規模ガバナンス談話分析のためのLLMを用いた比較パイプラインを提案する。
ERC-8004 (Permissionless, on-chain) と Google A2A (corporate-led) の2つのコントラスト標準で検証する。
統治形態は実質的な焦点に影響を及ぼすが、両政権は平等とコミュニティの断片化に匹敵するレベルの参加を示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:34:54 GMT)
Lifelong In-Context Learning with Transformers Requires Parametric Forms of Attention [5.1] コンテキスト内学習を生涯設定に拡張することは、AIエージェントの継続的な学習の実践的な解決策である、と我々は主張する。
メモリ容量の制限やコストのかかるオンライン更新により、現在、パラメトリックな注意が生涯学習に欠落している点を強調します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:14:20 GMT)
CoGeoAD: Hierarchical Color-Geometric Fusion with Multi-View Attention for Zero-Shot 3D Anomaly Detection [5.1] CoGeoADは、CLIPベースの統一フレームワークで、ピクセル整列した複数ビュー画像を構築することで、色と幾何学的特徴を融合する。
MVTec3D-ADとEyecandiesベンチマークの実験は、CoGeoADが最先端のパフォーマンスを達成することを示した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:12:22 GMT)
Large-Scale Tunnel Air--Ground Collaboration With FLISP: Fast LiDAR-IMU Synchronized Path Planne [5.0] FLISPは、UGV-UAV共同検査のためのマップレス計画フレームワークである。
FLISPは、UGV搭載のLiDAR-IMUスイートが両方のプラットフォームで同期パス生成を駆動する統一アーキテクチャを備えている。
FLISPは7ミリ秒のレイテンシで100%の成功率を達成した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:44:35 GMT)
Unlocking Model Potentials Through Adaptive Multi-Agent Scaffolding for Efficient Issue Resolution [5.0] 非効率的なコンテキスト管理は、迅速なコンテキスト劣化とコンテキスト中毒を引き起こす可能性がある。
共有コンテキストを同期型イベントベースのメッセージパッシングに置き換える分散型マルチエージェントスキャフォールディングであるicat-agentを提案する。
icat-agentは、すべての難易度において、顕著なベースラインを一貫して上回る。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:48:05 GMT)
WinDOM: Self-Family Distillation for Small-Model GUI Grounding [5.0] 小型の(2B$2B)GUIグラウンドエージェントは、デバイス上のデプロイメント、アクセシビリティツール、低コストのイテレーションに魅力的です。
本研究では,高額な人的アノテーションを使わずに境界ボックス学習データを取得する方法と,教師付き微調整と強化学習の併用方法の2つのオープンレシピ問題に対処する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:35:29 GMT)
LinStereo: Linear-Complexity Global Attention for Multi-Scale Iterative Stereo Matching [5.0] LinStereoは位置認識線形アテンション(PALA)モジュールで、局所的な再帰を線形コストでグローバルアグリゲーションに置き換える。
標準ベンチマークにおける最先端の精度と強力なクロスドメインの一般化を実現している。
実際の水中データセットであるSQUIDでは26%、TartanAir-UWではAbsRelが28%低下する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:58:03 GMT)
At the Edge of Understanding: Sparse Autoencoders Trace The Limits of Transformer Generalization [4.9] 本稿では,変圧器モデルロバストネスの正確な輪郭を記述するための力学的枠組みを提案する。
OOD入力は、微妙なタイプミスやジェイルブレイクプロンプトを含むもので、言語モデルが内部で多くの誤った概念を操作できるようにする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:26:43 GMT)
When Does Synthetic Data Augmentation Improve Score-Based Imbalanced Classification? [4.9] 本稿では,合成マイノリティ向上がしきい値積分およびしきい値最適化の指標を改善する際の特徴付けフレームワークを開発する。
増分効果は, 有効クラス重み付けの変化と, 合成分布と真のマイノリティ分布の相違の2つの成分に分ける。
近似誤差,有限サンプル推定誤差,合成分布誤差の役割を定量化する明示的な改善境界を提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:30:36 GMT)
Jolia: Concept-Level Vision-Language Alignment for 3D CT Contrastive Learning [4.8] ConQuerは、CLIPのグローバルアライメントと局所アライメントを増強する画像テキスト事前トレーニング手法である。
ConQuerはレポートを概念固有のセクションに分割し、一致するイメージ機能をプールするクロスアテンションクエリを学習する。
胸部CTと腹部CTの3次元CT基盤モデルであるJoliaをトレーニングするためにConQuerを用いている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:27:02 GMT)
Pulmonary Embolism Risk Stratification from CTPA and Medical Records: Vascular Graphs Are Not All You Need [4.5] ストラティフィケーションガイドラインは、患者の医療記録、CTPA(Computed tomography lung angiography)から測定されたパラメータ、血液検査に基づいている。
本研究は,画像から抽出した医療記録とバイオマーカーのみから,最先端のモデルがリスク階層化を正確に分類できるかどうかを考察する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:28:27 GMT)
Analytic Approach to Quantum Control Using Quantum Signal Processing [4.5] 量子アルゴリズムは、単体および非単体変換を実装するための厳密なエラー保証を提供する。
QSP-Controlは、量子ビットオシレータダイナミクスの量子制御のための分析フレームワークである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:56:12 GMT)
Rapid and robust laser-frequency auto-locking using Bayesian-optimization and discrete-wavelet-transformation algorithms [4.5] ベイズ最適化と離散生物直交ウェーブレット変換を用いた自動ロック方式を提案する。
提案手法は,従来の走査法と比較して,参照探索において5倍の高速化を実現する。
レーザー強度の急激な50%の変動の下でも、99.5%以上の識別精度が達成される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:05:54 GMT)
RouteCost: A Production-Inspired Multi-Stage Framework for Pre-Order Shipping Cost Estimation in E-Commerce [4.2] RouteCostは製品にインスパイアされたフレームワークで、問題をタイムアウェアの需要予測、料金カードによるインフォームドベースラインの価格設定、ステージ2の残留補正、プロキシベースのボックス統合推論に分解する。
ルートレベルのコスト見積は、製品レベルの出荷コスト予測を生成するために、ルート重み付き予測定式化を通じて集計される。
250,000以上の注文、260の製品、18ヶ月の注文履歴を持つこのフレームワークは、ルートレベルの解釈性を維持しながら、予測品質と集約キャリブレーションを改善している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:19:54 GMT)
Instruction Bleed: Cross-Module Interference in Prompt-Composed Agentic Systems [4.2] 1つのプロンプトモジュールを編集すると、共有変数や実行可能依存関係がないにもかかわらず、他のモジュールの振る舞いが静かに変わる。
我々はこれをコンポジション行動漏洩(CBL):コンテキストウィンドウを共有するモジュール間の干渉として定式化する。
我々は、CBLを再利用可能な3チャンネルプロトコルによって配置されたジョブ評価エージェント上で探索し、ボリューム、コンテンツ、フォームに沿った非焦点モジュールを摂動させる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 20:09:28 GMT)
When Certainty Is an Artifact: Keyword Lexicon Blindness and the (Mis)Measurement of Rhetorical Stance [4.1] キーワードベースのスコアリングでは,ロバストな負完全/真正の語彙共起パターンが見つかる。
キーワードレキシコンは普遍的な語彙的共起傾向を測定する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:36:39 GMT)
Power-Budgeted Underwater Vehicle Control via Constrained Reinforcement Learning [4.0] 水中車両は、推進が急速に枯渇する固定されたエネルギー予算から運用されるため、スラスターパワーを減らしながらタスクを完了し、ミッション範囲と持続性を直接的に拡張する制御装置である。
本稿では、PPO-ラグランジアンアルゴリズムを用いて、平均スラスタ電力が明示的な予算を受ける制約付きマルコフ決定過程として、エネルギー効率の高い水中制御を定式化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:48:30 GMT)
MAPL: Multi-Objective Preference Learning for Robot Locomotion [4.0] ロボット移動のための強化学習において、リワードデザインは依然として大きなボトルネックとなっている。
我々は,高レベルな自然言語の目的から移動報酬を学習するフレームワークであるMAPLを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:52:04 GMT)
Deterministic Pareto-Optimal Policy Synthesis for Multi-Objective Reinforcement Learning [4.0] 我々は、チェビシェフのスカラー化から動機付けられた新しい選好条件のベルマン作用素を導入する。
これらの収束Q推定値から決定論的ポリシーを抽出する方法を示す。
実験により,本アルゴリズムは複雑なトレードオフを回復することを確認した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:28:49 GMT)
Spin-imbalanced fermion on a dynamic lattice [4.0] 1次元スピン-1/2フェルミオン動的格子の磁気秩序について検討する。
反復フェルミオンはIsingのようなスピン依存ホッピングを介して結合中心の局所化されたスピンと結合する。
2つのスピン密度波位相は、反復フェルミオン間の反発的なハバード相互作用に対して堅牢である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:16:37 GMT)
Learning Subset-Shared Invariances for Domain Generalization with Mixture-of-Experts [3.9] ドメインの一般化は、1つ以上のソースドメインから、目に見えないターゲットドメインに一般化するモデルを学ぶことを目的としています。
共通のアプローチは、予測構造がグローバルに共有されていると仮定して、すべてのソースドメインにまたがる表現の不変性を強制する。
予測構造は領域部分集合内でのみ安定であると仮定する部分集合共有不変性を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:24:57 GMT)
Geometry-Aware MCTS for Extremal Problems in Combinatorial Geometry [3.8] 幾何学において、n×n$グリッドの点の構成を問う極端問題について研究する。
提案手法は、実行可能なアクション空間への漸進的な更新を通じて、厳密な幾何学的制約を強制する。
検討した6つの問題のうちの5つに、新しい最もよく知られた計算結果を確立する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:34:08 GMT)
Minimalist Preprocessing Approach for Image Synthesis Detection [3.8] 傾斜度を計算し,隣接する画素間の画素変動を簡易かつ効率的に検出する手法を提案する。
このアプローチはハイパスフィルタとして機能し、色の影響を最小限に抑えながら、正確な画像区別のための重要な特徴を強調している。
スマートフォンなどのローエンドデバイスへのデプロイに適している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:59:12 GMT)
Axon: A Synthesizing Superoptimizer for Tensor Programs [3.8] 本稿では、テンソルプログラムの超最適化であるAxonを紹介する。
プログラム合成を使用して、セマンティックス仕様からターゲット命令を自動的に生成する。
その後、ISA命令をターゲットとするテンソル操作を減らし、ハードウェア記述に制約されたタイリング構成を探索し、演算子と命令を融合してメモリトラフィックを最小化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:37:12 GMT)
Does Aurora Encode Atmospheric Structure? Latent Regime Analysis and Attribution [3.8] 空間プールPCAとLRPを用いたオーロラモデルの内部表現について検討する。
オーロラの潜伏空間は、主に季節周期によって構成されているのに対し、極端な嵐は線形に分離可能なクラスターを形成していないことを示す。
LRPは、このモデルが1987年のグレート・ストームの3次元垂直構造と一致する特徴を伴っていることを示している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 20:18:12 GMT)
Criterion for qubit-assisted quantum metrology approaching Heisenberg scaling [3.7] プローブ-キュービット結合を1、2方向のみに制限することは、有効動力学生成器の十分な基準である。
ボソニックプローブの場合、変位推定に関するQIは、プローブの平均励起数に比例する。
スピンアンサンブルプローブでは、回転相と磁場推定の両方に関するQFIは、プローブスピン数に二次的依存を示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:58:23 GMT)
Agentic System as Compressor: Quantifying System Intelligence in Bits [3.6] 大規模言語モデルは、独立した予測器からエージェントシステムへと変わりつつある。
我々は「圧縮は知性」に基づく分析的視点を採用する。
我々は,算術符号,シード符号,フォールバックを用いてこの尺度を運用し,5つの設定で評価する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:32:49 GMT)
Finite-Shot Sensitivity for Moment Estimation in Quantum Metrology [3.5] モーメント推定のための有限測度理論を開発する。
1/2$の補正が完全に消える一般密度行列条件を同定する。
結果として得られた閾値は、モーメントプロトコルプロトコルの感度が運用上可視になる前に、必要な測定回数を定量化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:01:01 GMT)
A Tattered Cloak of Invisibility: Measuring Anonymity Loss in Railgun on Ethereum [3.5] 暗号ミキサーにおけるレールガンの挙動漏洩について検討する。
特徴的タイミングパターン、アドレス再利用、トランザクション値にまたがる特異な桁パターンを保存するトランザクショングラフの近接、トランザクション量の集団が露呈するknapsack型マッチングの5つのリーク源を検討する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:03:56 GMT)
Is Variational Monte Carlo Robust? Sharp Moment Thresholds and Heavy-tailed Stochastic Optimization [3.5] 変分カルロ (VMC) は電子構造理論における中心的なアルゴリズムである。
本研究では,結果の最適化問題は波動関数の結節幾何学によって本質的に制御されていることを示す。
局所エネルギーとランダム変数の両方をクリッピングしたVMCのロバストな新しい変種を導入する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:29:54 GMT)
Radial Schmidt mode detector of entangled photons [3.4] 自然パラメトリックダウンコンバージョン法(SPDC)によって生成される高次元空間交絡2光子状態は、量子情報科学応用の有望な資源となっている。
高次元絡み合いの利点を利用するためには、シュミット基底における検出能力が必要である。
まず、SPDC二光子状態のアジムタール平均化は、典型的な実験条件下では放射状シュミット分解形式となることを理論的に示す。
次に、SPDC光子の放射状基底における密度行列を特徴付けることにより、放射状シュミットモードとそのスペクトルを抽出する革新的なアプローチを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:02:11 GMT)
A Benchmark for Heterogeneous Stereo Deblurring with Physically- and Epipolar-constrained Cross Attention [3.4] ヘテロジニアス・ステレオ・デブロアリングのための専用フレームワークを提案する。
身体的および極性に制約された横断的注意(PECA)を提案する。
PECAは、視線由来の異方性上界で区切られたエピポーラ探索ウィンドウに、クロスビューマッチングを制限している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:34:20 GMT)
TileMaxSim: IO-Aware GPU MaxSim Scoring with Dimension Tiling and Fused Product Quantization [3.4] ColBERTのようなマルチベクトル検索モデルは、きめ細かいトークンレベルのMaxSimスコアリングによって最先端の精度を達成する。
既存のGPU実装は、ほとんどのハードウェア性能を未使用のままにしている。
私たちは、このギャップを埋めるIO対応のTritonカーネルのファミリーであるTileMaxSimを紹介します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:03:56 GMT)
GPUSparse: GPU-Accelerated Learned Sparse Retrieval with Parallel Inverted Indices [3.4] 本稿では,GPUを高速化した正確なスパース検索システムであるGPUSparseを提案する。
ブロック整列されたワープ対応のポストリストを持つGPU並列逆インデックスを使用する。
Batched scatter-add スコアリングアルゴリズムは数百のクエリを同時に処理する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:07:57 GMT)
BlowLive: Blow-Based Multi-Factor Biometrics with Liveness Detection and Revocability [3.4] BlowLiveは、強靭な多要素バイオメトリック(MFB)フレームワークで、ブロー音響信号と顔バイオメトリックスを相補的行動および生理的モダリティとして統合する。
我々は,BlowLiveフレームワークを完全実装し,50人の被験者から収集した生体データを用いて,その有効性を実験的に評価した。
その結果、高い認証精度(ブロー音響では99.56%、顔と融合モードでは100%)、堅牢なライブネス検出(99.42%)、強いテンプレート保護と無効化、非侵襲性、高いユーザビリティが示されている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:12:43 GMT)
Beyond Takedown: Measuring Malicious Go Module Persistence in the Wild [3.3] 私たちは、Goエコシステムにおける自動化ベースのサプライチェーンキャンペーンを測定します。
アタッカーは、アタッカーが制御するオーナの下で、正当なGoモジュールを再パッケージする。
正規のGoモジュールの2,289の悪意のあるバージョンを特定しました。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:36:38 GMT)
An Integrated Hardware-Software Design for Low-Data Spatial Defect Detection in Robotic Visual Inspection with Hybrid Optoelectronic Neural Networks [3.2] 本稿では,視覚検査におけるデータ過負荷と非効率な形状レベルのアノテーションに対処するハードウェア・ソフトウェア統合光電子アーキテクチャを提案する。
アノテーション依存を最小限に抑えるために、非イメージングで低データのパラダイムが確立されている。
その結果、従来の画像と比較して、提案アーキテクチャは、データボリュームを90%削減しつつ、同等の精度を維持していることがわかった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:28:31 GMT)
Parametric Generalized Adaptive Moment Features (PG-AMF) for Bearing Fault Diagnosis and Machine Health Monitoring [3.2] 本研究では,データから直接特徴を学習するパラメトリック適応型特徴抽出フレームワークを提案する。
学習された表現は、幅広い信号特性を効果的に捉え、産業監視システムにおける診断性能の向上と実用性の両方をサポートする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:02:23 GMT)
High-Rate and Resource-Efficient All-Photonic Quantum Repeater Architectures with 9 km Repeater Spacing [3.1] 2つの遠いパーティ間の量子通信は、将来の量子インターネットの基盤となるだろう。
等価リピータ間隔9kmで1000km以上の量子通信が可能な全フォトニック量子リピータアーキテクチャを提案する。
これらの不完全性が存在する場合、我々の実現にはプロトコル当たりの中継局当たり数千GKPキュービットしか必要としない。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:26:48 GMT)
Optimizing Pump Conditions of Parametric Amplifiers for Fast Multiplexed Readout of Superconducting Qubits [3.1] 本稿では,高速多重読み出しに適したポンプ条件を決定するための戦略を提案する。
移動波パラメトリック増幅器を用いた5ビット多重読み出しチェーンで実験を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:05:33 GMT)
GROVE: Grounded Pedestrian Simulation via Natural Language for Interactive Social Robot Navigation [3.1] 歩行者シミュレーションは、社会ロボットナビゲーションアプローチの訓練と展開において重要な要素である。
GROVEはテキストからシナリオまでの歩行者シミュレーションフレームワークで、最先端のアプローチを組み合わせて現実的で社会的に困難なシナリオを生成する。
人間のシミュレーションはアイザック・シム、ガゼボ、RVizシミュレータに直接統合され、高度に社会的な環境でロボットを配置する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:39:01 GMT)
Racing a Wheeled Quadruped: Active Load Transfer Mitigation via Model Predictive Control [3.0] 本稿では,モデル予測制御(MPC)と強化学習(RL)を用いた階層型制御フレームワークを提案する。
このフレームワークはオフラインの時間最適レースライン生成、オンラインMPCプランナー、低レベルの全身RLポリシーを統合している。
ロボットの脚のアクチュエーターは、膝関節が反ロールトルクを発生させ、ターンに変形するアクティブサスペンションとして機能する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:54:17 GMT)
Mixture-of-Experts RL for Fault-Tolerant Legged Locomotion [3.0] 本稿では,故障診断情報を明示的に活用して特殊な制御専門家を活性化する,障害対応モジュール制御アーキテクチャを提案する。
実験結果から、明示的なフォールト条件のモジュラポリシは、同等の大きさのモノリシックポリシを一貫して上回ることが示された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:35:30 GMT)
H-Adapter: Pose-Robust Hairstyle Transfer via Attention-Derived, Source-Aligned Hair Masks [3.0] H-Adapterは、髪と非毛髪の目的を歪める領域特異的な損失で訓練することで、ポーズの堅牢性を向上させる。
ポーズ非依存サブセットおよびポーズ微分サブセットの実験は、強い定量的結果を示す。
我々は, VLM-as-a-judgeプロトコルを導入し, 髪型忠実度, 非毛髪保存, アーティファクト品質の連続的な向上を観察する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:52:06 GMT)
Verifying Intent and Harm: A Unified Defense Against LLM-Generated Threats [2.9] 大規模言語モデル(LLM)はますますインタラクティブなアプリケーションにデプロイされている。
敵との相互作用に弱いままであり、有害な、偽り、あるいは政策に違反するアウトプットを誘発する。
本稿では,迅速な意図と応答障害を共同で評価する,検証中心の防御フレームワークを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:00:39 GMT)
Enterprise Data Asset Quality: A Management-Standard Conformity-Benefit Realization Framework and Formation Mechanisms [2.9] 本研究では,データアセット管理能力,データ品質基準整合性,データアセットベネフィット実現能力を備えた3次元フレームワークを開発する。
本研究では,構造解析 (PLS-SEM), 必要条件解析 (NCA), 構成解析 (fsQCA) を統合フレームワークに統合する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:28:12 GMT)
Self Capacitive Tactile Sensor System designed for Companion Robots [2.9] 触覚はヒューマノイドロボットにとって、安全な物理的相互作用、巧妙な操作、真に人間らしい応答性を実現するために不可欠である。
従来のアプローチは複雑な多層構造、複雑な配線、高コスト、スケーラビリティに悩まされることが多い。
本稿では,自己キャパシタンス原理に基づくヒューマノイドロボットのための,シンプルでスケーラブルでハードウェアフレンドリな触覚センシングシステムを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:27:21 GMT)
Detect, Unlearn, Restore: Defending Text Summarization Models Against Data Poisoning [2.9] 訓練時のデータ中毒は、抽象的なテキスト要約のためにデプロイされた大きな言語モデルに重大な脅威をもたらす。
本報告では, 要約モデルにおいて, 微調整段階の毒を検知し, 即時処理するための統合されたポストホック防御フレームワークを提案する。
以上の結果から, 微調整時中毒は持続的な構造的遺物を残し, 完全再トレーニングを行なわずに, 実用的検出および再デプロイ後の回復を可能にすることが示唆された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:12:42 GMT)
Variational Inference via Entropic Transport Descent [2.9] 本稿では、各粒子の更新をエントロピー規則化された最適輸送問題としてフレーム化するParVIファミリーであるエントロピー輸送降下(ETD)を導入する。
ETDは完全にスコアフリーで動作でき、非正規化対象密度のポイントワイズ評価しか必要としない。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:02:26 GMT)
Deep Neural Networks with Ordinal Loss for Medical Applications [2.8] 我々は、順序データから学習するための汎用的でアーキテクチャに依存しないアプローチであるtextbfOrdinal Cross-Entropy (OCE) フレームワークを導入する。
OCEは、既存の最先端の順序のアプローチと比較して、予測エラーコストの低減とキャリブレーションの改善を実現している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:45:17 GMT)
AI-Assisted Computational Reproducibility on the FABRIC Testbed [2.8] FABRICテストベッドと,LoomAIを用いた大規模言語モデル(LLM)コーディングアシスタントを組み合わせることで,複数の領域にわたる実験の再現を簡易化できることを示す。
FABRICの3つのケーススタディを再現し,BBRファミリーの混雑制御評価,CPUのみのMPIクラスタ上でのLAMMPS分子動力学スケーリングベンチマーク,ストレスタンパク質ホメオスタシスゲノムパイプラインについて検討した。
ケーススタディ全体を通じて、AI支援ワークフローにより、再現の労力は約4~6倍削減された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:23:14 GMT)
General Techniques for Reducing Key-Switching Overhead in Privacy-Preserving Two-Party Transformer Inference [2.8] セキュアな双方向トランスフォーマー推論において、線形層は、暗号文または暗号文-暗号文行列乗算を通してFHEを用いて評価される。
既存の最適化はパッキング固有のアルゴリズムに大きく依存しており、一般的な適用性を制限している。
本稿では,注意計算のための前処理支援手法を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:33:17 GMT)
Information flow security on persistent memory [2.7] 我々は、単純なアセンブリ言語をモデル化する非構造化言語(つまり、ループではなくゴスを持つ)のための情報フローロジックを提供する。
この論理をx86アセンブリに適用し,命令のメモリへの非順序伝播の可能性を推論する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:31:13 GMT)
Test-Time Adaptation in Optical Coherence Tomography Using Trajectory-Aligned Time-Independent Flow [2.6] フローマッチング法はノイズ入力から高品質なサロゲート画像を生成する。
テスト画像のヒストグラムと合成基準軌跡をマッチングすることにより、テストデータとトレーニングデータのドメインギャップを克服する。
年代関連黄斑変性症(AMD)の2段階における重要なバイオマーカーのセグメンテーションにおける最先端性能の実現
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:05:23 GMT)
Energy-Efficient CNN Acceleration with MSDF Digit-Serial Arithmetic on FPGA [2.6] 本稿では,イメージセグメンテーションのためのU-Netアーキテクチャにおいて,畳み込み層のエネルギー効率の高いハードウェアアクセラレーションを提案する。
本稿では,これらの演算を統合パイプラインに融合する乗算付加アーキテクチャを提案する。
MMAユニットは空間入力深度を並列に処理するように設計されており、スタンドアロンのMSDFベースの設計と従来の設計の両方よりも大幅に高い性能を実現している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:37:40 GMT)
Fast mixing of all-to-all quantum systems at high temperatures [2.6] 有界強度相互作用を持つ任意の量子$k$局所ハミルトニアンは、システムサイズの独立スペクトルギャップを持つ量子ギブスサンプリング器[CKG23]を許容する。
これは、幾何学的に局所的な設定を超えて、既存の量子高速混合結果を一般化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:58:01 GMT)
Can Machine Learning Break Wi-Fi Privacy? A Study on MAC Address Randomization [2.5] 機械学習(ML)ベースの指紋認証を用いてデバイスを識別できることが示されている。
この論文の中核となる貢献は、ハイスループット(HT)情報フィールドのビットワイズ分解である。
以上の結果から,HT機能情報と3つのSRSSI測定値を用いたDBSCANは,最大89.6%の精度を達成できた。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:07:05 GMT)
AnySimLite: A Lightweight Few-Shot Similarity Encoder for On-Device Speech-Adjacent Classification [2.5] 我々は、AnySimLiteが、数ショット設定で、常に最先端(SOTA)またはSOTA競合性能を達成可能であることを示す。
最悪の場合であっても、パフォーマンス低下は7%以下であり、SOTA qLLaMA_LoRA-7Bベースラインのモデルサイズの$frac1250mathrmth$を使用する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:25:28 GMT)
Automated Detection of Configuration-Specific Security Vulnerabilities via Patch Analysis [2.5] VIC(Vulnerability Impact Condition)は、オリジナルの欠陥を含むすべての変種を指す。
PatchLensは,ASTレベルのパッチハンクをソースレベルの存在条件に合わせることで,VICを復元する手法である。
我々はPatchLensを1,192のLinuxカーネル、289のFF、100のPHPパッチで評価した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:10:29 GMT)
TensorLDM: A Component-Wise Latent Diffusion Model for Volumetric DTI Reconstruction from Sparse DWIs [2.5] DWIからの拡散テンソルの再構成は, 臨床現場での拡散イメージング(DTI)の促進に重要である。
本稿では,6つのテンソル成分を2つのグループ固有エンコーダで処理するコンポーネントワイド潜時拡散モデルを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:24:01 GMT)
Spatio-Temporal Mixture-of-Modality-Experts Diffusion for Quantitative DCE-MRI Synthesis from Incomplete MR Sequences [2.5] ST-MoMEは様々なサブセットから3次元DCEパラメータマップを合成する条件拡散フレームワークである。
3DパッチベースのトレーニングとSwinベースのバックボーンで、画像空間で直接拡散を行う。
正常化平均角誤差(NMSE)は,3つのDCEパラメータすべてで集計され,$v_p$および$v_e$での先行成績,$Kmathrmtrans$での競合成績,臨床的に重要な腫瘍領域における最小再構成誤差を達成している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:10:27 GMT)
Listening Like a Judge: A Music-Aware Framework for Automatic Singing Performance Evaluation [2.4] MusicJudgeは、自動歌唱品質評価のためのモダリティ誘導フレームワークである。
ピッチリズムの忠実度と歌詞の正しさを結合することにより、ブロック整列多重モーダル解析を行う。
意味的埋め込み、語彙的類似性、音声的アライメントを統合した多信号マッチングを用いて意味的に意味のある歌詞ブロックを検出する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:24:31 GMT)
Steering Vision-Language Models with Joint Sparse Autoencoders [2.4] 連成スパースオートエンコーダ(JSAE)を導入し、シーケンスプールされた視覚と言語アクティベーションを、共用、解釈可能な画像/カプセルレベルの特徴に分解する。
JSAEを視覚言語モデル(VLM)に適用すると、制御可能なクロスモーダルステアリングの方向として使うのが難しい表現が得られる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:11:04 GMT)
FunPiQ: A New Benchmark for Pixel-Level Quality Assessment in Fundus Images [2.3] 我々はFunPiQという,ピクセルレベルの品質アノテーションを提供する最初のFIQAベンチマークを紹介した。
我々は,非負の正負の学習を通してCNNを訓練するために,解剖学的視認性に基づく品質の擬似ラベルを用いた説明可能な設計(EBD)手法EFIQA-CPを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:59:34 GMT)
What Actually Works for Spacecraft Fault-Tolerant Control: An Honest Settled-Gate Benchmark of Learned and Classical Methods [2.3] 近年のFTCの研究は、宇宙船のアクチュエーターの故障で高い成功を収めたことを報告している。
我々は、成功がトレーニングで見たことのない欠陥にそれを保持することを意味しているとき、宇宙船が何を指しているのかを尋ねる。
私たちは、落ち着いたゲートの周りに構築されたベンチマークで回答します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:08:39 GMT)
Reliability-Asymmetric Spacecraft Autonomy: Co-Designing a Capable Learned GNC Stack with a Verified, Adaptation-Aware Runtime Shield [2.3] ルールベースの自律性は認証可能であるが不安定であり、学習された自律性は能力があるが検証するのは難しい。
AMPLE-GNCは3層誘導、ナビゲーション、制御スタックである。
文法制約付き復号化による事前訓練された360Mモデルの微調整は、ハードな出力値保証を与える。
我々は,有能な制御器であっても,ラッチングセーフホールドシールドが抑制可能であることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:55:21 GMT)
Conformal Recovery-Deadline Certificates for Runtime Assurance of Adapting Controllers [2.3] 本稿では,高度制御器から安全制御器に切り替えることにより,安全クリティカルシステムを保護する方法について述べる。
適応制御器のリカバリ時間に基づいて, 分割整形, 分布自由, 有限サンプル上限である整形回復遅延証明書を導入する。
限界範囲のカバレッジ、既知のフォールト・ディストリビューションシフトの下でカバレッジを回復する重み付き拡張、およびグループ条件のモンドリアンカバレッジを証明します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:02:06 GMT)
Reasonable Motion: A General ASP Foundation for Environment Constrained Movement Trajectory Computation [2.3] 本稿では,オブジェクトを現実の環境で移動させるための制約付き分岐軌道モードを計算するための,一般解集合プログラミングに基づくハイブリッド量修飾法を提案する。
適用性を示し、計算された軌跡が基盤となる安定モデルにどのようにトレース可能であるかを強調し、純粋に学習されたアプローチでは提供できない解釈可能性を与える。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:34:24 GMT)
Equivalence of non-local computation tasks beyond Clifford operations [2.2] 非局所量子計算(NLQC)は、2人の協力的プレイヤーが分散システム上でチャネルを実装する方法を研究する。
NLQCは、量子位置の検証から量子重力まで、様々な分野で応用されている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:59:21 GMT)
LLM-Based Discovery of Latent Requirements from Stakeholder Conversations: Preliminary Results from Industry [2.2] LENSは、株主インタビューの書き起こしを分析し、明確な要件を抽出し、追加の潜伏要件を推測するアプローチである。
LENSは,明示的な要求を抽出する上で,平均F1スコア84.4%を達成することを示す。
平均して、LENSによって特定される潜伏要件の75%は、ドメインの専門家によって有用な自動化や時間節約のポテンシャルを提供すると見なされた。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:14:07 GMT)
Action ControlNet: A Lightweight Delay-Aware Adapter for Smooth Asynchronous Control in Vision-Language-Action Models [2.2] Action ControlNet (ACNet) は、視覚言語-アクションモデルのための軽量遅延対応アダプタである。
ACNetは推論遅延下で堅牢性を改善し、直接チャンクストレよりもスムーズな非同期軌道を得る。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:53:43 GMT)
Direct Time-of-Flight Measurement Accuracy Improvement With Perimeter-Gated SPADs [2.2] 本研究では,SPADデバイスにおける周辺ゲーティングがデバイスレベルの検出精度の低下に寄与することを示す。
具体的には、異なるソースレベルから発生するdToFジッタを正確に推定する一般的なフレームワークを開発した。
我々はまた、0.35$mの標準CMOSプロセスで作製された周辺ゲートSPAD検出器を用いて、dToFsを測定した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:37:33 GMT)
Riazi-8B: An Urdu Large Language Model for Mathematical Reasoning [2.1] Urduは推論指向のリソースと、多段階の数学的問題解決に適応したモデルの両方を欠いている。
2段階の適応プロセスによって開発されたUrduの数学的推論モデルであるRiazi-8Bを開発した。
その結果,回答の正しさ,推論品質,応答完全性,ウルドゥー生成が一貫した改善を示した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:44:26 GMT)
Trust in Generative AI for Health Information Consumption and the Effect of Learned Dependency: An Experimental Investigation [2.1] ジェネレーティブ人工知能(GenAI)は、健康情報にますます使われている。
本研究は,学習したGenAI依存が信頼に影響を及ぼすか,テキスト強調が誤出力への過度な依存を軽減するかを検討する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:11:33 GMT)
RadarTwin: Scene-Specific mmWave Radar Simulation and Learning for Mobile Indoor Perception [2.0] RadarTwinは、実際のデータ収集の前にデプロイメント固有のレーダートレーニングデータを生成するためのフレームワークである。
シミュレーションと実レーダは同じ物体識別形状と材料特性を共有していることを示す。
シミュレーションだけで訓練された表現は、実際のレーダーラベルのない2.5倍の確率で実際の物体を認識し、いくつかのラベル付き例では、これを12方向の認識タスクで95.3%に引き上げている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:50:26 GMT)
Quantum steering in networks: Measurement-device-independent detection, continuous variables, and practical Gaussian schemes [2.0] マルチパーティネットワークにおける量子ステアリング認証について検討する。
ステアリング認定を測定デバイスに依存しない体制に引き上げることは,常に可能であることを示す。
本稿では,ガウス演算に基づく計測デバイスに依存しないネットワークステアリングプロトコルを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:57:56 GMT)
GRAG: Generic Response-Augmented Generation Framework for Personalized Conversational Systems [2.0] 現在のトレーニングパラダイムは、パーソナライズと接地を単一のモノリシックな学習問題として扱う。
本稿では,これらの競合する目的を分離するGAAG(Generic Response-Augmented Generation)フレームワークを提案する。
GRAGは補助的な足場を使用しない最先端の手法を著しく上回っている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:58:43 GMT)
When Agents Meet Electric Bus Fleet Operations: Pricing Behavior, Trade-offs, and Policy Implications in an Aggregator Framework [2.0] 本稿では,電気バスV2Gの動作を管理するためのエージェントアグリゲータフレームワークを提案する。
エージェントアグリゲータは、実行可能なスケジュールを維持し、再最適化を選択的に活性化し、充電とV2Gの柔軟性を向上させることで、適応的なフリートグリッド調整をサポートすることができる。
しかし、公開市場における彼らの展開には、透明性のある調整モード、監査可能な関税設定、明示的な価値共有ルールが必要です。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:41:52 GMT)
Approximating velocity fields with planted attractors via Neural-ODEs for classification purposes [2.0] 本研究では, 平衡点の定型化を施したニューラルODEを用いて, 分類作業に成功している。
植付されたアトラクタは対象クラスの指標として機能し、アーキテクチャの普遍的な近似能力を利用した速度場は動的景観を形作る。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:46:03 GMT)
Blasto-Net: An Explainable Multi-Task Learning for Blastocyst Segmentation, Grading, and Implantation Prediction [1.9] Blasto-Netは包括的ブラストシスト解析のためのマルチタスクディープラーニングモデルである。
モデルは、1つの前方通過で3つのタスクを同時に実行する: ZP, TE, ICMコンパートメントのセグメンテーション、モルフォロジーグレーディング、インプラント結果予測。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:45:06 GMT)
The Dependency Black Hole [1.9] 267のサービスからなる産業製品において,複数の依存信号の三角測量を行った。
ブラックホールに類似した依存ネットワークで繰り返しマクロ構造が観察された。
本稿では, ネットワークを特異点, 事象の地平線, 降着円盤のブラックホール解剖にマッピングする依存性ブラックホール理論を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:24:19 GMT)
TEMPO-Diffusion: Temporally Exposed Malicious Poisoning of Diffusion Models [1.9] TEMPO拡散(TEMPO-Diffusion)は、悪意のある分布シフトを一時的な非分布露光にローカライズするターゲットバックドアフレームワークである。
実験の結果,TEMPO拡散はクラス固有の合成データ生成を確実に阻害できることがわかった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:31:06 GMT)
JASPR: Joint Spatial Representation learning of histology and spatial genomics for improved virtual genomic screening and clinical prognostication [1.8] 本稿では,HE画像とSTデータを統合する自己教師型ディープラーニングフレームワークであるJASPR(Joint Spatial Representation Learning)を提案する。
共有モジュールを用いてモジュラリティの普遍的な空間特性を捉え、モダリティ固有の専門家は形態学的およびゲノムデータに特有の特徴を符号化する。
我々は,JASPRを乳がんデータセット上で訓練し,その学習された関節表現が9,248遺伝子のHEベースの予測を大幅に改善し,乳癌の予後に有意な価値をもたらすことを実証した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:35:49 GMT)
Hierarchical Reinforcement Learning for Neural Network Compression (HiReLC): Pruning and Quantization [1.8] HiReLCは、ディープニューラルネットワークの自動量子化と構造化プルーニングのための階層型アンサンブル強化学習フレームワークである。
低レベルエージェント(LLA)はブロックごとに独立して動作し、マルチ離散アクション空間上でカーネル単位の設定を選択する。
高レベルエージェント(HLA)は、フィッシャー情報に基づく感度推定によって導かれるアンサンブル投票を通じて、グローバルな予算配分を調整する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:19:29 GMT)
AXLE: A Cloud Infrastructure for Lean 4 Theorem Proving Utilities [1.7] AXLEはLean 4の証明操作、抽出、検証のためのクラウドサービスである。
これまでに5億以上のリクエストを処理し、Axiom Mathの証明活動の基盤となっている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:09:49 GMT)
Dissipative Quantum Multiplicative Weights with Sampling Feedback: A Classically Hard Primitive Realized via Engineered Open-System Dynamics [1.7] EmphDissipative Quantum Multiplicative Weights with Smpling Feedback (DQMW-Sample) を紹介する。
オープン量子系力学を工学的に構築したオンライン学習プリミティブであり、計算基底測定によって損失フィードバックが供給されるギブス状態を作成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:52:42 GMT)
Measurable Majorities Are Not Finitely Axiomatizable [1.7] Moss and Pedersen (2026) doi: 10.48550/arXiv.2606.23853> は、定性的多数決判定が有限加法的尺度で表現できるときに正確に特徴付けるコヒーレンス基準を導入する。
このノートは、有限社会決定フレームにおける厳密な過半数推論の有限公理性について研究する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:27:38 GMT)
Towards Safety-Aware Mutation Testing for Autonomous Driving Systems [1.7] SAMT(Safety-Aware Mutation Testing)へのパラダイムシフトを提案する。
従来の突然変異検査とは異なり、SAMTはADSモジュール間で交換されたメッセージに時間的に拘束された障害を系統的に注入する。
システム思考を突然変異テストパイプラインに埋め込むことで、SAMTはテストの妥当性を評価するための厳格なメカニズムを提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:36:04 GMT)
Towards Robust Optimal Measurements Against Noise in Quantum Metrology [1.6] 我々はフィッシャー情報計測ノイズの感受性理論に基づいて,ロバストな最適測定を実験的に検討した。
偏極型マッハ・ツェンダー干渉計により制御雑音下で位相推定を行う。
その結果、異なる測定値がノイズに対して異なる感度を示すことが示唆された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:44:05 GMT)
Probing in the Wild: A Case Study of Self-Supervised Speech Representations on Mandarin Sub-dialects with Unsupervised Articulatory Analysis [1.6] 本稿では,全くラベルのない探索パイプラインを用いたマンダリン自己教師音声モデルにおける調音特徴表現のケーススタディを提案する。
以上の結果から,マンダリンサブディレクトにまたがる調音的特徴デオードビリティのパターンが明らかとなった。
以上の結果から,言語に依存しない調音探索が実際の方言コーパスに応用できることが示唆された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:39:28 GMT)
Refusal Lives Downstream of Persona in Chat Models [1.6] アクティベーション空間における線形方向は、命令調整型チャットモデルにおける拒絶特性とペルソナ特性の両方について同定されている。
従順なペルソナゲートは拒否します。
Qwen2.5-7B-インストラクトとLlama-3.1-8B-インストラクトでは、一致したモデルペルソナ方向と拒絶方向を抽出し、両方に介入する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:25:59 GMT)
A functional central limit theorem for kernel gradient flow and infinitesimal gradient boosting [1.5] 我々は、その決定論的極限に関する過程のゆらぎを研究し、機能的中心極限定理を確立する。
この証明はバナッハ空間におけるODEの一般摂動解析に基づいている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:22:17 GMT)
Fault of Our Stars: Behavioral Drivers of Rating-Sentiment Incongruence [1.5] 本研究は、レビューテキストで表される感情が、星の評価によって示唆される感情と異なる、感情評価の不整合性について検討する。
16,156件のレビューのデータセットをトランスフォーマーベースの感情パイプラインを用いて分析する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:51:56 GMT)
CRAFT: Learn the Schema, Execute the Plan [1.5] CRAFTは、スキーマ基底符号化エージェントのための2段階の訓練後レシピである。
まず、スキーマストラップ付きPLAN教師付き微調整により、検証された軌道からドメイン構造化計画と実行可能な振る舞いを学習する。
第二に、実行形式の強化学習は、ツールの選択、コード品質、計画コードの一貫性、失敗した実行からのリカバリのポリシーを整合させる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:12:03 GMT)
Nanoelectromechanical Systems (NEMS) for Hardware Security in Advanced Packaging [1.5] 本稿では,Nanoelectromechanical Systems(NEMS)をハードウェアセキュリティプリミティブの新たなクラスとして紹介する。
NEMSはデバイスレベルでの物理的保証、改ざん検出、認証を可能にする。
標準的な半導体へのシームレスな統合は、防衛、航空宇宙、重要なインフラ、消費者電子製品にまたがるスケーラブルで検証可能なセキュアなソリューションの道を開く。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:33:33 GMT)
Implementation of reinforcement learning in chemical reaction networks: application to phototaxis as curiosity-driven exploration [1.4] 単細胞藻では、光タキシーはしばしば刺激-応答規則によって駆動される機械的ラン-タンブルプロセスとしてモデル化される。
本稿では, 部分観察可能決定過程と生化学反応のダイナミクスを結びつける枠組みを提案する。
我々のモデルは、このデータセットの客観的SSAベースラインに匹敵する経験的アライメント・ツー・ライト分布を再現する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:11:14 GMT)
Ramanujan Graph Rewiring with Non Negative Resistance Curvature [1.4] グラフニューラルネットワーク(GNN)は、エッジ間で情報を反復的に伝播し集約することにより、グラフ構造化データを学ぶための強力なパラダイムとして登場した。
従来のメッセージパッシング方式は、しばしばオーバースカッシングに悩まされ、指数関数的に大きな近傍は固定次元の埋め込みに圧縮される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:57:15 GMT)
Anatomically-conditioned Latent Diffusion Model for Data-Efficient Few-Shot Cross-Domain 3D Glioma MRI Synthesis [1.4] 解剖学的条件付き潜在拡散モデル(ALDM)は,データ効率,少数ショットMRI合成のための新しいフレームワークである。
ターゲット画像は16枚しかなく、極端に数発の撮影で評価された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:42:42 GMT)
Recall Before Rerank: Benchmarking Deep Learning Models for Large-Scale Code-to-Code Retrieval [1.4] 本稿では,大規模なコード・ツー・コード検索エンジンにおける第1段階のリコールのための,現代のディープラーニングモデルの有効性,効率,拡張性について検討する。
本稿では,LLMに基づくコード正規化とクエリ書き換え方式を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:41:36 GMT)
Nonlinear Dynamics of Coherent Parametric Amplification in Multipartite two-level System under Intrinsic Decoherence [1.3] 2レベル原子の多部構造における大域量子不協和と量子フィッシャー情報のダイナミクスについて検討する。
その結果, 内在的デコヒーレンスがなければ, 両量とも急激な振動, 崩壊, 回復挙動を示すことがわかった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:07:58 GMT)
Towards a Bathroom-Centered Human-Building Digital Twin Framework for Indoor Safety Analysis [1.3] 既存の浴室安全研究は、主に危険、アクセシビリティの問題、または設計上の修正を識別する。
人間中心のセンシング研究は、周囲の環境を十分な意味的に理解することなく、活動認識や転倒検出に焦点を当てることが多い。
本研究は,室内の安全度を考慮し,浴室中心の人造デジタルツインフレームワークを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:34:51 GMT)
Emcar: Embodied Controller for Animating Robots [1.3] この章では、ロボットの動きをプログラミングするための新しいソフトウェアツールであるEMCARについて説明する。
このノーコードプラットフォームの利点は、コラボレーティブロボットのためのクリエイティブなアプリケーションを拡張することだ。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:29:19 GMT)
Taxonomy-aware deep learning for hierarchical marine species classification in underwater imagery [1.3] 本稿では,生物分類の階層構造とトレーニング損失と推論規則を一致させる分類学対応の深層学習フレームワークを提案する。
このシステムの平均分類学的距離は1.581であり、第1位の解の3%以内である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:59:48 GMT)
Phonetic and semantic analyses of spoken corpora of Beijing and Taiwan Mandarin indicate that the neutral tone is a lexical tone [1.2] 中国語の中性音、または浮き声は、謎めいた性質を持つ音である。
二音節語では二音節のみに見られるが、一音節語は中音を持つこともある。
北京・マンダリンと台湾・マンダリンの会話音声コーパスにおける中性音の音素認識に関するコーパスに基づく研究を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 20:15:53 GMT)
Analysis of Autonomic Regulation in Cancer Survivors During Daily Physical Activity: A Real-World Wearable ECG Study [1.2] 本研究では, 乳がん生存者の身体活動に対する心拍数(HR)と心拍変動(HRV)の反応について, 実環境において収集した心電図(ECG)データを用いて検討した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:41:39 GMT)
A Survey of Quantum Programming Languages [1.2] 量子コンピューティングは近年、いくつかのブレークスルーを経験し、古典的コンピューティングに対する指数的な優位性の実証に近づいている。
プログラマは量子解を明確かつ効果的に表現するために、高レベルで汎用な実行可能プログラミング言語を必要とする。
本稿では,10の人気のある量子プログラミング言語を探索するために,言語分類フレームワークを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:01:51 GMT)
Maximal global device-independent randomness from projective measurements in every dimension [1.1] デバイス非依存乱数生成(DIQRNG)は、量子物理プロセスを用いてプライベートな乱数を生成する最も安全な形式である。
相互に偏りのない基底に基づいて2log(d)$ビットに到達する明示的なプロトコルを提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:50:28 GMT)
Sponsored Group Signature and its Application to Privacy-preserving Guest Access in Smart Environments [1.1] グループシグネチャ(グループシグネチャ)とは、グループメンバーが匿名でグループに代わってメッセージに署名できる、プライバシ保護のシグネチャスキームである。
グループシグネチャのメンバは、(信頼された)グループマネージャによってグループに登録される。
我々はSPGS(Sponsored Group Signature)と呼ばれる2段階のメンバ結合グループシグネチャを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:12:02 GMT)
Lightweight PCGAE-Net: Parallel CrossGate Attention and Bottleneck AutoEncoder for Efficient 5G Channel Prediction [1.1] 本稿では,ポストホック圧縮による効率問題に対処する軽量PCGAE-Netを提案する。
CS3T-UNetベースラインよりも58%少ない8.54,Mパラメータのモデルを生成する。
最大3.26,dBを5km/h、6.0,dBを9km/hで上回る。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:55:25 GMT)
FactorLibrary: From Polynomials to Circuits via Recursive Subgoals [1.1] ボトムアップとトップダウンの2方向の強化学習問題として定式化する。
我々は,Gumbel-PPO-MCTS と PPO+MCTS と SAC の2つのトップダウンエージェントを用いてボトムアップエージェントを訓練した。
PPO+MCTSトップダウンエージェントは、最も安定した性能を示し、認証された最適回路を、911.8%の成功率で8ドルまで複雑なものにした。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:45:09 GMT)
Memory Contagion: Cross-Temporal Propagation of Evaluator Bias via Agent Memory [1.0] Memory Contagion -- エージェントメモリによる評価者のバイアスの時間的伝播。
エージェントがバイアス評価者によって訓練されたり指導されたりすると、その経験がバイアスとなることを示す。
以上の結果から,現在のエージェントメモリ設計における重大な脆弱性が明らかとなった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:12:30 GMT)
TopoCast: A Topological Fidelity Framework for Evaluating Transformer-Based Time Series Forecasting [1.0] 時系列予測(TSF)における構造的忠実度を評価するためのトポロジ駆動フレームワークTopoCastを提案する。
持続図から4つの相補的トポロジカル忠実度尺度を導出し、それらをトポロジカル忠実度スコア(TFS)に集約する。
同様の予測誤差を持つモデルでは, 構造的忠実度プロファイルが著しく異なっており, 従来の評価で見落とされた故障モードが明らかになる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:03:39 GMT)
InvestPhilBench: A Multi-Layer Dynamic Benchmark for Evaluating Large Language Model Procedural Reasoning in Expert Investment Philosophy [1.0] InvestPhilBenchは8つの認知層にまたがる動的ベンチマークである。
v0.6リリースには118のプライマリソース認証投資原則カードが含まれている。
大規模な再現可能なスコア付けには、Benchmark Automated Scoring Pipelineを紹介します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:53:20 GMT)
Position Spaces and Graphs [0.9] 位置空間の形式化に基づくグラフベースの推論フレームワークである位置グラフを導入する。
この表現の包括的理論的解析は、まずグラフの一貫性の特徴づけから始める。
この問題は、制限された位置グラフのクラスにおいてもNP完全であることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:36:00 GMT)
Closed Quantum Boltzmann Bridges: Coherent Revivals, Hidden Microstates, and the Emergence of Classical Two-Time Entropy Conditioning [0.9] ボルツマン橋(Boltzmann Bridge)は、最初の低エントロピーのマクロ状態と後のマクロ状態の両方に条件付けられたエントロピー履歴を記述する。
我々は、マクロ部分空間プロジェクタ、ユニタリ時間進化、粗粒マクロセクターの次元で定義されるボルツマンエントロピーを用いてボルツマン橋の閉量子アナログを定式化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:47:57 GMT)
A Physics-Informed Neural Network with a Modified Lorentzian Activation for Nonlocal Gradient-Flow Equations in Dynamic Density Functional Theory [0.9] 非局所偏微分方程式のための物理インフォームドニューラルネットワーク(PINN)フレームワークを開発した。
これらの方程式は非線形性、非局所相互作用項、基礎となる勾配-流れ構造を含む。
我々は、PINN法をDDFT勾配流方程式に適用し、2つの計算成分を導入する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:01:13 GMT)
Toric code made subsystem: a framework for topological subsystem codes using anticommuting quantum spin liquids [0.8] 反共換量子スピン液体のクラスに基づいてサブシステムコードを構築するためのフレームワークを提案する。
コードは、量子スピン液体の多体トポロジカル秩序を継承し、トポロジカルサブシステムコードとなる。
矩形格子とかごめ格子幾何上にこれらの符号を構築するための具体的かつ詳細な例を2つ提示する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:00:01 GMT)
From Rubble Simulation to Active Magnetic Mapping: Quantum Sensing for Disaster Response [0.8] 既存のセンシングモダリティは、瓦の下の構造に関する部分的な情報のみを提供する。
本稿では,ドローンによる量子磁気計測を相補的モダリティとして提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:29:26 GMT)
Signature filtering: a lightweight enhancement for statistical watermark detection in large language models [0.8] Signature filteringは、透かしの埋め込みやテキスト生成を変更することなく、透かし検出を強化する検出時モジュールである。
繰り返し透かしテストの信頼性を損なう小さなトークンセットを学び、検出前にこれらのトークンを削除する。
2グラムと3グラムのシグネチャは、弱信号および低エントロピー設定における検出率を、フィルタリングなしで831%からフィルタリングで7899%に引き上げた。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:25:10 GMT)
MorphStrata: Layer-Specific Perturbations for Generating Morphence Students in Time-Series Moving Target Defense [0.7] MorphStrataは、従来のMorphenceディフェンスを拡張した選択的層特異的ノイズ注入による学生生成戦略である。
MorphStrataはトランスフォーマーのバックボーンを教師として使用し、ランダムに選択されたアーキテクチャブロックを摂動することで、学生モデルにまたがって構造化されている。
我々は,ジェナ気候,電力負荷図,アプライアンスエネルギー予測などの一連のベンチマークを用いて,バニラトランスフォーマーとモルフェンスバックボーンの評価を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:20:14 GMT)
RMTL: Reinforced Micro-task Learning for Long-Horizon Manipulation with VLM Rewards [0.7] ロボット操作のための強化学習では、しばしば手動で報酬関数を設計する必要がある。
1つのグローバルなプロンプトは、ランダムな初期条件を持つ長距離操作タスクには大きすぎると論じる。
本稿では,操作タスクを言語記述マイクロタスクの小さなセットに分解する手法であるReinforced Micro-Task Learning (RMTL)を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:32:48 GMT)
Interpreting "Interpretability" and Explaining "Explainability" in Machine Learning in Physics [0.6] 物理学における機械学習における解釈可能性と説明可能性の概念を概観する。
我々は、機械学習モデルは古典モデルと同じ科学的問題の対象であり、規模だけが異なることを強調する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:00:01 GMT)
Evolving Quantum Error-Correcting Encodings for Molecular Simulation [0.6] 言語モデルがプログラムを編集し、外部検証器が結果をスコアし、ハイスコアプログラムを保持・変更する。
ケーススタディでは、このループをfermion-to-qubitエンコーディングであるGeneralized Superfast (GSE)に適用する。
我々の知る限り、これらは高密度の分子ハミルトニアンに対して3ドルを超える距離のGSE/スーパーファストエンコーディングである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:19:43 GMT)
The Cost Geometry of Belief: finite-resource inference under noisy observation [0.6] 機械のデジタル双対である有限エージェントは、有限センサーを通してのみ、固定されたノイズの多い世界を見るので、そのコヒーレントな出力はポイントではなく信念である。
私たちはこの有限性を幾何学に変える:信仰コスト幾何学、それが心を変えるのに必要なものの幾何学である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:01:43 GMT)
DSP-SLAM++: A Unified Framework for Multi-Class, High-Fidelity Object SLAM in the Wild [0.6] 本稿では, DSP-SLAMフレームワークを拡張した DSP-SLAM++ を提案する。
本稿では,複数のオブジェクトクラスに対して,厳密なマッピングスレッドボトルネックを排除しつつ,細粒度で幾何学的に完備な形状を生成するシステムについて述べる。
この研究は、魚眼-LiDARセンサーを備えたプラットフォームでの使用を可能にすることで、自律運転やロボット操作といった現実世界のアプリケーションにとって、高忠実でマルチクラスなオブジェクトSLAMをより実用的なものにする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:27:23 GMT)
Accelerating Returns and the Qualitative Engine for Science [0.6] レイ・クルズヴァイル(英語版)は、技術進歩について議論する上で最も影響力のある物語であるリターンを加速する理論を説明した。
本稿は、この主張を数学的に簡単に解釈し、もしそのような加速が現実であるとしても、科学的な発見の中心的な問題をそれ自体で解決するわけではないと論じる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 20:14:37 GMT)
A 3D-Printable Dataset for Fair Testing and Comparisons of Tactile Sensors [0.6] 触覚センシングのための既存のテクスチャデータセットは、主に利用可能な表面や物体と相互作用する特定のセンサーからのセンサー読み取りで構成されている。
異なるプリンタやフィラメントタイプで確実に製造できるように設計された数学的に定義されたテクスチャの3Dプリント可能なデータセットを導入する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:27:16 GMT)
Unbiased Canonical Set-Valued Oracles Via Lattice Theory [0.5] 未来の出来事の確率を見積もる非エージェントの"オークル"AIは、自己参照の問題に直面します。
我々は、オラクルが単一の確率ではなく、クレダル集合を報告する自己参照的な方法を探る。
我々は、存在、自己整合性、および空虚性を証明し、建設が古典的な解答に崩壊することを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:20:13 GMT)
Accelerating Skill Assessment in Chess: A Drift-Diffusion-Enhanced Elo Rating System [0.5] そこで我々は,Drift-Diffusion-Enhanced Elo Rating System (DD-Elo) を新たなスキルアセスメントフレームワークとして提案する。
意思決定プロセスとしてのスキル表現をモデル化することにより、移動レベルデータを統合し、迅速なスキル変動を捉える。
DD-Eloはチェスの格付けのエコシステムに対して、説明可能で、応答性が高く、後方互換性のあるソリューションを提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:08:45 GMT)
Introducing corpora Hlava Cor and Hlava AD: Human Label Variation in Coreference and Discourse Relations [0.5] チェコ語のテキストに複数の注釈を付けた2つのコーパスを作成した。
最初のコーパスは、3つのアノテータが並列にアノテートした1,024のコンテキストから構成されており、様々なテキストタイプと文法・セマンティックカテゴリのコア参照の識別の違いを捉えている。
第2コーパスは512の文脈から構成され、5つのアノテータによって平行に注釈付けされ、帰属的および非帰属的構成における談話関係の同定に焦点を当てている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:32:05 GMT)
Cross-Subject Predictive Validity for Learning Outcomes of Delayed Start Behavior [0.5] Mathの練習中の遅延開始は、Mathと英語の両方で標準化されたテストパフォーマンスの予測である。
初学者(5分平均遅延、生徒の20%)と時間遅延(13分平均遅延、生徒の20%)の2つのサブグループを同定する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:23:24 GMT)
Charting the Growth of Social-Physical HRI (spHRI): A Systematic Review Pipeline Augmented by Small Language Models [0.5] 社会物理学的人間とロボットの相互作用(spHRI)は、ロボット工学、人間とコンピュータの相互作用、人間とロボットの相互作用、ハプティクスで急速に成長している。
スモールランゲージモデル (SLM) が, 大規模なspHRIシステムレビューにおいて, タイトルと抽象的なスクリーニングを支援することができる範囲について検討した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:09:20 GMT)
A probabilistic framework for online test-time adaptation [0.5] モデルはラベル付きデータに基づいてトレーニングされるが、トレーニングとテストの分布が潜在的に異なるという仮定の下で、テスト時にラベル付きデータに適応する必要がある。
このフレームワークは、パラメータ学習、パラメータ時間進化、事前チューニング、予測を特徴付ける状態空間モデリングアーキテクチャに基づいている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:37:09 GMT)
Simulating Universal Quantum Gate Sets on Photonic OAM Qubits: Single-Qubit and Multi-Qubit Operations via Spatial Light Modulator Phase Holography [0.4] 光量子情報処理のための再構成可能なプラットフォームとして空間光変調器(SLM)が登場した。
本稿では,HOLOEYE LC 2012 トランスミッションSLMに実装された量子ゲート演算の包括的シミュレーションとハードウェアによる忠実度解析について述べる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:57:15 GMT)
Implementing GenAI-Supported Learning in Software Engineering and Computer Science Education using Bloom's Taxonomy [0.4] ソフトウェアエンジニアリング教育におけるジェネレーティブAIの採用は、表面的な学習と学術的整合性に関する懸念とともに、学習支援の機会を高める。
本研究は,Bloomの分類に整合した明示的な指導指導が,SE/CS教育におけるGenAIの関与をどう支援するかを考察する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:44:07 GMT)
Spam and Sentiment Detection in Arabic Tweets Using MARBERT Model [0.4] 本研究は、MARBERTを用いて提案モデルを訓練し、f1スコア、精度、リコールメトリクスを用いて性能を測定した。
1,437件、否定13,828件、中立5,694件、皮肉1,221件、不定ツイート2,297件を含む、アラビアの24,513件のツイートデータセットでモデルをトレーニングした。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:22:39 GMT)
Deviance-style normalization for jointly overdispersed counts [0.4] 本稿では, 分散分散数行列に対するDirichlet--multinomial (DM) 分散残差化法を提案する。
DMヌルは、各サンプルのカウントベクトルを固定的な組成として扱う。
これは、観測されたサンプルの合計に対して、独立な負二項的特徴数を条件付けることによって、正確に生じる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:36:07 GMT)
Memory-Efficient Policy Libraries with Low-Rank Adaptation in Reinforcement Learning [0.4] また,Low Rank Adaptation (LoRA) は,全層の微調整に比べて20~160倍のメモリ使用量を最小化できることを示した。
同時に,本研究の結果から,選択したタスクの完全微調整とLoRA微調整との間には,成功率に有意な差がないことが示唆された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:15:42 GMT)
A phase-space approach for performing continuous-variable quantum teleportation with a non-Gaussian resource [0.4] ブラウンシュタイン・キンブル通信プロトコルにおけるPS-TMSFSの有用性について検討する。
PS-TMSFSは連続可変量子テレポーテーションには適さない。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:54:18 GMT)
Do (Not) Tell Me About My Insecurities: Assessing the Status Quo of Coordinated Vulnerability Disclosure in Germany Amid New EU Cybersecurity Regulations [0.4] ドイツのDAXに上場している40社のうち、CVDプログラムの採用状況と、課題と経験を分析した。
採用率は50%(2023年)から90%(2025年)に大幅に増加し、10の新しいCVDプログラムと25の新しいセキュリティ.txtファイルが利用可能になった。
調査回答は、例えば、法的義務はCVDプラクティスの採用を促進するが、(人間)リソースの欠如と様々な報告品質が欠点と見なされていることを示している。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:25:45 GMT)
Beyond Defensive Reporting: Machine Learning for Active Anti-Money Laundering Control in Insurance [0.4] 本稿では、機械学習が、不審な請求を支払前に警告するのに役立つかどうかを検討する。
我々は、後にマネーロンダリングの疑いがあるとして当局に報告されたクレームを検出するために、勾配式決定木モデルを訓練する。
その結果,不正関連調査ラベルを組み込むことで,洗浄の検出が大幅に向上することが示唆された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:22:34 GMT)
Taxonomy of Risks on Automated Fact-Checking Systems Considering its Propagation [0.4] 近年,ソーシャルネットワーキングサービス(SNS)における偽情報や誤情報などの偽ニュースの投稿が社会問題となっている。
この偽ニュースに対抗するために、SNS上の投稿の正確性を評価するためのファクトチェックがますます重要になっている。
現在、ファクトチェックはファクトチェック組織によって実施されているが、SNS上の全ての投稿をファクトチェックすることは困難である。
近年のファクトチェックシステムは人工知能と大規模言語モデルを利用しており、誤った判断や誤った結果を投稿するリスクがある。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:53:23 GMT)
DocHRL: A Hierarchical Reinforcement Learning Framework for Cost-Optimised Document Classification [0.3] ドキュメントごとに最もコスト効率の良い分類ポリシーを適応的に動的に選択することを学ぶ階層的強化学習フレームワークであるDocHRLを紹介する。
本研究は,文書理解システムにおける分類性能と運用効率を同時に向上できることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:05:01 GMT)
Cross-Modality Structural Guidance in 3D Latent Diffusion for Robust FLAIR Super-Resolution [0.3] 高分解能(HR)MRIの取得は、しばしばスキャン時間制限によって妨げられる。
深層学習に基づく超解像法は、しばしば解剖学的詳細を幻覚させ、脳の構造的整合性を損なう。
MR-DiffuSRは,HR T1w構造像を予め組み込んだ多解拡散型超解法フレームワークで,厚めのFLAIRスキャンの復元を誘導する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:26:01 GMT)
Naturalness Predicts but Does Not Cause Transferability in Image Encodings of Real-World Streams [0.3] 一般的な慣行では、1次元の信号を画像に変換して、自然写真に予め訓練された視覚バックボーンを認識のために再利用する。
符号化された画像の視覚的自然度が、凍結したバックボーンの下での転送精度とどのように関係しているかを問う。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:57:43 GMT)
Statistical and Structural Approaches to Algorithmic Fairness [0.3] 現代の機械学習システムは、その起源を独立した予測構造として誇張してきた。
アルゴリズムフェアネスの分野は、予測精度に最適化されたモデルが、体系的に疎外されたグループを損なう可能性があるという認識の高まりに対応して現れた。
この論文は、現代公正パラダイムの2つの基本的な制限を特定し、対処する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:23:40 GMT)
Auto-Labelling-Based Domain Transfer for 3D Object Detection on a Bicycle-Mounted LiDAR Platform [0.3] 都市交通における危険道路利用者(VRU)の3次元認識は、都市交通の安全と自律運転(AD)のコア要件に不可欠である
ミュンヘンのFUSE-Bikeプラットフォームから1027個のLiDARアノテート(18,000個以上の3D境界ボックス)の3Dオブジェクト検出ベンチマークを作成した。
我々は,VRUによる自動ラベリングパイプラインによって生成されたトレーニングラベルを微調整した後,GTボックス1,854個に対して,事前訓練された4つのnuScenes検出器を精査した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:08:17 GMT)
Self-Supervised Tree-level Biomass Estimation in Urban Environments From Airborne LiDAR and Optical Observations [0.2] カナダ・オンタリオ州の810km$2$の景観を対象とした,クラウンレベルの地上バイオマス(AGB)フレームワークを提案する。
ルールベースの擬似ラベルに基づいてトレーニングされた二重ストリームのクロスアテンションネットワークは、建物、針葉樹、落葉樹のセマンティックマークを生成した。
2018年の総AGBは1.73Tg、2023年の1.81Tg(811-850GgC)、ニアガラ・エスカルメント沿いの地元の密度は$sim140$Mgha$-1$となった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:02:39 GMT)
RoboTales: ROBOTic Anthropomorphic LEarning Systems [0.2] RoboTalesは安価なロボットストーリーテリングシステムで、表現力のある靴下人形を使って物語を作る。
ナレーション、ジェスチャー、口の動きを同期させ、キャラクター駆動のストーリーを実行する。
パイロットスタディでは、人形ベースのストーリーテリングはジェスチャーのみのモードより優れ、より高いHRIESレーティングと改善されたストーリーリコールを生み出した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:41:02 GMT)
A Neuromorphic Trigger for Efficient Audio Event Detection [0.2] 本稿では、下流モデルへの入力を選択的にゲートするスパイキングニューラルネットワーク(SNN)に基づく、音声イベント検出のためのニューロモルフィックトリガを提案する。
提案したニューロモルフィックトリガーは、柔軟な低コストのフロントエンドとして機能し、健全な音声セグメントを特定し、これらを分類などのタスクのより計算集約的なモデルで処理できるようにする。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:34:39 GMT)
Cross-Attention Multimodal Learning for Predicting Response to Neoadjuvant Imatinib in Gastrointestinal Stromal Tumors: A Multicenter Retrospective Study [0.2] 消化管間質腫瘍(GISTs)におけるネオアジュバント・イマチニブに対する反応は,高度に変動しており,確実な予測はできない。
本研究はCT(Computerd tomography)画像と臨床変数を統合したマルチモーダル学習フレームワークを開発し,評価した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:53:18 GMT)
Resonant false vacuum decay in two dimensions on a 4000-qubit quantum annealer [0.2] 本研究は, 局所共鳴条件により, ドメイン成長が核形成を桁違いに上回り, 制御されることを示す。
4000量子ビット以上のプログラマブル量子アニールを用いて、2次元量子イジングモデルを実現する。
以上の結果から, 量子シミュレーションが非準安定力学にどのようにアクセスできるかが明らかとなった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:33:51 GMT)
Reinforcement Learning for Software Vulnerability Analysis: A Systematic Review with Emphasis on C/C++ Source Code and Static Analysis [0.2] 本研究は,C/C++ソースコードと静的解析に着目し,ソフトウェア脆弱性解析のための強化学習(RL)技術についてレビューする。
我々は、2015年から2026年にかけて発行された21の主研究を、主要な科学的データベースと補完的な検索から特定する。
その結果、15の研究ではファジィングとガイド付き探索に焦点が当てられ、直接脆弱性検出には3つ、ステートメントレベルのローカライゼーションには1つに過ぎなかった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:09:42 GMT)
Cellular Predictions on the Move: What about Data? [0.2] 本稿では,モバイルデータトラフィックの時系列化に加えて,セルラートラフィック源の潜在的数とその移動量といった人口動態を特徴付けることを提案する。
総合的な実験では、これらのデータのみを使用することで、60ドルのオーダーで予測の改善が示される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 11:21:17 GMT)
Neural Voxel Dynamics: Learning Implicit 3D Physics via Volumetric Feature Advection [0.1] 本稿では,映像由来の監視信号から直接,暗黙的な3次元物理力学を学習するための自己次元フレームワークを提案する。
予測ボトルネックを2次元画像空間から3次元容積潜在空間にシフトすることで、この問題に対処する。
トレーニングや推論のための明示的な古典的シミュレータに依存する最先端のハイブリッドモデルとは異なり、当社のアーキテクチャは、高教師付きV-JEPA機能内の物質状態を暗黙的に追跡する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:06:35 GMT)
Model selection with proper scoring rules on data sets of time series: prefer the mean scaled score [0.1] 複数の時系列のデータセットから評価した確率的予測モデルにおけるモデル選択の問題について検討する。
このような相違はスコアの分布の歪みから生じることを示す。
テストセットのサイズが大きくなると、すべてのアグリゲーション基準は同じモデル選択決定に収束する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:19:17 GMT)
Methane-Plume Segmentation From Hyperspectral Satellite Imagery Via Multimodal Deep Learning [0.1] 本稿では,機能誘導型メタン濃縮機構を統合したマルチモーダル深層学習モデルを提案する。
提案手法はMPDatasetで評価され,MIoUでは+0.92,MPrecisionでは+0.87,Recallでは+1.01と,最先端技術よりも優れていた。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:12:16 GMT)
Bell inequalities tailored to optimal global randomness certification [0.1] 任意の出力数$d$に対して最適な大域的ランダム性証明を達成するために設計された2つの新奇なベル不等式を提示する。
最初のファミリーでは、$dtimes d$ maximally entangled state を用いて量子化を構築し、任意の$d$に対して最適であると予想する量子違反を与える。
2つ目の族に対して、最適量子違反とその量子化を任意の$d$に対して提供し、再び$dtimes d$ maximally entangled状態を使用し、少なくとも2つの非偏平基底上の射影測定を行う。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:53:41 GMT)
\chisao{}: A GPU-Native Parallel Optimizer for Multimodal Black-Box Functions via Convergence-Anticonvergence Oscillation [0.0] Chisaoはサンプルバッチ全体を同時に実行し、意図的な収束対収束サイクルを活用する。
Chisaoは textbf100% モードのリカバリを実現しており、CPUベースラインはすべて$d geq 8$で崩壊する。
このアルゴリズムは、PyPI上のスタンドアロンのPythonパッケージとして利用できる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:33:29 GMT)
Wide-field NV magnetometry under simultaneous high-pressure and high-temperature conditions [0.0] 高圧・高温同時条件下での広視野光磁気共鳴(ODMR)を実証した。
さらに, 7 GPa, 500 Kで鉄の広視野ODMRを行い, 試料からの成層磁場を圧力セルを通して空間的に可視化した。
これらの結果は、高圧・高温環境下での材料中の磁気現象を撮像するための有望なプラットフォームとして、NV中心磁気メトリーを確立した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:19:36 GMT)
What Browsers Do in the Shaders: A Measurement Study of WebGPU Privacy [0.0] WebGPUは、検証済みプログラミングモデルを通じて、通常のWebページでGPUワークロードを実行することができる。
バリデーションはメモリの安全性を保護するが、共有ブラウザ、ドライバ、OS、GPU状態は依然としてプライバシ関連シグナルを公開することができる。
WGPULensは、制御されたシナリオ、ブラウザネイティブの共抵抗性、参加者フィールドスタディ、公開ページロード、緩和ポリシーをまたいだこれらの信号を測定するためのフレームワークである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:11:06 GMT)
Weak decay of the positronium ion [0.0] 初期境界状態と最終粒子のすべてのスピン配置を明示的に評価することにより、崩壊率を計算する。
分岐比は正ポジトロニウムの弱崩壊と同等である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:54:07 GMT)
Toten: A Knowledge-Based System For Structure-Preserving Representation Of Physical Quantities And Technical Notation In Brazilian Portuguese [0.0] 技術的テキストを定量的に処理するAIパイプラインは、物理量、数、単位、記号表現が無傷である入力に依存する。
入力表現が各技術エンティティ全体を型付き単位として保存する知識ベースシステムTOTENを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:29:29 GMT)
Three Buddhist Vocabularies: Computational Stylometry of the English Pali Canon across Sutta, Vinaya, and Abhidhamma [0.0] 本稿では,英語翻訳における3つのピタカすべてにまたがるティピタカの計算的テクスチャ分析について述べる。
コーパスは、ビクフ・スジャト(英語版)のスッタ・ピタカ(英語版)からI.B.ホーナー(英語版)の1938年のヴィナヤ訳までの134,831節に及ぶ。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:06:23 GMT)
The impact of artificial intelligence on enterprise software user roles [0.0] 人工知能(AI)は、ソフトウェア開発における仕事の性質を急速に変えつつある。
本研究では、AIがSAPのBusiness Technology Platformのコンテキストにおいて、専門家の責任をどう変えるかを検討する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:04:30 GMT)
The Unfireable Safety Kernel: Execution-Time AI Alignment for AI Agents and Other Escapable AI Systems [0.0] 本稿では,AIシステムのアーキテクチャ制御を実現するRustリファレンス実装であるUnfireable Safety Kernelを紹介する。
我々は,生きた,回避可能なAIシステム,決定論的,自己改善的な世界モデルを管理するカーネルを,逃げ出す敵に対して評価する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:32:27 GMT)
The Inference-Compute Frontier and a Latency-Efficient Architecture for Limit Order Book Prediction [0.0] 予測的損失と構造的前進の実証的フロンティアは、権力法則によってよく要約されている。
我々はハードウェアフレンドリーな時間・特徴混合操作から構築した高密度軸分離型LOBミキサーであるFastBiNLOBを動機付けている。
FastBiNLOBは発行された$y_10$と$y_100$のマクロF1ターゲットを超え、既存のSOTAアーキテクチャよりも明らかにレイテンシが低い。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:54:09 GMT)
The Effortless Trap: Productive Struggle, AI, and the Illusion of Learning [0.0] AIが急速に進歩すると、教育者はジレンマに直面します。
うまく使えば、AIはフィードバック、例、実践、個別のサポートをスケールできる。
使いづらいのは、学習に必要な認知的な作業を置き換えることだ。
新しいアイデアは、プライム、プローブ、ポイント、アタッチメント、強化、テストの6つのステップを通じて学習される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:42:48 GMT)
The Cost of Removing Tunability in Quantum Data Re-Uploading [0.0] 固定されたアップロード回路で調整可能なアップロード回路を近似するための量的深度誤差スケーリングを確立する。
調整可能なアップロード回路は、深さ(D = O_!left[log (1/varepsilon)right[log (1/varepsilon)right]アイロンを用いて固定回路で近似できることを示す。
本結果は, 周波数から回路の複雑度への表現率の伝達過程を定量的に把握するものである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:05:18 GMT)
The Colored Hofstadter Butterfly as a Many-Body Quantum Hall Phase Diagram [0.0] 色付きのホフスタッター蝶は、弱い相互作用を持つ格子フェルミオン系の幅広いクラスに対する多体解釈を持つことを証明している。
相互作用しないホフスタッター蝶の整数色は、相互作用する量子ホール相のホール伝導性ラベルとして持続する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:02:28 GMT)
Tailor Made Embeddings for Quantum Machine Learning [0.0] 古典的データのタスク固有の量子埋め込みを学習する変分オートエンコーダフレームワークを提案する。
我々は,高次元データセットを13量子ビットの量子表現に圧縮できる一方で,学習復号器によって再構成可能であることを示した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:53:41 GMT)
TL++: Accuracy and Privacy Preserving Traversal Learning for Distributed Intelligent Systems [0.0] TL++は,ノード間の仮想バッチを構築し,集中型ミニバッチ勾配を回復する2モード学習フレームワークである。
セキュアモードは、各カット層活性化とオーケストレータと非凝固ヘルパー間の勾配を秘密に共有する。
CIFAR-10では、TL++ベースカット1と正確なセキュアカット3がそれぞれ91.41%(SD 0.19)と90.93%(SD 0.179)のアキュラティを達成し、最強の非TL++ベースラインを12ポイント以上超えた。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:34:27 GMT)
Story Operators: Decomposing the Original $\to$ Sequel Transformation in Embedding Space [0.0] オリジナル小説とその続編を考えると、私は第1作を第2作に変えるのに何が必要か尋ねる。
私は、変位 $d=barx_rm seq-barx_rm orig$ を作り、コンテンツベースで慎重に分解します。
プロジェクト・グーテンベルクの13の検証済みの著者ペアの中で、この分解は続編の小さな分類を明らかにしている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:21:36 GMT)
Spin-Momentum Impedance and Filtering by a Spin-Coupled Absorbing Boundary Condition [0.0] 我々は、パウリ粒子のスピン結合吸収境界が代わりにスピン-モーメントインピーダンスとして働くことを示す。
堅牢な結果は、普遍到着時法則ではなく、境界スケール $|boldsymbol|simsqrt$ を持つスピンモメンタムフィルタリング機構である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:07:49 GMT)
Specifying AI-SDLC Processes: A Protocol Language for Human-Agent Boundaries [0.0] プロトコルとしてAI-SDLCプロセスを指定するためのドメイン固有言語を提案する。
言語は、ポリシー(宣言された意図)とメカニズム(構造的な執行)を区別する
実行可能な実装は実現可能性を示し、実証的な評価は将来の仕事である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:52:02 GMT)
Sp(2N, R) interferometry in multi-mode Gaussian bosonic systems for optimal metrology and quantum control [0.0] 二次ハミルトニアンを持つ多モードボソニック系の量子制御について検討する。
感度を最大化する最適量子制御には、同じ方向のスキーズと変位を調整する必要があることを示す。
我々のスキームは、光学的、原子的、機械的なプラットフォームで容易に実現可能である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:43:11 GMT)
SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning [0.0] マルチモーダル会話における安全評価のためのポリシー適応型ガードレールモデルファミリーである textbfSingGuard を提案する。
SingGuardはアクティブポリシーをランタイム入力として扱う。
ターゲットコンテンツをアクティブポリシールールに対してルールでチェックし、安全ラベルとトリガルールの両方を予測する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:30:59 GMT)
Shift Variant Image Degradation and Restoration Using Singular Value Decomposition [0.0] 本稿では、シフト変動運動のぼかしによって劣化した画像の復元のための特異値分解(SVD)に基づくフレームワークを提案する。
提案手法は, 特異値エネルギー保持基準を用いて, 小さい特異値の寄与を決定する。
実験により, 画像の細部を復元し, 異なる動作モデル下でのぼやけたアーティファクトの低減に, 提案手法の有効性が示された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:34:20 GMT)
Sesame: Structure-Aware Molecular Generation via Spatial Density-Map Conditioning [0.0] 本稿では拡散型分子生成モデルであるSesameを紹介する。
デノボ生成とフラグメント条件付きリード最適化の両方をサポートする。
セサマはタンパク質-リガンドデータセットの大きなコーパスで訓練されている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:33:20 GMT)
SSM Adapters via Hankel Reduced-order Modeling: Injection Site Determines Task Suitability in Long-Context Fine-Tuning [0.0] 本稿では,Hankel Reduced Order Model (HRM) をSSMベースの残余モジュールとして導入する。
システム行列 $barA$ の時間不変性を利用することで、HRM は正確な FFT ベースの並列スキャンを可能にし、LoRA との計算等価性を達成できる。
ゲート解析により、HRMはリカレンスを効果的に修正し、長文シーケンスモデリングのための低ランク適応に頑健なアーキテクチャ上の代替手段を提供することが明らかとなった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:36:31 GMT)
Reclaim Evaluation: A Lossy Memory Is Worse Than an Empty One [0.0] 言語モデルのメモリは、メモリを全く持たないよりも悪い場合がある。
単一のソースエラーによって、下流のステップが増加し、修正不可能な状態が保たれる。
これは、ベンチマークではなく、メカニズムの制御された研究である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:24:53 GMT)
Quantum tomography of free electrons [0.0] 連続変数における任意の自由電子量子状態を測定するための普遍的アプローチを報告する。
最初の応用として、1つの電子の量子状態が、超周電子ガスの多体クーロン相互作用によってどのように変化するかを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 04:51:42 GMT)
Quantum metrology of electric and magnetic dipole moments: ultimate limits and optimal regimes [0.0] 量子系における電気的および磁気的双極子モーメント(EDM, MDM)の特性は、基礎物理学と量子センシングの中心である。
電磁場に結合したジェネリック2レベル系における両双極子モーメントの分離と同時推定の最終的な精度限界に対処する。
本研究は,中性子EMM探索から分子磁気学まで,様々な推定手法の統一的なメロジカルな枠組みを提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:45:19 GMT)
Quantum conditional mutual information and channel capacity [0.0] 第3のシステムによって支援された2つの間の量子相関を確立するための最適速度は、QCMIの半分で与えられることを示す。
この結果は、Csiszr と Ahlswede の古典的な鍵生成能力を量子領域に自然に拡張する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:01:57 GMT)
Quantum Detectability in Invisibility Cloaks [0.0] 量子状態の微分可能性問題として古典的に閉包された物体の検出可能性を定式化する。
検出モードに作用する有効ガウス量子チャネルとして線形受動的クロークを扱うことにより,検出された第1モーメントと第2モーメントを隠蔽対象パラメータから独立させる必要があることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:25:08 GMT)
ProvenAI: Provenance-Native Traces of Evidence in Generated Answers [0.0] 本稿では,マルチホップ質問応答における透明性を3つの独立した測定可能なレイヤに分解するフレームワークであるProvenAIを紹介する。
このシステムは平均引用忠実度スコアが71.55%の53.53%の解答精度を達成する。
実装された表面プロキシとトークンレベルのKL偏差ターゲットの関係を,忠実度条件で定式化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 23:22:38 GMT)
Project-wise Comparison of Software Birthmarks Using Weighted Partial Similarity [0.0] 我々は,モジュールレベルの類似性の対称的なアグリゲーションに基づくプロジェクトワイドな誕生マーク比較のためのフレームワークを構築した。
非常に類似したモジュールペアの上位部分に焦点をあてた部分類似性手法を提案する。
10のカテゴリにわたる35のオープンソースJavaプロジェクトに対する提案されたアプローチを評価し、同じプロジェクトの異なるバージョンを再利用ケースとして扱う。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:26:49 GMT)
ProfileFoundry: A Synthetic Person-Object Substrate for Privacy, Memory, and Tool-Use Evaluation in LLM Agent [0.0] ProFILEFOUNDRYは,10万個の成体合成対象物の決定的生成と固定参照リリースである。
リリースには709,228のイベント、40,338世帯、52,491人の雇用主、518,564人のリレーションシップエッジが含まれている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:43:36 GMT)
Probabilistic Agents in Deterministic Audits: Evaluating Multi-Agent Systems for Automated Audits Based on the German IT-Grundschutz [0.0] NIS-2 何千もの中小企業から堅牢なリスクマネジメントを委任する。
IT-GS認証はリソース集約的であり、ドキュメント、検証、リビジョンに高いレベルの手作業を必要とする。
本稿では,Multi-Agent System(MAS)アーキテクチャとHybridRAG(HybridRAG)を組み合わせたIT-GS認証の部分的自動化の技術的実装と実証評価について述べる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:31:06 GMT)
Predicting Fruit Quality with a Hybrid Machine Learning and Image Processing Approach [0.0] 本研究では,果実の鮮度を評価するために,画像処理とディープラーニングを組み合わせたハイブリッドアプローチを提案する。
我々は,0(完全に新鮮)から100(完全に腐った)までのスケールで劣化を定量化する画像処理アルゴリズムを開発した。
我々は、果実画像の大規模なデータセットを用いて、畳み込みニューラルネットワーク(CNN)を訓練し、バイナリ分類(フレッシュまたはローテン)を行った。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:16:14 GMT)
Pre-Warm: Input-Conditioned Weight Initialization for Convolutional Neural Networks [0.0] Pre-Warmは、単一のトレーニングバッチから平均中心のローカルパッチを抽出する。
それらをMiniKMeansでクラスタし、逆マンハッタン空間重み付けを適用し、その結果のセントロイドを使って第1層フィルタの半分を初期化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:27:53 GMT)
Permutation asymmetry unlocks emergent advantage in randomized Bell tests [0.0] 極大に絡み合った2量子状態は、一様ランダムな射影測度の下で同じ確率で局所現実性に反する。
共有状態の置換対称性が2つの実現の間の統計的関係を決定することを示す。
この結果は, ランダム化ベル実験において, 置換非対称性を有用な特徴として認識し, 量子非局所性における対称性の新たな役割を強調した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:00:05 GMT)
Orchestrating Black-Box Schema Converters: An Empirical Study of Automated, Quality-Ranked Conversion Across Heterogeneous Schema Languages [0.0] 現代のソフトウェアシステムは、複数のスキーマ言語で同じデータモデルを必要とする。
スキーマ言語間のコンバータは見つけにくく、エコシステムに散らばり、不均一な品質で、しばしば失われます。
我々のアプローチでは、スキーマ言語をノードとコンバータとしてモデル化し、指向エッジとしてブラックボックスとして扱う。
オープンソースのConversion Orchestratorとして実現し、MetaConfiguratorに統合し、現実世界のスキーマから構築された60の変換タスクで評価します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:37:19 GMT)
Operational detection of Wigner negativity in arbitrary quantum states from few copies [0.0] 我々は、ウィグナー関数の観測可能なモーメントを用いて任意の状態のウィグナー負性を検出する枠組みを開発する。
我々のフレームワークは、連続変数システムにおける非古典的リソースの特定に自然に拡張されていることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:55:58 GMT)
Non-ergodic dynamical phase transition via a zero-mode exceptional point in a non-Markov atomic Josephson junction [0.0] オープン量子系は、通常、環境デコヒーレンスによって初期記憶が失われ、熱化がもたらされる。
本研究は,本質的な運動量結合モデルであるCaldeira-Leggettモデルによって記述された,頭と尾のBose-Josephson接合におけるこのパラダイムの顕著な分解を実証する。
この遷移は、基本的に非マルコフ摩擦から生じるゼロモードの例外点によって支配される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:25:59 GMT)
Neural Machine Translation for Low-Resource Tangkhul--English [0.0] タングル語(Tangkhul)は、主にインドのマニプールで話されているチベット・ビルマン語族の言語である。
本報告では,(1)ByT5-largeファインチューニングに基づく基本システムと,(2)同一コーパス上のmT5-smallファインチューニングに基づくコントラストシステム,の2つのシステムについて述べる。
我々の主要なBYT5大規模システムは、コーパスBLEUスコア39.97、chrF++58.07、BERTScore F1、COMET0.7302をホールドアウトテストセットで達成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:54:46 GMT)
Neural Architecture Search for Generative Adversarial Networks: A Comprehensive Review and Critical Analysis [0.0] GAN(Generative Adversarial Networks)の設計を最適化する重要な手法として、ニューラルアーキテクチャサーチ(NAS)が登場した。
本稿では、GANに適用されたNAS手法の総合的なレビューを行い、探索戦略、評価指標、性能評価結果などの基準に基づいて、様々なアプローチを分類・比較する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 08:29:58 GMT)
Necessary but Not Sufficient: Temperature Control and Reproducibility in LLM-as-Judge Safety Evaluations [0.0] ノイズを安全特性として示すことができることを示す。
再生ハーネス(690コール、7条件)を公表し、ハーネスは、スコアと並んで第一級の健康指標としてグレーダの不一致を治療することを推奨する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:24:40 GMT)
Natural Ungrokking: Asymmetric Control of Which Rules Survive Pretraining [0.0] コーパスは、モデルが保持するルールを学習した損失曲線に痕跡がなく、決定します。
公的なピチアチェックポイントでは、予測されたモデルスケールで順序付けられた崩壊深さと同じ創発的崩壊ダイナミクスが現れる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:27:13 GMT)
Monitoring Beam Splitter Entanglement using Quantumness [0.0] 2つの独立した圧縮真空状態が平衡ビームスプリッタと混合して絡み合う実験報告
状態の量子度を用いて連続変数システムに適した代替フレームワークを$$.99で使用します。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:33:50 GMT)
Mechanisms governing photon-pair generation and emission directionality in quantum metasurfaces [0.0] 本稿では,光子対生成と検出を制御する主要なメカニズムについて検討する。
基板厚と多層構造は, 量子準曲面設計において, さらなる自由度を示すことを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:49:16 GMT)
Measures of Chirality in Mixed-State Topological Phases [0.0] 純粋な状態では、トポロジカルフェーズにおけるキラリティは、よく知られた診断の網に結びついている。
いずれの診断も混合状態では信頼性は保たない。
キラリティを診断できる相対エントロピーに基づく2つの尺度を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:00:03 GMT)
Many-Body Second Order Green's Function Theory for Ab Initio Molecular Quantum Electrodynamics [0.0] 電子系の二階多体グリーン関数論(GF2)を拡張し、電子-ボソン結合を包含する。
系のボソニックな部分,すなわちコヒーレントステート(CS)とラングフィロフ変換真空状態(LF)を扱うために2つのアンスターゼを用いる。
これらはGF2法と組み合わせて、CS-GF2とLF-GF2と呼ばれる2つの新しいアプローチを構築する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:51:52 GMT)
Low-Complexity Policy Tessellations in Structured Markov Decision Processes [0.0] 構造化マルコフ決定過程における最適政治幾何について検討する。
最適ポリシーは、より単純な決定テッセルレーションを誘導する。
政策領域を直接学習する境界ベースの政策近似を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:00:16 GMT)
Long-lasting Topological Entanglement in a Monitored Rashba Nanowire [0.0] 観測されたラシュバ鎖の量子ジャンプ軌道に沿った位相特性について検討した。
このDECは, たとえ散逸が境界に作用しても, システムサイズにおいて時間線形の位相値で持続することがわかった。
この現象の理由は、粒子保存の欠如と位相多様体の退化にある。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:08:31 GMT)
Learning Interpretable Text Signals for Structured Responses [0.0] 本稿では,解釈可能なテキスト応答モデリングの初期事例としての評価予測について検討する。
本稿では,テキスト再構成と評価予測の両方から文書トピック表現を学習する,非負の行列分解と二項回帰モデルを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:08:05 GMT)
Layered Outer-Loop Control for Disturbance-Robust Multi-Waypoint UAV Arrival [0.0] 外乱破壊型UAV位置制御は、良質なシミュレーションでは容易に証明できるが、アプローチの迅速化は困難であり、目標付近でよく動作し、単一のベンチマークを超えて信頼性が高い。
本稿では,PyBullet,PX4/Gazebo,ハードウェアにまたがって,マルチウェイポイントUAV位置制御のための階層型端末制御アーキテクチャを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:58:57 GMT)
Klein--Gordon Dynamics from Intrinsic Phase Periodicity [0.0] Klein--Gordon方程式は極小局所線型ローレンツ不変場方程式として内部位相構造と整合していることが示される。
この枠組みの中では、質量は波動伝搬を管理する固有周波数尺度として機能し、相対論的運動学は完全に回復する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:07:21 GMT)
KRVF: A Source-Aware Semantic Voxel World Representation for Edge Mobile Manipulation [0.0] KRVFはエッジモバイル操作のためのソース対応セマンティックボクセル世界表現である。
KRVFは、局地的な世界国家を、占有、色、意味的証拠、時間的新鮮さ、エビデンスソースを符号化するタスク指向のボクセルとして表現している。
レポートはKRVF表現を形式化し、オンラインRGB-D観測をタスク対応ロボットメモリに変換するROS2の実装を文書化する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:07:42 GMT)
Inverse Reinforcement Learning for Interpretable Keystroke Biomarkers in Parkinson's Disease [0.0] キーストローク力学はパーキンソン病(PD)の受動デジタルバイオマーカーとして広く研究されている。
逆強化学習(IRL)をキーストロークデータに適用し、各キーストロークをタイピング速度やリカバリよりも決定的な選択としてモデル化する。
我々の知る限り、これはIRLのキーストローク力学への最初の応用である。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:11:05 GMT)
Interpretable rule-based learning in an autonomous thermodynamic network [0.0] 我々は熱力学ニューロンに基づく自律的、解釈可能な学習アーキテクチャを開発する。
我々の結果は、正確で解釈可能な学習が自律力学から生まれることを浮き彫りにしている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:00:00 GMT)
Ingredient-Level Food Image Segmentation for Nutrition Awareness [0.0] 本研究は,各画素の成分クラスを予測するFoodSeg103の成分レベルのセマンティックセマンティックセグメンテーションについて検討した。
SegFormer-B0はより小さなベースラインモデル、SegFormer-B1はより大きな最終モデルである。
2,135枚の画像で保持されたFoodSeg103では、B0は0.7709ピクセル、IoUは0.2521ピクセル、B1は0.7929ピクセル、IoUは0.3204ピクセルだった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 02:34:21 GMT)
Improving device-independent quantum key distribution protocols through multiple routed Bell tests [0.0] デバイス非依存の量子鍵分布(DI-QKD)は最小の仮定でセキュリティを提供する。
本稿では,複数のソースと計測装置に基づくDI-QKDプロトコルを提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:14:44 GMT)
Hybrid privacy-aware semantic search: SVD-truncated document geometry and CKKS-encrypted query reranking under a restricted threat model [0.0] 本研究では,静的コレクションと動的クエリの非対称性を利用した中間経路について検討する。
各ベクトルは下次元のSVD部分空間に切り替わり回転する。
我々は,保護された部分空間に閉じ込められた攻撃者の復元誤差に対して,厳密な下限を証明した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 20:50:58 GMT)
Hybrid deep learning-based phase diversity method for wavefront reconstruction [0.0] 本稿では,畳み込みニューラルネットワークを組み合わせたハイブリッド波面再構成手法を提案する。
数値シミュレーションでは、この手法は0から1.3$までの波面歪みの根平均2乗(RMS)の80%で$sim 0.99$の効率を達成した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:03:16 GMT)
How Large Language Models Source Brand Reputation Across Languages and Markets [0.0] 我々は167,551URL接地引用(合計帰属列)を分析する(9,974行)
85.7%の引用は、ブランドが所有していない場所を指し、14.3%が所有している。
ウィキペディアは12言語のうち11言語で最も暗黙のドメインである。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:04:58 GMT)
How Do Tool-Augmented LLM Agents Perform on Real-World Energy Analytics Tasks? [0.0] 実世界のエネルギー市場分析タスクにおけるツール強化LDMエージェントの実証的研究について述べる。
我々の評価環境には、市場データ検索・分析、知識検索・解釈、高度な定量的モデリング・意思決定分析の3つのカテゴリにまたがる243の専門家による問題が含まれている。
エージェントには、米国の主要ISO向けのライブ電気市場API、規制ドケット検索、ユーティリティ関税データベース、資産最適化モデル、エネルギー市場文書による検索強化世代など、一連のドメインツールが備わっている。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 19:38:21 GMT)
Higher Berry curvature, second Chern numbers and magnetoelectric coupling in crystalline insulators [0.0] より高いベリー曲率で第二チャーン数を計算することができることを示す。
第2チャーン形式とチャーン-サイモンアキション結合の接続によって動機付けられ,3次元の磁気的カップリングについて検討した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:59:57 GMT)
Gradient-based inverse lithography for EUV masks via the waveguide method and a physics-informed neural operator [0.0] 新たなフレームワークは、微分可能な導波路法と最近提案された導波路ニューラル演算子(WGNO)をエンドツーエンドの物理エンジンとして扱う。
マスクの現実的な2Dおよび3D吸収体実験により、検討されたILT法により、ウエハ上の所望のフィールドを達成できるマスク構造が得られることが示された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 12:22:48 GMT)
Governing Actions, Not Agents: Institutional Attestation as a Governance Model for Autonomous AI Systems [0.0] 人間の機関は、連続した行動の時点で独立して証明された証拠を要求することによって、強力な自律的なアクターを統治してきた。
我々は、AIエージェントシステムの計算ガバナンスモデルとして、この制度パターンを定式化する。
提案したモデルでは、エージェントは計画と推論の完全な自律性を保持するが、指定されたリスクの高い行動に対する実行権限は保持しない。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:43:00 GMT)
Generating Input Distributions for Explaining Portfolio Optimization Pipelines [0.0] 本稿では、勾配に基づくサンプル生成を用いて様々なポートフォリオモデルを解釈する予測最適化記述フレームワークを提案する。
マクロ経済学的な条件下では、予測と最適化のパイプラインは、予測と最適化のパイプラインでリターンギャップを閉じたり、逆にしたりします。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:23:19 GMT)
From spectral structure to sensing limits in quantum thermometry [0.0] 有限スピンアンサンブルや縮退原子から、収束ポテンシャル、量子ウォーク、連続スペクトル普遍性モデルまで、幅広い種類の量子系を解析する。
量子フィッシャー情報の正確なスケーリング法則を導出し、2つの異なる高温普遍性クラスを明らかにする。
我々は, 励起状態の工学的退化や, 完全に連結した位相上の量子ウォークにより, 感度を任意に向上させることができることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:08:11 GMT)
Formal Grammars in Business Process Management: A Systematic Literature Review [0.0] ビジネスプロセス管理(BPM)は、ビジネスプロセスの体系的な設計、実行、監視、改善に関するものです。
形式文法はBPMの特に実りの多い形式主義として現れ、生成的、宣言的、分析的な能力を提供しています。
本稿では,形式文法とBPMの交わりにおける34の初等研究について,体系的な文献レビューを行う。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:59:35 GMT)
Folds of one curve: the superradiant phase diagram of Dicke modes with interacting matter [0.0] 相互作用する物質に結合した1つの空洞モードを持つディックモデルの熱力学的限界について述べる。
空洞を積分すると、磁化の正確な自己連続関数が$m$, $tilde e(m) = m2/2 + e_rm mat(m)$となる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:55:04 GMT)
Financing Artificial Intelligence Infrastructure: Mapping AI Infrastructure Investment and Compute Governance Across Africa [0.0] 本稿は、2019年から2025年までの合計127億ドルのプロジェクト46件の体系的な分析を通じて、アフリカにおけるAIインフラ投資フローについて検討する。
この結果から,グローバルデータセンタ運営者,ハイパースケール技術企業,開発金融機関が中心となる,高度に集中した環境が明らかとなった。
計算ガバナンスは、地理的アクセスだけでなく、資本フロー、オーナシップ、コントロールも考慮しなければなりません。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:14:02 GMT)
FinBench: Time-Gated Calibration and Uncertainty Benchmarking for Agentic Financial Forecasting [0.0] FinBenchは、財務予測のためのキャリブレーションと不確実性の品質を評価するために設計されたベンチマークである。
本稿では,ベンチマークの仕様を記述し,パイプラインの健全性チェックとして小さなパイロット走行を報告する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:27:30 GMT)
Feedback-Coupled Memory Systems in Continuous Time [0.0] FCMSアーキテクチャにおける普遍的な構成原理として,メモリの消散がフィードバックゲインを上回っていることが示される。
これにより、離散FCMS安定性条件の42ドルとCMGPの物理的分岐しきい値の$_c = 1/K$の両方が一般化される。
N=2$エージェントによる数値シミュレーションと平均場バリデーションは、N=106$で安定しきい値と、それが破られたときに現れる自己強化調整カスケードを確認する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:03:34 GMT)
Explainable Outlier Detection for Interval-valued Data [0.0] 本稿では,シャプリー値の概念を用いて,間隔値観測のアウトライジング性を説明する新しい手法を提案する。
正方形ロバストなインターバル・マハラノビス距離のシャプリー値に対する閉形式式を導出する。
この定式化により、外れ値の微細な解釈が可能となり、間隔値の観測の中心、範囲、および横断的な部分からの貢献を詳細に分解することができる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:52:01 GMT)
Exact Leg-Cut Influence Functional and Emergence of Gaussian Entanglement Theory in a Statistical-Dressing Ladder Model [0.0] 非ガウス格子スケールの相関関係が粗粒化の下でどのように破棄されるかを示す正確な格子定式化を示す。
粗粒化下では,非ガウス格子状態が2次連続体にどのように進化するかを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:29:12 GMT)
EvoFlock: evolved inverse design of multi-agent motion [0.0] 本稿では,マルチエージェント動作モデルの自動調整手法について述べる。
所望のグループ動作は、ユーザ定義の目的(/フィット/ロス)関数で測定され、遺伝的アルゴリズムで最適化される。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 01:32:24 GMT)
Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data [0.0] 本稿では,社会科学テキスト分類の典型的な条件下で,パフォーマンス指標の信頼区間法を評価する。
シミュレーション全体において、ウォルド間隔や基本パーセンタイルブートストラップのようなデフォルトメソッドは、最も正確ではない。
Agresti-Coull、Wilson、Cropper-Pearson、および新しい擬似カウント正規化ブートストラップを使用することで精度が向上した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:24:25 GMT)
Entanglement Scaling and Problem Structure in Quantum Approximate and Adiabatic Optimization Algorithms [0.0] エンタングルメント(Entanglement)は、量子アルゴリズムのパワーと、量子上の優位性を達成する可能性の基礎となる重要なリソースである。
本稿では,近未来の量子アプリケーションにおいて,絡み合いが問題構造とアルゴリズム性能にどのように関係するかを検討する。
最適変動パラメータトレーニングは、観測された絡み合いプロファイルを著しく修正し、スケーリングの挙動を無視できることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 20:52:48 GMT)
Edges Before Embeddings: A Confidence-Aware Blur Gate for Vision-Language Pipelines [0.0] MagikaDocumentFromPixelは、1つのイメージを1つのCPUコアで約7ミリ秒でシャープ、ぼやけた、あるいは不確実なものとして分類する。
ラプラシア語で書かれた補助的な入力チャネルは、古典的なぼけが依存しているスペクトル証拠に直接アクセスする。
最後のレシピであるMobileNetV3-Large with the EPM with 384x384 at paired GoPro Large frames, evaluate with 5-scale test-time augmentation with F1 = 0.9803 (AUC 0.9989) with a 17 MB ONNX artifact。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:51:42 GMT)
ESBMC-PLC+: A Unified IEC 61131-3 Formal Verification Framework as a PLCverif Successor [0.0] ESBMC-PLC+は、単一のESBMCバックエンドを介して3つの主要なIEC 61131-3入力フォーマットをサポートする最初のオープンソース検証フレームワークである。
ESBMC-PLC+ は PLCverif の入力カバレッジと一致し、より強力な保証を提供する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 10:18:33 GMT)
Dziri Voicebot: An End-to-End Low-Resource Speech-to-Speech Conversational System for Algerian Dialect [0.0] 本稿では,アルジェリア方言のための音声合成システムを構築する際の問題点について述べる。
本稿では,音声認識,自然言語理解,検索拡張生成,音声合成を融合したモジュールパイプラインを提案する。
実験結果から,ASRの単語誤り率,NLUの高目的分類,エンティティ認識スコア,安定した音声合成品質など,すべてのコンポーネントで高い性能を示した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 16:19:31 GMT)
Do Encoders Suffice? A Systematic Comparison of Encoder and Decoder Safety Judges for LLM Adversarial Evaluation [0.0] 大規模言語モデル(LLM)の安全性評価は、一般的にLLMベースの判断に頼っている。
ユーザモデル会話において,ModernBERTやEttinを含むModernBERTファミリーの細調整されたモダンエンコーダ分類器が,有害なLCM出力を確実に識別できるかどうかを評価する。
F1スコア,偽陰性率,高精度リコール測定値を用いて絶対性能を報告する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:00:25 GMT)
Discovery of connectivity-trainability trade-off of IQP Circuits for Hamiltonian Optimization [0.0] 本報告では、ハミルトニアン最適化のためのIQP回路の性能とトレーニング性について体系的に検討する。
その結果,回路構造がIQP回路の低エネルギー状態に到達するための重要な役割を担っていることが明らかとなった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:26:08 GMT)
Designing Recommendation Exposure and Favorite Lists: A Field Experiment in a Spot-Work Platform [0.0] お気に入りリスト管理のための露出制御機構を設計する。
しきい値の許容度制御(TEC)は完全に並列化可能であり、大規模デジタルプラットフォームに適していることを示す。
都道府県レベルのランダム化フィールド実験は、アクティブテンプレート当たりの実際の一致と露出を増加させる。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 05:30:04 GMT)
Delta-Position Estimation-Based IMU Odometry: A Comparison of MLP and Kolmogorov-Arnold Networks [0.0] 学習可能なB-スプラインベースのアクティベーションは慣性オドメトリー問題における誤差蓄積を低減する可能性がある。
学習可能なB-スプラインをベースとしたアクティベーションは,慣性オドメトリー問題における誤差の蓄積を減少させる可能性が示唆された。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 06:29:09 GMT)
Cross-View Variance Correlation in Path-Traced Stereo:A Hidden Shortcut in Synthetic Training Data [0.0] パストレーシングされた合成ステレオデータは、多くの不均一推定訓練パイプラインを実現する。
基礎となる共分散場は, 地道不均等ワープに整列すると, 高い相関関係を示す。
この信号はMCレンダリングデータに特有であり、候補のsim-to-realショートカットを構成する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:13:00 GMT)
Complex frequency-dependent quadrature squeezing in semiconductor lasers [0.0] 完全量子ランゲヴィン法に基づいて, レーザー場の周波数分解スクイーズマップを計算した。
本研究は, 半導体レーザを非古典光発生プラットフォームとして確立し, 量子通信・センシングへの応用に向けた新たな視点を開拓した。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:08:26 GMT)
Collective rotational cat states of molecules in microwave cavities [0.0] マイクロ波キャビティに結合した極性分子のアンサンブルが、ハイブリッド回転光子猫状態をサポートすることを示す。
空洞は、$sqrtN$-エンハンスメントを持つ$N$分子の明るい多様体の対称ローターと結合する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:30:30 GMT)
Characterization of nested Walsh parity-check filters in a single-photon eight-mode register on a cloud photonic processor [0.0] 我々は,Quandelaのクラウドフォトニクスプロセッサに実装された2つのネストしたWalshパリティチェックフィルタを特徴付ける。
340,000以上の検出で、中立な入力は、残余のDCポートリークが0.02%$-$1.1%$であることを示している。
セクター保存のユニタリコアは、1から3つのアプリケーションに対して、非中立的な制御よりもはるかに低いリークを保持する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:54:22 GMT)
Can AI Draw Science? A Benchmark for Evaluating Scientific Figure Generation by Text-to-Image and Multimodal Models [0.0] SciDraw-Benchは、8つの図形タイプと10の分野にまたがる32の構造化された科学フィギュア生成タスクのベンチマークである。
各タスクは自然言語プロンプトと、必要なラベル、関係、コンポーネント、規約、負の制約のマシンチェック可能な仕様とをペアリングする。
ドメイン固有システムであるSciDraw AIを汎用のテキスト・ツー・イメージモデルに対して評価し、コード・ツー・フィギュア・ベースラインを計画的拡張として概説する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 14:21:01 GMT)
Beyond Feedforward Networks: Reentry Neural Systems as the Fundamental Basis of Subjecthood and Intrinsic Safety of Next-Generation AGI [0.0] 閉じた再突入ループ(D->Iサイクル)に基づく安全汎用人工知能のための完全な青写真を提案する。
有向非巡回グラフであるフィードフォワードネットワークとは対照的に,提案アーキテクチャは自己持続的増幅を伴う構造サイクルを含む。
我々は,S>0が正の積分情報を意味するというマシン検証4つの証明を,TononiのNP-hard Phiに代わる,リーン時間[O(N3)]計算可能な代替手段として提示する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 21:54:02 GMT)
Benchmarking Dark Matter Search using a Parity-Check Protocol with Machine-Learning Optimized Pulses [0.0] 超伝導トランスモン量子ビットを二重キャビティ系に分散結合する。
我々はこの検出器を、量子ビット-キャビティ結合が増大した状態で動作し、その結果、スタークシフトは4.6MHzとなる。
我々は,このプロトコルを実験的に検証し,従来の実装に匹敵する単一光子検出性能を示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:13:44 GMT)
An Approach for a Supporting Multi-LLM System for Automated Certification Based on the German IT-Grundschutz [0.0] 本稿では,MLS(MultiLarge Language Model System)を用いた半自動BSI IT-Grundschutz認証手法を提案する。
ネットワークと情報セキュリティディレクティブ2(NIS2)のディレクティブ、専門家の不足、高い実装コストの課題に直面する中、当社のMLSアーキテクチャは、効率の向上、コスト削減、認証のサポートを目標としています。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 09:16:13 GMT)
Agentic Knowledge Tracing: A Multi-Agent LLM Architecture for Stealth Assessment of Financial Literacy in Serious Games [0.0] 本稿では,多エージェント大規模言語モデルアーキテクチャであるAgentic BKTパイプラインを提案する。
このパイプラインは、OECD/INFE金融リテラシーフレームワークに沿った、2Dプラットフォームからのイベントを4フェーズで処理する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:43:59 GMT)
A fidelity metric for quantum annealing benchmarked by extreme scaling quantum Monte-Carlo simulations [0.0] 量子アニーラーは、ハミルトニアンが自明な位相と非自明な位相の間をゆっくりと補間するので、系の基底状態が断定的に従うはずである。
このアプローチは本質的に不安定であり、考慮された問題とベンチマークとして使用される古典的アルゴリズムに強く依存する。
本稿では,最終結果だけでなく,実際の量子アニールプロセス自体の品質も測定できる量を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 18:00:02 GMT)
A Unified Josephson Dynamics Perspective for Single-Cavity BECs: From Self-Trapping to Dynamical Phase Transitions [0.0] 単光共振器に強く結合した2成分のボース・アインシュタイン凝縮体について検討した。
マクロな量子自己トッピング(MQST)は、2つの内部原子エネルギーレベルの間に出現する。
これらの単一キャビティMQSTと遷移ダイナミクスは、現在最先端のコールド原子技術の下での観察に非常に有用であることを示す。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 03:47:15 GMT)
A System for Fast, Resilient, and Adaptable Loco-Manipulation Behaviors on Humanoid Robots [0.0] この論文では、ロボットがローカルで実行可能で、実行時の振る舞いのオーサリングと実行システムを提示している。
当社のシステムは,Coactive Designの原則に従って,最大で観測可能,予測可能,指示可能であることを目標としています。
私たちのシステムは、Boston DynamicsのDRC Atlas、NASAのValkyrie、IHMC、ボードウォークロボティクスのNadia、UnitreeのH1-2、IHMCのAlexなど、多くのヒューマノイドロボットにデプロイされています。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 22:30:08 GMT)
A Short Note on the Generators of Controlled Quantum Gates [0.0] 任意のマルチキュービット制御ゲートの解析生成器を提案する。
これにより、量子回路のゲートベースのシミュレーションを超えて、デコヒーレンスやその他のノイズを量子コンピュータのシミュレーションに組み込むことができます。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 13:07:55 GMT)
A Sensorised Lattice Footplate for a Semi-Active Prosthetic Foot [0.0] 本稿では,ローコストな半能動義足の荷重に適合する要素に直接磁気式プランタセンシングを組み込むことができるかどうかを考察する。
センサ付3Dプリント格子足板,サーボ調整油圧ダンパー,低次足首モデルを組み合わせた試作機を提案する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 15:35:49 GMT)
A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation [0.0] 大規模言語モデル(LLM)の脆弱性を体系的に発見するフレームワークを提案する。
我々のアプローチでは、ターゲット、攻撃者、陪審員モデルからなる新しいマルチロールアーキテクチャを採用している。
爆発的な対抗策によって攻撃の成功率は7.9%まで増加し、信頼性の弱点が明らかになった。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 07:00:53 GMT)
A Mean-Field Lindblad Master Equation Framework for Interaction-Driven Decoherence in Solid-State Qubit Ensembles [0.0] マルチキュービットシステムはスケーラブルな量子技術には不可欠であるが、その性能はキュービット・キュービット相互作用と環境ノイズの非コヒーレンスによって制限されることが多い。
そこで我々は,相互作用するマルチキュービット環境における固体量子ビットの集団およびコヒーレンスダイナミクスのための,マルチキュービット平均場Lindblad Master equation (MQMF-LME) フレームワークを開発する。
この枠組みは、1つのキュービットを利害の系として扱い、周囲のキュービットを有効浴、本質的な緩和、およびシステムと浴の間の励起伝達として扱う。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 00:49:23 GMT)
A General Framework for Learning Algebraic Properties from Cayley Graphs using Graph Neural Networks [0.0] ケイリーグラフから直接有限群の代数的性質を学習する性質に依存しないフレームワークを開発する。
我々は,可換性,虚偽性,可解性について,代表的な事例研究として考察する。
論文参考訳(メタデータ) (Wed, 24 Jun 2026 17:37:16 GMT)