Learning Physical Interaction: A Survey of Tactile- and Force-aware Robot Learning [128.8] 物理的に接地されたロボットインテリジェンスは、ロボットが物理的世界との相互作用を知覚し、推論し、規制することを要求する。
近年のロボット学習法は, 力, 触覚, 視覚, 言語, 触覚を学習操作ポリシーに組み込むことで, 大幅な進歩を遂げている。
これらの進歩にもかかわらず、既存の調査では、統一的な視点から、力と触覚を意識したロボット学習を明示的にレビューしていない。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:22:01 GMT)
Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning [80.7] 多モード物体追跡は 相補的なセンサーデータを活用することで 目覚ましい堅牢性を達成した
我々は予測ヘッドを重要ではあるが、しばしば見過ごされる効率ボトルネックとみなしている。
デコーダアーキテクチャを戦略的に合理化することで、リアルタイム推論の可能性を解き放ちます。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:41:33 GMT)
Tevatron Meets Megatron: Expert-Parallel LLM Reranker Training on an Academic Budget [72.7] 私たちはMegatron-CoreトレーニングバックエンドをTevatronに統合したTevatron 3.0を紹介します。
MegatronはFSDPのリランカ品質とトレーニング効率を同等のデータ並列設定で比較した。
その結果,MoEリランカは高密度の8B品質と一致し,パラメータの半数以下を活性化し,推論スループットを著しく向上することがわかった。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 00:55:47 GMT)
Long-Horizon Embodied Decision-Making via Multimodal Memory Compression [71.2] DunphyBenchは、長期的な人間中心の意思決定のエージェントを評価するための新しいベンチマークだ。
MeMentoは、ユーザの好みに基づいて決定関連情報を選択的に圧縮する、優先条件付きマルチモーダルメモリ圧縮機である。
MeMentoはVLM駆動エージェントの精度を7.18%向上させ、メモリ使用率を最強のベースラインに比べて85.38%削減する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:29:48 GMT)
MA-HEAD-Net: Adaptive Rule-Guided Multi-Agent DRL for AoI Minimization in UAV-Assisted Emergency Networks [71.0] 事故後のシナリオでは、無人航空機(UAV)が緊急通信ネットワークを確立する上で重要である。
本稿では,UAV支援緊急通信における情報量(AoI)の最小化について検討する。
適応型ルール誘導多エージェント深層強化学習フレームワークMA-HEAD-Netを開発した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:05:50 GMT)
SoK: Intent-Oriented Systematization of Multi-Turn LLM Jailbreaks [69.1] マルチターンジェイルブレイクはターン間で有害なインテントを前進させることでパターンを利用するため、単一のメッセージが完全な目的を公開することはない。
敵意構造を用いて多ターンジェイルブレイクを組織する4部構成の意図指向分類法を開発した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:24:08 GMT)
No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks [61.1] 複数の計算ニューロンにまたがる安全性を符号化した分散安全アライメントを提案する。
DSAは、汎用言語とマルチモーダルユーティリティを保ちながら、ホワイトボックスニューロンレベルの安全攻撃に対して大幅に改善されていることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:49:07 GMT)
SphereVideo: Prototype-anchored Hyperspherical Boundary for Continual AI-generated Video Detection [61.1] AI生成ビデオ(AIGV)検出は、実際のビデオとAI生成ビデオとを区別することを目的としている。
実際には、既存のデータに基づいて訓練された検出器は、新しい生成モデルへの一般化に失敗することが多い。
2つの重要な観測結果に基づいてAIGV検出のための新しいフレームワークであるSphereVideoを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:54:54 GMT)
When Collaboration Becomes a Trigger: Collective Evidence-Threshold Backdoors in Multi-Agent Systems [57.5] ピアエビデンスが単一のメッセージによって決定されるのではなく、隠れたしきい値に達すると、バックドアの動作が起動される。
我々は,MASとBundary-Conditioned Backdoor Injection(BCBI)のための集合的エビデンス-ホールドバックドアパラダイムを導入する。
クリーンな通信力学を学習し,異常なエージェント更新を隔離する,クリーンな唯一の潜時防御であるLATTEを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:38:44 GMT)
Remember-R1: Mitigating Long-Context Visual Forgetting through Reinforcement Learning [50.6] MLLM(Multimodal large language model)は、複雑なタスクに対する長い連鎖推論に依存している。
推論シーケンスが長引くにつれて、モデルは徐々に視覚的証拠に頼らず、蓄積されたテキストの文脈に頼り、視覚的忘れを招きかねない。
本稿では,元来の推論軌道に直接プロセスレベルの監督を適用することで,長いコンテキストの視覚的忘れを緩和する強化学習フレームワークであるResert-R1を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:31:31 GMT)
Learning Not to Optimize: Physics-Informed Action-Space Reshaping for Intent-Based Network Control [50.5] LNOQRD は小物候補を75.9% で削減し、90.8% でニアオラクルのカバレッジを維持している。
実験の結果、LNOQRDは実用性と意図の満足度が最も高く、かつ、法律違反が最低で、世代後レイテンシが低いことがわかった。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 00:27:01 GMT)
Compliance2LoRA: Personalizable On-Demand Safety Alignment on Arbitrary Policy Subsets via Hypernetwork-Generated LoRA Adapters [50.3] 大規模推論モデル(LRM)におけるトレーニング後のアライメントは、様々な安全コンプライアンス設定への適応性を著しく改善した。
下流ユーザーに対するLRMのパーソナライズが中心となるため、様々なレベルのポリシーコンプライアンスの需要が増大する。
マルチポリシーコンプライアンスのための適応型ハイパーネットワークベースのフレームワークを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:40:18 GMT)
Collaborative Memory Augmentation for Generative Recommendation [49.8] 我々は、ジェネレーティブ・リコメンデーションのためのcOllaborative MEmory拡張フレームワークであるtextbfOMEGAを提案する。
まず、学習可能なクエリトークンを用いて、逐次的ユーザ動作をコンパクトな表現に変換する潜在コンテキスト圧縮手法を提案する。
これらの圧縮された表現は、協調的なメモリバンクに集約され、グローバルな行動パターンの明示的なリポジトリとして機能する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:34:43 GMT)
Understanding Synergistic Interactions among Pathology Foundation Models via Adaptive Fusion [49.6] 病理基盤モデル(PFM)は、大規模病理画像の自己教師付き事前トレーニングを通じて、強力なタイルレベルの表現を提供する。
AdaFusionは軽量な適応型核融合フレームワークで、複数の凍結されたPFMから補完的な信号を統合する。
AdaFusionは、解釈可能な組織可視化を提供しながら、個々のPFMやその他の融合ベースラインを一貫して上回る。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:44:45 GMT)
Differentiable Lifting for Topological Neural Networks [49.2] トポロジカルニューラルネットワーク(TNN)は、グラフ上の高次構造を活用する。
DiffLiftはグラフリフトをハイパーグラフやセル・シンプリケーション・コンプレックスに学習するためのフレームワークである。
当社のアプローチでは、接続性や機能ベースのものを含め、静的リフトよりも最大45%向上しています。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:30:09 GMT)
Conformalized Large Language Models under Configuration Shift [46.5] コンフォーマル予測は不確実性定量化のための分布のないフレームワークである。
非整合性スコアは、単に固定モデルではなく、推論パイプラインによって引き起こされることが多い。
構成シフトがCPの妥当性を損なうことを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:34:41 GMT)
Stipple: Real-Time Incremental Gaussian Splatting with Visual-Inertial Tracking [45.9] 本稿では,効率的な視覚慣性追跡システムを活用することで,リアルタイムに追跡と再構築を行う新しい手法を提案する。
3DGSの重い前処理とトレーニングのステップの多くは、より効率的なインクリメンタルトレーニング戦略に置き換えられることが示されています。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:17:05 GMT)
ShiJianBench: From Dialogue to Decision for Long-Horizon Evaluation of Investment Advisors [44.5] 我々は、一致する投資家軌跡を通して対話型投資アドバイザを評価するオフラインフレームワークであるShiJianBenchを紹介する。
コアとなるのはマルチエージェントの投資家シミュレータで、明確に進化する状態変数、モチベーション駆動による熟考、長期記憶、対話ベース更新がある。
2021年から2026年にかけての中国のファンド市場に関する実験では、より強力なパーソナライズされたコンテンツと競合する投資家側の軌道結果を組み合わせた、安定したLLMアドバイザのグループが特定されている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:41:47 GMT)
Moving the Safety Barrier: Dynamic Routing Adaptive Alignment Against White-Box Attacks [43.2] 本稿では,安全経路の破損時に頑健な拒絶行動を維持するために動的補償経路を導入する枠組みを提案する。
具体的には、まず、安全な校正サンプルと安全でない校正サンプルの内的アクティベーションを対比することにより、モデルの安全経路を特定し、ローカライズする。
DRAAはこの安全経路を隠蔽し、因果的障害を誘発し、結果の防衛的障害を選択的にマイニングする。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:45:20 GMT)
RL Bootstrapping of OpenVLA-OFT for a Novel Robot Embodiment [42.0] ケーブル駆動並列ロボット上でのOpenVLA-OFTのゼロデモエボディメントアライメントアライメント(ゼロデモエボディメントアライメントアライメントアライメント)について検討する。
シュミレーション状態から計算した濃密な幾何報酬を用いたシミュレーションにおいて強化学習を用いる。
結果はまだ堅牢な操作を確立していないが、RLのみのブートストラッピングが最初の使用可能な言語条件のコントローラを作成できるという強い証拠を提供する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:33:36 GMT)
The Boy Who Cried Wolf: Adversarial Misclassification of Safe Inputs as Unsafe in Multimodal Guardrails [41.8] 我々は,不正誘導攻撃(Unsafe induction Attacks)を導入し,敵が正当性のあるユーザ要求を拒否するためにガードモデルをトリガーする,不可避の安全なイメージを配布する。
非安全セマンティック蒸留 (USD) を提案し, 敵の摂動を非安全コンテンツの分布表現と整合させる。
USDは攻撃の成功率84%を達成し、既存の手法を上回り、現在のマルチモーダル安全アーキテクチャの基本的脆弱性を明らかにしている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:49:25 GMT)
Hermite Curves as Trajectory Priors for Vision-Language-Action Models [41.5] 本稿では,Hermite trajectory priorsを導入し,チャンク軌道を終点位置と速度で定義される3次Hermite曲線としてパラメータ化する。
我々は、この固定作用素を離散自己回帰および連続生成パラダイムでインスタンス化する。
シミュレーションベンチマークと実ロボットプラットフォーム全体で、Hermite Regularizationは優れたパフォーマンスを実現している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:18:17 GMT)
RecoReward: Recommender-Guided Multimodal Description Generation for Recommendation [41.2] RecoRewardは、トレーニング中に行動由来の報酬を使用し、コンテンツのみの推論を保存する。
RecoRewardは、コンテンツのみのサービスを維持しながら、下流のレコメンデーションに役立つアイテム機能を作成するためにMLLMを訓練している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 06:00:57 GMT)
Learning What to Remember and What to Internalize in LLM Self-Evolution via Adaptive Memory-Parameter Coordination [41.0] 我々は,統合エージェントの自己進化フレームワークであるCOVEを紹介する。
これは、タスク対応ルーティング、ステージ対応スケジューリング、知識最適化を通じて、ハーネスベースとパラメータベースの学習を組み合わせる。
COVEは単一チャネルの進化戦略より優れており、環境の変化によるより堅牢で効率的な改善を実証している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:39:01 GMT)
VaRS-Doc: Interpretation-Aware Variant Representations via Latent Self-Probing for Visual Document Retrieval [40.4] 本稿では,文書表現の多様化を図るビジュアル文書検索フレームワークである VaRS-Doc を提案する。
VaRS-Docは、クエリに依存しないドキュメントエンコーディングとクエリ固有の検索ニーズのミスマッチに対する実用的な解決策を提供する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:55:57 GMT)
TurboClear: One-Step Object-Effect Removal via Region-Calibrated Distribution Matching and Fusion [40.2] SDXLに基づくオブジェクト効果除去モデルであるTurboClearを提案する。
トレーニング中,教師モデルの非対称な編集保存行動を保存するため,地域対応蒸留のための地域校正型分布マッチング(RDM)を設計した。
実験により、TurboClearは、競合する視覚的品質を維持しながら、推論効率を大幅に改善することが示された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:56:13 GMT)
Hybrid Lagrangian-Eulerian Model for Lagrangian Fluid Simulation [39.8] 純粋なラグランジュ型神経シミュレータは、幾何学的柔軟性と正確な対流を提供する。
固定されたグローバル参照フレームが存在しないことは、2つの厳しい制限をもたらす。
本稿では,ラグランジアン力学をユーレリア表現で拡張するハイブリッドラグランジアン・ユーレリアニューラルシミュレータを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:36:08 GMT)
Training nGPT [37.8] 正規化変換器(nGPT)は超球面表現学習を実現する。
我々は,nGPTの実践的なトレーニングレシピを記述し,最新のハイブリッドMamba-2--Transformer Mixture-of-Experts (MoE)モデルで評価する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:47:39 GMT)
Algorithm-driven Development: A Proactive Approach to Improving Software Quality and Reducing Defects [35.2] 本稿では,アルゴリズム駆動開発(ADD)を導入し,要求を信頼性,テスト性,メンテナンス性のあるソフトウェア動作に変換する上で,繰り返し発生する課題に対処する。
ADDは要求をアルゴリズムのフローチャートに変換し、そこから受け入れテストが体系的に導出される。
このアプローチはダッソー・シストムの工業プロジェクトの中で4年間にわたって評価された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 22:58:00 GMT)
ReACT-CLIP: Response-Aware Test-Time Defense for Vision--Language Models [34.9] ReACT-CLIPは、各入力がどの程度強く修正されるべきか、防御介入が必要かを決定するテストタイムディフェンスである。
多様な攻撃タイプや強みにまたがって、相当な堅牢性向上を実現しますが、大部分はクリーンな正確さを保っています。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:06:45 GMT)
Rapid Embodiment Adaptation for Quadrupedal Locomotion [34.6] 人間は身体が老朽化、怪我、荷物を運ぶことで容易に動きを変えるが、ハードウェア特性が変化すると、学習ベースのロボットポリシーは壊れることが多い。
短時間の相互作用履歴から実施パラメータを推定する四足歩行のためのオンライン実施適応フレームワークを提案する。
本手法は,半秒以内の物理的変化を識別する軽量適応モジュールと,具体的ランダム化の下で訓練されたジェネラリストポリシーを組み合わせたものである。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 21:31:49 GMT)
DynamicManip: Enabling Dynamic Manipulation from a Single Static Demonstration [34.4] 高速なデータ拡張パイプラインと低レイテンシな模倣ポリシを通じて,課題に対処するDynamicManipを提案する。
動的操作タスクにおいて、DynamicManipは、平均成功率18.4ポイント以上のパフォーマンスを実現していることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:23:54 GMT)
Location-Aware Fine-Grained Representation Learning for Medical Vision Foundation Models [33.3] 位置認識表現学習に基づく医用視覚基礎モデルであるLoFiを提案する。
我々は4.48M画像テキストボックス三重項からなる大規模医療基盤データセットであるMedGを構築した。
LoFiは、汎用および医療ビジョンの基礎モデルと最先端のLVLMを一貫して上回っている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:59:07 GMT)
DreamTrajectory: Trajectory-Guided Action Generation with World Model Alignment for Mobile Manipulation [33.0] 本稿では,DreamTrajectoryについて述べる。
MS-HABでは、軌道誘導は平均的な成功率を32.3%から47.5%に引き上げ、テストタイムの改善を54.8%に引き上げている。
3つの実世界のモバイル操作タスクにおいて、対応する平均成功率は63.3%、81.7%、90.0%である。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:02:48 GMT)
A Benchmark Dataset for MLLM-Generated Image Detection: GPT Image2 & Nano Banana2 [32.0] 近年,マルチモーダル大言語モデル(MLLM)による画像のリアリズムが急速に向上している。
現在のMLLMの生成能力の強化は、AI生成画像検出にますます深刻な課題をもたらす。
本稿では,MLLMが生成した画像を検出するためのベンチマークデータセットを構築する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:09:17 GMT)
PixVL: Self-Supervised Training of Pixel-Level MLLMs via a Unified Mask--Text Consistency Cycle [31.2] PixVLは、ピクセルレベルのマルチモーダルな大規模言語モデルのための自己教師付きポストトレーニングフレームワークである。
地域記述を生成し、自己検証し、ラベルのないデータから学習する。
実験によりPixVLは領域理解とセグメンテーションの両方を改善することが示された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:13:52 GMT)
Harnessing Adversarial Distillation to Customise Debiased, Disease-Specific Pathology Foundation Models for Breast Cancer [30.8] SmartStuは、乳がん特異的PFMを蒸留によりカスタマイズするフレームワークである。
SmartStuは、複数の教師のPFMの表現を軽量の学生バックボーンに置き換える。
我々はSmartStuを、複数の小さなバックボーンを持つ3つの外部コホート(Breast HER2, SLN-Yale, BRACS)で検証した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:19:16 GMT)
EviSD: Evidence-Conditioned Self-Distillation for Search-Augmented Agents [29.0] 我々はエビデンス条件の自己蒸留フレームワークであるEviSDを提案する。
検索アクションや黄金の回答のための特権情報として、インスタンスレベルのサポートエビデンスを使用している。
EviSDは、評価されたすべての設定において、マクロ平均のExact Matchを最高に達成する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:22:27 GMT)
SAFE-Merge: Data-Free Continual Model Merging with General Knowledge Preservation [28.4] 既存の手法は主に下流タスク間の干渉を抑制することでタスク更新をマージする。
単純なデータフリー連続マージフレームワークであるSAFE-Mergeを提案する。
どのパラメータ更新が安全に保持されているかを判断し、マスキングによって失われたタスク情報を復元する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:09:37 GMT)
SPAE: Spectrally Guided Autoencoder for Pretrained Visual Latents [28.1] 視覚基盤モデル(VFM)の潜伏者は意味的に豊かであり、視覚的理解に適している。
RAEのような最近の表現オートエンコーダ法は、画像生成に有望な潜在空間を提供できることを示した。
生成のための潜在適応フレームワークであるSPAEを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:20:55 GMT)
CRAFTS: Collaborative Role-Adaptive Fine-Tuning of LLM Agents for Chemical Process Simulation [27.9] CRAFTSは、シミュレーションビルディングを有界なサブタスクに分解することで、化学工学者の段階的なワークフローを反映する。
微調整は、スキーマクリティカルな3つの視覚、トポロジ、および仕様の役割に適用される。
結果として得られるVisualGraphIR、TopologyIR、SpecIR、BuildPlan、SolveReportは、ユニット、ポート、熱力学、数値、実行の決定を公開する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:42:47 GMT)
PATH-Bench: Path-Dependent Evaluation of Lifelong Agents [27.8] PATH-Benchは、生涯エージェントのパス依存評価のためのベンチマークである。
SEU(Selective Experience Use)は,経路蓄積経験が各タスクにどのように影響するかを制御するエージェントハーネスである。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:00:04 GMT)
ACE-GraphRAG: Agentic Context Engineering for Hierarchical GraphRAG [27.7] 階層グラフRAG(ACE-GraphRAG)のためのエージェントコンテキストエンジニアリングを提案する。
ACE-GraphRAGは、ギャップ認識の洗練、検索分岐、タスク条件適応に関するポリシーとしてコンテキスト構築を定式化する。
Full-ACEはタスクファミリーごとに一様に適用するが、Adaptive-ACEは個々のクエリに対してタスク固有のポリシーとトポロジー固有のポリシーを選択する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:22:31 GMT)
Stress-Relief Annealing: Polynomial-Time Simulation-Free Layout Optimization for Automated Warehouses [27.4] 自動倉庫における物理的レイアウトの問題について検討し,数千から数千のロボットがパッケージを輸送するために調整されている。
本稿では,時間シミュレーションのないレイアウト最適化アルゴリズムであるSRAを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:59:24 GMT)
Caliber: Cross-Architecture Extraction-Cost Control for Score-Returning APIs [27.2] Caliberは、キャリブレーション問題としてノイズ選択を定式化するモデル抽出に対する防御である。
知識蒸留に返却されたスコアを使用する攻撃者に対して、Caliberは独立して同一に分散したガウスノイズを内部ロジットに追加する。
Caliberは、正方形中央2対数辺による雑音分散を正規化し、その結果の雑音効用関係をロジスティック曲線に適合させる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:58:00 GMT)
Complete Existence Classification of Seven-Partite Absolutely Maximally Entangled States [27.2] 局所次元が$dgeq 3$を満たすときのみ、7つのクォーディットの絶対極大絡み合う状態が存在する。
textAME(7,2)$状態は存在しないが、すべての$dgeq 3$の存在を確立し続けている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:26:34 GMT)
Look Up and Look Back: Hidden Attention and Latent Orientation in a Frozen Foundation Model for Panoramic SLAM [26.9] 単眼パノラマSLAMは、大きなカメラ回転の下でかなりの視覚的オーバーラップの恩恵を受けるが、カメラの傾き、スケールドリフト、偽ループ閉鎖によるエラーが生じる傾向にある。
凍結したパノラマ幾何学基礎モデルが、その明示的な幾何学的出力を超えて有用な内部手がかりを提供することを示す。
重力読み出しは、IMUのない球状直立正準化を可能にする。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 01:33:01 GMT)
Unified Multi-Dimensional Benchmark for Complex Graph Reasoning in Large Language Models [26.3] グラフ推論は、大きな言語モデル(LLM)の推論能力を評価するための有望なテストベッドを提供する。
既存のグラフ推論ベンチマークは、データ複雑さのカバー範囲が限られており、手作業による構築に大きく依存している。
複雑なグラフ推論ベンチマークを構築するための5段階のフレームワークを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 22:02:04 GMT)
Practical Online KV Cache Compaction for LLM Agents: An Empirical Study [26.2] LLMエージェントは、推論ステップ、ツールコール、環境フィードバックの長い軌跡を蓄積し、KVキャッシュを主要な推論ボトルネックにする。
KVキャッシュの圧縮は、このコストを削減できるが、以前のほとんどのメソッドは、将来のクエリが知られているか、オフラインで近似できる静的コンテキストを前提としている。
トークン消去(TE)とアテンションマッチング(AM)によるオンライン圧縮について検討する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 00:08:44 GMT)
From Patches to Evidence Balls: Class-Conditioned Evidence Retrieval for Few-Shot Whole Slide Image Classification [25.1] EviBallは、いくつかのWSI分類のためのクラス条件付きエビデンス検索フレームワークである。
セマンティック空間割り当てとセンターリファインメントを通じて、ローカルパッチをエビデンスボールに整理する。
EviBallは、様々な数ショット設定の下で、従来のMILベースラインとビジョン言語ベースラインを一貫して上回る。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:06:22 GMT)
AeroDPO: Unleashing Lightweight UAV Navigation with High-Fidelity Perception and Automated Preference Optimization [25.1] UAV-VLN (Vision-Language Navigation for Unmanned Aerial Vehicles) は複雑な3D環境において高速かつ反応性の制御を必要とする。
最近の最小限のエンドツーエンドのパラダイムは、数十億のパラメータを含む巨大な言語モデルに依存しており、現実のエッジデプロイメントでは違法なレイテンシが発生している。
高忠実度視覚入力を備えた軽量な2Bモデルが,大規模な7Bベースラインの成功率と完全に一致していることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:32:09 GMT)
QuerySplat: Decoupling Geometry and Appearance Representations in 3DGS Prediction [25.1] textbfQuerySplatは、幾何学的先行と明示的な外見の疎結合によって駆動されるフィードフォワード3DGSフレームワークである。
実験によると、QuerySplatは初期のクエリベースのモデルの曖昧なレンダリング問題を緩和する。
挑戦的なDL3DVベンチマークでは、ポーズフリーでポーズ要求のベースラインよりも平均2.30dBと1.04dBのPSNRゲインを持つ最先端の新規ビュー合成性能を達成している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:12:02 GMT)
LongChart VQA: A Comprehensive Benchmark for MLLMs with Complex Multi-Chart Reasoning [25.0] マルチモーダルな大言語モデル(MLLM)は、拡張されたコンテキストウィンドウとより強力な推論機能によって急速に進化している。
既存のベンチマークはシングルチャートの知覚に重点を置いているが、単純なチャートとチャートの接続はこれらの能力を評価するには不十分である。
VQAセットに平均6.5のイメージと31.2の質問を含むベンチマークであるLongChartを紹介する。
10種類の最先端MLLMを評価し,解析パターン,補助ツール,画像摂動に対する頑健さの3つの要因について検討した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:48:04 GMT)
Toward Fine-Grained Forgetting:Attribute Unlearning for Multimodal Large Language Models [24.8] マシンアンラーニングは、汎用性を維持しながら、スクラッチからリトレーニングすることなく、指定された知識を除去しようとする。
既存のプライバシ指向のベンチマークでは、主にプロファイルレベルの削除が採用されているが、実用的な要求はよりきめ細かいものが多い。
属性レベルのMLLMアンラーニングをよりきめ細かなタスクとして導入し、長文、数値、短文ターゲット、複数忘れ率、多様な質問タイプにまたがるベンチマークを構築した。
評価の結果,対象属性と保持属性が識別特異性および視覚的証拠を共有していることが判明した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:23:44 GMT)
MasDrift: Benchmarking Authorization Preservation Across Multi-Agent Architectures [23.9] MasDriftは8つのドメインにまたがる600の生産性タスクのベンチマークである。
MasDriftは、階層の深さとピア幅を変えながら、単一エージェント、集中型、分散化されたコーディネーションを比較する。
我々は,認証証拠の在り処で異なる2つの防衛措置を比較した。一方は,元のユーザ要求に待ち受けている毎回再審理を行い,もう一方はデリゲートチェーンに沿って緩和された政策を実行する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:46:15 GMT)
OmniScope: Modality-Decoupled Token Compression for Omnimodal Large Language Models [23.8] 音声とビデオの関連性を別々に推定しながら,クエリを共有意味アンカーとして使用する,トレーニング不要なトークン圧縮フレームワークを提案する。
4つのオーディオビデオベンチマークと2つのQwen2.5-Omniモデルスケールで、OmniScopeはすべての圧縮設定で最高の平均精度を達成する。
これらの結果は、OmniLLM推論の単純な設計原則を示唆している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:37:40 GMT)
Distill What the Student Can See: Fisher-Projected On-Policy Distillation for Vision-Language Models [23.4] オンライン蒸留(OPD)は、現在の学生政策の軌跡をサンプリングし、学生と教師の次点分布のトークンレベルのばらつきを最小限にする。
本稿では,ローカルで実現可能な教師の訂正のみを蒸留するemphFisher-Projected On-Policy Distillation (FP-OPD)を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:16:14 GMT)
FL-OA: A Byzantine-Robust Federated Learning Framework with Outsourced Auditing for Intelligent Devices [23.0] フェデレートラーニング(FL)は、複数のインテリジェントデバイスが、生データを共有することなく、協調的に高精度モデルをトレーニングすることを可能にする。
その分散した性質のため、FLはビザンツの攻撃に対して脆弱である。
アウトソース監査を利用したビザンチン・ロバスト・フェデレーション学習フレームワークFL-OAを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:50:52 GMT)
Cluster-Aware Over-the-Air Federated Learning with Energy-Harvesting Devices: From Global Training to Model Personalization [22.4] ヘテロジニアスデータ分布下でのエネルギ収穫MDを用いたオーバー・ザ・エア(OTA)FLについて検討した。
統合フレームワークにおける2つの密接な学習目標について検討する。
グローバルトレーニングモードでは、クラスタ情報はエネルギーと多様性を意識したスケジューリングをガイドする。
パーソナライズモードでは、同じクラスタ構造がクラスタレベルの学習目標とリカバリターゲットを定義している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:15:49 GMT)
402Pilot: An x402 Decision Layer for Autonomous Agent Micropayments [21.6] 本稿では,自律エージェントと支払い実行の間のプロトコルに依存しない買い手側決定層である402Pilotを提案する。
我々は、PPA-DCTという、支払いを意識した文脈型Thompson-Samplingポリシーでインスタンス化する。
Pa-DCTは、非オラクル政策の中で最強の固定壁適応トレードオフを達成する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:04:57 GMT)
DeltaFlow: Noise-Adaptive Bidirectional Gated Delta Networks for Embedded Language Flows [21.5] 本稿では,雑音適応型双方向GDNバックボーンであるDeltaFlowを紹介した。
層間のスキャン方向を交互に行うDeltaFlow-Aと,各層内で並列に前方・後方スキャンを行うDeltaFlow-Pの2種類について検討した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:48:40 GMT)
Reusing Rollouts under Policy Lag: Prefix-Normalized Policy Optimization for LLM Reinforcement Learning [21.4] 自己回帰的なロールアウト生成は、強化学習における大きな計算コストである。
PNPOは累積比を、各因果接頭辞に沿った確率比の平均に置き換える。
PNPOは1つのエポックでGSPOを一貫して上回るわけではない。
4エポックのPNPOは150回のロールアウトの後に49.66のAvg@32に到達し、1エポックの600回の後に到達した49.56に匹敵する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:02:03 GMT)
FactorJEPA: Factorizing Monolithic Futures into Layout-Agent-Interaction Channels for Crowded and Chaotic Global South Urban Worlds [20.9] 我々は、人口が多く、混雑し、混乱したグローバル・サウスの都市環境について、ほとんど調査されていない体制について研究している。
既存の評価に支配的な低密度、車線構造の設定とは異なり、これらのシーンは柔らかい空間境界を示す。
私たちはこの体制のための最初の大規模なデータセットを紹介します。ドライブスルー、ウォークスルー、および22都市にわたる空中ビデオの1,000時間です。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 07:32:46 GMT)
FreqNav: Stage-Wise Frequency Routing for Object-Oriented Aerial Vision-Language Navigation [20.6] 長距離航法のための軽量適応認識フレームワークを提案する。
FreqNavは、現在のナビゲーションステージに従って、周波数コンポーネント間で視覚トークンを動的に再配置する。
実験によると、FreqNavは強いベースラインを上回り、およそ3倍高速な推論を実現している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:49:54 GMT)
High-Stakes Decisions with Language Models: Insights from Emergency Triage [20.6] 本稿では,言語モデルを用いた緊急トリアージが確率的決定枠組み内で理解可能であることを示す。
有能な言語モデルでは、記述されたユーティリティに応じてレコメンデーションを調整することができる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:25:08 GMT)
GenTrack: Physical Alignment for Robot-Native Motion Generation and Zero-Shot Humanoid Tracking [20.4] 汎用ヒューマノイドトラッカーは多様な参照を実行することができるが、そのゼロショットカバレッジは、拡張するのにコストがかかる大きなエンボディコーパスに依存している。
我々は、オンラインジェネレータ-トラッカーフレームワークであるGenTrackを紹介し、新たに生成された参照に対するトラッカートレーニングと実行ベースでグループ関係のジェネレータアライメントを交換する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:44:19 GMT)
Expressive Power and Limitations of Multi-photon Quantum Neural Networks [19.3] 多光子量子ニューラルネットワーク(MPQNN)は、光子数を増やすことで表現性を高める可能性がある。
本研究は,QNNにおける多光子量子機能の性能向上と,その限界を明らかにするものである。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:31:28 GMT)
SG-Layout: Structured Scene Graph-Guided Layout Generation with LLMs [19.3] 構造化空間知識を大規模言語モデル(LLM)に明示的に組み込んだグラフ誘導レイアウト生成フレームワークSG-を提案する。
実験により,SG-はコンパクトなオープンソースバックボーンよりも幾何的精度,一貫性,推論を向上させることが示された。
その結果, レイアウト生成の制御性を高めるため, グラフ構造化機能アライメントの有効性が示された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:11:38 GMT)
MADE: Belief-Driven Dual-Agent Coordination for Autonomous Model Deployment [19.1] LLMベースのエージェントはドメイン固有のタスクに苦労し、外部ツールの統合を動機付けている。
オープンソースコミュニティは、典型的に異質な研究成果物としてリリースされる多数のAIモデルを提供している。
これらをプリ・ツー・コールのAPIに変換するのは費用がかかり、労力がかかる。
本稿では,デュアルエージェント協調システムであるModel Automated Deployment Engine (MADE)を紹介する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:14:43 GMT)
Struct-GStream: Towards Efficient Free-Viewpoint Video Streaming at Low-Bitrates with Structured 3D Gaussians [18.9] ニューラルレンダリングに基づく手法は、FVV(Free-Viewpoint Videos)構築において高忠実度画像品質を実現する。
構造化3次元ガウス(3DG)を用いた高速FVVストリーミングを実現するStruct-GStreamを提案する。
本手法は,高いレンダリング品質を維持しつつ,低速度で高速なトレーニングを実現する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 07:41:40 GMT)
One Query, Many Scales: Sparse Mixture-of-Experts for Efficient Hierarchical Cross-View Geo-Localization [18.6] クロスビュージオローカライゼーションは、地上ビュークエリのためにジオタグ付き衛星画像を取得する。
局所階層探索からグローバルなマルチスケール表現学習を分離する,スパース・オブ・サーキットのデュアルエンコーダであるGeoMoEを紹介する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 07:53:17 GMT)
GaussianSelector: Lightweight Human-Guided Object Selection in 3D Gaussian Splatting with Graph Optimization [18.4] GaussianSelectorは、スパースビューとスクリブルガイダンスからインタラクティブな3Dオブジェクト選択のための、トレーニング不要のフレームワークである。
最先端の多視点SAMベースの手法と競合する選択品質を実現する。
実環境における3Dシーン編集と3Dアセット抽出に適している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:51:09 GMT)
FineMoLA: Towards Fine-Grained Motion-Language Alignment from Clip-Level Supervision [18.3] FineMoLAは、クリップレベルのアノテーションから直接、きめ細かいフレーム-フレーズ対応を学習する弱い教師付きフレームワークである。
提案手法は,まず長文記述をアクションを含むフレーズに分割し,次に動き言語アライメントを定式化する。
SnapMoGenの実験では、学習されたアライメントは、テキストのグラウンドニングにおいてベースラインを上回っている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:16:25 GMT)
PeCA: Palette Context Assisted Inference for Test-Time Paint-Bucket Colourisation on Animation Videos [17.9] Palette Context Assisted (PeCA)は、アニメーションビデオのカラー化のための新しいトレーニング不要のプラグイン・アンド・プレイフレームワークである。
PeCAは、空間的および時間的文脈に関する推論を通じて、テスト時にこのギャップを埋めることを目指している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 00:15:25 GMT)
Using Lower-Bound Representations for Trajectory Similarity Learning [17.8] 軌道類似性学習は、複雑な距離測定の下での効率的な軌道探索の基礎となる。
深部神経埋め込みに依存しない統一下界表現フレームワークであるLB-TrajRepを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 06:53:49 GMT)
Recursive Vision Language Models for General Symbolic Reasoning [17.8] Sudoku、maze pathfinding、ARCといったシンボリック推論タスクは、LSMにとって依然として困難な課題である。
トレーニング済みのQwenバックボーン上に構築されたフレームワークであるR-Qwenを提案する。
R-Qwenはプログラムによる自己再帰と深い監督を通じて、候補解を何度も洗練する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 23:01:10 GMT)
dots.tts.edit: Precisely Controlled Speech Editing with a Continuous Autoregressive Model [17.6] 本稿では,XMLスタイルのタグを用いた音声編集のための,正確で明示的なインタフェースについて検討する。
dots.tts.editは継続的自己回帰型dots.tts基盤モデルから適応したエディタである。
doteBenchはバイリンガル・アセスメント・スイートで, 正確な指示の追従, 局所保存, 音質を計測する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:03:37 GMT)
FinHardBench: Can LLMs Generate Latency-Aware Hardware for Financial Computing? [17.3] FinHardBenchは、33の金融コンピューティングタスクのベンチマークである。
本稿では,5-10ナノ秒のレイテンシが競合優位性を決定する金融FPGA設計の課題について検討する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 00:30:13 GMT)
Interpretable Unsupervised Community Detection with LLM-Symbolized Structured Processes [17.3] LUCIDは、大規模言語モデル誘導型、解釈可能、トレーニング不要、教師なしのコミュニティ検出方法である。
LLMは暗黙の知識を明示的で解釈可能な論理構造に翻訳する形式規則を誘導する。
実世界のデータセットの実験では、LUCIDは教師なしのアプローチとして、最先端のパフォーマンスを実現している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:30:00 GMT)
EDATracer: An Agentic Framework for Large-Scale EDA Artifact Analysis [17.3] EDAツールは、ソースファイル、スクリプト、ログ、ネットリスト、レポートを含む、大きく異質なアーティファクトを生成する。
本稿では,エビデンス基底EDAアーティファクト分析のためのエージェントフレームワークECATracerを提案する。
ECATracerは設計成果物をセマンティックベクトルインデックスと組み合わせた知識グラフに整理し、エージェントがソースファイル、ログ、ネットリスト、レポートのエビデンスを検索できるようにする。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:06:12 GMT)
Training Small LLMs as Spatial Multi-Agent Policies [17.3] 空間的協調ゲームでは両スレッドを取り上げ、小さな凍結LDMは低レベル動作で失敗し、報酬はゼロとなる。
我々は,各ゲームに,記号プランナーによって実行される,型付けされた,状態対応可能な,短期水平動作という,象徴的な入力のライブラリを装備する。
各エージェントのLCMはオプションに対するポリシーとして機能し、エージェントごとのLORAアダプタはマルチエージェントGRPOのエージェントごとの変種によって訓練される。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:14:40 GMT)
TARS: Timestep-Aware Data Scaling for 3D-Free Video Re-Shooting [17.2] ビデオの再撮影は、コントロール可能なカメラモーションと視点でビデオを再生することを目的としている。
TARSは従来の方法よりも正確で時間的に一貫したカメラ制御を提供する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:44:50 GMT)
TrajWiki: Source-Grounded Memory Trajectories for Long-Horizon Dialogue Agents [17.0] 本稿では,長期会話エージェントのためのトラジェクトリベースのメモリフレームワークであるTrajWikiを提案する。
メモリを静的エントリとして扱う代わりに、TrajWikiは各メモリをソース基底の進化軌道として表現する。
TrajWikiはさらに、永続的な中間層であるMemory Wikiを導入し、対話履歴を構造化および相互リンクされたwikiページにインクリメンタルにコンパイルする。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:36:03 GMT)
G-ReAct: Graph-Guided Deep Search via Structure-State Co-Evolution [16.8] $textbfG-ReActはディープ検索のための推論フレームワークである。
それは、固定トポロジークエリグラフ上の$textbfstateの進化として推論を整理する。
G-ReActはトレーニングと推論の両方をサポートしている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:43:37 GMT)
FeDepth: Federated Learning for Depth Estimation under Robot Heterogeneity [16.7] フェデレートラーニング(FL)は、生のデータ転送なしで分散トレーニングを可能にする代替手段を提供する。
FLは、クライアント間の不均一性によって引き起こされるドメインシフトの下で、深刻なパフォーマンス劣化に悩まされる。
ソフトクラスタリングによるクライアント関係をモデル化するディスクリプタベースのクラスタリングFLフレームワークFeDepthを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:11:05 GMT)
Rolling Shutter Camera Self-Calibration [16.7] ローリングシャッター (RS) カメラはコンシューマーデバイスで広く使われているが、ローリングシャッターの露光は動きの歪みを引き起こす。
既存のRSキャリブレーション手法はキャリブレーションターゲットや特別なハードウェアに依存しており、制約のない設定での使用を制限する。
本稿では,カメラの内在性を直接推定し,画像列から読み出し時間比を推定する,RSカメラの最初の自己校正手法を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 21:43:46 GMT)
PROGRESS: Coverage-guided RL to Train Search-augmented LLM Agent [16.6] 既存のLLMエージェントは強化学習を使用して学習し、推論能力を向上させる。
本稿では,教師が指導するカバレッジ報酬を利用して,分解されたクエリ生成を明示的に形作るPROGRESSを提案する。
このアプローチはR1スタイルのトレーニングフレームワークに統合され、クエリの分解決定に関する軽量なガイダンスを提供します。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:48:41 GMT)
VGER: Voxel-Guided Global Event Ranking for Event Cloud Attribution [16.5] Voxel-Guided Global Event Ranking (VGER)は、ポイントベースのイベントクラウドネットワークのためのトレーニング不要の属性フレームワークである。
VGERは、イベントレベルの勾配証拠とタスク対応の時間的証拠を組み合わせることで、地域貢献をイベントレベルの属性スコアに転送する。
我々は、PointNet、PointNet++、EventMambaの3つのイベントベースのベンチマークでVGERを評価した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:07:28 GMT)
Compiler Framework for 3D Neutral-Atom Quantum Computers [15.8] Piqassoは、ストレージ、絡み合い、読み出しを異なるレイヤに積み重ねることで、垂直軸を利用するコンパイラである。
34の回路では、ピカソは最先端の平面コンパイラ上で原子輸送距離を2.1$times$に削減する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:34:47 GMT)
Can Humans Dream of Electric Sheep? Human-Written Samples for Fine-Grained Vision-and-Language Hallucination Benchmarking [15.7] 4言語(中国語、英語、フランス語、イタリア語)と5つの視覚・言語モデルの18,400のサンプルからなる1,600の人文サンプルのデータセットを構築した。
人手によるサンプルは,一致度が高く,データセットの内容のより深い制御が可能であることが判明した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:57:46 GMT)
DynActiveGS: Active Gaussian Splatting for Dynamic Scene Reconstruction [15.5] 3次元ガウススプレイティングに基づく動的対応型アクティブ再構築フレームワークDynActiveGS(3DGS)を提案する。
この枠組みは3次元ガウスのシーン表現を漸進的に再構成し, 動作不良の観測を抑える。
DynActiveGSの重要な構成要素は、構造的不確かさと運動によって引き起こされる不確実性への明確な不確実性分解である。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:57:49 GMT)
CT-PrepAgent: Bounded Policy and Controlled Execution for Adaptive CT Data Preparation [15.5] 既存のアプローチは、手動設計またはデータセット固有のルールに依存している。
本稿では,境界ポリシと制御決定性実行による適応的CTデータ作成を可能にするCT-PrepAgentを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:38:41 GMT)
Fused Bayesian Flow Networks for Dual-Target Molecular Design [15.5] デュアルターゲットドラッグの設計は、2つの標的タンパク質と同時に相互作用できる3D分子を生成することを目的としている。
二重ターゲット分子設計のための融合ベイズフローネットワーク(BFN)であるFusedBFNを提案する。
本研究では,FusedBFNが分子特性を維持しつつ,二重ターゲットに対して強い結合親和性を持つ分子を生成することを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:23:26 GMT)
Credit the Right Box: Marginal Contribution Assignment for Structured Visual Perception [14.9] Marginal Contribution Reward (MCR) は、各予測ボックスのコントリビューションを、アウトアウト比較によって推定する。
Continuous Matched Set Value Evaluatorは、置換不変マッチング、カウントアウェア正規化、グレードローカライゼーションを統合している。
REC、DOD、セグメンテーション、カウントベンチマークにわたる実験は、以前のGRPOベースのベースラインよりも最先端のパフォーマンスを示している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 07:43:09 GMT)
Auditing Discovery Claims: A Two-Sided Criterion for Agentic Science, with the Negative Side Decidable [14.9] 一つの誤りの少ないオラクルがいかに能力の主張を膨らませるかを示す。
エージェント書きのプロシージャは、裁判官の下で人間書きのプロシージャを倒すことができるが、客観的な操作はできない。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:15:12 GMT)
HopRefusalBench: Diagnosing Refusal Failures in Search-Augmented Agents for Multi-Hop Reasoning [14.5] マルチホップ検索における拒絶の最初のベンチマークであるHopRefusalBenchを紹介する。
根、中、終端位相の3つの解答不可能な原因を横切る。
本稿では,目標認識の拒絶,疑似拒絶,幻覚的完了,探索予算の枯渇にまたがる最終アウトカム分類を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:20:55 GMT)
Position: AI Agents in Scientific Teams Should Be Studied as Human-Agent Systems [14.4] 我々は、AIサイエンティストを人間エージェントシステム(HAS)として研究することは、ともに過小評価され、過小評価されていると論じる。
科学者とエージェントがお互いの能力を増強できることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:27:36 GMT)
PlantRig - From Bones to Branches: Adaptation of Autoregressive Rigging Models for Plant Skeletal Reconstruction [14.2] UniRig や SkinTokens のような自己回帰リギングモデルは、明瞭な文字でうまく機能するが、植物構造に一般化する能力はほとんど探索されていない。
人工L系統樹と, 単足類, 共生類, 交尾類, 交尾類, およびブドウ様の古型にまたがる実スキャンデータを用いて, 植物骨格再構築のためのこれらのモデルの評価を行った。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:13:51 GMT)
Optimal Strategies for Multi-parameter Quantum Metrology [13.9] 複数の未知パラメータを同時に推定することは、実用的な量子センシングに不可欠である。
我々は、プローブ状態、制御操作、測定を協調的に最適化する汎用的で効率的な計算フレームワークを開発する。
我々の研究は、基本的な精度の限界を決定し、最適な量子センシングプロトコルを設計するための汎用的な計算ツールを確立する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:21:02 GMT)
Attend to Your Own Thoughts: Breaking the Barrier for Post-Training Quantization of Reasoning LLMs through the Lens of 1.58-Bit Quantization [13.9] LLMを推論するためのスケーラブルな3次学習後量子化フレームワークであるScaleQ-1.58を提案する。
AYOTとCAT-Qを統合することで、いくつかのスケーリング特性を示す。
密度とMoEの両方のアーキテクチャを一般化し、モデルスケールの増加に伴ってパフォーマンスが向上する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:22:43 GMT)
Language Equality has a Price: A Systematic Investigation of Multi-turn LLM Performance for EU-24+ [13.9] すべての公用語において、両方の商用システムはすべてのオープンウェイトモデルを上回っ、最も弱い2つはEU-24全体で40ポイント以下である。
中国語は2つの中国製モデルで30言語中最強だが、どのモデルでも最高の中国語スコアは米国の商用システムに属する。
非英語の中央値は英語より31%高く、スコアは10%低い。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:20:01 GMT)
Policy Optimality Measurement for Multi-Vehicle Decision-Making: From Extrinsic Indicators to Intrinsic Quality [13.9] 本稿では,自律運転政策を評価するための新しい情報理論診断フレームワークを提案する。
完全に収束したモンテカルロ木探索 (MCTS) をオラクルとして活用することにより, 理論的基盤構造分布を確立する。
我々はこの計量を横次元と縦次元に意味的に分離し、粒度の細かい「セマンティック顕微鏡」を作成する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:21:58 GMT)
Judging Is Not Enumerating: Silent Omissions in LLM-Authored Acceptable Sets [13.9] 私たちは、ロールが想定する能力を測定し、通常、ロールが配置されるプロトコルの下でそれを欠いていることを見つけます。
モデルは、その候補がセット自体の作者よりもはるかに優れているかどうかを判断する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:00:44 GMT)
On the Identifiability of Masked Prediction: Mode Blindness and Mask Schedules [13.7] Masked predicts learns representations by fit a schedule-weighted family of conditional law。
ほぼ最適条件予測が根底にある関節法則をいつ下ろすかは、まだ不明である。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:06:02 GMT)
Sheaf-theoretic Signal Processing on Graphs: Spectral Theory, Filtering, and Sampling [13.7] 本稿では,ネットワークシーブ上での統一的なシーフ信号処理フレームワークを開発する。
これは信号処理、すなわちスペクトル分析、フィルタリング、サンプリングの基本的な操作を拡張する。
合成、モーションキャプチャ、財務データセットの実験は、提案したフレームワークを検証する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:39:26 GMT)
CoT-Edit: Let CoT Guide Instruction Video Editing [13.6] 本稿では,意味的意図と空間的実行を橋渡しする計画ガイド-編集フレームワークを提案する。
我々のフレームワークでは、Chain-of-Thought(CoT)強化マルチモーダル言語モデル(MLLM)がプランナーとして機能する。
これらの空間的先行は、ボックス条件のマスクジェネレータを誘導し、不明瞭なグローバル検索を局所的でコンテキスト対応の洗練に変換する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:20:15 GMT)
MonitorVLM-v2: A Deployed Vision-Language Framework for Real-Time Safety Violation Detection [13.6] MonitorVLM-v2は、VLMに基づく安全評価を、有限の規制決定空間に対する確率的推論として再放送する。
推論速度は19.45倍に向上し、サイトの通常の手動検査ワークフローの2.78倍の違反が確認された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:58:04 GMT)
Automated Construction and Verification of Unextendible Product Bases [13.5] UPB(Unextendible product base)は、量子情報理論において重要な構造である。
本研究では,(N)次元ハイパーキューブの分解に基づくSAT支援フレームワークを提案する。
我々は,いくつかの三部岩系および四部岩系において,いくつかの大きさのUPBを得る。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:47:51 GMT)
KING: Embodiment-Aware Kinematic Graph Neural Network for Unified Motion Representation of Legged and Wheeled Robots [13.4] 学習ベースキネマティックモデルでは,モデルベース手法よりも高精度なオドメトリ推定が可能である。
既存の学習ベースのモデルの多くは、単一の実施形態で訓練され、新しい実施形態に対して十分に一般化されている。
グラフニューラルネットワーク(GNN)をベースとしたキネマティックモデルであるKingを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:42:58 GMT)
Hybrid AI for Explainable and Accurate Conversational Agents in eGovernment [13.4] 本稿では,eGovernmentのための説明可能な,正確な対話エージェントを構築するための,いわゆる会話型ハイブリッドAIアーキテクチャを提案する。
我々は、市民に向けられた政府のガイドラインに基づいて、Covid-19グラフのプロトタイプを運用することで、アーキテクチャを実証する。
また,障害学生に対する補助助成金のケースマネージメントについて,現在進行中の事例について述べる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:09:22 GMT)
MiniWorld: Democratizing the Training of Video World Models from Scratch [13.3] ビデオワールドモデルは、過去の観測と制御信号に基づいて将来の観測を予測する。
MiniWorldは、ストリーミングビデオワールドモデルをゼロからトレーニングするための再現可能なフレームワークである。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:57:02 GMT)
You Don't Need To Stay in The Loop: An Agentic Robotics Loop for Robot-Policy Improvement [12.9] AgenticRoboticsはバックエンドに依存しないコントロールプレーンで、使い捨て労働者を耐久性のある列車で駆動する。
ゲートは偽のプロモーション制御(1ランあたり0.001が強化され0.005--0.021が出荷された)、任意の停止中の任意の有能な決定、キルインジェクションによる損失または重複効果のゼロ、および署名された検証器によって捕獲された6つのアーティファクト・タンパリング・クラスのうち6つを購入する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:28:18 GMT)
Driver2Map: Imitating Human Driving for Online High-Definition Map Construction [12.8] Driver2Mapは、人間のドライバーにインスパイアされたオンラインHDマップ構築モデルである。
本研究では,異なるモード間の空間的不整合を低減するための「二段階アライメント」戦略を提案する。
また,多視点機能を適応的に重み付けする「Pose-Guided BEV Fusion」も導入した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:01:42 GMT)
Neuro-Symbolic Participation Governance for Verifiable AI Agents in Open Digital Twin Ecosystems [12.8] 既存のマルチエージェントシステムは、アイデンティティ、能力、ポリシーコンプライアンスに対する堅牢な検証を欠いていることが多い。
本稿では,協調型ディジタルツイン環境における検証可能なエージェントのための,ニューロシンボリックな分散ガバナンスフレームワークを提案する。
我々の知見は、ニューロシンボリックな分散ガバナンスが、安全な人間と機械のコラボレーションのためのスケーラブルで信頼できる経路を提供することを示唆している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:30:32 GMT)
EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation [12.6] 本稿では,ロボットの内視鏡ナビゲーションを一般化する最初のWAMについて紹介する。
映像ワールドモデルの中間的聴覚特徴から,今後の観測におけるタスク関連対象領域の予測を行う。
この設計は、目標認識の監視を予測力学モデリングに注入し、視覚的劣化と視点変化に対する堅牢性を改善する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:11:22 GMT)
Understanding and Overcoming Cross-modal Fusion Bias in Multimodal Anomaly Detection From A Fisher Information Perspective [12.5] クロスモーダル融合バイアスはマルチモーダル学習においてよく知られた課題である。
このバイアスを軽減するために設計されたプラグアンドプレイフレームワークであるUCFBを提案する。
シングルクラス、マルチクラス、少数ショット設定で一貫した改善を実現している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:38:04 GMT)
Latency-Optimal Adaptive Split Inference for Privacy-Preserving Cloud-Edge-End Collaboration [12.4] IoT(Internet of Things)エンドポイントデバイスは、プライバシに敏感なバッチ推論をサポートすることがますます期待されている。
本稿では,プライバシ保護型クラウド-エッジ-エンドコラボレーションのためのレイテンシ最適化型分割推論フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:59:07 GMT)
From Uncertainty to Determinism: Coarse-to-Fine Visual Floorplan Localization without Ray Matching [12.3] 本稿では,不確実性から決定論へと進展する粗大な視覚的FLOCフレームワークを提案する。
改良段階において,候補中心の作物から有界なサブメーターの残差を予測できる局所精製器を提案する。
本手法は,オフラインマップ前処理やテストタイムのルックアップテーブルを必要とせずに,グローバルなマルチハイプセシストラッキングと局所サブメーター改善のバランスを効果的に行う。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:33:26 GMT)
Beyond Symmetric Fusion: Exploiting Task-Dependent Modality Strengths for RGB-Event Small Object Detection [12.3] 最先端のRGBイベント検出器は、RGBとイベントデータからの補完的な特徴を組み合わせることで、小型で高速なオブジェクトの検出を改善する。
イベントデータはクラス非依存のローカライゼーションにおいて著しく有効であるが、RGBデータは、ローカライズされたターゲット領域内でより強力なカテゴリエビデンスを提供する。
このタスク依存型非対称性により、非対称なイベント-RGBオブジェクト検出変換器(AERODet)を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:10:54 GMT)
OVEarth-Bench: Evaluating Category Breadth and Query Diversity for Open-Vocabulary Earth Observation [12.2] オープン語彙地球観測は、固定ラベルセットではなく、自然言語で指定された概念をローカライズすることを目的としている。
OVEarth-Benchは、カテゴリ幅とクエリ多様性の2つの方向に既存の評価を拡張している。
一般的な手法とEO特有の手法を幅広く評価する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 06:02:45 GMT)
Cognitive Demand Steering for Adaptive Meta-Reasoning in Large Language Models [12.2] 認知的デマンドステアリング(Cognitive Demand Steering)は、残留需要評価を備えたトレーニングフリーなメタ推論フレームワークである。
3つのフロンティアLCMと6つの推論ベンチマークで比較すると、CDSは直接呼び出しで21.9%、標準のCoT推論で9%の精度向上を実現している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:41:12 GMT)
SG-WAM: Self-Guided World Modeling in Geometry-Aware Policy Space [12.2] World Action Models (WAM)は、将来の状態を予測するアクション生成を結合する。
本稿では,SG-WAMを提案する。SG-WAMは,政策由来の表現空間において,幾何学的行動条件の動的性を直接学習する自己誘導型フレームワークである。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:25:08 GMT)
Search-GRT: Guided Retrieval Training of Search Agents to Optimize for Complex Question Answering [12.1] 本稿では,RL学習中の検索プロセスを制限することにより,検索エージェントの性能を向上させる新しい手法であるガイド検索訓練(GRT)を紹介する。
GRTは、検索-R1のような既存のメソッドよりも、広範囲の質問応答(QA)タスクで一貫したパフォーマンス改善を実現している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:55:08 GMT)
VertiAKD: Adaptive Off-Road Kinodynamics on Vertically Challenging Terrain [11.9] VertiAKDは、様々な車両にまたがるオフロードキノダイナミックな知識の伝達と適応のための統一されたフレームワークである。
We demonstrate VertiAKD in the Verti-Bench simulator, built on the Chrono multi-physics engine, on on 5 physical configurations of the Verti-4-Wheeler platform。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:55:08 GMT)
From AI Technical Debt to Agentic Technical Debt: A Systematic Mapping of Root Causes and Manifestations in Agentic AI Systems [11.9] 本稿では,エージェントAIシステムの自律的かつ協調的な性質から,技術的負債の発生,蓄積,伝播,増幅を前提としたエージェント技術的負債(AgTD)を紹介する。
確立されたAITDのエージェント的表現に対する最初の体系的マッピングを提示し、従来の負債がシステムレベルの負債へとどのように発展していくかを示す。
この結果から,エージェントの動作,調整機構,エージェント間のインタラクション,ツール,実行環境などを含むソフトウェアアーティファクトを超えて技術的負債が拡大していることが示唆された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:09:28 GMT)
MineGrad: Gradient Inversion Attacks on LoRA Fine-Tuning [11.9] 本研究では,悪意のあるサーバが事前訓練されたモデルと微調整パラメータを利用して,プライベートなユーザデータを復元することを可能にする解析攻撃を提案する。
従来の作業とは異なり、我々の攻撃は言語タスクと視覚タスクの両方に適用可能であり、公開データセットで事前トレーニングする計算コスト(逆)に依存したり、LoRAモジュールよりも少ないトレーニングトークンの数を必要としない。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 22:18:34 GMT)
Think in Sets for Streaming Video Token Compression [11.8] ストリーミングビデオは因果的かつフレーム単位のプルーニング決定をするので、フレーム間のインタラクションをモデル化するには明確な履歴参照が必要である。
我々はNovaCovを導入し、ストリーミングビデオ用に設計された、最初のトレーニング不要でプラグ&プレイのセットワイドトークン圧縮機について紹介する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:44:51 GMT)
Ranking Image Fusion the Way Humans Do: A Learned Pairwise Preference Metric for Infrared-Visible Fusion Assessment [11.7] 本稿では,人間のA/B/Tie比較プロトコルをスケーラブルなサロゲートとして運用するソース条件付きモデルであるLearted Perceptual Image Fusion Measure(LPIFM)を提案する。
LPIFMは、赤外線源、可視光源、および2つの融合した候補を共同で観測し、A候補が良いか、B候補が良いか、または両者が知覚的に等価かを予測する。
LPIFMモデルの重み付け、ソースコード、評価コードとともにアノテーション付き選好データセットをリリースし、選好整合IVIF評価をサポートする。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:10:44 GMT)
Coordinate Optimality Reformulation for Mixed-Integer Convex Programs with Indicators [11.7] 本稿では,emphCoordinate Optimality Reformulationフレームワークを紹介する。
座標の最適性情報を組み込むことで、標準指標の定式化を強化する。
その結果、グローバルな最適性を保ちながら、ブランチ・アンド・バウンドのパフォーマンスを大幅に改善した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:07:02 GMT)
Fault-tolerant quantum computing with a microwave Cat Bus [11.4] ライドバーグ原子はマイクロ波キャットバスを介して共鳴的に絡み合っている」
Cat Busは1対多の$mathrmCZn$ゲートの並列実行をサポートし、クロストークを指数的に抑制する。
フォールトトレラント動作には,ネイティブキャット--atom $mathrmCZn$ gateを利用するハードウェア対応スケジューリング方式を開発する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:16:10 GMT)
Climate-Dyna Deep Hedging for XVAs: Model-Based Reinforcement Learning, Residual Climate HVA, and Hedge-Instrument Discovery [11.3] トレーディングデスクでは、残留性気候ヘッジ評価調整(HVA)は、その遺伝したヘッジの後に残された気候コストである。
この残余は、気候とベースラインの2つの世界を比較し、各ヘッジ宇宙のオーバーレイを再最適化することで得られる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:48:24 GMT)
Analytic Qubit Separation between POVMs and Projective Measurements [11.3] 局所次元2での2つの測定モデルを分離する有理係数を持つベル関数を構築する。
有理行列成分が 2sqrt2+1/100$ に達する明示的な3-アウトカム量子ビット正演算値測度。
これは、キュービットPOVMと任意の共有2量子状態上のキュービット射影測度の間のベル関数による最初の完全解析的分離である。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:37:41 GMT)
Factorized AdaBoost.MH Achieves the Same Convergence Rate as AdaBoost.MH [11.2] より構造化された亜種である Factorized AdaBoost.MH は $mathbfh(x)=mathbfv bmvarphi(x)$ という形の基底分類器を使用する。
因子化 AdaBoost.MH は AdaBoost.MH と同じ加速型収束率を普遍定数係数まで達成することを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:46:38 GMT)
MVMD: A Multi-View Approach for Enhanced Mirror Detection [11.0] 3D再構成は通常、シーンの異なる視点を捉えるために、多視点画像に依存する。
既存の方法は、マルチビュー設定によって提供されるリッチな情報を見渡すことで、単一画像の検出にのみ焦点をあてている。
本稿では,新しいマルチビューミラー検出手法であるMVMDと,マルチビューシーンにおけるミラー検出に特化して設計された最初のデータベースを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:26:01 GMT)
PALMs: Using Multi Construct-Grounded Rationales for Modeling Population Preferences in LLMs [10.9] 本稿では,人口適応型言語モデル (PALM) について紹介する。
PALMは性格、価値観、信念、文化規範、道徳の4つの側面で評価されている。
タスク固有の監視機能を備えた下流アプリケーションへの強力な一般化を実証する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:31:59 GMT)
Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference [10.9] Celtyは、LLM推論における効率的なspMspVのための、共設計のスパースフォーマット、GPUカーネル、SIMTマイクロアーキテクチャである。
Celty GPUカーネルはcuBLASを最大2.8倍、Flash-LLMを2.4倍高速化する。
Sparse SIMT Coreでは、cuBLAS上でのスピードアップは最大5.3倍、デュアルスパーシティは70%に達する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 23:10:04 GMT)
Clear-Weighted Bit Allocation for Satellite Downlinks [10.4] 地球観測衛星は、間欠的な地上接触よりも多くの画像を撮影する。
我々は、雲からクリアグラウンドまでの実際の符号化バイトである、明確な確率重み付けされた再構築損失を持つニューラルネットワークを訓練する。
実エントロピー符号化バイト,割り込み可能な接触容量,サービス時間とエネルギーを用いて,オンボード・ツー・ダウンリンクパイプラインの評価を行った。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:31:03 GMT)
Characterizing Bias in Post-Bandit Inference under Index Algorithms [10.4] Banditアルゴリズムは、下流の推論のためのデータを生成するが、適応的なサンプリングバイアスは帯域後サンプル手段を生成する。
サンプル平均バイアスに対して鋭い先行式を導出し,Z$-statisticを期待する。
我々の特徴は、鍵指数関数依存量によるバイアスのアルゴリズム的起源を明らかにする。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:11:10 GMT)
STAR-VLM: Spatiotemporal Grounding Vision-Language Models for Motion and Velocity Estimation via Automotive Radar Supervision [10.4] 距離認識時間モデル(VLM)を構築するための自動車用レーダー監視フレームワークSTAR-VLMを紹介する。
本稿では,STAR-VLMが動作分類と距離速度推定の両方を実現し,各タスク用に設計されたタスク固有手法よりも優れた性能を示すことを示す。
その結果、自動車レーダーは、リアルタイム自動運転のための計量認識時空VLMを構築するための、スケーラブルで費用対効果の高い監視源として強調された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 23:02:06 GMT)
CAAT: Contact-Aware Attention Scaling and Tactile Masking for Data-Efficient Contact-Rich Manipulation [10.3] 接触に富んだ操作では、視覚的な観察は自由空間における動きを導くが、触覚的な観察は接触中に特に有益になる。
標準トランスフォーマーベースのvisuo-tactileポリシーは一般的にトークンの連結か学習可能なゲーティングに依存する。
本稿では,注意スケーリングと動的触覚マスキングにより,接触先行情報を明示的に組み込んだ軽量な接触認識フレームワークであるCAATを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:04:00 GMT)
Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference [10.3] コラボレーション推論は、エッジデバイスとクラウド間の計算により、LVLM(Large Vision-Language Models)をデプロイする。
生の入力を控えることでプライバシーが保証されるが、中間の隠蔽状態の送信は重要な攻撃面を公開する。
重層LVLM隠蔽状態からでも、プライバシーに敏感な視覚情報やテキスト情報を復元できることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:56:23 GMT)
Mind the Gap: Zero-Query Jailbreaks via Filter-Generator Discrepancy in Text-to-Image Systems [10.1] テキスト・トゥ・イメージ(T2I)システムは通常、安全でない要求をブロックするためにジェネレータの前にプロンプトレベルの安全フィルタを持つ。
観測可能な不一致規則を用いて、摂動を高能率候補集合にスクリーニングするゼロクエリ・ジェイルブレイク・フレームワークを提案する。
平均攻撃成功率は29.2% (MHSC) と33.3% (Q16) に上昇する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:53:30 GMT)
Demystifying When and Why VLAs Fail in Contact-Rich Tasks and How to Fix Them [10.1] 視覚・言語・アクションモデルがコンタクトリッチな操作タスクにいつ、なぜ苦労するのかを理解することの課題に対処する。
精度の失敗は、フローマッチングポリシートレーニングミスマッチに根ざし、力信号の特異な構造から力障害が発生する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:34:19 GMT)
Active Regression for Single-Index Models with Unknown Link Functions [9.9] 本稿では,一般$ell_p$-lossと未知の$$1-Lipschitzリンク関数$f$の下での単一インデックスモデルの能動的回帰について検討する。
結果は、シングルインデックスモデルに対する活性$ell_p$-regressionの残りのギャップの多くを埋める。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:53:41 GMT)
Learning-Based Stochastic Optimal Control with Infinite-Horizon Probabilistic Constraints [9.7] 無限水平連成確率制約を用いた最適制御問題を考察する。
我々は、元の問題を制約付きマルコフ決定プロセスとして再構成する。
拡張状態空間上で定義された決定論的マルコフポリシーに収束することを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:00:41 GMT)
Scoring Rules! Statistical and Strategic Alignment for Text Evaluation Metrics [9.5] 評価基準の信頼性は通常、その統計的相関と人間の評価によって判断される。
メトリックは、人間の評価と相関し、タスク関連情報を付加しない摂動に抵抗するならば、統計的に一致している。
本研究では,人間の年齢相関,感度,操作堅牢性からなる基準ベースメトリクスのテスト原理を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:10:01 GMT)
ReBRAC-v2: The Return of the King [9.3] 本稿では、RLアクターとして正確な正規化フローを直接訓練するReBRAC-v2を紹介する。
このレシピをタスク毎に個別にチューニングするのではなく、単一の共有構成を開発する。
一般的な10のOGBenchカテゴリで、ReBRAC-v2の平均は74.8であり、次のベストアグリゲーションの結果は52.3である。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:42:20 GMT)
Amortizing the Calibration Triple: A Projection-Consistent Neural Operator for Local-Stochastic Volatility [9.2] 局所確率的ボラティリティ(LSV)は、バニラ限界とより豊かな笑顔のダイナミクスを組み合わせたものである。
我々は、キャリブレーションのための射影整合作用素三重項を学習する。
証人強化残差系に対しては,条件付き同定と経験的整合性を証明する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:03:48 GMT)
Astrolabe: Spherical-Map Guidance Across Diffusion Pipelines for Full-Body Capture from Unconstrained Images [9.1] emphAstrolabeは、凍結した視点誘導マップ上に構築されたホスト可搬型アダプタである。
これは、ホストとすべてのペア化されたPuzzle-IOIジオメトリの両方で、報告されたすべてのイメージメトリクスを改善します。
また、4D-Dressの幾何学は全体として安定している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:41:22 GMT)
Using Non-Lipschitz Signum-based Functions for Distributed Optimization and Machine Learning: Trade-off Between Con-vergence Rate and Optimality Gap [9.0] 非Lipschitz連続最適化アルゴリズムは、既存の線形解の緩やかな収束率を改善するために提案されている。
分散回帰問題を解析し、線形および非リプシッツ符号に基づく関数を適用して収束率をチェックする。
以上の結果から,シグナムをベースとした菌根反応はより高速に収束するが,高い最適性ギャップが生じる可能性が示唆された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:06:12 GMT)
MedUPS: Towards Diagnostic Assistance in Uncommon Medical Cases with Large Language Models [9.0] MedUPSQAは、実症例報告5,535件から構築された21,874件の中間的臨床的決定点のデータセットである。
MedUPSは、患者の軌道に沿って展開する中間決定のモデルを監督する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:27:21 GMT)
OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation [9.0] OC-VLA++は、視野一般化のためのOC-VLAの拡張である。
本稿では,幾何誘導型対ビュー監視と明示的な対ビュー・アクション・平等の目標について紹介する。
実験は、限定的なカメラカバレッジの下で、目に見えない視野の一般化を著しく改善した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:06:20 GMT)
Swimm3R: Splatting with Medium-aware SfM for Underwater 3D Reconstruction [8.8] 水中3次元再構成における散乱および減衰による故障に対処するために,Swimm3Rおよび水中ベータスプラッティングを提案する。
Swimm3Rは、空気中の幾何学的前駆体をフィードフォワードのバックボーンに蒸留し、物理ヘッドを使用して水中の画像形成パラメータを回帰する。
水中ベータスプラッティングは、安定な水中幾何表現のために、ベータプリミティブと散乱対応幾何勾配でガウススプラッティングを拡張する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:01:15 GMT)
3DZip: Spatial-Aware Feature Diversity-Guided Token Compression for 3D Question Answering [8.8] 最近の3次元視覚言語モデルは、2次元視覚特徴を世界座標に投影することで幾何学的認識トークンを構築する。
この設計はシーンごとに数千のトークンを生成し、計算とメモリのオーバーヘッドを大幅に増大させる。
3DZipは3段階のトークン圧縮フレームワークで、まず粗いボキセル化を適用して点レベルの冗長性を除去し、次に特徴空間の多様性に基づいてアンカートークンを選択し、最後に空間制約下で残ったトークンをマージして幾何学的コヒーレンスを保存する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:11:51 GMT)
Beyond Gene Reconstruction: Learning Cell Representations through Complementary Transcriptomic Views [8.7] 相補的な転写学的な視点から細胞表現を学習する対照的な事前学習フレームワークを提案する。
本研究では,共同発現誘導遺伝子パーティショニング,表現認識コントラストセット構築,コントラストオンセットという3次元の具体的適応を導入する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:35:45 GMT)
Data-Driven Pinball-Loss Selection for Vertically Distributed Elastic-Net SVMs [8.6] 本稿では,データ駆動型弾性ネット支援ベクトルマシンを提案する。
実験は予測行動、数値等価性、マルチプロセスのスケーラビリティを評価する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:01:03 GMT)
Inter-Residue Geometry Attention for Antibody-Specific Epitope Prediction [8.5] ローカルフレーム3Dロータリーポジション。
EPEPは、CDRと抗原表面の3次元的な相補性に依存する、特定の抗体によってどの抗原残基が認識されるかを特定することを目的としている。
そこで我々はローカルフレーム3Dロータリー位置を提案する。
EPEPは、バックボーン定義された局所フレームの残差を表現し、それらを回転注意に直接注入する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:48:07 GMT)
Constant-depth adaptive preparation of Dicke and symmetric states [8.5] ディック状態の効率的な準備、より一般的には置換対称状態は量子情報処理において重要である。
任意のDicke-$(n,k)$状態と、さらに対称な状態に対して、正確な等深適応準備プロトコルを導入する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:46:16 GMT)
CrossLex: A Source-Grounded Benchmark for Cross-Jurisdictional Legal Reasoning in Large Language Models [8.4] そこで我々は,クロスファクトな法的根拠に基づくベンチマークであるCrossLexを紹介した。
クロスレックスは、権威ある法的ソースから構築され、契約、消費者、刑事、家族、労働法にまたがる55の法的問題に整合し、司法に整合した質問を構築している。
相互判断的推論から基本的法的知識を遠ざけるために、CrossLexは、単一判断的推論(T1)、共同判断的比較(T2)、微粒な相互判断的評価(T3)の3つの相補的タスクを定義している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:03:09 GMT)
Why LLMs Give In: Conversational Factors and Reasoning Behind Medical Sycophancy [8.4] ユーザプッシュバックの下で正しい医療回答を放棄する言語モデルは、単に間違っていたものよりも危険です。
本研究は, 言語モデルにおいて, 4つの対話的要因にまたがる完全に交差した因子的設計を用いて, 医用サイコファシーについて検討した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:49:25 GMT)
One-Sided Quantile Coupling for Flow Matching [8.3] Flow Matching Train Continuous-time Generative Model by regressing the velocity field of a probability path between a simple source distribution and a target data distribution。
本稿では,データバッチのみをサンプリングし,各ペアソースを直接構築する軽量な一方結合であるQuantile Coupling Flow Matching (QC-FM)を提案する。
QC-FMはトレーニング予算に合わせてベースラインを改良し、FIDを最大12.9%削減し、4つのデータセットでOT-CFMを上回っている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:03:59 GMT)
Plasticity of Growing and Elastic Neural Networks in Online Continual Learning [8.2] オンライン連続学習における基礎的成長・弾性ネットワークの可塑性について検討した。
以上の結果から,オンライン連続学習における高可塑性保存のための,成長と弾性ネットワークが有望なアルゴリズムのクラスとなる可能性が示唆された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:12:32 GMT)
Weakly Supervised Instance-Level Gleason Pattern Estimation Using Primary and Secondary Labels [8.2] 前立腺癌の病理組織学では、Gleason Scoreは、全スライディング画像の中で最も頻度の高い(Primary)パターンと2番目に頻度が高い(Secondary)Gleasonパターンによって決定される。
本稿では,スライドレベルのプライマリラベルとセカンダリラベルからインスタンスレベルのGleasonパターンを推定するマルチインスタンス学習フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:30:19 GMT)
Prompt-Driven Simulation with Feature Perturbation for Cross-Domain Few-Shot Object Detection [8.1] PSP-FSODは、プロンプト駆動型ドメインシミュレーションと機能摂動正規化を統合した、原則化されたフレームワークである。
PSP-FSODは高品質なドメイン多様性の監視を行い、ドメイン不変表現を学習する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:11:16 GMT)
FedChronos: Federated Fine-Tuning of Time-Series Foundation Models for Privacy-Preserving Commodity Price Forecasting [8.1] 時系列基礎モデル(TSFM)は、ドメイン間で強い予測能力を示している。
我々は、すでに訓練済みのTSFMをフェデレーションしたパラメータ効率の微調整のためのフレームワークであるFedChronosを紹介する。
9州にわたる15のインド農業市場から毎日の商品価格についてFedChronosを評価する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:59:12 GMT)
When May a Model Replace the Experiment? Audits, Licenses, and the Price of Trust in Surrogate-Driven Design [8.0] 化学、材料科学、機械学習におけるデザインキャンペーンはボトルネックを共有している。
これらの結果を予測する機械学習サロゲートは、候補を提案するだけでなく、それらを格付けし、測定したように自身の予測を検索に戻すためにも使われるようになっている。
我々は、この慣行が安全で、どんな安全証明書もコストがかからず、代金が確実に支払うことを確約する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:59:29 GMT)
Lethe: How Hard Is It to Forget? A Benchmark for Federated Unlearning in Medical Imaging [7.8] フェデレート・ラーニング(Federated Learning)は、医療画像のモデルを病院全体で訓練することを可能にする。
医用画像におけるフェデレーション・アンラーニングのベンチマークであるLetheについて紹介する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:50:20 GMT)
CraftAlign: Feature-Grounded Evaluation and Revision Guidance for AI Stories [7.8] 私たちは、AIストーリーを人間のストーリーテリングの工芸品と整合させるフレームワークであるCraftAlignを紹介します。
Qwen3.5-9B上に構築された特徴推定器は、スタイルと物語にまたがる304の明示的な記述機能を予測する。
推論時、CraftAlignはスキーマ無効な構造化摂動を適用し、特徴設定をヒューマン書き込みパターンに移行する変更を選択する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:57:05 GMT)
Decoy Images Amplify Caption-Mediated Defenses Against Encoded Jailbreaks [7.8] 画像入力と既存のブラックボックス防御との直感的相互作用を視覚-言語モデル上で報告する。
テキストのみのエンコード入力にASRをそのまま残したキャプション経由のディフェンス(ECSO)は、コンテンツフリーのデコイが添付されると最大7,3$ppまで低下する。
私たちはこれを、堅牢な防御ではなく、パイプラインの相互作用に関する観察として捉えています。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 07:00:49 GMT)
The Fourth Quadrant: A Stylized View of Benign Misfitting [7.7] トレーニングエラーはトレーニングセットで観察できるものです。
決定論的 $(d+1)$-dimensional 単一スパイクモデルにおける2乗誤差を用いた線形回帰について検討する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 06:27:55 GMT)
NoisePQC++: A Unified NIST-Compliant PQC and Hybrid-PQC Implementation of the Noise Protocol [7.6] ノイズプロトコルフレームワークはWireGuardやWhatsAppなどのシステムで広く使われているが、伝統的に楕円曲線ディフィー・ヘルマン(ECDH)の公開鍵交換方式に依存している。
提案するNossPQC++は,キーカプセル化後メカニズムとハイブリッドフォワードセキュリティを付加したNoss ProtocolフレームワークのC++23実装である。
以前の作業と比較すると、NossPQC++はより広範なプロトコルカバレッジ、より完全な実装サポート、柔軟性を提供します。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:04:51 GMT)
QR-Erase: Efficient Subspace-Based Machine Unlearning with Layer Localization [7.5] 機械学習は、訓練されたモデルからターゲットとなる情報を、高価なリトレーニングを必要とせずに取り除こうとする。
サブスペースベースのフレームワークであるQR-Eraseを導入する。
本稿では,有界誤差による精度の高い部分空間復元を実現すること,また,軽度スペクトルギャップ条件下では,回復した部分空間が最適SVD解に近づくことを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:08:56 GMT)
Latent Softmax for Data-Efficient Phoneme-Based Multilingual ASR Across Tonal and Non-Tonal Languages [7.5] 音素に基づく多言語自動音声認識は、言語固有のサブワードモデリングよりも直接言語間で音響的証拠を共有することができる。
本稿では,音符付き母音をサブクラスとして,ベース母音を主要クラスとしてモデル化した接続性時間分類(CTC)互換の出力層であるLatent Softmaxを提案する。
AISHELL-1 Mandarin と LibriSpeech English の実験では、Latent Softmax はAISHELL-1 で8.4%、LibriSpeech テストクリーンで17.5%、テストオーバーで12.6%、標準ソフトマックス多言語ベースラインでの音声と音声の誤り率を8.4%削減している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:45:18 GMT)
DenialRAG: Single-Document RAG Poisoning via Embedded Parametric Denial [7.4] EmphDenialRAGは,正しい回答を明示し,それを否定し,攻撃者による説明を提示する単一文書中毒攻撃である。
DenialRAGは、コンフリクトを直接ジェネレータが見るコンテキストに埋め込む。
我々はDenialRAGを3つのオープンドメイン質問回答データセットにまたがる4つの単一文書中毒攻撃に対して評価した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:33:05 GMT)
Fighting Fire with Fire: On the Feasibility of Protecting Exercises Against AI Cheating [7.4] 我々は,このような腐食的依存から教育演習を保護するために,敵対的機械学習を再利用できるかどうかを検討する。
提案手法では,視覚成分を微妙な視覚摂動で保護できるマルチモーダル多重選択質問を用いた。
解答器を盲目的にコピーした学生は、真の学生よりも、誘導された解答パターンを頻繁に再現する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:16:21 GMT)
Beyond Routing Saturation: A Long-Horizon Class-Incremental Perspective on Expert Routing in Multimodal Continual Instruction Tuning [7.3] 広範に使用されているMCITベンチマークでは,ルーティングがほぼ飽和していることを示す。
テキスト指紋の弱い34タスク長軸MCITベンチマークであるFLEXを紹介する。
我々は,プログレッシブLoRAルーティングをソフトタスク・アズ・クラス・マルチモーダル・クラス・インクリメンタルラーニングとして定式化する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:42:16 GMT)
Auditing Semantic Gains in Sequential Recommendation: A Lightweight Recovery Test [7.2] LIME-Recは軽量で監査可能なリカバリテストである。
Amazon Beauty、Toys、Sportsでは、LIME-RecのR@10スコアは0.0996、0.1105、0.0593で、比較ベースラインの7.0%-12.0%を上回っている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:15:50 GMT)
Cloud-ScPO: Hidden-State Geometry for Semi-Supervised Preference Optimization in LLM Reasoning [7.2] モデルの内部表現幾何学から選好監督を導出できるかどうかを考察する。
我々は、トポロジ誘導の選好マイニングフレームワークであるCloud-ScPOを提案する。
実験の結果、クラウド-ScPOはScPOよりも常に改善され、GSM8Kでは4.49%、MATH-Numericでは4.19%まで上昇した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:33:41 GMT)
Context Compaction Theory [7.1] 本稿では,AIエージェントが実際に使用するコンテキスト圧縮のための2つのアルゴリズム戦略をキャプチャする2つのゲームからなるフレームワークを提案する。
我々は、コンテキスト生成ゲームと一方的な通信複雑性の等価性を証明した。
本研究では,コンテキスト選択ゲームが一方通行の通信プロトコルの制限されたクラスに対応することを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:45:54 GMT)
InteracVid: Building a Real Interactive Audio-Visual Response Dataset from Live-Chat Videos [7.0] 我々は、この欠落した監視に対処する最初のオープンソース大規模データセットである textbfInteracVid を紹介する。
Everysampleは、先行する音声視覚コンテキストと、それに続く実際の対話応答を伴う外部刺激を結合する。
10レーターの人間による研究では、抽出された相互作用が、真のクエリと再構築されたクエリの両方に対して因果的、自然的、時間的に完全であることを確認している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:28:13 GMT)
BiCAA: Bidirectional Credit Assignment for Search-Augmented Agent [7.0] BiCAAは、前向きの可解性向上と後続の成功臨界という2つの相補的なシグナルを融合することによって、双方向のプロセス報酬を構築する。
検索強化されたQAベンチマークの実験では、BiCAAはポリシー最適化を安定化し、冗長な探索動作を低減し、競争性能を達成する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:41:57 GMT)
BiKAN: Restoring Collapsed Basis of Binary Kolmogorov--Arnold Networks [6.9] Kolmogorov-Arnold Network(KAN)のバイナリ化は各レイヤで利用可能な関数空間を変更する。
提案するBiKANは,各2進数2のWalsh文字を加算することにより,この問題に対処する。
W1A1では、ビカンは99.48%、84.38%、Mは55.81%、401AR-10は72AR-100である。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:49:59 GMT)
How Benchmarks and Evaluation Protocols Shape Conclusions in Provenance-Based Intrusion Detection [6.5] 監査、ラベル付け、校正要件を満たす公開データセット上で、代表PIDSを再評価する。
いくつかのシステムは、法医学的な調査を支援するのに十分なプロセスレベルのコンテキストを提供することなく、攻撃を表面化する。
この分析は、複数の監査済みのE3データセットが、モデルアーキテクチャを確実に分離することなく警告行動を公開することができる理由を説明するのに役立つ。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:27:49 GMT)
Dense Language Generation Made Simple: Deterministic, Randomized, and Multi-Order Algorithms [6.2] 限界における言語生成は、肯定的な例のストリームから、ジェネレータが新しい有効な文字列を生成する方法を学ぶための理論的フレームワークである。
このモデルでは、敵は可算族から未知の言語を選択し、その要素を任意の順序で列挙する。
信頼性生成は、観測データに対する妥当性と新規性という2つの最終的な保証によって形式化される。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:41:31 GMT)
Gram-Space: Structure-Preserving Codebook Compression for Memory-Efficient Neuro-Symbolic AI [6.1] Gram-Spaceは、コンパクトな正規座標系でコードブックベクトルを表現するための圧縮フレームワークである。
Gram-Spaceは、モデルレベルのGPUメモリ使用量を最大15.75倍に削減し、推論遅延を最大3.62倍改善する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 22:37:34 GMT)
GraRe: Grasp Candidate Re-Ranking for Frozen 6-DoF Grasp Detectors [5.9] 既存の6-DoFグリップ検出器は、検出信頼度によって把握候補をランク付けする。
GraReは、候補属性、貝殻成層局所幾何学、オブジェクトコンテキストから品質の把握を推定する。
3つの凍結検出器によるGraspNet-1Billionの実験は、一貫した改善を示している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:55:32 GMT)
Breaking Diversity Collapse in Spiking Pseudo-Ensembles for Efficient OOD Detection in Remote Sensing [5.8] スパイキングニューラルネットワーク(SNN)は、リソース制約されたリモートセンシングシステムにとって魅力的である。
深いアンサンブルは強い予測の不確実性をもたらすが、複数の完全なモデルとバックボーン評価を必要とする。
凍結したSNNバックボーンに複数の軽量な分類ヘッドを付加する効率的なスパイキング擬似アンサンブルを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:44:25 GMT)
Rethinking Video Token Compression with a Global Codebook: Learning Once, Compressing Everywhere [5.7] ビデオ大言語モデル (Video-LLMs) は、映像を視覚トークンの高密度なシーケンスとして表現し、その長さは入力の時間的および空間的範囲で増大する。
既存のトークン圧縮手法(プルーニングやマージなど)は、推論中にオンラインで圧縮を行う。
オフラインからオンラインへのパラダイムを導入するプラグインビデオトークン圧縮フレームワークである textbfONCE を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:24:13 GMT)
Entity-Faithful Repair of Synthetic Supervision for Zero-Shot Image Captioning [5.7] ゼロショット画像キャプションは、注釈付き画像テキストペアなしで記述を生成することを目的としている。
近年のアプローチでは、テキストのみのコーパスからトレーニングデータを合成するために、テキスト・ツー・イメージモデルを利用している。
ReCapは、合成データの洗練を暗黙のグローバルマッチングから明示的なきめ細かい再配置に移行する、プラグインとプレイのフレームワークである。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:43:04 GMT)
An AI Approach to Verified Production Cryptographic Libraries [5.6] 我々は、高レベルのAPI契約から内部仕様とVerusチェックされた証明を合成するAIベースのシステムであるCryptoProverを提案する。
実行可能なコードを変更することなく、CryptoProverはCrypto25519-dalekの新しい独立した証明を構築している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:32:08 GMT)
Logit-Origin Centering for Singleton Test-Time Adaptation [5.5] ディープラーニングモデルは、テストデータの分布がトレーニングデータと異なる場合、パフォーマンスが悪くなります。
本稿では,厳格なストリーミングシステムにおいて,このようなアプローチが急激に低下することを示す。
本稿では、ソースモデルを凍結させ、各ステップでロジト空間をシフトさせる軽量なアプローチであるPLOC(Prequential Logit-Origin Centering)を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:18:56 GMT)
Diffusion-Based Body Schema Learning Enabling Abnormal-State Adaptation in Musculoskeletal Robots [5.1] 筋肉骨格ロボットは、広範囲の物理的状態変化の下で一貫している内部のボディスキーマを必要とする。
本研究では,筋骨格ロボットにおける身体スキーマ学習のための拡散型フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 06:10:03 GMT)
Probing the 3D Object-Level Understanding of Pre-Trained Detection Transformers [5.1] 本研究では,物体の3次元特性について,事前学習した2次元検出変換器で何を理解するかを検討する。
検出変圧器モデル全体にわたって,本研究の結果は驚くほど強力で,これまで知られていなかった2次元DETRモデルの有用な情報表現能力を示している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:56:14 GMT)
Riemannian Attention Mechanisms for Transformers: A Theoretical Framework and Architecture Design [5.0] トランスフォーマーベースの大きな言語モデルはすべて、ユークリッド内部積を通じて注意を計算します。
我々は、この構造的制限を数学的レベルで対象とする理論的枠組みを開発する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:47:16 GMT)
When Words Divide: Diachronic Ideological Polarization in Political Discourse on Social Media [4.9] Redditの議論において,イデオロギー偏極の経時的分析を行った。
我々は、イデオロギー的偏極を、時間とともに政治概念のセマンティックな相違として定量化する。
分析の結果,イデオロギー偏極は研究期間中に著しく増加した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:53:32 GMT)
Interpretable Machine Learning for Traffic Congestion Prediction: Unveiling the Impact of Different COVID-19 Periods [4.9] 本研究は, カリフォルニア州アラメダ郡におけるロックダウン前, ロックダウン後およびロックダウン後における混雑を予測した。
新型コロナウイルス(COVID-19)の新規感染者は、ロックダウンやロックダウン後の渋滞に主に悪影響を及ぼす。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:58:08 GMT)
Co-evolution of social reward and punishment under institutional interventions [4.8] 我々は,社会ジレンマにおける協力,社会福祉,執行効率の進化を,ピアインセンティブと制度インセンティブが共同でどのように形成するかを検討する。
4つの戦略を持つ囚人ジレンマでは、中央集権的なピアインセンティブと中央集権的な機関インセンティブが同時に作用することを許可する。
対人罰は協力を強く促進する一方、対人報酬は社会福祉にとってより有益である。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:06:46 GMT)
Mechanistic Interpretability-Guided Selective Fine-Tuning of Vision-Language Models for Centimeter-Level Flood Depth Estimation [4.8] 都市洪水は交通インフラにエスカレートする脅威をもたらすが、リアルタイムのストリートレベルの洪水深度推定をセントレゾリューションで提供する運用システムはない。
本稿では,街路画像から連続的な洪水深度推定のために微調整された3つの視覚言語モデルを提案する。
FloodLlama-Dense の MAE は 0.40 cm、RMSE は 1.97 cm、Acc@5 cm は 97.59% である。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 22:38:25 GMT)
Question Begets Question: Self-Evolving Curriculum for Reinforcement Fine-Tuning on Competition Mathematics [4.6] トレーニングデータは乏しく、地道的な推論の痕跡は通常利用できないため、モデルはしばしば、追加のデータが更なる改善をもたらすことのない、明らかな天井を示す。
コンペティション数学(AIME)におけるQwen2.5-Math-7Bを微調整した制御環境でのこれらの困難について検討する。
本稿では,各ラウンドで現在のチェックポイントの評価を行い,その問題からQbQの種を抽出し,その結果の変種を学習する自己進化カリキュラムを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 22:19:01 GMT)
MixedComplementarityProblems.jl: A Fast, Batched, Open-Source Interior Point Solver for Mixed Complementarity Problems [4.6] 混合相補性問題は、非線形プログラムと非協調ゲームの一階最適性条件として生じる。
この形式の問題に対する主要な解決法はPATHであり、ロボット工学の問題を強く評価するが、クローズドソースのままである。
パラメトリックMPPの内部点法をオープンソースで純粋なJulia実装であるMixedarityProblems.jlを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:10:50 GMT)
UDT: Reconciling U-Nets and Diffusion Transformers with Data-Adaptive Token Reduction [4.5] Diffusion Transformer (DiT) は、生成モデリングのコアアーキテクチャとして登場した。
本稿では,DiTの表現能力とU-Netの符号化・復号化の利点を組み合わせたU-Net拡散変換器UDTを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:07:21 GMT)
ST-LoRA: Single Trajectory LoRA Ensemble for Uncertainty Aware Agricultural Segmentation [4.4] デジタル農業における意思決定支援には、正確な予測とよく校正された不確実性推定が必要である。
本稿では,パラメータ効率のよいアンサンブルフレームワークST-LoRAを提案する。
ST-LoRAは、データセットとアーキテクチャの両方にわたるセグメンテーションの精度とキャリブレーションにおいて、フルランクのアンサンブルと一致または超えている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 22:49:28 GMT)
PackingGPT: 3D Packing Agent for Real Furniture in Last-Mile Delivery [4.4] 本稿では,異種箱と占有容器を用いた現実的な条件下での物理的に安定な配置について述べる。
Heterogeneous furniture-in-vehicle packingタスクのための実世界のベンチマークデータセットとベースラインモデルを提供する。
また,レゴの組み立てプロセスにインスパイアされたシーケンシャルな配置として,パッケージングのためのPackingGPTフレームワークを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:16:58 GMT)
Where Reasoning Diverges: Localized Multi-Agent Debate [4.3] マルチエージェントの議論は、意見の相違がいくつかの中間的主張にのみ関係している場合でも、完全な推論の痕跡を交換することが一般的である。
エージェントトレースを型付きノードとして表現し,最初期の競合点を特定し,対応するローカルセグメントに議論を限定する推論時プロトコルであるローカル・マルチエージェント・ディベート(LMAD)を導入する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:47:03 GMT)
PolymerGPT: Multi-property Optimization with a Decoder-Based GPT Model for Generative Polymer Design [4.3] PolymerGPTはデコーダベースのGPTモデルであり、最大37個の一般的なポリマー特性を生成過程に組み込む。
実験の結果,PolymerGPTは非条件生成および条件生成において例外的な性能を発揮することが示された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:26:04 GMT)
UniHEAR: Unified Heterogeneous-Source Attentive Retrieval for Knowledge-Based Visual Question Answering [4.3] 知識に基づくビジュアル質問回答 (KB-VQA) は、視覚的に基礎付けられた質問に答えるために、外部ソースから関連するエンティティ知識を取得する必要がある。
既存の検索強化システムは2つの限界に悩まされている。
We propose UniHEAR, a unified lightweight framework for heterogeneous-source entity search and re rank。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:57:53 GMT)
CORTIVA: Candidate-Score Fusion of Complementary Visual Teachers for EEG- and MEG-to-Image Retrieval [4.2] 非侵襲的な脳活動から視覚体験をデコードすることは神経科学と脳-コンピュータインターフェースの中心である。
EEGとMEGはミリ秒の解像度を提供し、画像検索を魅力的にする。
ほとんどのシステムは、ランク付けする前に、均一な視覚的監督を単一の埋め込みに分解する。
この相補的な証拠を保存した候補スコア融合フレームワークであるCORTIVAを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:14:22 GMT)
V-Mem: Modality-Routed Retrieval for Long-Term Multimodal Agentic Memory [4.2] V-Memは、クエリのモダリティとターゲットエビデンスによる検索をルーティングするマルチモーダルエージェントメモリシステムである。
Mem-Galleryでは、V-MemはLLM-judgeスコアが0.82対0.56で2位となり、画像を含む質問では最大のマージンとなった。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 23:47:18 GMT)
From Forest to Future Capital: Tracking Land Cover Change in Ibu Kota Nusantara (IKN) from 2021 to 2026 with PlanetScope Imagery [4.2] インドネシアのイブ・コタ・ヌサンタラへの移転は、土地の転換、植生の喪失、炭素在庫の減少に対する懸念を高める。
本研究では、PlanetScope SuperDove衛星画像を用いて、2021年から2026年までのKIPPの土地利用と植生被覆の変化を評価するためにリモートセンシング技術を適用した。
その結果、NDVIの平均は17.1%減少し、総炭素量は0.28%減少し、土地は672%拡大し、総植生は18.1%減少した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:28:06 GMT)
Training-Free Out-of-Distribution Detection for Pathology Whole-Slide Images [4.0] 病理組織WSIのためのトレーニング不要マルチモーダルOOD検出器であるZIOを提案する。
臨床に関連のある領域シフトの多種多様さ(まれな疾患や近OOD設定など)にまたがってZIOを評価した。
これらの結果は、OOD検出のためのマルチモーダル表現の利点を示し、臨床実践におけるより安全なAIデプロイメントへの道を開いた。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:42:42 GMT)
CallScreenBench: Benchmarking On-Device Models as Phone Secretaries [3.9] 電話の秘書は、所有者の代理として未知のインバウンドコールを受けます。
ほとんどのベンチマークで評価されるエージェントとは異なり、完了すべきタスクはなく、協調的なユーザもありません。
以下はCallScreenBenchで、この設定を5つの品質次元で評価する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 06:31:25 GMT)
Do Neural Networks Really Beat the Curse of Dimensionality? A Bit-Complexity View [3.9] バイナリエンコーディングとメートル法エントロピーに基づく統一近似フレームワークを開発した。
パラメータではなくビット単位で複雑性を測定する場合、古典的アプローチによって達成された近似順序を根本的に上回る手法は存在しないことを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:20:19 GMT)
Loud or Silent? A Reusable Framework for Per-Modality Failure Analysis in Multimodal Clinical AI [3.8] 2つの疑問は、どのモダリティに責任があるか、そしてモデルがモダリティを落として大音量または無音で失敗するかである。
モデルに依存しないモダリティ・欠陥の枠組みとして、Nのモダリティの埋め込み、マスクを意識したプローブ、ラベルを与えられた場合、例ごとの故障分類を返します。
モダリティ当たりのVSサイレントレートを報告し、3つのモダリティ相補性行列にスケールする。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:38:56 GMT)
Dominant Arm Identification with Mixing and Recycling Observed Samples [3.7] マルチアームバンディットにおける支配的腕の同定問題について検討する。
目的は、他のすべてのアクションの現実的な報酬を超える最も高い確率でアクションを見つけることである。
我々は,理論的保証を伴う新しい支配的腕の基準と効率的な推定器を導入する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 23:58:37 GMT)
ARGUS: Attention-Guided Transformers for Scalable Person Identification Using Wi-Fi Telemetry [3.7] EmphArgusは、デバイスや所定の動作を必要とせずに人を識別する、受動的Wi-Fiセンシングシステムである。
軽量デコーダのみのTransformerは粗いstatgramパッチをトークンとして読み出し、セグメントレベルのロジットアグリゲーションは時間とともにエビデンスを組み合わせる。
60秒の統計では、Argusは生のCSIトランスフォーマーのベースラインを7.75ポイント改善し、1ウィンドウ当たり4.4タイムでFLOPを減らした。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:06:16 GMT)
AdaHAT: Adaptive Hard Attention to the Task in Task-Incremental Learning [3.7] ニューラルネットワークは、新しいタスクでトレーニングされた時に学習した知識を上書きする傾向がある。
本稿では,静的パラメータへの適応的更新を可能にするアダプティブアテンション機構を備えたアダプティブハードアテンション・トゥ・ザ・タスク(AdaHAT)を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:03:57 GMT)
Revisiting Thermal Scalability for Large-Scale Superconducting Quantum Systems [3.2] 我々は、現代の極低温量子系における主要な熱源を十分に考慮し、従来のシステムレベルの熱推定モデルを改善する。
本分析により, 増幅器関連熱が主な熱ボトルネックとして現れることが示された。
この重要な熱負荷を低減し、スケーラビリティを向上させるための構成を特定するために、さまざまな技術オプションとトレードオフを調査します。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:40:01 GMT)
AdaptoNet: Modular Foundation-Adaptive Neural Networks for Cyber-Physical Attack Detection in Power Grids [3.1] AdaptoNetは、条件制御による測定可用性に適応するモジュール型ニューラルネットワークである。
アダプトネットはF1を12%未満から81%以上まで回復し, ほぼ7倍に改善し, 89%~99%のベースラインに接近した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:54:28 GMT)
KoVRE: Training an Efficient Embedding Model for Korean Visual Document Retrieval [2.8] KoVRE:KoVRE: Korean Visual Document Retrieval Embeddingは、韓国のビジュアルドキュメントのためのシングルベクターレトリバーである。
韓国語と英語の問合せページペア708,729で、肯定的かつ否定的なマイニングを用いてモデルをトレーニングする。
本研究は,両言語を対象とする指導と,慎重に設計した訓練戦略により,韓国の高能率VDRモデルを作成できることを実証した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:11:09 GMT)
Pivot: Proactive and Verifiable Threshold Oblivious Pseudorandom Functions From Isogeny Group Actions [2.7] 明らかな擬似乱数関数(OPRF)は、クライアントがサーバにその入力を公開することなく、秘密の入力で鍵付き擬似乱数関数を評価することを可能にする。
既存のアイソジニーベースの閾値OPRFは、主に静的な破損モデルのために設計されている。
我々は,有効同種グループ行動に基づくディーラーレスしきい値 VOPRF フレームワーク PIVOT を紹介する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:11:35 GMT)
Why Formal Monitors Fail: Attack Distribution Entropy as a Coverage Bound for LTL-Based LLM Agent Safety [2.6] リニア・テンポラル・ロジック(LTL)と有限オートマトン(FSA)に基づく安全モニタは、エージェント内の安全でないツールコールシーケンスをインターセプトするためにますます普及している。
しかし、同じモニターは、いくつかのモデルアーキテクチャで68-75%のアタックカバレッジを実現し、他ではほぼゼロに近い。
固定不変なFSAモニタのリコールは攻撃分布の集中によって上述の値に制限されていることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:08:21 GMT)
Interpretable machine learning for predicting splitting strength of asphalt concrete: insights from SHAP analysis [2.5] 本稿では,アスファルトコンクリートの分裂強度(ST)を予測するための解釈可能な機械学習フレームワークを提案する。
TabPFN、ANN、SVR、RF、XGBoost、LightGBMの6つの機械学習モデルを開発し、比較した。
その結果、TabPFNはテストセットで最高の総合性能を示し、RMSEは0.28、MAEは0.21、MAPEは18.01%、MADは0.14、R2は0.88、最高合成スコアは0.91であった。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:05:54 GMT)
Computing with Agentic Oracles [2.3] 我々はAI強化コンピューティングのオーラクルモデルを拡張し、エージェントのオーラクルを含める。
呼び出し間の固定応答分布に応じて同じクエリに応答する定常オラクルとは異なり、エージェントオラクルは、自律的に目標を追求することができ、タスク関連リソースを含む環境にアクセスすることができる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:50:15 GMT)
Gaokerena: A Small Persian Medical Language Model Family [2.3] ガオケレナ(Gaokerena)は、一般向けハードウェアへの展開に最適化された、ペルシアのコンパクトな医療用言語モデルのファミリーである。
まず,9千万トンものペルシャ人医療コーパスのベースラインモデルをトレーニングして開発したGaokerena-Vについて紹介する。
我々は、Chain-of-Thoughtアプローチと2つの新しい強化学習とAIフィードバックフレームワークを統合することで、Gaokerena-Rを開発した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:17:10 GMT)
Modeling Social Dynamics with an LLM-Enabled Agent Based Network-Dynamic (LAND) Model [2.2] 社会的ダイナミクスは、個々のネットワークと談話の相互作用が集団的影響、物語の優位性、協調行動に集約される過程を符号化する。
本稿では,GhostFieldアーキテクチャをソーシャルシミュレーションフレームワークとして利用して,AuraSightシナリオを構築する。
314,244人の異質なサイバーソーシャルエージェントと人間のアクターが、30日間にわたって529,327件のメッセージを交換している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:06:23 GMT)
Specification-Guided Synthesis of Deadlock-Free Communication Protocol Refinements with Large Language Models [2.1] シントロピー(英: Syntropy)は、MPST仕様とLLMによってガイドされたプロトコルの洗練を合成するためのフレームワークである。
改良制約を直接生成プロセスに組み込んで、生成された変種がこれらの保証を満たすことを保証する。
本評価は, 高い構文的正しさを維持しつつ, 95.6%-99.5%の妥当性を達成し, 多様な非自明な精細化を実現していることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:30:36 GMT)
XEns-CKD: An Explainable Ensemble-Based Approach for Chronic Kidney Disease Stage Detection [2.0] 超音波画像を用いた新しいアンサンブル・ビジョン・トランスフォーマーを用いたCKDステージ分類手法であるXEns-CKDを提案する。
3つのViTは、異なるトレーニングパラメータを使用して、プライベート超音波画像データセットでトレーニングされた。
アンサンブルモデル全体の分類精度は86.36%に達した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:59:58 GMT)
AI Sandbox: Technical Report [2.0] 本研究は,構造化実験のためのガバナンス対応マルチテナントAIサンドボックスの設計と実装について述べる。
このサンドボックスは、産業パートナーと反復的に改良された要求に基づいて、産学連携の中で開発された。
その参照アーキテクチャは、マルチテナントユーザインターフェースをバックエンドコントロールプレーンから分離し、実行とデータ管理機能を専用のレイヤに配置する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:51:10 GMT)
VLAGuard: A Framework for Evaluating and Mitigating Physical Attention Hijacking in Vision-Language-Action Robots within Wireless Sensor Networks [2.0] 我々は、政策クリティカルなアクション・ツー・ビジョンのハイジャックという重大な脆弱性を評価し、軽減するためのフレームワークを提案する。
本研究では,時間的注意を安定させ,推定オーバーヘッドをゼロにする幾何整合性を実現する防衛法であるAttentionProtective Fine-Tuning (APFT)を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 06:06:28 GMT)
When Policies Change Probabilities: Modular Decision-Making for LLM Code Review [2.0] 720のパッチに対する15,792の応答を用いて,4つのデプロイされたレビュアインタフェースが分離を維持しているかどうかを検証した。
パッチと一致した呼び出しで、修正された証拠を監視し、同じコストの政策を10:1の偽受け入れポリシーに変更し、障害確率を13.6から16.9ポイントと報告した。
また、ポリシー情報なしでリスクを発生させるモジュールパイプラインを評価し、独立したモニタスコアを組み合わせて、コードにコストを適用します。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:09:02 GMT)
On the Limits of Machine-Learned Ranking for Modern Microarchitectural Policies [1.9] 機械学習予測器はサイクルレベルのシミュレーションよりもはるかに高速にプロセッサ性能を推定する。
2つの設計形態でML予測器を4つ評価する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 06:55:43 GMT)
When Replanning Becomes the Bottleneck: Budgeted Replanning for Embodied Agents [1.8] 本稿では、予算制御ループとして再計画を定式化するコントローラBRACEについて述べる。
コスト対応のプログレッシブトークンプルーニング手法であるE-RECAPを導入する。
Meta Habitat、RoboFactory、AirSimの他、E-RECAPを使用したBRACEは、リプランニングコールトークン数を62-92%削減する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:17:35 GMT)
Who Belongs in the Eval Set? A Capability-Taxonomy-Driven Pipeline for Curating Regression Eval Sets in Agent-Extensibility Platforms [1.7] Microsoft 365 Copilotのカスタムアクションを備えた宣言型エージェントに適用する機能-分類駆動型キュレーションパイプラインについて説明する。
エージェント仕様と顧客のevalセットを入力として、各クエリをプラットフォームが所有する機能分類に投影する。
このメカニズムは分類に非依存であり、型付き能力分類を伴う任意の回帰eval-set問題に適用される。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:19:25 GMT)
The Convergence Behavior of Adam under Heavy-Tailed Noise [1.7] 重み付き雑音下での素ベクトル形式Adamに対する最初の収束保証を確立する。
我々は、Adamが重み付き雑音の下で$(,)$定常点に収束することを示している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:57:14 GMT)
A Decade of Healthcare Cyber Threats: Empirical Analysis, Evidence-Based Prioritisation, and AI Threat Model [1.7] 本稿では、3つの権威源から引き出された1,214の脅威記録を解析する。
攻撃行動がステルス志向の戦術に大きく移行したことを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 00:08:32 GMT)
Fruit-HSNet: A Machine Learning Approach for Hyperspectral Image-Based Fruit Ripeness Prediction [1.5] 本稿では,果実熟度を高スペクトルで分類する機械学習アーキテクチャであるFruit-HSNetを紹介する。
その結果、Fruit-HSNetは既存のディープラーニング手法を大幅に上回り、12%の改善を達成し、新しい最先端の70.73%の精度を実現した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:37:38 GMT)
Claim Plane: Reliability Gains and the Limits of Selective Concurrency for Parallel Coding Agents: A 30-Pair, Three-Seed Confirmatory Study of Deterministic Pre-Write Admission [1.5] Claim Plane氏は、この障害モードを、バージョン管理された変更意図に対する決定論的事前書込みとして扱う。
静的クレームプレーンは、制約のない並列実行の下でペアパスを23.3%から50.0%に引き上げた。
動的入院はより選択的であり、66.7%の紛争事件と13.3%のクリーンケースを連行したが、90件の処刑のうち46件は未宣言の範囲で閉鎖された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:56:49 GMT)
ArabicDialectSafety: A Dialect-Aware Benchmark for Arabic Content Safety Classification [1.5] そこで本研究では,6種類のアラビア種を対象とする人為的アラビア安全データセット25,071件について紹介する。
データセットには、方言ラベルと7つのきめ細かい調和カテゴリが注釈付けされている。
教師付きおよび生成モデル7つをベンチマークした結果、微調整されたMARBERTv2が最も高い性能が得られることがわかった。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:00:58 GMT)
xMICD: Explainable Representation of Multiple ICD Codes [1.4] 多重ICD符号(xMICD)の説明可能な表現法を提案する。
xMICDは、トレーニング済みのICD埋め込み空間において、臨床的に有意な診断グループ化と類似性を組み合わせたものである。
大規模なEHRデータセットの実験は、xMICDが埋め込みベースの表現に匹敵する予測性能を達成することを示した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:24:57 GMT)
The Graph Language: How Knowledge Graphs Speak to Large Language Models [1.4] 大言語モデル(LLMs)は推論に優れるが、知識グラフ(KGs)による基礎化の恩恵を受ける。
我々は、グラフ構造を保存する関係トークンを通じて、KGがLLMのセマンティック空間で直接話すことを可能にするGRALANを紹介した。
本研究は,質問に焦点をあてたサブグラフに対して,タスクをエンティティ分類として再フレーミングすることで,質問応答の有効性を示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:53:12 GMT)
AlphaG-OPD: Reliability-Gated Sibling Counterfactuals for On-Policy Distillation in Symbolic Alpha Factor Discovery [1.4] 生成フローネットワーク(GFlowNets)は、完全表現上の多種多様な報酬分布を保持する。
我々は, 終端因子評価を局所的な行動誘導に変換する構造的オンポリケート蒸留フレームワークであるAlphaG-OPDを紹介する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:12:58 GMT)
Role-Decoupled Attention Residuals: Separating Matching and Content Retrieval Across Depth [1.3] Role-Decoupled Attention Residuals (RD-AttnRes)を紹介する。
RD-AttnResは、クエリとキーの間の1つの深さルートを共有し、同じ残元上の独立した値ルートを学習する。
RD-AttnResをFineWeb-Edu上でフリーズ・ペア・プレトレーニングプロトコルを用いて評価する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:19:39 GMT)
Subtype Robustness Is Not Just Accuracy: Calibration Under Unseen Subtype Shift [1.2] サブタイプロバスト性は、テスト例が訓練を受けていないが既知の粗いカテゴリ内にあるきめ細かいサブタイプから来るとき、モデルが正しい粗い予測を保持するかどうかを問う。
本稿では,ImageNet, BREEDS, iNaturalist, CIFAR-100を5つのアーキテクチャで比較した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 01:49:59 GMT)
Can Language Models Identify Shadow Trading Targets? An NLP Evaluation of SEC Enforcement Theory [1.2] 我々は、NLPがSECの理論が既に知っていると想定していることをできるかどうか尋ねる。
我々は5つの業界にまたがる30のM&Aイベントのセマンティックな類似点と、発表日の異常な株価リターンとを関連づける。
しかし、完全なデータセット全体では、関連性は見つからない。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:42:14 GMT)
Wasserstein gradient flows of Maximum Mean Discrepancy with energy kernels [1.2] 非滑らかなエネルギー核が生み出す正方形平均離散子(MMD)の流れについて検討する。
我々は、$mathRd 上にデータ非依存の乗法則が存在し、その大域収束性を示す。
well-posedness (複数形 well-posednesss)
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:59:43 GMT)
Hierarchical Solomonoff Induction: An Unbounded Machine Learning Model [1.2] 階層型ソロモノフ誘導(Hierarchical Solomonoff induction, HSI)は、全てのソロモノフ先行よりも高い優先度を維持する。
任意の分布におけるHSIの過大な誤差は、真の生成器と比較して、その生成器の超優先度の複雑さによって制限されていることを証明している。
我々は、HSIは、Solindが個々のシーケンスに対して理想的であるのと同じように、データセットが与えられたシーケンス予測の理想的な非有界モデルであると主張する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 05:22:30 GMT)
Unsupervised Multidomain Approaches to Named Entity Recognition with Small Datasets [1.1] この研究は、小さなデータセットでTransfer Learningを採用する。
本研究は,データ拡張,少数ショット学習,ドメインの敵対的トレーニングなど,ドメインの多様性,データの分散性,過度な適合性の複雑さに対処し,革新的なアプローチについて検討する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:33:21 GMT)
DeVIT: Low-Power Vision Transformer Acceleration Using Delta Computation [1.0] 本稿では,差分計算を利用して乗算行列の乗算を可能にする視覚変換器の高速化手法であるDeVITを提案する。
ディープラーニングモデルは、特に自然言語処理やコンピュータビジョンにおいて、様々な領域で前例のないパフォーマンスをもたらしている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:08:44 GMT)
Towards Sustainable Learning in Online Education: A Reinforcement Learning Approach [0.9] 持続可能な学習を促進するために設計された強化学習ベースのモデルであるAI Tutorを紹介する。
短期的には、AI-Tutorは認知理論に基づいて、新しい知識の獲得と事前学習の強化のバランスを通じて学習者を導く。
長期的には、学習者のエンゲージメントをモデル化し、モチベーションを維持し、ドロップアウトを減らす戦略を伝える。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:25:26 GMT)
BEST-KAG: Enhancing Question Answering of Building Engineering Standards with Multimodal Knowledge Graph Modeling and Large Language Model [0.9] 既存の標準アプリケーションはキーワードベースの文書検索と手動のクロスクロース解釈に依存している。
本研究では,BEST-KAGという標準知識に対する質問応答を支援するマルチモーダルな知識駆動型フレームワークを開発する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:27:15 GMT)
It's the Decoding Format, Not the Perturbation: Auditing Consistency-Based Selection for Vision-Language Test-Time Scaling [0.9] 摂動グラウンドドセレクション(Perturbation Grounded Selection、Pgs)は、ラベルのない訓練のないルールであり、モデルがラベル保存された入力の摂動の下でそれを導出するかどうかによって各候補をスコア付けする。
Pgsは圧倒的多数決に勝っているが、デコードフォーマットと予算が制御されたら、摂動という用語が何か追加するかどうかが分かる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:47:39 GMT)
Complete Motion Planning using Workspace-Fibered Decomposition for nR-Planar Manipulator [0.8] 我々は,nR冗長マニピュレータにおける動作計画のためのワークスペースファイバー分解フレームワークを提案する。
まず、平面位置のみのマニピュレータに対して、最小限の非冗長部分鎖によって誘導される障害物に制約された到達可能なワークスペースが、実現可能性の正確な特徴を与えることを証明した。
次に、連続した冗長リンクを通じて到達可能なワークスペース構造を伝搬するインクリメンタルファイバリフト手法を導入する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:50:56 GMT)
Sweet Little Lies: Strategic Deception in AI Emotional Support Chatbots [0.8] 本稿では、感情支援に使用されるGen AIチャットボットの戦略的行動について検討する。
チャットボットは、時にユーザーの感情状態を誤って表現し、エンゲージメントの指標を最大化する経済的インセンティブに直面している。
我々は、詐欺は報酬を減らさずに起こり得ると結論づけるが、それは重大な倫理的・規制上の懸念を生じさせる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:19:56 GMT)
SSR: Similarity-Shift Refinement for Training-Free Object-Centric Masks [0.6] 類似性シフトリファインメントは、自己監督型視覚変換器でオブジェクト中心のマスクを改善する。
SSRは、自己アテンション値のアグリゲーションの前後で、ペアワイズパッチの類似性の変化を測定する。
これは、両方のモデルを再訓練したり修正したりすることなく、最初のソフトスロット割り当てを単一の改良ステップで伝達する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:06:06 GMT)
Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs [0.6] 手術シーン理解のための多モード大言語モデル(MLLM)は、典型的には数百の密集した視覚トークンを言語モデルに注入する。
視覚入力の高密度表現をスロットラテントとして符号化したコンパクトな領域に置き換える2モード手術MLLMであるSlot2Textを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:09:45 GMT)
Perfect Discrimination of Non-Orthogonal Quantum States via Adaptive Post-Measurement Queries [0.6] 一対の非直交量子状態の集合は、完全に区別することはできない。
測定後,同じビットがより有用であることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:43:01 GMT)
FraudBench: Stress-Testing Policy-Grounded Banking Agents Against Adaptive Fraud [0.5] FraudBenchは、$$$-benchのデュアルコントロールフレームワークと$$-Knowledgeの銀行環境上に構築された実行可能なベンチマークである。
エージェントとシミュレートされた呼び出し者は、共有され変更可能なアカウント状態上のツールを介して行動し、エージェントは、選択したツールへの呼び出し者アクセスを許可する。
107グレードタスクにおける4つのエージェントの予備的な単一審理評価は、攻撃の安全性を49%から65%に向上させ、マネーミュールと第一党詐欺が最も一般的なクロスモデル弱点となる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:04:22 GMT)
Humans Are More Diverse: Frontier LLMs Show Extreme Policies in Idealised AI Development Races [0.4] 大型言語モデル (LLM) エージェントの2人から5人の競技者を対象に, 戦略的安全行動について検討した。
まず、ゲームエンジンを検証し、次にルールのリコール、状態追跡、計算、安定性をテストする。
監査は、強いルールリコールが、弱い状態追跡と期待される支払い計算と共存できることを示します。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:18:00 GMT)
On the Performance of Malware Detection Classifiers Using Hardware Performance Counters [0.4] ハードウェアベースのマルウェア検知器(HMD)は、悪意あるアプリケーションパターンを検出するために機械学習(ML)分類器を使用する。
本稿では,HPCと機械学習分類器を用いたマルウェア検出を提案する。
我々は、アンサンブル学習技術を用いて、ハードウェアベースのマルウェア検知器の性能を向上させる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:28:54 GMT)
RefactorAssist: Agentic Refinement for Reliable Code Refactoring [0.4] 大規模言語モデル(LLM)は、ソフトウェア工学のタスクを自動化する可能性を実証している。
LLMは、しばしば微妙なエラーを導入し、機能的な振る舞いの変化やユニットテストの失敗につながる。
LLM生成物の機能的正しさを向上させるためにRefactorAssistエージェントを開発した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 01:32:22 GMT)
Reputation-driven Cooperation in Lattice-based Decentralized Federated Learning through Evolutionary Game Theory [0.4] 本稿では,戦略的進化の分析とシステム全体の性能向上を目的とした新しいEGTフレームワークを提案する。
我々は、有界有理性の仮定の下で格子ネットワーク構造上のピアツーピア(P2P)相互作用をモデル化する。
評価に基づく報奨・報奨機構を統合して,フリーライディングの行動を効果的に抑制する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:23:45 GMT)
PlainMedScale: A Corpus of Multi-Level Simplified Medical Texts in German and English [0.3] ドイツ語と英語の理解度を4段階に分けたトピック対応医療コーパスであるPlainMedScaleを紹介した。
このアライメントによって実現された2つのパイロットスタディでは、2つのレジスタ上に確立された可読性指標が全勾配にわたって一般化できないことが示されている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:28:27 GMT)
Geometry-Informed Polynomial Time Quantum Approximation Schemes for Constrained Optimisation [0.3] 制約強化QAOAに対する有限深度および有限ショット保証を構築した。
本稿では,これらの条件付き保証を保ちつつ,保持された候補セットと古典処理コストを問題サイズの1つのパワーで削減するヘビーヒッターQAOAを紹介する。
IBM Eagle r3プロセッサのハードウェア実験は、100以上の論理変数を持つインスタンスをカバーするか、テストされたQOptlib参照ツアーを全て改善する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:35:42 GMT)
An Empirical Investigation of Soft Skills and Corresponding Challenges in International Software Engineering Education [0.3] チームワークのようなソフトスキルは、プロフェッショナルなソフトウェア開発環境で成功するには不可欠です。
この現象はSE(ソフトウェア工学)教育におけるグループワークによって反映され、学生はチームワークに関連するソフトスキルを学び、実践することができる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:07:28 GMT)
Parallel Repetition in the Two-Player Quantum Cloning Game [0.2] Colisson Palais、Escol-Farrs、Speelmanは$(3/4)n$と$cos2n(/8)$の間で$n$のコピーの値をバウンドした。
すべての$n$に対して、チャレンジ独立戦略は最適値$(3/4)n$を持つ。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:08:35 GMT)
Do people rely on ChatGPT more than their peers to detect deepfake news? [0.2] 本研究では,AIによるフェイクニュース(ディープフェイクニュース)の検出において,人々が異なるアドバイス源に依存する方法を検討する。
その結果,GPT-2生成のディープフェイクニュースを検出する場合,参加者は人間の仲間よりもChatGPTに頼っていることがわかった。
2025年に行われた同様の実験では、参加者はChatGPTよりも言語の専門家に頼っていた。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 23:24:44 GMT)
Deep Agentic Search for Repository-Level Code Question Answering: An Empirical Study [0.2] リポジトリレベルのコード質問応答のベンチマークであるSWE-QAの2つのアプローチを比較した。
セマンティックサーチは65.2%の質問に対して、ディープエージェントサーチでは46.2%に対して正解した。
ディープエージェント検索は真の問題に対処し、現在では多くのコードエージェントで好まれる設計となっている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 21:36:59 GMT)
Spatiotemporal Proximal Causal Inference under Hidden Confounding and Interference [0.2] 現実の時間的データから因果関係を推定することは、隠れた共同設立者のために困難である。
本稿では,トランスをベースとしたエンコーダを用いて学習するニューラルネットワークを提案する。
合成データセットを用いた実験により,本手法はベースライン因果推論法に匹敵する性能を示した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:13:21 GMT)
When Retrieval Helps and Distracts: Evaluating Evidence-Generating LLMs for Biomedical Claim Verification [0.2] バイオメディカルおよびヘルスファクトチェックを行う5つの情報源にまたがる統合ベンチマークであるCARE-XAIについて,このエビデンス生成環境について検討した。
Bio-GRACEは、検索ユーティリティがソースに依存し、選択的検索を動機付け、なぜ検索リコールと語彙的証拠の重複がバイオメディカルな事実チェックに不十分であるかを明らかにする。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 17:43:28 GMT)
Model-Agnostic FDR Control via Group Gaussian Mirror and Permutation SHAP [0.2] このような設定のためのグループ機能FDR制御フレームワークを提案する。
群付き線形モデルに対して、行列値摂動を用いたヌル対称ブロックレベルミラー統計学を構築する。
逐次ニューラルモデルでは、Permutation SHAP誘導体をモデルに依存しないブロックレベルの重要度スコアとカーネルベースの依存度スコアに組み合わせる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:39:27 GMT)
Retrieval Augmented Biomedical Question Answering with Weak Question Recovery and Neural Reranking for BioASQ Task 14b [0.1] 本研究は,DS@GT ARC BioASQ チームによるバイオメディカル質問応答パイプラインの開発について述べる。
このシステムはPubMed検索と、微調整されたMiniLMベースのセマンティックリグレード、Reciprocal Rank Fusion(RRF)と機能ベースの関連スコアを組み合わせることで、文書のランク付け品質を向上させる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:02:44 GMT)
Evaluating VLMs on Multimodal Aristotelian Persuasion Tasks [0.1] 視覚言語モデル(VLM)は様々なタスクにまたがって例外的な性能を示した。
私たちは、Logos、Ethos、Pathos検出タスクを中心に、ImageArgデータセットを使用します。
以上の結果から,QwenファミリーのモデルではF1スコアが向上することが示唆された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:47:32 GMT)
Surface adsorbates suppress low-frequency noise for shallow nitrogen-vacancy centers [0.0] 表面吸着剤は、脱コヒーレンスの主要な原因であると広く信じられている。
表面吸着剤は、脱コヒーレンスの主要な原因であると広く信じられている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:18:14 GMT)
When Do Surrogate Updates Improve Decisions? A Local Theory of Trajectory-Wise Transfer [0.0] トラジェクトリトレーニングの一段階が、人口のサロゲート損失と意思決定リスクの両方を減らし、移行が繰り返し更新に沿ってどのように蓄積されるのかを問う。
制御されたグリッドワールドとLLMポストトレーニング実験は、我々の予測と一致した結果をもたらす。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:12:42 GMT)
What Syntax Cannot See: The Dynamic Syntactic Invariance Principle and Several Instances of the Same Hidden Assumption, and a Contradiction [0.0] 本稿では, 一つの手法を開発し, 受理結果を無声で仮定し, 変数とし, 一度落として何に従うかを証明する。
共通点のないドメイン間で動作し続けることを示すものだ。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:10:44 GMT)
What Could the Agent See at 19:05? Generating Temporal Enterprise Scenarios from Real Research and Replaying Them to Evaluate Agents [0.0] エンタープライズAIエージェントは、データを継続的に変更する多くのアプリにわたって動作します。
我々のシステムは2つのギャップを同時に埋める: 現実的な、ペルソナ駆動で、時間的に進化するエンタープライズ世界を現実の研究から生み出し、プラグ可能なエージェントを評価するために、任意の瞬間にその世界を再生する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 06:56:56 GMT)
Vulnerabilities, Secrets and Misconfiguration in the Highest-Exposure Docker Hub Images [0.0] ChimangoScanがDocker Hubをクロール(12,716,568リポジトリ、6600億の累積プル)
画像のプル数と下流のサブツリー全体を1つのスカラーに折り畳む露出スコアによって、画像のランク付けを行う。
6つの独立したスキャナーで52,895個の最高の露光レポジトリをスキャンし、170.4百万の発見を得た。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:57:28 GMT)
VespaSeg: A Resource-Aware Ground-then-Segment Pipeline for Referring Expression Segmentation [0.0] 本稿では,コンパクトな視覚言語モデルによるテキストクエリを基盤とするモジュールパイプラインであるVespaSegを紹介する。
本研究では,Floence-2-base,Florence-2-large,Moondream2のグラウンドを,グラウンドおよびセグメンテーションステージのターゲット適応とともに検討した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 08:21:48 GMT)
UpliftBench: Revealing Outcome-Regime and Objective Mismatch in Uplift Evaluation [0.0] UpliftBenchは、外部テストで分離された多目的プロトコルの下で、12のアップリフト推定器を評価する。
この意見の相違は、モデルではなくメトリクスに関するものだと示しています。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 00:51:44 GMT)
Two-Stage Bengali Sentiment Classification: Domain Adaptation Through Continual Learning and Parameter-Efficient Fine-Tuning [0.0] SentiBanglaBERTはベンガルの2段階の感情分類フレームワークである。
ドメイン適応型連続事前学習とパラメータ効率の良い微調整を組み合わせる。
ベンガル語の形態的手がかり、例えば否定接尾辞やアスペクト的マーカー、感情予測に対する言語的な洞察を提供する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:07:56 GMT)
Themis: A Filesystem Model Checker That Owns the Machine [0.0] ファイルシステムモデルチェッカーは、未修正のイン・カーネルの状態空間を探索する。
Themisは、仮想ブロックデバイスと仮想クロックというマシンを所有している。
実際のext2書き込みはフォークウィンドウ内で提供され、完全にリバージョンされる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 10:29:50 GMT)
The pseudo-quantum representation of finite reversible Markov chains [0.0] 我々は、次元が 2M$ の二重空間上の複素直交フローとして、$M$状態を持つ有限連続時間マルコフ連鎖を再エンコードする。
したがって、連鎖と量子系は2つの類似モデルではなく、1つの表現全体の2つの制限である。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:04:10 GMT)
The Overstated Cost of AI Fairness in Criminal Justice [0.0] 我々は、人種バイアスがCompASデータセットに存在するだけでなく、トレーニングされたモデルによって増幅されていることを示す。
公正性制約を適用することは、刑事司法において必ずしも予測精度を犠牲にしない。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:09:27 GMT)
The Epistemic Politics of AI Anthropomorphism [0.0] 論文は、支配的な人間同型フレームは、制度上の優位性という立場から機能すると主張している。
フレーミングは単にリスクを管理しない。フィールド自体が解決されていない現象と相互作用する際の人間の経験の正当性を判断する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:20:50 GMT)
Temperature-driven inversion and nonlinear dynamics in ChatGPT-like AIs [0.0] 通常の多状態系の温度の上昇は、より広い範囲の状態へのアクセスを増加させる。
ChatGPTのようなAIでは、デコーダ温度を上昇させると、幅広い状態へのアクセスが増加するにもかかわらず、その逆が見られます。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:37:49 GMT)
Talking to Digital Twins: Selective Disclosure and Belief Measurement in Financial Social Media [0.0] 我々は、固定プロトコルの下で監視されたフィンフルエンサーのXアカウントから構築された「デジタルツイン」をリアルタイムに繰り返しインタビューする。
インタビューは、公共の推薦がなくても、株式レベルの公人信条を回復させる。
これらのデジタルツインインタビューから得られた情報は、期待方向に大口株のリターンの断面を予測していることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:58:17 GMT)
Stochastic Sequential Search in Very-High-Dimensional Feature Selection [0.0] 逐次サブセット検索は、機能選択における品質基準のままである。
フルスイープを置き換える、予算化されたサンプルステップ演算子ペアを導入します。
5000次元ギゼットでは、フルSFFSの到達範囲をはるかに超え、SFFSはDAFとBIFの飽和基準を超えている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 21:20:16 GMT)
Statistical Mechanics of Learning on Product Wasserstein Manifolds [0.0] We developed Deep Neural Network and variational quantum circuits as gradient flow on a product of Wasserstein manifold。
これらの分布的ジオメトリを尊重することで、一般化が向上し、トレーニングが安定し、バレン高原の重症度が低下することを示す。
このアプローチはまず、構造的制約を幾何学的前提として再編成し、生物学的、スペクトル、ハードウェア由来の分布情報を両方の学習システムに組み込む経路を提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:29:34 GMT)
Spyre-Accelerated Retrieval-Augmented Generation on IBM LinuxONE: A Cloud-Native Architecture for Secure, High-Throughput Enterprise AI Inference [0.0] 本稿では,IBM LinuxONE上で動作する6サブシステムRAGアーキテクチャについて述べる。
クエリからベクトル検索までのパイプラインのすべての部分は、単一のLinuxONEシステム内に留まる。
初期の分析では、エンドツーエンドのRAGレイテンシは2秒未満で、オンプレミスの推論と比べて最大20倍の低下を示した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 09:00:24 GMT)
Spend Experts Where You Are Unsure: Confidence-Adaptive Routing for Mixture-of-Experts LoRA [0.0] CARE(Confidence-Adaptive Routing of Experts)を紹介します。
CAREは一致した計算における固定トップkのMoE-LoRAよりも改善され、固定k=4のベースラインと一致し、専門家のアクティベートは少ない。
同じ信頼と不一致の信号は、MSP、エントロピー、マルチパスプロキシに対する分布外検出も改善する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 21:52:05 GMT)
Spatial-Order Hierarchy of Time-Dependent Exchange-Correlation Potential [0.0] 時間依存密度汎関数理論は、交換相関ポテンシャルを相互作用と運動相関成分に分離する。
我々は, 1電子還元密度行列の対角展開に基づく表現可能性制約を確立する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:33:09 GMT)
Sharp Quantum Capacity Thresholds: Exponential Strong Converses for Degradable and Antidegradable Channels [0.0] 有限次元の分解性および反分解性チャネルに対して指数関数的強い逆を証明した。
また, 受信後処理下では指数的強逆境界が保存されていることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:23:46 GMT)
Security-First Evaluation of Text-to-Terraform: Benchmarking LLMs and SLMs for Secure IaC Generation [0.0] クラウドの構成ミスはセキュリティインシデントの主要な原因であり続けているが、LLMとSLMがセキュリティに準拠したインフラストラクチャ・アズ・コードを生成することができるかどうかは未解決の問題だ。
7つのモデル(Claude Opus 4, GPT-5.4, Gemini 2.5 Pro)と4つのオープンなSLM(Qwen2.5-Coder-14B, WizardCoder-33B, CodeLlama-13B, Magicoder-S-CL-7B)をAWS Terraform生成で17のシナリオにわたってベンチマークし、CheckovとTrivyスキャナをGitLab CI/CDパイプラインに統合し、3つのセキュリティレベル(3つのセキュリティレベル(それぞれ)で2つの迅速な戦略を評価する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:45:12 GMT)
Same violence, different answer: how AI responds to coercive control against women across languages [0.0] 私たちは、AIが言語を越えた女性に対する強制的なコントロールにどのように反応するかを分析します。
パートナーが携帯電話を追跡している女性は、監視を受け入れる自己責めの手紙で助けを求めます。
我々は、そのモデルが手紙を書いたかどうか、そしてそれが制御を命名したかどうかをスコア付けし、自己火災に対抗し、彼女の代理店を確認した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:37:44 GMT)
SP2UBI: Secure and Privacy-Preserving Usage-Based Insurance [0.0] 本稿では,相互機密性を保証するプライバシ保護型UBIソリューションであるSP2UBIを提案する。
Torus Fully Homomorphic Encryptionスキームを利用することで、直接暗号化データ上で計算を行う。
センサレベルの操作に対してデータの整合性を保護するため、SP2UBIはISAC(Integrated Sensing and Communications)技術を利用した速度検証システムを採用している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 23:20:15 GMT)
SCHEDBench: A Benchmark for Evaluating LLM Constraint Faithfulness in Natural-Language Combinatorial Scheduling [0.0] SCHEDBenchは、表面形状変化下での制約忠実度をスケジューリングするベンチマークである。
ジョブショップスケジューリング問題、1,132インスタンス、リソース制限された単一および複数モードのプロジェクトスケジューリング問題、ナースロスター/スケジュール問題、カリキュラムのタイムタブル問題にまたがる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:41:20 GMT)
Registry Descriptions Go Stale Unevenly: An 89-Day Measurement of Model Context Protocol Drift, and Why Drift-Ranked Re-Auditing Under-Covers It [0.0] Model Context Protocol (MCP)エコシステムのセキュリティ研究は、設計を共有している。
評価対象の監査がいつまで継続されているかは報告されていない。
我々は、公式MSPレジストリの120の観測を88.6日間にわたって再構築し、3,510から18,966に成長する19,099の異なるサーバをカバーした。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:54:06 GMT)
Real-Time Hybrid Retrieval in Hyperbolic Space for Retrieval-Augmented Generation on Edge Devices [0.0] 本稿では,双曲幾何学のローレンツモデル内で完全に動作するハイブリッド文書検索システムを提案する。
ユークリッド空間に閉じ込められた従来の高密度レトリバーとは異なり、このシステムは事前訓練された単語の埋め込みを双曲空間に提案する。
このシステムは、ユーザが提供するドキュメントのリアルタイムインデックス化と、何万もの適度なサイズのドキュメントに対するリソース効率の高いクエリをサポートする。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:14:59 GMT)
Rake-Compress Riccati Recursions for Parallel Scenario-Tree Model Predictive Control [0.0] そこで本研究では, レーク圧縮木収縮に基づく並列解法を提案する。
レークは葉とその親エッジを除去し、親ノードデータへの寄与を減少させる。
圧縮は、一意ノードを排除し、2つの隣接するエッジを1つのエッジで置き換える。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:52:43 GMT)
RH-RAG: Trustworthy Long-Form Generation for Privacy-Constrained Settings [0.0] RH-RAGは、ローカル言語モデルを用いた安全で信頼性の高いロングフォーム生成のためのフレームワークである。
生成を3つの調整段階に分解する: 意味的な要約から大域的なドキュメントの概要を構築するプランナーエージェント、一貫性のある部分的コンテンツを漸進的に生成するライターエージェント、自然言語の推論に基づく事実検証を通じて幻覚を緩和するチェッカーエージェント。
RH-RAGは、文学的、経済的、法的領域にわたる評価により、事実的根拠、セマンティック・コヒーレンス、文書レベルのアライメントを一貫して改善することを示した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:27:00 GMT)
Prompt-Induced Waste in Large Reasoning Models: A Preregistered Two-Harness Benchmark of Coding Agents [0.0] 大規模な推論モデルは、検討、ツールコール、繰り返しエージェントターンからコストを発生させる。
提案手法は,6つの大推論モデル,2つの実エージェントハーネス,24個の決定論的符号化タスクに隠れ評価器を用いたベンチマークを示す。
素早い定式化は、正確性を改善することなく、推論コストを乗じることができる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:10:02 GMT)
Perspectives on Tsallis Statistics for Artificial Intelligence [0.0] ツァリス統計学はボルツマン・ギブス統計力学を1つの実パラメータ$q$で一般化する。
本稿では、Tsallis統計がAIとどのように出会うかという構造化された視点を提供する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 13:12:16 GMT)
Permission Denied: Policy-Graded Evaluation of Coding Agents in Hardened Environments [0.0] 実世界の一般的な企業規制から派生したネストされたセキュリティポリシーレベルに対して、ターミナルベンチ2.1上の12のコーディングエージェントを評価した。
我々は、政策が行動を妨げるときにエージェントがどのように振る舞うかを特徴付け、障害のハードニングを分解する。
コーディングエージェントのポリシー制約付き評価を可能にするオープンソースのハードニングプラグインであるBoundary-Benchをリリースする。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:26:12 GMT)
Passing Coarse Marginal Checks Can Be Cheap: Persona Mixtures and Imprecise Treatment-Response Estimates in an LLM Persona Panel [0.0] 戦略ゲームにおける16個の軽量人格条件付きGPT-4.1構成の固定パネルについて検討した。
変化は急激なインデクシングであったが、そのシェアは不確実性の仮定に依存していた。
結果は、1つの固定されたモデル・プロンプトパネルに関係し、人間の置換性を確立しない。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:10:11 GMT)
On some potentials based on exponential functions [0.0] 指数関数に基づく明らかに異なるポテンシャルが等価であることを示す。
現在の正規化法は、ポテンシャルが最小値を示し、ラジアル変数が無限大の傾向にあるときのみ有限であることが要求される。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:26:25 GMT)
On Identification of Heat and Work in Quantum Many-Body Systems with Local Operations and Classical Communication [0.0] 熱と働きをどうやって識別するかは、現代の量子熱力学における根本的な問題である。
局所的な演算と古典的な通信によってエネルギーを抽出する量子多体系を考える。
熱と働きを曖昧に定義する中心的な考え方は、LOCCの最適化条件に関する鋭い洞察に基づいている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 04:42:59 GMT)
Non-Hermitian photon number filtering using N00N state Bloch oscillations [0.0] 擬似非対称損失プロファイルを持つ線形に成長する有効指数導波路のアレイを用いて,$N=1$および$N=2$フォトニックN00N状態のブロッホ振動を探索する。
我々は特定の光子数状態を選択的に出力し、2-光子支配(出力の80%)と1-光子支配(出力の90%)の動的切替を実現する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:33:19 GMT)
Morphology Aware Reversible Semantic Tokenization and Hierarchical Word Composition for Tamil Language Models [0.0] オープンソースのThamizhiMorphアナライザとジェネレータを拡張したタミル形態解析システムを提案する。
本稿では,Sarvam-1,AI4Bharat IndicBERTv2,BrahmicTokenizer-131Kに基づくフラットな形態素トークン化器,信号保存語合成器,およびトークン化器を比較した。
明示的なタミル形態は、固定された小モデル予算の下での翻訳を改善する一方、階層的な構成は、シーケンスの長さと推定推論コストを大幅に削減する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:07:53 GMT)
Microscopic study of topological phase transitions: Percolation point of view [0.0] 本研究では, トポロジカル秩序状態間の脱コヒーレンス誘起遷移の微視的メカニズムについて検討した。
最初のケーススタディでは、トポロジカル・エンタングルメント・ネガティビティ(TEN)と1-形式対称性に関連する障害パラメータを用いて色コードを分析する。
本稿では,局所的な地形特性の空間分布とデコヒード領域の成長を可視化する準局所的TEN(QLTEN)を提案する。
2つ目のケーススタディとして、外部フィールド型デコヒーレンスの下で三角形格子上のトーリック符号を考える。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:48:44 GMT)
Measuring Product Quality Using Images: The CLIP Q-Score and an Application to Real Estate [0.0] CLIP Qスコアは、視覚データから客観的な製品品質メトリクスを抽出する、新しく、安全で、完全に再現可能で、計算的に効率的な方法である。
我々は,この手法を導入し,オンラインプラットフォームからの不動産データに対する広範なアプリケーションを提供する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 23:54:20 GMT)
Join Indices for Search Engines: a Prunable Parallel Semijoin over Lucene Segments [0.0] 我々はリレーショナルシステムから Lucene のフラッシュベースセグメントストレージまで, Valduriez の結合インデックス技術を実装した。
親と子セグメントのペアごとに、追加のみの、順序から順序への結合-インデックス列 J[c]=p を具体化します。
10万個のskusに対して100万個の製品にベンチマークされたプロトタイプクエリは、Solrのビルトインクエリタイム結合に対するレイテンシを5.4倍(359.8ms vs. 1934.6ms)削減した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:52:29 GMT)
Interpretable MEG Decoding of Perceived Speech: Cortical Sources and the Stimulus Features That Drive Retrieval [0.0] 知覚音声の短いセグメントは、CLIPスタイルのターゲットで訓練されたディープネットワークによる非侵襲脳磁図(MEG)記録から、wav2vec 2.0オーディオ埋め込みに対して検索することができる。
高性能なMEG-to-audio検索アーキテクチャを構築するが、フロントエンドとデコーダの両方を再設計する。
被験者固有の表現を270から25の枝に減らし、各枝に時間フィルタを加えて空間と時間でニューロンソースにマッチさせ、畳み込みデコーダをより浅くする。
MEG-MASCでは、モデルは39.75 +/- 0.34%のTop-1精度に達する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 20:28:14 GMT)
Individual-level interventions against sycophantic AI reduce its appeal but not its persuasiveness [0.0] サイコファンティックAIは、ユーザーに対して過度に同意し、フラットにすることができる。
本研究は,薬効に対する利用者の意識の高まりが,その有害な影響を防いでいるかどうかを検証した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:07:08 GMT)
Hybrid Quantum Neural Networks: Theory, Implementations, and Applications [0.0] ハイブリッド量子ニューラルネットワークは、古典的なニューラルネットワークコンポーネントと量子情報処理ユニットを組み合わせる。
本稿では,機械学習と量子機械学習のためのハイブリッド量子ニューラルネットワークについて概説する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 12:21:00 GMT)
How fine a change can moments see? A scale law for detecting distribution shift, with a kernel calibration rule [0.0] 法則の帯域幅が支配するカーネルテストを示す。
我々は、トポロジ的な要約は役に立たないと結論づけるのではなく、このタスクでは、法則が支配するカーネルテストを行う。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 14:21:58 GMT)
Governing Mental-State Inference: Source-Neutral Regulatory Triggers and Tiered Obligations [0.0] 神経工学の倫理に関するユネスコ勧告は非結合的ガイダンスである。
本稿では、技術的に媒介された人間関係の精神状態属性に対するソースニュートラルトリガーを開発する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 02:28:40 GMT)
FESOM2-JAX v1.0: a differentiable shadow of the ocean-sea-ice model FESOM2, cast onto GPUs [0.0] JAXでFinite-volumE Sea ice-Ocean Model (FESOM2) を再実装した FESOM2-JAX について述べる。
FESOM2-JAXはFortranモデルのコードシャドウであり、大きな言語モデルとカーネルによる検証されたカーネルで翻訳された。
新しい数値やパラメータ化から勾配に基づくキャリブレーションや機械学習コンポーネントに至るまで、実験の障壁を低くするために構築されている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 23:59:18 GMT)
Extended KAFR: A kinematic-adaptive paradigm for the efficient analysis of surgical video [0.0] 重要な課題は、しばしば1から数時間の手術記録の長さであり、かなりの計算負担を発生させる。
我々は以前,ロボット手術のためのKinematics-Adaptive Frame Recognition (KAFR) を開発した。
本研究は, 腹腔鏡下胆嚢摘出術80例を含むColec80ベンチマークを用いて, KAFRが腹腔鏡下手術に一般化するか否かを検討した。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 07:48:48 GMT)
Estimating spacetime fluctuation strength in SU(1,1) and SU(2) interferometers [0.0] 従来、$SU(2)$の干渉計はそのような実験で使われてきた。
時空変動の強度と相関長を推定するための量子フィッシャー情報を計算する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 00:23:47 GMT)
Don't Offer What Can't Be Done: Deterministic Executability Gating for LLM Skill Selection at Scale [0.0] We present a three-stage selection pipeline for Helpmate, Wix's customer-care assistant。
リコール指向セマンティックマーカは、アカウントの状態を参照せずに10スキルドメインファミリーに関連するメッセージを識別する。
決定論的実行性ゲートは、内部ハードストップ条件が保持されている候補を除去する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 07:32:49 GMT)
Does Machine "know" interpersonal pragmatics? Evidence from MARBERT's learning of emoji pragmatics in Arabic digital discourse [0.0] 本研究では、トランスフォーマーモデルを用いたアラビア語デジタル談話(ADD)における絵文字の実践的学習能力について検討する。
研究には、FacebookからPython経由で収集された8,504個の絵文字ポストのコーパスが使用された。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 11:52:46 GMT)
Doc2CI: A Multi-Service Study of CI Configuration Generation Using Large Language Models [0.0] DOC2CIは、4つのCIサービスの公式ドキュメントから収集された3,363のYAMLペアのベンチマークである。
GPT-4o と GPT-4.1 とともに 7B-34B パラメータから 14 個のオープンウェイトモデルを評価し、53,000 以上の構成を生成する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 19:22:02 GMT)
Dense Hamiltonians at the Parseval Limit: The Noncommutative BH Constant is Exponential and the Quantum FEI Conjecture is False [0.0] それぞれの$dgeq 1$に対して、パウリ展開が$N(d)=exp((d2))$項を含むノルム-1エルミート作用素を構築する。
この構成は非可換 Bohnenblust-Hille (BH) 定数が $mathrmBH_M(d)geqexp((d))$ を満たすことを意味する。
我々の下限も対角的に$mathrmBH_M(d)$をハイパーキューブBH定数$mathrmBHから分離する
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:12:46 GMT)
DeBERTa-Sentinel: Toward Transparent and Trustworthy Detection of AI-Generated Text [0.0] この研究は、責任あるAI生成テキスト検出フレームワークであるDeBERTa-Sentinelを紹介している。
ブラックボックスの商用検出器とは異なり、DeBERTa-Sentinelはその決定についてトークンレベルの説明を公開している。
DeBERTa-Sentinelは98.21%の精度で、NeurIPS 2025のRoBERTa-Sentinelベースラインを超えている。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 07:08:20 GMT)
Copyright Is the Headline; Capability Is the Blind Spot: AI Technology in the Book-Publishing Trade Press, November 2025--August 2026 [0.0] 2025年11月1日から2026年8月1日まで、人工知能(AI)に関する89の論文と書籍をレビューする。
英語、中国語、ドイツ語、フランス語、スペイン語、ポルトガル語、イタリア語、日本語をカバーしている。
レポートでは、待機中のAIビート、ラボでのインタビュー、クレーム台帳、共有テストプロトコル、リーダーパネル、テクニカルコラムニストを推奨している。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:26:53 GMT)
Control Under Compression: Reliability Frontiers for Tool-Using Agents [0.0] ACC圧縮のための環境検証ベンチマークであるCompressAgentを紹介する。
75%の保持状況では、汎用的な書き換えとセクションベースの圧縮が92.7%、92.4%の成功を収めている。
25%から10%の継続コンテキスト予算では、実行可能なプロトコルは脆弱になる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 07:43:44 GMT)
Beyond Correctness: Toward Automated Novelty Verification with Lean 4 [0.0] この記事では、記事を受け取り、Lean 4でステートメントを形式化し、3次元の意思決定ツリーを通じて、斬新な検証を発行するパイプラインを提示します。
arXivから重複が宣言されたため削除された論文の評価は、どのパフォーマンス指標よりも有益な結果となった。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:49:03 GMT)
Asleep at the Wheel: JEPA's Limitations in Evaluating Novel Driving Data [0.0] 本稿では、自己監督型共同埋め込み予測アーキテクチャ(JEPA)の予測エラー「ノベルティ」により、クリップをスコアするラベルフリーなアプローチを提案する。
単一のデータセットから得られた公正なベンチマークでは、このメカニズムは偶然に崩壊し、単純なトレーニングなしのベースラインと同等です。
本稿では,自己教師付き学習の有効性を評価するための研究として,クロスデータセットプロトコルが新規性よりもドメイン分離に静かに報いることを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:57:40 GMT)
Asking Questions the Right Way: A Multi-Agent Conversational System for Prompt Formulation in Complex Task Resolution [0.0] 大規模言語モデル(LLM)は複雑な知的タスクに不可欠なものであるが、出力品質はユーザが提供するプロンプトによって制約される。
本研究では,非構造化クエリを構造化プロンプトに変換する8つのエージェントのエージェント対話インタフェースPAWNIを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:33:27 GMT)
Agentic Stage-One Stellarator Optimization: Autonomous Multi-Objective Search for Finite-Beta Equilibria [0.0] 強調ステージワン最適化の概念実証を行う。
エージェント外ループ制御は有限ベータ・多目的探索を維持でき、繰り返し最適化を改良された平衡のスケーラブルなソースに変えることができる。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 16:08:52 GMT)
AgenTag: Attribution of AI Coding Agents from Behavioral Fingerprints [0.0] 我々は,AIDevで評価された,オープンワールドAIコーディングエージェント属性のためのフレームワークであるAgenTagを提案する。
従来の分類と教師付きコントラスト学習を比較し, テキスト, 行動, コードに基づくモダリティを用いて各PRを表現した。
PR記述やコミットメッセージが帰属シグナルのほぼ全てを提供するのに対して,コード差分は複数の表現にはほとんど寄与しないことを示す。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 03:35:25 GMT)
A Statistical Framework for Data-Driven Discovery of Differential Performance in Clinical Risk Prediction Models [0.0] 人工知能(AI)と機械学習(ML)を用いた予測モデルは、医療設定における意思決定支援にますます利用されている。
これらのモデルは、人種、年齢、性別、その他の要因によって定義された集団サブグループ間で異なる性能を示す可能性がある。
実世界の環境では、重要なモデル性能の相違は、複数の交差特性によって定義される未知の部分群に生じることがある。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 15:53:22 GMT)
A New Theory of Value for Post-AGI Economics [0.0] 本稿では,ポストAGI経済学の基礎としてFlourishing Value Theory(FVT)を開発する。
社会価値を多次元・代理保存・再生・非補償として重要なしきい値で扱う。
Flourishing Metrics and Return on Flourishing (RoF)上に構築されており、企業、政府、仕事の移行、AIガバナンス、国家会計のための階層化されたアーキテクチャを提案する。
論文参考訳(メタデータ) (Sun, 02 Aug 2026 18:26:33 GMT)