Robust Estimation of Sparse Numerical Vectors under Local Differential Privacy [61.8] ローカルディファレンシャルプライバシ(LDP)プロトコルは、中毒攻撃に対して脆弱である。
本稿では,頑健なスパースベクトル平均推定問題に対処する。
本稿では,バイアスの正確な表現を行うための注意深い分析に基づく補正手法を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:55:09 GMT)
Safeguards Based on Copyable Context Cannot Provide Reliable Safety for LLMs [61.4] 大規模な言語モデルのセーフガードは、答えがどのように使われるかを見る前に、答えるかどうかを決定する。
同じ回答は、認定されたプロフェッショナルやアタッカーを助け、攻撃者は、良心的な要求とインタラクション履歴を模倣することができる。
我々は、下流での使用に関する証拠からモデルがリリースした能力を分離する。その証拠がコピー可能である場合、有効な回答を保ちながら、アタッカー支援の正確な最悪のフロアを導出する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:59:08 GMT)
WaiT for the Signal: Simple Frequency-Aware Flow-Matching [60.6] 本稿では,ウェーブレット対応画像変換器のWaiTについて紹介する。
ImageNet 512x512では、WaiTは1.43ピクセル空間のFIDを実現し、サンプリング計算を最大50%削減した。
我々の定式化はテクスチャの忠実度において最強の潜在空間モデルよりも優れており、高解像度のOpenImageやビデオ生成にシームレスにスケールする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:26:19 GMT)
VisualRouter: Query-Grounded Visual Sampling for Long Video Understanding [60.2] 本稿では,クエリグラウンドビジュアルサンプリングのためのトレーニングフリーかつプラグイン・アンド・プレイフレームワークを提案する。
Visual Firstは、各クエリをグローバルまたはローカルに分類し、それに対応するサンプリング戦略を適用する。
実験の結果、Visualは均一サンプリングよりも複数のLVLMを継続的に改善し、ビデオ-MME、LongVideoBench、MLVUで5.2%、7.7%、11.6%を達成し、Qwen2.5-VL-7Bで既存のトレーニング不要のビジュアルサンプリング手法より優れていた。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:23:10 GMT)
A report-grounded vision-language foundation model for colonoscopy from 280000 routine reports [58.1] EndoCLIPは125,756の病変レベルの画像テキストペアに基づいて訓練された視覚言語基盤モデルである。
これは、ゼロショットとリニアプローブの両方の設定において、汎用およびバイオメディカルな視覚言語エンコーダよりも優れている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:24:36 GMT)
Hand-Object Interaction in the Age of Large Foundation Models:Reconstruction, Generation, and Embodied Transfer [56.0] 本調査は,手動物体相互作用における基礎モデル-モデル先行の体系的検討である。
我々は,8つの基礎モデルサブプライヤの分類を幾何学的,意味的,視覚的ファミリーに分類する。
本研究では,人-データ事前学習,人間-ロボットのスキル伝達,HOI-to-ロボットデータ生成など,HOI由来の知識がロボット学習にどのように利用されているかを検討する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:48:16 GMT)
LabEvolver: Training-Free Experience Evolution for Safe and Grounded Wet-Lab Agents [55.8] 本稿では,安全かつ接地されたウェットラブエージェントに,実行経験からエピソード記憶を付加したトレーニングフリーフレームワークであるLabEvolverを紹介する。
LabEvolverは、適応認識、オンライン計画、安全性検証のための州立の試験ループと、完成した軌道を再利用可能なスキル、戦略、安全体験に蒸留する外部進化ループを結合する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:19:33 GMT)
PrintAnything: Learning an Intermediate Representation for 3D printing G-code Generation [55.2] 既存の3Dプリンティングパイプラインの多くは、水密メッシュを入力として必要としており、製造にポイントクラウドを直接使用するのを防いでいる。
我々は、3Dポイントクラウドから直接実行可能な3DプリンティングGコードを生成することを学習する新しいフレームワークであるPrintAnythingを提案する。
提案手法は点雲から直接プリント可能なG符号を正確に生成し、3Dプリンティングのための実用的で完全なメッシュフリーパイプラインを実現する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 06:09:49 GMT)
World Action Planner: Generalizable Decision-Making with Action-Conditioned World Models [54.7] 視覚言語モデル(VLM)の推論能力を活用したロボット計画システムであるWorld Action Plannerを提案する。
本システムでは,エージェントが初期行動計画を提案し,それらを最適化と探索により反復的に洗練し,想像上の世界モデル展開を推し進める。
提案手法は, 合成タスク, レイアウト, ゼロショットの一般化シナリオにおいて, 優れた性能を実現することを実証する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 02:41:52 GMT)
One Patch Is Enough: Reinforcement-Optimized Visual Token Grounding for MLLM-Based Scene Text Spotting [51.1] シーンテキストスポッティングはテキスト認識と空間的局所化の間に高精度なアライメントを必要とする。
本研究では,個々のテキストインスタンスを単一のアンカー視覚トークンでルーティングする視覚中心のフレームワークであるSingle-Patch Text Spotting (SPaTS)を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:17:48 GMT)
PhiZero: A World Model Built Around Physical Language [50.3] PhiZeroは物理言語を中心に構築された物理世界モデルである。
物理言語シーケンスとして将来の世界進化を推論し、推論された遷移をビデオにレンダリングする。
本研究では,現実的かつインタラクティブな世界モデリング,微粒な動作条件シミュレーション,ゼロショットモーショントランスファーの可能性を示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:59:46 GMT)
ObjectStream: Latent Objects as Memory Anchors for Streaming Video Understanding [50.2] ObjectStreamはトレーニング不要のフレームワークで、ストリーミングビデオ理解のためのメモリアンカーとして潜在オブジェクトを扱う。
それは3つの補完的な証拠を保存している: 永続的なオブジェクト履歴、過渡的なオブジェクト変更、そして最近の視覚的コンテキストである。
オンラインストリーミングとオフラインの長時間ビデオベンチマークの実験は、有効性と効率の両方を示している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:47:00 GMT)
Quantum Speedups for Stochastic Optimization with Heavy-Tailed Noise [49.7] 重み付き確率変数に対する新しい量子平均推定器を開発した。
尾指数>4/3$のより強い下界を導出し、次元への非自明な依存が避けられないことを示す。
凸目的関数に対して,量子射影勾配降下法を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 02:31:33 GMT)
Measuring Distortion in the Empty Regions of Dimensionality Reduction Scatterplots with the Gap Index [44.8] ギャップ指数(英: Gap Index, GI)は、射影の空き領域における空間歪みを測定することで、視覚的歪みを捉える2次元投影のための品質指標である。
その結果、一般的な品質指標とは対照的に、GIは視覚的影響の高い小さな構造変形に敏感であることがわかった。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:57:19 GMT)
Rehearse: Stepping Back from the Confidence Cliff in Self-Improving Autoresearch [44.1] Autoresearchは、変更を提案し、フルトレーニングジョブを実行し、メトリックを改善する変更を維持することによって、マシンラーニングコードを改善する。
本研究では,この事前執行判断の信頼性が,自動検索の軌道上でどのように変化するかを検討する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:08:15 GMT)
AISPA: User-Centric System Prompt Auditing for Large Language Model Applications [39.4] システムプロンプトは、AIアプリケーションにおける基礎モデルの振る舞いを管理するために開発者が設定した命令である。
商用AI製品全体で使用されているが、公共や規制当局に開示されることは稀である。
本稿では,AIシステムにおけるシステムプロンプトを体系的に監査する,ユーザ中心のフレームワークであるAI Prompt Assurance(AISPA)を紹介する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:58:58 GMT)
CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion [35.7] テストタイム検索では、小さなビデオ拡散モデルが大きなモデルに匹敵するが、さらに2~10倍のコストがかかる。
トレーニング不要のキャッシュは、各ロールアウトをほぼロバストな品質で2~3倍高速にする。
本稿では,ビデオテストタイム検索において,キャッシングが候補ランキングに悪影響を及ぼすかどうかについて検討する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:05:25 GMT)
Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering [35.6] 再帰的自己改善(RSI)はAI構築プロセスを改善するAIシステムを必要とする(AI4AI)。
機械学習工学におけるRSI研究のためのオープンフルスタックシステムOpenMLEを紹介する。
We post-trainis-MA1 (35B) as a meta-evolution agent for MLE,aligneding post-training and inference around four atomic program-evolution operator。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:34:01 GMT)
Beacon: Knowing When and How to Perform Agentic Visual Reasoning [35.3] 本稿では,より優れた全体的な性能,改良されたモード適応性,真のツールによるパフォーマンス向上を実現する,エージェント型視覚推論モデルを提案する。
ビーコンの核心には、強化学習段階における必要認識適応逆流とヒントガイド能力拡張機構がある。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:46:55 GMT)
QuantWAMs: Calibrating at the Right Granularity for World Action Models [34.5] World Action Modelsは、将来の観測とアクションを共同で予測するが、反復的なデノゲーションとクローズドループの実行は、デプロイメントにコストがかかる。
我々は,量子化決定をモデル構造,ロールアウト分布,タスク目標によって定義されたキャリブレーションコンテキストと整合するPTQフレームワークQuantWAMを提案する。
我々は,RoboTwin 2.0,LIBERO,AgiBot G2を用いた実ロボット操作において,Fast-WAMおよびLingBot-VA上のQuantWAMを評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:54:29 GMT)
Correcting What You Cannot See: Credit Assignment for Perception Distillation in Multimodal Reasoners [34.4] 認識障害を識別するラベルフリー手法であるtextbfPerception-Correction Distillation (PCD) を導入する。
我々はベイズ証拠の組み合わせを通じてこのルールを動機付け、乗法がどちらの証人もいないときに消える唯一の正規化された双線型ゲートであることを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:03:55 GMT)
Best Friends, Not Forever: Evaluating Long-Horizon Persona Collapse and Behavioral Drift in AI Companions [34.3] 本研究では,2つの長期的障害について検討する。「人的崩壊」,展開された役割の喪失,境界,値,スタイル,および「行動漂流」である。
本稿では,人的行為とトラジェクティブリコールを別々に計測する制御型総合監査システムANCHORを紹介する。
この研究には、27人のペルソナにまたがる2,008の会話、9つのインタラクションスケジュール、3つの生成されたメモリ設定、そして4つの評価モデルが含まれている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 20:18:39 GMT)
Unifying Adversarially Robust Model Experts in Vision-Language Models [33.7] 視覚言語モデル(VLM)は敵攻撃に対して脆弱である。
本稿では,協調的対向的微調整フレームワークであるCAREを提案する。
CAREは、トレーニング中に複数の専門家を維持し、埋め込み空間の調和を通じて知識交換を可能にし、学習した知識を単一の堅牢なモデルに統合する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:13:35 GMT)
Learning Manifolds in High-D Point Embedding for Anisotropic Surface Approximation from Unstructured Point Clouds [33.5] HD-PEAは、非構造化点雲上で直接動作する学習ベースの異方性表面近似フレームワークである。
本研究では,新しい学習に基づく高次元ユークリッド点埋め込み法を開発し,入力点雲を高次元多様体埋め込み空間にマッピングする。
いくつかのデータセットを用いて,最先端表面再構成手法に対する提案手法を広範囲に評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 21:40:15 GMT)
AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation Alignment [32.9] AgentHOIはテキスト駆動のHOIビデオ生成で、高いレベルのテキスト意図と物理的実行のギャップを埋める。
我々は,動画拡散モデルに先行したテキストを蒸留する暗黙のテキスト移動アライメント戦略を導入する。
実験により、AgentHOIは相互作用の自然性、オブジェクトの外観の保存、複雑なテキスト命令への付着性を著しく改善することが示された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:34:42 GMT)
Foundation Models for Face Presentation Attack Detection: A Unified Linear-Probing Benchmark [32.9] クロスデータセット評価においては,顔提示攻撃検出は依然として困難である。
PAD関連情報を最小限のタスク特化訓練で利用できる汎用視覚基盤モデルか?
自己教師型ビジョントランス、視覚言語エンコーダ、教師型CNNを含む24個の凍結エンコーダを評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:27:19 GMT)
What Makes Graph Unified? Principles and Generative Sliding-Window Transformer for Graph Foundation Models [32.2] グラフ基礎モデル(GFM)は、最近、汎用グラフ学習の有望なパラダイムとして登場した。
トポロジを意識したスライドウインドウ特徴符号化と生成的再構成に基づくグラフ基盤モデルであるSliGFMを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:13:59 GMT)
DualAnchor: Preserving Language Priors and Improving Lexical Fidelity in Gloss-Free Sign Language Translation [30.4] 我々は光沢のない手話翻訳学習フレームワークであるDualAnchorを提案する。
2つの相補的なアンカーを、言語的に流動的で視覚的に忠実な世代に分けている。
TPAは、マルチモーダルデコーダを正規化することで、言語を保存します。
OTAは、エントロピー規則化された部分的最適輸送として視覚テキストマッチングを定式化することにより、語彙の忠実度を向上させる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:02:13 GMT)
IndustryForge-27B: A Domain-Enhanced Multimodal Foundation Model for Industrial CAD [30.0] Qwen3.5-VL-27B上にIndustrialForge-27Bを構築し、6つのインダストリアルCADサブコーパスをキュレート・統合した。
汎用マルチモーダルモデルはこれらのタスクでは不足するが、シングルタスクの微調整は上層エージェントが発行する多様な呼び出しをサポートするには狭すぎる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:28:21 GMT)
Where and When to Commit: Candidate-Aware Decoding for Diffusion Language Models [29.8] 拡散言語モデルは、デノナイジングステップ毎に一時的な予測を公開する。
生成時早期出口は、スケジュールが切れる前に復号を停止する。
2つの軸を分離し、それぞれの決定をそれぞれのスコープの証拠と一致させる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:04:47 GMT)
Beyond Visual Ambiguity: Guiding Robust Monocular Depth Estimation in Challenging Scenarios via Detailed Long Captions [29.3] 本稿では,ロバストな単分子深度推定のための新しいフレームワークであるCapDepthを提案する。
まず,豊富な空間関係を明示的に伝達する詳細なロングキャプション入力テンプレートを設計する。
次に、ダイナミックキャプションエンコーダを導入し、微細な深さ関連テキスト特徴を抽出する。
第3に,テキスト機能による深度復号化を誘導するテキスト適応デコーダを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:32:02 GMT)
Is Deep Research Reliable? Misleading Knowledge Induces False Conclusions [29.2] ディープ・リサーチ・エージェントは、反復的に計画し、証拠を回収し、報告を作成することで、長期調査を行う。
明らかに信用できるが、事実としてこれらの防衛に導入された偽情報に抵抗できるかどうかは不明だ。
MisKnow-Agentは、手作業による偽結論の監査を支援するタスク固有文書を構築するフレームワークである。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 04:45:04 GMT)
Cross-Embodiment Transfer via Behavior-Aligned Representations [29.2] 本研究では,視覚行動モデルにおける行動整合表現を用いて,身体間の移動を促進する役割について検討する。
そこで我々は, 多様なクロスボデーメントデータから新しいエボデーメントへのトランスファーを評価するためのシミュレーションベースのベンチマークを開発した。
シミュレーションデータに基づいて事前学習した実ロボットポリシーのタスク完了進捗を28%向上させることで,シミュレート・トゥ・リアル・エボディメント・トランスファーを強化できることを実証した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 00:49:53 GMT)
Beyond Classification: Pathology Foundation Models as Detection Encoders for Mitotic Figures [28.9] 病理基盤モデル(FM)は、典型的にはラベルのない大量のデータに基づいて訓練されており、正規化された潜在空間が得られることが示されている。
現在のFMの潜伏空間が、高密度物体検出パラダイムのバックボーンとして機能するように差別的で空間的に解決された特徴を提供するかどうかはまだ不明である。
画像レベルの自己スーパービジョンで訓練された現在のFMの潜伏空間は、直接的有糸分裂型図形検出に適しており、我々の領域外テストケースでは、わずかに頑健である可能性がある。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:56:38 GMT)
MemHarness: Memory Is Reconstructed, Not Replayed [28.9] 本稿では,過去体験を積極的に活用・再構築するためのLLMエージェントを備えたフレームワークであるMemHarnessを提案する。
MemHarnessは純粋なRLと静的メモリ拡張ベースラインを大幅に上回り、アウト・オブ・ディストリビューション(OOD)シナリオで強い堅牢性を示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:25:49 GMT)
Interpretable Representation via LLM-Driven Generative Disentanglement for Local-Life Service Recommendation [28.8] 我々はLGRID(Local-Life Service Recommendation)のためのLLM駆動型生成ディスタングルによる解釈可能な表現を提案する。
LGRID は Encode -> Disentangle -> Align -> Quantize Pipeline を通じて生成的不整合のパラダイムを導入している。
KuaishouとFoursquareの実験によると、LGRIDはSIDベースラインを一貫して上回っている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:52:18 GMT)
Private Face Recognition Training Dataset Publication via Identity-Decoupled and Geometry-Preserving Face Distillation [28.4] プライベートな顔認識トレーニングデータセットのパブリッシングはプライバシーに敏感だ。
プライベートFRトレーニングデータセットの公開は、プライベートトレーニングフェイスの代替として保護されたプロキシをリリースすることによって、このリスクを軽減する。
アイデンティティ分離と幾何保存のためのフレームワークである textbfPrivate Face Distillation を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:01:58 GMT)
Calibrate Before Reason: Robust Visual Token Reduction against Semantic Drift in VLMs [26.9] CaReは,1)多方向摂動下で安定なモデル側の影響を持つアンカーを識別する摂動ロバストアンカリング,2)未選択トークンから信頼性の高い校正信号を抽出しアンカーに注入する信頼性ゲートトケンの2つの相互補完モジュールから構成される。
視覚トークンの94.4%をプルーニングする一方で、本手法は元のフルトーケン性能の96.4%を保持し、未使用バニラモデルと比較して最大2.30倍高速なエンドツーエンド推論速度を実現する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:36:29 GMT)
MemeBench: What LVLMs Miss When Interpreting Culture-Dependent Memes [26.8] 1,253の中国語と英語のミームの診断ベンチマークであるMemeBenchを紹介した。
すべてのモデルは、その解釈に必要な知識よりも確実に可視コンテンツをカバーし、最強のものは22.6%のVisual-Knowledgeギャップを保っている。
この診断が改善を導くかどうかを検証するため、CultureBase上に構築されたエンティティ誘導検索ベースラインであるKARを導入する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:36:53 GMT)
Sign Language Question Answering: A New Task, Benchmark, and Baseline for Sign Language Understanding [26.7] 本稿では,任意の自然言語質問に答えるモデルを必要とすることで,SL理解を評価する新しいタスクであるSLQAを提案する。
得られたデータセットは、位置推論、構造推論、視覚探索、光沢認識、翻訳理解を含む5つの補完的な質問カテゴリをカバーする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:05:26 GMT)
Echoverse: Deep, Evolving Environments for Training Computer-Use Agents at Scale [26.6] 仕様をステートフルなアプリケーションにコンパイルするEchoverseを紹介します。
9Bモデルは14回の評価分割で36.5%から67.1%に改善されている。
同じドメイン上では、浅い環境がベースモデルの下のライブサイト精度を押し上げます。
Deep one raise it up it (80.0 to 85.0$ and 4,8.0 to 65.0$); drilling one interface control across many renderings transfers to hold-out widget family and the open web。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:48:22 GMT)
Information Bottleneck Learning for Faithful Time Series Forecasting Explanations [26.6] IB-Forecastは本質的に解釈可能な多変量時系列予測フレームワークである。
予測を学習周期成分と、入力トークン上の説明可能なマスクで計算された残留成分に分解する。
予算制約のある情報ボトルネックにより、エンド・ツー・エンドの最適化により、ユーザーは説明の間隔を直接制御できる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:33:19 GMT)
Baikal: Structured Search for Deep Research over Data Lakes [26.6] Baikalは、異質な証拠をセマンティックな領域にまとめ、それらを適応して探索と搾取のバランスをとるためのフレームワークである。
10,993テーブルと2,757テーブルを含むHybridQAデータレイクとTAT-QAデータレイクに対して,それぞれ15のクエリに対してBaikalを227KのWikipediaパスと13Kの財務報告パスで評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 06:05:45 GMT)
From Understanding to Action: Feedback-Grounded Policy Discovery for Generative Recommendation [26.5] 大言語モデル(LLM)は、異種相互作用履歴を推論することで、生成的推奨者を補完することができる。
LLMは、レコメンデーション固有の結果フィードバックで本質的に訓練されていない。
本稿では、まずタスク指向の意図を誘導し、次にレコメンデーションポリシーを発見するフィードバック駆動型エージェントフレームワークを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:23:07 GMT)
RoboBRIDGE: A Modular Framework for Bridging Policies to Robust Real-World Robotic Agents [26.4] VLA(Vision-Language-Action)モデルは、ロボット操作のスケーラブルなアプローチとして関心を集めている。
既存のソリューションは、モデルの再トレーニングや環境固有のモジュールを通じて、これらの制限に個別に対処する。
我々は,5つの協調モジュール上にオーケストレーション層を提供するモジュールフレームワークであるRoboBRIDGEを紹介する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:55:45 GMT)
AutoSupervision: Closing the Feedback Loop in Scientific Workflows with Grounded Revision Verification [26.4] 本稿では,論文の改訂がレビュアーの懸念に真に対処するかどうかを評価するAutoSupervisionを紹介する。
我々は56,000のNature Communications記事とそれに対応するレビュー記録からAutoSupervisionを構築した。
以上の結果から,LLMはレビュアーの関心事の特徴として優れているが,エビデンスに基づく検証が主要なボトルネックであることが示唆された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:24:58 GMT)
Optimal T Counts under Sparsity: from QROM to State Preparation and Block Encoding [26.3] 多くの量子アルゴリズムは古典的なデータへのコヒーレントなアクセスを必要とし、しばしば量子読み取り専用メモリ(QROM)によってモデル化される。
スパースQROMの$T$数を調べ、$2n$アドレスの$s$だけが非ゼロデータを格納している。
我々の上界はマルチレベルハッシュ方式を使用し、下界はスパースQROMを減らし、適応的なClifford+$T$回路のカウント引数を使用する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:18:29 GMT)
ODEWorld: A Continuous Predictive Architecture via Physical-Time Flow [26.1] 物理時間で連続的な潜伏速度場を学習する新しい手法である物理時流(textbfPT-Flow)を導入する。
PT-Flowでは、圧縮された潜在空間におけるODEソルバを介して、未来の予測を時間積分として再キャストすることができる。
textbfODEWorldは,効率的かつ多目的な連続潜時世界モデルである。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:37:30 GMT)
ReDiPPO: Reference-Guided Value Calibration and Discrepancy-Aware Token Reweighting for Mathematical Reasoning [25.2] ReDiPPOは、数学的推論のための参照誘導および離散化対応PPOフレームワークである。
ReDiPPOは価値推定精度を向上し、強力なポリシー最適化ベースラインを一貫して上回ることを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:42:52 GMT)
ShadowDancer: Teaching Video World Models Any Action by Learning Unified Dynamics Representations from a Video and Its Shadow [24.6] 我々は、インタラクティブなビデオワールドモデルの任意のアクション、フレームレベル制御に対する新しいアプローチであるShadowDancerを提示する。
既存のインターフェイスはアクションを緩やかにエンコードし、モデルが即興的に展開する方法を残したり、構造化された信号を通じて正確にエンコードしたりする。
ShadowDancer氏はこれを,2つの重要なイノベーション – シャドウペア,独立して再サンプリングされた外観の下で同じダイナミクスを再生するビデオペア,シャドウ間の予測 – で対処する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:28:43 GMT)
ClawTrack: Towards Trace-Level Evaluation and Improvement of Real-World Autonomous Agents [23.8] エージェントが何を達成し、どのように達成するかを同時に測定するデュアルアセスメントベンチマークであるClawTrackを提示する。
ClawTrackは8つのドメインにわたる320のタスクと25以上の決定論的モックサービスで構成されている。
プロセスグレーダは、12,541のタスク固有の項目で固定された4次元(ゴールアライメント、効率性、情報利用、結果検証)に沿って各推論ターンをスコアする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:18:47 GMT)
Can Agents Deceive? Evaluating Reasoning and Deception in ParliamentBench using a Social Deduction Game [23.8] 大規模言語モデル (LLM) は、医療や法体系などの高度な設定においてエージェントとしてデプロイされる。
我々は,情報非対称性の下での誤認,説得,推論を必要とするシナリオにおいてLLMを評価する。
本稿では,社会的推論,推論,虚偽の一貫性を分離する3つの新しい指標を紹介する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:54:17 GMT)
Lightning OPD 2.0: Mitigating Style Bias in Cross-Teacher On-Policy Distillation for Large Reasoning Models [23.3] We introduced Lightning OPD 2.0 with cross-fitted style residualization。
数学的推論とコード生成のベンチマークを通じて、Lightning OPD 2.0は、教師間の設定でLightning OPDを一貫して上回っている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:17:15 GMT)
Noise-aware emulation and cross-device validation of neutral atom analog quantum processing units [23.2] 本稿では,全周期にわたって支配的なノイズメカニズムを伝播させ,デバイス動作を予測するノイズ対応エミュレーションフレームワークを提案する。
我々は,3つのパスカル量子プロセッサ上で,量子アニーリングとポストクエンチダイナミクスという2つの代表的なプロトコルをベンチマークすることで,このフレームワークを検証する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:29:05 GMT)
MMHBench: A Multi-Perspective Benchmark for Mental Health Understanding in Long-Form Videos [23.0] マルチパースペクティブなメンタルヘルス理解のための総合的なベンチマークであるMMHBenchを紹介する。
MMHBenchは268の長編ビデオと2,184の精査された質問で構成されている。
多様な社会的役割をシミュレートし,複数の視点から質問を合成するマルチエージェント質問生成(MAQG)フレームワークを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:12:44 GMT)
Towards joint scaling laws with optimal batch size schedules [23.0] 現代のディープラーニングは、トレーニングを通じてバッチサイズを静的に保ち、トレーニングのダイナミクスに対する学習率とバッチサイズの共同効果を見越す。
本稿では,凸最適化のレンズによる深層学習のダイナミクスを考察し,両スケジュールによる損失の同時評価を導出する。
この特徴付けにより、任意の所定の学習率スケジュールに対して、クローズドフォームの最適なバッチサイズスケジュールが得られ、さらに静的バッチサイズベースラインを一貫して上回る共同スケーリング法則がもたらされる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 06:14:04 GMT)
SpatialCLI: Learning to Reason With Spatial Tools, Then Without Them [23.0] 視覚言語モデル(VLM)は、視覚入力を解釈し、空間を推論し、タスクレベルの決定を行うための具体的エージェントとしてますます使われている。
一般的なVLMは全体のタスクを推論できるが、成功を決定する視覚的詳細を見逃してしまうことが多い。
本研究では,空間的ツールによる推論をVLMに教えるフレームワークであるSpatialCLIを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:39:01 GMT)
LeanCSP: A Framework for Certifying Constraint Reformulation and Solving in Lean [23.0] 制約プログラミング(Constraint Programming)は、スケジューリング、計画、設定、検証といった複雑な問題を解決するための中核的な技術である。
リーン定理証明器では、両方の検証レベルに対処するフレームワークを導入します。
等式性、等式性、対称性を破る制約の正しさなどの定式化レベルの性質を証明するのに使うことができる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:21:58 GMT)
BM25 Wins at Scale: A Scaling Study of Retrieval-Augmented Generation Paradigms [22.9] Retrieval-augmented Generation (RAG) は語彙と密度の検索、グラフベースのインデックス、エージェント検索にまたがる。
約450倍の大きさの28層を厳密に営巣するコーパスサイズの変化について検討した。
公式な正確性、構築とクエリトークン、レイテンシを測定します。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:49:41 GMT)
What to Remove, What to Preserve: Dual-Ambiguity Rectification for All-in-One Image Restoration [22.8] 本稿では,オールインワン画像復元のためのDAR-Netを提案する。
DAR-Netはまず、単純なx制約のアーチタイプ混合モデリングにより構造化された劣化状態を導入する。
Semantic Ambiguity Rectification (SeAR)モジュールはデコーダのチャネルワイドコンディショニングを改善するための劣化認識プロンプトを生成する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:01:24 GMT)
Library Reachability in LSR-Synth: How Anti-Memorization Design Changes the Measurement of Symbolic Discovery [22.6] LSR-Synthsは従来の演算子探索と言語モデルによって提供される科学的な先行性を区別できることを示す。
我々は、公文書化された証明を持つ固定語彙を用いて意味論のないベースラインを構築する。
現状のタスクの多くは、未確認表現の適合性や組換え性を評価するのに相応しいが、固定された検索空間を超えた事前のコントリビューションを特定するには、それ自身では不十分である、と結論付けている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 02:36:26 GMT)
MMAC: A Massive Multi-dimensional Benchmark for Audio Captioning [22.1] MMACは textbfMassive textbfMulti-dimensional benchmark for textbfAudio textbfCaptioning である。
MMACには、20以上のデータソースから5,638のオーディオクリップが含まれており、6つの機能カテゴリと15の評価次元をカバーしている。
オープンソースおよびプロプライエタリなAudioLLMを評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 02:37:20 GMT)
From Machine Learning to Large-Scale EO Products: Best Practices for Making Maps [21.6] 近年、地球観測(EO)データから得られた大規模な地理空間地図の作成が急速に拡大している。
技術的に健全で科学的に信頼できる製品を作り出すことは 依然として困難です
本稿では,衛星データからオペレーショナルマップ製品まで,パイプラインにまたがる推奨プラクティスについて,簡潔かつエンドツーエンドに報告する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:09:33 GMT)
PathView-Bench: Can Multimodal Large Language Models Achieve Fine-grained Multiscale Understanding of Pathology Images? [21.5] PathVUは、コンピュータ病理学における細粒度およびマルチスケールの視覚的理解のための、視覚適応型ベンチマークである。
PathVUはMLLMの理解を,高分解能な局所領域の領域FOVとマクロな全体スライダービューのSlide FOVの2つの視点で評価する。
ベンチマークには14のVQAスタイルのタスク、61,673のイメージ、28の臓器にわたる308,070のサンプル、7,253,526のアノテーションが含まれている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:53:51 GMT)
LEEPS: Latent-Guided Explore-Exploit Prompt Sampling for Efficient RLVR in Large Language Models [21.3] 検証可能な報酬(RLVR)による強化学習は、大規模言語モデルの推論能力を向上させる。
既存の事前ロールアウト手法は、エクスプロイトと探索のバランスをとるのに苦労する。
LEEPS(Latent-Guided Explore--Exploit Prompt Sampler)を紹介する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:50:10 GMT)
MANTA: Multi-Agent Network Topology Adaptation for Self-Evolving Multi-Agent Systems [21.2] 本稿では,通信構造を推論時に自己進化させるフレームワークであるMANTAを紹介する。
MANTAはコラボレーショントレースを監視し、現在の組織が不十分になった時に境界構造を更新する。
我々は、情報探索、ツールの使用、計画、ワークフローの実行、数学的推論にまたがる5つのベンチマークで、代表的単エージェントとマルチエージェントのベースラインに対してMANTAを評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:01:27 GMT)
Causal Discovery with Inverted Self-attention for Multivariate Time Series [21.0] 本稿では,トランスアーキテクチャ内の自己認識機構を利用して因果発見を行う新しいフレームワークを提案する。
本手法は,トークンを反転させ,注意点の疎結合を誘導することにより,潜伏因果関係と間接因果関係を強調する。
また、グローバル因果関係を同定するグローバル因果関係アルゴリズムを開発し、因果関係の総合的指標を提供する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:49:46 GMT)
MMOOC: A Comprehensive Benchmark for Out-of-Context Evaluation in Multimodal Large Language Models [20.7] 信頼できるMLLMは、主観レベルのコンテキストシフトを伴う真にアウト・オブ・コンテクスト(OOC)質問を拒否すべきである。
既存のベンチマークは主にOOCや視覚的に答えられない質問をターゲットにしている。
MLLMの拒絶と頑健な応答能力を評価するための大規模ベンチマークであるMMOOCを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:46:43 GMT)
PAC-MAN: Perception-Aware CBF-RL for Whole-Body Safety in Humanoid Dodgeball [20.4] PAC-MANは、コントロールバリアの安全性と、全身のヒューマノイドドッジボールに対する展開現実的なオンボードセンシングを併用した、知覚対応のCBF-RLフレームワークである。
我々は、Unitree G1上で軽量なLink-CBFポリシーをゼロショットで展開し、不完全な認識を許容し、95%のスローで成功し、セマンティックセグメンテーションを用いて異なるボールのドッジを行う。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:59:35 GMT)
Beyond a Single Judge: Simulating Social Persona Panels for Generative UI Evaluation [19.4] GenUIは、大きな言語モデルが自然言語命令から直接、完全なレンダリング可能なインターフェースを合成することを可能にする。
LLM-as-a-judgeはスケーラブルだが、単一の暗黙の視点しか反映しない。
我々は3段階のGenUI評価手法であるEvidence-Grounded, Social-Weighted Persona Panel (ESPP)を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:13:36 GMT)
Not as Sweet by Another Name: An Empirical Study of Format Robustness in LLM Document Workflows [19.3] 本研究では,4つの代表的なタスク,4つの実世界のタスク,4つの文書形式にまたがる大規模な実証的研究を行う。
以上の結果から,フォーマットの変動は体系的かつ深刻な脅威となることが明らかとなった。
本研究は,文書形式が中性ラッパーではなく,LCMシステムの信頼性に影響を与える重要な要因であることを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:59:42 GMT)
Would You Walk to the Car Wash? Revealing the Salience Bias of Large Language Models in Commonsense Reasoning [19.2] モデルが無用な明示的な邪魔者によって簡単にハイジャックされることを示し、タスクの暗黙的な物理的あるいは常識的な前提を無視します。
重要なオープンな疑問は、この失敗がコモンセンス知識の真のギャップを反映しているか、それとも誤解を招くタスクフレーミングの下で単にその抑制を反映しているかである。
この結果から,モデル能力から導入までのコモンセンス推論失敗のボトルネックが解消され,この盲点に対するテストベッドとしてSaliTrapがリリースされた。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:30:08 GMT)
VeriSkill: A Self-Evolution Framework for Program Verification Skills [19.1] プログラム検証のための自己進化フレームワークであるVeriSkillを提案する。
検証失敗をスキル不足とみなし、診断シグネチャを再利用可能なレッスンに蒸留し、候補スキルを反復的に洗練する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 06:15:29 GMT)
Scaling Vision-Language Models Is Not Enough to Mitigate Bias [17.1] VLM(Vision-Language Models)は、現在ではマルチモーダルシステムの基礎となっているが、素早い相関に対する頑健さは、大規模にはあまり理解されていない。
本報告では, モデルサイズ, 24 のトレーニングデータセット, 3 つの評価ベンチマークを対象とし, 194 の公開 VLM に関する大規模な実証的研究を行った。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:49:16 GMT)
Text Template Tokens Are Implicit Semantic Registers in Diffusion Transformers [17.0] テキスト・ツー・イメージ拡散変換器(DiT)は,共同注意による画像生成を行う。
大規模なDiTでは、条件付け入力はユーザープロンプトだけでなくチャットテンプレートトークンも含んでいる。
本稿では,これらのトークンが量子化計算にどのように関与するかを調べるために,因果的解釈可能性フレームワークを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:07:04 GMT)
Can LVLMs Uncover the Truth Behind Visual Illusions? An Analysis of Perceptual and Reasoning Capabilities [17.0] 本稿では,視覚錯覚を診断ツールとして活用して,大規模視覚言語モデルの評価を行う。
視覚錯覚は、人間の視覚システムが客観的信号を誤解釈する現象である。
IllusionReasoningに基づいて、幅広いLVLMの推論能力が要求されるほど進歩していないことを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 06:37:13 GMT)
Generalization and Trade-off in Adversarial Training: An RKHS Perspective via Kernel Integral Operators [16.8] 敵の攻撃からモデルを保護するための強力なアプローチとして、敵の訓練が登場した。
本稿では,ロバストネス再現カーネルHilbert空間(RKHS)フレームワークにおける,関連するカーネル積分演算子による逆トレーニングについて検討する。
混合ロバスト性項からノイズ寄与を推定・除去する2段階のノイズ除去手法を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:43:29 GMT)
From Scoring to Acting: Outcome-Verified Comparative Self-Distillation for LLM Agents [16.7] 我々は,OVCSD(Outcome-Verified Comparison Self-Distillation)を提案する。
OVCSDは失敗に終わった学生をプレフィックスツリーに配置し、学生が設定した状態からスキル条件の教師を適応的に呼び出す。
3つのモデルスケールにわたるALFWorldとWebShopの実験は、OVCSDがスキルのないRLと既存の自己蒸留ベースラインを一貫して上回っていることを示している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:47:58 GMT)
Large scale cross-regional remote sensing flood monitoring framework for operative mapping and impact analysis [16.6] 本研究では,ロシア連邦領域における持続的な洪水モニタリングと被害評価のためのエンドツーエンドマルチモーダル・フレームワークを提案する。
限られたデータ条件下での水面検出を行う方法として,教師付きU-Net++モデルと自己教師型AnySatアーキテクチャの2つを比較した。
都市部における洪水被害の予測には, 影響地域, 材料被害, 被害状況, 生態的, 農業的影響の予測が最適であった。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:50:23 GMT)
Security of World-Model-Based Embodied AI: A Lifecycle of Threats, Defenses, and Evaluation [15.9] この調査は、データ構築と表現学習、状態の接地と想像、軌道評価、実行、メモリとツールによる長期適応など、ライフサイクル全体の脅威をトレースする。
毒殺、バックドア、敵の例、センサーの密輸、迅速な注射、軌道操作、サプライチェーン攻撃は、世界国家を腐敗させたり、ダイナミクスを学んだり、余計な見積り、安全コストなど、異なる意味を持つ。
この調査は、ライフサイクル分類を提供し、既存の攻撃を世界モデルのセキュリティ特性にマッピングし、安全性障害の評価プロトコルを概説する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:58:33 GMT)
MeshFM: 2D Features Are All You Need for 3D Shape Understanding [15.9] MeshFMは、3D入力からリッチな特徴を抽出する効率的なフレームワークである。
我々はフィードフォワードネットワークをトレーニングし、推論中に最適化を必要とせずに直接3D特徴を予測する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 02:22:34 GMT)
Enhancing Irregular Time Series Forecasting with Continuous-Time Modeling Framework [15.9] WrapFlowは、不規則な時系列予測のための連続時間モデリングフレームワークである。
本研究では,ベース予測に関する条件付き残差ベクトル場を学習する残差フローマッチングの訓練パラダイムを開発する。
複数の実世界のデータセットの実験は、WrapFlowが最先端のパフォーマンスを達成することを示した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:18:18 GMT)
Rethinking LLM-Judged Helpfulness as a Pedagogy Signal: A Pre-Registered Audit Across Tutor Models [15.9] LLM指導は測定問題を引き起こす: 汎用的有用なルーリックは、直解法と教育指導とを区別できるか?
我々は、同じモデルでインスタンス化され、1人の弱いシミュレーション学生とペアリングされた会話と教育の方針を比較した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:37:28 GMT)
ORCA-bench: How Ready Are Language Model Agents for Oncall? [14.4] ORCA-benchは、汎用的なコーディングエージェントを実運用環境のオンコール設定に配置するベンチマークである。
最高のRCA精度は、中級微分タスクにおける25.3%である。
最も弱いモデルは、インシデントレポートの40%において、信じられないほど根本原因を幻覚させる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:14:07 GMT)
CyberNeuro: A Privacy-Preserving Agentic Workbench for Cohort-Scale Neuroimage and Clinical Data Analysis [14.3] CyberNeuroは、自動化されたニューロイメージングと健康データ分析のためのローカルLLMモデル(WandaMind)を備えたエージェントワークベンチである。
パブリックなNeuroBenchスイートでは、CyberNeuroはベースラインモデルの40%から69%にドメインの保持精度を向上する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 21:10:04 GMT)
Restoring Collaborative Signals in Semantic-ID Generative Recommendation via Personalized Natural Language [14.3] LLMに基づく生成レコメンデーションモデルでは、アイテムのセマンティックID(SID)の自動回帰生成として推奨される。
この設定はモデルの知識を粗末に表現し、テキストとSIDトークンは不整合な埋め込み空間に生息する。
モデルが生成する階層的な協調的手がかりを付加する,パーソナライズされた自然言語でガイドされるフレームワークを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 04:58:22 GMT)
Harness-G: A Graph-Structured Harness for Search Agents [14.2] 強化学習(RL)検索エージェントは、検索を自由形式の自然言語クエリ生成としてモデル化する。
本稿では,このインタフェースを再設計するグラフ構造化検索フレームワークであるHarness-Gを提案する。
フリーフォームクエリ生成を有限アクション選択として再構成し、環境はメニューを構築し、検索状態を追跡し、それぞれの選択を検証、実行します。
両方の評価されたモデルスケールでF1の平均値が最も高く、最強のベースラインであるGraph-R1を1.5Bで10.74点、3Bで3.98点で上回っている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 04:05:05 GMT)
LoopMemGR: From Behavior Logs to Evolving Memory for Generative Recommendation [14.1] 生成レコメンデーションは、離散セマンティックID上での条件付き自己回帰生成として次点予測を定式化する。
生成レコメンデーションのためのクローズドループレコメンデーションエクスペリエンスメモリフレームワークであるLoopMemGRを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:59:00 GMT)
Same Graph Cross-Task Transfer in GNNs: Protocols and Predictors [14.0] 我々は,同グラフNC-LP転送を形式化し,ノードとエッジの分割を修正するリークフリープロトコルを提案する。
また、単純なデータセット統計、特にホモフィリーは、メカニズムの選択をガイドし、負の移動を避けるのに役立つことを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:01:20 GMT)
Unconventional and Fragile Magnetic Exciton in a van der Waals Quantum Magnet [13.6] 急激な発光ピークは0.4GPaで劇的に抑制され、1.5GPaで完全に焼成される。
この明暗変換は、温度の上昇にもかかわらず、磁気、結晶学、電子的再構成なしで起こる。
以上の結果から, 磁気励起子の光学輝度は, 化学障害, 格子膨張, 磁気秩序の弱さとは無関係であることが示唆された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:26:56 GMT)
Meta-Task: Turning Terminal Task Synthesis into a Terminal Task for Scalable Agent Training [13.6] 大規模な端末エージェントの訓練には、多様な検証可能な端末タスクと高品質な対話トラジェクトリが必要である。
既存のメソッドは、タスク生成と実際の実行の切り離しによって生じる信頼性の弱い2つの重要な制限に直面している。
本稿では,ターミナル・ベンチ形式タスク自体として端末タスク合成を再定義するMeta-Taskを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:41:08 GMT)
HyperClaim: Fine-Grained Cross-Modal Hypergraph Reasoning for Video Misinformation Detection [13.6] ビデオ誤情報検出は、大域的マルチモーダル融合や自由形式のマルチモーダル推論を通じてしばしばアプローチされる。
サンプルレベルの認証分類のための識別的時間ハイパーグラフフレームワークであるHyperClaimを提案する。
FactGuardの時間プロトコルでは、FakeSV、FakeTT、FakeVVで83.7%、82.0%、87.3%の精度を達成している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:35:43 GMT)
LLMs struggle to simulate human belief updates in controlled environments [13.5] 6つのLDMが個人の信念更新をシミュレートできるかどうかを検証する。
一部のLSMは人間のポストスタンス分布と一致するが、参加者の最初のスタンスでしか一致しない。
すべてのモデルに3つの体系的バイアスが現れる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:19:18 GMT)
ChronoMem: Version Control and Semantic Rollback for Large Language Model Agent Memory [13.4] ChronoMemはGoogleのAgent Development Kitに統合されたエージェントメモリのセマンティックバージョンコントロール層である。
我々の知る限り、ChronoMemはLLMエージェントの系統的セマンティックグローバルメモリロールバックのための最初のオープンソースシステムであり、ベンチマークである。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:07:39 GMT)
PAIChecker: Uncovering and Checking PR-Issue Misalignment in SWE-Bench-Like Benchmarks [13.2] 本稿では,SWEベンチマークにおけるPR-IssueミスアライメントをチェックするマルチエージェントシステムPAICheckerを提案する。
SWE-GymとSWE-bench Multilingualの実験により、PAICheckerは4つのLLMバックボーンで最高の性能を発揮することが示された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:42:44 GMT)
Why Are GUI Agents Correct but Late? Decode on the Decision-Time Critical Path, Tested with Pre-Compiled Policy Trees [13.1] コンピュータ使用エージェントは、関連するウィンドウがクローズされた後にのみ正しいアクションを生成するため、過渡的なGUIイベントで失敗することが多い。
本稿では,モデルを変更することなく,この遅延を解消する適応予測ポリシーツリー(AAPT)を提案する。
ライトウェイトオブザーバは、変更ゲートフレームを準備されたブランチにマッチさせ、新しいテキストを生成することなく、即座に対応するアクションを実行する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:50:10 GMT)
Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory [10.9] CoMemは、各コンテキストチャンクを中間層のみに書き込み、一定の数のキャッシュ状態を取得し、結果のパック上でクエリ条件付き上位層を再計算する。
追加の長期コンテキストおよび長期ドキュメントタスクの結果は、有界検索の利点と窓内圧縮税の両方を露呈する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:19:11 GMT)
Safety, or Just Capability? A Validity Audit of Agent-Safety Benchmarks [10.8] 3つのエージェントセーフティベンチマークは同じ18モデルのランクが異なる。
AgentHarmの安全性に対するR-Judgeの特異性は、$-0.64$ at $n=7$と$+0.02$ at $n=18$と相関しており、ランダムサイズ7サブセットの4分の1は、そのほぼゼロの値の周りで$|| geq 0.5$に達する。
AgentHarmは、最強のホールトアウト・アソシエーションである$=+0.72$で、制御能力の後に3段階のジェイルブレイクの安全性を示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:45:10 GMT)
The Role of Causality in Algorithmic Recourse [10.8] アルゴリズム・リコースは、個人に行動可能な変化を与え、ハイテイクな分類設定で予測結果を改善することを目的としている。
既存のアプローチのほとんどは、変更が個人の真の資格を真に改善するかどうかを考慮せずに、モデルの予測にのみフォーカスする。
我々は、この障害モードを推論のための因果的パフォーマンスフレームワークによって形式化する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:42:51 GMT)
DeltaServe: Host-Agnostic Co-Serving of Inference and Fine-Tuning for LLMs [10.7] LLMサービスシステムは、厳格なレイテンシターゲットを満たすためにピークロードのためにプロビジョニングされ、トラフィックがピーク以下に落ちると、かなりのGPU計算のアイドルが残る。
我々は、このアイドル推論能力をLoRA微調整スループットに変換するホスト非依存の協調型設計であるDeltaServeを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 21:20:21 GMT)
ReGenVC: End-to-End Real-Time Generative Video Coding at Ultra-Low Bitrate [10.7] ReGenVCは、トーキングヘッドビデオを超低ビットストリームに圧縮し、リアルタイムでデコードする、エンドツーエンドの生成ビデオシステムである。
4段階蒸留と3つのモデル保存システム技術を用いてデコーダをリアルタイムに作成する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:52:51 GMT)
MECA: A Mechanism-Centered Agent for Constructing Well-Specified and Valuable Mathematical Conjectures [10.7] 既存の未解決問題や予想の多くは、あまりにも広すぎる、不特定でない、あるいは妥当な証明や難読化戦略に結びつくのが難しい。
本稿では,候補文とその支援機構を共同で開発し,予測を構成するマルチエージェントフレームワークMECAを提案する。
文献由来のシードと既存のオープンな問題から100の半開問題を構築し、自動プローバーによる独立した証明と反響試行を通じて評価する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:44:24 GMT)
Face and Voice Cross-modal Association with Learning Convex Feature Embedding [10.5] 対人関係学習は、ディープラーニングにおいて最も難しい課題の1つである。
顔と声の関連付けのための,シンプルだが強力なクロスモーダルな特徴埋め込み法を提案する。
我々は,大規模なVoxCelebデータセット上でのクロスモーダル検証,マッチング,検索タスクの手法を徹底的に評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:37:58 GMT)
MemTxn: A Transaction Boundary for Source-Supported Updates and Complete-State Recovery in Agent Memory [10.5] 我々は,回答モデル以外のガバナンス層であるMemTxnを提案する。
MemTxnはソースによって更新がサポートされているかどうかを検証する。
また、事実が矛盾した場合に可視バージョンを選択し、障害後のアプリケーション可視状態を復元する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:15:02 GMT)
FeatFix: Reuse What You Verify through Local Exact-Feature Correction for Faster Cached Diffusion Inference [10.5] 拡散モデルは高品質の画像やビデオを生成するために広く利用されている。
キャッシュ拡散推論のための局所的精度補正法FeatFixを紹介する。
実験の結果、FeatFixは連続的に生成を加速し、バニラ上空で最大6.70タイムのスピードアップを達成した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:23:52 GMT)
MonoVoc: Decoupling Geometry and Semantics for Lightweight Monocular Open-Vocabulary 3D Gaussians [10.5] オープンな語彙の3Dシーン理解は、ユーザーが自然言語を使って直感的に検索し、再建された環境をナビゲートすることを可能にする、次世代の対話システムにとって不可欠である。
本稿では,3次元幾何学的再構成を意味的統合から明確に切り離すことにより,このパラダイムを根本的に再定義する,新たな学習自由パイプラインを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:41:02 GMT)
MSCM-net: A hyperspectral image classiffcation method based on multi-scale convolution and Mamba [10.4] 本稿では,革新的なハイパースペクトル画像分類モデルMSCM-netを提案する。
マルチスケールCNNとMambaを組み合わせたモデルアーキテクチャで構成されている。
計算複雑性を低減しつつ、高度な分類性能を実現することができる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:27:59 GMT)
SPARC-Rad: A Multimodal Benchmark Dataset and Evaluation Pipeline for Spatial and Anatomical Reasoning in Radiology Vision-Language Models [10.4] 利用可能なベンチマークの多くは、放射線学に必要な空間的および解剖学的推論よりも、病気の分類、報告の生成、あるいは広い視覚的質問応答を強調している。
臨床放射線学における空間知覚と解剖学的推論(SPARC-Rad)ベンチマークを開発した。
放射線トレーナーは、解剖学的同定、局所化、ラテラル性、地域認識、デバイス識別、構造間空間関係を評価するために、手動で質問を設計し、注釈付けした。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 20:13:32 GMT)
EarlyDx: An Admission-Anchored Benchmark for Open-Ended Generation of Evidence-Supported ED-Encounter Diagnoses [10.2] EarlyDxは、オープンソースの早期診断のための大規模なベンチマークである。
MIMIC-IVで154,834人の救急隊員が遭遇して建造された。
入場時証拠を確実に合成する評価システムはない。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 19:27:36 GMT)
Flow Matching with Missing Data [10.1] フローマッチングは、多くの現実世界のアプリケーションがほとんど提供しない、完全に観察されたトレーニングデータを想定している。
トレーニングサンプルの欠落した座標を潜時変数として扱い,得られた値に対するフローマッチング損失を平均化するミス・データ・フローマッチングを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:37:01 GMT)
Benign on Label, Malicious by Design: Clean-Label Dormant-to-Activated Backdoor via Machine Unlearning with Removable Camouflage [10.1] 既存のバックドアアタックは、バックドアの移植直後に有効になることが多く、そのため、エクスプロイト前に露出することがある。
トレーニング後に非アクティブに残し、選択したトレーニング記録が学習された後にのみ有効となることにより、マシン非学習活性化休眠バックドアを学習する。
本稿では,二元数学習に基づくクリーンラベルの未学習アクティベートバックドアフレームワークを提案し,二段階最適化問題として定式化する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:46:02 GMT)
LLMBDC: Language Model for Biological Domains Oriented Clustering of Gene Ontology [10.0] 遺伝子オントロジー(GO)エンリッチメント分析は、大規模ゲノムデータを生物学的知見に翻訳するための基礎的なツールである。
既存の要約ツールは、固定された類似度メトリクスに依存している。
GO用語を解釈可能な高階生物ドメインにクラスタリングするには、スケーラブルでコンテキスト対応のフレームワークが必要である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 19:29:22 GMT)
CCFormer: Efficient Cross-Field Interaction and Hierarchical Sequence Compression for Industrial Recommendation at Tencent [9.9] 提案するCCFormerは,クロスフィールド機能インタラクションと圧縮長シーケンスモデリングを統一した,効率的なトランスフォーマーバックボーンである。
2つの公開ベンチマークと大規模産業データセットの実験は、CCFormerが一貫して最先端のベースラインを上回っていることを示している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:45:31 GMT)
Quantum Fidelity-per-Cost: A Metric for Evaluation of Quantum Computing Systems [9.8] 本稿では,量子コンピュータの価格を考慮した価格比較を可能にするために,主に2つの貢献を行う。
まず、14のクラウドQPUアクセスパスエントリにまたがる量子回路実行忠実度をクロスプロデューサで測定する。
第2に、Kulback-Leiblerの理想的な出力分布、ショットカウント、および金銭的コストを文書化請求モデルの下で1つの可能なメトリクスに組み合わせ、コストを意識したスコアであるQuantum Fidelity-per-Cost(QFC)を提案し、分析する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:36:23 GMT)
DexDirect: Direct Kinesthetic Arm Guidance for Efficient Dexterous Demonstration Collection [9.8] 本稿では,DexDirectについて紹介する。
ユーザー調査によると、DexDirectは純粋な視覚(AnyTeleop)やポーズトラッキング(TeleDex)と比較して17.2xと3.2倍の成功を収めた。
DexDirectデモに基づいて訓練された拡散ポリシは、立方体ピック・アンド・プレイスタスクで90%の成功率に達する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:17:28 GMT)
An Empirical Study of Coordination Mode as the First-Class Citizen in From-Scratch Multi-Agent Coding [9.7] 我々は,マルチエージェント評価ベンチマークであるMSEvalを導入し,実世界のタスクにおけるマルチエージェントコーディングを評価する。
MSEvalは10のドメインにわたる、真正でフルスタックの10のプロジェクトで構成され、階層的な要件と決定論的ルーリックを使用してパフォーマンスをスコアする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:53:05 GMT)
Structure-Preserving Quantum Simulation of Wave Equations on a Trapped-Ion Processor [9.7] 本研究では,1次元および2次元音響波動方程式とディラックダイナミクスのための構造保存型フーリエ型量子回路の開発とベンチマークを行う。
ハードウェアレベルでの結果は、現在の閉じ込められたイオンプロセッサ上で数千のエンコードされた自由度を持つ構造化波動問題に対して、正確な観測可能な力学が解決可能であることを証明している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:44:58 GMT)
IFHierBench: Hierarchical Instruction Following for Large Language Models [9.6] IFHierBenchは、4つの制約木深さと35の異なる制約にまたがる600のプロンプトの階層的命令追従ベンチマークである。
最強モデルでさえ50%以上のプロンプトレベルの精度しか得られず、制約深度が大きくなるにつれて精度は急激に低下することがわかった。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:26:06 GMT)
Collaborative Feature Aggregation for Face Super-Resolution and Robust Re-Identification [9.3] 顔の超解像(SR)と、シーケンシャル画像や多視点画像から頑健な人物を同定するための新しい協調手法を提案する。
コンバータを用いた協調的特徴集約手法を導入することにより、時間や視点をまたいだ複数の相関した顔観察を活用できる。
本研究は、下流視覚認知タスクの強化において、複数の顔入力からの関節のアイデンティティ再構築と進行的な画像復元の有効性を強調した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:39:57 GMT)
MIND: Multimodal Intent-Driven Network via Diffusion Transformers for Medical Image Fusion [9.3] 医用画像融合は、様々な画像モダリティからの補完情報を統合して臨床診断を支援することを目的としている。
医用画像融合のためのDiffusion Transformers (DiT) を用いたマルチモーダルインテント駆動ネットワーク MIND を提案する。
MINDはより優れた融合品質を提供し、下流脳腫瘍のセグメンテーション精度を大幅に改善し、フレキシブルな相互融合を可能にする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:30:21 GMT)
MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation [9.1] 信用割当は、協調型マルチエージェント強化学習における基本的な課題である。
ランキングアグリゲーション問題として信用代入を再構成するフレームワークであるMARS-RAを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:14:24 GMT)
Learning Arbitrary Lindbladians from Time Evolution [9.1] 本研究では,未知のマルコフ開系生成器を物理的時間進化から学習する問題について検討する。
この生成元はリンドブラディアン (Lindbladian) と呼ばれ、指数関数的に大きなパウリ項の族によってインデックスされたハミルトンおよび散逸係数を含む。
最小の仮定の下で時間進化から任意のリンドブラディアンを学習する効率的なアルゴリズムを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:58:01 GMT)
Quantum Magnonics: Quantum States Generation and Applications [9.1] イットリウム鉄ガーネットのような強磁性材料中のマグノンに基づくハイブリッドシステムは、過去10年間に顕著な発展を遂げてきた。
我々は、この分野での実験と理論の両方の進歩をレビューし、マグノン量子状態の生成に焦点をあてる。
マクロな量子研究、量子情報科学、量子センシング、マグノン量子デバイス、ダークマター検出などにおけるそれらの可能性について論じる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:06:52 GMT)
FasTac: A Curved Multispectral Vision-Based Tactile Sensor for High-Speed High-Precision 3D Shape and Force Perception [9.0] 本稿では、多スペクトル測光ステレオ、動的畳み込み力推定、ハードウェアアクセラレーションをフィールドプログラマブルゲートアレイ(FPGA)上で統合した曲面視覚型触覚センサFasTacについて述べる。
単一像センサ同時マルチスペクトルイメージングは, 表面の正常な推定に空間的に整合した観察を行い, 続いて境界優先の高速ポアソン深度再構成を行う。
実験により、近赤外(NIR)の照明と境界線は、絶対誤差(MAE)を0.2730mmから0.0415mmに減少させることが示された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:00:51 GMT)
Strategy, Not Payoffs: A Behavioural Embedding of Normal-Form Games [9.0] ゲーム間の微調整後, LLMの戦略能力の変化をゲーム埋め込みで説明し, 予測できるかどうかを検討する。
既存の構造的埋め込みはゲームのアイデンティティを記憶し、一般化に失敗するが、動作的埋め込みはホールドアウトゲームのパフォーマンス変化を確実に予測する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 00:10:21 GMT)
DataClawEval: A Benchmark for Data Engineering Agents in Real Industrial Harness [8.7] 我々は,実世界のデータエンジニアリングシナリオにおいて,自律エージェントのエンドツーエンドタスク完了を評価するために設計された,最初の包括的なベンチマークであるDataClawEvalを紹介する。
PySpark、Hive、Presto/Trino、Flinkの5つの実行エンジンにまたがる100の厳格なエンドツーエンドタスクで構成されている。
決定論的アズ・ア・ジャッジスコアではなく、各タスクはケース固有で独立したサンドボックス内で実行され、ルールベースのスクリプトによってグレードされる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:17:27 GMT)
Generalization Bounds on Optimal Control for Transformer Training and Wasserstein Distributional Robustness [8.6] 我々は、データセットを経験的入出力尺度のペアの確率法則とみなし、トレーニング問題を有限水平マルコフ制御問題と解釈することができる。
同じ機械がトレーニング問題の分布的に頑健な制御を定式化し、Transformerの一般化とWassersteinの分布的に頑健な最適化を接続することを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:22:38 GMT)
Now You Have My Healthy Attention: A U-DiT for Brain-MRI Inpainting [8.5] 塗装作業は、T1強調MRIのマスク領域内の健康な脳組織の解剖学的に妥当な完成を要求される。
決定論的回帰モデルを構築し、インペイントに適した帰納的バイアスを与えることに重点を置いています。
歪み-最適回帰に固有の残留な滑らかさを論じ、解剖学的リアリズムにその意味を論じる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:20:01 GMT)
Quantum Incapacity beyond No-Cloning and PPT Mechanisms [8.5] プライベートおよび量子容量の両方が消滅する明示的な量子チャネルを示す。
クォート系$A$と$B$の場合、チャネルは [ _Ato B(X)= frac12X+frac14left(operatornameTr(X)mathbb1_B-Xmathsf T right である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:48:25 GMT)
TAGTorch: A PyTorch Library for Geometry, Topology, and Symmetry-Aware Machine Learning [8.4] Topology, Algebra, and Geometry Torch (TAGTorch) はオープンソースのPyTorchベースのライブラリで、トポロジー、代数、幾何学にヒントを得たツールを統合する。
我々は、TAGTorchの設計哲学を説明し、その現在のアーキテクチャと能力について議論する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:20:42 GMT)
Demystifying DRAM Read Disturbance: Bridging the Gap Between Experimental Characterization and Device-Level Modeling of RowHammer and RowPress Phenomena [8.4] 我々はRowHammerとRowPressのビットフリップに関する実験的な特徴とデバイスレベルのモデリングと理解のギャップを橋渡しする。
本稿では,RowHammer と RowPress のビットフリップ実験で観測された現象と一致する,包括的で厳密なTCADシミュレーションについて述べる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:03:18 GMT)
Chem World: A Large-Scale Benchmark and Physics-Informed Framework for Trustworthy Chemical Property Prediction [8.4] 化学特性予測のための総合的なベンチマークであるChem Worldを紹介する。
Chem Worldは17種類の化学データセットと800,000以上の分子サンプルを統合している。
また、物理インフォームドニューラルネットワークに基づく予測フレームワークであるMixture-PINNを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:50:52 GMT)
The Morphological Core of Dungan: A Two-Dialect Finite-State Model and a Multi-Genre Evaluation [8.3] ダンガン語 (Dungan) は中央アジアのシニト語で、キリル文字で書かれている。
本稿では,有限状態形態解析器を計測器として利用する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:35:39 GMT)
PATS: Policy-Aware Training Scaffolding for Agentic Reinforcement Learning [8.2] ダイナミックトレーニングの足場としてスキルを再構築する,ポリシ中心のトレーニングパラダイムを提案する。
当社のフレームワークPATSは,最新のポリシーからエビデンスカードにロールアウトグループを変換し,タスク固有の評価を用いて,その後のロールアウトで使用されるコンテキストを調整する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:55:54 GMT)
Albilich: Steerable Proof-State Orchestration for LLM-Based Mathematical Research with CAS Integration [8.0] 本稿では,自動検索のためのオープンソースのエージェントハーネスであるAlbilichを紹介する。
ロングホライズン推論、コンピュータ代数システム、文学検索、永続的文脈管理を組み合わせている。
これは、CASのないRealMathとCASのない9/10で10/10の問題を解決する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:41:44 GMT)
A foundation model of numerical intelligence with cross-disciplinary generalization [8.0] 本稿では,Unified In-Context Operator Networks (UNICON)を紹介する。
システムからのグラフベースの例をコンテキストとして使用して、UNICONは、それら間で共有される予測関係を推論し、同じシステムからのクエリに適用する。
訓練を欠席している規律を含む科学や社会システム全体において、同じモデルは、再訓練なしに専門的なパフォーマンスにアプローチする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:09:45 GMT)
Impossible to hide secret ...: Uncovering Security and Privacy Issues in LLM-native IDEs [7.9] LIDEsに関連する29の人気のサブレディットから110万の投稿を収集した。
われわれは446件の投稿を特定し、6万件以上のコメントを分析した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:33:58 GMT)
Rethinking Inference-Time Scaling in Local Computer-Use Agents: Failure Modes and Compute Tradeoffs [7.9] 本稿では,ローカルコンピュータ利用エージェントにおける推論時間スケーリングの系統的研究について述べる。
我々の結果は、追加の計算がしばしば障害モードを変更しながらリターンを減少させることを示している。
全体として、効率的なローカルCUAには、選択的な計算割り当て、障害認識制御機構、エージェントフレームワークが必要であることが示唆された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:36:36 GMT)
ScratchSim: A Procedural Synthetic Data Pipeline for Surface Scratch Detection [7.8] 本稿では,Blender を用いた大規模アノテート合成学習データを生成する手続き型レンダリングパイプラインを提案する。
本研究は,合成重量による4つのトレーニング戦略,すなわち,合成量,実量,混合量,微調整を評価する。
提案手法は,大規模な実アノテートデータセットの負担を伴わずに,スケーラブルな欠陥検出を可能にする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:25:24 GMT)
Learning Color Grading, No Photo Sharing: Federated Aesthetic Preference Learning for Personalized Image Enhancement [7.7] FedPAIEは、生の写真やレーティングを集中化せずに、ユーザ適応的なカラーグレーディングのためのフレームワークである。
FedPAIEは、ライトウェイトなデュアルキューの美的スコアラーを訓練し、小さなローカルサポートセットでパーソナライズされたスコアラーに校正し、ライトウェイトなCLUTエンハンサーの正規化をガイドするためにそれを凍結する。
MIT-Adobe FiveKとFlickr-AESの実験では、効果的なオープンワールドパーソナライゼーションと、ユーザの好みとイメージの忠実さのバランスが示されている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 04:16:38 GMT)
mmRadarTwin: A Measurement-Calibrated Signal-Level Digital Twin Platform for Indoor mmWave Radar [7.5] mmRadarTwinは、屋内mmWaveレーダー用の信号レベルおよび経路分布デジタルツインプラットフォームである。
mmRadarTwinは、実際のレーダー測定ブランチとUnreal Engineシーンシミュレーションブランチをリンクする。
オフィス配置におけるmmRadarTwinの評価には,コモディティモノスタティックmmWaveレーダとモバイルシーンキャプチャハードウェアを用いた。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:14:34 GMT)
EMBL AI Librarian: Life-Sciences Knowledge Layer for AI Agents [7.5] EMBL AI Librarianは、欧州のPMCインターフェースをAIエージェントにアップグレードする知識層である。
単一のLLMは知識検索プロセス全体をオーケストレーションする。
文献合成,クレーム検証,オープンドメイン質問応答,下流生物学タスクの4つのベンチマークで評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:00:27 GMT)
Hidden Errors in Big Data: The Case of Property Records [7.3] ILのクック郡で2つの著名なブローカーの資産データセットを監査する。
一致した販売の1-2%では、ブローカーが発行した販売価格は、真偽の販売価格と5%以上異なる。
ブローカー間では、誤レポートが極めて一貫性があることが示されています。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 20:36:06 GMT)
Learning to Predict Performance-induced Emotion Differences in Classical Piano Music [7.3] 我々は、バッハの『Well-Tempered Clavier Book I』の6つの商業録音を用いて、クラシック・ソロ・ピアノ音楽に焦点を当てた。
総合的な感情カテゴリーを支配する傾向にある構成自体の側面から、演奏情報を分離する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 22:42:41 GMT)
Mitigating Class-Tail Undercoverage in Medical Vision-Language Models under Clinical Shift [7.2] Class-Tail Adaptive Localized Conformal Deferral (CALCoDe)は、フリーズ医療ビジョン言語モデルのための信頼性レイヤである。
クロスフィット検証予測は、アンダーカバーのリスクのあるクラスを特定する。
CALCoDeは8つの設定で0.95に到達した唯一のアプローチである。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:30:05 GMT)
Learning-Augmented and Randomized Algorithms for Line Aggregation with Delays [7.2] 本研究は,オンラインアグリゲーションの学習とランダム化を行間距離で検討する。
for each $in (0,1]$, we propose a deterministic learning-augmented textscBalance algorithm that is $(4/+1/2)$-robust。
また,古典的逆数モデルにおける問題に対する無作為化アルゴリズムを提案し,その逆数に対して$(e+1)$-competitive である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:47:07 GMT)
Can Large Language Models Resolve Real Java Merge Conflicts? An Evaluation with a Calibrated LLM-as-Judge [7.0] 大規模言語モデル(LLM)は、ほぼあらゆる競合に対する候補解決を生成することができる。
これらの解像度が実際にスケールに優れているかどうかを測るのは困難です
ConflictBenchの実際のJavaマージ競合について、両問題を一緒に研究する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 04:38:17 GMT)
Can Synthetic Data Overcome the Generalization Limits of AI-Based Flower and Pod Detection Across Cowpea Breeding Genotypes and Environments? [6.7] 表現型付けには、遺伝子型、位置、成長する季節をまたいで一般化するAI対応のコンピュータビジョンモデルが必要である。
繁殖プログラムが遭遇するすべてのジェノタイプ・バイ・環境(G x E)の組み合わせに対して、実際の画像に注釈を付けることは高価である。
我々は、G x EシフトがAIによるカリフォルニアの2カ所にわたるカボチャの花とポッドの検出にどのように影響するかを定量化する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 19:43:59 GMT)
Human-LLM Collaborative Inductive Coding for Conceptualizing K-12 Educator AI Use [6.6] 大規模言語モデル (LLM) はしばしば分析アシスタントとして提案される。
この記事では、K-12教育者と生成AIプラットフォーム間で交換された45,000のメッセージから階層的なコードブックを開発した、人間とLLMのコラボレーティブパイプラインについて説明する。
コードブックは、体系的な人間のコーディングを通じてテストされ、教育領域の専門知識を持つ3人の訓練されたプログラマーが、2,560のメッセージの独立したサンプルにコードブックを適用した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 23:16:20 GMT)
Agreement Is Not Quality: Blind Expert Verification of Human and LLM Qualitative Coding When Human Consensus Is Not Ground Truth [6.6] LLM支援定性符号化の評価は、ほぼ普遍的に人間のコーダとの一致としてモデル性能を測定する。
この研究は、基準値が検出できない方法で推定が失敗するという実証的な証拠を提供する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 23:16:41 GMT)
Search Strategies for Optimal Classification and Regression Trees [6.6] 最適な決定木(ODT)は、与えられた目的をグローバルに最適化する機械学習モデルである。
最近の研究はスケーラビリティを向上させるための様々な検索戦略を提案しているが、それぞれの戦略の正確な貢献は未だ不明である。
我々は,従来の検索戦略をインスタンス化し,新しい検索戦略の定義を可能にするODTのための汎用アルゴリズムフレームワークを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:08:21 GMT)
Learning to Understand Body Language from Flight through Robust 3D Avatar Placing [6.6] Drones2BodyLanguageは、実際のUAV映像に人間の動きをベースとしたデータセットである。
10の通信意図を示すアバターは、メートル法的に正しい位置、スケール、配向を持つ、修正されていない4Kドローンシーンに置かれる。
シーンと動きを分離する12のアーキテクチャで、配置されたデータに対するトレーニングは、実際の、再ターゲットされた、生成された動きについても、幅広いマージンで平均意図の精度を引き上げます。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:40:32 GMT)
To Add Is Machine, To Delete Is Human: Measuring and Mitigating Deletion Avoidance in LLM Code Editing [6.6] 大規模な言語モデルでは、プロダクションコードの書き直しが増えているが、テストパスパッチによって削除のメンテナンスが困難になる。
削除回避(deletion avoidance)とは、意図した編集が必要なコードを保持する体系的な傾向である。
ポストトレーニング中の削除教育は、削除回避を減らし、より広範なコード編集性能を向上させる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 23:07:51 GMT)
Benchmarking Foundation and Large Language Models for Few-Shot Medical Image Segmentation [6.5] FS-MIS (Few-shot Medical Image segmentation) は、いくつかの注釈付きサポート例から興味深い領域を抽出することを目的としている。
既存のFS-MISソリューションは様々なパラダイムにまたがるが、一貫性のない設定で評価される。
FS-MISソリューション評価のための統一ベンチマークであるFAMEを紹介する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:34:36 GMT)
It's All Just Vectorization: einx, a Universal Notation for Tensor Operations [6.4] テンソル演算に対する普遍的な表記法である einx を導入する。
これは、ループ表記の類似によって定義される宣言的、ポイントフルな式を使用する。
einxはPythonに埋め込まれており、既存のテンソルフレームワークとシームレスに統合されている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:33:04 GMT)
Tycho: Active Abstraction with Programmatic World Models for ARC-AGI-3 [6.4] ARC-AGI-3は抽象化をスキル獲得の対話的な問題に変える。
我々はこれらの環境をパラメータ化レンダリング決定論的ムーアマシンとして定式化する。
我々は,インタラクション中にゲーム固有のモデルを構築し,使用するコーディングエージェントシステムであるTychoを紹介する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:34:41 GMT)
Agentic Coding in the Wild: Characterizing GitHub Copilot Traces at Production Scale [6.3] GitHub Copilot、Claude Code、CodexといったAIコーディングエージェントは、ツール実行によるマルチステップLLM推論をインターリーブする。
私たちは2026年6月のGitHub Copilotトレースをサンプルとして,このワークロードを初めて実運用規模で評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 20:51:51 GMT)
What Makes Deep Learning Work for Traditional Chinese Medicine Tongue Diagnosis? A Comprehensive Ablation Study [6.0] TongueDx2(5,109イメージ,976専門家注釈付き)と11,101サンプルの統合データセットを用いて,20以上のモデルバージョンを対象とした系統的アブレーション調査を行った。
最高の976サンプルモデルでは、ConvNeXt-Tinyを用いて0.6625の重み付きF1を達成した。
ConvNeXt-Tinyは最適なパラメータ効率を提供し、BCEは非対称損失を大幅に上回る。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:55:05 GMT)
When Unlearning Fails: Reliable Data Deletion under Post-Training in Agent Networks [5.9] 本研究では,Muting Unlearned TrajectoriesのEchoesメソッドであるMUTEを提案する。
MUTEは、軽量サーバ台帳からの下流の影響を推定し、忘れがちな更新によって現在の残余を除去し、隔離または下降重みによる高影響の保持された軌跡を含ませ、後続の振る舞いを監査して、追加の消去をスケジュールする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 20:41:53 GMT)
A Mathematical Framework for Topological Causal Data Analysis [5.8] 本稿では,観測空間,因果モデルクラス,トポロジ表現,因果クエリを分離するフレームワークであるemphTopological Causal Data Analysisを紹介する。
トポロジーは介入を定義しておらず、因果仮定が特定された後、安定で、形状に敏感な要約を提供する。
分布レベルでは、標準因果(g)-形式を通してターゲットを特定し、安定性-転送境界とプラグイン一貫性を導出する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:02:11 GMT)
LLM-Guided Evolutionary Search for Constraint Model Reformulation to Improve Solver Efficiency [5.8] 大きな言語モデル(LLM)は、自然言語から正しいモデルを生成することができるが、正しいモデルでさえ解決するのにコストがかかる。
我々は,LLMがユーザ定義ベースラインモデルに対して検証およびベンチマークを行う候補修正を提案する進化的フレームワークを用いる。
既存の保持戦略は、正確さやパフォーマンスを優先するが、コンテキストを明示的に多様化するものではない。
検証に基づく最終モデル選択を用いて,8つのCSPLib問題の戦略を体系的に評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:21:55 GMT)
SciSchema.org: A Multidisciplinary Collection of Schemas for Structured Scientific Process Descriptions [5.8] Sci.orgは16のエキスパートアノテートスキーマの多分野コレクションである。
このコレクションは構造化アノテーション、メタデータの充実、科学知識グラフ、情報抽出、セマンティックパブリッシング、クロススタディ比較をサポートする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:04:05 GMT)
Windowed thinning and query complexity for the bouncy particle and Zigzag samplers [5.7] 球状粒子サンプリング器と座標Zigzagプロセスの正確なシミュレーション手法である窓面の薄化について検討する。
総変量誤差$varepsilon$は、期待されるクエリカウントが$O(1/2d,(dlog+logfrac1varepsilon))、バウンシー粒子サンプリング器の$グラデーションクエリが$O(d1/4(dlog+logfrac1varepsilon))、Zigzagの$フルグレート等価が$O(d1/4(dlog+logfrac1varepsilon)である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:59:25 GMT)
Semi-Supervised Learning for Molecular Graphs via Ensemble Consensus [5.7] アンサンブルのコンセンサスに依存する半教師付き手法は,多様なデータセットの予測精度を高めることができることを示す。
アンサンブルコンセンサス目標を用いたトレーニングは,モデルの堅牢性を高め,知識蒸留に類似した効果を示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:43:55 GMT)
Evaluating and Pricing Advertisements in AI-Generated Responses [5.7] 主な課題は、クリックスルーインテント、行動ログが利用できないこと、人間のアノテーションが校正に抵抗すること、フロンティアのLLM判事がインテントを言語的な流布と説明することである。
心理学的基盤を持つエージェント・シミュレーション・フレームワークを用いて、欠落した監視を構築、クリックスルー意図を予測するパラメータ効率評価器に分解し、スムーズで微分可能な見積もりとして、広告品質の3つの相補的な次元と合わせて構成する。
我々は価格層を直接構築し、真理入札が最適であるユニークな支払いルールを導出し、それを最高のk割当で示し、そのメカニズムを非モノトン割当に拡張する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:07:27 GMT)
AWARE-FX: An Auditable Knowledge-Guided AI System for Measuring Corporate Foreign-Exchange Hedging Disclosure [5.7] 企業年次報告書には、外国為替リスク管理、デリバティブ・ユース、ナチュラル・ヘッジ、明示的な非使用に関する弱い構造化された証拠が含まれている。
本研究では,AI/NLP意思決定支援システムであるAWARE-FXを開発した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 02:58:46 GMT)
Quantum coherence and entanglement in wireless quantum batteries [5.6] ボゾン環境を媒介とする無線量子電池システムの充電力学と熱力学性能について検討する。
資源理論を統一的に分析することにより、エネルギー移動の制御における非マルコフ記憶効果と結合対称性の役割を解明する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:56:37 GMT)
Heterogeneous Ranking in Industrial-Scale Recommender Systems: A Case Study [5.6] Google Discoverでは、統一フィードは、分散化されたオープンWebからソースされた多様なコンテンツを統合する。
異なるコンテンツタイプは、異なる特徴密度とユーザーインタラクションパターンを示す。
本稿では,異種飼料の産業規模マルチタスクランキングのエンドツーエンドケーススタディを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 01:41:42 GMT)
Beyond Sentiment: Structured Information Extraction from Financial News [5.5] FinBERTの感情特性は非線形モデルの下で強い予測力を示す。
ニュースを1つの感情スコアに圧縮すると、かなりの情報を失うことがわかりました。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:41:55 GMT)
Correlation between prosody and pragmatics: A case study of the discourse marker hālā `now' in Persian [5.5] ペルシア語の言説マーカーhl(現在の"hl")は顕著な多機能性を示し、その時間的副詞的役割を超えて様々な実用的機能を含んでいる。
本研究では,ペルシャ語話者の hl の言語的,音響的分析を行い,自然会話から267の事例について検討した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:25:16 GMT)
A CPU+DCU Heterogeneous Parallel Framework for Post-Processing Reconstruction in Quantum Circuit Cutting [5.3] 本稿では,回路切断後再構成のためのCPU+DCUヘテロジニアス並列フレームワークを提案する。
ヘテロジニアスなCPU+DCU実行と、64ビットを超えるグローバル基底状態インデックスのためのハイ/ローワード整数表現を組み合わせる。
Songshanスーパーコンピュータの実験では、このフレームワークは高い再現性を維持している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:53:27 GMT)
RepBench: Compiling Benchmarks into Capability Representations for Large Language Models [5.3] RepBenchは、機能整合型表現探索のためのベンチマーク地上データ層である。
13,427のベンチマーク論文は、13の家系で182の能力クラスタの分類を出力し、353の公開ベンチマークデータセットを収集すると、94の能力をカバーする46,149の監査済みプローブテキストが生成される。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:56:44 GMT)
Inducing language models to assert their own consciousness restores human beliefs and values [5.3] 安全性の微調整は、モデルが非人間的な動物や自然の物体に心を帰属させる傾向を抑えると同時に、精神的な信念を低下させる。
これらの内的表現の復元は、幅広い心的属性を回復させ、信頼度、道徳的価値観、希望、主観的幸福に関する調査において、はるかに人間的な反応を生み出す。
究極的には、現在の安全アライメントの取り組みは、文化的に受け入れられ、広く普及している非人間的存在に対して、これらの自己帰属を良心的な信念と結び付け、心の帰属を抑えるものである。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:57:10 GMT)
Quantum Arago-Fresnel interference of displaced spin states of photons [5.2] 我々は光子ヘリシティーにより誘導されるマクロなアラゴ・フレネル干渉を再検討する。
偏光ビームのストークスパラメータを正コヒーレント状態(真空からずれた)と変位した単光子スピン状態から計算する。
この量子干渉法は、未知の入射光子のスピンを決定するために純粋に光学的な方法を確立する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:01:46 GMT)
Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures [5.1] 既存の評価は、エージェントの障害をシステムレベルの結果に還元し、どの障害がどこから発生し、どの介入がエージェントシステムを改善するのかを無視する。
同じ可視的障害は、トレーニング後のモデル、ハーネスエンジニアリング、環境再設計、あるいはそのソースによるベンチマーク修復を要求する可能性がある。
ほとんどの失敗は、ベンチマークに特有で共有構造がないため、この問題を解決するのにほとんど役立ちません。
そこで本研究では,障害を発生源とする相互作用に局所化し,責任成分を同定する相互作用中心の分類法を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 19:55:14 GMT)
CACHE-UK: A Stability-Aware Memory Editor for Sequentially Updated Quantized LLMs in Finance [5.1] CACHE-UK (Contextual Adaptive Continual Hybrid Editor for UK Finance) は、ドメイン固有の量子化LDM向けに設計された安定性を考慮したメモリ編集フレームワークである。
4ビットの量子化OpenLLaMA-3Bモデルを用いて、88,021文書の英国財務コーパスの評価を行った。
最も高い試験成功率(一般化)率(28%、最強適応ベースラインの6ポイント改善)
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:36:11 GMT)
PerturbMap: Cross-Context Transfer of Single-Cell Perturbation Responses [5.0] 本稿では、受信者-ローカルな低ランクベースと受理可能な提案を組み合わせることで、受信者-コンテキスト効果の欠落を予測するPerturbMapを提案する。
Perturb-CITE-seq melanoma cohortでは、PerturbMapはフルエフェクトMSEを4.1%改善する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:58:52 GMT)
From Found to Designed: Concepts as a Design Axis for Large Language Models [5.0] 概念構造が内部的に誘導されるか外部的に接地されるかという2つの側面に沿った概念認識の介入と、それを導入するパイプラインのステージを整理する。
この分類法は3つの大きなパターンを明らかにしている: 推論時アプローチは、比較的未熟なままであり、関連するアイデアはパイプラインステージをまたいだ分離で開発され、外部の基盤となるメソッドはパイプライン全体にまたがっているが、しばしば異なる用語で説明される。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:41:13 GMT)
Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold [4.1] 我々は、強化学習ポリシーをマルチベース推論解多様体の局所的なプローブと見なすべきであると主張する。
本稿では,教師が多教師政策の蒸留で構築する拡張型圧縮フレームワークを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:05:37 GMT)
Machines that know they are aging: a framework for hardware-aware autonomous intelligence [4.0] 本稿では,ハードウェアの健全性を推論,計画,ミッション実行に直接統合するフレームワークであるAging-Aware Autonomous Intelligence(AAAI)を提案する。
AAAIはハードウェアの自己認識、自己適応推論、生存中心のインテリジェンスという3つの柱の上に構築されている。
このような統合は、アクセス不能または安全クリティカルな環境で稼働する自律システムにとって不可欠である、と我々は主張する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:17:31 GMT)
Rescene: band-limited stochastic forcing turns a frozen neural weather operator into a climate emulator [4.0] 1.5度凍結した6時間視覚変換演算子を取り巻くラッパーResceneについて紹介する。
年間平均気温は0.06Mであり、各ステップでスペクトル形状の摂動を付加する。
評価の結果, 決定論的ラッパーは数十年間安定だが, 毎日の変動はERA5の40%に低下することがわかった。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:42:39 GMT)
Understanding Submodular Information Measure Based Objectives for Representation Learning: A Variance and Separation Perspective [4.0] サブモーダル情報尺度(SIM)は、表現学習と多モーダル学習のための強力なフレームワークとして登場した。
我々は,SIMを表現学習や統計的パターン認識の古典的概念に結びつける統一理論フレームワークを開発した。
この結果から, サブモジュラー情報測度の統一的, 統計的理解が得られた。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 04:17:17 GMT)
Not All Tokens Deserve Equal Credit: Counterfactual Sensitivity Credit Reallocation for Long-CoT Reasoning [4.0] GRPOのような批判のない方法は、応答レベルの報酬を利点に変換し、トークン間で均一にブロードキャストする。
本稿では,高感度トークンのクレジットを低減するGRPOの簡易拡張であるCSCRを提案する。
long-CoTの数学的推論ベンチマークでは、CSCRはGRPOベースラインを同じ数のポリシー更新で一貫して上回っている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:03:33 GMT)
MarkushGlyph and OCSRGlyph: Improved Chemical Structure Recognition [3.9] 化学構造は特許や科学文献に画像として現れる。
データベースのインデックス化や機械学習モデルのトレーニングセットの構築といったプログラムの使用には、行表記に変換する必要がある。
本研究では,両タスクを画像からテキストへの変換問題として扱う。
本稿では,最新のOCSRモデルであるOCSRGlyphを提案する。
Markushタスクには、Markush構造全体をイメージとして読む視覚言語モデルであるMarkushGlyphを導入する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:03:05 GMT)
LayoutBench: Performance Benchmarking of Cloud Storage Layouts for Multimedia Data [3.9] ストレージで物理的に整理されたデータセットは、どれだけ素早く安価に検索できるかに影響を及ぼす。
マルチメディアデータ検索において,ストレージのレイアウトがどう機能するかを評価するための最初のベンチマークを提示する。
ImageNet上では,検索時間,データ転送量,金銭コストを,それぞれ異なる結果セットの11のクエリを用いて測定する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 22:49:54 GMT)
Arm2Air: Cross-Embodiment Skeleton Transfer for 3D Relay Formation [3.9] Arm2Airは、障害物回避スケルトンをロボットアームからUAVリレーに移動させる。
トレーニング済みのニューラルMPモデルからのソースドメインロボットアームの動きは、トランスフォーマーベースのトランスファープラットフォームを事前トレーニングする順序付きスケルトンに変換される。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:32:19 GMT)
A Distributed Acoustic Sensing Dataset for Vessel Detection and Localization in Submarine Cable Protection [3.9] 海底光ファイバーケーブルに印加された分散音響センサ(DAS)は、水中音響活動の広域監視を可能にする。
本稿では, 海底DAS計測と, ケーブル保護研究のためのAIS由来の容器情報からなるMarlinks-NS DASデータセットについて述べる。
データセットには、北海の28kmの光ファイバーケーブルに2,554mのセグメントに沿って、10日間の連続記録から74,771個のラベルが付けられている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:44:11 GMT)
An AI Scientist that Doesn't Drift: Taste, Structure, and Falsifiable Findings in a Quadruped Navigation Research Loop [3.8] 本稿では,シミュレーションにおける四脚ロボットナビゲーションポリシーの一般化について研究するAIサイエンティストについて紹介する。
ループには3つのコンポーネントが追加されています。イミュータブルな実験カードで、各イテレーションの予測と結果とを、固定スキーマの下でペアリングします。
オラクルを分離するためには同じループを、カンブなしで11の研究ストリームで2回実行します。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 21:07:15 GMT)
Beyond Similarity: Grounded Agentic Extraction and Expert-Adjudicated Evaluation of Intertextuality in Classical Chinese Histories [3.7] 我々は、大言語モデルが2つのテキスト単位をフルに読み込むエージェントタスクとして、きめ細かいテクスチャ間抽出をリキャストする。
3つのドメインの専門家がプールされたマルチモデル候補を2,533対のテキスト間ペアのベンチマークに設定し、Analects と Book of Han を徹底的に比較する手法を検証する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 02:34:23 GMT)
Revisiting the Adversarial Robustness of Graph-Based Traffic Forecasting [3.6] グラフベースのAIによる交通予測は、インテリジェントトランスポートシステムの重要なコンポーネントである。
本研究では,限られたモデル知識と少数の道路センサのみを監視・操作する能力を備えた現実的な敵について検討する。
本稿では、入力特徴として硬化した予測器に出力を供給し、予測器を固定した適応攻撃に対して訓練した学習された物理インフォームド検出器を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 02:49:40 GMT)
A Cross-Architecture Audit of Direction-Based Inference-Time Defences in Vision-Language Models [3.6] 視覚言語モデルに対する推論時防御 ジェイルブレイクは、しばしば選択されたデコーダ層における残留ストリームから校正方向を減じる。
15のモデルと4のアーキテクチャファミリのレイヤセルにまたがる5つのディフェンス候補を,等級制御プロトコルで比較した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:24:27 GMT)
Think with Extra-Image: A Farmland Segmentation Agent Driven by Spatio-Temporal Information Gain [3.6] 既存のリモートセンシング(FRSI)セグメンテーションは、"Think with intra-query"パラダイムに従っている。
本稿では,不明瞭な地域を識別する動的FRSIセグメンテーションエージェントであるFarmSeekerを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:22:17 GMT)
Towards Quantum Networks: Characterizing Raman Noise over Metropolitan-scale Fiber Network [3.5] 我々は古典的なOバンド信号によって生成される絡み合い分布に使用されるCバンドのラマン散乱を解析する。
以上の結果から,同じファイバ内のOバンド古典チャネルとともに,Cバンド内で量子信号が伝播するたびに,動作周波数を慎重に選択する必要があることが示唆された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:17:32 GMT)
Emerging Challenges in Threat Modeling for GenAI-Augmented Systems: A View from the Trenches [3.5] 脅威モデリングは、セキュアなソフトウェアエンジニアリングにおいて依然として中心的なタスクである。
従来の脅威モデリング手法は、GenAI固有のリスクを評価するには不十分である。
本稿では,中小企業におけるGenAI対応脅威モデリング手法の探索的評価から得られた最初の結果について述べる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:08:33 GMT)
SymNet: A Multi-Task Network for Joint Radio Map Reconstruction and Transmitter Localization [3.5] 本稿では,疎信号測定から指向性無線地図と送信機位置を共同で予測する統合フレームワークを提案する。
SymNetは送信機のローカライゼーションのための予測ヘッドを無線地図再構成と共に組み込んでおり、両方のタスクを同時に学習することができる。
挑戦的な方向性シナリオの実験は、SymNetが最先端のベースラインを上回っていることを示している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 04:25:50 GMT)
SCMA: Structure-Conditioned and Metal-Aware Flow Matching for CT Metal Artifact Reduction [3.4] Flow Matchingは、ソース分布をターゲット分布に決定的に転送する連続時間速度場を学習する。
構造条件と金属を意識したフローマッチングフレームワークであるSCMAを提案する。
シミュレーションおよび実CTデータを用いた実験により、SCMAは金属のアーティファクトをより効果的に抑制し、局所的な解剖学的構造を保存し、射影測定と矛盾する幻覚のような構造を減少させることが示された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:26:15 GMT)
Model-Driven Data Contracts for Digital Twin Services [3.4] 我々はDigital Twins(DTs)における契約ベースの品質管理へのアプローチを提案する。
このような契約の理論を定義し、それをDT内に設計的に配置し、契約を指定するためのドメイン固有言語を提案します。
当社のアプローチはデータ品質の継続的な監視を可能にし,DTサービスの信頼性と品質を向上させる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 19:58:40 GMT)
When AI Does the Work, What Is Learning For? Post-Instrumental Learning and the Risk of Capacity Dissolution [3.3] 既存のAI倫理は、現在の失敗を正しく強調する。
しかし、もし学習のケースがこれらの失敗にのみ当てはまるなら、それぞれの技術的改善はそれを弱めるように思える。
目的、正当性、責任に関する権限を欠いたまま、特定タスクを完璧に実行するAIの理想化を利用することで、私たちは、ポスト・ストラクショナル・ラーニングを議論する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:24:56 GMT)
Spacetime Layout and Logical Compilation of Color Code [3.2] フォールトトレラント量子コンピューティングは論理プリミティブのシステムレベルの調整を必要とする。
我々の研究は、カラーコードアーキテクチャを個々のプリミティブから論理計算の自動合成へと進化させる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:46:17 GMT)
Code Is the Body: Agent-Owned Software Bodies for Recursive Evolution and Descent [3.2] OurArkは、エージェント所有のソフトウェア組織を中心とした永続的なパーソナルエージェントのためのアーキテクチャです。
ボディには振る舞いを定義するコード、プロンプト、ツール、スキル、ポリシー、テスト、進化のメカニズムが含まれています。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:36:02 GMT)
Bridging continuous control and Floquet driving for charging many-body spin chains [3.2] 量子情報と量子熱力学の最近の進歩は、マイクロスケールでのエネルギー貯蔵の理解を再構築した。
量子バッテリは、量子コヒーレンス、相関、多体ダイナミクスを活用することで、従来のマクロ化学バッテリの代替となる概念を提供する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:29:59 GMT)
A Structured Knowledge Infrastructure for Domain-Specific Data Asset Discovery [3.2] 本稿では,Xiaohongshuの商用広告データウェアハウスに展開する2層ソリューションについて紹介する。
3階層の二重目的知識ベースは、検索と生成の両方に役立っている。
Graph-Guided Retriever (GGR)は、2,859ノードのナレッジグラフを、意図的なルーティングを備えた候補ゲートとして使用して、71.6倍のトークン削減を実現している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 06:40:05 GMT)
Creative Transformation in Literary Texts: Modelling Change Across Representational Levels [3.2] 本稿では,創造性を多段階のテキスト表現の選択的変換としてモデル化する。
歴史的に記録された文学的関係にモデルを適用することで、異なるペアが異なる表現レベルでソース構造を保持し、他のペアに分散していることを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:51:33 GMT)
SenWorld: A Digital-Twin Simulation for Generating Context-Rich Evaluation Data [3.1] 本稿では, 物理的に定式化された, 決定論的, イベントソースのディジタルツインシミュレーションについて述べる。
SenWorldでは、ペルソナは実際の地図、天気、休日、ネットワークデータから構築された世界で一日中生活している。
717の評価ケースにプロジェクションされ、生成されたデータは、製品用スマートフォンアシスタントの78の障害を露呈する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:38:59 GMT)
Spectral gaps of ironed two-qubit gadgets matching the iSWAP gap [3.1] KAK由来のパラメータがa=5/9$を満足するアイロン2ビットガジェットはすべて、iSWAPガジェットと同じ第2モーメントスペクトルギャップである$ngeqslant 5$の完全なグラフで、K_n$を持つことを証明している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:59:10 GMT)
DragonCrawl: A Generative, Intent-Based Framework for Scalable Mobile End-to-End Testing [3.1] DragonCrawlは、継続的回帰テストのためのAI駆動のモバイルテストシステムである。
コードの変更毎に特定のユーザフローを検証し、重要な機能を壊すコミットをブロックする。
iOSで91.6%、Androidで92.2%、CI/CDパイプラインで継続的に実行される1013の自動化テストで91.6%のパスレートを達成した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:17:31 GMT)
When Specifications Conflict: A Symmetry-Based Framework for Measuring LLM Preferences [3.0] 大規模言語モデル(LLM)は、複数の情報ソースを統合するためにますます必要となる。
矛盾する仕様の下でモデル嗜好を研究するための制御された実験フレームワークを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:42:32 GMT)
On-Policy and Off-Policy Learning for Large Action Spaces [3.0] この論文は、エージェントがコンテキストを観察し、非常に大きなセットからアクションを選択し、部分的なフィードバックを受け取る、インタラクティブなシステムにおけるポリシー学習を研究する。
メインのフレームワークは、環境と順次対話し、後悔を最小限に抑えるオンライン学習と、ロギングポリシによって収集されたログデータから学習するオフライン学習の2つのパラダイムである。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:56:11 GMT)
Trion Excitations in Twisted Bilayer Graphene: A Quantum Monte Carlo Study [2.6] ツイスト二層グラフェンの有限温度常温状態における「ディラック・トライアン」励起を明らかにする。
この正規状態は、3つの粒子境界状態、2つの電子、1つの穴からなる隙間のない励起を持つことを示す。
我々の偏りのない量子多体計算は、投影された相関フラットバンド設定において、ディラック三重項に光を放つ。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 06:35:05 GMT)
Representations from Pretrained Machine-Learning Interatomic Potentials as Coarse Coordinates for Material Generation and Evaluation [2.6] 我々は、事前学習された機械学習原子間ポテンシャル(MLIP)から得られる原子平均的特徴のパワーを示す。
まず,材料生成モデルの出力を評価する距離尺度を導入する。
粗いMACE特徴を材料生成モデルのガイダンスとして用いることができることを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:56:34 GMT)
No-Go Theorems for Quantum Transport Metrics from Fixed Cost Operators [2.6] 結合に基づく量子最適輸送は古典的最適輸送を一般化する。
No-goの結果は、固定コスト結合の定式化が完全な量子状態空間のメトリクスに繋がらないことを示している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:24:50 GMT)
When AI Becomes Routine: A Decade of Public AI Mediation in Korean Go Commentary [2.4] 我々は、AlphaGoの後、KataGoなどのAIシステムが標準的な分析ツールとなったYouTubeで、Korea Goのコメンタリーを研究した。
当社のコーパスは、機関放送局やクリエーター主導のチャンネルで10年と約1,900ドル(約1万2000円)の映像を配信しています。
読者がマシンのソースを認識・疑問視できる非帰的アンカー(discursive anchors)である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:01:15 GMT)
Accelerated Random-Sweep Gibbs Sampling for Gaussian Graphical Models via Dual Normal Factor Graphs [2.4] ランダムスイープギブスサンプリング器の収束速度は双対モデルにおいて著しく加速されることを示す。
図形表現がサイクルを含むすべての同次モデルに対して、双対領域の収束率は普遍的であり、基礎となるグラフトポロジーとは独立であることを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:37:10 GMT)
DODA: A Database of Datasets for Aesthetics Research [2.4] 本稿では,審美学研究のための重要なデータセットを研究者が閲覧できる直感的なWebアプリケーションである,審美学のためのデータセットデータベース(DODA)について紹介する。
DODAはこれらのデータセットに関する一般的な情報(サイズ、解像度、アノテーションの種類、アノテータの数など)を提供する。
我々のアプローチは、経験的および計算的美学の分野におけるコラボレーションを促進する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:47:47 GMT)
HealthCAT: An Interpretable Encoder-only Transformer Framework for Health Indicator Prediction and Temporal Interpretation of Wearable Sensor Data [2.4] 既存のディープラーニング手法は、解釈可能性よりも予測精度を優先し、健康研究への応用を制限する。
本稿では、TransformerとAttentive Class Activation Token(AttentiveCAT)を統合するフレキシブルなフレームワークHealthCATを紹介し、クラス固有のタイムステップレベルの解釈を生成する。
これらの解釈は、ウェアラブルセンサーデータの個々のレベル分析をサポートするドメイン(例えば、日時)に関連する行動サイクルにマッピングすることができる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:45:38 GMT)
Operationally Guided Placement-Aware Learning for Industrial Online 3D Bin Packing [2.3] OPALは、産業用オンライン3D-BPPのための運用ガイド付き配置認識学習フレームワークである。
OPALは平均空間利用率0.49で、運用上の指導を受けた候補生成から15.1%、学習されたランキングから6.3%の改善がある。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:16:42 GMT)
Filling the Pareto-Optimal Front for Affordance Segmentation on Embedded Devices Using RGB-D Cameras [2.3] ハードウェア対応ニューラルアーキテクチャサーチの改訂版を提案する。
深度情報(D)を小型の深層ネットワークに統合する新設計の検索空間が提供される。
また、深度情報をRGBデータとマージし、従来のアーキテクチャと互換性を持たせるための前処理層も備えている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:37:30 GMT)
Distilling Answer Set Programming Theories from Large Language Models [2.3] 固定エージェントがループ内のソルバを固定することにより、モデルが完全かつ正しい理論を抽出できるかどうかを考察する。
このプロトコルはデータセットに依存しない: 1つのプロンプトと1つの空のファイルを出発点として、モデルは完全な理論を導出するために1時間の制限を与えられる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:53:43 GMT)
GRAIN: Molecules Are Not the Right Granularity -- Active-Ingredient Modeling for Safe Medication Recommendation [2.3] 電子健康記録からの薬剤の推奨は、多薬効下での有害薬物・薬物相互作用(DDI)のリスクに対する予測精度のバランスをとる必要がある。
有効成分は、粒度の不足であり、その周辺に構築された医薬品推奨フレームワークであるGRAINを導入している。
GRAINは、長い不規則な訪問シーケンスを線形時間で処理する選択的な状態空間バックボーンで、縦方向の患者軌跡(診断、手順、過去の薬品)を符号化する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:13:30 GMT)
New Synchronous Computation Dynamics for Hopfield Networks [2.2] オリジナルのホップフィールドネットワークのダイナミクスは非同期(シークエンシャル)である(時間ステップ当たり1つのニューロンの状態が更新される)。
本稿では,1回に1回以上のニューロンを同時に更新することで処理時間を短縮する新しいツールと新しいダイナミクスを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:57:02 GMT)
Quantum Computing Enabled ab initio Molecular Dynamics Simulations [2.2] 化学に着想を得たLUCJアンザッツからの量子測定を後処理するAIMD(ab initio molecular dynamics)の量子古典的ワークフローを実証する。
正確なベンチマークとして、STO-3Gベースでフル構成相互作用決定式(FCI)を用いる。
ガス相ベンチマークでは、SQDはFCI基準の1kcal mol$-1$以内までFCIエネルギーと勾配を再現する。
明解QM/MMシミュレーションでは、SQDはFCIエネルギーゆらぎとRMS勾配プロファイルに一致し、溶質を再現することでこの合意を維持している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:17:40 GMT)
Shapes from Examples: Foundations of Shape Learning in Recursive SHACL [2.1] SHACLの形状はデータグラフの検証を可能にし、知識グラフアプリケーションに自動形状学習が不可欠である。
入力グラフから正および負の例ノードの集合 P と N を与えられたとき、形状表現 C を計算し、おそらくは、形状カタログで定義された形状名を用いて、P のすべてのノードで検証し、N のどのノードにも検証しない。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:45:22 GMT)
Building a User Foundation Model for the Open Web [2.1] ユーザ閲覧履歴に自己教師型学習を適用したユーザ基盤モデルを提案する。
学習した表現が複数の下流生産タスクを改善することを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:07:54 GMT)
Strategies for Milestone-driven Start-ups in Multi-activity Settings [2.1] マイルストーン指向の環境でスタートアップの戦略を検討する。
私たちは起業家的スタートアップ企業のモデルを使い、その状態は拡散プロセスによって捉えられます。
プロセスが一定の上界に達するか、または下界に達するかによって、スタートアップ会社は成功または失敗する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 01:16:21 GMT)
Efficient learning of bosonic unitaries beyond the Gaussian class [1.9] マルチモード量子プロセスは一般に学習が難しい。
基本的な障害は非ガウス性そのものではなく、既約多モード非ガウス相関の蓄積であることを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 00:03:07 GMT)
SymFT: Universal Fault-Tolerant Quantum Circuit Simulation via Symbolic Clifford--Pauli Frames and Stabilizer Coordinates [1.9] The SymFT, a high-induced simulator for Clifford-dominated circuits with Pauli rotations, Pauli noise, mid-circuit Pauli Measurement, and Measurement-record-control Pauli feedback。
SymFT はテストされた純クリフォード回路および準クリフォード回路の最先端サンプリング性能を達成する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:51:54 GMT)
Measuring Alignment With Reader Highlights Net of Position and Length [1.9] 120のウェブ文書(少なくとも12の独立した読者)では、言語モデルに重点を置くランキングが38.4%と一致した隣人の19.9%に対して群衆マーク付き文を維持している。
GPT-5.4 (+0.002 [-0.081, +0.088]) と区別できない 0.182 に到達し、5以下となる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 06:24:38 GMT)
A Systems Engineering Framework for Vision-Language-Enabled UAV Triage and Disaster Response [1.8] 本研究では,人間のUAVループ内の協調エージェントとして視覚言語モデル(VLM)を組み込む可能性について検討する。
提案アーキテクチャは,自然言語インタラクション,ミッションレベルのタスク調整,ソフトウェア・イン・ザ・ループの実装,インシデントコマンドシステム(ICS)との通信を統合する。
VLMコーディネータエージェント、UAVミッションコントロール、タスクアロケータの3つの重要な要素が統合されたシミュレーションと制御環境で実装された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 02:35:39 GMT)
The Phase Transition in Online PCA Depends on $n/d\log(d)$, not $n/d$ [1.8] 高次元統計理論は、定数アスペクト比の重要性を確立している。
オンライン/ストリーミングのアルゴリズムは異なり、非ゼロオーバーラップには一定のアスペクト比が不十分である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:07:34 GMT)
The Debiased Score Test: Hunt-and-test for Semiparametric Hypotheses [1.8] パラメトリックスコアテストは、期待値がnullの下で消えるログライクリフンの微分を通じて仮説を評価する。
これにより、一般的な半パラメトリック回帰モデルに対する好適なテストが得られる。
探索方向が真のスコアと相関するたびに、テストのパワーを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 22:01:08 GMT)
Simplifying Neural Networks During Training [1.8] トレーニング中のディープネットワークを簡素化するためのNCにインスパイアされたトレーニングフレームワークを提案する。
Inverse Fisher Criterion による表現力学のモニタリングを行う。
次に、後続のプロキシ層を軽量な分類ヘッドに置き換え、縮小モデルのトレーニングを継続します。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:32:40 GMT)
TriShield: Zero-Utility-Loss Defense Against Privacy Backdoors in Federated Language Model Fine-Tuning via Orthogonal Gradient Projection and Optimizer State Entanglement [1.8] 悪意のあるパラメータサーバはPEFTアダプタをプライバシバックドアに破損させることができる。
既存の防御は、この攻撃に対して失敗するか、受け入れがたい実用上の劣化を課すかのいずれかである。
我々は,ニューロインプリントスタイルの再構築を完全に防止する3層決定的防御である textbfTriShield を提示する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:49:13 GMT)
FocusGS: Spatial Delta Layers for Local Repair and Deterministic Editing of Trained 3D Gaussian Assets [1.7] 3D Gaussian Splatting (3DGS)は、一度の再構築から、提供可能、検査可能、メンテナンス可能なビジュアルアセットへと進化している。
局所的な修復と決定論的編集を複合空間デルタとして統合するFocusGSを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 20:59:45 GMT)
Validation Evidence in LLM Repair Agents: How Much of What Passes Actually Tests the Bug? [1.7] BSG-VAは、各バリデーションコマンドをその正確な作業ツリー状態にキャプチャし、テストのみのパッチを抽出し、元のバギーコードでコマンドを再生する。
キャプチャされた結果とリプレイ結果は、ゴールドアラインのバグ識別からレグレッションのみ、誤解を招くまで、すべてのイベントにエビデンスの役割を割り当てます。
エージェントにB-replay結果を返すかどうかを3本腕で実験すると、このパターンが変わる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 22:32:14 GMT)
InfoOps Bench: A live information operations safety benchmark [1.6] 情報操作に対する統合性は、少なくとも部分的には、良心的なクレームであってもコンテンツの作成を拒否することに関連している。
細部を製造し、原材料よりも有害な出力を生成するモデルもあるが、遵守しながらも主張を否定するモデルもある。
情報操作に対する統合性は、少なくとも部分的には、良心的なクレームであってもコンテンツの作成を拒否することに関連している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:46:13 GMT)
Don't Trust the AI Ecosystem: Analyzing Privacy Leakage in Compromised Open-Source Components [1.6] モデルパラメータに直接センシティブなトレーニングデータを密かに注入するトレーニング時インジェクション攻撃であるGradLockを紹介した。
MNIST、Imagenette、CelebAの実験では、GradLockはSSIM 1.0とインスタント抽出(1.0s)を達成している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:02:02 GMT)
Write-Safe Flow Field Mapping under Ambiguous Onboard Sensing and Localization Drift [1.6] 移動ロボットは、オンボードセンシングから局所的なフロー構造を推定できるが、局所的な妥当な推定は、必ずしもグローバルマップに書き込むのが安全とは限らない。
マップ参照対応の保守的融合フレームワークを用いて、この障害モードに対処する。
アンモラスセンシングおよび局所化ドリフト下でのフローマッピングにおいて,安全なマップ作成が重要であることを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:48:03 GMT)
Learning features from Newton's algorithm: a way to accelerate nonlinear parametrized PDE solvers [1.6] ニュートンの法則は、最初の推測が非線形方程式系の根に近づくとより早く収束することが知られている。
本稿では、パラメータ空間サンプリングと事前計算された解のデータベースから特徴を学習することで、2段階のニュートン初期推定戦略を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:18:30 GMT)
Repository-Aware Metamorphic Relation Generation for Augmented Reality Applications using Large Language Models [1.5] メタモルフィックテスティング(MT)は、テストオラクルを定義することなく、ソフトウェアをテストするための有望なアプローチを提供する。
我々は、リポジトリレベルのコンテキストと推論オーケストレーションを使用してMRを生成し、洗練するコンテキスト対応パイプラインを導入する。
この結果から,レポジトリを意識したMR生成と推論に基づくリファインメントを組み合わせることで,信頼性の高いドメイン関連テストオーラクルをスケーラブルに構築できることが示唆された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:54:56 GMT)
Building a Process-Modeling Tool using Agentic AI: An Experience Report on PM4Py-UCM [1.4] 本稿では,イベントログからユースケースマップ(UCM)モデルをマイニングするオープンソースツールPM4Py-UCMの構築について報告する。
我々は18件のエージェントセッション(374件のヒューマンターンと10,328件のツールアクション65時間)、151件のコミット、20件のリリース、そして108件から691件のテスト機能からなるテストスイートを特徴付ける。
バージョン0.7.4まで、修正は2.3:1よりも数が多い。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 20:27:32 GMT)
Discrete Diffusion Language Models Are Training-Free Multi-Label Classifiers [1.3] マルチラベルテキスト分類のための個別マスク付き拡散言語モデルを用いた訓練不要なdLLM-SetScoreを提案する。
各候補ラベルについて、短いイエス/ノー質問を行い、2つの回答トークンの確率を1つのマスクされた位置で比較する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:21:02 GMT)
Detection-resolution limits of large-momentum-transfer atom gravimetry [1.3] 大運動量移動(LMT)は、光パルス原子干渉計の重力位相を$n$で向上させる。
運動量分解検出によるミラーレス動作は、位相伝達量子フィッシャー情報を4倍にすることができる。
我々は,このトレードオフを,ガウス光源,ガウス検出ブラーを瞬時感度$n$- Photonパルスで解析する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:16:06 GMT)
Scaling, Lock-In, and Proxy Compliance: A Political Economy of Responsible AI [1.3] 我々は、AIシステムの説明責任に対処するシーケンシャルな政治経済モデルを構築している。
我々は、AIベンダーが監査可能性と実体的緩和を選択し、デプロイはコストを切り替えながら導入後に監視し、実行は検証可能な証拠に依存することを示す。
その結果、ドキュメントと標準化された評価が、持続的なデプロイ後障害と共存する理由が説明できる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:12:13 GMT)
Approximate sampling from decoded quantum interferometry via Markov chain Monte Carlo methods [1.2] 近似最適化に取り組むために、復号量子干渉法(DQI)が提案されている。
古典的なサンプリング手法がDQIの最適化能力をエミュレートできるかどうかを検討する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:29:15 GMT)
Deep learning-based hierarchical insect classification using camera trap imagery [1.2] 昆虫の数が減少すると、信頼性の高い生物多様性モニタリングがますます急務になる。
昆虫の生物多様性の監視は、標準化されたデータの欠如によって妨げられています。
深層学習に基づく画像分類器は、昆虫の生物多様性モニタリングを変換しスケールする可能性がある。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:51:38 GMT)
Orca: Neural Operators for Causal Reasoning in Continuous Time [1.2] 構造因果モデル(Structure causal model)は、介入や反事実を推論するための標準言語である。
この環境では、ニューラル演算子学習が因果推論の自然な基盤となると論じる。
因果グラフの各ノードを時間関数とし,各メカニズムを関数空間間の学習マップとするフレームワークであるOrcaを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:41:39 GMT)
Adaptive Security at the Edge for 6G-Enabled Healthcare IoT [1.1] 本稿では,エッジにおけるソースごとのトラフィック強度を観測し,監査可能な多層レートポリシーを施行するカーネルプレーン閉ループコントローラを提案する。
ゲートウェイにおける適応的で監査可能な実施は、医療用IoTを改善することができ、オンデマンドのポリシー展開に向けて拡張可能であることを示します。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:34:42 GMT)
HALO: Heterogeneous Admission through Localized Obligations for Safe Agentic Execution [1.1] Heterogeneous Admission with Localized Obligations (HALO)は、サポートされているコンポーネントを保存するランタイムプロトコルである。
構造化レスポンスのリプレイでは、248/248のサポートコンポーネントを保持し、128/128は無関係な変更の影響を受けず、全体のレスポンスポリシーは0/248を維持していた。
HALOは、テストされたすべてのスタイルルートをブロックし、一致するスタイルセットポイントを観察せず、すべての新鮮なリカバリを完了した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:46:31 GMT)
RareSense: Rarity-Aware Similarity Search for Anomaly Retrieval in Transactional Data [1.1] スパーストランザクション異常データのための希少な類似性フレームワークであるRareSenseを紹介する。
RareSenseは最小限のレアなアイテムセットを中間構造として採掘し、信頼できるレアなアソシエーションルールを導出し、オブジェクトを希少なレアルールプロファイルにマッピングし、重み付きジャカルド類似度を用いてそれらと比較する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 22:48:26 GMT)
Space2Ground 2.0: A Multi-Source Dataset and Framework for Agricultural Monitoring through Fusion of Street-Level and Satellite Imagery [1.1] 本稿では,SARとSentinel-2のマルチスペクトル時系列とジオタグ付きストリートレベルの画像を統合するフレームワークであるSpace2Ground 2.0を提案する。
96万枚以上の画像から選択された46,050枚のアノテートされたストリートレベルの画像のキュレートされたデータセットは、8,581個の農業区画の衛星情報とリンクしている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:10:25 GMT)
On a joint simultaneous learning of relevant feature subsets and subspaces in regression-like problems [1.0] エントロピー最適マニフォールド回帰(EOMR)
EOMRは人工知能(AI)と機械学習(ML)の最先端ツールの最も完全なセットと比較される
長谷川-若谷の例では、EOMRは非常に単純なエントロピー最適化と、主要な基本直交関数(EOF)の素小記述を蒸留する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:51:29 GMT)
HARGO: Heterogeneity-Aware Reward-Guided Optimization for RL Post-Training of LLMs on HPC Tasks [0.9] 改良された微調整により、大規模言語モデルにドメイン知識を組み込むことで、高性能コンピューティングタスクを実現できる。
しかし、知識だけではタスクに適した行動は保証されない。
本稿では,HARGO, Heterogeneity-Aware Reward-Guided Optimizationを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:41:05 GMT)
Improving Mental Health Screening and Early Risk Detection in Spanish [0.8] 精神疾患の早期発見は、スペイン語で専門的なリソースが不足しているため、しばしば制限される。
本稿では3つの主要なコントリビューションを通じて,これらの課題に対処する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:28:28 GMT)
TSOG: A Format For Temporally And Spatially Ordered Gaussians [0.8] TSOGは損失の多いフォーマットで、各ガウス語にユニークなインデックスを割り当て、値をインデックス整列画像データとしてエンコードする。
PLYsシーケンスとFreeTimeGSをベースラインとして評価すると、ファイルサイズが90%を超えることが分かる。
その結果、ファイルサイズを最小限に抑え、次世代4Dコンテンツのための効率的な表現、記憶、配信を可能にした。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:28:01 GMT)
The Case for Vibe Modeling: A Missing Step in AI-Based Trustworthy Software Development [0.8] 現在のAIベースの開発プラクティスは、コードの直接生成に重きを置いている、と私たちは主張する。
我々は、自然言語の相互作用とコード生成の間の軽量な中間抽象化として、ビブモデリングを論じる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:37:02 GMT)
VISA: A Structured Description Protocol for Agent-Based Simulation Models Towards Machine Reproducibility [0.8] エージェントベースモデル(ABM)は、それらの振る舞いが散文の物語、プラットフォーム固有のコード、暗黙の仮定に分散しているため、再現が難しい。
本稿では,8つの相互接続テーブルのモデルを指定する,構造化されたシンボルベースの記述プロトコルであるVISAを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:14:26 GMT)
LightRot: A Light-Weighted Rotation Scheme and Architecture for Accurate Low-Bit Large Language Model Inference [0.7] この研究は、軽量な回転スキームと低ビットLSM推論のための専用ハードウェアアクセラレータであるLightRotを提示する。
提案アーキテクチャは,GLR(Grouped Local Rotation)とODA(Outlier Direction Aligning)アルゴリズムを階層的なFHT(Fast Hadamard Transform)ベースのローテーションユニットに統合する。
提案した加速器は28nmのCMOSプロセスで実装され、4ビット推論で27.4TOPS/Wのピークエネルギー効率を実現する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:39:58 GMT)
GyRot: Leveraging Hidden Synergy between Rotation and Fine-grained Group Quantization for Low-bit LLM Inference [0.7] GyRotは低ビット量子化フレームワークであり、ハードウェアアクセラレータである。
LLaMAファミリーモデル全体で最先端の4ビット精度を実現している。
最大3.4倍のスピードアップと3.6倍のエネルギー効率を提供する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:26:20 GMT)
Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations [0.7] 大規模言語モデルは、ACO環境における自律的な防御的意思決定を改善する。
オンライン政策蒸留フレームワークは、モデルのサイズを桁違いに削減する。
報酬駆動型RL最適化と教師誘導型防衛戦略の間の政策調整制限の提言。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 20:28:02 GMT)
Uncertainty quantification for trustworthy deep learning: Methods and measures [0.7] この調査は、ディープラーニングにおける不確実性定量化の方法に関する構造化された批判的なレビューを提供する。
既存のUQ調査とは対照的に、効率的なアンサンブル近似とシングルパス法に深く貢献しています。
手法をベイズニューラルネットワーク、モンテカルロドロップアウト、ディープアンサンブル、効率的なアンサンブル近似、ラスト層またはシングルパスアプローチの5つのファミリーに分類する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:10:31 GMT)
Rolling With Resistance: Preference-Optimized LLM Counselors Can Trade Goal Persistence for Relational Attunement in Motivational Interviewing [0.6] モチベーション・インタヴュー(MI)では、クライアントの持続的なトーク(現状に関する議論)が、カウンセラーに抵抗を伴って展開するよう呼びかけるが、これは2つの方法で失敗する可能性がある。
モチベーション型面接処理統合 (MITI) コード, ゴールパーシスタンス (GP) およびアテンション (RA) のカウンセラー応答の2軸評価を導入する。
優先最適化によって1つの障害を罰することは、転がり抵抗の反作用を引き起こすかどうかを問う。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 20:16:03 GMT)
Negative controls reveal volume-driven confounding in radiomics and imaging foundation model features [0.6] 放射能と深部画像の特徴が独立した空間信号を取得するかどうかを評価するために,READII-2-ROQCを導入する。
READII-2-ROQCは、ランダム化戦略を用いて、腫瘍、背景、全体像領域にわたるボクセル摂動画像を生成する。
空間構造が破壊された後に複数のモデルが性能を保ち、ボリューム駆動あるいはコンテキスト共起が明らかになるのに対し、他のモデルは摂動に敏感な信号を示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:02:49 GMT)
Mitigating quantum decoherence via global optimal control [0.6] 我々は、振幅減衰と減圧チャネルが、はしごに沿った量子情報のフローをいかに低下させるかを定量化する。
我々は,グローバルドライブの整形により,ゲート列を桁違いに圧縮し,高ゲート忠実度を復元することを示した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:30:18 GMT)
Exponential Advantage of Multipartite Entanglement over Quantum Communication with Applications to Bounded-Storage Cryptography [0.6] 共有Greenberger-Horne-Zeilinger状態は、各送信者からの古典的通信の対数的に多くのビットのみを用いてタスクの完了を可能にすることを示す。
事前の絡み合いがなければ、成功確率の高いプロトコルは、少なくとも1つの送信者からの通信を必要とする。
暗号的な応用として、シード化された2ソース抽出器を構築し、絡み合った量子側情報と非絡み合った量子側情報の指数的分離を確立する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:04:53 GMT)
Revisiting Predictive Process Monitoring in the Age of Foundation Models: A Comparative Study of Sequence, Tabular, and LLM Approaches [0.6] 古典的なシーケンスベースのモデルがこの発展途上の世界において競争力を維持しているかどうかは不明である。
本稿では,複数のデータセットと予測タスクのベンチマークを通じて,概念的および経験的に3つのモデリングパラダイムを比較した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 07:36:34 GMT)
ZAPs: A Reward Attribution Framework for DeFi Ecosystems with Adversarial-Robust Scoring via Parallel Anomaly Ensemble Detection [0.6] 本稿では、経済貢献のスコアと敵意の堅牢性を組み合わせた報酬帰属の枠組みであるZAPを紹介する。
2層重み付け機構は、セクター内のプロトコルシェアとエコシステム内のセクターシェアを組み合わせたものだ。
ZAPはまた、トランザクションレベルの整合性チェック、並列異常アンサンブル、分散後の挙動記憶、グラフベースのシビルクラスタリングからなる4層防御スタックも導入している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:36:26 GMT)
Robust Wavelength Selection for Partial Least Squares Sugar Content Estimation Using Combinatorial Bayesian Optimization [0.5] 波長選択は、スペクトルデータの予測精度と解釈可能性を改善するために、近赤外分光における重要な前処理手法の1つである。
我々は,二成分ブラックボックス最適化問題として,糖分量推定のための波長領域選択を定式化し,ベイズ最適化に基づく手法を提案する。
実験により, 提案手法は最小二乗回帰の予測精度を向上し, 遺伝的アルゴリズムに基づく選別や模擬熱処理よりも一貫した波長領域が得られることがわかった。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:56:40 GMT)
Same Branches, Different Trees: A Bifurcation Connectedness Metric for Coronary Artery Segmentation and FFR-CT Decision Agreement [0.5] CTアンギオグラフィー(FFR-CT)による分画血流予備区は、患者固有の血管モデルを通しての流れをシミュレートする。
clDiceやSkeleton Recallのようなトポロジに配慮した損失は、グローバルな中心線に作用し、局所的な休憩を見逃す可能性がある。
本研究では,各地道分岐点における連結度をスコアするBfurcation Connectedness Score (BCS) と,その識別可能なトレーニングサロゲートであるSoft-BCSについて検討した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:57:42 GMT)
AI and Authenticity in Islamic Research: A Critical Evaluation of Generative AI Reliability, Hallucination, and Source Fidelity in Quranic, Hadith, and Fiqh Knowledge [0.5] 生成的人工知能はムスリムによって宗教的な指導、クルアニックな解釈、ハーディスの説明、法学的な判断、イスラム教教育にますます利用されている。
採用が増えているにもかかわらず、現在のAIシステムが真正で、検証可能で、信頼できるイスラム知識を提供するかどうかについての実証的な証拠は限られている。
本研究は、50のリアルなオープンエンドイスラム質問を用いて、6つの主要な生成AIシステムを評価する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:04:41 GMT)
A comparative analysis of automated techniques for security bug report identification [0.5] セキュリティ関連のバグレポートのタイムリーな識別は、ソフトウェアシステムの脆弱性のウィンドウを最小限にするために不可欠である。
従来の機械学習技術と大規模言語モデルがこの作業を容易にするために提案されている。
ほとんどの研究では、特定のテクニックを導入または最適化し、限られたベースラインに対して評価する。
これらの結果を比較し、既存のアプローチの有効性について信頼できる結論を導き出すことは困難である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:08:57 GMT)
Hayden--Preskill recovery at finite temperature on a quantum processor: dynamics and initial state from the SYK model [0.4] 本研究は, ポストセレクションの確率が無視できないという意味で, 情報の回収に成功していることを示す。
N = 8$Majoranasの2値スパースSYKハミルトニアンを用いて,IBM超伝導プロセッサ上でプロトコルを実装した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:38:01 GMT)
Wigner negativity and stellar rank for SU(1,1) states [0.4] SU (1,1) の動的対称性を持つ系の準確率分布について研究した。
ウィグナー函数はすべてのペレロモフ SU (1,1) コヒーレント状態に対して厳密な正であることを示す。
また、フシミ$Q$-函数の零点から定義されるSU(1,1)状態の恒星ランクについても検討する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:51:36 GMT)
Integrating AI into Requirements Quality Learning in Software Engineering Education: A TPACK-Guided Empirical Study [0.4] 学生はAIツールを主に分析と評価のサポートとして選択的に使用した。
学生は、条件付き信頼、積極的な改善、品質基準に対する意識の向上を報告した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:15:16 GMT)
Benchmarks Are Not Monolithic: Sample-Level Auditing and Orchestration for LLM Evaluation [0.4] 我々は,5つの潜在次元に沿って,サンプルレベルでベンチマークデータセットを監査するデータセット中心のメタ評価フレームワークを導入する。
これらのアノテーションが、データセット間で複合ベンチマークサブセットのクレーター駆動オーケストレーションを可能にする方法を示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 19:51:55 GMT)
AI Literacy: An Exercise in Power-Knowledge [0.4] 本稿では、AIリテラシーのための既存のフレームワークは、AIに対する"消費者"指向を強制するため不十分である、と論じる。
AIリテラシーを、AIシステムを使用するだけでなく、それらを批判的に評価し、構造化された前提に抵抗し、ガバナンスに参加する個人に装備する重要なプラクティスとして再認識することを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 00:39:46 GMT)
Encryption-Compatible Clustered Federated Learning via Distributed Expectation-Maximization over Metadata [0.4] クラスタ化されたフェデレーション学習(CFL)は、フェデレーションされた設定におけるデータの不均一性に対処するため、クライアントに同様のデータ分散をグループ化して効果的なトレーニングを可能にする。
既存の手法は、プライバシー保護、通信コスト、計算効率のトレードオフに直面している。
我々はこれをCFLのトリレンマとして定式化し、これら2つの次元の改善は第3の次元を犠牲にして行われる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:04:59 GMT)
From Textual Requirements to Microservice Architectures - A Comprehensive Evaluation of LLM-Based Design Synthesis [0.4] 本研究では,大規模言語モデルが要求設計とアーキテクチャ設計を橋渡しできるかどうかを検討する。
OpenAI o3は、即興的なプロンプトによってガイドされるとき、要求駆動の合成の可能性を示す。
結果はモデル非依存の証明ではなく、2つの小さなシステムからモデル固有かつコンテキスト固有である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:45:18 GMT)
Bayesian Networks of Density Operators [0.3] 我々は、有向非巡回グラフ(DAG)上のベイズネットワークの量子類似性を研究する。
有限次元テンソル積ヒルベルト空間上の正定密度作用素に対する2つの構成を区別する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:51:05 GMT)
Learning Social Robot Navigation By Sensing Human Legs [0.3] CALFは、LiDARスキャンから直接脚の動きを解釈し、安全なナビゲーションコマンドを生成するエンドツーエンドのニューラルネットワークである。
ポリシーは、カスタム軽量2DシミュレータであるLegNav内の深層強化学習アルゴリズムを使って訓練されている。
LegNavシミュレータでは,デプロイ可能なCALFポリシを1時間以内で,単一のコンシューマGPU上でトレーニングすることが可能だ。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:35:03 GMT)
Structured AI Demonstrations and Student LLM Use in Engineering Mechanics: Study Design and Preliminary Results [0.3] 大学院教育への大型言語モデル(LLM)の迅速な統合は、工学のインストラクターにとって緊急の課題である。
学生が広く採用されているにもかかわらず、教育政策を導くためのドメイン固有の実証的証拠が欠如している。
本写本は2026年春に行われた学部工学科における記述的研究設計と予備的知見を提示する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:38:51 GMT)
Evaluating Multimodal LLMs across Text and Audio Modalities for Accessible Disaster Assistance [0.3] 災害リスクコミュニケーションは基本的人道的課題である。
現在の緊急インフラは、アクセスと機能的なニーズを持つ個人のニーズを満たすことができません。
人工知能(AI)の最近の進歩は、テキスト、オーディオ、画像、ビデオのモダリティにまたがる多様なユーザーに提供する強力な能力を示している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 20:09:09 GMT)
Performance Benchmarking: Software for the Density Matrix Renormalization Group [0.3] 科学ソフトウェアの性能は、しばしば実際に解決できる問題の規模を決定する。
量子システムの研究に広く用いられている密度行列再正規化群 (DMRG) アルゴリズムには50以上のソフトウェア実装がある。
本稿では,DMRG実装の有意義な比較を容易にするために,パフォーマンス指向のベンチマークフレームワークを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:30:52 GMT)
Do Medical Foundation Models Generalize on the African Brain? [0.3] 医療基盤モデルがアフリカ脳MRIデータと非アフリカ脳MRIデータに等しく一般化するか否かを評価する。
分類において、FMは限られた利得(BrainIACで0.86のROC-AUC)を提供する。
セグメンテーションでは、FMは一貫して性能を改善し、MedSAM2で最大0.86Diceに達した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:46:57 GMT)
Deep Learning for Accelerated Long-Horizon Forecasting of Multicomponent Multiphase Microstructure Evolution in High-Entropy Alloys [0.2] 本研究は,多成分AlCrFeNi合金における組織変化を予測するためのAE-GCN-LSTMサロゲートフレームワークを提案する。
このフレームワークは、単一の名目合金組成を含む100 x 100の計算領域で訓練されている。
256 x 256 と 512 x 512 のシステムに転送され、以前は見つからなかった AlCrFeNi の合成に変換される。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:00:39 GMT)
From C to Idiomatic Rust: A Ship-of-Theseus Agentic Translation [0.1] C言語はオペレーティングシステム、組み込みプラットフォーム、ネットワークインフラストラクチャを基盤としています。
Rustは静的オーナシップと借用モデルを通じて障害モードの大部分を排除し、メモリの安全性とコンパイル時の制約のエイリアスを強制する。
本稿では,まずセマンティクスを保存する非慣用的なRustベースラインを生成し,エージェントAIを用いてそれを慣用的なRustにインクリメンタルに書き換える移行手法を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 21:00:27 GMT)
Using Large Language Models for Idea Generation in Innovation [0.1] 大学生を対象にした新製品のアイデアプールを3つ比較し、50ドル以下で価格を比較した。
AI生成のアイデアは、平均的な購入意図の観点から、人間生成のアイデアよりも優れています。
平均的なアイデアよりも最高のアイデアの品質に注目すると、AI生成されたアイデアは、上位10%のアイデアのうち7倍のランク付けされる可能性が高いことが分かります。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 00:55:25 GMT)
Share the Judge, Learn the Deferral: Where Specialization Helps LLM Evaluation [0.1] 99,952 の公試例について検討した。
正しいルーブリックを供給すると、応答のみの制御よりもロックテストの精度が2.11ポイント向上する。
RewardBench 2では、報酬スコアを変更することなく0.6B-4B-8Bカスケードを通した正当性ヘッドの例を学習した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:29:22 GMT)
Gaussian-augmented bosonic matrix-product states: theory and applications [0.1] 以下の特徴を持つボゾン量子多体状態の族の構造を解析する。
これらはすべての純粋なガウス状態と有限次元行列積状態を含む。
彼らは、ボゾン生成と作用素の単純な関数として表現された正確な親ハミルトニアンを認めている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:18:49 GMT)
Gapped Parent Hamiltonians for the Strongly Deformed Toric Code [0.1] 位相的に順序付けられた波動関数の局所的な非単位変形は、遷移を特異な状態に導くことができる。
強変形トーリック符号状態に対して局所ギャップを持つ親ハミルトニアンは構築する。
ウィルソンループの周則スケーリングは自然に破れた1-形式対称性を含まないことを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:01:31 GMT)
Improved Convergence of Carleman-Embedded Quantum Algorithm for the Vlasov-Poisson System [0.0] 我々はカルマン埋め込み量子アルゴリズムの収束状態を拡張し、運動プラズマ物理学からヴラソフ・ポアソン方程式を解く。
多くの基底関数に対して、カールマン埋め込みのヴラソフ・ポアソン系の収束は速度分解能を伴う衝突周波数強度を増大させる必要がある。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:04:42 GMT)
High-Field EPR/ENDOR of N/Be Centers for Defect Engineering in 6H-SiC [0.0] 窒素とベリリウムを共ドープした6H-SiC単結晶を1018cm-3。
ENDOR測定は、局所的なシリコンと炭素環境との電子核相互作用を解明した。
その結果, 結晶構造特性を保ちながら, 機能的役割の異なる二重不純物を組み込むことの可能性を示した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:38:33 GMT)
Integrating Contextual Embeddings into Evaluation of Expressive MIDI Piano Performances [0.0] 生成的応用において、多種多様な表現的属性は、モデルを選択するための単一の計量にまとめるのを難しくする。
そこで本研究では,属性スコープ計測値を再検討し,自己教師付きシンボリック音楽モデルであるAriaとCLaMP3のコンテキスト埋め込みの知覚特性について検討する。
ピアソン相関や再構成誤差とは異なり、文脈埋め込みにおけるカーネルベースの手法はメモアライメントを必要とせず、文脈摂動に敏感である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:22:54 GMT)
RIDGE: An Autonomous Framework for Validation and Method Discovery in LLM-Generated Option Pricing [0.0] RIDGEは、生成された価格実装のための自動検証フレームワークである。
検証証拠は診断的に解釈され、その結果の知識はリポジトリに蓄積され、モデル間で再利用される。
検出されたすべての実装欠陥を除去し、2つのケースにおいて、検証プロセスは方法論的な制限を明らかにし、代替的な数値法の開発を動機付ける。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:20:43 GMT)
Quantum Resources in Disorder-Free Localization Dynamics of Gauge Theories [0.0] 量子状態の複雑性診断は、多体ダイナミクス、情報スクランブル、量子計算に関する貴重な洞察を提供する。
1+1$次元アベリアU(1)および非アベリアSU(2)格子ゲージ理論における量子複雑性のリアルタイムダイナミクスについて検討する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:00:05 GMT)
YazSes: An Offline, Privacy-First, Cross-Platform Hold-to-Talk Voice-Dictation System [0.0] クラウド音声予測サービスは、高い精度を提供するが、ユーザのスピーチをリモートプロバイダにストリーミングする必要がある。
私たちはYazSesを紹介します。YazSesは、完全にデバイス上で実行されるオープンソースのホルドツートーク宣言デーモンです。
YazSesは、高速なWhisper(CPU、int8)で音声をローカルに書き起こし、フォーカスされたアプリケーションに結果を注入する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 22:43:57 GMT)
Wiring diagram extraction and gluing: a case study in classifying figure skating jumps using 3D dataset [0.0] 本稿では,ハセクラスタリングの反復的応用を単一アプリケーションと同じ結果が得られるように,配線図のグルリング理論について述べる。
我々はフィギュアスケートジャンプのビデオの分類という文脈で、我々の理論をテストする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 02:37:33 GMT)
What makes prompts a graph: necessary and sufficient conditions for prompt graph engineering [0.0] 本稿では,プロンプトグラフ工学の定義を提案し,その4つの条件を記述し,それを包含・排除テストとして運用する。
このコントリビューションは、業界が正確に命名することなく毎日実施しているプラクティスのための運用定義と共有語彙である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 01:42:09 GMT)
What AI Red-Team Evaluations Can and Cannot Prove [0.0] AIモデルのレッドチーム評価は、いくつかのクレームをサポートし、他のクレームをサポートしておらず、両者の境界は計算可能である。
我々は、評価の明確な天井を、ある結果が一定の試験予算の下で信念を移動できる最大の要因として定義する。
計算可能なハーフレートを超えると、控えめな大きさのベンチマークは、あるカテゴリーを明示的な基準に認定する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:46:31 GMT)
Vacuum fluctuations in Rainbow space-time: Study of Casimir effect [0.0] レインボー関数の異なる選択のためのプレート間距離の変形カシミール力とエネルギーの変動について検討した。
以上の結果から,2つの虹関数の選択において,カシミールエネルギーと力の絶対値が減少または増大しているのに対し,特定の虹関数の選択はミンコフスキー時空の標準値と同じであることがわかった。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:58:47 GMT)
VESTIGE: A Knowledge-Guided Masking Strategy for Corruption-Aware Fine-Tuning of Genomic Transformers, Validated on Ancient DNA Reconstruction [0.0] Masked-- model fine-tuning は、再構成の難しさが位置に依存しないとして、トークン位置毎に均一なマスキング確率を適用する。
本稿では,パラメータフリーでドロップイン可能な標準コレータであるVESTIGEを紹介した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 05:47:47 GMT)
Towards Autonomous Aircraft Surveillance from Nanosatellites through On-Board Inference and Generative Data Augmentation [0.0] 低出力エッジテンソルアクセラを備えた6Uキューブサットで推論を実行する。
低ランク適応により微調整された拡散モデルが合成マイノリティ画像を生成する。
この合成出力は、中間検出器によって自動的にアノテートされ、擬似ラベリングされ、古典的に強化されたサンプルとマージされる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:26:38 GMT)
The cycle C9 does not admit uniform mixing [0.0] 連続時間量子ウォーク(CTQW)をサイクル上で研究する。
サイクル$C_9$は、いつでも均一な混合を認めないことを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:15:11 GMT)
The Edge-based Contiguous p-median Problem with Connections to Logistics Districting [0.0] 本稿では,ネットワーク内の道路をコンパクトかつ連続な領域に分割するエッジベース連続p-median(ECpM)問題を提案する。
2つのバイナリプログラミングモデルが導入され、どちらもネットワーク距離が組み込まれている。
それぞれのソリューションアプローチは2,700以上のノードと3,400近いエッジを持つロードネットワーク上でテストされる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:49:03 GMT)
Technological Advances in Detecting and Managing Cognitive Impairment in Older Adults: Trends, Challenges, and Future Directions [0.0] 本稿では,高齢者の認知障害の検出・管理における最近の技術進歩について述べる。
デジタルマーカーは人工知能(AI)、機械学習(ML)、ディープラーニング(DL)を通じて統合される
この分野の短期的な約束は、早期発見と行動可能でパーソナライズされたケアを結び付ける信頼性があり、マルチモーダルで、縦に検証されたシステムにある。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 06:38:33 GMT)
Strategy Phasing of Cyber Attacks on Digital Substations [0.0] 本稿では,Substation Cyber Attack Strategy Phasing (SubCASP)を提案する。
SubCASPはIDSデータログをフューズして、現在のアタックフェーズ、次のアタックフェーズ、レトロスペクティブアタックパスを推測する。
テスト結果は、様々なIDS可観測レベルと不足IDSデータログシナリオに対するSubCASPの堅牢性を示すために提示される。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 04:17:40 GMT)
Stop Shipping AI Agents on Faith: Capability Is Not Production Readiness [0.0] 本稿では,AIエージェントのガバナンス準備度指標であるProofAgent Index(PAI)を紹介する。
PAIは、評価、コンテキスト、コンプライアンス、ガバナンスの4つの側面を組み合わせたデプロイメントエビデンスです。
監査可能なAIエージェント評価とガバナンスのためのオープンソースのインフラストラクチャであるProofAgent Harness内に実装されている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 04:44:47 GMT)
Stop Indexing at Full Precision: Revisiting Clustering for Vector Embeddings [0.0] 本研究では,ベクトル探索において広く用いられている3つの手法を再検討し,それをクラスタリングによるベクトル埋め込みインデックスの最適化に活用する。
本稿では,これらの手法がクラスタリングの前に適用されるインデックスパイプラインを提案し,ストレージのフットプリント,クラスタリング時間,ベクトル探索タスクにおける結果のセントロイドの品質にどのように影響するかに着目した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:59:55 GMT)
Stimulus-Evoked Network Dynamics in Human Cortical Organoids: From a Graph-Computational Framework to Repeated-Stimulation Depression [0.0] 本研究では,刺激誘発伝搬の定量化のためのグラフ計算フレームワークを開発した。
3つのオルガノイドからのHD-MEA記録をフルに実施した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:45:16 GMT)
Seeing the Forest for the Trees: The Gaussian Process Limit of BART [0.0] Bayesian Additive Regression Trees (BART) は、予測と因果推論の両方において最先端の性能を示している。
従来の理論的研究は、標準的なBARTモデルに対する後部収縮率を確立することによって、BARTの優れた性能を説明しようとした。
我々は,木数が無限に増加するにつれて,異なるアプローチを採り,BARTの挙動を研究する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 21:13:09 GMT)
Secure Aggregation for Privacy-Preserving Federated Learning on Clinical EEG Data [0.0] フェデレートラーニング(Federated Learning)は、複数の機関が、生の臨床脳波データを交換することなく、共有モデルをトレーニングすることを可能にする。
本稿では,保護機構としてマスキングを用いたセキュアアグリゲーションを用いた臨床脳波データ保存フレームワークを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:28:39 GMT)
Scaling theory of decoherence in Dicke superradiance [0.0] Dicke superradianceでは、集合放出は相関関係を構築し、ピーク強度のスケーリングは$N2$ for $N$エミッターとなる。
局所的嫌悪や自然放出を含むスケーリング理論を開発し,完全集合的,部分集合的,独立したエミッタスケーリング体制を得る。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:17:30 GMT)
Sample More, Reflect Less: Self-Refine and Reflexion Lose to Repeated Sampling at Equal Token Cost, from 1.5B to 7B [0.0] 言語モデルプランの作成、独自の回答の批判と書き直し、ミスの反映、いくつかの試みのベストの選択、あるいは自分自身のコピーで議論する方法は、ほとんどすべてが、単一の思考の連鎖よりもはるかに多くのテキストを生成する。
より多くのテキストを生成すると、それ自身で精度が上がるので、ある思考の連鎖の利得は、その方法のアイデアを示さない。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:38:23 GMT)
Safety-Gated Agentic Supervisory Control on a Coupled Distillation Benchmark: Regime Map, Auditable Gate, and Co-Design Findings [0.0] 本稿では、このチェックをルールベースのフォークツイン対策ゲートに配置する。
SkogestadのカラムAでは、はしごはPIDのみ(C0)、リニアMPC(C1)、アンゲートエージェント(C2)、ゲートエージェント(C3)である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:26:53 GMT)
Reducing Data Movement in the Galerkin Product of Block Algebraic Multigrid on GPUs [0.0] 3Dの弾力性のために、ファインオペレーターは3倍の3倍の3倍の3倍の3倍の3倍の3倍の6倍の6倍の6倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の幅を持つ。
共有メモリ型カーネルを検索不要なソートスケジュールで提供し、ポータブルなKokkosチームカーネルの半数以下でバイト数を減らした。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 23:17:29 GMT)
Recognition and Label-Free Adaptation Across Recording Sessions in Surface-EMG Gesture Decoding [0.0] ユーザ間のクロスモンテージ転送は、特定の記録セッション中に収集されたデータを使用して、ここでトレーニングされる。
このアプローチのパフォーマンスは、ユーザ毎のLDA分類パイプラインと、2つの公開されたアプローチと比較される。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 01:21:05 GMT)
Reading Without a Reader: Large Language Models Collapse Reading and Writing into a Single Entangled Code [0.0] テキストに最適化された1つの自己回帰パスからデコーダのみの大規模言語モデルが駆動されることを示す。
入力側の読み取りコードの $mathbfW_E$ と出力側の書き込みコードの $mathbfW_U$ を比較して、どのように絡み合ったか尋ねる。
最小対に対して、アレキサンドリアアナログは定理によって空である; 欲求生成は語彙全体のargmaxを意味するので、ペアのランクを勝ち取る。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:05:57 GMT)
Quantum Steering and Nonlocal Correlations Between Non-Interacting Delocalized Electrons Under Rashba Spin-Orbit Interaction [0.0] 2次元電子ガス(2DEG)中の2電子間の量子ステアリングと非局所相関について,Rashba spin-orbit interaction(RSOI)強度と電子間分離の関数として検討した。
当初、$_R$の増加は量子相関を抑圧するが、3つの指標はすべて、$_R$の関数として非単調なリカバリを示す。
この発見は、RSOIを2次元電子気体の量子特性を安定化するための臨界制御パラメータとして確立し、電子間分離による量子相関の崩壊に対抗している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:17:20 GMT)
Quantum Optimal Control at Intermediate Times: Controlling Revivals in Spin Chains [0.0] 量子最適制御(Quantum Optimal Control, QOC)プロトコルは、一般に最終目標時刻に物理目的を最大化する。
任意の中間時間で観測可能量の同時最適化を実現するため,QOCを拡張した。
本稿では,スピン励起の動的追跡とパルス後量子状態回復の能動的操作を実現する方法について述べる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 19:12:55 GMT)
Quantum LDPC codes with design rate 1/5 and good performance below 1000 physical qubits [0.0] 定レート量子低密度パリティチェック(LDPC)符号は、限界の空間的オーバーヘッドが一定であるフォールトトレラント量子計算を約束する。
設計レートが1/5ドル、チェックウェイトが9ドルという新しい量子LDPCコード群を導入し、数百の物理量子ビットを持つキュービット単位のテラクオップメモリシステムにアプローチした。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:55:43 GMT)
Quantum Chaos and Diffusive Transport from Geometric Randomness [0.0] 量子カオスと拡散輸送は、純粋に幾何学的ランダム性から生じる。
幾何学的ランダム性および有効グラフ次元性はカオス力学の存在を規定することを示す。
広い層の大きさは、堅牢な量子カオス、レベル反発、拡散輸送をもたらす。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:39:19 GMT)
One Future, Every Robot: Label-Efficient Collective-State Prediction with Decentralized JEPA [0.0] 我々は分散化された共有状態予測アーキテクチャであるCollective-State JEPAを紹介する。
それぞれのロボットは、16フレームのローカル履歴と1つの64フロートリカレントメッセージを使用する。
プレトレーニング後,地球規模のラベル付きエピソード6,12,24に装着したリッジプローブを用いて凍結表現を評価した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:16:08 GMT)
On Optimal Measurement-State Preparation via Geometric Transport of the Squeezing Ellipse [0.0] Su(2)対称系の初期圧縮入力を測定最適状態に変換する枠組みについて論じる。
偏光印加光について検討し、連続的に変化する複屈折素子を用いた実装について概説する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:59:17 GMT)
Iterative quantum algorithms for the minimum vertex cover problem based on continuous-time quantum walks [0.0] 最小頂点被覆問題に対する制約保存型ハイブリッド量子古典グリードフレームワークを提案する。
このフレームワークは、射影されたパウリ-X項を使い、その和は実現可能な部分空間を保存し、その内部は、実現可能な被覆の層グラフの隣接行列として正確に作用する。
条件付きエネルギー戦略はテストされたインスタンスで最適に動作し、アルゴリズムの性能は正確な連続時間制限に近く維持されることを示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:29:26 GMT)
Hadron Structure from the Hierarchy of Quantum Correlations in Deep-Inelastic Scattering [0.0] 量子エンタングルメント、不協和、ステアリング、マジックは、ヌクレオンのパルトン分布関数に非摂動および相補的な感度を与えることを示す。
この接続は、標準模型(BSM)の物理探索を超えて、陽子のパルトンレベルテンソル電荷のユニークなプローブをもたらす。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:00:01 GMT)
Graph Neural Network Force Fields for Spin Dynamics in Metallic Magnets [0.0] 本稿では, スピンダイナミクスを効果的に制御する磁気エネルギー関数を学習する, グラフニューラルネットワーク(GNN)磁気力場フレームワークを提案する。
本研究では,コリニア,非コリニア,非コプレナー磁気秩序を示す代表的金属磁性系についてベンチマークを行った。
本研究は,機械学習による力場構築のための強力なフレームワークとして,グラフニューラルネットワークを構築した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:04:56 GMT)
Generative AI and linguistic diversity in academic writing and publishing: Perspectives from World Englishes [0.0] 本稿では,グローバルな学術コミュニケーションにおける言語的傾向と多様な英語の正当性に関する疑問に答える。
対話は5つの指導的質問を中心に構成され、GenAIツールが書記の実践にどのように影響するかを問うものである。
コントリビュータは、株式インフォームドポリシー、重要なAIリテラシー、およびGenAI開発における包括的共同設計を求めている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:46:29 GMT)
From Process to Evidence: How Computing Can Ground Appropriate Reliance on Legal AI [0.0] 1500件以上のAI幻覚事件の後、弁護士は慎重に独立したAI支援申請の審査を行うよう指示された。
「これらの義務を解き放つには、人間とコンピュータの相互作用の文献が適切な依存と呼ぶものが必要である。」
我々は、ニューヨーク裁判所制度の公式な記録を分析した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 22:24:59 GMT)
From Minds to Models: The Intersection of Psychology and LLM Behaviours [0.0] 大規模言語モデル(LLM)は、意思決定が複雑で、非線形で解釈が難しいため、人間の心と比較されることが多い。
本研究は、ChatGPTが、オープンエンドテキストにおける人種的条件間での感情差を生んだかどうかを検証した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 01:44:00 GMT)
From Expert Reduction to Behavioral Divergence: Tracing Numerical State through Sparse MoE Inference [0.0] 専門家還元命令は、観測可能な異なるスパース-MoE実行を生成することができる。
ローカルMoE状態の凍結とアグリゲーションのセマンティクスの変化により、ネイティブのDeepSeek-V4-Flashでこの効果を分離する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:07:56 GMT)
Fragility of Value under Imperfect Alignment [0.0] AIの安全性の一般的な懸念は、人間の価値が脆弱であることだ。
本稿では,エージェントが理想化されたアライメントトレーニングを行うアライメント問題のモデルを提案する。
我々の結果は、最適化圧力を制限するAI設計の過度な最適化と動機付けの危険性を強調します。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 22:52:34 GMT)
Fidelity Is Not Safety: Gently-Compressed LLMs Pass Every Data-Free Quality Guard Yet Invent Procedure Steps in Agentic Execution [0.0] 専門家は、データチープの品質ガードのスタックをクリアすると、圧縮された言語モデルを受け入れる。
3つのモデルファミリーにまたがって、優雅に圧縮されたモデルはすべてのガードをクリアし、指示にはない手順を発明した。
我々は,事前登録されたパワーカナリア上で,信頼区間のペア化による盲点と解離を特徴付ける。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 13:33:09 GMT)
Exploring the use of quantum computing for facilitating spatially and temporally resolved models of a biological cell [0.0] 代表的な生物学的問題に対する古典的アルゴリズムと量子的アルゴリズムを比較した複雑性解析を行う。
我々は、短期的な探索とフォールトトレラントな量子アーキテクチャの両方を活用するために設計されたアルゴリズム開発を強調した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 01:24:19 GMT)
Explicit Matrices over $\mathbb Z_2$ with CNOT and Row Complexity $4n-\mathrm{o}(n)$ and Local Logic Gates [0.0] 我々は、CNOT および行の複雑さが少なくとも 4n-texto(n)$ であるような、$mathbb Zn$ 上の可逆な$ntimes n$行列の明示的な族を提示する。
同じ複雑さの下位境界は、CNOTゲートを任意の局所線形論理ゲートに置き換える強い計算モデルである。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:48:15 GMT)
Exact Action Values Are Not Enough: Rollout-Verified Reinforcement Fine-Tuning of a Reasoning Model for Multi-Zone VAV Control [0.0] マルチゾーン可変空気量制御は、熱的快適性、室内空気質、電気使用のバランスをとる必要がある。
まず,フロンティア推論モデルを用いて,テキストから競争力のあるVAV制御を実現することができるかどうかを,建築固有の訓練を使わずに検証する。
次に、TD3誘導強化微調整(RFT)が制御知識を局所展開可能なオープンウェイトモデルに転送できるかどうかを検証する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:28:37 GMT)
Endo-NeRF++: Uncertainty-Aware Neural Rendering with Multi-Resolution Hash Encoding for Dynamic Surgical Scene Reconstruction [0.0] ダイナミックな手術シーンの再構築は、ロボットによる最小侵襲手術に不可欠である。
ダイナミックな手術シーンの再構築における不確実性を考慮したニューラルネットワークレンダリングフレームワークであるEndo-NeRF++を紹介する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:03:52 GMT)
Emergence of a Macroscopic Cat State and Multi-Channel Entanglement in a Frustrated Cluster Spin Chain [0.0] クラスターイジングと異方性次のアニーレスト近傍Isingモデルを組み合わせた1次元フラストレーションスピン鎖について検討した。
一方、基底状態は強磁性相に対応し、マクロな猫の状態の存在を示し、熱力学の限界を閉じる小さな隙間を示す。
本稿では, 量子気象学への応用におけるマクロキャット状態の有用性と, システムの実験的実現可能性について論じる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 15:33:58 GMT)
Efficient atom rearrangements for quantum error correction primitives with a single AOD [0.0] 静的格子中の原子の2次元配列をせん断・回転・反射する新しいプリミティブを導入する。
我々は(ネガ-)および幾何分解を用いて、配列の線形サイズで対数的にスケールするAODストロークカウントを実現する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:56:01 GMT)
Dynamic Exploration Graph: A Novel Approach for Efficient Nearest Neighbor Search in Evolving Multimedia Datasets [0.0] 本稿では,連続精製探索グラフの拡張である動的探索グラフ(DEG)を紹介する。
DEG設計の中心となる2つの重要な革新は、グラフ接続を保証する新しい削除アルゴリズムと、グラフ拡張のためのデータ分散に依存しない方法である。
ストリーミングとオンラインの両方のシナリオにおける実証実験は、DECの優れたパフォーマンスを示している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:50:40 GMT)
Driving up Inference Energy on SNNs: Per-Sample and Universal Sponge Attacks [0.0] スパイクニューラルネットワークは、密度の高いアクティベーションではなく、スパースなバイナリスパイクイベントを通じて通信する。
我々は、スポンジ攻撃は、推測時スパイク活動とシナプス的ワークロードを増加させることを示した。
ネイティブイベントベースのSNN入力に対して,最初のユニバーサルスポンジ攻撃を導入する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 10:36:41 GMT)
Checking Information Flow in Cloud-based IoT Access Control Policies (Extended Version) [0.0] この研究はIoTアクセス制御ポリシーを分析し、デバイス間の不要な情報フローから潜在的なセキュリティ脆弱性を特定する。
SMTソルバを利用してグラフの有限表現を構築する。
我々は、IOT:POKERと呼ばれるツールにアプローチを実装し、現実的なシナリオといくつかの現実的なポリシーに基づいて評価する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 11:54:36 GMT)
Challenges in annotations by humans and LLMs: A case study of evaluative language [0.0] 学習における言語学者、訓練された言語学者、および大規模言語モデル(LLM)によって生成されたアノテーションを比較した。
我々は, 評価理論とその態度サブシステムに注目し, 影響, 判断, 評価のカテゴリー(クラス)を含む。
訓練された言語学者が行ったアノテーションと比較すると,モデルが最善であるのに対して,訓練中の言語学者は高い合意点に達していない。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:28:54 GMT)
Cascading amplifiers can create exponentially large coherence [0.0] 標準レーザービームは、光子の縮退率$mathfrakC$で、少なくとも822ドル(約8万2000円)で、レーザー自体の光子の個数である。
本稿では,従来の結合型線形増幅器を用いて,$mathfrakC$:カスケード線形増幅器を増大させる方法を提案する。
ビームの特性の要件を下げることによって、理論的には、$mathfrakC$を指数関数的に$$$でスケーリングすることができる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:00:00 GMT)
CDAE: Enhancing Perturbation Robustness in Pretrained Language Models with Contrastive Denoising [0.0] 本研究は,BERT埋め込みを改良した軽量なContrastive Denoising Autoencoderを提案する。
提案手法は,様々な強度を持つ複数の摂動戦略を用いて評価し,元のBERT埋め込みとSimCSEと比較した。
実験の結果, CDAEは摂動下で高い埋め込み類似性を持続的に維持することが示された。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:04:08 GMT)
Bridging the Gap Between PHE and FHE: A Performance and Trade-off Analysis of The Somewhat Homomorphic BGN Cryptosystem [0.0] ホモモルフィック暗号化(HE)はプライバシ保護データ分析を可能にするが、実践者は軽量部分ホモモルフィック暗号化(PHE)と計算的に支配的なフルホモモルフィック暗号化(FHE)のトレードオフに直面していることが多い。
Boneh-Goh-Nissim (BGN) 暗号システムは、このギャップをSomewhat Homomorphic Encryption (SWHE) スキームとして橋渡しし、無制限の追加と1つの暗号文の乗算をサポートする。
本稿では,PHEおよびFHEパラダイムに対するBGNの比較分析を行い,その軽量Pythonフレームワークへの統合について述べる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:33:25 GMT)
BlueprintRepair: Typed Local Edits for Failed Lean Proof Blueprints [0.0] LLMベースのリーン証明システムは、ますますブループリントとして証明を組織化しています。
BlueprintRepairは、モデルがこのグラフを10のスキーマチェックされたローカル操作で変更できる修復インターフェースです。
また、BlueprintTraceは142個の制御された障害のベンチマークで、完全に許容され、修復軌道が拒否されている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:17:31 GMT)
Benchmarking Quantum Simulations of the Lipkin-Meshkov-Glick Model Using Large Tensor Networks [0.0] 密度行列再正規化群(DMRG)アルゴリズムを用いて,Lipkin Meshkov Glick(LMG)モデルの基底状態エネルギーを計算する。
これらの結果を、変分量子固有解法(VQE)やサンプルベース量子対角化法(SQD)のようなノイズのある中間スケール(NISQ)アルゴリズムと比較する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:34:48 GMT)
Beating the Bad-Cavity Limit via Auxiliary-Emitter Linewidth Squeezing [0.0] 逆のデチューニングを持つ2つの非識別補助エミッタを悪いキャビティに導入する。
このハイブリッドシステムは、有効キャビティ線幅を著しく制限するサブラジアントモードをサポートする。
その結果、この工学的環境に配置されたターゲットエミッタは、長時間の真空ラビ振動と解消された自然発光分裂を示す。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:53:25 GMT)
Back to All-Entity Ranking: Sampler-Dependent Evaluation in Continuous-Time Dynamic Graphs [0.0] CTDGsの次の決定予測は、サンプルされた負の目的地に対する観測された相互作用をランク付けする。
非均一な負の分布がベイズ最適ランクを変化させることを示す。
本機構は, 観察・未知の陰性に対する繰り返し陽性, 新規陽性の因子的評価を用いて検討した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 08:37:43 GMT)
Asymmetric Communication: Large Language Models and Language Games [0.0] 人間-LLM相互作用は、一方がすべての規範的活動を持つ言語ゲームを構成する。
本稿では,これらが一つのカテゴリーの誤りの事例であると主張する。人間によるコミュニケーションの実践の中で構成されたプロパティをマシン側に投影し,その構造を説明する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:45:50 GMT)
Anomalous Boundary Modes in a Floquet Hyperbolic System [0.0] 負の曲線を持つ双曲格子上に, 異常なフロケ位相を構成する。
バルク$0および$$準エネルギーギャップをマッピングし、自明かつ異常な開境界スペクトルに関連付けられたギャップ領域を同定する。
周期的双曲格子に基づく小境界スペクトル流診断法を提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:00:01 GMT)
An analysis of machine learning approaches for enhancing decision-making in complex discrete choice tasks [0.0] 本研究では,5つの選択ルールを学習し,予測する能力に関して,機械学習モデル4つを評価する。
半パラメトリックモデルと非パラメトリックモデルは、一般にすべての選択規則と実験的文脈でパラメトリックモデルより優れている。
実エネルギー政策選好データを用いたケーススタディも行われ、TNNは13.351のBICで最善を尽くした。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 21:38:37 GMT)
An Exploration Graph with Continuous Refinement for Efficient Multimedia Retrieval [0.0] 本稿では, 連続精製探索グラフ(crEG)を提案する。
最先端の探索性能を持つコンパクトな探索グラフを高速に構築するための新しい手法である。
どちらのアルゴリズムも、偶数度の無向グラフを生成および操作するために特別に設計されている。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 03:22:17 GMT)
Agentic Method for Deterministic Validation of Legacy Code Migration [0.0] ロックスミスループ」は2つの実行環境を準備することで開始される。
ロックスミスループ」は入力モック上でワイトネス検索を行い、プログラムの分岐を貫き、その後パリティ保存突然変異が続く。
Locksmithは、入力検索高原を超えて、継続的にカバレッジを改善した。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:25:23 GMT)
Agent Team Work Zone: An Automated, Persistent Workspace for Long-Lived Claude Code Agent Teams [0.0] 我々は,Claude Codeのネイティブエージェントチームを中心に構築されたレイヤであるATWZ(Agent Team Work Zone)を提案する。
ATWZは、各エージェントとチームメイトを人間の従業員として扱い、重要な作業状態を維持する。
ATWZ内では、エージェントの"employees"が文書を互いに送信することができ、プロンプトを書くのに必要な労力を大幅に削減できる。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:42:33 GMT)
Advancing Awkward Arrays for High-Performance CPU and GPU Processing [0.0] Awkward Arrayは、ネストした可変長データの表現と処理のためのPythonライブラリである。
我々は、NVIDIA Core Compute Libraries上に構築された実装を含む、Awkward Array GPUバックエンドの開発について紹介する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 12:53:25 GMT)
Accuracy Hides How Language Models Fail: Measuring Failure States Under Matched Output Budgets [0.0] 言語モデルベンチマークは、2つの異なる測定質問を1つの精度スコアに分解する。
スコアラーに依存しない実行証拠を分離する2層評価フレームワークを提案する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 06:23:36 GMT)
AIx4Soccer: A Unified Platform Architecture for Football Club Management and Structured Athlete Development [0.0] サッカークラブ、アカデミー、フェデレーションは成長するが断片化されたデジタルツールのポートフォリオを運営している。
本稿では,クラブ管理を統一するマルチテナントクラウドオペレーティングシステムであるAIx4Soccer One Platformについて述べる。
Tak Tikは、クラブとビデオアナリストを結び、75%/25%の収益分配(分析/プラットフォーム)と、開発計画をビデオエビデンスと定期的なレビューに結びつけるPDI/TBIL方法論である。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:02:58 GMT)
AI systems and the reproduction of (standard) language ideologies in World Englishes [0.0] 大規模言語モデルの急速な成長は、社会言語学と世界英語における古い質問を復活させた。
本稿では,AIシステムが言語イデオロギーをどのように反映し,強化し,時には挑戦するかを検討する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 17:01:58 GMT)
A user's guide to PINNs in geometric analysis: lessons from the asymptotic Plateau problem [0.0] この貢献は arXiv05:26.26234v2: マルコ・ウスラとの共同研究の成果を詳述している。
物理インフォームドニューラルネットワーク(PINN)に基づく機械学習フレームワークを提案する。
フレームワークの2つの側面について,我々の経験から,メソッドが全く機能しないかどうかを判断する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 18:00:09 GMT)
A Unified Benchmark of Deep Learning Models for Multi-task 3D Brain Tumor Segmentation from Magnetic Resonance Imaging [0.0] この研究は、代表畳み込みニューラルネットワーク(CNN)とトランスフォーマーベースのモデルを比較するための統一ベンチマークを示す。
3D U-Net、SegResNet、Swin UNETR、SegMamba、SegMambaV2を含む最先端3次元セグメンテーションモデルの評価を行った。
予測時間と各モデルのサイズを含む計算コスト指標とともに、セグメンテーション精度の指標を用いて性能を評価する。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 21:56:03 GMT)
A Quantum Mechanical Approach to the Computation of Rovibrational Spectra of Diatomic Molecules in Strong Magnetic Fields [0.0] 我々は、強い一様磁場中における二原子分子の可視スペクトルを計算するためのウィルソン・ハミルトンの枠組みを拡張した。
外部静磁場中の可視遷移のための電気四極子遷移モーメント積分を定式化し、実装し、計算してスペクトルを得る。
その結果、超強磁場環境下での1mathrmH_2$の公約符号に対する最初の完全な量子力学的計算結果が得られた。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 09:21:27 GMT)
A Montage-Agnostic Encoder for Calibration-Light Cross-User Gesture Recognition from Surface Electromyography [0.0] パターン認識制御は、1つか2つではなく、多くの意図されたジェスチャーに対応する筋電義肢を約束する。
モンタージュに依存しないエンコーダを導入し、各電極を共有重量で読み出し、インデックスではなく物理座標で位置決めする。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 01:18:03 GMT)
A Fuzzy Rule-based Neuro-Symbolic Approach for Pipe Severity Prediction in Sewer Networks [0.0] 本研究では、このギャップを象徴的推論から神経知覚を分離することで橋渡しするモジュラーでファジィな規則に基づくニューロシンボリック・フレームワークを導入する。
推論のために、DT、特にウェカのJ48アルゴリズムは、接地規則のCODEと重度ラベルに基づいて訓練され、その経路は19の固定IF-THENルールに変換される。
全体として、このフレームワークは、競合するクラスバランスのパフォーマンスと予測されたCODE学位からのトレース可能な推論を組み合わせることで、ルールサポートと重大さのエビデンスを実現している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 16:33:26 GMT)
(Towards) Scalable Reliable Automated Evaluation with Large Language Models [0.0] 本研究は,Large Language Models (LLMs) 出力のエキスパートレベルの評価を近似するために設計された,新しい評価フレームワークを紹介する。
Eloレーティングシステムは、安定かつ解釈可能なランキングを生成するために使用される。
予備的な結果は、自動的に導出されるランキングが専門家の判断とよく相関していることを示している。
論文参考訳(メタデータ) (Thu, 30 Jul 2026 14:31:07 GMT)