Scaling Near-Optimal SFT-RL Annotation Budget Allocation from Small to Large LLMs [115.3] 教師付き微調整と強化学習の間に固定アノテーションの予算を分割する方法は、未解決の問題である。
ピーク性能の特定の許容範囲内でのアロケーションの集合である近最適領域を特徴付ける。
我々の結果は、タスク、モデルファミリー、および好みに基づくオフ・ポリティクスと報酬・スーパービジョン・オン・ポリティクスの2つの方法に一貫して当てはまる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:39:55 GMT)
Forbid Your Attention: Fooling Multimodal Large Language Models by Selectively Removing Intrinsic Focus in Spectral Domain [94.6] MLLM(Multimodal large language model)は、より文脈的なマルチモーダル情報を処理するために、大規模言語モデル(LLM)の能力を拡張した。
近年の研究では、MLLMは敵対的な入力、特に視覚成分を標的とする入力に対して非常に脆弱であることが示されている。
本稿では, 構造関連位相領域に対する対向的摂動を明示的に制限する, 位相対応型対向攻撃フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 06:34:32 GMT)
Uncovering Understanding-Generation Synergy in Native Unified Multimodal Models: From Representation, Task to System [90.6] 統一マルチモーダルモデル(UMM)は、単一のモデル内で視覚的理解と生成を共同で行う。
制御された、構造的にネイティブな環境で、それらの関係を表現、タスク、システムレベルで調査する。
適切な特殊化やタスク知識の共有,エンドツーエンドの最適化など,UMMの価値は統一インターフェースを超えて,共存を相乗効果に転換できることを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:59:59 GMT)
AnyWorld: Factorized Egocentric World Models for Cross-Embodiment Generalization [88.3] 我々は,クロス・エボディメント・ワールド・モデリング・フレームワークであるAnyWorldを提案する。
私たちのモデルは、アクション、カメラ、エンボディメントへのインタラクションを分解します。
大規模なヒューマンインタラクション事前トレーニングでモデルをトレーニングする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 11:29:01 GMT)
Dotting the Eye: An Intent-Driven Image Retouching Agent for Visual Focus Enhancement [85.5] MLLM駆動のリタッチエグゼキュータであるEyeControlを提案する。
わずか数クリックまたは粗いストロークで、EyeControlは意図した領域に視覚的注意を向け、画像の事実上の「目を引く」。
また,グローバルな調整と局所的な調整のコーディネーションを改善するための操作一貫性制約を導入し,より自然でコヒーレントなリタッチを実現する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:24:33 GMT)
Figures as Programs: Recursive Generation of Editable Scientific Figures [79.8] 最近の画像生成モデルは、視覚的に魅力的な図形を合成することができるが、人間の満足な結果を生み出すことは、単一の生成段階において難しいままである。
textscFigTreeは、科学論文を構造化ベクトル図形に自動的に変換するテキストマルチエージェントシステムである。
レンダリングクリティカルリファインメントループは、レンダリングされたフィギュアとその基礎となるプログラムを共同で検査し、視覚的欠陥を特定のステートメントにトレースし、正確に修復することを可能にする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:53:47 GMT)
Knowledge Distillation During Mid-Training Favors Reasoning over Factual Recall [79.6] 教師が自信を持つトークンを蒸留する簡易な中間訓練目的であるスイッチ蒸留を提案する。
標準的なNTPとは対照的に、推論性能は1.61-1.71x、知識と常識性能は1.13-1.19xである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:00:30 GMT)
Towards Effective Structured Context Modeling for Conversational Recommender Systems via Dual-node Monte Carlo Tree Search [78.4] DREAMSは,マルチターンインタラクションを通じてユーザの嗜好の進化を捉える新しい木構造コンテキストモデリングフレームワークである。
DREAMSは、会話勧告システム(CRS)の2つの基本的な目的、すなわち、嗜好の誘惑と嗜好の搾取を支持している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:02:58 GMT)
Scaling Large Reasoning Models beyond Human Supervision: A Path toward Superintelligence [77.3] 検証可能な報酬による強化学習は、数学やコードの推論を大幅に改善することができる。
しかし、人間の直接監督は、モデル生成体験のスケールと複雑さに追随することはできない。
本稿では,人間の指導が学習ループから徐々に遠ざかっていくにつれて,LRMがいかに改善していくかを検討する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:17:42 GMT)
Towards Generalizable Visually Grounded Exploration of Household Devices [74.7] 汎用的な自律的実施エージェントを実現する上でのボトルネックは、Generalizable Visually Grounded Explorationにある。
VGEBenchは、視覚言語モデルの一般化可能な視野探索能力を評価するために設計されたベンチマークである。
静的なデータセットとは異なり、我々はLogic-Driven State Machineフレームワークを構築している。このフレームワークは多ターンインタラクションループをシミュレートし、アクティブな視覚知覚とフィードバック駆動の修正によって目標を達成するエージェントを説得する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:42:45 GMT)
WorldBench: Culturally Grounded Benchmark for Multilingual Agents [69.8] 既存のベンチマークでは、状態の保存、言語間のパフォーマンス、現実的な根拠のあるシナリオへのアプリケーションをテストすることはめったにない。
We present WorldBench: a comprehensive, multilingual benchmark, where agent can act in a sandbox via structured action。
WorldBenchは、7つの言語と8つの文化にまたがる1,600のタスクで構成され、人間のアノテータからのフィードバックによってフィルタリングされ洗練されている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:53:07 GMT)
EvoSCM: Scientific Belief Revision Through Causal Model Evolution and Experimentation [68.8] EvoSCMは、新しい証拠が収集されるにつれて進化する明確な構造因果モデルを持つ科学エージェントを装備することを目的としている。
EvoSCM onPhysicsはエージェントが実験を通して非標準物理世界の隠れたダイナミクスを明らかにするのに必要なベンチマークである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:55:56 GMT)
The Safeguard Worked. Is the LLM System Safer? [66.5] 配備されたLLMサービスの保護は、拒絶、攻撃の成功、およびポリシー違反率によって評価される。
サービスが依然としてアタッカーに適応し続け、別の方法を見つけてくれるような有害なタスクに対して、どの程度の助けがあるか、という問題に、デプロイは答える必要があります。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 00:38:35 GMT)
Socrates went Nuclear: Comparing Interaction Strategies for AI systems in a Learning Context using Brain Sensing [66.0] 本稿では,ユーザとAIのインタラクションに関する3つの設計を学習場面で比較する。
50人の研究参加者が核安全プロトコルの学習に従事した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:24:35 GMT)
Calibration is the Bottleneck: An Action-Class Diagnostic of Multi-Turn Tool-Calling [65.0] 本稿では,マルチターン障害を2つのモードに分解するアクションクラス指向診断フレームワークを提案する。
複数のマルチターンベンチマークにまたがるツールコールモデルのパネル上で検証を行う。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:08:15 GMT)
MemoryWalker: Stop Training Agents on Contexts They Never Saw [63.7] 生産エージェントは、ロールアウト中にClaude CodeやQwen-Agent圧縮コンテキストを使用する。
圧縮下でのトレーニングは条件付けの問題を発生させる: すべての信念は有効な歴史を分岐するので、学習対象は列ではなく木である。
我々は、LogitTree と SDCC の2つの正確な勾配等価補正を導入する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:01:27 GMT)
Solaris: Towards Interfaces That Are Generated, Not Coded [61.8] ユーザアクションに応答して,インタラクティブなUIを直接フレーム単位で生成するインターフェースワールドモデルであるSolarisを紹介する。
Solarisはマウスの相互作用を条件付け信号として扱い、対話的な速度で結果の視覚状態を自己回帰的に合成する。
言語モデルは、ユーザ意図を解釈し、インタラクションがどのように生成された環境に影響を与えるかを指定することで、視覚世界モデルを補完する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 06:10:49 GMT)
SignMatch: Matching Dictionary Signs to Continuous Sign Language Video [61.1] 我々は,各学習可能なプロトタイプが手話クラスに対応する連続的なビデオから,手話の組込み空間を学習する。
分離された辞書ビデオは、このサインスペースにマッピングされ、辞書の例えと連続的なサインインスタンスのマッチングを可能にする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 21:33:33 GMT)
HarnessDev: Can LLMs Create and Evolve Their Own Agent Harness? [61.0] 評価単位をタスク出力から実行インフラストラクチャにシフトするベンチマークであるHarnessDevを紹介します。
Creationでは、エージェントは最小限のシードと少数のケースから始まり、完全な実行システムを構築する。
Evolutionでは、独自のハーネスから始まり、ベンチマークのパフォーマンス向上を目標として、下流の実行フィードバックを使用して反復的に修正する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:45:33 GMT)
Comments on the recent improvements of the MRRW bounds [59.0] 本稿では,コードワードに付随する単一ベクトルを部分空間に置き換えるスペクトル法の拡張として,OpenAI証明を符号化理論の言語と文脈に提示する。
また、符号化理論の言語と文脈におけるOpenAI証明を、コードワードに付随する1つのベクトルを部分空間に置き換えるスペクトル法の拡張として提示する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:43:23 GMT)
Heard but Not Heeded: Paralinguistic Information Encoding and Loss in Audio-Language Models [58.8] 本稿では,Whisper-large-v2,Qwen2-Audio-7B Instruct,Qwen2.5-Omni-7B,Chroma-4Bの4つのオープンソースモデルにおけるパラ言語情報の力学解析を行った。
我々は、中心となるカーネルアライメント、線形探索と1人の話者のアウト評価、オープンエンドトーン予測、およびコンテンツ韻律リークメトリクスを組み合わせることで、スタイル情報がオーディオエンコーダから最終出力へどのように移動するかを追跡する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:03:33 GMT)
Can LLMs Discover Scientific Laws in Real and Parallel Worlds? [58.8] SCILAWS-BENCHは、公表された研究と実際の科学データから構築された科学法発見のためのベンチマークである。
381の科学論文から118の問題を抽出し、291の法則と6つの科学分野にわたる800万の実際のデータポイントをカバーしている。
予測適合性は、科学的妥当性から分岐し、モデルが公表された公式を再現するか、移動するかを記憶する形に変化し、我々のベスト・オブ・N研究は選択ボトルネックを明らかにした。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:17:59 GMT)
Right Frame, Wrong Rule: Cultural Cues Expose the Financial Knowledge Gap They Were Meant to Close [58.0] イスラム金融における規範的多元主義を4つの分類法を用いて研究する。
文化的キューは1つのフレームワークに向かってモデルを操縦するが、そのモデルはそのフレームワーク内で間違った答えを選択する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:46:53 GMT)
A Glance Is All You Need: Single-Pass Fine-Grained Image Captioning with SimLoss [57.6] 単一パスの微細な画像キャプションのための参照不要な埋め込み空間であるSimLossを提案する。
SimLossは視覚言語モデルをトレーニングし、プロジェクションされた隠れ状態表現と凍結したイメージ埋め込みを一致させる。
ローカルに利用可能な埋め込みモデルを通じてバックプロパゲートするSimLoss FFTと、そのモデルをブラックボックス報酬として扱うSimLoss GRPOとしてインスタンス化します。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:31:34 GMT)
From Visual Cues to Spoken Narration: Rethinking Audio Description [56.8] Cue2Narrateは2段階のパイプラインで、長い動画クリップで何といつナレーションするかを共同で予測する。
デュアルヘッド音声視覚ローカライザは、AD発話毎に2つの時間的に異なるウィンドウを予測する。
ロラ適応VLMは予測された視覚的証拠から簡潔なADを生成する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:00:50 GMT)
EmbodiedSkills: A Unified Framework for Orchestrating, Training, and Deploying VLA Agents [56.3] 視覚言語アクション(VLA)モデルは、視覚観察と言語指示を直接ロボットアクションにマッピングする。
本稿では,各スキル決定を実行提案として扱うフレームワークであるEmbodiedSkillsを提案する。
共有可能スキルインタフェースは、ハイレベルスキル選択、バウンドローレベルVLA実行、ポストアクション検証を接続する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:14:47 GMT)
Hyper-Fold: Exploring the Expressive Limit of Sequence-Geometry Learning for Proteins via Hypergraph Modeling [55.4] コンテント幾何学的外積に対する完全双線型作用素、すなわち2階の相互作用の十分統計は、表現的天井であることを示す。
次に、メッセージパッシングコストで天井に近づく、ランク-K分離可能な畳み込みバックボーンであるHyper-Foldを紹介します。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:39:16 GMT)
From Production Traffic to Post-Training: Building a Self-Hosted LLM That Covers the Corporate Request Mix [55.1] 200以上の内部アプリケーションから1つのモデルにトラフィックを集約します。
我々は、各軸ごとに別々のGRPOエキスパートを訓練し、2段階のSLERPを介してそれらをマージする。
このモデルは、プラットフォームトラフィックの50%、月1億6600万リクエストをサービスコストのごく一部で吸収する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:39:26 GMT)
Multi-Image Visual Token Pruning in Large Visual Language Models [54.5] 本稿では,多種多様な視覚言語モデル(LVLM)に適用可能な,トレーニングフリーで適応型ビジュアルトーケンプルーニング(AVTP)フレームワークを提案する。
種々のLVLMにおける視覚的注意分布の実験的解析に基づいて,プルーニング層を戦略的に決定する。
AVTPの有効性とロバスト性を示すため,様々なLVLMに対して広範囲にわたる実験を行った。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:05:18 GMT)
Overfitting Mitigation via Singular Value Decomposition in Minimum Bayes Risk Decoding [53.9] 本稿では,一対のユーティリティ行列をノイズ情報信号としてフレーム化するSVD-MBRを提案する。
実験により、SVD-MBRは復号化に成功し、一般化されたメトリクスの範囲でかなりの利得が得られることが示された。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:11:29 GMT)
EM^2Mem: Event-Centric Multimodal Memory for Large Language Models [52.3] 本稿では,イベント中心型マルチモーダルメモリフレームワークEM2Memを提案する。
3つの長ビデオQAベンチマークで、EM2Memは最強のメモリベースラインの平均精度を2.0、2.4、および3.7ポイント改善した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:38:41 GMT)
Measuring Optimal Transport in Transformer Depth [51.7] トレーニングされたネットワークが、最適な転送方法として、最も低コストで、各トークンと最適な宛先をペアリングするマップに沿って、このクラウドを移動するかどうかを問う。
Pythia-160m と Pythia-410m の両方を連続層雲間の正確な割り当てで測定する。
最後の層では、どちらのモデルも、ピチア410mの最適コストとピチア160mのわずかに高い価格で、最適なトランスポートマップが送信するトークンを移動させる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:27:31 GMT)
Monocular Depth Estimation from a Single Image: Progress and Opportunities [51.4] この調査は、初期学習に基づく手法からトランスフォーメーション基盤モデルの出現まで、この分野の進化を辿るものである。
本稿では,視覚SLAM,コンテンツ生成,ロボット知覚などのアプリケーションへの深度推定の統合を強調した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:48:10 GMT)
TAPVid-MV: A Benchmark for Tracking Any Point in 3D Across Multiple Views [50.3] この設定の最初のベンチマークであるTAPVid-MV(Tracking Any Point in Video across Multiple Views)を紹介します。
キュレートされた284のシーケンス、1,142のキャリブレーションされたカメラストリーム、109,769のトラックが、屋内と屋外のドメインにまたがる7つのサブセットにまたがっている。
本研究では,センサ深度,LiDAR,SLAM,SfM点,ヒューマンメッシュ,ポーズされたオブジェクトメッシュ,シミュレーションといった,データセット固有の補助的モダリティを用いてこれらのトラジェクトリを解析し,各シーケンスとトラジェクトリを人間のアノテーションによって視覚的に検証する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 21:58:51 GMT)
DGNet: Dual-knowledge Guided Network for Infrared Small Target Detection [43.3] InfRared Small Target Detection (IRSTD) はコンピュータビジョンにおける目立った課題である。
複数の一般化可能なテキストに基づく新しいDual-knowledge Guided Network(DGNet)を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:44:47 GMT)
World Model-Guided Reinforcement Learning via Counterfactual User Engagement Simulation [43.3] ユーザ中心エージェントの強化学習は、オンラインフィードバック収集のコスト、レイテンシ、リスクによって制限される。
We propose World Model-Guided Reinforcement Learning via counterfactual user engagement Simulation (WMG-RL)。
UEWMは、ドメイン間で信頼性があり、転送可能な報酬信号を提供する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:59:41 GMT)
Efficient and Robust Absolute Pose Estimation via Gravity-Prior-Driven Transformation Decoupling and Pose Refinement [42.0] 本稿では,従来の重力から得られる幾何学的関係を生かした新しい変換戦略を提案する。
1-DoF回転角に対して、最適推定に1次元大域的投票アルゴリズムを適用する。
正確なポーズ結果を得るために、回転と翻訳の精度を高めるために、新しいポーズ改善アルゴリズムを導入する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:43:39 GMT)
One Policy, Any Budget: Internalizing Budget-Aware Search via Reinforcement Learning [41.6] 我々は,予算制約下での予算対応検索を単一ポリシーで行えるフレームワークであるAnySearchを提案する。
第1フェーズでは、明確な予算状態注入と構造化推論プロンプトでエージェントを訓練する。
第2段階では、足場を除去し、エージェントは適応的にサンプル化された予算制約の下で自律的に操作することを学ぶ。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:12:32 GMT)
Kirin: Animal Motion Generation from In-the-Wild Video [40.9] キリン(きりん)は、動画から動きを再構築し、大規模に動きの先行を学習し、アニメーションの資産に直接適用可能な現実的な動きを生成する枠組みである。
AiM3Dは、四足動物向けのビデオテキスト移動を提供する最初の大規模データセットである。
市販のイメージ・トゥ・3Dモデルを利用することで、生成した動きを用いて3Dメッシュを自動的にリグ・アニメーションし、準備の整ったアニメーション動物を生成する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:56:15 GMT)
VIBE-Bench: Evaluating Personalized Large Language Models When Profiles Don't Mean Preferences [40.2] 既存のベンチマークでは、セマンティックな歴史から好みを検索できると推定されている。
我々は、未調査だが実際は重要な制度であるプロファイル参照概念の誤りについて研究する。
心理学的な2つのタスクと12,239の対話を備えたベンチマークであるVIBE-Benchを紹介する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:45:28 GMT)
Dense Process Supervision for Search Agents via Fact Utility Estimation [39.9] 本稿では,実効性推定に基づくプロセス監視手法を提案する。
7つのシングルホップおよびマルチホップQAベンチマーク実験により,本手法が既存のベースラインを一貫して上回ることを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:34:33 GMT)
On the Human and Computer Alignment of Attribute-Based Music Matches [38.9] 我々は、メロディ、ハーモニー、リズム、声、音色という5つの音楽特性に焦点を当てている。
我々は,三重項に基づく強制選択タスクを,盗作例,カバー曲,AI生成音楽を含む300件のケースで設計する。
この実験から,83名の専門家による属性に基づく音楽マッチングの知覚的評価のコレクションであるMATCHAデータセットを紹介した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:41:29 GMT)
ZipTok3D: High-Fidelity 3D Tokenization with Compact Token Prefixes [38.7] ZipTok3Dは、非常に短いトークンシーケンスからの高忠実度再構成のために設計された3Dトークンライザである。
同じトークン次元でZipTok3Dは32token COD-VAEベースラインに匹敵する再現性を実現する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:07:49 GMT)
H3-World: Turning Language Understanding into World Control [38.6] H3-Worldは、33B MiniMax-H3ビデオジェネレータをインタラクティブな世界モデルに変える効率的なフレームワークである。
8000のゲームプレイサンプル、10,000のLORA最適化ステップ、0.199%のトレーニング可能なパラメータで、H3-Worldは効果的なキャラクタとカメラ制御を実現している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:21:40 GMT)
MegaStyle++: Scaling Image Style Space through Hierarchical Style Definition [38.6] 本稿では,全体スタイルのアイデンティティから細かな視覚的属性に至るまでのイメージスタイルを記述した階層型スタイル定義を提案する。
この定義に基づき,MegaStyle++-8Mを構築し,150Kの全体的なスタイル識別,100Mのきめ細かいスタイルプロンプト,8Mのスタイリング画像を含む大規模スタイルデータセットを構築した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:37:09 GMT)
One Demonstration, Many Objects: Generalizing Manipulation via Local Contact Geometry [38.5] 人間のデモから学ぶことは、ロボット遠隔操作のスケーラブルな代替手段として現れてきた。
最近のsim-to-real RL法はそのような先入観を取り入れているが、しばしば正確な接触を明示的に動機付ける報酬を省略する。
接触点に局所的な形状に着目してオブジェクトを操作できるDemoMimicを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 23:04:35 GMT)
How Correct Is Your Answer? A Semantic Correctness Framework for Open QA Evaluation [38.5] 本研究では,8つのクラスに有意な回答を割り当てる意味的正当性分類を導入し,有意な内容によって汚染されたものから有意な回答を分離する。
次に、広く使用されているQAデータセットにまたがる8.8kサンプルベンチマークであるCAP-Correctnessと、質問応答ペアを宣言文に変換する11kサンプルデータセットであるCAP-Statementsをリリースする。
第三にCAP(Context-Aware Precision)は、双方向NLIを用いて質問条件文をスコアする参照ベースのメトリクスである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:06:39 GMT)
Verification of $K$- and Infinite-Step Strong/Weak Anonymity Using Concurrent Compositions [38.3] 本稿では,非決定論的有限状態オートマトンでモデル化した部分観測離散イベントシステムに対して,$K$-および無限ステップ匿名性を導出する。
まず、2つの強いタイプと2つの弱いタイプの$K$-および無限ステップの匿名性を定義し、これは強および弱匿名射影を考慮して、既存の$K$-および無限ステップの匿名性の概念と根本的に異なる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:03:52 GMT)
GadIR: A Spatial-Topology Preserving Compiler for Quantum Many-Body Systems Simulation [36.6] 量子多体シミュレーションのための空間位相保存コンパイラを提案する。
パウリガジェットをハミルトニアンの表現として使用し、元の物理モデルの空間位相情報を保存する。
コンパイラバックエンドは、Pauliガジェット上でトロッタライズとスケジューリングを行い、その後、Pauliガジェットをハードウェアネイティブな量子プログラムに合成する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:42:13 GMT)
Membership Inference in Fine-tuned Diffusion Language Models via Token-level Memorization Asymmetry [35.9] 拡散言語モデル(DLM)は、並列生成や双方向コンテキストモデリングといった利点を提供する。
生成能力への関心が高まりつつあるにもかかわらず、DLMのプライバシーリスクは未調査のままである。
そこで我々は,Q-Skewを提案する。Q-Skew,Q-Skew,Q-Skew,Q-Skew,Q-Skew,Q-Skew。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:07:21 GMT)
Births are difficult to predict even with rich survey and full-population register data [35.8] 我々は,3年以内に子どもを産むことの1つの成果を,予測の理想に近い設定で検討した。
147人の研究者が18~45歳のオランダ人の出生を調査データと全人口登録簿を用いて予測した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:04:29 GMT)
Closing Cost-Quality Gap in Document VLMs: Difficulty-Aware Data Curation and Quality-Adjusted Deployment Economics [35.8] 我々は、Mixture-of-Experts VLM(合計35B、3Bアクティブ)上に構築された文書理解システムを提案する。
レイアウトの多様性、事実抽出性、モデル間の整合性のために、Difficulty-Awareパイプラインによってキュレーションされたオープンドメインドキュメントと混在する社内生産データに基づいて微調整された。
これは、人間のベースラインに対して80%以上コストを削減し、最高の競合するオープンソースモデルに対して50%以上コストを削減します。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:40:29 GMT)
Who Judges the Judges? A Chinese Safety QA Benchmark for Evaluating LLM Responses and Safety Judges [32.8] C-SafeQAは中国の有害物質評価のための政策ベースベンチマークである。
538のベースクエリと8,877の逆クエリで構成される。
目標モデル安全性の評価と7人の自動安全判事の監査の両方をサポートする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:15:01 GMT)
A multicenter benchmark and clinically structured metric for coronary CTA report generation [31.9] CSM$_textCCTA$, CSM$_textCCTA$。
CCTAをトレーニングしたC2RGモデルは4つの病院で最高CSM$_textCCTA$スコアを達成した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:38:44 GMT)
TUTTI: Toward generalizable audio-to-score transcription via fully synthesized data [31.8] Generalizable Audio-to-Score (A2S) の書き起こしは、高品質な実世界のペアリングデータの深刻な不足によって制限される。
TUTTI (Transformer for Unified Audio-to-score Transcription trained on Synthetic Multi-Instrumentation Data) は、純粋に合成された大規模データセットによって駆動される事前学習パラダイムである。
複数構成データに対する統合された注意ベースモデルの事前学習は、単構成トレーニングよりも一貫して強力な表現が得られることを実証的に実証した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:17:03 GMT)
Explore Before Committing: Hypothesis-Guided Search for Deep Research Agents [31.4] Deep-Researchエージェントは、検索やブラウジングツールと対話することで、複雑な質問に答える。
我々の軌道レベルの分析では、エージェントがいくつかの可能な方向を持つ早期探索状態に遭遇する共通の故障モードが明らかである。
ソフト検索ヒントとして軽量な仮説を生成するPhySearchを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:27:37 GMT)
Belief-Calibrated Optimization: An Explicit World Model for Agentic Optimization [31.3] 本稿では,Belief-Calibrated Optimization (BCO)について述べる。
蓄積された文書が与えられた新しい予測器は、コンテンツが偽造された文書や同形コピーよりも、どのように環境がより正確に応答するかを予測する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:47:04 GMT)
Space Generative AI with Solar Energy Harvesting [31.1] 本稿では、衛星がユーザのプロンプトを受け取り、拡散ベースの画像生成モデルを実行し、厳密な時間窓で圧縮結果をダウンリンクする太陽エネルギー空間生成AIのためのフレームワークを提案する。
我々は、決定論的軌道運動によって誘導される予測可能な太陽-EHダイナミクスを活用し、抽出可能な2段階アプローチを用いて、共同でC$2$の資源最適化フレームワークを開発する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:58:15 GMT)
On the Design Fundamentals of Pixel Text Representation Learning [28.3] テキストリッチな視覚入力は、ピクセル空間で直接言語を読み、検索し、圧縮できるモデルを必要とする。
既存のピクセルテキストエンコーダは、固定解像度事前学習、視覚的ショートカット学習、弱い視覚的接地、多言語視覚的テキスト理解に苦慮している。
Pixel Linguist IIは、オンザフライレンダリング、統一コントラストグラウンド、および2億8000万以上のトレーニング例の多言語カリキュラムで訓練されたネイティブ解像度の視覚エンコーダです。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:20:19 GMT)
SoK: When Safe Agents Fail Together: The Security of Multi Agent LLM Systems [28.3] マルチエージェントセキュリティシステム(MAS)は、情報、状態、決定、権限を主要境界を越えて移動させ、ローカルチェックが見逃す可能性のある障害を生成する。
我々はMASのセキュリティを,6つのインタラクションインターフェース,4つの敵位置,7つのシステムレベルリスク,8つの繰り返し攻撃経路を含む,実行中心の197の作業の解析を通じて体系化する。
我々は,A-I-Rフレームワークを導入し,敵位置,インタラクションインターフェース,およびシステムレベルリスクによる攻撃を組織化し,MAS全体でフラグメント化された攻撃機構を統一する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:34:44 GMT)
RingMoClaw: An Experience-Inspired Multi-Agent Framework for Self-Evolving Research in Remote Sensing [27.9] RingMoClawは、リモートセンシング視覚解釈のためのエクスペリエンスインスパイアされたマルチエージェントフレームワークである。
クローズドループ最適化プロセスを確立するために、研究ブランチ、品質制御ブランチ、デュアルストリームダイナミックエクスペリエンスバスを統合する。
オブジェクト検出では1.84% mAP$_50$でパフォーマンスが向上し、他の3つのタスクで一貫したゲインを実現している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:13:50 GMT)
MaskCode: Mask Transformer for Feedback-Assisted Coding With Linear Block Codes [27.9] MaskCodeは、ECCd符号化システムのトランスフォーマーベースの内部フィードバックコードである。
外部線形ブロック符号の構造知識をインナーフィードバックエンコーダ設計に明示的に組み込む。
常に全てのベースラインを上回り、1.5dBのSNRを達成している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:47:42 GMT)
Can Large Language Models Forecast What Researchers Study Next? [26.4] コミュニティの文献が切り離されてしまうと、システムは最大5つのランクのアイデアを生み出し、それが後の論文に対して評価される。
GPT-4.1、Qwen2.5-7B/14B、Qwen3.5-9Bの5つの履歴圧縮戦略と学習モード分割予測器(MDF)を比較した。
結果盲検評価では、Qwen2.5はより広範な予測を生成するが、その利点にどの程度の幅が貢献するかは特定していない。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:26:37 GMT)
BeamRMX: Radiation-Pattern-Driven Learning for Generalizable Beam Radio Map Prediction and Beam Management [26.3] 6G無線ネットワークは、より大きなアンテナアレイと高指向性マルチビーム伝送を駆動している。
BeamRMXは、空間放射パターンを主要なBeamRMクエリとして扱うための最初の専用のフレームワークである。
XBaseは放射線クエリとシーン幾何学の間のマルチスケール相互作用を学習する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:59:08 GMT)
SinkPruner: Sink-Free Visual Token Pruning for Multimodal Large Language Models [26.0] MLLM(Multimodal large language model)は、長い視覚トークンシーケンスを処理する際に、かなりの計算オーバーヘッドを発生させる。
SinkPrunerは、効率的なMLLM推論のためのトレーニング不要なビジュアルトークンプルーニングフレームワークである。
SinkPrunerは、ハイノーム冗長性をフィルタし、注意シンクと注意分散を緩和するビジュアルサニタイザと、テキストクエリにセマンティックに整合したトークンを保持するテキスト誘導プルーナーの2つの主要なモジュールで、粗い粒度の設計に従う。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:52:10 GMT)
One Prompt Is Enough: Watermark Laundering Through Foundation Image Models [25.3] 攻撃者は、単一の再構成プロンプトで透かし画像を送信し、見えない透かしを確実に復号できない、視覚的に忠実な出力を得ることができる。
我々は、この障害モードをウォーターマーク洗浄として形式化し、ビット誤り率(BER)と視覚的および意味的保存を組み合わせた共同ペイロード忠実度プロファイルを用いて評価する。
一方、Nano Banana 2は、DwtDctが高忠実度再構成の下で脆弱であることを示しています。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:46:31 GMT)
Same Request, Different Boundary: Evaluating Cybersecurity Assistance across Conversational Contexts [25.3] 大規模言語モデル(LLM)は複雑な問題を解決することができるが、リスクの高いドメインでの誤用は深刻な結果をもたらす可能性がある。
3R-Benchは、現実の150のサイバーセキュリティ要求のベンチマークで、2つの対向的な会話設定が強化されている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:16:56 GMT)
ADAPT: Agile Diffusion Action Priors for Robust and Steerable Online Text-Driven Humanoid Control [25.2] 本稿では,対話型テキスト調和型ヒューマノイド全身制御のためのエンドツーエンドフレームワークADAPTを提案する。
ADAPTはテキストラベル付きヒューマノイド状態反応軌道の前に拡散に基づく作用を学習する。
実験では、堅牢な言語によるスキル実行、スムーズなインタラクティブなトランジション、スタイル保存による下流制御が示されている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:53:38 GMT)
AI Alignment through a Game-theoretic Lens: A Survey [24.6] 主要なゲーム理論要素に関する最近の進歩を整理し、好みの多様性、アライメントの優先順位、時間的ダイナミクスという3つの課題に沿って文献を合成する。
この視点は、現在のアライメント手法がゲーム理論の分析から真に恩恵を受けていること、フレームワークがゆるいこと、堅牢で適応的で検証可能なAIシステムを構築する上での課題を明らかにする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:18:51 GMT)
Harness-of-Harness: Multi-Day Autonomous Software Development with Continual Improvement [24.3] 我々は,自律開発において,コーディングエージェントがソフトウェアを継続的に改善できるフレームワークであるHarness-of-Harness(HoH)を紹介した。
HoHは既存のコーディングエージェントハーネスで動作し、実行を反復的な計画コーディングテストループに編成する。
平均相対利得は52.25パーセント、最大利得は3回の反復で82.86パーセントに達する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:17:18 GMT)
Agents That Model Agents: Five Principles Toward a Theory of Mind for 6G Networks [24.2] 6Gネットワークは、Radio Access Network (RAN)を管理するためにLarge Language Model (LLM)エージェントに依存する。
現在のアーキテクチャでは、エージェント間メッセージは客観的な事実を伝える。
メッセージは送信者の推論の例証である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:49:44 GMT)
Evaluating Multimodal LLMs as Generalist Vision-Language-Action Agents for Drone Control: Commanding, Approaching, Tracking and Searching [23.8] 小さなオープンモデルはしばしばフロンティアモデルよりも成功半径に確実に移動するが、到着時期を早めるか全く宣言しないかでエピソードを失う。
我々はMLLMが交換可能なコンポーネントであるアーキテクチャであるDroneCATS-Agentと、モデルを独立変数として扱うベンチマークであるDroneCATSを紹介する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:27:43 GMT)
SDARE-Bench: Evaluating Large Language Models on Conversational Stigma Detection and Response in Dyadic and Group Dialogue [23.5] SDARE-Benchは,大規模言語モデルにおけるスティグマ検出とオープンエンド応答生成を評価する最初のシナリオベースベンチマークである。
経験的結果は、特にグループ対話において、スティグマ成分の同定が不十分であることを示している。
シュティグマ反応は、特に社会的に複雑な会話の文脈において、繰り返し発生するLLMの安全性の脆弱性であると考えられた。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:15:22 GMT)
Harness Engineering in LLM Tool Use via Agent-Native Reusable Tool Primitives [23.3] textbfTool Primitivesは、厳格なAPIスキーマベースの呼び出しを、ツール呼び出しのインターフェースとして自然言語に置き換える設計である。
textbfHEART - textbfHarness textbfEngineering framework via textbfAgent-native, textbfReusable textbfTool Primitives。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:07:09 GMT)
Graph Evidence Is Not Enough: Diagnosing Native Decoder Use in Graph-Augmented LLMs [23.3] グラフ拡張された大きな言語モデルは、しばしば、外部計算によって生成されたグラフ証拠をネイティブデコーダで使用することができると仮定する。
グラフエビデンスを提供することは、使用可能にすることとは同じではないことを示す。
診断駆動インタフェース設計がネイティブデコーダのユーザビリティを向上させることを示す例として,S$2$GEを挙げる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 06:44:00 GMT)
Value Over Language Model: Detecting Original Contribution in Writing [23.2] 我々は、言語モデルが自分自身で容易に生成できるものの上に、人がどれだけの価値を付加するかを測定するフレームワークを設計する。
この方法は、トレーニングやラベル付きデータを必要とせず、文書の表面のテキストをスコアすることはない。
ヒューマンオーサリングされた文書と、ジェネリックタスク記述から生成された一致したLCM生成文書とを分離する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:21:20 GMT)
TempCloze: Can Video-LLMs Identify the Missing Middle? [23.0] 我々は,ビデオLLMにおける視覚的時間的推論を評価するためのビデオクローゼベンチマークであるTempClozeを紹介する。
私たちは3次元に沿って同じソースのイントラクタを構築し、セマンティックはイベントの発生を尋ね、アライメントプローブはいつ発生すべきか、どのように展開するかをテストします。
さらに、TempCloze-MixedとTempCloze-Hardのエラーパターンと行動感度分析を行い、エラーの発生場所と、候補順序、コンテキスト方向、可視範囲、フレーム密度、テスト時間スケーリングの影響モデル選択について検討する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:45:02 GMT)
What's in Your Agent's Context? Context Privilege Escalation Attacks against AI Agent Harness [21.9] 現実の高名なAIエージェントハーネスは、しばしばコンテキストアセンブリのベンダプライエタリな設計や不透明な設計に依存している。
実世界のAIエージェントハーネスにおけるコンテキストアセンブリ設計のシステマティック分析について述べる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:26:21 GMT)
Investigating Assistant Bias in LLM User Simulators Using a Role Vector [21.7] LLMベースのユーザシミュレータは、大規模に自律エージェントを評価するために、ますます利用されている。
モデルトレーニング中にアシスタントバイアスが焼き込まれ、ロールプレイングプロンプトがオーバーライドしない。
i) ユーザ指向はアクティベーションにおいて識別可能であり, ユーザライクな振る舞いを誘発し, アシスタント特性とは異なる特徴を捉えている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:49:30 GMT)
Import What You Need: Learning When and How to Augment EHR Graphs with External Knowledge [21.6] 本稿では,KGインポートをビジット毎の予算対応政策として活用する強化学習に基づく動的トポロジ拡張フレームワークを提案する。
ReTAは、効率を保ちながら、強いベースラインを一貫して上回り、データセットとナレッジグラフをまたいで転送し、解釈可能な拡張パターンを生成する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:16:55 GMT)
Polished but Unresolved: Identifying Late-Stage Pressure States in Long-Horizon Tool-Use Agents [21.2] 我々は、エージェントが最終回答を提出する際、鍵制約が未解決のまま、完全で洗練されているように見えるようにバイアスがかかる後期の圧力状態について研究する。
加圧加圧方向を適度に調整し, 高圧力下で構造組織に移動させるプラグインであるPSPR(Probe-Sensed Pressure Relief)を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:24:53 GMT)
CMRVision: A Foundation Model for Cardiac MR Image Analysis [21.2] 我々は、DINOv3スタイルの自己教師型学習を用いて訓練されたCMR固有の基礎モデルであるCMRVisionを紹介する。
CMRVisionは、シネ間でのマルチタスクセグメンテーション、後期ガドリニウム増強(LGE)、マッピングシーケンスの2つの下流タスクで評価される。
実験の結果、CMR固有の事前トレーニング、パッチサイズ、パッチレベルの目標がダウンストリーム性能を継続的に改善していることが判明した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:34:30 GMT)
Chain-of-Thought Faithfulness of Reasoning Models Varies with Where and How Preference Cues Are Delivered [21.1] CoT(Chain-of- Thought)モニタリングは、推論トレースがモデルの回答を形作る情報を忠実に記録していると仮定する。
FACE-Evalは5,100サンプルの評価で、キュー位置(ユーザメッセージやツールリターン)と明示性を変化させる。
本研究は, クエフォロー回答の言語化コミットメントと, クエッドサンプルの非言語化導入度を測定した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:45:29 GMT)
ADGNet: Asymmetric Dual-text Guided Network for Infrared Small Target Detection [21.0] InfRared Small Target Detection (IRSTD) は難しい課題である。
現在のマルチモーダルメソッドでは、ターゲットとバックグラウンドの両方を単一のテキストプロンプトで記述している。
我々は、新しい非対称デュアルテキストガイドネットワーク(ADGNet)を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:48:22 GMT)
D-FROST: Decentralized Federated pRompt-tuning via Optimal tranSporT for Non-IID and Imbalanced Data [20.8] 分散化フェデレーション学習における即時チューニングに関する最初の研究について述べる。
D-FROSTは、最適なトランスポートベース(OTベース)の分散プロンプトチューニングアルゴリズムである。
不均一なクライアントデータに基づく実験は、分散的なプロンプトチューニングにおけるD-FROSTの有効性を示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:16:14 GMT)
hLLM: Single Pass Decoding for Generative Reranking [20.8] hLLM(ハンガリー語)はフォーマット特化復号化戦略であり、$O(1)$フォワードパスですべての$N$オーディナルをデコードする。
また,LoRAをベースとした微調整と教師のランク付けを併用した微調整は,教師と同等の格付けを維持しつつ,エンドツーエンドの推論で28msの高速化を実現した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:30:04 GMT)
DramaChain Bench: An End-to-End Benchmark for Short-Drama Generation [20.5] DramaChain Benchは、完全なプロダクションチェーンのすべてのステージを評価する最初のショートドラマベンチマークである。
1次元システムDramaChain Dimensionsを共有する3つの社内システム上に構築されている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:23:45 GMT)
From Language to Behavior: Scaling Sequence Transformers for Industrial Recommendation Ranking with Rec-Native Designs [20.4] ReSTはレコメンデーションネイティブなTransformerスケーリングフレームワークである。
信号品質のために、二重ゲートの注意を持つシーケンスエンコーダを導入している。
非対称性では、ランキングを重い再利用可能なエンコーダとデコーダに分解する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:40:36 GMT)
LEAP: Likelihood Elicitation and Aggregation for LLM-based Probabilistic Forecasting [20.2] 予測段階でどのように収集された証拠が使用されるかを再編成するLEAPを提案する。
LEAPは、それぞれのエビデンス項目を別々に調査し、ターゲットに対する影響を説明する可能性パラメーターを抽出する。
再現可能なエビデンスコントリビューションを維持しながら、継続的、単一選択、複数選択予測をサポートする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:49:19 GMT)
Latent Action as Intention Enables Efficient Future Imagination for World Action Models [20.0] 提案するアーキテクチャ**LAWA**は,コンパクトな潜伏動作を将来の意図の操作的表現として利用するWAMアーキテクチャである。
RoboCasaでは、LAWAは数ショットと全データ設定で65.6%と80.8%という最先端の平均的な成功率を達成した。
また、一致したJoint-WAMモデルの性能レベルも保持し、42.9%の遅延時間を必要とする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 06:44:23 GMT)
VerTox: Verifiable Reward-Guided Corpus Poisoning Against Neural Ranking Models [20.0] 本研究は、コーパス中毒攻撃に対するニューラルネットワークランキングモデルの脆弱性について検討する。
敵は少数の悪意ある文書をコーパスに注入し、ランキング動作を歪ませる。
報奨誘導型強化学習問題としてコーパス中毒を定式化した最初のフレームワークであるVerToxを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:43:11 GMT)
RISA: Response Inspection and Selective Actions for Refusal Calibration in Large Language Models [19.9] トレーニング時間アライメントは、モデルパラメータを安全データで更新することで、拒絶動作を改善するが、さらなる計算とトレーニングが必要である。
インフェルノ時間アライメントは、基礎となるモデルパラメータを更新することなく、推論中のLCMの振る舞いを変更することを目的としている。
本稿では、初期応答を検査し、ベースモデルを更新することなくエラーを選択的に修正する推論時フレームワークである、応答検査と選択行動(RISA)を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 06:37:42 GMT)
Can LLMs Design Video Coding Tools? A Case Study on Planar Mode [19.4] 本稿では,大規模言語モデル (LLM) がビデオ符号化ツールを設計できるかどうかを考察する。
ビデオ符号化標準における長年の予測ツールであるPlanarモードに関する実証事例を提示する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:04:47 GMT)
A SoK for SoCs: Reading the TI Leaves on AI for Cyber Threat Intelligence Generation and Sharing [18.7] 生の攻撃証拠を共有可能なサイバー脅威インテリジェンス(CTI)に変換するプロセスは、いまだに断片化され、検討されている。
我々は学術論文の文献調査を行い、CTIライフサイクルを脅威データ収集、CTI生成と共有、CTI消費の3段階に編成する。
第1段と第3段は文献でよく表現されているが、CTI生成と共有を扱う論文はごく少数である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:49:54 GMT)
From Base Rollouts to RL Reasoning: A Budgeted Search Perspective [18.6] 検証可能な報酬(RLVR)による強化学習は、言語モデル推論を改善するが、これらの効果が推論時復号と探索にどのように関係するかは、まだ不明である。
我々は、トークンレベルのサンプリング、ビームライクな検索、ツリー検索、シーケンスレベルの再サンプリングを、共有予算の運用空間上で実行可能なポリシーとして表現するUDF(Unified Decoding Framework)を用いて、これを行動的に研究する。
そこで,SimpleRL-Zoo の Base/RL チェックポイントをペア化することにより,RL のデフォルト政治曲線を Base 動作点の構造化経路で近似できるかどうかを問う。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:08:39 GMT)
Need One Bell-pair Only (NOBOL) for Low-Overhead Fault-Tolerant Quantum Computing [18.5] 任意のCSSコードで符号化された2つの遠いキュービット上で論理的CNOT演算を行うために,ベルペアを1つだけ必要とする新しいアプローチNOBOLを提案する。
論理演算子の大きさの対数深度を持つ深さ最適回路を含むNOBOLの様々な回路実現について述べる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 22:02:03 GMT)
Aligned but Flattened: Analyzing the Trade-off between Cultural Alignment and Diversity in LLMs [17.2] 文化的整合性の追求は、常に多様性の急激なコストを伴い、深刻な「文化的平坦化」につながることを示す。
本研究は,現状のポストトレーニングパラダイムの限界を明らかにするとともに,異文化多元主義を保全したアライメント目標へのシフトを求めるものである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:59:29 GMT)
Accelerating Reinforcement Learning via MPC Solver-Gradient Guidance for Weights-varying MPC [17.2] 本稿では,RLをベースとしたオンラインMPCコスト重み付けのためのソルバ感度向上手法を提案する。
SG-RL in Proximal Policy Optimization (PPO) with four modular algorithm that inject solver-gradient guidance into actor-update scaling, policy loss, advantage estimation, and value-function learning。
意図的なモデルミスマッチを持つ2つのフルスケールの自律レースプラットフォームにおいて、SG-RLは最大70.6%のサンプルでPPOの最高のクローズドループリターンに達し、クローズドループリターンにおいてGB-PLベースラインを少なくとも54%上回り、ゼロショットを目に見えない環境に一般化する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:55:18 GMT)
An Intelligent Decision Support System for Emotion Monitoring using Microscopic Fixational Dynamics [16.8] 本稿では,視覚的微視的固定パターンから感情状態を予測するための知的意思決定支援システムと広範エッジコンピューティングフレームワークを提案する。
提案システムは3つの異なる神経生理学的微動を抽出し分解する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:43:42 GMT)
Trust Your Guide Only When Certain: Uncertainty-Aware Sparse Alignment at Inference Time [16.4] 弱みの監督者は、大多数のトークンに広範に高いエントロピーを示す。
信頼に基づく不確実なスパースアライメント(TUSA)は動的仲裁プロセスとしてアライメントを再構築する。
実験により、TUSAは安全アライメントと一般的な有用性の両方を一貫して改善することが示された。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:05:49 GMT)
Modelpedia: A Catalog of Model Findings for the Meta-Science of AI [16.3] Modelpediaは、発行された論文からモデルに関する発見を抽出し、関連するモデル、データセット、メソッド、概念にリンクし、結果を検索可能なパブリックカタログに集約する自動フレームワークである。
ICLR 2024 と 2025 の論文にプロトタイプを適用して,1000 以上の知見を抽出し,そのカタログ自体を研究対象として扱い,コミュニティによるモデル調査のメタ分析を行う。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 11:29:03 GMT)
The Data Problem in Software Vulnerability Analysis: Artifacts, Quality, and Consumption [15.4] データセット中心の分類法を用いて脆弱性分析の背後にあるデータについて検討する。
2016-2026年に関する1522の論文の体系化されたコーパスと、それ以前の基礎的な作業から、私たちは111のアンカー・ペーパーの結びついたセットをディープコーディングしました。
実行可能アーティファクトは、24のデータセットのうち15が実世界のグレード化され、独立したチェックを受けたラベルを持つ唯一の主要なタイプです。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:33:30 GMT)
Pointwise Majorization for sub-Weibull and Mixed Tail Processes with Applications in Quadratic Chaos and Ergodic Diffusions [15.4] バナッハ評価過程に対する最初の同時点分極理論を確立する。
我々の境界は、大域的な量ではなく、ポイントワイドの複雑さ$_,d()$によって決定される。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:42:38 GMT)
How Do Prompt Variations Affect Energy Consumption in On-Device LLMs? [15.4] 大きな言語モデル(LLM)はモバイルデバイスにますますデプロイされ、エネルギー効率が重要なデプロイメント制約となる。
本研究の目的は,認知的負荷と表現パターンという2つの迅速な特性が,デバイス上でのLCM推論のエネルギー的挙動をいかに形作るかを理解することである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:08:04 GMT)
Compressing AI Traffic: Standardized Neural Network Coding of Visual-Token Representations in Split Vision-Language Inference [15.4] ビデオ-MMEの精度は、送信されたBF16テンソルの98%まで圧縮されていない基準に近づき、その後崩壊する。
オープンエンドMLVU生成はLLM判定の下で同じプラトー・アンド・ロバスト性を示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:07:32 GMT)
Human-robot conversation with multiple participants in noisy public spaces [15.3] 本研究は,遠隔操作者へのクリーン音声として音声認識や伝送に使用できる音声システムを提案する。
第1のシナリオはアンドロイドERICAによる注意深い聴取システムであり、第2のシナリオはモバイルテレコロボットによる会話支援システムである。
本稿では, 雑音の多い環境下での複数の話者の発話を向上するだけでなく, アバターに基づく会話対話において, より没入感を増すような空間的音声を提供する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:25:03 GMT)
SciTrue: Reliable Scientific Claim Validation with Frontier and Open Language Models at the NTCIR SciClaimEval Task [15.3] 11のフロンティアとオープンなマルチモーダルモデルを1つの正直なサンプル・プロトコルでベンチマークする。
SciTrueは4つのエビデンスカテゴリ/サブタスクの組み合わせのうち3つに明確なマージンを付けている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:30:45 GMT)
OutageDiT: A Generative Foundation Model for Power Outage Forecasting and Scenario Simulation [15.1] OutageDiTは、クォーター時間解像度で7日間の停止軌跡を生成する基盤モデルである。
条件エンコーダは、予測毎に1回、履歴コンテキストと既知の未来のco変数を処理します。
浅い流れデコーダは、結果として生じる水平方向の状態を再利用し、完全な軌道を生成する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 21:54:17 GMT)
User Representation via Cross Multi-source Behavior Pre-training for Mobile Games [15.1] デバイスレベルの動作ログに基づくモバイルゲームユーザ表現学習のためのクロスマルチソース行動事前学習モデルを提案する。
CM-PTMはユーザの内在的関心を効果的に捉え、ダウンストリームなモバイルゲームレコメンデーションタスクにおいて常に大きなパフォーマンス向上をもたらすことを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:53:47 GMT)
The Rise of Verbal Reinforcement Learning [15.0] このパラダイムをVerbal Reinforcement Learning (VRL)と呼び、その最初の統一的な説明を提供する。
一つの軸の周囲のフィールドを整理し、エージェントのライフサイクルに音声フィードバックが影響し、3つの柱が生成される。
この分類は、より有能で整合したエージェントを構築する上での課題と機会を定義しつつ、言語的強化がエージェント開発をいかに形作るかを示している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:58:18 GMT)
Teaching Vision-Language Models to Use the Scale They Are Given: Label-Free Equivariance Training for Metric Physical Reasoning [15.0] ビデオに関するメトリックな質問は、視覚計測を物理単位に変換するために視覚言語モデルを必要とする。
現在のモデルでは、このスケール情報を部分的にのみ使用しています。
8つの視覚言語モデルにまたがって、このアンダーレスポンスは4桁以上持続する。
メトリックアノテーションを必要とせずに、この正確なスケーリング関係を監視として使用します。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:36:33 GMT)
Disclosure-Gated User Simulation for Companion-Agent Evaluation [15.0] 私たちは大きな言語モデルを使ってユーザをプレイし、その仕様に対してユーザシミュレータをトレーニングします。
ゲーティング行動は、トレーニングコーパスの合成ブランチから学習され、実際のブランチは、人々が話す方法と反応する方法を提供する。
ランク付けは順序保存でなければならず、絶対スコアはスケール安定でなければなりません。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:39:41 GMT)
Manifold-Aware General Coded Computing for Straggler-Resilient Distributed Computing [14.8] 既存の符号化計算設計では、入力データ固有の構造を明示的に利用していない。
本稿では、この固有形状を利用して、データの自然な多様体に従う符号付きサンプルを設計する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:42:03 GMT)
Measuring the Behavioral Fidelity of Long-Horizon Human Activity Simulations [14.7] 本研究では,長距離活動シミュレーションにおける行動の忠実度を評価するための枠組みを提案する。
ケーススタディとして、43時間のオフィス活動のデータセットを収集する。
私たちは、行動の忠実度がメトリクス間で均一でないことに気付きました。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:51:11 GMT)
Induction and Inquiry via Probabilistic Reasoning over Language and Code [14.6] 人間の成長と、希少でノイズの多い経験データからの抽象的な知識の維持は、認知科学における長年の課題である。
本稿では、自然言語とソースコードを結合したメンタルプログラムとして記号的知識を符号化することにより、これらの3つの特性を捉える計算モデルを提案する。
様々な行動学的研究において、このモデルは人間の帰納的学習と活発な調査の定量的なシグネチャを再現することに成功している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:44:18 GMT)
Skill Following: Evaluating Actual Skill Use in Retrieval-Enabled LLM Agents [14.6] 大きな言語モデル(LLM)エージェントは、ますます外部スキルに依存している。
この実使用能力を測定するために、我々は「スキル追従(SF)」を定式化し、検索誘導実使用効果(RAE)を導入する。
RAEは、エージェントが積極的にスキルを回収したタスクにのみ条件付きで、マッチしたスキル対応実行とスキル障害実行の間の同じタスク結果の差を計算する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:33:57 GMT)
Data-Driven Persona-Conditioned Agents for A/B Test Simulation [14.5] データ駆動型ペルソナに条件付きLLMエージェントを用いて,A/Bテスト結果を予測するシミュレーションフレームワークを提案する。
合成または規則に基づくペルソナに依存する以前の作業とは異なり、エージェントは匿名化された行動データアクティビティーパターンから構築される。
最適構成は, 試験量に応じて0.75-0.90の方向精度を達成できる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:35:49 GMT)
ContextPipe: Database-Inspired Context Assembly for Long-Horizon Agents [13.9] ContextPipeのコンテキストは監査可能で、再生可能で、フェールアイソブラウザであることを示す。
SWE-bench Pro Quteサブセットを用いた予備評価では、追加のみのコンテキスト構築ポリシと比較して、ContextPipeは、KVキャッシュヒット比の低いコストで、トークン総量を31%削減し、LLMコールを23%削減し、レスポンスタイムを9%削減した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:27:38 GMT)
CQF-HMR: Continuous Quaternion Flows for Probabilistic 3D Human Mesh Recovery from a Single Image [13.8] 2次元ポーズ推定を条件とした四元数制約連続正規化流を用いた確率的3次元人間のための新しい手法を提案する。
実験では,Human3.6M,特にあいまいな環境での手法の現状を実証した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:45:38 GMT)
Will the User Ever Know? Covert Indirect Prompt Injection Attacks on Tool-Using LLM Agents [13.1] アタック成功率(ASR)は、インジェクションが成功するかどうかをカウントするが、エージェントの最終応答でユーザが気付くものを無視する。
エージェントは通常の応答を返しながらインジェクションを実行するか、最終応答でインジェクションされたアクションを報告する。
ICoAはインジェクションの実行後にエージェントをユーザタスクに戻して隠蔽結果を誘導するIPI攻撃である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:14:01 GMT)
ASSERT: Adaptive Stochastic Sampling for Robust Diffusion Models on Analog Compute-in-Memory Hardware [13.1] 拡散モデルは、強い画像生成品質を実現するが、高い反復的 denoising コストをもたらす。
初期高雑音化段階は最終改良段階よりもかなり脆弱であることを示す。
本稿では,早期かつスムーズな復調性を利用したトレーニングサンプルであるASSERTを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:13:10 GMT)
Visual Attention Faithfulness in Vision-Language Models is Heterogeneous [13.1] 視覚的注意の忠実度は不均一であり、3つの異なる処理モードで表されることを示す。
人間の注釈付き接地トラス領域は、モデルアテンションランキングと比較して60ドル%のケースで包括性を満足している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:32:01 GMT)
Video2Reaction: Training Foundation Video Models to Predict Audience Reaction [12.8] Video2Reactionは、短い映画のセグメントを野生の視聴者の感情的な反応にマッピングするデータセットだ。
LoRAで微調整された2つの視覚言語モデル(VLM)をベンチマークする。
我々は,VLMがVideo2Reactionから効果的に学習し,支配的な反応予測に基づく特殊ベースラインよりも優れていることを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:44:23 GMT)
Revisiting Face Recognition for Monozygotic Twins: The Celeb Twins Test Set [12.4] Celeb Twins Test Set (CTTS)には、80組の有名人の双子のためのウェブスクレイプ画像ペアが含まれている。
これは、皮膚のマークとミラー非対称性を区別した双生児のためのメタデータを備えた唯一の双生児テストセットである。
現在のディープCNNマーカは、CTTSの同一人物/異人物画像ペアの分類において76%以上の精度を達成することができる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:17:43 GMT)
Feed-Forward Multi-view Multi-person Reconstruction with Contrastive Human-Aware 3D Representation [12.3] 統合された、インスタンス中心の人間中心の3D空間を維持するための新しいトップダウンパラダイムを提案する。
クロスモーダルコントラスト学習は、カメラキャリブレーション、クロスビューアソシエーション、人間の再構築を同時に行うことができる。
実験は、実世界の挑戦的なシナリオにおいて、堅牢で、正確で、効率的なマルチビューの人間の再構築を示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:24:20 GMT)
Median-of-Means as an Extremal Convex Estimator and a Nonconvex Route to the Trimmed Oracle [11.6] 重み付きおよび逆向きに破損したデータを用いた堅牢な学習のためのファミリーブロックLp推定器を開発した。
ブロックLpの目的は、すべての局所的なミニマが真実に近づき、悪い盆地が存在しない、良質な景観を持つことが示される。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:39:04 GMT)
From Rollouts to Recipes: Self-Contained Post-Training for LLMs [11.4] セルフルーティング(Self-Routing)は、ロールアウトの正確性と信頼性を使用して、各サンプルの最適化方法を決定する、行動条件付きポストトレーニングフレームワークである。
本稿では, 均一なGRPO, 均一なOPSD, 固定混合, より単純なルーティングベースラインに対して, 自己追従は一貫して改善されることを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:36:26 GMT)
HarnessEvolve: Learning from Reference Trajectories for Reliable Agent Self-Evolution [11.4] 我々は、信頼できるエージェントの自己進化を実現するために、参照軌道から学習する自己進化フレームワークであるHarnessEvolveを紹介する。
私たちは、さまざまなモデルとエージェントフレームワークを使用して、オープンドメインとエンタープライズシナリオにまたがるいくつかのベンチマークで広範な実験を行います。
結果は、HarnessEvolveがすべてのベンチマークと設定で、最先端のベースラインを一貫して上回っていることを示している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:31:18 GMT)
CHARM: Character Hallucination for Multicultural Role Play Benchmark [10.8] 実写と架空の40文字のベンチマークであるCHARMを紹介する。
時間的(歴史的対現代的)とクロスユニバース(人物の物語や歴史的宇宙の外側の領域)という2つの境界タイプを、禁忌対応の多重選択質問を用いて探索する。
幻覚は、主にコンプライアンスの失敗によって引き起こされることを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:57:14 GMT)
A Backend-Agnostic MWIS Kernel for Stochastic Unit Commitment with Neutral-Atom Hardware Validation [10.7] 本稿では,単位コミットメントの離散的な決定層を移動に基づく最大重み付き独立集合問題にコンパイルする,バックエンドに依存しない計算インタフェースを提案する。
提案手法をグリーンスケジューリング設定で検証し,QuEra Aquila中性原子量子プロセッサ上に展開する。
これは、実際の運用上の決定をプログラム可能な中立原子ハードウェアに接続する、最初のエンドツーエンドの産業用スケジューリングワークフローである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:46:26 GMT)
Designing Proactive Thought Partners for Writing [10.6] 本稿では、文章作成中に、カスタマイズ可能な高レベルの認知支援を積極的に提供するAIエージェントについて、プロアクティブな思考パートナーの設計空間について検討する。
私たちはこのコンセプトをテクノロジプローブでインスタンス化し、1週間に16人の参加者でデプロイしました。
ユーザが書いているように、関連するパートナが適切なタイミングでイニシアティブを実施して提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:54:32 GMT)
When Tokenization is Secretly Output Supervision [10.5] 言語モデルのトークン化は、入力前処理決定としてデフォルトで扱われる。
自己回帰モデルでは、トークン化器の粒度は、1つの前方通過でモデルが解決しなければならないものを決定する。
これは学習問題の難しさとモデルの内部に現れる表現の両方に影響を与える。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:16:19 GMT)
In-Context Neurofeedback: Can LLMs Control Their Internal Representations through Privileged Access? [10.4] 最近の研究では、ニューロフィードバックを大言語モデル(LLM)に適用し、内部表現を制御できると主張している。
我々はLLMのニューロフィードバックパラダイムを再設計し、制御対象が特権アクセス要件を満たすようにした。
以上の結果から, LLMにおけるメタ認知の厳密な評価には, 特権アクセスを要求される評価方法が必要であることが示唆された。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:36:00 GMT)
VATO: A Vortex-Force-Aware Transformer Operator for Unsteady Separated Aerofoil Flows [10.4] 本稿ではVortex-Force-Aware Transformer Operator(VATO)を紹介し,Vortex Force Map(VFM)法を幾何認識ニューラル演算子に結合させる。
VATO-Sは速度,圧力,渦度の誤差をそれぞれ10.4%,1.0%,15.6%減少させ,VATO-Aは15.8%,7.5%,31.2%減少させた。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 00:17:13 GMT)
Mind the Rift: Cross-Scale Coupling Mismatch for AI-Generated Video Detection [10.3] クロススケールカップリングミスマッチは新しい法医学的信号である。
自然ビデオでは、マクロレベルの時間的ダイナミクスとマイクロレベルの残留パターンは、統合されたイメージング物理パイプラインによって本質的に結合される。
しかし、この共同分布を明示的に保持していないトレーニング目的を持つAIジェネレータは、この結合を体系的に違反する。
このようなミスマッチの検出は、両方のスケールで独立して情報を抽出する必要があるため、難しい。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:23:48 GMT)
CopyShield: A Cross-Level Benchmark of Copyright Defenses in LLMs [10.2] 異なる介入レベルで3つの代表的防御を比較したベンチマークであるCopyShieldを紹介した。
5冊のパブリックドメインの本を対照記憶として,LLaMA-3.1-8BとMistral-7B-v0.3の2つのモデルファミリー上でのCopyShieldの評価を行った。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:43:02 GMT)
Looped Transformers under the Jacobian Lens: Does the Global Workspace Survive Recurrence? [10.2] 仮想アンロールアダプタを用いて,ジャコビアンレンズを繰り返しアーキテクチャに拡張する。
各アーキテクチャの繰り返し部分でワークスペースが形成されるのが分かりますが、その繰り返しはアクセス方法を変えます。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 22:47:16 GMT)
Joint Training Is Not Enough: Conditioned Cross-Granularity Training for Multimodal Document Understanding [10.0] 相互強化効果(MRE)は、細かなスパンレベルと粗いドキュメントレベルのタスクが、1つのモデルが両方を扱うときに互いに助け合うかどうかを問う。
3つのコーパス、レシートの2つ、スキャンされたビジネスフォームの1つについて、マルチモーダル文書で検証する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:39:33 GMT)
Separating Syntax from Language: A Mechanistic Account of Translation in Multilingual LLMs [10.0] 翻訳が以前想定されていたよりもモジュール化されていることを示す。
単語順の言語間差異を分離する多言語データセットを構築する。
我々は、構文変換に選択的に敏感な個々の注意ヘッドを同定する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:58:38 GMT)
MROP: Mask-Region Optimized Purification Against Backdoor Attack in Deep JSCC [10.0] ディープジョイントソースとチャネルコーディング(JSCC)は、直接チャネルシンボルにマッピングして、エンドツーエンドのディープニューラルネットワーク(DNN)を介してソースを送信し、レシーバーでそれを再構築する。
受信機は、送信された画像が破損した場合、容易にセキュリティ攻撃を検出することができない。
我々は,入力に添付された小さなトリガーパッチがデコーダに攻撃目標画像の出力を強制する,深部JSCCに対する入力パッチバックドア攻撃に対する防御について検討した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 06:31:07 GMT)
Seeing the World and the Self from Egocentric Video [9.8] 既存の手法では、シーン再構成と動き推定を別々に扱う。
決定論的幾何再構成と幾何条件の運動生成を結合した統合フレームワークRESELFを提案する。
実験により、RESELFは個々のタスク用に設計された最先端の手法より優れていることが示された。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:10:13 GMT)
FTU-Seek: Foundation Model-Guided Hard-Negative Learning for Sparse Functional Tissue Unit Segmentation [9.8] 機能組織単位(FTU)は、組織学的に局所的な免疫、血管、上皮組織をコードする。
FTUは、しばしばスパースであり、異種であり、多くの形態学的に類似した背景組織に囲まれている。
FTU-Seekは、スパースFTUセグメンテーションのキーコンポーネントとして、負のパッチ選択を扱う。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:32:26 GMT)
Text Capability Loss in Vision-Language Adaptation: An Attention-Sink Diagnosis [9.6] 事前訓練されたLLMを視覚言語モデル(VLM)に微調整することで、バックボーンのテキスト能力を損なうことができる。
我々は、VLトレーニングなしでVL後の劣化を予測する1つのGPU上で、ベースLLM上で数秒で計算された1つのスカラーであるSink Strengthを紹介した。
プレトレーニング後のQK-RMSNorm注入はネイティブQK-RMSNormの保護を再現するのに失敗するのに対し,市販の重み付け設定では失われる能力の回復に失敗する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:24:37 GMT)
Some Emotions Run Deeper: Layer-wise Probing and Causal Intervention in Large Language Models [9.3] 感情がアクセス可能になった深さがモデルの特性なのか、あるいはテキストソースなのかを考察する。
レイヤワイズ探索とオフライン機能スケーリング、オンライン前方介入、転送分析、早期退行分類器を組み合わせる。
i) 最良な探索層は, (i) コーパス全体にわたって, 入力隣接層から半モデル深度まで体系的に変化し, この順序はラベル・バイ・ラスト・ビン分布の一致後に持続することがわかった。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:14:13 GMT)
HELIOS: From midnight to noon, continuous outdoor urban scene relighting [9.2] HELIOSは、トレーニングのためにペアイメージを必要とせずに、ラベルのない現実世界のデータセットに依存する、新しいイメージリライト方式である。
本手法では,アルベド系条件付けをサイクル一貫性拡散パイプラインに統合し,同一性崩壊を防止する。
我々は従来のテキストプロンプトをGPSからの太陽角に基づくきめ細かい制御機構に置き換え、滑らかで連続的な照明操作を可能にした。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:27:24 GMT)
Confess What You Know: Forget-Set Misalignment with Model Knowledge in LLM Unlearning [9.1] このギャップを忘れセットの誤認識と呼び,2つの症例を同定する。
アンラーニングでは、忘れられたセットは記憶された情報を省略し、リークは継続する。
Out-of-Knowledge Unlearningでは、アルゴリズムは学習したことのない知識を“忘れる”ように駆動され、パラメータを摂動させ、ユーティリティを劣化させる。
本稿では,モデルが記憶した知識を抽出し,形式化し,モデルに整合した左折集合を構成するデータブラインドフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:47:43 GMT)
Candidate Generation and Definition-Guided Verification for Sentence-Level Depression Symptom Recognition [8.8] 同様の症状が症状の関連性が異なるため,抑うつ症状の文レベル認識は困難である。
本研究は,症状候補生成と定義基底検証を分離する2段階の枠組みを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:08:03 GMT)
A Composable Evaluation System for Reproducible Omni-Modal Foundation Model Evaluation [8.8] OmniEvaluatorは推論エンジンとキュレートされた評価ライブラリを高いレベルで接続する。
すべての実行は、正確な再現のために完全な構成をキャプチャするアーティファクトとして記録される。
CPUで動かすのに十分小さい内蔵検証器は、エンジン間でスコアを安定させます。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:37:57 GMT)
CliffRank: A Dual-Branch Framework for Activity-Cliff Ranking Prediction [8.5] CliffRankは平均二乗誤差、閾値付きリストワイドロス、ペアワイド参照一貫性(PPC)の2つの並列予測器を訓練する。
ESM2-t12とCliffRankの3つの抗菌ペプチドデータセットでは,平均スピアマン相関が0.5393,平均Recall@50が21.4であった。
今後の研究は、より多くの標的と抗菌ペプチドシステムを評価し、適応的なPPCスケジュールを開発し、利用可能なタンパク質や膜コンテキストを組み込む必要がある。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:57:56 GMT)
The Multiple Timescales of Gradient Descent on the Edge of Stability: A Perturbative Derivation of the Central Flow [8.4] 我々は、中心流が勾配降下の限界である摂動的体制を導出する。
最も急な方向に沿った振動の速い時間スケール、自己安定化機構の中間の時間スケール、そして中心フローの$g$-の最小値に沿った力学の遅い時間スケールである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:32:48 GMT)
Context-Grounding Gains Are Mediated by Pre-existing Machinery: Auditing GRPO, SFT, and DPO [8.4] GRPO, SFT, DPOにまたがる9つのトレーニング後腕を比較した。
5つの試験されたGRPOの変種のうち、グラウンドゲインは小さい。
Conflict-SFTとDPOは、主に開始モデルと同じ因果的注意セットを使用する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:49:01 GMT)
A Compact Robotic Finger with 2-DoF MCP Joint Embedding DoF-Selective Passive Continuously Variable Transmission for Wide Force-Speed Operating Range [8.3] この手紙は、柔軟受動型連続変速機(CVT)を備えた小型2自由度ロボット指(DoF)を提示する。
ヒト中手指関節の機能的分化にインスパイアされ、提案機構はDoF特異的な伝達分化を実現する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:57:28 GMT)
XQDT: eXplainable and Quantitative Data-Text Alignment Metric with Feedback Signals [8.3] データ-テキストペア内の省略データ、余分データ、誤りデータ、正しいデータユニットを識別するために、言語モデルを微調整するエンドツーエンドで説明可能な評価指標を提案する。
我々のモデルは誤り予測においてLLM-as-Judge法を上回り、競合精度、リコール、F1スコアを達成する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:50:11 GMT)
Same Semantics, Different Outcome: On the Modality Robustness of Multimodal LLMs under Knowledge Conflict [8.1] MLLM(Multimodal large language model)は、異種形式の文脈的証拠としてますます多く提供される。
モデルがパラメトリックな知識と矛盾する場合、これらの曲面がいかに一貫して処理されるかは、いまだに不明である。
13のMLLMと2つのデータセットにまたがる知識衝突下でのモダリティの堅牢性について検討し、それらがロバストから遠く離れていることを発見した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:37:18 GMT)
Sierpiński--Knopp Wasserstein Distance for Persistence Diagrams and Applications to 2-Wasserstein Approximation [8.0] 本稿では、永続図間の高速な計量であるSierpiski-Knopp(SK)ワッサーシュタイン距離を紹介する。
符号化された点集合は、1次元の最適割り当てによって効率よく一致する。
227図からなる12の科学的収集実験は、(W) の最先端近似に対する (d_mathrmSK) の中央値の加速を示す(626時間)
d_mathrmに基づくヒルベルト(k)平均とスペクトルクラスタリング
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:57:04 GMT)
SpecMine: A Large-Scale Corpus of Spec-Driven Development Artifacts [7.9] SpecMineは、パブリックGitHubリポジトリでSpec-Driven Development (SDD)をキャプチャする。
これにより、AIエージェントの時代にソフトウェアがどのように特定されているか、コミュニティで初めて研究することができる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:50:48 GMT)
MemeCULT-1K: Benchmarking South Asian Cultural Context and Humor Understanding of Multimodal Models [7.9] 我々はベンガル語、英語、ヒンディー語で1000の南アジアミームのベンチマークであるMemeCULT-1Kを紹介する。
我々は、ミームオンリーとコンテキストアウェアの2つの設定で、13の人気のあるビジョン言語モデル(VLM)を評価した。
きめ細かい誤差解析により、クローズドソースモデルは、主にエンティティと参照の誤識別に失敗し、一方、オープンソースモデルは、より広い文化的知識ギャップによってボトルネックになっていることが明らかになった。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:43:03 GMT)
Random Forest-Informed Cellular Automaton for Large-Scale Wildfire Spread Modelling [7.9] ランダムフォレストモデルとセルオートマトン(CA)を組み合わせた3段階フレームワークを提案する。
2021年のカナダ火災シーズンで訓練されたRFモデルは、毎日のピクセルレベルの火災発生確率を推定する。
RFインフォームドCAは、RF確率層と5kmの格子上の近傍駆動の拡散を結合する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:06:53 GMT)
Calibrating Small Language Models for Claim Check-Worthiness Detection [7.9] NN-PPIは予測パワー推論のポイントワイド拡張であり、推論時にモデル予測を軽量なポストホック層として校正する。
NN-PPIはベースラインモデルのサイズと性能に応じて12%から33.80%の重み付けF1ゲインを達成する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:12:44 GMT)
FairLens: Benchmarking Fairness in Vision-Language Models for High-Stakes Decision-Making [7.8] 視覚言語モデル(VLM)を,雇用,法的,医療の3つの領域で評価する。
第一の失敗は不平等な治療ではなく、不当な推論であることがわかった。
公平な高感度VLM動作には,グループ間での同様の処理が必要であり,高感度特性を外観から推測することを拒否した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:06:50 GMT)
Obstacle-Aware Autonomous Coverage and Navigation for Outdoor Robots [7.8] 本稿では,包括的計画,ロバストなローカライゼーション,およびNav2ベースの実行を組み合わせた,屋外カバレッジのための統一されたROS 2アーキテクチャを提案する。
EKFに融合したデュアルアンテナRTK-GNSSは、ロボットの位置と方向の両方を、長いミッションで正確に保ちます。
Behavior-Treeミッションマネージャは、マルチゴール実行、階層化リカバリ、コスト意識の目標管理、返送充電のための自律ドッキングをコーディネートする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:15:45 GMT)
RATIO: A Benchmark for Retrieval Across Typed Ideation Operations in Scientific Literature [7.5] RATIOは3つの操作で関連性を定義する大規模なベンチマークである。
RATIOはCS文学にまたがる数百万のフルテキスト科学論文から構築されている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 11:22:32 GMT)
Facet-0: A Robotic Foundation Model for Contact-Rich Precise Manipulation [7.3] ロボット基礎モデルであるFacet-0を提案する。
ManuFacet-1Kは3つの実施形態と複数の製造細胞にまたがる1000時間力同期コーパスである。
このシステムは5ミリ以下のコンピュータ組立タスクで平均82%成功し、最強のベースラインでは15%となる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:58:07 GMT)
SG-AMP: Scene-Graph-Guided Active Perception and Semantics-Aware Motion Planning for Pepper Plants [7.2] 本稿では,SG-AMPと入力条件の不確実性,永続的パノプティカルマッピング,植物シーン図の推論を併用した,堅牢な深度補完手法を提案する。
ペッパーデータでは、知覚ネットワークはセマンティックmIoUで55.27%、PQで38.67%、深度RMSEで40.62ドルを達成している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:44:23 GMT)
Subliminal Learning as Trait-Direction Drift: A Mechanism and Targeted Control under SFT Distillation [7.0] システムプロンプトに偏った教師は、数値シーケンスのような意味的にクリーンなトレーニングデータを生成することができる。
サブリミナル学習のメカニズムとして,特徴方向のドリフトを提案し,検証する。
蒸留中, キャリブレーションされた特性方向に沿ってドリフトを拘束するターゲットディフェンスであるプローブ空間回廊正則化を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 11:32:53 GMT)
On-the-Fly3R: Towards Robust Online 3D Reconstruction with Feed-Forward 3R Models for Large-Scale UAV Scenarios [6.7] On-the-Fly3Rは、大規模なUAV画像のためのトレーニングフリーでプログレッシブなオンライン3D再構成フレームワークである。
本手法は,検索誘導動的サブセット構築による非順序入力からの再構成を可能にする。
提案手法は,3Rモデルから5000枚以上のUAV画像への拡張に成功した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:47:58 GMT)
From Confusion to Clarity: Confusion-Aware Retrieval and Knowledge Injection for Text Classification [6.6] 大規模言語モデル(LLM)は、テキストを多くの意味論的に類似したラベルで分類するのに苦労する。
モデルが区別に苦しむラベルペアを識別するフレームワークを提案する。
また、類似の候補を区別するターゲットルールも生成します。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:31:02 GMT)
Lightweight Interpretable RGB-Guided Hyperspectral Super-Resolution under Real Cross-resolution Misalignment [6.6] RGB誘導ハイパースペクトル超解像は、高解像度のRGBガイドから低解像度のハイパースペクトル画像へ空間的詳細を転送する。
モデルベースGram-Schmidtization fusionとクロスモーダルフローアライメントを組み合わせた軽量かつ解釈可能なRGB誘導型HSRフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:55:11 GMT)
Learning with Volterra Neural Networks: A System Theoretic Perspective [6.6] kVNNは、コンパクトな高次フィルタリングのための学習可能なカーネル化されたVolterra Neural演算子である。
提案された定式化は、ボルテラフィルターのオーダーワイド構造と学習可能な原子を組み合わせることで、異なる相互作用順序を表現できる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 22:58:05 GMT)
OASIS: Optimizing Attacker Sequences for Hard-Label Black-Box Text Attacks [6.5] ハードラベルのブラックボックステキストアタックにおける攻撃者のシーケンスを最適化する手法を提案する。
OASISは、攻撃成功率と摂動のバランスをとるために、候補シーケンスを二目的攻撃チェーンで1回検索する。
その結果,攻撃者の構成は単なる実装選択ではなく,実用的な最適化対象であることが示唆された。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:35:09 GMT)
Embedded Conditional Independence Tests for Large Language Model Generated Text with an Application to German Parliament Speeches [6.1] 条件独立テスト(CIT)は、2つのランダムオブジェクト間の条件依存をテストし、$X$と$Y$は3番目のランダムオブジェクト$Z$である。
このようなテストは、大言語モデル(LLM)の出力に関心があることを示し、そこでは、ソーステキスト$Z$から生成された$X$が、$Z$自身を超えて$Y$に関する情報を運ぶかどうかをテストする。
我々は、$X$と$Z$を埋め込んだ組み込みCIT(eCIT)を提案し、その結果の表現に既存のCITを適用し、$Y$にします。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:05:55 GMT)
A Study of Hidden-State Optimization Order in Predictive Coding Networks [5.7] ローカル学習は、エンドツーエンドのバックプロパゲーションに代わる手段を提供するが、その非構造化されたローカルな目的は、ディープネットワークにおける弱い特徴学習を生み出すことができる。
本稿では,モデルをチャンクに分割し,まずチャンク境界に隠れた状態をコーディネートし,各チャンク内の表現を洗練する境界ファースト推論スケジュールを提案する。
我々は、このスケジュールを、推論中に隠れたアクティビティや予測エラーを明示的に露呈するローカルラーニングフレームワークである予測符号化ネットワーク(PCN)でインスタンス化する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:07:04 GMT)
Ranked by the Matcher: A Reproducibility Audit of Knowledge Graph Extraction from Threat Reports [5.6] 8つのプロトコルで共有ドキュメントに出力された10のシステムを再描画すると、45対の注文のうち11が逆転する。
GRID の外部 378-item キャリブレーションセットでは、機械式マッカーは 71% 以上のマルチリビューアの偏見に一致しない。
バリデーションは、4つのホストバックボーンの精度を高め、3つのオフラインバックボーンの精度を下げます。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:45:44 GMT)
ViTAMINS: An Empirical Study of Training Self-Supervised Vision Transformers with Synthetic Hard Negatives [5.6] 本稿では,合成ハードネガティブを教師なし視覚変換器に組み込んで表現品質を向上させる手法であるViTAMINSを紹介する。
提案した否定は,画像の意味的内容に関する明示的な情報を含む,創発的特性をもたらす。
本研究は, コントラスト学習を, 優越的な生成・自己蒸留法に代わる, シンプルかつ強力な代替手段として再考する動機となっている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:39:25 GMT)
HitMem: Hierarchical Temporal 3D Memory with Multi-Modal Context-Aware Retrieval for Dynamic Environments [5.6] HitMemは階層的な時間的3Dメモリフレームワークで、マルチモーダルなコンテキスト認識検索機構を備えている。
HitMemはオブジェクトの移動精度を大幅に向上し、探索コストを低減し、動的環境におけるタスク実行性能を向上させる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:09:21 GMT)
REVISE: Validity-Guided Recovery for Online Revisions in Agent Workflows [5.5] textscReviseは構造化エージェントのきめ細かい回復に有効である。
無効な作業を止め、最初期の紛争を超えて有効に確立された進捗を保ち、影響を受けた地域のみを再計算する。
モデルコールをフルリスタートに対して40.6--56.0%、サフィックス再計算に対して31.3--43.6%削減する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:22:18 GMT)
Independent Reinforcement Learning in Discounted Markov Games [5.5] 各固定割引係数に対して、割引された一般マルコフゲームにおいて、逆多項式的精度の粗相関平衡に対する非時間アルゴリズムが存在することを示す。
提案アルゴリズムは,マルチエージェント設定に合わせたステップサイズスケジュールの増大を伴う,楽観的ミラー降下の多層版である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 00:07:45 GMT)
DSG: Dynamic 3D Scene Graph Construction for Embodied Agents in Changing Indoor Environments [5.4] DSGは動的3次元シーングラフ構築フレームワークであり、オブジェクトの変化を検出し、空間的関係推論を行う。
Dyn-ThOR, 3RScan, 実世界のシーンにおける大規模な実験により、DSGは、オブジェクトノードの構築と空間関係推論の両方において、既存の手法よりも一貫して優れていることが示された。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:03:10 GMT)
Exploring Nonlinear Body Oscillations for Natural Quadruped Gaits [5.3] 動物の身体形態は歩行パターンを形作っており、機械共鳴は能動制御の必要性を減らす。
四足歩行ロボットの多くは、非線形力学の複雑さのため、特に機械共鳴を利用するように設計されていない。
本稿では,設計過程においてロボットの非線形力学を予測可能であることを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:25:11 GMT)
AlphaRAD: Grounded Zero-Shot Classification in Chest Radiology via $α$-Corrected Binary Cross Entropy and Factorized Latent Supervision [5.3] 我々は,大規模言語モデルで解析した医療報告から,大規模に構造化された医療概念空間であるAlphaRADを紹介した。
また,VLPM表現を独立部分空間に分解する極めて単純で効果的なクロスモーダル機能融合モジュールであるFLaSを提案する。
AlphaRADは様々な胸部放射線学のタスクに強いゼロショットの一般化を示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:24:50 GMT)
From Truncation to Commitment: Persistent Context in Uniform Discrete Diffusion [5.2] 均一状態の離散拡散モデルは、すべての位置を変更可能にしながら、すべてのトークンを並列に更新する。
我々は、選択したargmaxトークンを格納し、その後のモデル入力に挿入する訓練不要なサンプルである、コミット露光サンプリング(CRS)を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:43:24 GMT)
Common-Center Geometry and Certified Radial Reconstruction for Energy-Form Full Conformal Regions [5.2] この注記は、経験的エネルギー形対のスコアによって生成される共形予測(FullCP)領域の幾何学に焦点を当てる。
12ドルと$mge2$の場合、明示的なデータチェック可能な微分境界は、ラジアル出口と正確な共形ラジアル関数のリプシッツ制御を与える。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:44:26 GMT)
InSight: A Benchmark for Agentic Claim Verification in Interactive Visualizations [5.2] 本稿では,対話型ビジュアライゼーションを用いたエージェントクレーム検証のベンチマークであるInSightを紹介する。
データセットは21,349件のクレームからなり,完全にインタラクティブなWebベースの環境を基盤としている。
従来の評価とは異なり、InSightは相互作用トレースを推論の固有のプロキシとして扱い、モデルがどのように視覚的証拠を求め合成するかの厳密な監査を可能にする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:15:30 GMT)
Matched Queries for Curvature and Density at Branching Junctions [5.1] 一階の量では、個々の枝がどのように曲げられるか、あるいはその密度が中心から離れてどのように変化するかは決定できない。
一致したスコアクエリを使って、この逆問題に5$と$$で対処する。
強い一階誤差では、一致した応答は、平均的なタンジェント減算に対する中央値パラメータの誤差を49.4倍に削減する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:38:59 GMT)
Measuring consistency via ensemble margin and local prediction variability: Auditing decision systems in the presence of predictive multiplicity [4.9] ラショウモン効果は、同じ精度のモデルが同じ入力に対して異なる予測を生成する機械学習現象である。
本稿では,アンサンブルマージンと各構成モデルに対する局所的予測変数の尺度を組み合わせた一貫性基準を提案する。
実験の結果,Rashomon集合からのアンサンブルモデルにより,誤検出のリスクを大幅に低減できることがわかった。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:22:01 GMT)
Solving In-Table Prediction Problems by Deep Neural Networks with Performance Evaluation Using Synthetic Data [4.7] 本研究では、ディープNNを用いて、与えられたテーブル内の個々の列間の関係を学習する。
NNが与えられたテーブル内の任意の選択された列の値を、残りの列に基づいて予測できるかどうかを検討する。
マスクアウトする列をランダムに選択し,学習対象として利用することにより,この問題に対処する自己教師型学習手法を適用する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:53:12 GMT)
Bilinear correlations in Fluctuating Gaussian States with anti-unitary symmetries [4.6] 記号問題のないシステムの一般クラスにおける双線形次数-パラメータ相関について検討する。
モンテカルロシミュレーション(英語版)の支援により、このような系は2種類の破れ対称性の相を示すと論じる。
フェミオン系FGSと反単位対称性を持つフェルミオン系FGSの不安定性のため、フェミオン系FGSを特定の射影エンタングルドペア状態(PEPS)アンサッツで表す可能性についても論じる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:00:49 GMT)
Probabilistic Model Checking of Autoregressive Neural Sequence Models [4.6] 自己回帰型ニューラルシークエンスモデルをデプロイする上で問題となる2つの問題に対して、テストセットの精度は静かである。
テスト対象のシステムの質量は、サンプリング時に到達可能な制約違反の代替品にどの程度の確率があるか。
確率論的モデル検査で両方答える。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:37:55 GMT)
Does This Moment Justify the Recommendation? Counterfactual Behavior-Grounded Evidence Retrieval for Personalized Video Recommendation [4.5] 本研究では,このような証拠が存在するかどうかからパーソナライズされた証拠が生じる場所を分離した反事実的行動接地証拠検索について検討する。
ビデオレベルのエビデンス推定からセグメントレベルのローカライゼーションを分離する,コンパクトなフレームワークCBGERを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:46:27 GMT)
What Does an Agentic Software Engineering Benchmark Measure? Profiling Task Demands and Agent Behaviour Beyond What Category Labels Reveal [4.3] 本稿では,レポジトリレベルのコーディングタスクの要求を3軸で評価するSpread-Novelty-Centrality (SNC)プロファイルを紹介する。
このプロファイルを5つの広く使用されているベンチマークと2つのモデルファミリーの14,922のトラジェクトリに適用し,その3つの知見を報告する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:04:15 GMT)
Let Confidence Change, Not the Prediction: Prediction-Preserving Repair for Post-hoc Calibration [4.3] ポストホック校正は報告された信頼性を補正するが、マルチクラス校正器は関連するトップ1予測を変更することもできる。
完全校正された確率ベクトルを修復することにより正確な予測を強制する最初のポストフィットアダプタである、トップ1決定保存(CORD)の校正器出力修復を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 11:03:30 GMT)
On Global Regulatability of Robot Manipulators by Classical PID [4.3] 本稿では,拡張PID(EPID)制御を用いた不確実なマルチインプット・マルチアウトプット(MIMO)非線形系のクラスについて検討する。
我々はチャネルワイズEPIDコントローラを開発し、各制御入力は対応する追従誤差の比例、積分、微分項から構成される。
この集合から選択したパラメータは閉ループ系の半言語的安定性を保証し、所望の集合点規則を実現する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:13:54 GMT)
Importance and methods to control, vary, and characterize mud strength for studying locomotion [4.0] 砂のように泥は固まったままにしたり、流体のように流れたりする。
固流体遷移が起こる泥の収量強さは、粗い粒と細い粘土の量に依存する。
乾燥した砂は, 反発力と摩擦力を持つ粗粒が支配するが, 粘着力の強い微粘土が支配する泥はほとんど知られていない。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:56:47 GMT)
Probing Factual Knowledge Transfer with Training Data Interventions [4.0] 複数言語モデルが継続事前学習中に言語間で事実知識を伝達するかどうかを検討する。
我々は,20関係にまたがる500の3分の1の資源であるSIFTを構築する。
最も厳格な除去条件の下では、英語で取得した事実の大多数はペルシア語への移動に失敗する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:51:12 GMT)
Parsing the Stream: A Live Trace Model for Long-Horizon Agents and Their Observers [4.0] ロングホライゾンエージェントのトレースは、実行を監視している人間のオブザーバとエージェント自体の両方のコンシューマをオーバーホールする。
我々は、ライブトレースモデル、追加のみのイベント台帳を型付けされた実行状態に段階的に折り畳み、両方のコンシューマに対して評価する。
LLMリーダをプロキシとして評価したオブザーバ側では、コンパイルされたビューは、約14倍、15倍少ない入力トークンを使用して、質問に回答する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:03:54 GMT)
Mudskippers use tail thrusting to help crutching to move on mud of various wetness [4.0] 水陸両用魚は、水面に濡れた流動性基質に遭遇する。
これらの基質が濡れたり乾燥したりすると、その降伏強度と凝集度が変化し、移動に挑戦する。
固-流体遷移が生じる範囲で, 制御された, 可変湿潤度を有する粘土泥の泥切り片について検討した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:57:28 GMT)
Three-slit interference with a which-path memory ancilla: A bright-dark state formulation [3.9] 本研究は,1パスメモリアンシラが3スリット干渉パターンに及ぼす影響について検討する。
2つの経路に対して、$C_BD$は集団と1対のコヒーレンスによって完全に固定されることを示す。
また、メモリの適切な測定により回復可能な経路コヒーレンス損失の一部を区別する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 11:57:07 GMT)
Feedback-Enhanced Quantum Metrology and Clock Precision under Thermodynamic Uncertainty [3.9] 我々は、単体ジャンプフィードバックの下でオープン量子系の完全なカウント統計を定式化する。
フィードバックによってパラメータ推定とクロック精度が向上することを示す。
電荷モニターされた二重量子ドットは、このフレームワークを描いている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:04:09 GMT)
A Certificate-Producing Cascade for Equational Implication: The SAIR EQT2 Stage 2 Solver [3.8] SAIR Mathematics Distillation Challenge on Equational Theories では、あるマグマが別のマグマの同一性を意味するかどうかを解き明かす。
我々は,最も安価な第1カスケードとして構成された単一ファイル解決器を提案する。
その偽分岐は、構造化代数族上の係数テスト、有界有限モデル探索、明示的な中心群群証人、およびいくつかの無限キャリア証人を組み合わせたものである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:34:00 GMT)
Position: Privacy Is a Claim, Not a Property of Synthetic Data [3.6] 合成データは、脅威モデル、推論リスク、偽造可能なプライバシクレームを明確に記述することなく、プライバシーに敏感な設定で頻繁に使用されることを示す。
我々は、プライバシーを明示的でエビデンスに基づく科学的主張として扱うことを主張し、MLの会場は、プライバシー関連の主張を明確にスコープ化し、検証可能で、競争しやすいものにすることを要求する規範を採用することを推奨する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:06:02 GMT)
Privacy Amplification Without Independence: How Far Negative Dependence Carries the Guarantees of Poisson Subsampling [3.6] 我々は、$k=1$のランダムアロケーションに対して、レニ・ディファレンス基準に対する線形法則を証明した。
Poissonベースの計算が構造化された参加に相応しいままで、どこで失敗し、デプロイに何の代償がかかるか、というように、プライバシ会計の代用マップを提供します。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 23:20:11 GMT)
Depth-1 expanders on the unitary group and applications [3.2] 量子展開器を$n$ qubits上に構築し,各ユニタリをパウリまたはCNOTゲートの深さ1ドルと1Dの回路で実装する。
これは、基底状態が絡み合い-ギャップ関係に従うフラストレーションのない1Dハミルトニアン族を構成するために用いられる。
我々は量子展開器をユニタリ群上の定数度および定数ギャップ拡大器に拡張し、各ユニタリは1ドルT$ゲート、1ドルTdagger$ゲート、または1ドルTdagger$ゲートである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:59:56 GMT)
Runtime-Independent Persistent Agents: Preserving Identity, Memory, and Code Across Models, Harnesses, and Servers [3.2] 永続的なエージェントに対して実行時非依存のアーキテクチャを提案する。
6つの連続不変量とquiesce--checkpoint--validate--bind--rehydrate-resumeプロトコルを定義する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:32:22 GMT)
Continuous Autonomous Refactoring: A Research Roadmap for AI-Driven Code Quality Maintenance [3.1] LLMベースのパイプラインは、時々手作業でのみ呼び出されるツールではなく、ソフトウェアメンテナンスの継続的コンポーネントである、と私たちは考えています。
このビジョンの下で、AIエージェントはソフトウェア品質の明示的で進化している概念に対して継続的に監視し、評価し、改善する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:35:29 GMT)
Reflect-SQL: A Self-Reflection Based Framework for Text-to-SQL [3.1] 自然言語によるデータアクセスの民主化は、現代企業にとって重要な目標である。
テキスト・トゥ・エフェクトの実践的採用は、現実世界の複雑さによって著しく妨げられている。
我々は,多段階自己回帰アプローチに基づくテキスト tosql の新たなフレームワークである Reflect- を紹介する。
我々のフレームワークは72.03%の精度で実行し、最先端のベースラインを大幅に上回っている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:46:27 GMT)
Completing or Refusing Low-Dimensional Records of Structured Quantum Circuits: Measurement Loss, Compression Loss, and Hardware Drift [3.0] 記録は、回路パラメータに対して異なる反応を示す確率をマージすると、制御依存の情報を失う。
パラメトリックなハードウェアノイズモデルや低次元統計ファミリを使わずにこの損失を評価する。
IBMは、固定粒子数およびGHZ族におけるキングストンとマラケシュのテスト決定に関する実験を行った。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:30:37 GMT)
VocalAffectBench: Evaluating Vocal Emotion Recognition in AI Audio Models [3.0] 我々は、AIオーディオモデルが生音声から表現された音声感情を識別できるかどうかを評価するテスト専用ベンチマークであるVocalAffectBenchを紹介する。
このベンチマークには、51人の話者による273本の英語のWAVクリップが含まれており、7つのラベルで合計1.95時間である。
すべてのベースラインは、書き起こしやコンテキストメタデータなしで、オーディオのみから評価される。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:00:14 GMT)
Parametric amplification of continuous-variable entangled state for loss-tolerant quantum distributed sensing [3.0] 圧縮状態からの光パラメトリック増幅多重モード絡み合わせを用いた量子分散センシングを提案する。
大利得光パラメトリック増幅(OPA)を導入した場合、感度は損失や検出非効率に対して堅牢である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:49:09 GMT)
CordisBench: Can Language Models Reason About Component Lifecycles in Dynamic Agent Harnesses? [2.9] 1200のライフサイクル推論のベンチマークであるCordisBenchを紹介します。
コントロールされたフォーマルな設定と、コンポーネントの依存関係とクリーンアップを管理するランタイムであるCordisに対して実行されるプログラムを組み合わせる。
我々は,2, 4, 8, 16, 24, 32の関連相互作用を用いた3つの効率指向モデルの評価を行った。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:59:13 GMT)
DNC-IMM: Early Lane-Change Intention Recognition via Neural Calibration Based on Driving Context Information [2.9] 車線変更意図の早期認識は、自律運転システムにおける前向きな意思決定に不可欠である。
本稿では、駆動環境への適応性を向上するDNC-IMM(Dual Neural-Calibrated Interacting Multiple Model)を提案する。
高Dデータセットの実験により,提案手法は車線交差前の車線変更意図を確実に認識することを示した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 11:59:00 GMT)
SoK: Motion Data Privacy in Extended Reality [2.9] 拡張現実感(XR)は没入的でインタラクティブな3D体験を提供する。
これらの体験を可能にするためには、デバイスはユーザーの動きを追跡する必要がある。
モーショントラッキングは、人の動作パターンを記録して以来、プライバシー上の懸念を高めている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:40:49 GMT)
Robust Bayesian Inference for Unnormalized Models with Mixed-Domain Data [2.8] SME-BETELは、スコアマッチング方程式と指数関数的に傾いた経験的可能性を組み合わせた半パラメトリックフレームワークである。
本研究では,SME-BETELの信頼性セットが,スコアマッチング推定器のサンプリング変動に正常に調整されていることを示す。
この構成により、混合領域二重抽出可能なモデルに対する頑健なベイズ推論が可能となる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:51:42 GMT)
The resource cost of magic in a code block [2.8] コードブロックに1つの論理キュービットと、前もって計測、フィード、受け入れを行う適応プロトコルを設定しました。
受け入れられた魔法は、少なくとも自由集合からのセルの合計距離の1倍である。
抑制は閾値によって設定され、ブロックの位相によって設定されない。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:13:05 GMT)
Uniform Hiding of Haar Block Transpose Gram Matrices [2.8] 対応する複素ガウス変換グラム法則と比較して有限の総変分を証明した。
誤差境界は明示的であり、選択された出力モードの数では2次であり、圧縮されたアクティブ入力の数では均一である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:55:29 GMT)
Pre-carved Niches: The Formation Dynamics of Modular Task Partitions in Early LLM Training [2.4] 大きな言語モデルは、人間の脳のよく研究された機能的ネットワークを反映するモジュラー内部組織を示す。
我々は、Pythia-410Mモデルをスクラッチ(2つのトラジェクトリ、bf16、fp32)からトレーニングし、各ステップで属性パッチを実行する。
基板からの逸脱は、学習されるドメインにのみ現れ、モジュラリティが学習を追跡するという仮説と一致する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:47:09 GMT)
Zero-Energy Problems for Supersymmetric Hamiltonians on a Chain Are $\mathrm{QMA}_1$-Complete [2.4] 相互作用を1次元鎖上に配置した超対称性量子系の正確なゼロモードについて検討する。
この構成は、還元されたNOインスタンスのすべての基底エネルギーに明示的な逆多項式の下界を与え、それをゼロから分離する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:01:16 GMT)
The Fermionic Cohomology Problem on the Full Fock Space Is $\mathrm{QMA}_1$-Complete [2.4] 我々は、セクターが特定されず、コホモロジーがフルフォック空間のどこでも起こりうる世界的問題を研究する。
この定式化は、空間全体の基底状態の問題と直接一致する: 指定された次数 NO のインスタンスは、他のセクターでゼロエネルギー状態を持つかもしれない。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:15:06 GMT)
Local Gaussian bounds on the non-destructive discrimination of two-mode squeezed states [2.4] 局所的なガウス測度を用いて2モード圧縮真空状態の非破壊的判別を解析した。
我々の研究は、絡み合った状態の差別における情報ゲインと乱れの間のトレードオフを自然に拡張する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:09:39 GMT)
Separating perception from reasoning in vision-language models: a model-free render ceiling for crystal structures [2.4] マルチモーダル評価は、視覚言語モデルが画像を読み間違えたか、それを誤読したかは定かではない。
我々は、既知のオブジェクトをレンダリングすることによって構築されたベンチマークのためのモデルなし参照であるレンダリング天井を紹介する。
我々は、天井が2,160個の結晶構造上に空になっていることを証明し、射影偶然の計算可能なセットを通してのみ失敗することを証明した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:42:37 GMT)
TopoCompress: Long Context Compression via Graph-Wired Semantic Trajectories [2.4] TopoCompressは,コヒーレントなセマンティックスパンを選択することで,長いコンテキストを圧縮するフレームワークである。
TopoCompressはまず、セマンティックアクセラレーションとともに、密度と語彙のクエリ関連を使って各スパンをスコアする。
次に、セマンティックな類似性とシーケンシャルな隣接性に基づいてスパンを結合するハイブリッドグラフを構築し、グラフ上のクエリ誘導関連スコアを伝搬する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:42:01 GMT)
VoiceLongMemEval: Do Assistants Remember How You Sounded? [2.4] 現在のベンチマークでは、この対話履歴を、長い地平線上の情報検索、時間的推論、知識更新として評価している。
我々はVoiceLongMemEvalベンチマークを示し、すべての回答は会話のターンに付随するパラ言語的メタデータに依存する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:06:10 GMT)
Convergence Theory of Knowledge Distillation in Asynchronous P2P Gossip Learning Network [2.4] 分散化されたサーバレス学習は、さまざまなアーキテクチャを実行するデバイスをますます接続します。
知識蒸留は重量よりも柔らかい予測を交換し、この障害を横取りする。
完全分散非同期ピアツーピア(P2P)KDに対する収束理論を提供する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 23:52:01 GMT)
Validating FKG.in: Soundness Assessment in LLM-Augmented Indian Food Knowledge [2.3] 大規模言語モデル(LLM)により抽出・拡張された構造化レシピデータを検証するための半自動音質評価ワークフローを提案する。
インドのレシピで評価されるが,提案手法は多言語・多文化料理分野に適用可能である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:34:21 GMT)
Candidate-Expanding Routing with Permutation-Stabilized Experts for Mixed-Format Medical VQA [2.3] VQA(Mixed-format Medical visual question answering)は、安定したオプション選択と機械可読な自由テキスト出力を必要とする。
両課題を,応答テキストメモリ,置換安定化専門家,スパース候補拡張ルータを用いて解決する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:18:19 GMT)
Soft-Argmax for the Projective Plane via the Veronese Embedding [2.3] emphVeronese soft-argmax in a transform Hough-based network across all resolvable lines。
我々は,全可解線にまたがる変換Houghベースのネットワークにおいて,emphVeroneseのソフトargmaxを検証する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 00:40:06 GMT)
Learning Sparse Decision Trees via Transformer Variational Auto-Encoders [2.3] 本稿では,複雑な目的に対して決定木を学習するためのTREVISを提案する。
決定木を潜在表現にマッピングすることで、TREVISは離散探索空間を連続的に置き換える。
その結果、TREVISは、既存の近似アルゴリズムの予測性能と一致する決定木を発見した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:40:33 GMT)
The zbMATH Open Knowledge Graph: Tracing Centuries of Mathematical Research [2.3] zbMATH Open KGは250年以上の数学研究をカバーした大規模RDF知識グラフである。
このグラフは、既存のセマンティックウェブ語彙で表される3億3800万のエンティティと1億6800万のRDFトリプルで構成されている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:27:06 GMT)
Few-Shot Out of Domain Intent Detection with Covariance Corrected Mahalanobis Distance [2.2] マハラノビス距離はOOD意図の同定に有効であり、競合するアプローチよりも優れていることを示す。
領域外インテントを検出するための共分散補正マハラノビス距離を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:19:44 GMT)
Edge-Girth as a Structural Edge Feature for Graph Neural Networks [2.2] メッセージパッシングに基づくグラフニューラルネットワーク(GNN)は1次元Weisfeiler-Leman色補正テスト(1-WL)ほど強力ではないことが証明された。
一般的な治療は、前もって計算された構造記述子でノードやエッジの機能を増強し、多くの場合、三角形や長いサイクルのような固定された小さな部分グラフを数えている。
我々は、この選択を避ける記述子について研究する。エッジのエッジ幅は、それを通る最も短いサイクルの長さであり、その乗法性はそのような最も短いサイクルの数である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:50:42 GMT)
Peg-in-Bench: A Modular Benchmark for High-Precision Robotic Insertion [2.1] 本稿では,高精度挿入におけるタスクの一般化を評価するために,再構成可能なペグ・イン・ホールベンチマークを提案する。
ベンチマークは、複数のペグ、許容レベル、ジオメトリのベース構造を含む、完全な3Dプリント可能なモジュラーコンポーネントで構成されている。
また,標準化されたタスク構成と機械可読なタスク記述を生成するシナリオ生成ツールも提供する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:37:31 GMT)
Patterning in Practice: Debiasing Reward Models with Susceptibilities [2.1] Instruct reward model training on Skywork-Reward-Preference v.0.2。
これは、小さなモデルや合成タスクを超えて、特異学習理論に基づくプログラムであるパターニングの最初の応用である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:20:43 GMT)
Agentic programs: an emerging form of scientific software in computational materials science [2.1] 近年, LLM をベースとしたエージェント・ハーネスは, 新たな科学ソフトウェア, エージェント・プログラムの実現を可能にすると論じている。
この概念を、実験によって測定された歪んだ結晶構造から原子モデルを構築するためのエージェントプログラムであるDeMARSで説明する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 06:45:03 GMT)
Accurate in space, unreliable in time: how LLMs represent national cultural change [2.1] 文化心理学の研究は、文化的価値が時間とともに異なる速度と方向で変化することを示している。
文化を意識した"モデルでは、文化が現在どこにあるのかだけでなく、時間とともにどのように変化したのかを捉えなければなりません。
本研究では,20年以上にわたる世界価値調査データを用いて,この文化的意識の欠落について検討する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 22:03:06 GMT)
PersianAnonymizer: Evaluating LLM-Labeled Training for Efficient NER-based Anonymization in Persian [2.1] LLMラベルによる監視からコンパクトなNERモデルをトレーニングし、デプロイメントに最適なラベルを選択できる。
我々は、DeepSeek-V3-0324、GPT-OSS-120B、Qwen3-235B-A22B-Instruct-2507の3つの命令調整LDMを比較し、共有プロトコルでスパンアノテーションを生成する。
MatinaRobertaベースのトークン分類器は、クラス毎にトレーニングされ、トークンレベルのPrecision/Recall/F1(すべてとクラス毎に)で評価される。
我々は、非Oとして予測される金非Oトークンの割合であるカバレッジ・リコール(LCR)を報告する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:18:11 GMT)
Does Playing it Safe Count as Faithfulness? Reassessing LVLM Hallucination Mitigation Methods [2.0] 大型視覚モデル (LVLM) に対する幻覚緩和法は幻覚ベンチマークにおいて強い利得を報告している。
より低い幻覚スコアがマルチモーダルグラウンドの改善を反映しているか、より保守的な生成を反映しているかは、まだ不明である。
3つのLVLMと4つのベンチマークにまたがる6つの緩和手法の評価を行った。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 21:34:31 GMT)
Investigating Linear Probe Robustness to Linguistic Register, Medical Specialty, and Corpus Shifts in Medical QA [2.0] 幾何学的には、真と偽の文は隠れ状態空間の安定な方向に沿って分離される。
私たちは、真理の方向性が書体に強くなっていることに気付きました。
レジスタ結果は第2のジェネレータで複製され、人書きの患者質問に受け継がれる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:01:47 GMT)
The Ceiling Is in the Channel: Auditing Learner Gaps and Measurement Frontiers in Clinical Prediction [2.0] 最適平衡精度は、全変分分離によって特徴づけられる。
PRISMAで誘導された104の臨床的タスクの合成は、同じチャネルレベルの規則性が18以上の疾患コホートに再帰していることを示している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 22:15:49 GMT)
Self-Reports Are Not Verification: Environment-Grounded Auditing of LLM Operators in Evolutionary Search [1.4] 各中間提案が正確な結果を受け取る環境監査を導入する。
言語モデルは進化的コンテキスト検索を演算し、フィードバック関数は人間のアノテーションなしで正確なランクを推測する全ての有効な推測を割り当てる。
信頼度は校正され、継承された合理的性は後続の提案に影響を及ぼし、フィットネスベースの選択はレポートの品質を改善する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:28:37 GMT)
Meta-ethics and AI: exploring the novel meta-ethical questions in the era of AI [1.4] 私が「AIの自己倫理」と呼ぶものに関して、新たなメタ倫理的疑問が生まれます。
論文は、そのようなAIシステムが生まれると現れるであろう疑問を特定するための条件付き方法論のフレームワークを提供する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:56:09 GMT)
CaRL-EM: Cost-Aware Reinforcement Learning for Entity Matching with LLMs [1.4] CaRL-EMは、タスクの複雑さに基づいて、安価で高価な演算子の使用を動的に計画することを学ぶ。
強力なLCMベースのベースラインよりも優れた品質とコストのトレードオフを実現している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:05:47 GMT)
Interpretable Symptom Vectors for Depression in a Large Language Model [1.4] 機械的解釈可能性技術を用いてGemma-3-27B-PTの残留ストリームを解析した。
評価された臨床機器から抽出した症状記述間でのアクティベーションを記録した結果,症状群が最も幾何学的に分離していることが判明した。
セマンティック・プロジェクションを用いて、これらの楽器から構築されたシンプレクティックベクトルに、保持された自然主義的なテキストを投影した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:07:03 GMT)
A Version Space Approach for Digital Circuit Analysis [1.4] 本稿では、バージョン空間ビューを一つの手法として開発し、2つの回路解析問題に適用する。
1つ目は確率的組合せ同値チェックで、候補はブール関数であり、観測は修正ハールスペクトル係数である。
第2のアプリケーションは、論理ロックされたネットリストのキーカウントであり、候補がキー、観察がオラクルの応答である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:49:34 GMT)
Imaginarity witnessing enhancement via spectral norms of witnesses [1.4] 我々は虚偽の目撃を、虚偽の操作者の以前の知識によって改善する。
我々は、すべての虚偽ウィットネス演算子を、この境界に基づいて4つの異なる族に分類する。
これら4つの証人クラスに対して、それらの完全性と有限完全性に関する包括的解析を行う。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:05:55 GMT)
Retrieved but not ranked: surface-form bias in structural retrieval, from mathematics to agent trajectories [1.3] 表面形状と意味を意図的に分離した埋め込み検索の評価を行った。
数学では、失敗は完全である: 最も重い偽りの階層における厳密なhit@1は、両方のプロダクション埋め込みに対して0.0%である。
表面の変化が付随する軌道では、同じモデルが超幾何学的確率で着陸する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:19:57 GMT)
Private Computation Space: Experience with Trusted Multi-Cluster Federated Learning for Agriculture [1.3] 我々は、ファーマーデータを安全にプロビジョニングおよび処理するためのオープンソースの機械学習システムであるPrivate Computation Space (PCS)を紹介した。
農村部における信頼性を確保するため,マルチクラスタオーケストレーションによる農業環境に適したシステムを設計する。
このシステムは、ニューヨークで6ヶ月間、生きた植物センサーで窒素をモニタリングし、カリフォルニアの気象観測所から10ヶ月間、蒸発を予測している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:12:09 GMT)
Consistency as Regularization for Unsupervised Shadow Removal [1.2] シャドウイメージから直接シャドウ除去を学習する、教師なしのフレームワークであるシャドウCLRを提案する。
私たちのキーとなる観察は、背景のシーン内容がほぼ一貫したままである間、影は観察によって異なることである。
複数のベンチマークの実験では、ShadowCLRは最先端の教師なしメソッドよりも競争力があり、しばしば優れたパフォーマンスを示している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:26:25 GMT)
Towards Natural Gas Contract Selection via Quantum-Guided Independent Set Reduction [1.2] 本稿では,ノイズの多い量子ハードウェアの限界内で大規模MISインスタンスを解くための量子古典的フレームワークについて検討する。
最大900のコントラクトを含む6つの合成対契約適合性グラフ上で,アルゴリズムの評価を行った。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:14:34 GMT)
Staged Linguistic Seeding: Grounded Query Expansion for Verified-Unit QA in AI Contact Centers [1.2] 検証済みQAユニットのクローズドなセットからのみ回答するシステムをデプロイする。
1つの手法は両方のドメインで再利用されるため、推論はクエリ時間生成なしで1つの検索パスにとどまる。
陰性な結果を含む応用研究として報告する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:42:39 GMT)
Diffusion as a Training Curriculum for Timestep-Free Iterative Reasoning [1.2] 任意の深さまで走れる隠れ状態拡散デノイザを導入する。
Sudoku-Extremeでは99.90%、Maze-Uniqueでは98.93%の精度で解決している。
我々は,拡散が常に解き放つ主な要因は,推論におけるサンプリング手順ではなく,認知的学習カリキュラムであることに気付く。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:55:01 GMT)
Automated Event Log Generation from Unstructured Text Using Finetuned LLMs [1.2] 本稿では,Large Language Models (LLMs) を自動データトランスレータとしての有用性について検討する。
新たに作成されたテキスト・ツー・ログのデータセットにLCMを微調整し、結果のモデルが高忠実度イベントログを抽出できることを実証する。
我々の手法は、未使用のデータを採掘生態系の処理に利用するための有望なパイプラインを提供する、と結論付けている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:39:37 GMT)
A Network Science Perspective on Evaluating Deep Graph Generative Models [1.2] ディープグラフ生成モデルは現実世界のネットワークから直接複雑な構造分布を学習し、より現実的な合成ネットワークを生成する。
実際のソーシャルコンタクトネットワークはプライバシー上のリスクのために共有できないため、人工ネットワークは疫病対策の開発と評価の代替手段として機能する。
2つのディープグラフ生成モデルにより,実世界のネットワークの構造特性によく似た合成ネットワークが生成され,効果的な免疫戦略の特定が可能であることが確認された。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:06:13 GMT)
Low-Quality Face Recognition using Center Aligned Representations and Local Margin Constraints [1.1] 低品質顔認証(LQFR)は、低品質(LQ)入力画像と劣化したクエリ(プローブ)画像のマッチングが困難であるため、依然として困難である。
1)モデルの識別環境から直接サンプルごとの難易度を推定するローカル確率マージン(LPM)、(2)選択したトランスフォーマー層に自己保持機構を組み込んだ新しい低ランクアダプタモジュールであるNested Attention Module(NAM)、(3)既製の画像品質推定器がアダプタコントリビューションを変調する品質ゲーティングプロトコル(QGP)の3つの主要なコンポーネントを組み合わせた統合フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:04:12 GMT)
SILK: Closing the Time-of-Check-to-Time-of-Use Gap in RoT-Protected AI Systems [1.1] SILK(Streaming Inline Lightweight Keying)は、最終的な事前計算境界における重みストリームを検証する、その場での整合性メカニズムである。
軽量ストリーミングチェッカーは、認証タグを分離せずにこれらのチェックを再計算し、コミットゲーティングを使用して、未検証の重み付けが計算エンジンに到達するのを防ぐ。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:43:49 GMT)
Automated Tree Knowledge Graph Construction using Ontology Expansion and Retrieval from Vietnamese History Textbooks [1.1] 階層的知識グラフ(KG)に基づく検索拡張生成(RAG)は,構造化知識を持つ大規模言語モデルを支援するための強力なアプローチとして登場した。
我々は,KG構築および検索戦略評価のためのエンドツーエンドパイプラインを提案する。
本稿では,ベトナムの高校歴史教科書(約400ページ)から木知識グラフを構築し,750のノードと4,341のセマンティックエッジを生成する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:52:50 GMT)
SignRR: Retrieve and Refine Real Motion for Sign Language Production [1.0] 本稿では,実際の検索動作から始まり,それをグローバルなコヒーレントな署名シーケンスへと洗練するパラダイムであるrequire-and-refineを提案する。
我々のフレームワークであるSignRRは、実符号セグメントの辞書からの動作を初期化し、部分認識された残差VQ-VAEで全シーケンスを洗練する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:13:52 GMT)
Cross-Model Distillation of a Human-Pose Foundation Model from Unannotated Infant Video for Markerless 3D Pose Estimation [1.0] サピエンス2ポーズモデルからSAM3Dボディモデルへのクロスモデル蒸留を行う。
ファインチューニングは、Sapiens参照と同じビュー2Dキーポイント合意を改善する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:17:00 GMT)
PyDoseRT Proton: A GPU Pencil-Beam Engine with a Convolutional Residual-Correction Network for Fast Proton Dose Calculation [0.9] このカテゴリには物理学に基づく分析用鉛筆ビーム(PB)線量エンジンと3次元畳み込み残差補正ネットワーク(RepVGG-U-Net)が含まれる。
我々は、PyTorchで実装されたGPUアクセラレーションエンジンであるPyDoseRT Protonを用いて、DoseRAD2026陽子線量予測タスクに対処する。
二重ガウスPB核をGATE/Geant4集積水深線量に2段階調整した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:11:57 GMT)
A Study of Conditional Diffusion Models for Open-Loop Control under Dry Friction and Stiction [0.9] アクション拡散(Action Diffusion)は、ドライ摩擦とスティクションを備えた点質量系の開ループ分布である。
条件1D U-Netは、初期状態および目標状態に条件付けられた有界制御シーケンスを生成する。
その結果,特に低サンプル状態において,動作拡散は終端誤差と停止ステップを減少させることがわかった。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:23:56 GMT)
Training-Free Inpainting Across Domains with a Frozen Text-to-Image Diffusion Model [0.9] そこで本研究では,フリーズドジェネリックテキスト・ツー・イメージ拡散モデルを用いて,3つの評価された自然画像領域に対して条件付きインペインティングを行うことができることを示す。
Step-PIは、境界間遅延フィードバック、永続的なPI状態、および4フィールドリリーススケジュールを備えた既知の領域プロジェクションを強化する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:57:53 GMT)
A Closed-Loop Evaluation of Capability Loss and Recovery in Compressed Driving Policies [0.9] プルーニング、知識蒸留、量子化は、学習した駆動政策のサイズと推論コストを減らすための標準的な方法である。
圧縮パイプラインを通した運転ポリシーに従う段階的な閉ループ評価手法を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:50:17 GMT)
Basin Geometry and Reliable Recall of Dynamical Memories in Reservoir Computing [0.9] 貯水池計算に基づく連想記憶では、予測不可能な地域が支配する盆地にもかかわらず、時間的手がかりが動的記憶を確実に回復する。
記憶盆地にはタコのような構造があり、アトラクションの近くにある「頑丈な頭部」と、細く絡み合った「触手」のスパンニング状態空間がある。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 22:32:34 GMT)
From Silicon to Boot Code: Extending Automated Program Repair to Firmware-Layer Security Workarounds [0.8] 現在の技術は、チップが生産される前にRTLまたはHLS設計のバグをローカライズし、修正する。
本稿では,このファームウェア層へのRTL修復のために開発された辞書誘導・オーバーフロー合成バリデート手法の適用可能性について検討する。
4つとも100%のリコールを達成しており、精度はCファミリーの2.1-15.5%から、アセンブリとHOBファミリーの100%まで変化している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:39:30 GMT)
A System for Fast, Resilient, and Adaptable Loco-Manipulation Behaviors on Humanoid Robots [0.8] 有用なロボットは、移動、全身の動き、知覚、接触、操作者の監督を調整する必要がある。
本稿では,これらの課題に対処するロボットローカルな実行可能動作オーサリングとランタイムシステムを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:47:00 GMT)
Agent Memory Is a Surface for Endogenous Authorization Laundering [0.8] 長期にわたるLLMエージェントは、相互作用間の状態を運ぶために永続メモリに依存している。
記憶が進化する認可状態を示すと、エージェント自身の記録は、基礎となる歴史が許されていない権限を与えることができる。
我々は、この障害を内在的な認可洗浄と呼び、急激な許可がメモリに書き込まれ、無許可の行動につながる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:12:08 GMT)
Johnny Still Receives Spam SMS: Assessing the Robustness of SMS Spam Detection [0.8] エンドユーザーが実際に依存するSMSアンチスパムシステムの堅牢性を評価する。
実験の結果,既存のスパム検知器が相手に操作されたメッセージを識別する能力に,大きなギャップがあることが判明した。
これらの弱点に対処するため,アーキテクチャやトークン化の多種多様なスパム分類器と敵対的訓練を組み合わせたマルチモデルアンサンブルを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:47:36 GMT)
SwapRec: Warming Up Cold Items Through Training-Time Swaps [0.7] コールドアイテムは、IDベースのレコメンデーションシステムのリアルタイムパーソナライズに悪影響を及ぼす。
これは、そのようなインタラクションを使用することで、ユーザの好みの見積が低下するためです。
推論時にこの欠点に対処するためにしばしば適用されるものは、"スワップ"(swap)と呼ばれるコールドスタートアイテムを、最もよく似た"ウォーム"隣人によって置き換えることである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:41:58 GMT)
Benchmarking Spatial, Spectral, and Self-Supervised Cues for Face Forgery Detection under Realistic Degradation [0.7] 本稿では,MFFI(Multi-dimensional Face Forgery Image)データセットを用いた顔偽造検出のための標準化されたベンチマークを提案する。
我々は、畳み込みネットワーク、トランスフォーマーベースモデル、凍結自己管理型DINOv3バックボーンを含む6つのモデルファミリを比較した。
RGB の Xception は 0.884 に達すると ROC-AUC となるが、ハードパーティションでは大幅に劣化する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:41:55 GMT)
Bonded Recourse for Smart-Contract Settlement of Compensable Agent Side Effects [0.7] 承認と局所補償は、事前行動の許可と実行中のロールバックをカバーしているが、許可された行動が失敗した後に残る残余の損害は解決しない。
我々はRecourseを設計する。Recourseは、補償可能なエージェントサイドエフェクトのためのスマートコントラクトのプロトコルで、それぞれのアクションをスコープ、リカバリ、エビデンス、支払い、担保にバインドする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 23:05:43 GMT)
On Synthesis of Metric Interval Temporal Logics [0.6] 本稿では,表現型時間論理の適応型学習に最初に取り組む枠組みを提案する。
我々のアプローチは、タイムドラーニングの問題を、拡張性のある未使用のものに正式に還元します。
いくつかのベンチマークで実装を評価し,提案手法の有効性を実証した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:30:46 GMT)
Autonomous robotic bridging using distributed swarm control without inter-agent communication [0.5] SCARAB-Swarm-Capable Self Robotic Aquatic Bridgingについて述べる。
エージェントとドッキングターゲットの分散Swarmコントロールとマルチモデルセンシングを使用して、エージェントは自分自身をローカライズし、フォーメーションに参加して、望ましいターゲット位置へ進むことができる。
我々の技術により、陸軍は予測不可能で分散した渡河を行い、乗組員の生存可能性を高め、現在の改良リボン橋と比べて物流のフットプリントを最小化できる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:21:12 GMT)
EEG-AS: Instance-Level Foundation Model Selection for EEG Foundation Models via Behavior Reconstruction [0.5] データセットや個々のEEGインスタンス間で一貫して最高のパフォーマンスを発揮するファンデーションモデルは存在しない。
インスタンスレベルのアルゴリズム選択問題として,脳波基礎モデル選択を提案する。
EEG-ASは、アンカー基礎モデルに規定された特権付き予測トークンから、利用できない基礎モデル行動の再構築を学ぶ。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:30:29 GMT)
A Dynamic Intermediate Representation for Hybrid Quantum-Classical Programs [0.5] ゲートを第一級値に高める新しい中間表現(IR)を導入する。
この統一表現により、古典的な計算は量子的振る舞いを操ることができる。
ノイズモデリング、ランダム化計算、誤差補正、計測に基づく量子コンピューティングのケーススタディは、我々のIRがこれらのプログラムをコンパクトに表現していることを示している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:35:46 GMT)
HiLRP: Toward One Trustworthy Explanation for Vision Transformer: Conservation-Valid Attribution via Attention Primitives [0.5] ビジョントランスフォーマー(ViT)の設計は、コンボリューションステム、ウィンドウド、リニア、マルチ軸アテンション、マージパッチ、空間リダクションを組み合わさって、ますます多様化している。
この多様性は既存の帰属法に問題をもたらし、その仮定はViTの変種をまたいでは成立しないことが多い。
既存の手法が、このアーキテクチャ領域にまたがる統一的な属性フレームワークを提供していないことを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:16:08 GMT)
Bosonic quantum control with a weakly coupled fluxonium qubit [0.3] 単一モード共振器流束装置における制御キュービットとして動作するビットフリップ保護フラックスの数値ケーススタディを提案する。
半古典的定式化を用いて、共振器の強い駆動状態を数値的にシミュレートする。
本稿では,光子損失とスプリアス非線形項が共振器軌道に与える影響を考慮に入れた改良型EDD系列を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:45:50 GMT)
Vision-Based Leader-Follower Formation Control for Cooperative UAVs in GPS-Degraded Environments [0.3] 本稿では, 追従型UAV上で動作する視覚型協調形成フレームワークを提案する。
前面のRGB-Dカメラを使って、リーダーUAVをリアルタイムで検出し、追跡し、ローカライズする。
その結果,提案フレームワークは,合理的な計算コストで安定したリーダ・フォロワ構成を維持していることがわかった。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:35:38 GMT)
FractalNet-Based Heterogeneous Federated Learning for Orbital Edge Intelligence in Satellite Mega-Constellations: A Wildfire Case Study [0.3] 大規模センシング、通信、計算ファブリックとして、メガコンステレーションが出現している。
軌道エッジインテリジェンスのためのフラクタルネットアーキテクチャに基づく異種フェデレーション学習手法を提案する。
シミュレーションされたメガコンステレーションの実験は、収束、通信効率、エネルギー適応、スケジュールされた貯蓄、堅牢性、レイテンシーのアプローチを検証する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:07:39 GMT)
When the Algorithm Becomes the Brand Crisis: A Sociotechnical Theory of Distributed Responsibility and Accountable Transparency [0.3] 技術的因果関係、顧客対応制御、ガバナンスの義務がAIシステムに分散している場合、ステークホルダーはどのように責任を割り当てますか?
本稿では, 社会工学的プロセス理論を, 実証された学術資料と一次資料の構造化, フェデレートされたスコピング合成から開発する。
AI関連の組織的危機と、AI関連の組織的スキャンダルとを区別する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 00:21:39 GMT)
Recent Developments in Transformer Inference Deployment on FPGA Platforms: A Survey [0.3] FPGAプラットフォーム上でのTransformer推論の最近の進歩,トレンド,設計選択について検討する。
文献の体系的なレビューを行い、実装と最適化のために好まれるテクニックを抽出し、掘り下げる。
この研究と提案されたトピックの分類は、学術や産業の研究者のガイドとして機能する可能性がある。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:18:00 GMT)
Quantum-Based Optimization of Gas Throughput in Natural Gas Transmission Networks Under Hydraulic Constraints Using QAOA [0.3] 水圧および運用上の制約下での伝送ネットワークにおけるガススループットの最大化は、ネットワークサイズとともに複雑性が指数関数的に増大する問題である。
本稿では,パンハンドル-B水理方程式の下での節圧割り当てを最適化することにより,グラフに基づく最適化問題に対処する。
そこで本研究では,QAOA回路の動作を従来よりもかなり浅くすることで,有意義なガスネットワーク最適化動作が得られることを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:26:34 GMT)
Towards a Reliable and Practical Eval Pipeline [0.2] 本稿では,evalチェックリスト生成と,チェックリスト応答の学習集約を組み合わせたエンドツーエンドのevalパイプラインを提案する。
さらに, 自己整合性, 説明, 予測の不確実性も促進し, その効果を実証的に実証する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:02:06 GMT)
Fi-ImageNet-1k: An OOD Benchmark From the Inside of the ImageNet-1k Validation Set [0.2] Out-of-distribution (OOD) 検出は、テストイメージが事前に定義されたクラスのどれにも属さないかどうかを予測する。
我々は、ImageNet-1k検証画像から構築されたOODデータセットであるFi-ImageNet-1kを提案する。
ImageNet-1kラベル空間の外で特定のクラスを割り当てることのできるイメージのみを保持する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:23:40 GMT)
Ctrl-F-Resist. Practices, Challenges, and Technical Needs of Civil Society Organizations Monitoring the Far-Right Online [0.2] 市民社会組織(CSO)は、オンラインの反民主的ダイナミクスの監視において、重要かつ認識されていない役割を担っている。
彼らの重要な社会的役割にもかかわらず、CSOは技術ソリューションの採用や共同開発において大きな障壁に直面している。
既存の研究とツール開発努力は、これらのアクターがより制度的に埋め込まれた利害関係者に有利であるとして、ほとんど見過ごされている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:03:00 GMT)
Emerging Personas and Tools for Hybrid Quantum-HPC Systems [0.2] 我々は,量子中心超計算環境に関わる6つの異なる人物を特定し,特徴付ける。
我々は、各ペルソナに関連する責務とツールを分析し、運用データに対する異なる要件について検討する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:29:16 GMT)
FrOGS: Discrete Neural Sampler for Independent Alloy Configurations Across Chemical Conditions [0.1] Free Energy Offering Generative Sampler (FrOGS)は、自己回帰モデルと連続的なマルコフ連鎖を結合するハイブリッドな離散型ニューラルネットワークサンプリングである。
我々は、幅広い化学条件にまたがって単一のモデルを訓練し、共通の絶対自由エネルギースケールで見積もりを生成する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 21:38:36 GMT)
Replicating TRACE: A Practitioner's Guide to Its Threshold and Particle Budget [0.1] TRACEは、事前訓練された自己回帰シーケンスモデルから因果グラフを読み出す。
正確な介入真理に対する平均F1は、語彙サイズ1000で0.90-0.91に達する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 11:48:16 GMT)
Autonomous discovery of new structure-plausibility laws for explainable and rapid crystal diagnosis and screening [0.1] 結晶生成器と工具利用剤は密度汎関数理論よりも早く構造を提案する。
ほとんどのスクリーンは原子重なり以上のテストは行わず、失敗する化学的理由も与えない。
ここでは、エージェントが200万の候補者法を作成し、テストし、積極的に反論します。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:14:52 GMT)
Stochastic Optimization of Tree Tensor Networks [0.1] 我々は, テンソルテンソルネットワーク(TTN)をパラメータと商の両方に基づいて導出する。
ハイブリッドCNN-TTNアーキテクチャを用いて,Fashion-NIST, CIFAR10, Imagenetteの手法を評価する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:03:33 GMT)
Identification of Compositional Risks in Data Protection Impact Assessments and Beyond [0.1] プライバシのリスクは、コンポジションに含まれるデータプロセッサの選択からのみ発生します。
異なるデータプロセッサは同じクラウドプロバイダに依存している可能性があるため、個人データの意図しないリンクが可能である。
プライバシに対するこのような構成リスクを検出し,管理するための新しいプロトコルを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:08:18 GMT)
Polish ModernBERT: The Long and Short of Polish Language Understanding [0.0] ポーランドの4つのエンコーダのファミリーであるtextbfPolish ModernBERTを紹介した。
ステージ化された選択実験を通じて、ModernBERT事前学習のレシピを適用し、長いコンテキストのベンチマークをリリースする。
Polish ModernBERTは評価されたポーランドのエンコーダの中で最高の全体的なパフォーマンスを達成する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:13:13 GMT)
Fast Microwave-free State Preparation and Measurement of Superconducting Qubits [0.0] 10nsで99%の忠実度を有する超伝導量子ビットを作製・読解するためのマイクロ波フリー法が提示された。
技術はスケーラブルな超伝導デジタル制御システムと互換性がある。
我々は15nsで完全な量子-デジタル変換を実演するが、これは最先端のマイクロ波ベースの手法よりも桁違いに高速である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:47:44 GMT)
TWIX: a Two-Stage Approach for End-To-End Named Entity Recognition and Relation Extraction [0.0] Information eXtraction (TWIX) は3つの相互接続モジュールを備えたエンドツーエンドのIEパイプラインである。
提案手法は, ベースラインを広いマージンで大幅に上回ることを示す。
これらの結果から,提案した2段パイプラインは実運用環境での精度とリコールを効果的に向上することが示された。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:33:21 GMT)
iPINN for Broadband CARS Phase Retrieval: A Framework for Function Approximation and Inverse Modeling Problems in Nonlinear Spectroscopy [0.0] コヒーレント反ストークスラマン分光法における位相探索は不適切な逆問題である。
逆物理インフォームドニューラルネットワーク(iPINN)を導入し,生のBCARSスペクトルからローレンツピークパラメータを予測する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:17:10 GMT)
Zeta-Lite: A Concurrent, Branchable In-Browser SQL Database for Agentic Memory [0.0] Zetaデータベースエンジンは、Zetaサーバを2.87gzipのアーティファクトにコンパイルするWebAssemblyビルドである。
Zetaliteは268k315kポイントの読み取り/秒をサポートし、数百万の操作に対して読み取り/書き込みの混合ワークロードをフラットに保持する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:47:01 GMT)
You Cannot Photograph the Same Street Twice: Reliability Limits in Vision-Language Measurement of Urban Change [0.0] われわれは、アメリカの5つの都市で435のGoogleストリートビューから4,648枚の連続した画対を使っている。
同じ街路の再撮影では、同じ都市の2つの異なる通り間の差の66.5%に相当する知覚スコアが平均0.80ポイント変化している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:25:38 GMT)
Where the Verifier Fails: A Category-Level Audit of Reward Signals in RLVR [0.0] 報酬付き強化学習(RLVR)と標準ベンチマーク評価はどちらも、無料テキスト回答をバイナリ報酬に変換する自動検証に頼っている。
以前の調査では、1つの評価ハーネスは、自身の真実の答えの94%しか受け入れず、解析を非難している。
モデルではなく検証器にメタモルフィックテストを適用し、検証された等価解の変種を生成する。
我々は、307,420以上の4つの広く使用されている検証結果に対して、回答カテゴリごとの拒絶を計測する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:57:59 GMT)
When Features Become Instances: Inverted Contrastive Learning for Unsupervised Feature Selection [0.0] 教師なしの特徴選択は、クラスラベルにアクセスすることなく、情報的特徴のコンパクトなサブセットを求める。
Inverted Contrastive Learning for Unsupervised Feature Selection (ICLFS)を提案する。
ICLFSは、UFSをサンプルではなく特徴よりも表現学習の問題として再定義する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 06:25:43 GMT)
When Does Online Adaptation Pay on the Edge? A Leakage-Free Evaluation of Warmup, Learning-Rate Selection, and Resource Trade-offs for Time-Series Forecasting [0.0] オンライン適応は、分布ドリフト下でのエッジ時系列予測に役立つが、その測定された利点は評価選択に敏感である。
本研究では,ビルセンサとスマートメーターデータを含む6つの公開多変量ストリームを,リークフリーストリーミングプロトコルの下で検討する。
6つのデータセットバックボーン設定で、推定適応の利点は1,000-20,000ステップの一般化範囲で3.0から18.8ポイント(pp)に変化する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:04:08 GMT)
When Does Information Sharing Improve Decentralized Discovery? Aggregation, Independent Rescue, and Equilibrium Selection [0.0] 情報共有は、独立した救助行動を取り除き、プールされた見積もりを改善することができる。
本稿では、これらの効果を正確な有限な発見モデルで分離する。
モデルは合成され有限であり、人間や組織的なデータは使用されない。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:41:30 GMT)
When Can a Machine Trust a Statute? A Survival Certificate for Machine-Extracted Legal Logic [0.0] 29,365のミズーリ地区と502のインディアン・セントラル・アクティクト地区では、登録済みのホールトアウトゲートパス(正確には7つのタイトルに10の法定家族が通っている。
我々は,機械抽出法コンテキストのDukenne-Guigues含意に基づく受動的生存証明書を構築した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:08:01 GMT)
What Limits Robustness in Deep Image Watermarking: An Analysis of Mechanisms and Their Scaling Across Capacities [0.0] 本稿では,キャパシティ自体が限界なのか,他の制限を目に見えるものにするかを問う。
最初は、透かしが生き残らなければならない歪みを整理し、それらに抵抗するために開発された戦略を、それを支配する軸によって順序付けする。
第2のメカニズムは、ペイロードを空間ブロックグリッドにマッピングするスキームにおけるロバスト性を制限する3つのメカニズムを特定して測定する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:46:58 GMT)
Web Price Extraction: State of the Art and an Adaptive Browserless Implementation [0.0] ウェブサイトからの価格抽出は、電子商取引における市場モニタリング、価格比較、ビジネス分析の鍵となる課題である。
既存の手法は手書きのラッパーとラベル付きページからのルール誘導に依存しており、精度は高いが構造的な変更には不適応である。
本稿では,Webサイト間の構造的差異に対するロバスト性を向上する適応型ブラウザレス価格抽出システムを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:28:11 GMT)
Wave-Particle Complementarity from Fourier-Pontryagin Duality: A Categorical Formulation on Schwartz Rigged Hilbert Spaces [0.0] 我々は、シュワルツ・リッグされたヒルベルト空間に基づく連続なカテゴリー集合における位置-運動量相補性(英語版)を定式化する。
正の正規化パラメータ$$は、物理定数$hbar$とは独立して導入されるので、文字ペアリングは$_p()(x)=exp(ipx/)$という形を取る。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 21:51:54 GMT)
UAV Thermal Imagery for Inert Ordnance Screening: Multi Campaign Dataset Development,Object Detection, and Practical Recommendations [0.0] 本研究では,不活性オードナンスのマルチキャンペーンUAV熱画像データセットを作成し,収集した画像からラベル付き画像を作成し,対象検出モデルを検証し,人道的な地雷活動や地雷処理の実践的検討を行った。
夏と冬の4回のテネシー州の野戦戦で、短い草、高い植生、砂利、マルチ、岩、コンポスト、圧縮された表面に置かれた不活性な鉱山、弾薬、その他の兵器を用いて収集された。
テクニカルサーベイやEDDアセスメントのフォローに対するスクリーニングと優先順位付けが目的であり、スタンドアローンのクリアランスではない。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:07:41 GMT)
Tuning Boron-Vacancy Qubit Coherence through Layer Number in hBN [0.0] hBNは、ファン・デル・ワールス結晶の中で初めて同定された光アドレス可能なスピン量子ビットである。
バルクhBNのコヒーレンスは、欠陥面の側面にある層のホウ素核によって制限される。
層番号は、$VB$ベースのセンシングの設計パラメータとして現れる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:37:27 GMT)
Triple-Bottom-Line Sustainability of Language Models for Edge AI: A Comparison Between SLMs and Quantized LLMs [0.0] エッジAIモデルの選択は、一般的に1つの独立したメトリック – 正確性、レイテンシ、メモリ、エネルギ、安全性 – によって駆動される。
我々の研究は、訓練後量子化によって圧縮されたna-tively trained small language model (SLM) と large language model (LLM) が、より持続可能なエッジデプロイメントトレードオフを提供するかどうかという疑問に答えることに焦点を当てている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:44:18 GMT)
Towards Behavior Tree-Guided Vulnerability Detection with Lightweight LLMs [0.0] 大規模言語モデル(LLM)は、ソフトウェア脆弱性の検出にますます利用されている。
それらのパフォーマンスは、ソースコードが入力でどのように表現されるかによって異なります。
本稿では,LSMに基づく脆弱性検出のための代替中間表現として,行動木(BT)について検討する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:25:01 GMT)
Toward Explainable and Policy-Aware AI for Carbon Credit Price Prediction: A Research Framework for Emerging Carbon Markets [0.0] 炭素市場は排出量に価格を付けているが、その価格は予測しにくい。
EPA-CarbonNetは、ポリシー対応の説明と並行して、ポリシーテキストを相互注意と調整間隔で融合する。
結果はおおむね否定的であり、測定値として報告されている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:36:04 GMT)
Thinking effort aligns between humans and reasoning models in abductive reasoning [0.0] 大規模言語モデル(LRM)は、検証可能な報酬からの強化学習によって最適化され、推論タスクに対する正しい解決策が奨励される。
近年の研究では、人間の反応時間とモデル推論トレースを比較することで、人間とLEMの思考コストを調査している。
我々は、LRMと人間の推論努力が一致していることのさらなる証拠と、モデルと人間が同様の誤りを犯す傾向があることの証拠を見出した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 21:02:18 GMT)
Thermal screening and critical scaling of quantum energy teleportation in a harmonic chain [0.0] 一次元調和鎖における量子エネルギーテレポーテーションの有限温度ガウス状態定式化を開発する。
Gibbs状態の場合、最適化された測定フィードバックプロトコルは熱二点関数に還元される。
単一部位のプロトコルでは、抽出されたエネルギーは単一の相関子によって制御され、熱力学的かつほぼ臨界な限界は分析的に引くことができる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:51:41 GMT)
The Structure of Quantization Damage in LLMs: Why the Next Bit Should Be Spent Globally [0.0] 後学習量子化(PTQ)は、大規模言語モデル(LLM)を提供するコストを削減するために広く用いられている。
我々は、量子化の損傷の発生源と、小さな追加の精度予算の配分方法について検討する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:53:41 GMT)
The Memory Trust Gap: Capability-Dependent Failures in Persistent-Memory Agents [0.0] 永続メモリはパーソナライズされたエージェントをサポートするが、古い保存された事実は警告なしで現在の信頼できる証拠をオーバーライドすることができる。
モデル能力が変化するにつれて、この害がいつ始まるかを研究する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:35:00 GMT)
The Constitutional Coverage Trilemma in AI Governance [0.0] AIシステムは、Emphconstitutional institutionsとして機能する。各デプロイされたモデルは、安全性、有用性、誠実性、自律性、株式の暗黙のランクを符号化する。
我々は、フロンティア憲法型の供給が人間の需要をカバーするかどうかを問う。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:08:56 GMT)
Ten Architectures, One Error: Shared Failure Modes in Hyperspectral Classification under Spatially Disjoint Evaluation [0.0] ランダムスプリット法では、大量のテストピクセルがトレーニングピクセルにすぐ隣に落下し、報告された精度を膨らませる。
本研究では,空間分離をモデル受容場にリンクするリークフリー評価プロトコルを提案する。
このプロトコルを古典、スペクトル、スペクトル空間、トランスフォーマー、ビジョンバックボーン、ステートスペースファミリを含む10の異なるアーキテクチャに適用すると、マクロF1は平均で0.147減少し、モデルランキングは最大5箇所まで変化する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:58:59 GMT)
Smart Contracts Claimed Vulnerable by the CVE Database, with Labels and Source Locations [0.0] 本稿では、スマートコントラクトを参照して、CVEレコードのキュレートされたデータセットであるCVE-Smart-Contractsを紹介する。
データセットには3つのラベルに従って脆弱なアーティファクト(ソースコードとバイトコード)が含まれている。
このデータセットは経験的セキュリティ研究、特にコード解析と修復技術の評価をサポートする。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:01:39 GMT)
Scattering and Tunneling in Real Quantum Mechanics [0.0] 進化方程式の一般的な形式を確立し、実量子力学における散乱とトンネルの研究を行う。
我々は、実波作用素と関連するS-行列の観点から散乱理論を定式化する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:59:17 GMT)
SCULPT: Training Edge Vision Models for Post-Training Quantization Readiness [0.0] エッジビジョンモデルは、リソース制約のあるハードウェアにデプロイするのは難しい。
通常のFP32微調整におけるPTQの即応性を改善する訓練時間であるSCULPTを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:10:19 GMT)
RosettaBitcoin: An Artifact-Backed Experience Report on Verification Infrastructure for Agent-Assisted Consensus Validators [0.0] この体験レポートは、12の個別に実装されたBitcoin testnet4コンセンサスバリデータを構築した、単一開発者プロジェクトであるRosettaBitcoinを調査している。
スナップショットの追跡されたエビデンスデータベース、キュレートされたアーティファクトインデックス、標準適合フィクスチャ、検証スクリプト、ブロッカレコード、バージョン履歴を分析します。
このケースは、明示的な障害記録、フィクスチャ、ポート所有、バリデーションがエージェントアシストシステムをより監査可能にすることを示唆している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:22:07 GMT)
Relational-Core Graph Analytics Querying graphs at SQL scale, and why the node/edge model is a performance tax, not a truer picture of connected data [0.0] 永続的な仮定では、グラフ分析には目的を持ったグラフエンジンが必要である。
私たちは、企業が実際に実行するワークロードに対して、その逆を論じています。
グラフクエリ言語で表されるカラムリレーショナルエンジンは、分析グラフクエリ上でネイティブグラフエンジンと一致するか、あるいは超える。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:55:11 GMT)
Relational Task Generation Language: A Declarative Specification Framework for Relational Deep Learning [0.0] 深層学習(DL)は多言語データから学習するための強力なパラダイムとなっている。
RTGLはオープンソースのRDLタスク定式化のための宣言型言語である。
RTGLの実用性は,多種多様な形態と対象型を持つ様々な新しいタスクを設計することによって実証する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:27:06 GMT)
Purification of photonic graph states [0.0] ホストされたスピンを持つ量子エミッタは、決定論的にフォトニックグラフ状態を生成することができる。
一般に様々なノイズ源に悩まされ、生成した状態の忠実度が低下する。
我々は絡み合ったフォトニック状態の浄化法を開発した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:00:01 GMT)
Public-Sharing Labels and Verbatim Field Egress in an MCP-to-A2A Agent Configuration: A Controlled Multi-Model Study [0.0] Model Context Protocolツールの使用のために別々に評価され、Agent2Agent(A2A)デリゲートは、エージェントが両方を使用するときの振る舞いを記述する必要はない。
一つの制御されたMCP-to-A2A構成でそのような挙動を計測する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:24:11 GMT)
Prompt-Robust Language Models: Which Training Strategies Work? [0.0] 現在の頑健さの微調整法は、標準的な微調整やテキスト内学習よりも改善されているが、最良な迅速なギャップは、性能の40~57%に留まっている。
さらに、私たちがテストしている最近のロバスト性向上手法 - コントラストアライメントのためのCoINと整合性正規化のためのPPCL - は、多くの場合、最も単純なデータ構築戦略を上回りません。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:21:32 GMT)
Pricing the DeFi Tail: Do Protocols or Depositors Price Operational Risk? [0.0] DeFiプロトコルは、預金業者を運用上のリスクに晒す。
銀行とは異なり、彼らはそれに対して資本を保有する必要はない。
1つのベンチマークで、基礎となるテールを定量化します。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:39:42 GMT)
Prediction-Assisted Pricing and Admission for LLM APIs with Stochastic Token Consumption [0.0] LLMアプリケーションは、複数のサービス製品を販売したり、内部的に割り当てたりすることが多い。
価格が購入確率を変更し、トークンキャップがユーザ値とリソース消費のテールの両方を変更する。
オンラインの信頼区間とオフラインの予測区間を交差する予測クラッピング UCB を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 04:40:34 GMT)
Panda Diplomacy: Foundation Model Pre-training across Particle Imaging Detectors for High Energy and Nuclear Physics [0.0] 点雲自己蒸留フレームワークにより、より一般的なセンサレベルの事前学習レシピが得られることを示す。
3つの定性的に異なる検出器のモジュラリティに対して最小限の変更を伴って、同じ改良されたアーキテクチャと目的を独立に事前訓練できることが示される。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:56:05 GMT)
Ontic and epistemic states in the theory of spacetime-local beables [0.0] ベルの定理は、量子現象を記述するための局所因果理論の開発を規定している。
多くの者は、量子絡み合いのモデルが非局所的な規則に従う変数(ベルによる可算と呼ばれる)を使わなければならないことを暗示している。
もう1つの方法は、過去と将来の入力に依存するかもしれないビーブルを持つオール・アット・オンス(ブロック・ユニバース)アプローチを採用することである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:46:23 GMT)
On the relaxation problem in statistical mechanics [0.0] 記録された信号の局所時間統計値$Z(t)$。
予測の主題は、真であると考えられる数学的モデルから分布を推定する測定結果の、将来の新鮮なアウト・オブ・サンプル読解に関する信念である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:53:32 GMT)
On the Reliability of Generative Augmentation: A Wasserstein-Based Theoretical and Empirical Study [0.0] 本研究では,条件付き生成促進のための統計的枠組みを開発し,その分類リスクへの影響を解析する。
得られたリスク歪みは, 拡張強度とクラス条件ワッサーシュタインの相違により制御されることを示す。
条件付きGANと条件付きWGAN-GP拡張を用いた二項・多クラス不均衡分類タスクのフレームワークの評価を行った。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:30:24 GMT)
Observable- and state-selective prethermalization and bounds on prethermal lifetimes [0.0] スペクトルエネルギースケールの分離は予熱プラトーの出現を保証しないことを示す。
この選択性を支配するメカニズムを解明し、予熱台地の出現はハミルトニアンだけでなく、観測可能な状態と初期状態にも依存することを示した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:59:58 GMT)
Nonlocal wavefront shaping through complex media [0.0] 空間的に絡み合った光子対を用いた非局所波面形状を実験的に実証した。
我々のアプローチは散乱媒質から波面補正を物理的に切り離し、コンパクトでアクセス不能なシステムにおいて複雑な媒質を通したイメージングの道を開く。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:08:08 GMT)
Non-Markovian interactions with pulses of quantum radiation [0.0] 我々は、散乱器を擬モードにコヒーレントに結合することで、非マルコフ入力出力理論を考案する。
散乱器における非マルコフ的コヒーレンス復活は、入射パルスの単一モードの性質を歪曲する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:01:09 GMT)
Neural Symbollic Regression Using Deep Learning and Sparse Modelling [0.0] シンボリック回帰は、データ内の基本的な関係を表す簡潔な数学的表現を見つけようとする。
遺伝的プログラミングのような従来の手法はスケーラビリティの課題に直面しており、ノイズに非常に敏感である。
本稿では,ニューラルネットワークを記号発見のための関数型プレコンディショナーとして扱うニューラルシンボリック回帰フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 11:46:28 GMT)
Latent unified smooth Hamiltonians for excited state chemistry [0.0] 本稿では、任意の分子系の電子基底および励起状態のモデル化を目的としたニューラルネットワークアーキテクチャとトレーニング手順について述べる。
電子状態ハミルトニアンの潜在的で暗黙的な基底表現を間接的に学習することにより、モデルは複数の電子状態の統一的な処理を提供する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 21:09:17 GMT)
Lagged Coupling: Internal Representations Become Readable Before They Become Causal [0.0] 内部可読性は因果効果を体系的に上回り、ラグはスケールとともに縮小しない。
予め登録されたOLMo-2複製は、減衰した大きさで方向を保存する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:46:42 GMT)
Irreducibility and regularisation properties of Gaussian quantum Markov semigroups [0.0] 連続可変量子系に作用するGQMSの正則性と既約性について検討する。
古典的な場合とは対照的に、既約性は正規化を保証する条件よりも厳格に強い。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:14:48 GMT)
Integrated Laser Scanning and Image-Based Topology Optimization Techniques for Detection and Quantification of Visible and Subsurface Structural Defects [0.0] 本研究では, 構造成分の欠陥の検出と定量評価のための2つの相補的非接触的視覚的アプローチを提案する。
第一のアプローチは、損傷した鋼の3次元点雲を生成するために高分解能レーザー走査を用いる。
第2のアプローチは、3D-DICを用いて得られたフルフィールド表面の変形測定と有限要素モデルの更新とトポロジー最適化を組み合わせたものである。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:31:32 GMT)
Inspicio: Open-Vocabulary, LLM-Based Sense Retrieval for Historical Languages [0.0] Inspicioはオープン・ボキャブラリ検索パイプラインであり、オープン・イングリッシュ・ワードネットのシンセセットとコンテキスト内のトークンをリンクする。
それぞれの事象に対して、命令調整されたLLMは2つの英訳、少数の辞書スタイルの定義、およびいくつかの英語の補題を生成する。
我々は,ラテン文字と古代ギリシア語の知覚動詞を手動で注釈付けした新しいバイリンガル集合に対して,LLMの6x6グリッドと文埋め込みモデルを用いたパイプラインの評価を行った。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:46:38 GMT)
Information geometry of non-equilibrium quantum states: Mixed metric structures on an extended information manifold [0.0] 非平衡力学における量子状態の特徴付けのための情報幾何学的枠組みについて論じる。
このフレームワークは$h$と$t$を拡張情報多様体の座標として扱う。
幾何学的オブザーバブルは、多様体上の進化速度と時間的方向とパラメータ・変形方向のアライメントを特徴づける。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:33:32 GMT)
Influence of Logging Frameworks on Bind9 [0.0] 我々は,Fail2BanモニタリングBIND9のような広くデプロイされたセットアップを,65パーセント未満のDNSトラフィックで打ち負かすことができることを示した。
我々は、カーネルMbpsをバイパスし、ログメッセージのコピーを減らす高性能なロギング用に設計された新しいICCを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:12:04 GMT)
Improved Automatic Target Recognition in Synthetic Aperture Sonar Imagery Using Large Deep Neural Networks [0.0] 本研究では,ネットワークサイズ,アーキテクチャ,事前学習方法,データ拡張,その他の形式がSAS-ATR性能に与える影響について検討する。
我々は,最高のSAS-ATRモデルを作成し,最先端のSAS-ATRモデルをトレーニングするためのロードマップを提供する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 19:09:21 GMT)
How Do Language Models Choose Between Context and Memory? [0.0] 方向に沿った操舵が因果関係を確立できないことを示す。
また、オーソリティ計算はタスク間で再利用可能なものではなく、タスクに依存している可能性があることを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:35:36 GMT)
HiveTraceGuard-Pro: A Compact Generative Guardrail for Prompt Injection, Jailbreaks, and Adversarial Obfuscation [0.0] 本報告では,Qwen3-0.6Bから構築したHiveTraceGuard-Proについて述べる。
ロシア語と英語で訓練され、最終目標のターンに1つの二進法(セーフ/アンセーフ)を用いる。
15モデル比較において、HiveTraceGuard-Proは、ロシアの最もクリーンなロバスト性の組み合わせであるF1(0.88)とロシアのプロンプトインジェクションリコール(0.999)を持つ。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 10:46:09 GMT)
Hints Help But Do They Teach? Evaluating Skills Transfer in Code Generation [0.0] Qwen2.5-3B-インストラクションで選択された79の障害のうち36の適切な関連ヒントが回収された。
Qwenのメカニスティックテストは、関連するヒントと無関係なヒントによって共有される安定した活性化方向を特定する。
ポストジェネレーション後の隠れ状態プローブは、AUROC 0.806と0.780のプールを持つベンチマーク間で転送されるが、トークンの信頼性よりもトップワンの選択優位性は統計的に未解決である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 11:47:39 GMT)
Grounded, Compute-Efficient LLM Policy Agents for Energy-Poverty Equity in Physically-Constrained Peer-to-Peer Energy Markets [0.0] EqGridは,低周波かつオープンウェイトなLCM政策エージェントが価格と炭素境界を設定し,実証的な家庭のペルソナコミュニティに対する補助金を目標とするクローズドループシミュレーションである。
私たちの貢献は3倍になり、AIの社会的影響を直接的に測定する方法に対処します。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 22:37:34 GMT)
Gouy Phase across PT-Symmetry Breaking in Non-Hermitian Dirac Systems [0.0] 我々は,Gouy相がグローバル$mathcalPT$-symmetric-breaking閾値の感度の高いプローブを提供することを示す。
破壊状態における非エルミート・グーイ相の成分を測定するための実験的スキームを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 21:30:39 GMT)
GenONet: A Generative operator Network for High-Resolution Precipitation Nowcasting [0.0] 高分解能降水流は、厳しい天候の影響を軽減するために重要であるが、急激な嵐の進化のために依然として困難である。
ディープラーニングモデルは、このタスクに非常に有望であるが、予測スキルは、長い予測地平線よりも劣化することが多い。
GenONetは3時間以内の長距離降雨を予測できる新しいアーキテクチャで、特にシャープで物理的に一貫した結果を生成するように設計されている。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 01:30:33 GMT)
From Terminology to Diagrams: Visual-Instruction Generation for Scientific Diagram Understanding [0.0] 視覚言語モデル(VLM)は,自然画像を用いた視覚的質問応答において高い性能を示した。
本稿では,学術カリキュラムから派生した用語を活用することで,大規模図表基底命令データを生成するフレームワークを提案する。
SciGramは、194K以上の図と1.4Mの視覚的指示のデータセットで、生命、地球、物理科学を横断する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 09:07:31 GMT)
From Open Standards to Openly Governed: Standards-Setting Organizations as Stewards of Openness amid Platformization and Digital Sovereignty [0.0] オープンな地理空間標準により、データ、サービス、システムはプラットフォーム間で機能する。
標準はデジタル・パブリック・グッズとして機能し、かつてはデジタル・パブリック・インフラストラクチャーとしてパブリック・システムに組み込まれた。
本稿では,オープンな地理空間標準が,囲いのチャネルになるのではなく,公共のインフラのままであるかどうかを問う。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:43:37 GMT)
FIREQ: FPGA Instrumentation for Readout and Qubit control [0.0] FIREQは超伝導量子ビットの制御と読み出しのためのオープンソースのフレームワークである。
FireQはモジュール型のAXI準拠のファームウェアアーキテクチャとPYNQベースのソフトウェアスタックを組み合わせる。
AMD Zynq UltraScale+ RFSoC ZCU216では、FIREQはパルスデューレーション解像度107 ps、イベント最適化解像度1.7 nsのRFパルスを最大9.3 GHz出力する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 06:28:34 GMT)
ExecRetrieval: Measuring the Functional-Correctness Gap in Code-Embedding Retrieval [0.0] 埋め込みベースのコード検索は、コードエージェントと検索拡張コード生成のコアコンポーネントである。
既存のベンチマークは、各クエリの標準実装の、実行検証された単一編集の亜種を配置しない。
ExecRetrievalは、それぞれ939のPythonタスクで、1つの実行検証された標準実装と最大4つの実行検証されたバグギーなインタプリタをペアリングします。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:55:17 GMT)
Exact Risk-Complexity Laws for Projective Boundaries in Scenario Optimization and Distribution-Free Certification [0.0] 条件違反のリスクは、尾がベータ二項表現を持ち、そのパラメータがサポート、キャリブレーション、圧縮次元である正確なベータ法に従う。
本稿では、これらの式の背後にある決定論的境界機構を特定し、観測された境界サイズがランダムである場合に対応する法則を導出する。
また、条件付き確率証明や、観測された複雑さだけでは不十分な理由を説明するNo-go結果も得られる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:58:38 GMT)
Evidential Deep Learning for Multi-Modal Anti-UAV Detection [0.0] 本研究では,明らかな深層学習ヘッド,デンプスター・シェーファーのエビデンス融合,不確実性駆動型時間センサゲーティングが抗UAV検出を改善するか否かを評価する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:09:46 GMT)
Epistemic Sybil Resistance: Multiplying AI Agents Without Multiplying Evidence [0.0] エージェントの生成とレポートの合成により、マルチエージェントAIシステムは推論を改善する。
しかし、どうやら独立した報告は、同じ証拠に由来するかもしれないし、真に独立した証拠は、ほぼ同一の報告を生成することができる。
一般に、レポートのみのアグリゲータは、複製と独立のコロンボレーションを区別できない。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 21:11:27 GMT)
Emergence of Fibrations, Compression, and Symmetry Breaking in Artificial Neural Networks [0.0] 深層ニューラルネットワークにおける学習は、フィブレーションや被覆として知られる局所対称性を生成する。
これらの対称性をエクスプロイトすることで、劇的なモデル圧縮が可能になり、性能を犠牲にすることなく、ネットワークを元のサイズの17%に削減できる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:39:03 GMT)
Dynamical phase transitions for single particles in the semiclassical and weak noise limits [0.0] 単一粒子量子系における動的相転移の統一的な記述を示す。
遷移は、古典的相関関数と逐次量子弱値として実現された、統一された軌道に基づく順序パラメータによって区別される。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 13:06:11 GMT)
Drift-Aware LLM Routing with Sparse Contexts and Shared Budgets [0.0] マルチモデル言語サービスは、計算、レイテンシ、メモリ、あるいは金銭的コストのワークロードレベルの予算を維持しながら、各要求をルーティングする必要がある。
我々は、複数のknapsack制約とオプションのシャドウ・オーディットストリームで非定常スパースコンテキストルーティングを定式化する。
政策は、ロール監査窓から報酬とリソースの使用を推定し、悲観的な報酬と楽観的なコスト見積を使ったルートを推定し、リソースの影の価格をオンラインで更新し、コミットメントの前にハードメーターを適用する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:39:59 GMT)
Does Fault Localization Beat a Fresh Attempt? A Placebo-Controlled Study of Test-Guided Code Repair [0.0] フォールトローカライゼーションは、失敗したテストが意味するステートメントにコードモデルの修復に集中することができるが、ターゲットの編集が成功するのは、それが小さいためだけである。
我々はこれらの説明を3つの腕で分け、同じ失敗候補に当てはめます。
3つのフリーズ26-32Bモデル、3つのベンチマーク、488の候補が失敗し、3つの結果が続いた。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:48:51 GMT)
Direct laser-written optomechanical double membranes in an optical microcavity [0.0] オプトメカニカル膜・イン・ザ・ミドルシステムは、拡張されたオプトメニカルカップリングと集合力学を提供する。
3次元直接レーザーによるモノリシック集積二重膜共振器を用いたファイバベースファブリペロマイクロキャビティを提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:20:00 GMT)
Direct Optimization of a 3D Finite-Source Reflector via Neural-Network Parameterization [0.0] 三次元自由形反射器の直接最適化法を提案する。
この方法は、テストされたすべての例に対して、単一のGPU上で数秒以内に確実に収束する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:24:25 GMT)
Design and Implementation of a Kalman Filter-Infused Algorithm for Tilt Estimation [0.0] 本稿では,MPU6050慣性測定器を用いた単軸傾斜角推定システムを提案する。
提案手法は, 騒音測定を効果的に低減し, 動的応答を良好に保ちながら長期間のドリフトを抑制する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:07:14 GMT)
Consistency Without Alignment: Item-Sensitive Language Models Indistinguishable From Random [0.0] 項目感度は、モデルの選択が自身の出力よりも特定の入力に依存するかどうかとして定義され、タスク能力の証拠として広く報告されている。
この証拠は、香港のボードゲーム『Deception: Murder: Hong Kong』から抜粋された強制選択シグナリングタスクを用いて、必要だが不十分であることを示す。
7つの言語モデル、2つのモデルファミリー、訓練後のアブレーション、3つの独立したスコアリングルールは、21のモデル・バイ・ルール・セルのうちの1つが確実にアイテムに敏感である。
我々はこの一貫性をアライメントなしで呼び、アイテム感度、置換整合性に依存するあらゆる評価に一般化する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:12:10 GMT)
Beyond the Clock: Measuring the Value of Adaptive Revision [0.0] 我々は,マネージャが低レベルの計算を統括するコミットメントを維持したり置き換えたりできる階層的潜在推論器について検討する。
3つの事前コミットされた訓練種のうち、学習されたリビジョンタイミングは質的に異なるポリシーを生成する。
コントローラは、その振る舞いを再現可能なタスクパフォーマンスの利点に変えることなく、内部状態でアクションを変更できる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 08:07:38 GMT)
Beyond Landmark Extraction: A Framework for Robust Geometric Feature Construction in Structured Image Classification [0.0] 識別情報は個々のピクセルよりも、意味的部分間の空間的関係の方が少ない。
本稿では,ランドマーク後の特徴写像を解析の中心的対象として検討する。
摂動・アブレーション実験により,座標,距離,角度,ハイブリッド表現を評価した。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:10:55 GMT)
BS: Take the Hint - Interactive Multitracer PET/CT Lesion Segmentation with a Scribble-Conditioned ResEnc U-Net [0.0] オートPET/CT Vチャレンジは、画像と一緒にユーザのスクリブルを供給することによってセグメンテーションをインタラクティブにする。
提案する提案は,CT,PET,スパーススクリブルマップの4つの入力チャネル上で動作するスクリブル条件付残エンコーダU-Netである。
約85%の利得は最初のスクリブルに続いており、折り畳みモデル間の広がりは同じラウンドで5倍に狭まる。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 17:19:34 GMT)
Arkios: An Open Bilingual English-Nepali Language Model Trained From Scratch, with a Devanagari-Aware Tokenizer [0.0] 我々は150Bのバイリンガル・イングリッシュ・ネパリ文字のトークンにスクラッチから事前訓練された高密度トランスフォーマーArkiosを提示する。
アルキオスは、訓練トークンの桁数が桁違いであるにもかかわらず、3つの比較可能な大きさのオープンモデル(Pythia-1.4B、TinyLlama-1.1B、OLMo-1B)を超える。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:17:13 GMT)
Are You Thinking What I am Thinking? : Examining Conceptual Separation in Neural Architectures [0.0] 畳み込みニューラルネットワーク(CNN)と大規模言語モデル(LLM)の概念的組織について検討する。
CNNでは、慣れ親しんだImageNetの概念は一貫性があり、セマンティックに順序づけられた表現を形成するが、これは目に見えない概念を弱める。
LLMでは、明確に区別されたドメインが適切に分離され、関連するドメインがより深く移動し、あいまいなトピックの区別が崩壊する。
これらの結果は、概念的分離は、出力精度だけでは不可能な構造を明らかにし、モデルがいかに頑健に、そのモデルを識別するよう要求された概念を表すかの有用な診断として役立ちうることを示唆している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 05:53:05 GMT)
Architecting Conversational Data Systems for Stateless LLM APIs: The Hydration Proxy Pattern [0.0] Hydration Proxy Patternは、セッションの永続化を推論エンジンから切り離すアーキテクチャである。
我々は、主権国家管理とKVキャッシングのトレードオフを解決するために、コンテキスト安定化委任を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:08:04 GMT)
Analog-DB: An Agent-First Analog Integrated Circuit Database, From Blocks to Systems [0.0] 本稿では,共有可能な設計表現上に構築されたオープンソースバージョンデータベースであるアナログdbについて述べる。
ドメイン固有の言語は、各設計をプロセスニュートラルトポロジ、再利用可能なテストベンチ、マシン可読スキーマとしてキャプチャする。
データベースには16のクラスに68の回路があり、階層化されたハーネスの下でスキーマレベルで検証可能である。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 14:22:37 GMT)
An efficient EM algorithm for both element-wise and structural missingness in matrix-variate normal mixture models [0.0] 本稿では,行列変量正規データに対する効率的な部分EMアルゴリズムを提案する。
提案手法は計算時間を大幅に削減することを示した。
ハイパースペクトル画像パッチへの実データ適用により、提案した計算戦略を行列-変量混合モデルに組み込んで、同時に計算とクラスタリングを行うことができることを示す。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 03:01:09 GMT)
Adversarial Vulnerabilities of Neural Biomarker Identification Systems [0.0] 我々は,盗難された脳波記録のターゲット変更を通じて,認証システムを騙すための適応攻撃アルゴリズムのコレクションを開発する。
その結果,スプーフィング攻撃に対する脆弱性は記録条件に大きく影響し,記録時のタスクによって大きく異なることがわかった。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 20:39:51 GMT)
Accurate Reconstruction of Gas Turbine Blade Geometry Using 3D/2D Rigid Registration and CT View Optimization [0.0] 製造部品の寸法精度を確保するためには,非破壊X線およびCT検査が不可欠である。
本研究では,CADモデルとX線投影との整合性を考慮した多部3D-2D剛性登録手法を提案する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 15:06:11 GMT)
A monolithic segmented 3D ion trap fabricated from fused silica by selective laser-induced etching [0.0] 本稿では,量子科学応用のためのモノリシック,セグメント化,三次元線形ポールイオントラップを提案する。
このトラップは、選択的レーザー誘起エッチング(SLE)を用いて単一の溶融シリカブロックから製造され、その後金属化される。
ほぼ等間隔構成を含む,33$40$Ca$+$イオンの線形鎖の安定トラップと制御を実証する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:27:20 GMT)
A continuous-mode quantum-optical representation of finite strong-field laser pulses in free space [0.0] 自由空間における有限パラ軸レーザーパルスのエネルギー一貫性の量子光学的表現を定式化する。
このフレームワークは、測定された自由空間パルスと量子光学計算の間の便利な、エネルギー一貫性のあるインターフェースを提供する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 12:34:47 GMT)
A Sensor-Adaptive Incremental Learning Framework for Artifact Detection in Satellite Precipitation Data [0.0] 本稿では,地球規模の衛星による降雨物中のアーティファクトを識別する異常検出システムの開発について述べる。
その結果, 衛星毎の軌道から正則軌道を分離する手法の有効性が示された。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 16:43:27 GMT)
A Mathematical Framework for Legacy, Governance, and Decision Integrity in Enterprise AI [0.0] 本稿では,制度的遺産のためのデザイン・サイエンス・フレームワークを開発する。
i) 知識保持、ガバナンス、人間の監督、適応性、フィードバック学習、および管轄権の忠実さという、厳格化された幾何学的平均に基づく正規化されたレガシースコア。
また、8つのAI決定整合性ルール、評価プロトコル、再現可能な計算実証も提案している。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 02:06:32 GMT)
A Checklist to assess the energy and carbon impacts of ML/AI applications in Earth System Modeling [0.0] 成長する文学組織は、機械学習と人工知能の倫理的かつ持続可能な発展に対処する。
我々は、これらの議論をML/AIとアースシステムの専門家が自身のアプリケーションの環境フットプリントを評価し、削減するために使用できる実践的なチェックリストに抽出する。
それぞれの質問に対して、我々は、研究者が開発サイクルのすべての段階で直面する意図的原則と意思決定のギャップを埋めることを目的として、最近の文献から具体的な事例と実行可能な提案を指摘します。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 07:44:38 GMT)
$\mathcal{N}$-bein formalism for degenerate states in the parameter space of quantum geometry [0.0] 近年、量子系のパラメータ空間を研究するために、カルタン形式における正則フレームに類似した幾何学的対象を導入した。
我々はこの枠組みを拡張し、退化スペクトルを用いて量子系のパラメータ空間を解析する。
論文参考訳(メタデータ) (Tue, 01 Sep 2026 18:22:09 GMT)