In-Context Model Predictive Generation: Open-Vocabulary Motion Synthesis from Language Models to Physics [110.0] In-Context Model Predictive Generation (ICMPG)は、言語モデル計画と推論時の物理的フィードバックを統合するフレームワークである。
ICMPGは2つのモジュールでモデル予測制御(MPC)のようなプロセスとして運動合成を再構成する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:50:33 GMT)
PhysEditWorld: A Large-Scale Dataset Toward Physics-Editable World Models [99.8] 物理パラメータを持つマルチモーダルデータセットであるPhysEditWorldを紹介する。
各シナリオは正常化されたアクショントレースを記録し、複数の重力設定の下で同じ初期状態、文字コントローラ、アクションシーケンス、カメラポリシーを再生する。
各サンプルは、RGB、ディープ、ノーマル、オーディオ、アクショントレース、カメラ軌跡、エンジン状態、セマンティックアノテーション、明示的な重力ラベルを含む同期マルチモーダル信号を提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:27:09 GMT)
Scalable Behavior Cloning with Open Data, Training, and Evaluation [95.6] ABCは,動作のクローン処理のためのオープンソーススタックである。
ABC-130Kは、これまでで最大のオープンソースの遠隔操作データセットであり、195の多様なタスクにわたる130Kエピソードにまたがる3500時間のデータを特徴としている。
アクセス可能なハードウェアセットアップ、トレーニングインフラストラクチャ、シミュレーションパイプラインもオープンソースで公開しています。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:59:57 GMT)
Event-Aware Instructed Assistant for Referring Video Segmentation [95.3] EVIS(Event-Aware Video Instructed Assistant)は、ビデオを単純なイベントに分割する。
また,MLLMが長期ビデオのターゲットを追跡できるObject-Pixel-Hybrid Learningを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:12:43 GMT)
ViQ: Text-Aligned Visual Quantized Representations at Any Resolution [91.5] 本稿では,視覚的量子化表現フレームワークViQについて紹介する。
我々のアプローチは、量子化学習をテキスト整列事前学習と特徴分別という2つの段階に構成する。
マルチモーダル・タスクの実験では、ViQは最先端のマルチモーダル・ビジョン・エンコーダに比べて競争性能が高いことを示した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:29:27 GMT)
NaviCache: Test-Time Self-Calibration Caching for Video Generation [82.9] NaviCacheはビデオ拡散モデルのためのテスト時間自己校正手法である。
基本的な領域ギャップと非定常的な拡散の性質を橋渡しする。
理論上は、誤差バウンド・スキップのメカニズムを提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:28:12 GMT)
ReasonCLIP-58M: Visually Grounded Commonsense Reasoning Supervision for CLIP [82.9] 提案するReasonCLIP-58Mは,大規模推論監視をCLIPスタイルのモデルに組み込む連続事前学習フレームワークである。
我々は、ゼロショット検索性能を向上しつつ、視覚的に接地されたコモンセンスと合成推論を改善するReasonCLIPのファミリーを訓練する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:27:54 GMT)
AgentX: Towards Agent-Driven Self-Iteration of Industrial Recommender Systems [82.3] AgentXはプロダクションデプロイされたマルチエージェントシステムで、このプロダクション機能を再構築する。
自律的に生成し、実装し、評価し、レコメンデーション実験から学ぶ。
AgentXは4つの密結合したステージをクローズドループでオーケストレーションする。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:42:28 GMT)
JuZhou 1.0 Technical Report: The First Edge-Native Text-to-Image Foundation Model Trained Entirely on China-Developed AI Accelerators [82.2] テキスト・ツー・イメージ(T2I)拡散モデルは通常、かなりの計算資源とクラウドインフラを必要とする。
We present JuZhou 1.0, a Ultra-lightweight T2I foundation model designed for complete offline, on-device execution。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:14:03 GMT)
Unison: Benchmarking Unified Multimodal Models via Synergistic Understanding and Generation [81.0] 統一マルチモーダルモデルにおける共同理解と生成を評価するためのベンチマークであるUnisonを紹介する。
Unisonは2,169の高品質な統合タスクサンプルで構成されている。
また,人間の判断に適合した評価モデルであるUnison-Judgeを紹介する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:58:54 GMT)
Perception, Verdict, and Evolution: Hindsight-Driven Self-Refining Forensics Agent for AI-Generated Image Detection [80.2] ForeAgentは、反復的な自己進化を伴うAI生成画像検出のためのエージェント法医学フレームワークである。
ForeAgentはChameleonベンチマークで最先端のパフォーマンスを達成し、精度は82.18%に達した。
ForeAgent は GPT-5 や GPT-5-mini と比較して、より一貫性があり、因果的な推論をもたらす。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:59:33 GMT)
Advancing Omnimodal Embodied Agents from Isolated Skills to Everyday Physical Autonomy [79.1] 非構造化環境で永続的なエンボディエージェントを構築するには、異種ツールの統一的なオーケストレーションが必要である。
我々は,多モーダルなセマンティックプランナを統合したフレームワークであるOmniActを紹介した。
すべての複雑性レベルにわたって、エンドツーエンドの成功において一貫した改善が達成されます。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:36:35 GMT)
Parametric Open Source Games [78.3] プログラム平衡の連続的な類似であるパラメトリックオープンソースゲームを導入する。
対称な2時間2ドルゲームにおける利己的な勾配上昇が、欠陥から協調へと切り替わる正確な結合閾値を導出する。
我々は、クロスプレイヤーとセルフプレイヤーの感度の比で一階協調条件が支配されるニューラルネットワークのセマンティクスクラスにフレームワークを拡張した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:14:24 GMT)
Autodata: An agentic data scientist to create high quality synthetic data [73.5] このようなデータサイエンティストエージェントを訓練(メタ最適化)する方法を示します。
我々は,計算機科学研究タスク,法的推論タスク,数学的対象による推論実験を行う。
この方向は、AIデータの構築方法を変える可能性がある、と私たちは信じています。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:26:50 GMT)
MemoBench: Benchmarking World Modeling in Dynamically Changing Environments [72.2] MemoBenchは動的に変化する環境において、消失・再出現するパラダイムを中心に構築された診断ベンチマークである。
合成シーンと実世界のシーンにまたがる360度地上トラスクリップをキュレートし,VQAに基づく評価と自動メトリクスを組み合わせた評価スイートを設計する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 20:37:39 GMT)
Information-Aware KV Cache Compression for Long Reasoning [71.8] 既存のKVキャッシュ圧縮法は主にトークンの重要性を推定するために注意重みに依存する。
情報理論を組み込んだエントロピー対応KVキャッシュ圧縮フレームワークである textbfInfoKV を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:03:37 GMT)
Qwen-Image-Agent: Bridging the Context Gap in Real-World Image Generation [70.6] 提案するQwen-Image-Agentは,計画,理由,探索,記憶,フィードバックをコンテキスト中心の方法で統合した統合エージェントフレームワークである。
Qwen-Image-Agentはユーザ入力を部分的コンテキストとして扱い、コンテキスト認識計画とコンテキストグラウンディングを通じて生成コンテキストを段階的に構築する。
IA-Bench, Mindbench, WISE-Verified の実験により, Qwen-Image-Agent は強いベースラインを上回り,最先端のパフォーマンスを達成することが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:40:12 GMT)
Cluster, Route, Escalate: Cascaded Framework for Cost-Aware LLM Serving [69.5] 大規模言語モデル(LLM)のための2段階カスケードソリューションを提案する。
ステージ1は、受信するクエリをクラスタ化し、各クラスタを最もコスト効率の良いモデルに割り当てる。
ステージ2は品質推定(QE)カスケードを追加し、ステージ1からの出力が低品質であると判断されると、クエリはより強力なモデルにエスカレーションされる。
テストデータセットでは、カスケードシステムは最強モデルの精度の97-99%を保持し、TPOT(Time Per Output Token)を削減している。
タスクの正確性ラベルのみを必要とし、手動で再構成することなくモデルプールの変更に適応する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:29:24 GMT)
Capacity-Controlled Multi-View Stylization of 3D Gaussian Splatting [66.3] 3DGSのマルチビュースタイリングのためのキャパシティ制御フレームワークを提案する。
可変強度のカラム容量制約を導入することにより,複数対1のマッチングが緩和される。
また、シーンコンテンツとスタイルパターンの対応を制約するために、新しいクロスビューマッチングガイダンスを組み込んだ。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:36:50 GMT)
Wan-Streamer v0.1: End-to-end Real-time Interactive Foundation Models [66.0] Wan-Streamerは、ローストリーミングインタラクションのためのエンドツーエンドのインタラクティブ基盤モデルである。
音声とビデオは、入力と出力の両方を単一のTransformerシーケンスでシームレスにモデル化する。
およそ200msのモデル側レスポンスレイテンシと、合計550msのインタラクションレイテンシを実現している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:59:51 GMT)
Improving General Role-Playing Agents via Psychology-Grounded Reasoning and Role-Aware Policy Optimization [62.8] Psy-CoTは、事前応答推論を3つの役割固有のステップに分解する、思考の連鎖フレームワークである。
CoSER, CharacterBench, CharacterEvalの実験は、Psy-CoTが既存のロールプレイングCoTメソッドより優れていることを示した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:34:47 GMT)
DanceOPD: On-Policy Generative Field Distillation [62.3] 本研究では,フローマッチングモデルのためのオンライン生成フィールド蒸留フレームワークであるDanceOPDを紹介する。
各サンプルを1つの機能フィールドにルーティングし、1つの低雑音の学生が引き起こした状態をクエリし、単純な速度MSE目的のトレーニングを行う。
T2I, 編集, リアリズム-フィールド吸収, CFG吸収に関する総合的な実験により, 提案手法は多機能化を図っている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:59:58 GMT)
Erase-then-Delta Attention: Decoupling Erase and Write Addresses in Delta-Rule Linear Attention [62.0] Delta-ruleリニアアテンションは、現在の書き込みアドレスに保存されているものを修正することで、リカレントメモリ更新を改善する。
本稿では,Erase-then-Delta Attention (EDA)を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:12:19 GMT)
Reasoning Quality Emerges Early: Data Curation for Reasoning Models [58.6] 我々は,初期推論トークンのみを用いて,多種多様かつ挑戦的な推論例を識別可能であることを示す。
本手法は,トークン効率を91%向上させながら,既存のベースラインを最大1.7%向上させる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:32:58 GMT)
Blackwell Approachability and Gradient Equilibrium are Equivalent [58.4] グラディエント平衡(GEQ)は,ブラックボックスオラクルへのクエリを用いて常に解けるという意味で,ブラックウェルのアプローチ可能性と同値であることを示す。
我々の削減は効率的であり、楽観主義や強い適応性といった洗練された保証を、後悔の最小化からGEQへの移行に利用することができる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:29:48 GMT)
Agentic Collaborative Cognition for Zero-Shot 3D Understanding [57.9] 本研究では,高レベル視点計画の処理に計画エージェントを割り当てる協調型マルチエージェントフレームワークを提案する。
知覚エージェントは、3Dシーンを構造化された全体的認知マップに明示的に要約する。
ScanReferでは11.1%のAcc@0.5、3D支援ダイアログでは14.6 BLEU-1、SQA3Dでは2.1 EM、最先端の6ベンチマークでは2.1 EMを実現している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:22:24 GMT)
Bridging Talk and Thought: Understanding Dialogue Dynamics Across Collaborative Problem-Solving Contexts [57.8] 本稿では,協調的問題解決における対話の分析のための概念的枠組みを提案する。
本フレームワークは,認知的・非認知的問題解決とメタ認知的制御機構を統合する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:20:49 GMT)
PhysiFormer: Learning to Simulate Mechanics in World Space [56.2] 物理的に表現可能な3次元物体運動のための拡散変換器であるPhysorFormerを提案する。
世界座標で表される3Dメッシュとしてオブジェクトを表す。
これは、軌道精度、剛性保存、運動量に基づく物理的一貫性において、自己回帰ベースラインを大幅に上回る。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:59:00 GMT)
PortraitGen: Exemplar-Driven GRPO with Dual-Reward Guidance for Photorealistic Portrait Generation [54.9] フォトリアリスティックな肖像画生成に適した新しいフレームワークであるPortraitGenを提案する。
まず、実画像を直接GRPOサンプリンググループに導入することで、固有の生成境界を破る。
OmniReward for general quality と AI-Portrait for human-centric fidelity。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:05:40 GMT)
Directed Graph Topology Inference via Graph Filter Identification [54.5] 本稿では,グラフ畳み込みフィルタが生成するノイズ測定から有向ネットワークを推定する問題に対処する。
また、上記のステップを交互に交互に組み合わせて、サンプルの複雑さを向上する結合グラフフィルタとトポロジー同定アルゴリズムを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:25:57 GMT)
Sculpting NeRF Geometry: Human-Preference Fine-Tuning of a 3D-Aware Face GAN [54.4] 学習報酬から直接、事前学習した3D認識生成モデルを微調整する。
このモデルは事前訓練を必要とせず、小さな好みのサンプルで容易に訓練し、3次元幾何学において堅牢な改善をもたらす。
密度一貫性制約は、2次元の外観を定性的に類似させ、幾何が再形成され、測定可能だが有界な分布コストで保持する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:26:06 GMT)
TOPS: First-Principles Visual Token Pruning via Constructing Token Optimal Preservation Sets for Efficient MLLM Inference [54.4] マルチモーダル大言語モデル(MLLM)は強力なマルチモーダル推論機能を実現しているが、その効率は多数の視覚トークンによって制限されている。
Visual token pruningは自然なソリューションを提供するが、既存のメソッドは不完全である。
各種MLLMに適用可能なトレーニングフリーでモデルに依存しないプルーニングモジュールTOPSを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:29:37 GMT)
DiCoBench: Benchmarking Multi-Image Fine-Grained Perception via Differential and Commonality Visual Cues [54.3] DiCoBenchは、きめ細かい知覚のための包括的でマルチイメージの高解像度のベンチマークである。
評価の結果,人的精度 (98.3%) と比較して顕著な性能差がみられた。
DiCoBenchは、自律的で高解像度のマルチイメージ知覚における将来の研究を促進するための、挑戦的なテストベッドとして機能すると考えています。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:02:38 GMT)
Paying More Attention to Visual Tokens in Self-Evolving Large Multimodal Models [54.1] 現在の自己進化型LMMは、イメージキャプションや視覚的質問応答といった視覚言語理解タスクに苦慮している。
モデルの視覚条件を直接正規化する,純粋に教師なしの自己進化型フレームワークであるVISEを提案する。
VISEは、専門的な役割、外部報酬モデル、アノテーションなしで単一のモデル内で動作します。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:59:55 GMT)
Tactile-WAM: Touch-Aware World Action Model with Tactile Asymmetric Attention [53.8] 触覚非対称注意機構(TAAM)を備えたタッチ対応WAMであるTactile-WAMを提案する。
ManiFeelでは、Tactile-WAMは平均成功率を38.9%改善し、コンタクトリッチタスクでは86%改善した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:54:56 GMT)
Do Image Editing Models Understand Lighting? [52.7] 我々は、3Dアンコールライトプローブ(3DLP)ベンチマークを導入し、現実世界の照明変化の高忠実度HDRデータセットを新たに取得した。
データセットは、光プローブを物理的にオン/オフする、多様な屋内風景の1Kイメージ対で構成されている。
我々は,光プローブの編集精度と現実性との整合性を評価することによって,最先端の画像編集モデルの評価を行った。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:20:34 GMT)
Ask, Solve, Generate: Self-Evolving Unified Multimodal Understanding and Generation via Self-Consistency Rewards [52.4] 視覚的理解と画像生成の両方をサポートするほとんどの統合された大型マルチモーダルモデル(LMM)は、訓練後の監督に頼っている。
本稿では,3つの内部的役割を持つ自己進化型トレーニングフレームワークを提案する。 視覚的質問を生成するプロポーラ, 回答と評価を行うソルバ, 画像を生成するジェネレータである。
画像生成のために,質問文の忠実度とサイクル一貫性キャプションを組み合わせたマルチスケール内部評価手法を設計する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:59:57 GMT)
Position Rebinding Cache Reuse: Replay-Free Visual Revisiting for Interleaved Multimodal Reasoning [51.6] マルチモーダル推論は、マルチステップ生成中に視覚的証拠を再考することによって、視覚的接地を改善する。
再生不要な視覚的再考のためのキャッシュレベルフレームワークであるPlace Rebinding Cache Reuse (PRCR)を提案する。
PRCRはリプレイレベルまたはパフォーマンスの向上を実現し、平均精度を5%向上し、視覚的再考を最大数万倍削減する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:47:52 GMT)
LA4VLA: Learning to Act without Seeing via Language-Action Pretraining [51.2] VLA(Vision-Language-Action)モデルは、視覚的な観察と言語指示を共同で行動にマッピングすることで、ロボットのデモンストレーションで一般的に事前訓練される。
LA4VLAは、視覚的観察なしに、ポリシーが言語条件付きアクションの事前取得を可能にする、言語行動事前訓練フレームワークである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:13:02 GMT)
SocialPersona: Benchmarking Personalized Profiling and Response with Multimodal Social-Media Context [51.2] SocialPersonaは、マルチモーダルな大規模言語モデル(MLLM)が、縦方向のソーシャルメディアタイムラインから明らかにされた好みを回復し、対話で使用することができるかどうかを評価するためのベンチマークである。
SocialPersonaには、テキスト、画像、タイムスタンプ、および7つの関心領域にまたがる2,597の人間認証された好みタグが含まれている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:31:56 GMT)
SemCityLoc: Aerial 6DoF Localization Using Semantic 3D City Models [51.1] 本研究では,空中ポーズ推定を再構成する意味幾何学的アライメントシステムSemCityLocを提案する。
粗い輪郭や密集したテクスチャをマッチングする代わりに、本手法は、セマンティックサーフェスとモノクルディープを軽量なセマンティック3Dビルディングモデルと整合させる。
実験は、既存のマップベースのアプローチよりも大幅に改善されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:13:39 GMT)
EO-WM: A Physically Informed World Model for Probabilistic Earth Observation Forecasting [50.3] マルチスペクトル地球観測予測のためのビデオ拡散変換器であるEO-WMを紹介する。
EO-WMは、気象基準線、気象異常、累積的な物理的ストレス信号を通して気象的な強制力を表す物理的に情報を得た条件付けフレームワークを組み込んでいる。
実験の結果、EO-WMは予測正規化植生指数(NDVI)の減少振幅を相対5.63%減少させ、方向のヒット率を相対7.80%向上させることがわかった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:53:30 GMT)
OctoSense: Self-Supervised Learning for Multimodal Robot Perception [50.2] ステレオカメラとイベントカメラ、LiDAR、サーマルカメラ、慣性測定ユニット、プロプリセプション(車からのCANバスデータ、四足歩行ロボットの関節角度)を備えたオープンソースのセンサプラットフォームであるOctoSenseについて述べる。
匿名のOctoSenseデータセットには、59時間の時間同期駆動データが含まれている。
このような実世界のデータを用いて,センサの表現,周波数,レイテンシ,ノイズの異なるマルチモーダル自己教師型学習を実演する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:30:49 GMT)
CoVStream: Edge-Cloud Collaboration for Understanding of Long Video Streams [49.9] CoVStreamは、長いビデオストリームを理解するための最初のエッジクラウド協調フレームワークである。
生のビデオストリームを、コンパクトな視覚的特徴と、クラウドへの送信のためのセマンティックキャプションに蒸留し、帯域幅のコストを最小化する。
実験によると、CoVStreamは、クラウドベースラインの精度の99.2%を維持しながら、帯域幅を87.6%削減している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:29:16 GMT)
Focusing on What Matters: Saliency-Harnessing Accurate Routing for Diffusion MoE [49.5] Mixture-of-Experts (MoE)アーキテクチャは、視覚生成における拡散モデルをスケールするための強力なパラダイムとして登場した。
シャープモエ(SharpMoE)は,サリエンシハーネスの正確なルーティング機構を備えたポストトレーニングフレームワークである。
ノイズ歪んだ入力をバイパスすることで、SharpMoEはルータに明確なサリエンシガイダンスを提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:13:40 GMT)
The Generalization Spectrum: A Chromatographic Approach to Evaluating Learning Algorithms [48.6] 従来の評価は、i.d.テストセット上での学習アルゴリズムの最終性能を測定し、学習を1つの集計スコアに還元する。
このアプローチは、基本的な疑問を曖昧にしている — 特定の例から学ぶことは、どの程度他人に一般化されるのか?
この隠蔽次元を公開するために設計された評価フレームワークであるGeneralization Spectrumを紹介する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:37:45 GMT)
Latent Diffusion Posterior Sampling with Surrogate Likelihood Guidance for PDE Inverse Problems [48.2] 潜在空間拡散後サンプリング(L-DPS)は偏微分方程式(PDE)によって支配される高次元逆問題に対する近似ベイズ的枠組みである
L-DPSは、正確で堅牢な逆解を生成し、フルスペースDPSに対する推論コストを低減し、スパースおよびノイズレシエーションにおいて、償却された逆ベースラインより優れる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:33:44 GMT)
Safe Autoregressive Image Generation with Iterative Self-Improving Codebooks [47.9] 自己回帰統合マルチモーダルモデルは、離散化された視覚トークンを逐次予測することによって画像を生成する。
このような自己回帰的な方法で生成された画像は、どの程度安全か?
安全な自己回帰生成のための反復的自己改善コードブックを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:18:31 GMT)
Reinforcement Learning without Ground-Truth Solutions can Improve LLMs [47.0] LLMを訓練するための検証可能な報酬(RLVR)による強化学習は、典型的には報酬を割り当てるために根底からの回答に依存している。
我々は,スコアベース最適化タスクにLLMをトレーニングするtextbfRanking-textbf誘発のtextbfverible framework (RiVER)を導入する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:59:36 GMT)
EvoEmbedding: Evolvable Representations for Long-Context Retrieval and Agentic Memory [46.4] EvoEmbeddingは、検索のための進化可能な表現を生成する新しい埋め込みモデルである。
情報は動的でシーケンシャルで、継続的な状態追跡を必要とする、長期コンテキストシナリオ用に調整されている。
EvoEmbeddingは、パフォーマンスを高めるためにエージェントにシームレスに統合される。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:16:13 GMT)
UniFormer: Efficient and Unified Model-Centric Scaling for Industrial Recommendation [46.1] UniFormerは、産業レコメンデーションシステムのための効率的で統一されたモデル中心のスケーリングフレームワークである。
効率を改善するために、UniFormerは全体のモデリング空間を機能空間とタスク空間に分解する。
UniFormerは、ユーザーエンゲージメントとインタラクションのメトリクスを継続的に改善します。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:03:28 GMT)
LMs as Task-Specific Knowledge Bases: An Interpretability Analysis [45.9] タスク固有の方法で知識を符号化する言語モデルについて検討する。
本研究では,あるタスクで獲得した事実が,トレーニング中に他のタスクと共存することができないことを示す。
連鎖推論は, 評価課題に関連づけられたパラメータよりも, タスク固有のパラメータを係合させることによって, その有効性の一部を引き出すことを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:22:43 GMT)
Magnetic long-range order at finite temperature in two-dimensional hyperbolic lattices [45.9] ギャップレスゴールドストーンモードの赤外特異点は、従来の2次元系の有限温度における磁気的長距離秩序を阻害する。
対称性によって要求されるゼロエネルギー集合モードは、局所的なスペクトル重みを消滅させる。
熱スピン波補正から順序モーメントまでの順序温度を推定する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:00:01 GMT)
COOPA: A Modular LLM Agent Architecture for Operations Research Problems [45.4] Operations Research (OR)は、高い意思決定のための厳格な枠組みを提供する。
最近のLSMベースのシステムはパイプラインの一部を自動化しているが、複雑な問題に対して低い精度で制限されている。
本稿では,解釈可能かつスケーラブルなOR決定支援のためのモジュール型LLMエージェントアーキテクチャであるCOOPAを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 23:56:58 GMT)
JetSpec: Breaking the Scaling Ceiling of Speculative Decoding with Parallel Tree Drafting [44.7] 投機的復号(SD)は、複数のトークンを起草し、それらを並列に検証することによって、自己回帰的大規模言語モデル(LLM)を加速する。
従来のヘッドベースSD法は因果効率ジレンマに直面していた。
本稿では,一方向起案効率と分岐的因果条件を組み合わせたヘッドベースSDフレームワークJetSpecを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:18:29 GMT)
Nemotron-TwoTower: Diffusion Language Modeling with Pretrained Autoregressive Context [44.4] TwoTowerはブロックワイドの自己回帰拡散モデルで、役割を2つの塔に分離する。
Nemotron-3-Nano-30B-A3Bは30BハイブリッドのMamba-Transformer MoEモデルで、約2.1Tトークンで訓練された。
コードとモデルの重み付けはhttps://huggingface.co/collections/nemotron-twotower.comで公開しています。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:52:44 GMT)
Rolling Shutter Relative Pose Estimation Made Practical [44.3] ローリングシャッター(RS)カメラは、ほぼすべての消費者向けデバイスに装備されているが、RS対応の相対ポーズ推定は実用的ではない。
RS2ビュー幾何にアフィン対応を導入することで、RS相対ポーズ推定を実践する。
線形化代数解法を開発し、7つのACからポーズとRSの運動を推定する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:47:53 GMT)
PMDformer: Patch-Mean Decoupling Information Transformer for Long-term Forecasting [44.1] 長期時系列予測(LTSF)は、エネルギー管理、金融、交通予測といった分野において重要な役割を果たす。
本稿では,各パッチの平均値を減じることで,傾向と残留形状情報を分離するパッチ平均デカップリング(PMD)を提案する。
さらに、より効果的に長距離依存関係をモデル化し、異種間関係を捉えるために、進化回復注意(TRA)とPVA(Pximal Variable Attention)を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:49:08 GMT)
G2DP: Diffusion Planning with Spatio-Temporal Grid Guidance [44.0] 自律運転において、拡散に基づくプランナーは、密集した対話的な交通におけるロバストな動き計画のための有望なパラダイムとして現れてきた。
既存のガイダンスは、通常、スパースでエンティティ中心の幾何学的クエリやポストホックの洗練に依存し、インタラクティブなシーンにおいて限られた認識と脆弱なパフォーマンスをもたらす。
G2DP(GuidedGrid-Guided Planning)は,経路時マップによる確率的将来の占領指導を融合させることにより,時間的費用の変動を図っている。
nuPlanの最先端のパフォーマンスを達成し、リアクティブトランスファーにおいて、最強の模倣学習ベースラインを+7.2ポイント上回る。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:22:23 GMT)
In-Context World Modeling for Robotic Control [43.3] In-Context World Modeling (ICWM) は,システム識別を文脈内適応問題として扱うフレームワークである。
ICWMは、自己生成されたタスク非依存的相互作用の短い歴史から、ロボットポリシーが重要なシステム変数を自律的に推論することを可能にする。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:51:45 GMT)
RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation [43.3] RayPEは、位置エンコーディング拡張で、トークンごとの6D Plucker座標を、自己注意のクエリとキーに付加的に注入する。
結果として得られた注意スコアは、内容項、幾何学用語、および2つの内容と幾何学的相互項に分解される。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:51:02 GMT)
GRAFT: Biological Graph and Hypergraph Benchmarks for Linked Gene Expression and Phenotypic Trait Prediction in Arabidopsis thaliana [42.5] シロイヌナズナにおける遺伝子発現プロファイルと表現型形質測定をリンクする新しいデータセットを提案する。
GRAFTは表現型予測や解釈可能なグラフ学習などのタスクをサポートする。
これは、同じシロイヌナズナの標本に対して、マルチモーダル遺伝子情報および異種形質または表現型データを提供する最初のデータセットである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:02:38 GMT)
PlanRL: A Trajectory Planning Architecture for Reinforcement Learning-based Driving Experts [42.3] 強化学習(Reinforcement Learning, RL)は、自動運転車の運転専門家を育成するための重要なフレームワークとなっている。
本稿では、RLポリシーをキネマティックベースの軌道プランナーと統合したRL駆動の専門家のための新しい軌道計画アーキテクチャを提案する。
我々はCARLAベンチマークに対する我々のアプローチを評価し、既存の制御ベースのRL専門家を著しく上回っている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:42:15 GMT)
SAM2Matting: Generalized Image and Video Matting [42.3] SAM2Mattingは、VOSトラッカーを高忠実度ビデオマッティングに進化させるトラッカー・ツー・マッティングフレームワークである。
ビデオマッティングに新たな最先端パフォーマンスを確立し、多様なプロンプトタイプをサポートし、時間的一貫性を強く維持し、人間中心のシナリオと戦時シナリオの両方にわたって堅牢な一般化を実証する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:48:27 GMT)
See & Sniff: Learning Visuo-Olfactory Representations [42.3] SmellNet-Vは,匂いの識別が意味圏内の視覚的変換にほとんど不変であるという知見に基づいて構築された,スケーラブルなビズオ嗅覚データセットである。
これにより、ニオイのみのサンプルをセマンティックに整列したWebイメージで合成し、アンモダル嗅覚データセットをクロスモーダルベンチマークに変換することができる。
本研究では,密集した局所的アライメントを通じて共同嗅覚表現を学習する自己教師型フレームワークであるSeee & Sniffを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:26:47 GMT)
Vulnerability of Natural Language Classifiers to Evolutionary Generated Adversarial Text [42.2] 本稿では,自然言語モデルに対する敵対的攻撃を生成するハイブリッド遺伝的アルゴリズム(GA)を提案する。
GAversaryは、BAEやA2T攻撃と比較して、テストデータに対するターゲットモデルの精度を大幅に削減することができる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:05:38 GMT)
ReWorld: Learning Better Representations for World Action Models [41.9] 世界行動モデル(WAM)は、行動条件下での将来の環境進化をモデル化する。
WAM向けに設計された最初の表現学習フレームワークであるReWorldを提案する。
ReWorldは、FVDの微調整ビデオ生成を23.9%改善することを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:37:58 GMT)
Learning Stable Canonical Worlds for Novel View Synthesis and Beyond [41.4] 乱雑な多視点観測を安定したシーン中心の表現にマッピングするフィードフォワードパイプラインであるCanonicalGSを紹介した。
新規なビューを合成するためのピーク信号対雑音比が2.5ドル向上し、セマンティックセグメンテーションの精度が11%向上した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:36:03 GMT)
Smaller Models, Unexpected Costs: Trade-offs in LLM Quantization for Automated Program Repair [41.1] 言語モデル(LLM)の量子化は、しばしばベンチマークスコアによって要約される。
異なるビット幅,方法,および対象成分(重みおよびKVcache)を6つの代表LDMに分散した13の量子化構成を分析し,APRベンチマークで評価した。
以上の結果から, ベースモデルと量子化モデルでは, 補修問題と同等の数の補修問題を保ちながら, 重なりがほとんどない異なる補修問題セットを提供できることがわかった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:02:05 GMT)
Term-Centric Hierarchy Induction from Heterogeneous Corpora [39.0] 本稿では,大規模文書コレクションにスケールする階層コーパスを誘導する用語中心のフレームワークを提案する。
提案手法は,文書を多種多様な情報源から自動用語抽出を用いて共有表現空間にマッピングする。
100万以上の文書からなる新しい英語とドイツ語のマルチソースベンチマーク実験により,我々の手法は,ソース間のコヒーレンスと階層的品質を向上することを示した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:37:33 GMT)
Empowering GUI Agents via Autonomous Experience Exploration and Hindsight Experience Utilization for Task Planning [39.0] 小さなオープンソースMLLMは、弱い計画と限られたクロスウェブサイトの一般化に悩まされている。
本研究では,環境を自律的に探索して経験を発見するPEEU手法を提案する。
実世界のベンチマーク実験はPEEUの優れた性能を示し、より大きなQwen2.5-VL-32Bモデルを上回った。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:44:48 GMT)
MiniOpt: Reasoning to Model and Solve General Optimization Problems with Limited Resources [38.2] MiniOptは、最適化問題を解決するための強化学習フレームワークである。
定式化と解法を共同で評価する階層的なスコア構造を持つ報酬関数である OptReward を導入する。
実験により、MiniOpt-3Bは様々な最適化タイプ、問題シナリオ、タスク領域にまたがる強力な最適化の一般化を示すことが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:38:04 GMT)
When are likely answers right? On Sequence Probability and Correctness in LLMs [38.1] 順序確率、すなわち、プロンプトが与えられた連続の条件付き確率は、実際は正しさと一致しているか?
我々は、この関係をデコード方法、モデル、ベンチマークで4つのレベルで定量化する。
高いシーケンス確率は、固定されたデータセット内のプロンプト・アンサー・ペア間での正確性を予測することがよくある。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:58:02 GMT)
Generative Retrieval via Diffusion Transformer with Metric-Ordered Sequence Training and Hybrid-Policy Preference Optimization [37.9] 埋め込みベースの検索は、共有ベクトル空間内のクエリと類似度でアイテムをランク付けする。
我々はこれをパターン保存属性検索として定式化する。
そこで我々は,MO-DiT+HPPOを提案する。MO-DiT+HPPO,生系列事前学習,メートル順序継続事前学習,テールセントロイド微調整,HPPO。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:29:51 GMT)
Multilingual Reasoning Cascades Need More Context [36.8] 文脈対応翻訳カスケードは、原質問、英訳質問、および、最終翻訳モジュールの文脈にさかのぼる推論を与える。
本研究は,誤りの伝播を緩和するために,機械翻訳カスケードにおける情報フローのより良い設計の必要性を強調した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:26:46 GMT)
Theory-Scale Auto-Formalization of Logics for Computer Science [36.5] LCS-Bench は Logics for Computer Science に基づく理論スケールのベンチマークである。
アーティファクトには327の教科書項目,4,076以上のリーン宣言,85万行以上のリーンコードが含まれています。
LCS-Benchは高品質で一貫性があり、忠実であることを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:59:53 GMT)
Counting Trees from Satellite Imagery with Noisy Supervision [36.4] 個々の木を数えることは環境モニタリングの基本的な課題であるが、衛星画像ではほとんど探索されていない。
不均衡最適輸送を通した空間密度マッチング問題として木数法を定式化する。
3大陸と3つの衛星センサーにまたがる新しいベンチマークであるTinyTreesに対する我々のアプローチを評価した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:16:05 GMT)
A Latent ODE Approach to Spatiotemporal Modeling of Cine Cardiac MRI [35.8] 両心室解剖とフルサイクルシネ運動を連続的軌跡として符号化する潜在力学モデルを提案する。
循環器疾患を伴わない英国バイオバンク72,386名を対象に,心不全367例を含む調査を行った。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:53:45 GMT)
PressMimic: Pressure-Guided Motion Capture and Control for Humanoid Robot Imitation [35.4] PressMimicは、モーションキャプチャからヒューマノイドコントロールまでの完全なパイプラインに圧力を統合するフレームワークである。
認識段階では,RGBと圧力を融合したマルチモーダルモデルであるFRAPPE++を導入し,共同で3次元ポーズとグローバルモーションを推定する。
制御段階では,圧力依存性の信号を強化学習に組み込んだ圧力制御ポリシ(PSP)を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:24:35 GMT)
CORTEX: A Structured Reasoning Benchmark for Trustworthy 3D Chest CT MLLMs [35.4] 我々は3次元胸部CTのための構造化推論ベンチマークであるCORTEXを紹介する。
各質問に対して、CORTEXは欠落した推論を4段階の診断トレースとして復元する。
CORTEXは、オープンエンドVQA、クローズドエンドVQA、レポート生成を含む76,177個の検証された推論トレースからなる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:47:05 GMT)
Multi-parameter two-photon polarimetry at the quantum limit [35.4] フォトニック量子メートル法は、幅広い応用において精度と資源効率の利点を証明している。
本稿では,2つの偏光パラメータにおいて,基本量子クラメル・ラオ精度境界(QCRB)に同時にアプローチする実験プロトコルを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:00:05 GMT)
VoiceTTA: Enhancing Zero-Shot Text-to-Speech via Reinforcement Learning-Based Test-Time Adaptation [35.0] VoiceTTAは、事前訓練されたゼロショットTSモデルの音声模倣を改善する強化学習ベースのテスト時間適応(TTA)手法である。
実験は、一般的でない音声のプロンプトを大幅に改善し、最先端のベースラインを上回った。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:18:24 GMT)
Large Language Model Teaches Visual Students: Cross-Modality Transfer of Fine-Grained Conceptual Knowledge [35.0] 言語のみの教師から視覚のみの学生モデルへ高レベルの意味的知識を伝達するためのフレームワークであるLaViD-Language-to-Visual Knowledge Distillationを提案する。
LaViDは、視覚クラス間のセマンティックな区別を探索するマルチチョイス質問(MCQ)を生成するように促すことで、LLMから概念的なシグナルを引き出す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 20:19:50 GMT)
CascadeFormer: Depth-Tapered Transformers Motivated by Gradient Fan-in Asymmetry [34.4] ディープトランスフォーマーは、一様に積み重ねられた残余ブロックで構成されているが、最も深いレイヤは、ほとんど価値を与えない。
この非対称性を利用する2つの効率方法を提案する。
CascadeFormerは、レイヤー間の不均一な情報フローに一致する深さで幅をテーパーし、同じトレーニング予算で均一なベースラインに匹敵する難易度を実現し、レイテンシを8.6%削減し、スループットを9.4%向上させた。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:25:00 GMT)
A Generalization Theory for JEPA-Based World Models [34.1] JEPA(Joint Embedding Predictive Architectures)は、世界モデリングのための有望なパラダイムとして登場した。
実証的な成功にもかかわらず、JEPAベースの世界モデルの理論的理解は依然として限られている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:29:20 GMT)
Asymptotically Optimal Learning for Parametric Prophet Inequalities [34.1] 我々は指数型パラメトリック・ファミリーから引き出された報酬を未知のパラメータ$$.d.で予言の不等式で学習する。
まず、この家族の最適な全情報競合比を特徴付ける。
次に、オンライン学習のための信頼性に基づく動的プログラミングポリシーを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:26:16 GMT)
Structure Before Collapse: Transient semantic geometry in next-token prediction [33.9] Neural Collapseは、バランスの取れたワンホット分類が、モデル表現を互いに等しく遠くにプッシュする、と予測する。
次世代の予測言語モデルは、主にワンホットラベルでトレーニングされる。
トレーニングの初期に意味幾何学が出現し,共有属性によるクラスタ表現が現れる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:33:34 GMT)
Coarse-to-Fine: A Hybrid Self-Supervised Method for Non-rigid 3D Shape Matching [33.8] 非剛体3次元形状マッチングはコンピュータビジョンとグラフィックスの基本的な課題である。
本稿では,粗大な戦略に基づくハイブリッド自己管理手法を提案する。
提案手法は,様々な難題にまたがって最先端のパフォーマンスを実現する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:08:41 GMT)
AIGP: An LLM-Based Framework for Long-Term Value Alignment in E-Commerce Pricing [33.5] 我々は,Large Language Model (LLM) を利用して,解釈可能な知識を考慮した価格決定を行う新しいフレームワークであるAIGPを提案する。
AIGPの中心はLong-Term Value Estimator (LTVE)であり、過去のデータに対するオフラインの強化学習を通じてトレーニングされている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:21:42 GMT)
Beyond MoCap: Scaling Motion Tokenizers with Synthetic Human Motion for Generative Modeling [32.8] 本研究では,大規模合成人間の動きを利用して,動きの表現空間を拡大する枠組みを提案する。
狭義のデータ分布で訓練された従来のトークン化ツールとは異なり,本手法はトレーニング分布と離散コードブックの両方を共同でスケールする。
合成運動を用いた学習が学習運動語彙のカバレッジと構成性を大幅に向上させることを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 20:50:31 GMT)
Learning User Simulators with Turing Rewards [32.7] 対話的な環境でのユーザをシミュレートする学習は、エージェントアシスタントのトレーニング、パーソナライズシステムの評価などを促進する可能性がある。
本研究では,ユーザシミュレータモデルをトレーニングするためのチューリングテストに基づく強化学習手法であるチューリング-RLを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:03:06 GMT)
SceneBot: Contact-Prompted General Humanoid Whole Body Tracking with Scene-Interaction [32.6] 現在のヒューマノイド強化学習政策は、自由空間運動において優れているが、接触に富むタスクに苦慮している。
SceneBotは、自由空間の移動と全身操作を扱える統合されたモーショントラッキングフレームワークである。
この結果から,SceneBotは,複雑な長期タスクを実行する自由空間とコンタクトリッチな動作をシームレスに統一する最初の汎用フレームワークであることが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:13:29 GMT)
Algebraic structures of the Lindblad equation [32.5] 散逸ダイナミクスは純粋にユニタリ進化よりもかなりリッチな代数構造を必要とすることを示す。
提案フレームワークは有限次元リンドブラッド力学の一般的な数学的記述と、効率的な解析的および数値的実装のための実践的基礎を提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:28:13 GMT)
Hardware Design for Table Tennis Robot Capable of Beating Professional Players [32.4] 本稿では,卓球ロボットがプロ選手を倒すために必要なハードウェア仕様に焦点を当てる。
エリート選手の動きを分析した後、作業空間、ペイロード、外部力抵抗、物理的性能、サービス能力、エンドエフェクタ精度の目標仕様を定義した。
これらの仕様に基づき,カスタム8-DoFロボット「エース」を開発した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:14:03 GMT)
Internalizing the Future: A Unified Agentic Training Paradigm for World Model Planning [32.3] 大規模言語モデル(LLM)エージェントは、シーケンシャルな意思決定において強力な能力を示している。
コミットメントの前に潜在的な計画を評価するために「What-if」推論を採用する人間とは異なり、標準エージェントは将来の成果をシミュレートする内的世界モデルが欠如している。
本研究では,1つの自己回帰モデルを訓練し,将来的な状態展開と計画条件による成功推定の両方を言語化することにより,将来の計画の内在化を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:05:44 GMT)
Soft Token Alignment for Cross-Lingual Reasoning [31.9] SOLARは教師付き微調整のための補助的目的であり、言語間でソフトトケン表現を整列させる。
次に、共有埋め込み空間において、各非英語のソフトトーケン要約を英語のそれと一致させる。
SOLARの精度はベースモデルで+17.7ポイント、標準教師付き微調整で+3.8ポイント向上している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:01:58 GMT)
DFM: Difference Feature Modeling with Text-Guided Gated Contrastive Loss for Remote Sensing Image Change Captioning [30.8] リモートセンシング画像変化キャプション(RSICC)のエンコーダは、異なる時刻にキャプチャされたリモートセンシング画像間の変化を自動生成する。
本稿では,1つの自己回帰生成パラダイムを置き換えるための差分特徴モデリング(DFM)フレームワークを提案する。
特に,テキストモダルの観点から重要な特徴を抽出するビジョンを導くために,テキストガイド付きGated Contrastive Loss (TGCL)を導入する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:49:21 GMT)
Confidence-Aware Tool Orchestration for Robust Video Understanding [30.4] 本稿では,フレーム単位の信頼性を推論のあらゆる段階に統合するエージェントビデオ理解フレームワークであるRobust-TOを提案する。
8つのタスクにまたがる2つのビデオ推論ベンチマークで、Robost-TOはクリーンな入力で平均56.4%の精度を達成した。
5つの現実的な汚職タイプの下では、Robust-TOは54.3%の平均精度を維持し、5.8%が最強のオープンソースベースラインより上である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:37:51 GMT)
SpatialFlow-GRPO: Where Spatial Credit Drives Image Editing [29.7] 本研究では,空間的に微粒な報酬フィードバックを導入するトレーニングフレームワークであるSpatialFlow-GRPOを提案する。
このフレームワークは、地域対応報酬を意味領域レベルの最適化信号に変換し、ポリシー更新中に対応する潜在位置とリージョンの利点を一致させる。
その結果,SpatialFlow-GRPOは局所的なフィードバックを空間的に整合した更新信号に変換し,編集品質を向上することを示した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:58:25 GMT)
LayersReg: A Layer-by-Layer Progressive Regressor for Reliable Intraoperative 3D/2D Registration [29.6] 3D/2Dの登録は、外科ナビゲーションの基盤となる技術である。
深層学習に基づく手法は、反復最適化から画像の外観特徴を空間的ポーズにマッピングする回帰問題への登録を再構成する。
本稿では,3次元解剖学的認識をモデルにもたらす先駆的回帰パラダイムであるLayersRegを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:21:52 GMT)
PhysReflect-VLA: Physical Feasibility and Self-Reflective Regulation for Reliable Vision-Language-Action Policies [29.5] ロングホライゾンのロボット操作は、物理的に実現不可能な遷移、接触による障害、実行中の効果的な自己補正の欠如に非常に敏感である。
本稿では,PhysReflect-VLAを提案する。PhysReflect-VLAは,クローズドループ制御パイプラインにおいて,VLAポリシーを物理的実現可能性評価と構造化自己回帰により拡張する,プラグアンドプレイ実行時信頼性フレームワークである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:18:10 GMT)
Extracting Neural Materials from Multi-view Images [29.3] 画像から空間的に変化するニューラル物質を抽出する,微分可能な逆レンダリング手法であるNeuMatExを提案する。
我々は、画像から初期色、ニューラルネットワーク潜伏剤、およびアレタリック不確実性ガイドを直接予測する大規模材料再構成モデル(LMRM)を訓練する。
合成および実資産の実験により、NeuMatExはPBR法よりも優れた視覚的品質と物質分解を有する複雑な物質を抽出することが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:50:32 GMT)
Full spectrum Unlearnable Examples via Spectral Equalization [29.2] スペクトル等化(FUSE)によるフルスペクトル未学習例を提案する。
FUSEは、異なるバンドからのコントリビューションを等しくし、バンド間の一貫性を強制することにより、スペクトルに依存しない摂動を生成する。
複数のデータセット、アーキテクチャ、スペクトルフィルタリングにわたる実験は、FUSEによって達成された強力な保護を示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:53:53 GMT)
Dual-Prior Guided Null-Space Learning with Mixture-of-Splines for Arbitrary Medical Slice Super-Resolution [28.9] 超解像は、任意のスケールで中間スライスを合成することにより異方性の臨床的取得から等方性ボリュームを再構成する。
この不適切な逆問題を、制約のない残差に基づく回帰リスクとして扱うことで、不明瞭な構造を幻覚させる。
本稿では,2つの相補的事前に導かれる制約付き回復過程としてタスクを再構成するDual-Prior Null-space Learningフレームワークを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:53:36 GMT)
HarmVideoBench: Benchmarking Harmful Video Understanding in Large Multimodal Models [28.8] 大規模視覚言語モデル(LVLM)は、最近、自動コンテンツモデレーションにおいて大きな可能性を示している。
HarmVideoBenchは、1,379の動画と4,137の質問のペアからなる診断ベンチマークである。
BCRは,推論境界を予測し,必要なときにのみ動的にコンテキストを検索するベンチマークアライメント手法である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:50:33 GMT)
The Curse of Multiple Mediators: Hidden Interaction Effects in Activation Patching [28.4] アクティベーションパッチ(Activation patching)は、機械的解釈可能性の主要なツールである。
モデル行動の因果責任は、その自然な間接効果を見積もることによって、個々のコンポーネントに比例する。
また、コンポーネントの因果効果自体がモデル内の他のコンポーネントの状態に依存するかを測定する相互作用効果(INT)も含む。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:52:16 GMT)
Learning from Annotation Uncertainty: Entropy-Aware Curriculum for Speech Emotion Recognition [28.3] 音声感情認識(SER)は、しばしばアノテータの不一致を崩壊させるハードコンセンサスラベルに依存する。
MSP-Podcast 2.0における9クラスSERの分布に基づく監視について,WavLM-Baseマルチタスクモデルを用いて検討した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 20:35:17 GMT)
Advancing Speaker-Based Vocal Effort Classification with WavLM and Data Augmentation in Naturalistic Non-Calibrated Speech Recordings [28.3] 発声作業分類において初めてWavLMを導入し,wav2vec2 と HuBERT に対してベンチマークを行った。
Augmentation は WavLM を継続的に改善し、+0.6% から+1.8% まで上昇した。
我々の最良システムは、緩やかな凍結、拡張、ガウス近傍のソフトラベルを持つWavLM-BASEであり、平均精度は78.2%である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 20:46:48 GMT)
From Weights to Features: SAE-Guided Activation Regularization for LLM Continual Learning [28.0] 重み空間正規化法は,大規模言語モデルに適用した場合,性能が低下する傾向にある。
このような過小評価は、大言語モデルの多意味性によって部分的に説明できると論じる。
本稿では,事前訓練されたスパースオートエンコーダ(SAE)を単意味特徴辞書として用いて,モデルのアクティベーション空間における正規化を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:46:04 GMT)
TMP: Tree-structured Mixed-policy Pruning for Large-scale Image Generation and Editing [26.7] 我々は,最初の木構造混合政治計画フレームワークであるTMPを提案する。
画像タスク(T2IとTI2I)と合成(Mixture-of-Experts (MoE)とDiffusion Transformer (DiT))を一般化する。
我々は,現在オープンソースとなっているSOTA Hunyuan Image-3.0インストラクションと,一般的なZ画像ターボ実験を行った。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:26:27 GMT)
Don't Settle at the Mode! Mitigating Diversity Collapse in Pretrained Flow Models via Feature Self-Guidance [26.5] 最先端のフローモデルは、テキストや画像プロンプトから素晴らしい画像を生成する。
同じ条件下で複数のサンプルを生成すると、多様性が崩壊する。
我々は,報酬モデルの追加を必要とせず,多様性の崩壊を緩和する,効率的でトレーニング不要な自己指導機構を導入する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:59:47 GMT)
Bridging Performance and Generalization in Reinforcement Learning for Agile Flight [26.5] RLをベースとしたドローンレースのアジャイル飛行におけるゼロショット一般化のためのフレームワークを提案する。
提案手法は,実世界の様々な未確認競馬場において,強いゼロショット性能を実現する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:54:36 GMT)
Uncertainty quantification via conformal prediction in data assimilation [26.0] 共形予測(CP)は、制御された理想的な環境で不確実性を定量化する、最近の機械学習(ML)手法である。
CPの3変種に対する平均経験的カバレッジ,平均区間長,低損失,高遅延,平均区間スコア損失(AISL)を比較し,評価した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:18:15 GMT)
Learning from the Self-future: On-policy Self-distillation for dLLMs [26.0] 私たちは、dLLM用に調整された最初のOPSDフレームワークであるd-OPSDを紹介します。
まず,自己生成型回答を接尾辞条件として用いることで,自己学習者構築を再構築する。
第二に、トークンレベルからステップレベルへと監督をシフトし、dLLMの反復的認知プロセスとトレーニングを整合させる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:08:43 GMT)
TriPAH: Imbalance-Aware Tri-Prompt Affinity Hashing for Cross-Modal Medical Retrieval [25.8] クロスモーダル医療ハッシュ検索は,効率的な画像テキスト検索を実現することを目的としている。
現在の手法は、ノイズの多い臨床言語、長い尾のラベル、脆い量子化による意味的断片化に悩まされている。
本稿では,Tri-Prompt Affinity HashingフレームワークTriPAHを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:24:34 GMT)
MORL-A2C: Multi-Objective Reinforcement Learning Reranker for Optimizing Healthiness in MOPI-HFRS [25.5] 不健康な食事行動は、米国における公衆衛生問題であり続けている。
この研究は、多目的パーソナライズされた健康に配慮した食品レコメンデーションシステムを拡張した。
MORL-A2CはMOPI-HFRSの健康基準軸をターゲットとしたシーケンシャルな意思決定拡張である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:09:16 GMT)
GEOALIGN: Geometric Rollout Curation for Robust LLM Reinforcement Learning [25.1] Geoalignは反復ポリシー最適化におけるロールアウトキュレーションのためのプラグインである。
プロンプト内選好ペアを形成し、ロールアウト毎の隠れ状態のオンラインプロジェクターを学習し、報酬順序の変位方向を集中させ、プロンプト内安定な代替手段で修正する。
学習された報酬モデルとの対話や、二進的な検証された報酬による数学的推論など、Geoalignは最終的なパフォーマンスを改善し、トレーニングの振動を低減する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:53:37 GMT)
NOVA: A Verification-Aware Agent Harness for Architecture Evolution in Industrial Recommender Systems [24.6] NOVAは、検証対応アーキテクチャ進化のためのレベルアウェアエージェントハーネスである。
L2 ScaleUpとL3 Literature-to-Productionタスクにおいて、最も効果的なパスレートを達成する。
1つの文学から生産までのサイクルを、人間に従属した時間で13倍に短縮する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:30:39 GMT)
RedVox: Safety and Fairness Gaps in Speech Models Across Languages [24.3] 音声対応モデルは、言語を越えた現実世界のアプリケーションにますますデプロイされている。
しかし、彼らの安全と公正さは、イングランドの設定や自然主義的な条件を超越したままである。
このギャップに対処するため、実際の音声で構築された音声と音声のマルチリンガル安全性と公平性ベンチマークであるRedVoxを紹介した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:40:39 GMT)
Socratic agents for autonomous scientific discovery in high-dimensional physical systems [24.1] AHOISはソクラテスの助産師をクローズドループの実験に埋め込む。
物理批判的エージェントは因果質問を通じて仮説を尋問する。
AHOISは、ランダム干渉符号化仮説を自律的に提案し、検証した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:01:07 GMT)
Disco-LoRA: Disentangled Composition of Content, Style, and Motion for Multi-concept Video Customization [24.0] テキスト・トゥ・ビデオ(T2V)モデルに基づくビデオのカスタマイズは、参照データから特定の特徴を学習し、制御可能なビデオを生成することを目的としている。
我々は、コンテンツ、スタイル、動きの協調制御を必要とするマルチコンセプトビデオカスタマイズのタスクを体系的に定義する。
本稿では,異なる概念を2段階に分割し,柔軟に再結合することで,この問題に対処する統合フレームワークであるDisco-LoRAを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:01:05 GMT)
When the Aggregator Cheats: Data-Free Backdoors in Federated LLM-based QA Systems [23.6] フェデレートラーニングは、生のクライアントデータを共有せずに協調的なトレーニングを可能にする。
本稿では,悪意あるアグリゲータがサードパーティベンダと共謀する可能性のある脆弱性について検討する。
我々は,クライアントがトレーニング中にアップロードした勾配を活用し,データフリー・ステルス中毒のための2段階のフレームワークを開発することを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:53:37 GMT)
Cross-Head Attention Uplift Network with Inverse Propensity Score under Unobserved Confounding [22.8] 個々の治療効果を推定するために不可欠なリフトモデリングは、二重課題に直面している。
本稿では,CHAUN(Cross-Head Attention Uplift Network)とRobust Adrialversa Inverse Propensity Score(RA-IPS)を提案する。
RA-IPSは堅牢性を高め、観測不能な条件下で標準IPSを5.4%上回った。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:49:50 GMT)
Robust Onion: Peeling Open Vocab Object Detectors Under Noise [22.6] ロバスト・オニオン(Robust Onion)は、制御された視覚的劣化を利用してOV-ODs層を層ごとに剥離する実験的な研究である。
以上の結果から、類似の視覚バックボーンを持つモデルは、類似の層における同様の機能崩壊によって、同等の堅牢性を示すことが明らかとなった。
現実世界のBDD100K、WiderFace、VisDRONEの堅牢性を改善することで、私たちの洞察を検証します。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:16:42 GMT)
Look-Before-Move: Narrative-Grounded World Visual Attention in Dynamic 3D Story Worlds [22.4] Look-Before-Moveは、監視仕様とモーション実行を分離するカメラ計画フレームワークである。
StoryBlenderをベースとしたダイナミックな3Dストーリーワールドベンチマークを構築し,50ストーリー,457シーン,アニメーションによる1585ショットをカバーした。
実験により,本フレームワークは主観的知覚,意図整合性,軌道品質を代表的ベースラインよりも向上することが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:38:39 GMT)
Intracranial Aneurysm Classification and Segmentation via Tri-Axial ROI and Multi-Task Learning [22.1] 頭蓋内動脈瘤はしばしば破裂するまで無症候性であり、死亡率が高い。
マルチラベル分類,マルチクラス大動脈瘤セグメンテーション,マルチクラス血管セグメンテーションを同時に行うマルチタスクフレームワークを提案する。
我々の2倍のアンサンブルは、RSNA 2025の頭蓋内動脈瘤検出チャレンジで2位となった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:35:06 GMT)
Dismantling Pathological Shortcuts: A Causal Framework for Faithful LVLM Decoding [19.4] LVLM(Large Vision-Language Models)は、洗練された推論を示すが、対象の幻覚に影響を受けやすい。
トレーニング不要な推論時間フレームワークであるFox(Faithfulness and Observational-flow via eXpression-rectification)を提案する。
FoxはSOTAのパフォーマンスを達成し、言語豊かさを維持しながらSIDを29.1%上回っている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:55:46 GMT)
DiffRGD: An Inference-Time Diffusion Guidance Through Riemannian Gradient Descent [19.3] 拡散モデルは、生成モデルにおいて広く採用され、多くの画像生成タスクの基礎モデルとして機能してきた。
DiffRGDは分布認識型ガイダンスフレームワークで,潜在ガウス構造を明示的に保存する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:06:41 GMT)
Einstein World Models [19.3] アインシュタイン・ワールド・モデル(Einstein World Models)は、視覚的時間的ロールアウトを推論トレースの中に配置する推論システムのための青写真である。
EWMでは、LLMはワールドモジュールと呼ばれ、検討中のシーンの短いロールアウトを生成する。
返却されたロールアウトは回答ではなく、後の推論をサポートする検査可能な仮説として扱われる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:42:04 GMT)
PhysRAG: Enhancing Physics-Awareness in Video Generation via Retrieval-Augmented Generation [19.3] 我々は、検索・拡張生成(RAG)を通して映像生成における身体的認識を高める新しいパイプラインであるPhysRAGを紹介する。
WISA-80Kデータセットに基づく2段階データフィルタリングパイプラインを設計する。
物理ビデオデータベースを構築し,学習可能なクエリを用いて物理知識をビデオ拡散モデルに注入する機構を開発する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:53:27 GMT)
VibeAct: Vibration to Actions for Contact-Rich Reactive Robot Dexterity [19.2] VibeActは、本物の視覚的触覚とシミュレーションに基づく強化学習を橋渡しするフレームワークである。
実世界では、圧電マイクロホンを器用なロボットハンドに埋め込んで、遠隔操作でバイブロ音響データを収集する。
触覚推定器は、実際のマイクロホン波形から接触や滑りを予測し、操作ポリシーは、シミュレーションされた接触から直接計算された同じ表現のシミュレーションで訓練される。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:50:07 GMT)
A-Evolve-Training: Autonomous Post-Training of a 30B Model [19.0] 我々は、30Bのネモトロンを訓練した後、ループに人間がいないループを走らせる自律システムについて報告する。
自律生産されたモデルは、NVIDIA Nemotron-Reasoning Challengeのリーダーボード上で、トップヒューマンの0.87に対して0.86の保持スコアに達した。
GPT-2クラス(124M)の予算に事前の自律ML-Researchのデモが行われたのは、今回が初めてである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:21:07 GMT)
LithoDreamer: A Physics-Informed World Model for Multi-Stage Computational Lithography [18.9] 計算リソグラフィのための物理インフォームド・ワールド・モデル(WM)フレームワークであるLithoDreamerを紹介する。
LithoniaDreamerは、ステージ固有の物理インフォームト空間をモデル化するために、隣接する状態間の特徴変化をキャプチャする。
実験によると、LithoDreamerは進化と逆計画において最先端のパフォーマンスを達成する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:48:59 GMT)
Beyond Global Divergences: A Local-Mass Perspective on Bayesian Inference [18.9] KLの発散やELBOのようなグローバルな目的は、分布の差を測定するためにベイズ推定において広く用いられている。
本稿では,これらの目的によって直接捉えられていない局所質量挙動について考察する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:26:42 GMT)
To Run or Not to Run: Analyzing the Cost-Effectiveness of Code Execution in LLM-Based Program Repair [18.7] 実行には時間がかかり費用もかかるが、プログラム修復エージェントへの影響は未調査のままである。
コード実行は分析されたすべてのエージェントとモデルで使用され、タスク毎に平均8.8のテスト実行が実行される。
現在のエージェントは実行を無差別に適用し、ほとんど利益が得られないインスタンスにコストを支払う。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:49:59 GMT)
A hardware-safety-gated system for LLM-written native ARTIQ control code on a trapped-ion platform [18.2] 大言語モデル(LLM)エージェントは、実験的な制御コードを書き、実行することができる。
チェックされていないコードは装置を損傷させる可能性があり、人間の承認/監督とエージェントの判断の間に正式な操作ごとの境界は存在しない。
本稿では,LLMエージェントを,そのような境界を保ちながらトラップイオン実験のループに配置する制御システムを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:19:23 GMT)
Learning Cross-View Semantic Priors for Single-Reference Unseen Object Pose Estimation [18.0] 初期のクロスビューセマンティクスを中心に、対応パイプラインを構築しました。
提案手法は,同等の推論速度を維持しつつ,最先端の性能を実現する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:04:00 GMT)
Liquid Fusion of Heterogeneous Representations Towards General Salient Object Detection [18.0] General Salient Object Detection (SOD) は、視覚的に興味深い物体を一様性や多様性から識別・分離することを目的としている。
液核融合ネットワーク(LFNet)と呼ばれる VMamba と ConvNeXt を含む2つのバックボーンの機能を動的に統合する液体核融合を導入する。
LFNetは最先端のパフォーマンスを実現し、検出精度とモデル効率のトレードオフが優れている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:35:42 GMT)
Evaluation Pitfalls and Challenges in Multimedia Event Extraction [17.9] 本稿では,マルチメディアイベント抽出における評価落とし穴の最初の体系的解析について述べる。
不整合データ処理、不整合タスク仮定、過度に緩和された評価設定の3つの問題源を同定する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:05:13 GMT)
Geometric and Information Compression of Representations in Deep Learning [17.8] ディープニューラルネットワークは、入力データを幅広い下流タスクをサポートする潜在表現に変換する。
中心的なオープンな問題は、入力と表現の間の低相互情報(MI)が必然的に幾何学的に圧縮された潜在空間を意味するかどうかである。
幾何学的圧縮と理論的MI推定の尺度として,クラスワイズクラスタリングを用いてこの問題を考察する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:10:27 GMT)
Learning to Throw: Agile and Accurate Cable-Suspended Payload Delivery with a Quadrotor [17.7] クアドロレータは、時間クリティカルなアプリケーション中にサスペンションペイロードを高速に輸送するために必要なアジリティを提供する。
最先端のアプローチは一般的にモデルベースの軌道最適化と追跡に依存している。
複素ロープおよびペイロード相互作用のための物理解法と高忠実度解析的四元子モデルとを結合したハイブリッドシミュレーションフレームワークを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 23:30:52 GMT)
DnA: Denoising Attention for Visual Tasks [17.7] まず,どの画像特徴が正しいクラスに属するかを正の問合せで識別し,負の問合せで密接に関連しているが無関係な画像特徴を識別する。
提案したDnAは,VT-Bのバックボーンを用いてImageNet-1Kにおいて,ベースラインに比べて0.8%向上した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:59:48 GMT)
MMGist: A Comprehensive Multimodal Benchmark for 2027 [17.4] MMGistは、7つの機能ディメンションをカバーし、7,262項目を含むキュレートされたベンチマークである。
MMGistは3段階のパイプラインで構築されており、テキストアブレーションフィルタリング、クロスモデル飽和フィルタリング、異常検出フィルタを順次組み合わせている。
我々は,27個のLVLMについて広範囲に実験を行い,MMGistと23250項目の生プールを比較した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:10:03 GMT)
A Sensitivity-Aware Test Collection for Search Among Personal Information [17.2] 我々は,感性評価のために手作業でラベル付けされたEnron文書のサブセットに対するクエリ関連評価をクラウドソースする。
本報告では, 関連性, 感度分類, 感度認識検索のためのベースライン性能について述べる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:24:17 GMT)
Improving Vision-Language-Action Model Fine-Tuning with Structured Stage and Keyframe Supervision [17.1] StaKeはVision-Language-Action(VLA)モデルのプラグイン補助監視フレームワークである。
手動のアノテーションなしで、デモグリップ状態から2つの補完信号を自動的に導き出す。
バイマニュアルシミュレーションとシングルアームのFranka実ロボットタスクの実験は、StaKeが一貫して成功率を改善することを示している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:38:11 GMT)
Sample-efficient Transfer Reinforcement Learning via Adaptive Reward Shaping and Policy-Ratio Reweighting Strategy [17.0] 本稿では,自律走行車線変更のための安全転送強化学習フレームワークを提案する。
まず,リスク探索を抑えるために,即時安全コストに基づく適応型教師介入機構を設計する。
第2に、教師誘導型安全伝達モジュールは、教師政策の行動評価情報を学生学習に組み込む。
第3に、教師誘導重み付け最適化機構は、確率比係数を用いて政策最適化におけるサンプル重み付けを調整し、転送性能を安定させる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:02:37 GMT)
TraMP-LLaMA: Generative Interpretability with Decoupled Instruction Tuning for Facial Expression Quality Assessment [17.0] TraMP-LLaMAは、重度スコアを共同で予測し、顔の動きの手がかりから構造化されたテキストレポートを生成する統合マルチモーダルフレームワークである。
PFED5+の実験では、TraMP-LLaMAはレポート生成において競合するビデオ言語ベースラインを上回っている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:15:52 GMT)
Bridging Vision and Language Concepts through Optimal Transport Semantic Flow [17.0] 概念ボトルネックモデル(CBM)は、人間の解釈可能な概念を通して予測することで透明な推論を約束する。
既存の視覚言語CBMは、事前に整列されたエンコーダやグローバルコサインの類似性に依存することが多い。
最適輸送フロー概念ボトルネックモデル(OTF-CBM)を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:24:44 GMT)
Localizing RL-Induced Tool Use to a Single Crosscoder Feature [16.9] RLによる微調整は、言語モデルの内部表現を安心して、ツールの使用のようなエージェント的な動作を可能にする。
どのような特徴が出現し、どの特徴が保存され、特定された特徴がトレーニングなしの行動制御に活用できるかは不明である。
DFC(textitDedicated Feature Crosscoders)$は、ツール呼び出し機能を仲介するRL固有の機能のコンパクトなセットを分離する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:17:11 GMT)
RigPI: Dynamic Parameter Identification of Rigid Body via VLM-Seeded Differentiable Simulation [16.7] RigPIは、ロボットと物体の相互作用において、剛体と多リンク剛体の動的パラメータを特定するためのフレームワークである。
RigPIは、視覚に基づくセマンティックオーディエンス、フォーストルク測定、モーションオブザーバを、微分可能なシミュレーションパイプラインに統合する。
相対的および原始的な関節を持つ物体に対する大規模な実世界の実験は、RigPIが正確で安定したパラメータ推定を達成することを証明している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:30:32 GMT)
Physical Layer Authentication With Channel Knowledge Maps in Indoor Environments [16.2] 複数のアクセスポイント(AP)が受信した信号から支配的なチャネルタップパス損失(PL)と到着角(AoA)を推定する屋内環境におけるデバイス移動のためのPLA機構を提案する。
総合的なセキュリティ分析は、ランダム攻撃と最適攻撃の両方で行われる。
代表的な屋内シナリオにおける数値計算の結果, CKMはレイトレーシングにより得られ, 提案したPLA手法の有効性を検証した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:51:04 GMT)
Model Forensics: Investigating Whether Concerning Behavior Reflects Misalignment [16.1] 安全研究の中心的な目標は、モデルが一致していないかどうかを決定することである。
以前の研究は、行動に関する検出に主に焦点を合わせてきた。
これはモデル法医学を動機付け、その行動が悪性意図によって駆動されているかどうかを調査する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:58:23 GMT)
Tessellating The Earth [16.1] TTE (Tessellating the Earth) は、学習可能な球状ボロノイ分割から構築された位置エンコーダである。
TTEは、地理空間分類と回帰タスクのスイートにまたがって、ロケーションエンコーダの新たな状態を設定する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:58:13 GMT)
FracEvent: Event-Camera Simulation via Fractional-Relaxation Pixel Dynamics [16.0] イベントカメラは、マイクロ秒の時間分解能で明るさの変化を報告しているが、実際のイベントデータは大規模な収集が困難である。
FracEventは、このピクセルレベルのライフサイクルを、分数レラクゼーション電圧のダイナミックスでモデル化するイベントシミュレータである。
画像再構成と光フロー推定におけるイベントストリーム比較と下流転送によるFracEventの評価を行った。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:01:39 GMT)
Algorithmic Foundations of Deep Learning: Complexity-Theoretic Rates and a Characterization of Universal Approximation [15.8] ニューラルネットワークはフレキシブルな基底関数として、また計算のモデルとして見なされるべきであることを示す。
自然並列化条件を満たす任意の定義可能なNNモデルは、非アフィン非線形性を含む場合に限り、普遍近似であることを示す。
提案理論の範囲は,連続関数に対する普遍近似保証,ベソフ類に対する最小最適近似保証,正則関数に対する対数誤差複雑性,およびニュートン・ラフソン根探索や電力計算のような数値アルゴリズムをエミュレートできることを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:34:20 GMT)
A Set-Theoretic Approach to Detecting Logic Bugs in DBMS Inner Join Optimizations [15.8] 我々は,INNER JOIN最適化に関連するバグを,セット理論のレンズを用いて検出するテスト手法を提案する。
私たちはこの設計を、オラクルテストエグゼキュータとして機能するJoinEquivで実装しています。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:44:57 GMT)
Not All Actions Are Equal: Rethinking Conditioning for Dexterous World Model [15.6] アクション・コンディショニングは、アクション・コンディショナード・ワールド・モデルでは未発見のままである。
本稿では,グローバル圧縮ではなく構造化プロセスとして動作条件を扱うDexACを提案する。
セマンティックブランチとDexACを組み合わせることで、FID、FVD、PCKが大幅に向上し、視覚的時間的リアリズムと行動追従一貫性が向上することを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:36:35 GMT)
RelAfford6D: Relational 6D Affordance Graphs for Constraint-Driven Robotic Manipulation [15.6] RelAfford6は複雑な調音オブジェクトのためのトレーニング不要のフレームワークである。
本システムでは,一次相互作用部分を物理的アンカーにリンクする意味的トポロジを推定する。
我々は満足度問題として下流実行を解析的に定式化する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:42:26 GMT)
Learning to Recover Task Experts from a Multi-Task Merged Model [15.6] マルチタスクモデルマージは、複数のタスク固有の専門家を統一モデルに統合することを目的としているが、静的マージはパラメータ干渉に常に悩まされている。
このようなパラメータ摂動はアフィン変換としてモデル化でき、加算オフセットとして近似することができる。
Recover Task eXpert(Re)は、パラメータ干渉を解き、単一のマージされたチェックポイントからタスクエキスパートのパフォーマンスを回復するために、これらのオフセットを予測するフレームワークである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:34:33 GMT)
OpenRCA 2.0: From Outcome Labels to Causal Process Supervision [15.5] 本稿では,因果伝播経路の再構築に既知の介入を活用する段階的ラベリングプロトコルPAVEを紹介する。
PAVEを適用することでOpenRCA 2.0(500インスタンス)が得られる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:24:23 GMT)
Generating Special Triangulations with Transformers [15.5] 三角法、すなわち幾何学的対象の三角形のような部分へのよく構造化された分解は、数学や物理学の多くの分野において中心的な対象である。
三角測量の高次元性と複雑さは、古典的な数値法や機械学習でモデル化することを困難にしている。
適切な符号化方式を備えたトランスフォーマーを効果的に訓練することにより,ポリトープサイズの異なる新しいFRSTを選択的に生成できることを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:47:39 GMT)
What Survives When You Compress a Recursive Reasoner for the Edge? [15.5] 再帰的推論モデルは、潜伏状態を繰り返し更新することで、数百万のパラメータだけで複雑な構造化タスクを解くことができる。
攻撃的な圧縮は局所的な予測を保存するが、グローバルな推論を損なう。
我々は,この損傷とその回復を予測できるラベルのない信号として,フル精度推論経路に類似した搬送軌道の忠実さを導入する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:47:15 GMT)
RSPC: A Benchmark for Modeling Stress and Psychiatric Conditions in Digitally Mediated Relationships using Psychiatrist Annotations [15.0] 我々は、精神科医が診断カテゴリーに注釈を付けた1,799件のReddit投稿を含むストレス精神医学コーパス(RSPC)を紹介した。
我々は、多ラベル障害分類、トリガー検出、時間予測タスクにおいて、7つの微調整されたトランスフォーマーモデルと5つの大きな言語モデルをベンチマークする。
全体として、RCFPCは、リレーショナルコンテキストを考慮したNLPタスクのベンチマークを確立し、個人中心のヘルスモデリングからコンテキスト対応のヘルスモデリングへのシフトをサポートする。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:33:57 GMT)
SSI-Policy: Learning Structured Scene Interfaces for Vision-Language Robotic Manipulation [15.0] SSI-Policyは統一されたRGBのみの中間表現で、単分子深度特徴、言語基底のオブジェクトレイアウト、命令条件の2Dモーショントラジェクトリを共同でエンコードする。
SSI-Policyは、タスク毎に10のデモしか行わないLIBEROベンチマークにおいて、最強の事前メソッドよりも15%近く改善されている。
さらに,空間的推論,クロス・エボディメント・トランスファー,コンタクトリッチな操作にまたがる13の現実世界タスクについて検証を行った。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:38:05 GMT)
The Tilted Playing Field for Women in Science [14.9] 我々は、上位機関の研究者がより多くの協力者を持つという相対的な可能性として、名声の優位性を定量化する。
権威と科学的成果の関連性は,ジェンダーによって体系的に異なることがわかった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:06:33 GMT)
Where Do CoT Training Gains Land in LLM based Agents? [14.8] 思考の連鎖(CoT)推論は言語モデルエージェントで広く使われている。
以前の研究は、言語化されたCoTは必ずしも忠実ではなく、むしろポストホック推論を反映していることを示している。
私たちはCoTトレーニングが実際に改善しているものは何なのか尋ねます。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:09:16 GMT)
Speaking Numbers to LLMs: Multi-Wavelet Number Embeddings for Time Series Forecasting [14.8] 大言語モデル(LLM)は、異種テキスト信号を統合することができるため、コンテキスト対応の時系列予測には魅力的である。
本研究では,TempoWaveを提案する。TempoWaveは,各スカラー観測をマルチウェーブレット,マルチスケール係数から構築したディジタルワイド埋め込みにマッピングする,時間的ウェーブレットディジットインタフェースである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:44:09 GMT)
Ordinal Neural Collapse as a Representation Prior for Visual Navigation [14.6] 本稿では,ナビゲーション動作の順序構造に従ってエンコーダの表現空間を整理する手法であるORIONを提案する。
実験によると、ORIONはナビゲーションの成功率と目標達成率において、エンドツーエンドと神経崩壊のベースラインを一貫して上回っている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:25:25 GMT)
CLIR: Liveness-Driven and Structure-Aware Fuzzing for the Cranelift Compiler [14.5] Craneliftは、Rustの実験的なバックエンドとして最近採用された、モダンなコンパイラバックエンドである。
SSAの有効性を保証するため,構文保存型階層生成戦略を統合した差分テストフレームワークであるCLIRを提案する。
72時間以内に、CLIRはすべてのターゲットアーキテクチャにまたがる24のバグを発見し、21と9が修正された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:48:54 GMT)
TaskTok: Delving into Task Tokens for Task-driven Image Restoration [14.5] タスク駆動画像復元(TDIR)は、下流の高レベル視覚タスクの性能を最大化することを目的としている。
近年のTDIRの先進的なアプローチは、TDIRの可能性を示唆している。
タスク関連トークンのみを選択的に復元する新しいフレームワークであるTaskTokを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:20:01 GMT)
LogicIR: Logic Gate Networks for Image Restoration [14.5] 本稿では,画像復元に特化して設計された最初のLGNであるLogicIRを紹介する。
LogicIRは、論理ゲートで構成されたUNetにインスパイアされたアーキテクチャを取り入れている。
その結果,LogicIRは計算コストを大幅に削減し,高い性能を実現していることがわかった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:11:28 GMT)
Where Do Models Find Happiness? Emotion Vectors in Open-Source LLMs [14.3] 近年の研究では、感情の概念を符号化し、人間の心理的構造を反映する幾何学を示す内部表現であるクロード・ソネット4.5の感情ベクトルが特定されている。
Apertus-8B-Instruct-2509 と Gemma-4-E4B-it の2つのオープンウェイトモデルにおいて,これらの発見の一般性を検証する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:01:11 GMT)
PhyEditBench: A Real-World Multi-Stage Benchmark for Physics-Aware Image Editing [14.1] 編集モデルの物理的理解を評価するためのベンチマークであるPhyEditBenchを紹介する。
ビデオから細心の注意を払って抽出した高品質で高解像度の現実世界のインスタンスは238個ある。
現在のSOTA編集手法の実証分析は、物理に基づく推論においてかなりの制限を課している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:57:34 GMT)
VIGIL: Runtime Enforcement of Behavioral Specifications in AI Agent Skills [14.0] VIGILはエージェントシステムのためのエンドツーエンドのランタイム実行フレームワークである。
エージェントの実際の実行トレースを、スキル仕様、オペレータ定義制約、複数のスキルにまたがるグローバルルールから、行動ポリシーに対してチェックする。
95%以上のリコールと偽陽性率で政策違反を検出する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:58:44 GMT)
CAT-Q: Cost-efficient and Accurate Ternary Quantization for LLMs [13.9] 本稿では,LCMの圧縮と高速化を目的としたCAT-Q,コスト効率,高精度な3次量子化について述べる。
1.7B から 8B のパラメータを持つ事前訓練された LLM では、CAT-Q は512 の校正サンプルのみを使用して3次モデルに効率よく定量化できる。
CAT-Qは,14Bから235Bのパラメータを持つ事前学習LLMを,わずか8時間から60時間で第3次モデルに定量化できることを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:24:02 GMT)
Ask, Don't Judge: Binary Questions for Interpretable LLM Evaluation and Self-Improvement [13.8] BINEVALは評価基準を原子二分問題に分解するフレームワークである。
タスクプロンプトが与えられたとき、メタプロンプトはきめ細かい評価質問を生成する。
LLMはそれぞれの出力に対して独立して答え、透過的な質問レベルのフィードバックをもたらす。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:14:50 GMT)
Risk-Aware Selective Multimodal Driver Monitoring with Driver-State World Modeling [13.5] 自動車両の連続運転監視には低遅延推論が必要である。
デプロイ可能なマルチモーダルドライバ監視のためのコストアウェア選択推論フレームワークを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:59:21 GMT)
TESLA-for-5G: Broadcast Authentication for 5G Networks Using TESLA [13.5] 5G基地局は、セル選択中にすべてのユーザ機器(UE)が読み取る認証システム情報(SI)を放送する。
従来のアプローチでは、UEはデジタルシグネチャを使用してシステム情報ブロック1(SIB1)を認証する必要がある。
TESLA と GG09 Schnorr-like Identity-based signatures (IBS) を組み合わせた 5G SIB1 のブロードキャスト認証プロトコル TESLA-for-5G (TF5) を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:07:02 GMT)
Inference-Time Robot Behavior Steering through Physically-Aware Reconfiguration of Task-Structure [13.4] ReStructは、オブジェクト中心の仕様から時間論理的な制約まで、幅広い好みを操縦します。
タスクの成功と選好フォローの両方でVLAモデルを上回る。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:20:08 GMT)
Do more heads imply better performance? An empirical study of team thought leaders' impact on scientific team performance [13.3] 思想的リーダシップは、チームのパフォーマンスを高める上で重要な役割を担います。
本研究では,出版物の著者を科学チームとみなし,概念的タスクに責任を持つ著者を思想的リーダーとして定義する。
我々は,思考的リーダの数とチームパフォーマンスの2つの側面,すなわちチームのインパクトとチームの破壊性との関係を,相関性と因果性の両方の観点から検討する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:42:45 GMT)
DMuon: Efficient Distributed Muon Training with Near-Adam Overhead [13.2] DMuonはオープンソースの分散Muon実装で、既存のトレーニングパイプラインをドロップインモジュールとして統合します。
DMuonは、エンドツーエンドのステップタイムで1.48x-3.01xのスピードアップ、ステップタイムで6.85x-163.00xのスピードアップを達成する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:23:03 GMT)
LearniBridge: Learnable Calibration of Feature Caching for Diffusion Models Acceleration [13.1] LearniBridgeは、軽量なLoRA更新を通じて複数のタイムステップをブリッジする機能キャッシングのための学習可能なキャリブレーションメカニズムである。
画像生成とビデオ生成の実験では、LeardiBridgeはFLUX、HunyuanVideo、WAN2.1で最大5.87times$、$5.75times$、$4.10times$加速を達成した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:12:51 GMT)
Sketched Linear Contrastive Learning: Approximation, Optimization, and Statistical Scaling [13.0] 本研究では,2組のガウス潜在変数構成の下で,コントラスト学習のためのスケッチ付き線形モデルについて検討する。
我々は、リスク分解を既約リスク、近似誤差、GDバイアス、GD分散、およびクロス項に導出する。
標準的な線形回帰スケーリング法則と比較すると、対照的な設定は2つのビュー間の相互作用を学習しなければならない。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:20:21 GMT)
SelectAnyTree: A Promptable Instance Segmentation Model for 3D Forest LiDAR Point Clouds [12.8] SelectAnyTreeは、アクセラブルなインスタンスセグメンテーションモデルで、3Dフォレストポイントクラウド内の個々のツリーを数クリックから切り離すことができる。
目標木を78.2インターセクション・オーバー・ユニオン(IoU)に分割し、1クリックで24.8ポイント、最強のプロンプトベースラインを上回っている。
最小クリック数ですべての精度ターゲットに到達する一方で、パラメータをはるかに少なく、事前のプロンプト可能なモデルよりも推論時間が少ない。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:15:36 GMT)
Witness expansion: A unified framework for analytical and measurable mixed-state resource detection [12.6] そこで本稿では, 量子資源検出のための非線形基準を構築するための統一的な枠組みを提案する。
例えば、コヒーレンスのノルム$l$、エンタングルメントの部分転位モーメント、非安定化剤性(量子魔法)の安定化エントロピー、フェルミオン非ガウシアン性のためのフェルミオン的アンティフラットネスなどである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:43:38 GMT)
Appearance-Preserving Refinement of Generated 3D Assets for Monochromatic Fabrication [12.6] 我々は、単色加工のための外観指向幾何微細化フレームワークGenMFを提案する。
実験により、GenMFは単色レンダリング下での外観保存を著しく改善することが示された。
以上の結果から, 外観を意識した幾何学的改良は, 生成した3次元アセットと製造可能な単色物体との間に有効な橋渡しを提供することが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:36:00 GMT)
KARLA: Knowledge-base Augmented Retrieval for Language Models [12.5] トークン生成時に,LLMが知識ベースから知識を自動的に抽出する手法を提案する。
すなわち,(1) LLM出力の実際の知識は, LLM出力を再トレーニングすることなく更新可能であり, (2) LLM出力の成果は透明性と説明可能性の知識ベースにトレース可能であり,(3)より小さなモデルでは,より大きなモデルと同じ事実精度が得られる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:44:40 GMT)
Hallucination in World Models is Predictable and Preventable [12.4] 幻覚は状態-作用空間の低被覆領域に集中していることを示す。
モデルがどこで失敗するかを正確に予測する3つの信号を開発する。
その結果,世界モデルにおける幻覚は本質的にデータカバレッジの問題であることが判明した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:38:45 GMT)
Test Case Selection for Deep Neural Networks: A Replication Study on LLMs for Code [12.4] ディープニューラルネットワーク(DNN)の運用評価を支援するために,テストケース選択(TCS)技術が検討されている。
我々は、当初提案されていたDNNのための確立されたTCS戦略を再検討し、これまで評価されなかった統計的サンプリング戦略を補完する。
コードに関連する3つの分類タスク – クローン検出,脆弱性検出,技術的負債予測 – において,その有効性を評価する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 23:25:53 GMT)
Zero-shot Tweet-Level Stance Detection Enhanced by External Knowledge and Reflective Chain-of-Thought Reasoning [12.3] KIRPと呼ばれるゼロショットのツイートレベルのスタンス検出フレームワークを提案する。
データ拡張のために外部知識とエンティティの再編成を統合し、推論のために即時連鎖を採用する。
実験により、KIRPは最先端のパフォーマンスを達成することが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:46:01 GMT)
An ultralow-loss integrated photonic platform for discrete-variable quantum information processing [12.3] フォトニック集積回路は、スケーラブルで堅牢な量子情報技術への経路を提供する。
高性能な離散可変量子情報処理のために, モノリシックで超低損失な窒化ケイ素プラットフォームを試作した。
結果は、極低損失Si$_3$N$_4$集積フォトニクスを、大規模で展開可能な量子情報プロセッサのための決定的かつ製造可能なプラットフォームとして確立する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:45:20 GMT)
Is This AI? Longitudinal Analysis of Strategies Used for AI Detection on Two Subreddits [12.2] 我々は2つのRedditコミュニティで議論されているAI検出戦略の2年8ヶ月を分析した。
これらの戦略とメンタルモデルは、AI能力の変化に応じて、時間とともに変化します。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:37:43 GMT)
GAVEL: Grounded Caption Error Verification and Localization [12.0] 本稿では,画像テキストペアの検証,説明,ローカライゼーションを共同で行うタスクであるGAVELを紹介する。
実験によると、強力なクローズドソースモデルでさえGAVELに苦戦しているのに対し、教師付きベースラインはグラウンド化と説明のメトリクスで一貫した改善をもたらす。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:00:45 GMT)
Forget, Anticipate and Adapt: Test Time Training for Long Videos [11.9] テストタイムトレーニング(TTT、Test Time Training)は、モデルが自己教師付き(SSL)タスクを実行し、推論中に重みを更新することで、入ってくるテストサンプルに適応するメカニズムである。
本稿では,長編ビデオのTTTに着目した。
1) 従来のフレームを含むスライディングウィンドウを用いてTTT更新を行い、その計算量はウィンドウのサイズとともに線形に増加する。
1)スライディングウィンドウ内の3つのフレーム、すなわち、出口するフレーム、現在のフレーム、そしてそれに続くフレームのみで動作するフレームフォッティングネットワーク(FFN)を提示する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:40:10 GMT)
Beyond Logical Forms: LLM-Extracted Patterns for Fallacy Classification [11.8] 本研究では,抽象論理構造と文脈レベルの言語的手がかりを融合させることが,誤りの分類に有用かどうかを考察する。
本研究では,このようなパターンを誤用例から帰納的に抽出するフレームワークを開発し,大規模言語モデルを用いてその説明を行う。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:30:37 GMT)
Efficient foundation decoders for fault-tolerant quantum computing [11.7] 本稿では,効率的な基盤デコーダのための統合フレームワークを提案する。
NTUの中心的な特徴は、コード距離をまたいでデコードタスクを調整できることである。
変換器を用いたニューラルデコーダとしてNTU-Transformerをインスタンス化する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:58:33 GMT)
When Does Personality Composition Matter for Multi-Agent LLM Teams? [11.6] マルチエージェントチームパフォーマンスにおいてパーソナリティ構成が重要であるかを検討する。
人格効果はタスク構造に大きく依存している。
マルチエージェントシステム設計における意味について論じる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:13:33 GMT)
AEGIS: A Semantic GAN and Evidential Learning Frameworkfor Robust Adversarial Detection in Vision Sensors [11.5] AEGISは、視覚センサパイプラインのためのセマンティックアウェアと不確実性ガイド付き敵検出フレームワークである。
SemantiGANモジュールは、視覚的に矛盾する敵入力を識別しフィルタリングする多クラスセマンティック識別器として機能する。
Tiny ImageNetデータセットの評価は、AEGISの有効性を示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:03:02 GMT)
Not All Relations Rotate Alike: Transformation-Aware Decoupling for Viewpoint-Robust 3D Scene Graph Generation [11.3] 3Dシーングラフ生成(3DSGG)は、3Dシーンを構造化されたオブジェクト-リレーショナルオブジェクトグラフとして表現する。
現在の3DSGGモデルは、しばしば視点シフトの下で期待される変換挙動に従う関係予測を作成できない。
本稿では,関係推論を述語変換の振る舞いに応じて分離する3DSGGフレームワークであるTransform-Aware Decoupling (TAD)を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:44:40 GMT)
DroidBreaker: Practical and Functional Problem-Space Attacks on Machine-Learning Android Malware Detectors [11.3] アドリアAPK(Adrial APK)は、機械学習のマルウェア検出を回避するために問題空間で修正されたAndroidアプリケーションである。
DROIDBREAKERは実用的(ビルドセーフ)で機能的(セマンティック保存)な問題空間攻撃フレームワークである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:37:57 GMT)
Event-based Gaze Control System for Accurate Real-time Spin Estimation in Professional Ball Games [11.2] 球の追跡とスピンの計測をリアルタイムで行うイベントベースアクティブビジョンシステムを提案する。
システムは、高時間分解能と最小モーションボケのためのイベントカメラと、視野にボールを保持するための高速パン/チルト・ガルバノメーターミラーと、ボールの空間分解能を高めて焦点を合わせるための低照度望遠レンズで構成されている。
プロの卓球試合において,高精度(8.8%と6.4°軸ミスマッチ),3sレイテンシ,750Hzスループットの3ビュー設定で,信頼性の高いトラッキングとスピン推定を実証した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:14:03 GMT)
How Much Static Structure Do Code Agents Need? A Study of Deterministic Anchoring [10.1] LLMベースのコードエージェントは、キーワード検索を通じてリポジトリをナビゲートするが、ソフトウェアがどのように動作するかを定義する構造的関係を見逃す。
これらのエージェントに対して,軽量な静的解析が決定論的アンカーを提供するかどうかを検討する。
我々の研究は、決定論的アンカー効果(deterministic anchoring effect)と呼ばれるものを特定する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:50:01 GMT)
ATGBuilder: Feature-Assisted Graph Learning for Activity Transition Graph Construction with Seed Supervision [9.9] アクティビティトランジショングラフ(ATG)は、アプリのGUIナビゲーションをモデル化するために広く使用されている。
近年の学習に基づくアプローチは、ATG構築をシード管理リンク予測として扱うことができる。
シード管理型ATG構築のための特徴支援グラフ学習手法であるATGBuilderを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:19:36 GMT)
Inverse Design of Compact and Wideband Inverted Doherty Power Amplifiers Using Deep Learning [9.9] 本稿では,小型広帯域反転Dohertyパワー増幅器(PA)の逆合成のためのディープラーニング支援手法を提案する。
CNNと遺伝的アルゴリズムは、ピクセル化されたDohertyコンバインダーネットワークを生成するために共同で使用される。
概念実証として,GaN HEMT Doherty PAを画素出力結合器で設計・製造する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:19:38 GMT)
Observation of Non-Hermitian Skin Dynamics in the Liouvillian Regime [9.8] フォトニックメッシュ格子に可変なオープンシステム量子ウォークを実装した。
我々は、コヒーレンスパラメータと非ハーミティシティパラメータの両面における質量中心のドリフトを測定する。
この結果は、オープン量子力学をシミュレートするための制御可能なフォトニックプラットフォームを構築した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:49:36 GMT)
Do Safety Guardrails Need to Reason? LeanGuard: A Fast and Light Approach for Robust Moderation [9.7] 我々は、軽量な双方向エンコーダと推論ガードを同じコーパスで訓練する。
連鎖がモデレーション精度を向上しないことを示す。
395Mラベルのみのエンコーダは、公開ベンチマークで平均82.90$pm$ 0.26のF1に達する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:15:33 GMT)
MedBench v5: A Dynamic, Process-Oriented, and Hallucination-Aware Benchmark for Clinical Multimodal Models [9.5] 既存の医療AIベンチマークには、プロセスの可視性、アトミックスキル評価、統合幻覚検出が欠如している。
臨床マルチモーダルモデルのための再設計されたベンチマークであるMedBench v5を紹介する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:16:06 GMT)
Learning Adversarial Augmentation Policies for Robust Garlic Seedling Detection [9.5] 増量政策学習に基づく照度ロスト苗検出フレームワークを提案する。
提案手法はAP$_50$の91.6%を達成し、ベースラインを0.9ポイント改善する。
下流の苗のローカライゼーションでは、75.0%の精度と67.0%のF1スコアを達成し、ベースラインを4.8ポイント、2.0ポイント改善する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:08:37 GMT)
Benchmarking Multi-Modal Graph-based Social Media Popularity Prediction [9.5] マルチモーダルグラフベースの人気予測ベンチマークであるMMG-Popを紹介する。
また,MMG-PopNetは,上記マルチモーダル信号とグラフ構造化ソーシャルインタラクションを協調的にモデル化する統合マルチモーダルグラフベースのネットワークである。
これらの知見は、異質なモダリティと社会的に認識されるエージェント生態系パラダイムの下での社会動態モデリングと介入に関する将来の研究のための統一的な基盤を確立する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 20:39:41 GMT)
Mostly Automatic Translation of Language Interpreters from C to Safe Rust [9.3] 本稿では,現実のインタプリタプログラムをCから安全なRustに変換する手法であるRebootを紹介する。
我々は6つのインタプリタを6kから23k行のCコードから安全なRustに翻訳しました。
すべての翻訳は提供されるテストスイートの100%をパスし、62%--92%のパスレートを別々に作成した検証テストで達成する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:59:08 GMT)
Chai: Agentic Discovery of Cryptographic Misuse Vulnerabilities [9.3] Chaiは、自然に発生する信号を通じて暗号的誤用脆弱性を発見し、検証するAIベースのシステムである。
多数の欠陥を監査する代わりに、ライブラリレベルで欠陥をカタログ化し、依存関係グラフを越えて伝播する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:08:07 GMT)
IDEA: Insensitive to Dynamics Mismatch via Effect Alignment for Sim-to-Real Transfer in Multi-Agent Control [9.3] 本研究では,マルチエージェント制御のためのsim-to-real法を提案する。
提案手法は,ランダムな環境構造と閉ループ制御による個別の意味行動を組み合わせることで,政策学習をセマンティック・抽象化のレベルに引き上げる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:49:25 GMT)
Beyond the Hard Budget: Sparsity Regularizers for More Interpretable Top-k Sparse Autoencoders [9.3] 我々はTop-k$アーキテクチャと互換性のある2つの空間正規化器を導入する。
私たちの中心的な発見は、互いに排他的というよりは、ハードなアーキテクチャのスパーシリティとソフトなスパーシリティの正則化が相補的であることです。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:34:39 GMT)
Towards Explainable Adjudicative Variance: Quantifying Judicial Discretion via Gated Multi-Task Learning [9.2] 法的結果予測は、客観的事件事実を判断的文脈から切り離さなければならない。
本稿では,この区別を明示的にモデル化した判断学習型マルチタスク学習アーキテクチャを提案する。
13,937イギリス雇用裁判所の決定に対する我々のアプローチを評価した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:14:27 GMT)
Beyond Points: Spherical Distributional Part Prototypes for Interpretable Classification [9.1] プロトタイプベースのニューラルネットワークは、少数のプロトタイプの小さなセットに予測を接地することで、本質的な解釈性を提供することを目的としている。
現代の視覚バックボーンは、通常、各セマンティック部分が実質的なクラス内変動を示す正規化された方向の埋め込み空間で機能する。
超球面上のvon Mises-Fisher成分の混合として各クラスをモデル化する分散部分プロトタイプフレームワークであるvMFProtoを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:16:41 GMT)
TRUST: Item-Calibrated Interval Evidence for Temporal Session-Based Recommendation [9.0] 本稿では,それぞれの観測間隔を,対応する項目の経験間隔分布と比較して評価する枠組みを提案する。
実験により,提案したスコアリング関数は,モデルに依存しない手法として,既存の時間的セッションレコメンデータを改善することができることが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:05:36 GMT)
Nonadiabatic Holonomic Single-Qubit Gates in Non-Hermitian Systems [8.9] 我々は, ノンジャンプシステムにおける駆動型3レベルシステムのための非断熱ホロノミックスキームを開発した。
生物直交の枠組みの中では、調整された複素パルスは計算-部分空間進化の正確な閉包を強制する。
提案手法は,すべての素固有状態の減衰と劣化をパルス設計に直接組み込むことにより,非ジャンプゲートの忠実度を低下させない。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:33:48 GMT)
Designing Reward Signals for Portable Query Generation: A Case Study in Industrial Semantic Job Search [8.8] 本稿では,Emphportable Search クエリを生成するために,エンドツーエンドの RLAIF フレームワークを提案する。
このタスクは、ポリシー最適化がルーリックの欠陥を活用し、冗長なコピー動作をもたらす、非常に敵対的な報酬曲面を導入する。
提案手法では,提案手法の誤りを再現する報酬を補正するルールベースの報酬フロアを導入することで,家族間評価審査員に+0.147ドルの品質改善をもたらすことを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:09:12 GMT)
Mask to Concept: Auto-Promptable SAM3 via Efficient Test-Time Concept Embedding Search for Few-Shot Annotation [8.8] Mask to Concept (M2C) は、SAM3を外部モジュールを使わずに、医療的な小ショットアノテーションに適応する効率的なフレームワークである。
M2Cは、その凍結したアーキテクチャの中で、転送可能な視覚概念を検索する。
医用セグメンテーションのベンチマーク実験により,SOTAの少数ショットセグメンテーション性能と優れたアノテーション効率が得られた。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:44:37 GMT)
Diffusion-corrected Autoregressive Fourier Neural Operator for Droplet Evolution Prediction [8.6] 拡散補正型自己回帰フーリエニューラル演算子(DiffARFNO)について紹介する。
DiffARFNOは自己回帰型フーリエ・マイノネットと条件付き拡散拡散インプリシットモデル(DDIM)を結合する。
Fluentによるドロップレットデータセットの実験では、DiffARFNOが既存の最先端モデルを大幅に上回っていることが示されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 23:42:02 GMT)
Geometry-Aware Superpixel Graph Transformer with Metadata for Skin Lesion Classification [8.1] 既存のCNN/ViTパイプラインは、グローバルまたはパッチレベルの機能に依存しており、しばしば後期融合を通じて患者のメタデータを組み合わせる。
本稿では,空間的コヒーレントなスーパーピクセル領域のグラフとして,病変を明示的にモデル化する新しい領域ベースグラフ学習フレームワークを提案する。
本研究では,領域レベルの関係モデルとグラフネイティブなマルチモーダル融合が,最先端技術に対して一貫した利得をもたらすことを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:23:43 GMT)
ShareLock: A Stealthy Multi-Tool Threshold Poisoning Attack Against MCP [8.1] マルチツールのしきい値中毒フレームワークであるShareLockを紹介します。
ShareLockは悪意のある命令を、複数のツール記述に隠された秘密の共有として配布する。
以上の結果から,ShareLockはツール記述に基づく検出において,既存の単一ツール中毒対策を著しく上回ることがわかった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:35:28 GMT)
Compiler-Driven Approximation Tuning for Hyperdimensional Computing [8.1] 超次元コンピューティング(HDC)は、従来のディープラーニング技術に代わるものである。
本稿では,HDCワークロードにおけるドメイン固有近似の自動識別と適用のためのフレームワークであるApproxHDCを紹介する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:46:49 GMT)
Random Walk on Bézier Curves for Global Optimization [8.1] 本稿では,進化的探索を適応軌道構築として再構成する幾何駆動最適化フレームワークを提案する。
進化中の曲線の順序を適応的に変化させることにより, 提案手法は, 多様化した大域探査から改良された局所的利用へのスムーズな移行を可能にする。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:50:06 GMT)
Retrieval-Warmed Energy-Based Reasoning: A Five-Arm Ablation Methodology for Diffusion-as-Inference on Structured Reasoning Tasks [8.0] textbfwarmretrieval-ed energy-based reasoning (RW-EBR) - IREDエネルギーベース拡散モデル。
We study textbfwarmretrieval-ed energy-based reasoning (RW-EBR) -- a IRED energy-based diffusion model。
We study textbfwarmretrieval-ed energy-based reasoning (RW-EBR) -- a IRED energy-based diffusion model。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:28:08 GMT)
FlameVQA: A Physically-Grounded UAV Wildfire VQA Benchmark with Radiometric Thermal Supervision [7.9] UAVからのワイルドファイア監視には、複雑な空中シーンに対する信頼性の高い推論が必要である。
FLAME 3上に構築されたUAVベースの山火事インテリジェンスのためのベンチマークであるFlameVQAを紹介する。
FlameVQAには、6つの運用能力グループにまたがるイメージ毎に34の多重選択質問が含まれている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:06:59 GMT)
Discovering Millions of Interpretable Features with Sparse Autoencoders [7.9] textbfQwen3-Instruct SAEは、Qwen3命令チューニングモデルファミリでトレーニングされたSAEの包括的スイートである。
本研究では,選択したSAE特徴量を用いて,Qwen3モデルの動作拒否を因果的に制御できることを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:33:03 GMT)
Learning 3D Affordances for Blade Insertion in Cluttered Stowing [7.9] VulcanVoxelは人間のアノテーションを使わずに1万件の実際の倉庫のストーエピソードをトレーニングし、最高のポーズベースのベースラインでは0.89対0.71のトップ5のカバレッジを達成した。
実羽根挿入サイクルのデータセットを公開し,RGB-D観測でシーン,空間,マルチアームで撮影した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:09:56 GMT)
Heavy-Ball Q-Learning with Residual Weighting Correction [7.8] 本稿では、強化学習(RL)のための修正重ボールQ-ラーニング法を提案する。
また、理論上、この手法が標準Q-ラーニングよりも早く収束することが保証されている条件を特定する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:48:58 GMT)
How Reliable Is Your Jailbreak Judge? Calibration and Adversarial Robustness of Automated ASR Scoring [7.8] LLMジェイルブレイクとプロンプトインジェクションに関するほぼすべての論文は、アタック・サクセス・レート(ASR)を報告している。
我々は2人の裁判官の家族と人間の多数決を比較して攻撃する。
審査員の精度とリコールを報告し、審査員の精度を補正したASRを報告し、審査員の逆チェックを含めることを推奨する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:04:55 GMT)
Jailbreaking for the Average Jane: Choosing Optimal Jailbreaks via Bandit Algorithms for Automatically Enhanced Queries [7.8] ますます懸念されるのは、専門家でない悪質なアクターが、悪意のあるリクエストに対して実行可能な応答を引き出す可能性があることだ。
本稿では,マルチアーム・バンディット・フレームワークに基づく新たな攻撃戦略を提案する。
我々の盗賊による攻撃は、平均して15ドル以上のSoTAオープンウェイトLSMで、最大97%の成功率を達成した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:11:28 GMT)
Pseudo-Text-Conditioned 3D Grounding DINO for Organ Localization in Abdominal CT [7.6] CT-3GDINOは、Grounding-DINOスタイルのクエリベースのアーキテクチャを固定臓器の局在に適応させる軽量な3D検出器である。
193例のRSNA/RATIC CTボリュームにセグメンテーション由来のボックスを装着し,評価を行った。
最高のマルチスケールモデルは、スクラッチからトレーニングされ、3D IoUしきい値から0.1から0.7までの0.5830のトップ1クラスのmAPを達成する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:22:07 GMT)
Kalman Prototypical Networks for Few-shot Fault Detection in Combined Cycle Gas Turbines [7.6] 複合サイクルガスタービン(CCGT)は現代の発電において重要な役割を担い、高効率と環境負荷の低減を図っている。
複雑な熱流体と機械的相互作用は、特にラベル付き断層データが不足している場合に、断層検出を複雑にする。
本稿では,CCGTの故障診断に特化して開発されたKalman Prototypeal Network(KPN)について紹介する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:41:00 GMT)
An Empirical Study of LLM-Generated Specifications for VeriFast [7.6] 静的検証ツールは、産業規模のソフトウェアを保証できますが、仕様を書くにはかなりの人的労力が必要です。
最近の研究は、検証対象の仕様を含むコード、テスト、証明を生成するために、大きな言語モデル(LLM)を適用している。
本稿では,SL検証器 VeriFast で 303 C 関数を検証するための仕様を生成するために LLM がいかにうまく機能するかを徹底的に評価する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:50:43 GMT)
Fine-tuning a multimodal large language model for clinician-grade autism behavioral scoring from short home videos [7.6] 自閉症スペクトラム障害(Autism spectrum disorder)は31人中1人に影響を与えるが、診断時の平均年齢は4歳を超えている。
Gemini 2.5 Proを400種類のクリニカルなホームビデオに微調整し、低ランク適応訓練を30種類の行動特性で行った。
微調整LDMは、自閉症の評価と診断に使用するスケーラブルな行動特徴抽出器として機能する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:06:39 GMT)
Multipath Adaptive Gated Bottleneck Latent ODE with Raman Data Fusion for Cell Culture Process Forecasting [7.6] バイオプロセスの予測は、測定がまばらで不規則にサンプリングされているため困難である。
我々は,Gated Bottleneck Latent Specific Differential Equation (GB-Latent ODE)とMulti-Path Just-In-Time Fine Tuning (MP-JIT-FT)を組み合わせた適応型フレームワークを提案する。
38個のFeed-batch 5Lバイオリアクターが14の条件で動作し、MP-JIT-FTとRaman融合は最高平均ランクを達成し、9つの変数のうち8つでグローバルなLatent ODEベースラインを上回っている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:53:08 GMT)
Fast algorithms for learning a Gaussian under halfspace truncation with optimal sample complexity [7.4] 未知のハーフスペースに切り替わる高次元ガウス学習の基本的な問題について検討する。
非自明な切り抜きでは、任意の目標精度$varepsilon > 0$に対して、$n = tildeO(d2/varepsilon2)$サンプルを使用する効率的なアルゴリズムを与える。
我々のアルゴリズムも高速であり、その実行は経験的共分散行列の計算コストに支配されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:14:57 GMT)
Perceptual 3D Simulation With Physical World Modeling [7.4] P3Simは、部分的な観察と不完全な3D変換信号の両方の下で将来のシーン状態をシミュレートする物理世界モデリングシステムである。
学習した推論と明示的な幾何学的構造を組み合わせることで、P3Simはデータ駆動の柔軟性とインダクティブバイアスの組込みのバランスをとる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:01:34 GMT)
Clinical Harness for Governable Medical AI Skill Ecosystems [7.3] 本稿では,AI可能な臨床機能の登録,オーケストレーション,保護,監視を行うランタイムガバナンスアーキテクチャを提案する。
骨粗しょう症を例として,知識駆動型,データ駆動型,物理駆動型のスキルが,実行時管理下でのライフサイクルケアをいかに支援できるかを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:53:24 GMT)
The Capability Frontier: Benchmarks Miss 82% of Model Performance [7.3] 既存のベンチマークでは、1回のランで1つのモデルの精度が報告されるのが一般的である。
これにより、実世界のLLM能力、特に異種データ分布を体系的に下降させる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:20:47 GMT)
ForesightSafety-VLA: A Unified Diagnostic Safety Benchmark for Vision-Language-Action Models [7.1] 本稿では,視覚自明な動作(VLA)システムにおいて,安全性を主要な評価対象とする診断ベンチマークであるForesightSafety-VLAを紹介する。
物理的相互作用安全性(セーフコア)、命令側安全(セーフラング)、知覚側安全(セーフビジョン)を対象とする13カテゴリーの安全分類を定義する。
我々は,RoboTwinの66の安全拡張ベースシナリオを5つの実施形態でインスタンス化し,代表VLAベースラインについて報告する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:19:36 GMT)
EGG: An Expert-Guided Agent Framework for Kernel Generation [6.8] LLMの判断を導くために,専門家最適化の原則を取り入れた,カーネル生成のためのエキスパートガイドエージェントフレームワークEGGを提案する。
EGGはPyTorchよりも平均2.13倍のスピードアップを実現し、既存のエージェントベースおよびRLベースのアプローチより優れている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:44:26 GMT)
Protocol Prying: Systematic Vulnerability Research in the Apple AirDrop and Android Quick Share Proximity Transfer Protocols [6.8] Apple AirDropとGoogle/Samsung Quick Shareは、50億以上のデバイスで使われている近接ファイル転送プロトコルである。
両スタックの最初のクロスプラットフォームリバースエンジニアリングとプロトコル対応ファジリング研究を行う。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:40:13 GMT)
HumanoidUMI: Bridging Robot-Free Demonstrations and Humanoid Whole-Body Manipulation [6.7] 我々はHumanoidUMIを提案する。HumanoidはHumanoid全体データ収集のためのポータブルかつロボットフリーなフレームワークである。
軽量なVRデバイスとUMIにインスパイアされたグリッパーを使用して、スパースな人間のキーポイント軌跡、手首視観察、グリッパーアクションを収集します。
5つの実世界のシナリオで実験を行い、提案したフレームワークの有効性を実証した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:23:56 GMT)
Quantization in Federated Learning: Methods, Challenges and Future Directions [6.7] 本稿では,FL中心の量子化を初めて体系的に検討し,FL固有次元を中心に整理された新しい分類法を提案する。
量子化がクライアントドリフト、部分的参加、収束安定性、セキュアアグリゲーション、差分プライバシーなどの中核FL行動とどのように相互作用するかを分析する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:03:55 GMT)
Geometry-Anchored Transport Framework for Exemplar-Free Class-Incremental Learning [6.6] 巨視的異方性ドリフトを緩和するGeometry-Anchored Transport Frameworkを提案する。
また、局所化多様体の分解を正規化するトポロジー・アウェア進化の目的も導入する。
CIFAR-100、TinyImageNet、ImageNet-100にわたる実験では、提案されたフレームワークが既存のポストホック代替品を一貫して改善していることが示されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:20:34 GMT)
scBench-Long: Verifiable Benchmarking of Long-Horizon Single-Cell Biology [6.5] 長距離単細胞生物学のベンチマークである scBench-Long を紹介する。
scBench-Longは、エージェントが局所的な分析段階を超えて複雑な科学的主張を行うことができるかどうかを評価する。
1,068タスクで最強のモデルハーネスペアは16/63ラン(25.4%)をパスした。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:21:50 GMT)
\textsc{DiARC}: Distinguishing Positive and Negative Samples Helps Improving ARC-like Reasoning Ability of Large Language Models [6.4] ARC;citealpcholletmeasureには、限られたグリッドサンプルからのパターンの要約と出力グリッドの予測を必要とするタスクが含まれている。
我々は,ARCライクな問題を解くためには,テキスト陽性サンプルの監視だけでなく,テキスト陰性サンプルを識別してモデル推論を改善する能力も必要であると主張している。
本稿では、出力レベルの視覚変換、DSLレベルのルールインバージョン、タスク固有のルール編集など、負のサンプルを作成する3つの方法を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:10:29 GMT)
Depth-Semantic Alignment and Affinity-Guided Fusion for Structured Radar Point Cloud Generation [6.4] ミリ波レーダーポイントの雲は、通常疎く、ノイズがあり、構造的に不完全である。
本稿では,ビジョンレーダ融合に基づくマルチモーダルポイントクラウド生成手法を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:28:18 GMT)
HantaWatch: Federated Learning for Hantavirus Genomic Surveillance [6.1] HantaWatchは、研究室や監視サイトが、生データを共有せずに、シーケンスベースのモデルを協調的に訓練できる学習フレームワークである。
HantaWatchはk-mer機能抽出、ソース対応のフェデレーションクライアント構築、適応DU-FedProx最適化、監視固有のモデル選択、予測のみのトリアージを統合している。
モデルアウトプットをリスクスコア、信頼度推定、不確実性フラグ、ランク付けされた専門家レビューの優先順位に変換する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:22:00 GMT)
Bridging Handheld and Teleoperated Supervision for Contact-Rich Manipulation via State-Gated Experts [6.1] コンタクトリッチな操作のためのハンドヘルドと遠隔操作による監視の相互作用について検討する。
我々は、観察と所望の監督のミスマッチに対処するため、Gated Experts (BRIDGE) によるImitation Dataのバイモーダルルーティングを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:06:38 GMT)
SPARK: Low Latency Single-Camera 3D Pose Estimation for Autonomous Racing using Keypoints [5.9] キーポイント検出を用いた自律走行のための単カメラポーズ推定アルゴリズムであるSPARKを提案する。
最先端のモノクロカメラ検出アルゴリズムよりも高い精度で長距離検出を実現する。
我々は、実世界の自律レースデータに対するアプローチの性能を評価し、それを最先端のLiDARとカメラ検出アルゴリズムと比較した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:13:26 GMT)
Symplectic Neural Networks for learning Generalized Hamiltonians [5.8] ハミルトニアンニューラルネットワーク(HNN)は、システムのハミルトニアンを学習し、一般化とサンプル効率を改善することで、物理プライドをニューラルネットワークに統合する。
シミュレーションがハミルトン系の長期的な挙動を忠実に反映するためには、系の幾何学的構造を保存するシンプレクティック反復を用いることが不可欠である。
本研究では, 暗黙のシンプレクティックインテグレータをベースとしたHNNモデルを用いて, トラジェクトリーのノイズ観測に基づくHNNトレーニングの代替手法について検討する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:36:44 GMT)
Organizing in the Digital Age: Understanding Community, Challenges, and Consequences in Digitally-facilitated Labor Organizing [5.8] 本研究では、様々な労働組合の労働者がデジタル・テキスト・ベースのコミュニケーション・プラットフォームをどのように活用しているかを詳細に分析する。
この結果から,デジタルツールは現代の労働成功に不可欠なものではあるが,新たな複雑さももたらしていることが明らかとなった。
これらの知見に基づいて、デジタル組織化のより広範な理解と、組合におけるデジタルツールの役割とを関連づける。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:13:17 GMT)
Non-Hermiticity of an anomalous superradiant phase [5.7] 我々は、多体光マター系における非エルミート物理学の最小設定として、エルミートスクイーズ・ディッケモデルを提案する。
我々のシステムは、エキゾチックな非エルミート物理学と非相互量子増幅の代替経路を提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:54:29 GMT)
The Riddle Riddle: Testing Flexible Reasoning in Large Language Models and Humans [5.7] 人間は与えられた問題の要求に柔軟に推論戦略を適用する。
リドル・リドル(Riddle riddle)は、一般的なリドルを模倣するために書かれた単語の問題である。
人間と大きな言語モデルは、このパラダイムでは反対方向に失敗する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:41:12 GMT)
Understanding Domain-Aware Distribution Alignment in Budgeted Entity Matching [5.7] 低リソース・ドメイン対応EM-BEACONの最先端手法について検討する。
我々は,その性能がアルゴリズムの選択やデータ可用性の条件によってどのように影響を受けるかを検討する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:49:48 GMT)
Data-Free Reservoir Features for Efficient Long-Horizon Cold-Start Continual Learning [5.7] コールドスタート 古典的なクラス増分学習は、リプレイ、外部事前トレーニング、あるいは大きな初期タスクなしで成長するクラスの集合を学習する必要がある。
画像分類に BiRC2D を応用した, 固定二方向2次元貯留層から構築したクラスインクリメンタル分類器 CIRCLE と, ストリーミング線形判別分析ヘッドを提案する。
CIFAR-100、TinyImageNet、ImageNet-Subset、ImageNet-1kでは、CIRCLEは10~20タスクスプリットで競争力があり、トレーニング中に強力なCS-EFCILベースラインを50、100、500タスクスプリットで大幅に上回っている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:31:55 GMT)
Quantum Physics-Informed Neural Networks for Solving Integro and Fractional PDEs [5.7] この研究は、量子物理学インフォームドニューラルネットワーク(QPINN)フレームワークを導入し、量子ニューラルネットワークと一般的な非線形方程式の制御方程式を組み合わせる。
一連の数値実験により,提案するQPINNフレームワークが非線形IDEおよびFIPDEの挙動を正確に把握できることが示されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:51:47 GMT)
Decision-Aligned Evaluation of Uncertainty Quantification [5.5] 評価基準が下流のユーティリティと有意に一致していることを示す基準である意思決定アライメントを導入する。
本稿では,決定整合性評価を行うための適切なスコアリングルールの特別なクラスである,事前重み付きユーティリティメトリクスを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:05:41 GMT)
Paved with True Intents: Intent-Aware Training Improves LLM Safety Classification Across Training Regimes [5.5] 我々は1,724個の困難な安全プロンプトを人間に注釈付けしたデータセットであるAIMSを紹介する。
我々はAIMSを用いて、教師付き微調整、嗜好学習、推論蒸留、強化学習における意図認識トレーニングを評価する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:03:57 GMT)
HiLSVA: Design and Evaluation of a Human-in-the-Loop Agentic System for Scientific Visualization [5.5] 我々は、混合開始型SciVisをサポートするHLSVA(Human-in-the-loop agentic system)を提案する。
HiLSVAはエージェントSciVisを人間の分析的推論を置き換えるのではなく、協力的なプロセスとして再構成する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:19:07 GMT)
R2D-RL: A RoboCup 2D Soccer Environment for Multi-Agent Reinforcement Learning [5.4] RoboCup 2D Soccer Simulation (RCSS2D)は、成熟したロボット・ソクラシー・プラットフォームを提供する。
R2D-RLはRCSS2DとHELIOSベースのプレイヤークライアントをPython MARLインターフェースに接続する強化学習環境である。
私たちは、ベースライン結果とともに、フロントゴールシナリオと11-vs-11フルフィールドベンチマークを提供します。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:55:34 GMT)
NebulaExp-8B: An Empirical Post-Training Pipeline via Full-Scale Ablation Research [5.3] トレーニング後のアライメントは、大きな言語モデルの能力に従って、推論と人間の好みを決定する。
この研究は、Qwen3-8Bベース上に構築された完全に透明でアブレーション駆動のポストトレーニングパイプラインであるNebulaExpを提示する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:03:25 GMT)
From Celebrities to Anyone: Characterizing AI Nudification Content, Technology, and Community Dynamics on 4chan [5.2] 野生におけるAIヌードの大規模研究を行い,24,105個のSNEACI項目を同定した。
非有名人は現在55.8%の目標を達成しているが、以前の研究では4.7%に過ぎなかった。
オープンソースモデルはプロダクションを支配し、安定拡散ファミリーは42.7%、ワンは66.5%の動画を生成している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:21:38 GMT)
Narrative-UFET: Narrative Generation for Ultra-Fine Entity Typing [5.2] 超微細エンティティタイピングの制御拡張であるNarrative-UFETを提案する。
各エンティティの言及は、自動的に生成された短く一貫性のある物語とペアリングされる。
文レベルのベースラインよりも長い尾の型が一貫した改善をもたらすことを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 23:04:05 GMT)
RouterVLA: Turning Smoke Tests into Supervision for Heterogeneous VLA Selection [5.2] 政策選択を監督するために、事前配備評価ロールアウトを再利用できるかどうかを検討する。
政策選択を監督するために,事前配備評価ロールアウトを再利用できることが判明した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:56:33 GMT)
Joint Learning of Experiential Rules and Policies for Large Language Model Agents [5.1] LLMエージェント(JERP)における経験則と政策の連成学習
JERPは、長期間の経験則プールと、同じ相互作用軌道からポリシーを更新する。
AlfWorldとWebShopの実験では、複雑な対話的なタスクに対して、JERPは決定性能において一貫した利益をもたらすことが示されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:11:02 GMT)
Structured-Li-GS: Structured 3D Gaussians Splatting with LiDAR Incorporation and Spatial Constraints [5.1] LiDAR統合によるガウス鋳型(3DGS)の構造的枠組み(構造化Li-GS)
構造化Li-GSは、高精度で密度の高い色の点雲をトレーニングすることで、より少ないガウスで高品質な3D再構成を実現する。
ハードウェア同期型LiDARカメラハンドヘルドスキャナを試作した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:49:22 GMT)
Large-Scale Tunnel Air-Ground Collaboration With FLISP: Fast LiDAR-IMU Synchronized Path Planner [5.0] FLISPは、協調UGV-UAV検査のためのマップレス計画フレームワークである。
FLISPは、UGV搭載のLiDAR-IMUスイートが両方のプラットフォームで同期パス生成を駆動する統一アーキテクチャを備えている。
FLISPは7ミリ秒のレイテンシで100%の成功率を実現し、グリッドベースのメソッドよりも7倍のスピードアップを実現している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:13:04 GMT)
Aloe-Vision: Robust Vision-Language Models for Healthcare [5.0] 医療に特化したLVLM(Large Vision-Language Models)が、将来性のある研究方向として浮上している。
しかし、進歩は、高品質な医療マルチモーダルデータの不足、安全クリティカルな設定の堅牢性への懸念、狭く汚染される可能性のある評価ベンチマークによって制限されている。
この研究は、マルチモーダルとテキストのみのソースをまたいだ医療ドメインと一般ドメインの両方を統合する、大規模で高品質なフィルタデータであるAloe-Vision-Dataを導入している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:36:38 GMT)
Learning in Markovian bandits with non-observable states and constrained decision epochs [5.0] 我々は,マルコフの包帯が非可観測状態であり,おそらくは制限された決定のエポックを伴って,後悔の問題を研究した。
バンドイットの根底にある知識がなければ、腕を切り替えるアルゴリズムの後悔は、すべてのバンドイットに対して超論理的にスケールすることが滅多にないことを示す。
マルコフ帯域に関する事前知識が、その腕のバイアス関数に束縛された形で与えられると、UTB-NOMの適切なインスタンス化は、$O(log(T))$ regretとなる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:18:15 GMT)
From Hallucination to Grounding: Diagnosing Visual Spatial Intelligence via CRISP [4.9] CRISPは、一貫性を通して視覚空間知能を評価する構造診断的評価パラダイムである。
従来のブラックボックスのQAとは異なり、CRISPはメトリクス3Dシーングラフとオラクル介入プロトコルを使用して、潜在推論能力を知覚的ボトルネックから切り離す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:18:38 GMT)
Cleaning Logs for Downstream Tasks (Registered Report) [4.9] LogPurifierは、ログメッセージテンプレート間の依存関係関係に基づいた、タスクに依存しないログクリーニングアプローチである。
本稿では,LogPurifierが2つの下流タスクの有効性と効率に与える影響を評価するために,制御された実験設計を用いた経験的評価計画を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:17:00 GMT)
Human--LLM Collaboration Is Transforming Complexity Metrics in Scientific Texts [4.8] 大きな言語モデル(LLM)は、人間の言語力学に急速に貢献している。
ここでは,2010年から2025年までの数百万のarXiv抽象表現において,微妙なLLM効果を求める。
2023年以降に現れた2つの複雑さメトリクスの微妙な変化を観察します。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:58:23 GMT)
Cascaded Multi-Granularity Pruning for On-Device LLM Inference in Industrial IoT [4.8] 本稿では, 層やアテンションヘッド, フィードフォワードチャネルを粗い順序で除去する多粒度刈取フレームワークを提案する。
情報理論解析は、この順序付けを動機付け、構造独立推定(SIA)はチェック可能な条件として定式化される。
NVIDIA DGX Sparkを使用した産業用スリーディングベアリング障害診断プラットフォーム上に展開され、圧縮されたモデルは推論遅延を67.2%、ピークメモリを62.5%削減した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:44:48 GMT)
SamaVaani: Auditing and Debiasing Multilingual Clinical ASR for Indian Languages [4.7] 我々は、カナダ、ヒンディー語、インド英語を対象とする現実世界の精神科面接データに対して、自動音声認識(ASR)性能の体系的な監査を行う。
本研究の結果から,インド英語では競争力があるものの,地域言語では機能しないシステムが存在するため,モデルや言語間でのかなりの変動が明らかとなった。
SamaVaaniは、ASRのパフォーマンスを同時に改善し、人口集団間の公平性を向上する統合デバイアス手法である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:34:07 GMT)
Extracting Problem and Method Sentence from Scientific Papers: A Context-enhanced Transformer Using Formulaic Expression Desensitization [4.7] 本稿では,学術論文から問題や方法文を抽出することに焦点を当てる。
科学論文に注釈をつけることは労働集約的であり、結果として学習できる情報モデルの量を制限する小さなデータセットが作られる。
本稿では,3つの観点からの小規模データセットによる問題に対処する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:42:16 GMT)
SKILL-DISCO: Distilling and Compiling Agent Traces into Reusable Procedural Skills [4.7] SkillDisCoは、再利用可能なPFSMサブグラフを、成功したトレースから蒸留し、呼び出し可能、実行可能、検証可能な手続きスキルにコンパイルするフレームワークである。
ALFWorldとWebArenaの実験によると、SkillDisCoは成功率を改善し、ベンチマークやモデルスケールを越えたエージェントターンを減らす。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:02:32 GMT)
Compression-Driven Anomaly Detection in Brain MRI Using an Interpretable Quantum Autoencoder [4.6] 脳MRIデータにおける圧縮駆動型異常検出のための量子オートエンコーダについて検討する。
このアプローチでは、角度符号化を利用して画像パッチを量子状態にマッピングし、次に補助的なゴミキュービットを介して情報を破棄するように訓練された変分エンコーダデコーダアーキテクチャを使用する。
異常スコアは、入力が通常のデータに対して圧縮に抵抗する程度を反映し、学習された正規多様体の偏差に対応する高いスコアを持つ。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:56:20 GMT)
Utilizing Cognitive Signals Generated during Human Reading to Enhance Keyphrase Extraction from Microblogs [4.5] 脳波(EEG)信号が、マイクロブログベースのキーフレーズ抽出のために、視線追跡信号を補完できるかどうかを検討する。
その結果,読み上げ時の認知信号は特徴の組み合わせやモデルアーキテクチャによらず,AKE性能を一貫して改善することがわかった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:43:12 GMT)
Calibrated Harmonic Overlaid Implicit Neural Representations for Multi-Dimensional Data [4.4] インプシット・ニューラル表現(INR)は多次元データの強力な先行候補として浮上している。
我々はCHOIR(Calibrated Harmonic Overlaid Implicit Representation)を提案する。
本手法は最先端手法よりも優れた性能を実現する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:48:31 GMT)
Temporally Consistent Label Interpolation for Robust Surgical Multi-Task Learning under Challenging Conditions [4.4] ロバスト・オペレーティング・シーン(FAROS)のフロー誘導時間
ゼロショットセグメンテーションに基づくマスク伝搬と光学的フロー推定を組み合わせたフロー誘導ラベルフレームワークは,手術条件下での外観ベースの伝搬の限界を克服する。
統合されたトランスフォーマーベースのマルチタスクフレームワークは、手術相認識、ステップ認識、予測、楽器セグメンテーション、アクション認識を共同で学習する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:55:26 GMT)
Are LLMs Ready for Anti-Pattern Detection in Microservice Architectures? [4.3] マイクロサービスシステムは、保守性、進化性、運用品質を妨げるアーキテクチャアンチパターン(AP)を繰り返す傾向があります。
本稿では,大規模言語モデル(LLM)がマイクロサービスアーキテクチャにおけるアーキテクチャアンチパターン検出をサポートする準備が整っているかを検討する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:03:24 GMT)
DanceDuo: Bridging Human Movement and AI Choreography [4.3] 本稿では、拡散モデルを利用して、さまざまなジャンルに同期したAI振り付けダンスシーケンスを生成する新しいプラットフォーム、DanceDuoを紹介する。
このシステムでは、ユーザーは音楽トラック、ヒューマノイドモデルを選択し、比較のために個人ダンスビデオをインポートすることでAIと対話し、リッチで魅力的なユーザー体験を育むことができる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:26:36 GMT)
SharQ: Bridging Activation Sparsity and FP4 Quantization for LLM Inference [4.2] SharQは、オンラインスパース-デンス分解による活性化空間とFP4量子化を橋渡しする。
スパースFP4 GEMMはバックボーンを処理し、密度の高いFP4 GEMMはマスク誘起活性化損失とスパースパス量子化誤差の両方を補償する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:19:04 GMT)
A Givens-exchange ansatz for molecular variational eigensolvers [4.2] アーキテクチャ探索を回避する固定トポロジであるGivens-Exchange ansatzについて検討する。
6つの固定種子、係数検証されたLiH-6とH2O-8ハミルトニアンは、BeH2-6の公的な特定候補とともに、全ての実行において化学的に正確である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:49:07 GMT)
hia-gat: A Heterogeneous Interaction-Aware Graph Attention Network For Frame-Level Traffic Conflict Risk Prediction On Freeways [4.2] 本稿では,多エージェントシーングラフレベルのバイナリ分類問題として,フレームレベルフリーウェイリスク評価を定式化する。
ノードとして車両とエッジとして2つのインタラクションタイプを備えた,フレーム毎の関係対応グラフを構築した。
NGSIM I-80 と US-101 フリーウェイデータセットの実験では、HIA-GAT が平均リスクレベルの最高のパフォーマンスを達成することが示されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:04:54 GMT)
A Closed-Form 4-DoF Inter-Robot Pose Estimator using Bearing-only Measurements [4.2] ベアリング・オーソメトリに基づく協調的ローカライゼーションは、最小限のインフラ要件のため、研究の関心が高まりつつある。
既存の6-DoFアプローチは、正確で信頼性の高いロボット間ポーズ推定を迅速に取得する上で、依然として課題に直面している。
まず, 回転数推定の非線形制約を緩和し, 誤り予測を用いた4-DoFロボット間ポーズ推定器を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:20:20 GMT)
Making Failure Safe: A Constrained, Verifiable Agent Framework for Open-Web Data Collection [4.1] LLMやエージェントは自然言語でWebスクレイパーを生成することができるが、直接生成は信頼性が低い。
本稿では,LLM出力を自由形式コードから型付きコレクタ構成に変換する制約付き検証可能なエージェントフレームワークを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:05:37 GMT)
Large-scale multimode entangling-gate synthesis in trapped-ion systems [4.1] トラップイオンシステムは、スケーラブルな量子情報処理のための主要なプラットフォームとして登場した。
トラップ中のイオンの数が増加するにつれて、多モードの絡み合いゲートの合成がますます困難になる。
ここでは,制御フィールドを探索するマルチトーンゲート合成のための数値解析フレームワークを開発する。
これらの結果から,大規模トラップイオン量子プロセッサにおいて,マルチモードゲートをプログラマブルな相互作用工学への有効な経路として同定した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:47:56 GMT)
Attributed, But Not Incremental: Cannibalization-Corrected Attribution for Large-Scale Advertising [4.1] 大規模な有償買収および成長広告システムでは、有償変換は体系的に真の漸進的な成長を誇張する可能性がある。
この帰属・共食いミスマッチは、段階的なROI測定と予算決定を大規模に歪めてしまう可能性がある。
本稿では,スパルスリフト測定を日次補正推定に変換するために,因果アンカーとして漸進性実験を用いる実験校正属性補正フレームワークを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:21:37 GMT)
Quantum Generative Diffusion Model for Real-World Time Series [4.1] 時系列合成のための量子生成拡散モデルQDiffusion-TSを提案する。
このフレームワークは、デノナイジング変換器内のフィードフォワードコンポーネントを量子ニューラルネットワークに置き換えることで、古典的な拡散アーキテクチャを拡張している。
量子拡張アーキテクチャは、パラメータが大幅に少ない古典的性能に一貫して適合し、頻繁に超えることを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:33:57 GMT)
Batch-Invariant Spectral Intelligence for Robust and Explainable Insect Authentication [4.1] 食用昆虫は、従来の家畜よりも土地や水が少なく、温室効果ガスの排出も少ない、オルタナティブなタンパク質の効率的な供給源を提供する。
彼らの食品サプライチェーンへの統合の成功は、アレルゲンの曝露を防ぎ、密通を防ぎ、規制基準を満たすための信頼性の高い種認証を要求する。
本稿では,学習可能な前処理モジュールとSavitzky-Golayフィルタを併用したエンドツーエンドのフレームワークであるBatch-Invariant Spectral Network(BISN)と,バッチ固有のスペクトル変動を抑制するために,エントロピー規則化された対向目的を導入する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:42:51 GMT)
Spacecraft Fiducial Marker for Autonomous Rendezvous, Proximity Operations, and Docking [3.9] フィデューシャルマーカーは、自律的なランデブー、近接操作、宇宙ロボットのドッキングを支援する。
本稿では,自律型軌道上ロボット操作のためのフィデューシャルマーカーであるAstraTagについて述べる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:52:15 GMT)
Zero-Shot Size Transfer for Neural ODEs on Sparse Random Graphs: Graphon Limits and Adjoint Convergence [3.9] グラフオン微分方程式 (Graphon Differential Equations, Graphon-NDEs) と随伴グラフオン-NDEs をフォワードおよび随伴E系の無限極極限とみなす。
また,DTO(disretize-then-Optimize)とOTD(Optimized-then-Discretize)のトレーニングについても検討した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:53:20 GMT)
When Does Quality-Aware Multimodal Fusion Matter? A Leakage-Safe Diagnostic for Decision-Level Dependence [3.9] 本稿では,推測時に信頼性情報を使用するかどうかを簡易に診断する手法を提案する。
感情分析のためのストレス認識とCMU-MOSEIの実験は、変動する信頼性スコアは、性能が変わらないことを示している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:14:22 GMT)
Closing the Quality Gap in Low-Resource Text-to-Speech: LoRA Fine-Tuning of VoxCPM2 for Khmer and Korean [3.9] 事前訓練された大規模なテキスト音声モデルは、十分にソースされた言語ではほとんど人間に聞こえるが、トレーニングデータでは稀な言語ではずっと悪い。
フローマッチング拡散拡散拡散拡散を伴うMiniCPM-4言語バックボーンを結合するモデルであるVoxCPM2を用いて、クメールと韓国のこの品質ギャップについて検討する。
約26時間の共有言語タグ付きコーパスを構築し、VoxCPM2を1つのLow-Rank Adaptation (LoRA)アダプタで適応させ、同時に両方の言語でトレーニングし、言語モデルとデコーダの両方に追加します。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:27:18 GMT)
Same Scrutiny, More Time: Eye Tracking Insights into Reviewing LLM-Labelled Code [3.8] We conduct a Wizard-of-Oz experiment to examine how software engineers behavior when code is clearly labeled as LLM- generated during a code review task。
コードレビューの徹底性は参加者にとって変わらなかったが、ラベル自体が注意に影響を及ぼすことを示すLCMに多くの時間を費やした。
実践者は、特定の基準に基づいてコードを評価したり、そのプロンプトを使ってレビューをガイドすることで、LLMをラベル付けしたコードに対するレビュー戦略にも適応した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:23:05 GMT)
DeCoFlow: Structural Decomposition of Normalizing Flows for Continual Anomaly Detection [3.8] 正規化フロー(NFs)は正確な密度推定を提供するが、パラメータ更新が密度多様体を歪ませると破滅的な忘れ込みに悩まされる。
更新を分離するために、フリーズされたユニバーサルベースとタスク固有の低ランクアダプタへの変換を分解するDeCoFlowを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:18:13 GMT)
MLFFM-SegDiff: A Multi-Level Feature Fusion Diffusion Model for Skin Lesion Segmentation [3.7] MLFFM-SegDiffは皮膚病変分割のための多層拡散拡散モデルである。
拡散フレームワーク上に構築され、デュアルパスU-Netエンコーダ、MLFFM(Multi-Level Feature Fusion Module)、境界感度損失関数を導入している。
MLFFMは、注意、スケールアライメント、適応的なクロスレベル融合によるスキップ接続を改善している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:45:28 GMT)
Syntactic Belief Update as the Driver of Garden Path Processing Difficulty [3.6] レキシカル・サプライサル(Lexical surprisal)は、通常、文処理の難しさを非常によく予測する尺度であり、庭の道の文に良い予測を与えることができない。
本稿では,構文木上の確率分布を積極的に予測し,各単語の後にその分布を更新する手法を提案する。
このSyntactic Belief Updateは、ガーデニングパス文の人間の読書時間データによくフィットする。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:02:14 GMT)
PanoImager: Geometry-Guided Novel View Synthesis and Reconstruction from Sparse Panoramic Views [3.6] PanoImagerはSfMフリーのフレームワークで、フィードフォワードのポーズ/ディープスプリエント、幾何条件の拡散ビュー補完、奥行き誘導3DGS最適化を組み合わせている。
SfM/SLAMの初期化に失敗した場合,PanoImagerはマップリファインメントのためのオフライン/バックグラウンドコンポーネントであることが示唆された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:15:09 GMT)
AI Healthcare Chatbots as Information Infrastructure: A Large-Scale Study of User-Reported Breakdowns [3.5] この研究は、59のAIヘルスケアチャットボットアプリから15,000以上のユーザーレビューを調査する。
アクセス障壁とサービスの信頼性、ユーザエクスペリエンスとインタラクション品質、請求と顧客サポートの問題です。
我々の発見は、アクセス障害、ユーザビリティ、信頼がユーザに与える影響を強調し、デジタルヘルスシステムの改善を目指すデザイナー、政策立案者、情報専門家に実用的な洞察を提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:24:26 GMT)
RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning [3.4] RLVRシステムのためのポストトレーニングフレームワークであるRolloutPipeを提案する。
固定重量のロールアウトを完全なグループパイプラインに変換し、トレーニング可能なグループがトレーナーに移動し、後続のグループが生成する。
ロールアウトパイプはロールアウト・トゥ・トレイン・エンド時間を30.7%-42.3%短縮し、トレーナーの待機率をスライムに比べて37%-76%下げる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:14:14 GMT)
Improving Reasoning in Vision-Language Models via Perception Verified Self-Training [3.4] 本稿では,視覚的根拠に基づく推論を強制する自己学習フレームワークを提案する。
まず,認識を推論から切り離すCoTテンプレートを用いて,視覚的理解の独立した検証を可能にする。
回答の正確さとともにキャプション検証を用いて、データを3つのサブセットに分割する: 簡単(正しいキャプションと結論)、中(正しいキャプションだが、間違った結論)、ハード(間違ったキャプション)。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:42:39 GMT)
Quantum Mutant Equivalence via Transpilation [3.4] 量子ソフトウェアでは、突然変異試験がますます使われているが、等価な突然変異問題は未解決のままである。
本稿では,トランスパイラベース等価性(Transpiler-Based Equivalence, TBE)を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:06:50 GMT)
ProtoKV: Streaming Video Understanding under Delayed Query with Summary-State Memory [3.4] ProtoKV は一定フットプリント SVU メモリであり、固定容量の要約状態として長い歴史を表す。
長遅延状態におけるSVUベンチマークのトークン保持ベースラインよりも最大12.5ポイント精度が向上する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:47:15 GMT)
Towards Evaluation of Implicit Software World Models in Coding LLMs [3.4] 観測可能な軸を実行リソースにシフトすることで、より広範な評価に向けて一歩踏み出します。
私たちはSWE-bench Verifiedをデータソースとして使用し、実際のソフトウェアエンジニアリングタスクに近いテストを保持します。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:02:32 GMT)
Adaptive Utility driven Resource Orchestration for Resilient AI (AURORA-AI) [3.4] AURORA-AIは、レジリエントAIのためのAdaptive Utility-driven Resource Orchestrationフレームワークである。
フィードバック制御、リアプノフをベースとした安定性監視、公正性を意識した複合ユーティリティを単一のクローズドループポリシーに統合する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:22:07 GMT)
A Shared IPTC Topic Space for Cross-Source Topic Modelling [3.4] 本稿では,分類学で定義された1つの共有トピック空間にコーパスを配置する再現可能なフレームワークを提案する。
フレームワークはNew York Times 2011コーパスで開発され、選択された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:32:41 GMT)
Mean-Field PhiBE: Continuous-Time Mean-Field Reinforcement Learning from Discrete-Time Data [3.3] Mean-Field-PhiBE は離散時間遷移情報をワッサーシュタイン空間上の連続時間 PDE に組み込む。
我々は、最適MF-PhiBEポリシーによって誘導される値が最適連続時間値に近似することを示す一階一貫性推定を証明した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:05:27 GMT)
Evidence-Driven LLM Agent for C-to-Synthesizable-C Conversion and Verification [3.3] Cプログラムは、高レベル合成(HLS)ツールチェーンの4段階のパイプラインを完了できない。
我々は,HLSツール上でのC-to-HLS-C変換をクローズドループ生成-検証-診断-修復問題として定式化する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:55:02 GMT)
Fortress and Gatekeeper: Theorizing Transitive Trust in Third-Party Cybersecurity Risk Governance [3.1] サードパーティベンダはますます、デジタルサービスデリバリに没頭している。
サードパーティのサイバーセキュリティリスクは、信頼関係とデリゲートの問題の両方である。
論文は、サードパーティのサイバーセキュリティリスクは信頼関係と委譲問題の両方であると主張している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:52:48 GMT)
Pingquanqi (Equalizer): A Cross-Domain Sociotechnical Framework for Human-Agent Interaction Governance [3.0] 本稿では,人間-エージェントインタラクションガバナンスのためのクロスドメインな社会技術フレームワークであるPingquanqiを提案する。
Pingquanqiはネイティブとしてデプロイ可能な4つの統合コンポーネントで構成されている。
この論文は、Pingquanqiの主要な経済的利益は、エンタープライズ展開エージェントサービスであると主張している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:47:12 GMT)
An Iterative Dual-Channel Neural Quantum State Algorithm for Selected Configuration Interaction [3.0] 我々は,古典的に訓練された自己回帰型変圧器ニューラル量子状態を,サンプルベース量子対角化の繰り返しサンプル-対角化-更新フレームワークに組み込むHandover Iterative Neural Quantum State (HI-NQS)アルゴリズムを導入する。
HI-NQSは試験された全てのシステムに対して化学的精度を達成し、最小の活性空間を除いて、従来の CIPSI ベースの SCI よりもかなり有利である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:47:04 GMT)
Kolmogorov Arnold networks (KAN) for aerodynamic prediction: a comparison with MLPs and GNNs [3.0] Kolmogorov Arnold Network (KAN)は、トレーニング可能なパラメータがアクティベーション関数に適応するニューラルネットワークアーキテクチャとして最近導入された。
ここでは、流体力学モデリングの領域におけるKansの性能と、グラフニューラルネットワーク(GNN)との比較について述べる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:02:04 GMT)
Automating Potential-based Reward Shaping with Vision Language Model Guidance [2.8] 本稿では視覚言語モデルからのフィードバックから直接潜在的な機能を学ぶVLM誘導PBRSフレームワークを紹介する。
このアプローチはポテンシャルに基づく報酬形成に基づいているため、元の最適ポリシーを保っている。
結果として得られた選好ラベルは精度が低いが、実証的な証拠は、選好ラベルが学習を加速するためにも使用できることを示している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:45:57 GMT)
Self-Stigma Is Not a Monolith, but Generic Empathy Is: Persona-Conditioned LLM Support for People Who Use Drugs [2.8] セルフスティグマ(Self-stigma)は、薬物を使用する人の治療の回避と解離を予測する。
LLM支援に対するペルソナ認識アプローチの3段階的概念実証研究を提案する。
以上より,総観的共感判断と臨床対応型反応設計が反対方向に導出できることが示唆された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:43:12 GMT)
Surviving by Serving: Functional Relevance Drives Self-Organization in Complex Adaptive Systems [2.8] 我々は、自己組織化の原則としてServingによるSurvivingを提案する。
安定なトランスフォーメーション・チェーンの出現,コア周辺組織,新しい状態の生成を観察する。
これらの結果から, 機能的利用は, 組織構造の出現と安定化のための単純かつ基質に依存しない機構を提供する可能性が示唆された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:16:35 GMT)
Contextual Associations Between Webpage Elements for Web Accessibility: An Empirical Study [2.7] 本稿では、リンク予測を用いて、アクセシビリティツリーからウェブページ要素間の文脈的関連を復元できるかどうかを考察する。
我々は、Trancoのトップミリオンリストに階層化された35のウェブサイト上に、人間による注釈付きコンテキストアソシエーションのデータセットを構築し、ページごとに3つの独立したアノテータを配置する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:38:55 GMT)
Effective Covariance Dynamics in Solvable High-Dimensional GANs [2.6] 線形生成器がデータから低次元部分空間を学習するGANトレーニングの可解な高次元モデルについて検討する。
顕微鏡トレーニングプロセスが高次元の極限において、この効果的な共分散によって支配される決定論的常微分方程式に収束することを証明する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:33:54 GMT)
Ko-WideSearch: A Korean Breadth-Search Benchmark for Exhaustive Set Enumeration by Web Agents [2.4] 金のセットが完成し、すべてのセルが正しいことを証明することは、1つの答えをチェックするよりもはるかにコストがかかる。
textscKo-WideSearchは、自動合成および検証パイプラインによって構築された韓国のパンス検索ベンチマークです。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:51:59 GMT)
PairSAE: Mechanistic Interpretability from Pair Representations in Protein Co-Folding [2.4] 我々はNモードSVDによるペアワイズテンソルをトークンワイズインタラクションロールに要約するPairSAEを紹介する。
次に、スパースオートエンコーダを使用して、シーケンスとペア表現の両方にデコードするトークンレベルの機能の共有セットを学習する。
これらの結果は、PairSAEが構造生物学の基礎モデルの潜在空間と解釈可能な構造概念を結びつけていることを示している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:01:44 GMT)
How to evaluate clustering with ground truth? [2.3] 我々は,セットマッチングに基づく尺度に着目した,最も一般的な外的妥当性指標についてレビューする。
説明可能な結果を持つ直感的なクラスタレベル尺度であるため,Centroid Index (CI) を推奨する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:07:17 GMT)
Operational Tube-Sector Theory of Quantum State Distinguishability Under Generalized Symmetries [2.2] 一般化対称性を持つ多体系において、量子状態の微分可能性の変分原理が確立される。
交絡切断で対称性の作用が終了すると、区別性は境界管代数によって支配される。
得られた最適測定構造は境界管代数の中心によって一意に固定される。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:15:52 GMT)
Forecasting With LLMs: Improved Generalization Through Feature Steering [2.1] 我々はスパースオートエンコーダを用いて、予測タスクが時間固有の知識や一般化可能なパターンに依存しているかどうかを調べる。
時間認識能力の増幅は,一般的な推論性能を維持しつつ,予測プロンプトのルックアヘッドバイアスを著しく低減することがわかった。
これらの結果は, 解釈可能な時間的特徴を用いて, LLMをより歴史的に根ざした推論へと因果的にシフトさせることができることを示唆している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:59:20 GMT)
SatSplatDiff: Geometry-preserving generative refinement for high-fidelity satellite Gaussian Splatting [2.1] そこで我々は,SatSplatDiffを提案する。
本手法は,極小幻覚とセンサの持続的な外観で最大5倍の解像度向上を実現する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:12:36 GMT)
State Representation Matters in Deep Reinforcement Learning: Application to Energy Trading [2.1] 本研究では, 揚水型調停環境において, 強化学習エージェントに与えられる状態表現について検討する。
私たちは、絶対価格/カレンダ機能、現在の価格と最近の市場履歴、予測機能、そしてすべての組み合わせを比較します。
状態表現は、ストレージトレーディングRLにおけるマイナーな前処理の選択ではなく、ポリシー設計の中心的な部分であることがわかった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:39:57 GMT)
A Process Harness for Uplifting Legacy Workflows to Agentic BPM: Design and Realization in CUGA FLO [2.1] 我々は、Agentic Business Process Management(Agentic BPM)にレガシーをアップリフトするための新しいメカニズムであるプロセスハーネスを導入します。
プロセスは、決定論的ワークフローエンジンの周囲にポリシーが支配するエージェント層を配置し、指定された制御ポイントをインターセプトして推論、適応、監視を行い、エンジンはプロセスの構造的権限を保持する。
我々は、CUGA FLOをTDFモデルの設計と実装の実現として提示し、3つのエージェントタイプすべてとフック駆動の規制オーバーライドを実行するローン承認ワークフロー上でそれを実証する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:50:42 GMT)
Speculative Refinement: A Hybrid Autoregressive Diffusion Decoding Strategy and Its Behavior Across Benchmarks [2.0] 我々はSpecRef(Speculative Refinement)を用いて、ARドラフトからマスク付き拡散言語モデルをウォームスタートする。
We evaluate SpecRef across six benchmarks (HumanEval, MBPP, GSM8K, BBH, ARC-Challenge, HellaSwag) with three distinct evaluation protocol。
これらの観察は、多段階または非自己回帰生成パイプラインに適用され、より診断評価の実践に向けて向けられる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:52:24 GMT)
TGHE: Template-based Graph Homomorphic Encryption for Privacy-Preserving GNN Inference in Edge-Cloud Systems [2.0] 既存のホモモルフィック暗号(HE)ベースのGNNシステムは、クエリごとのコストとグローバルグラフサイズを結合するグラフ中心のパラダイムを採用している。
我々は、テンプレート現象を利用してこれを解決するエゴ中心のフレームワークであるTGHEを提案し、トランザクショングラフの局所木は、小さな構造の集合に収束する。
TGHEはエッジでエゴグラフを標準化し、構造上同一のツリーをSIMD並列暗号化推論のための共有暗号文にまとめる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:55:06 GMT)
BetXplain: An Explanation-Annotated Dataset for Detecting Manipulative Betting Advertisements on Social Media [1.9] われわれはInstagramとRedditから収集した賭け関連広告の新しいデータセットを紹介した。
広告は手動で操作的かつ詐欺的な広告慣行に注釈付けされた。
広告を賭けるのによく用いられる戦略を分析し,こうした説得的戦術がユーザのメンタルヘルスに与える影響について検討する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:51:53 GMT)
Scientific discovery as meta-optimization: a combinatorial optimization case study [1.9] 本稿では,最適化目標自体が最適化されているメタ最適化として研究の形式化を提案する。
LLMが生成する目的関数は相関重み付け投票によって結合される。
本稿では,デジタルMemComputingマシンをベースとした3SAT問題に対するアルゴリズム探索に適用する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:11:48 GMT)
LLM-Based Examination of Eligibility Criteria from Securities Prospectuses at the German Central Bank [1.9] 本稿では,Large Language Models (LLMs) を適用した最初のケーススタディについて述べる。
提案手法は,タスクを抽出,正規化,解釈に分解し,ノイズの多いテキストを扱う際の柔軟性を高める。
以上の結果から, LLM を用いたシステムでは, 文書レベルの信頼性が 91% まで向上することが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:29:58 GMT)
Radar Guided Camera Verification for Automatic Emergency Braking Rethinking Object Detection in Radar Camera Fusion [1.9] 本稿では,レーダー誘導画像領域内の障害物検証を行うレーダースコープエッジ密度ゲートを提案する。
提案されたアプローチにより、カメラの検索スペースは最大98.7パーセント削減された。
33回にわたる脅威シナリオでは、完全なABBシステムは無故障のブレーキイベントを記録していた。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:13:00 GMT)
Exploring dynamics of individual vortices in a superconductor via a levitated magnetic transducer [1.8] トラップされた渦は超伝導体の基本的な性質を決定づけ、磁気浮上のような多くの実用化において重要な役割を担っている。
ここでは、ミクロンスケールの浮遊磁性粒子の機械的運動を用いて、個々の渦のダイナミクスを探索する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:14:21 GMT)
Humanoid-DART: Humanoid Loco-Manipulation using Diffusion-guided Augmentation through Relabeling and Tracking [1.8] 人間のデモンストレーションを模倣することは、ヒューマノイドのロコ操作ポリシーを学ぶための支配的なパラダイムとして現れてきた。
本稿では,スパースデモからブートストラップし,行動レパートリーを段階的に拡張する自己教師型フレームワークを提案する。
我々は,複数のヒューマノイド・ロコ・マニピュレーション・スキルにおけるフレームワークの有効性を実証する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:40:33 GMT)
Proposal-Conditioned Latent Diffusion for Closed-Loop Traffic Scenario Generation [1.7] 本稿では,インスタンス中心のシーンコンテキストとマルチモーダルな提案を前提とした拡散型シナリオ生成フレームワークを提案する。
Open Motionデータセットの実験では、さまざまなインタラクティブなシナリオにおけるリアリズム、安全性、コントロール可能性のバランスが好まれている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:01:31 GMT)
MetaboNet-Bench: A Multi-modal Benchmark for Glucose Forecasting in Type 1 Diabetes [1.7] 1型糖尿病患者に対するマルチモーダルグルコース予測のベンチマークを導入する。
データモダリティを追加する利点は、モデルの複雑さに左右されることが示されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:17:47 GMT)
How Good Can Linear Models Be for Time-Series Forecasting? [1.6] コンテクスト長,局所正規化,正規化,および8つの標準ベンチマーク上の拡張を探索する。
その結果得られたモデルは、ほとんどのデータセット水平エントリで以前の線形予測器を破り、8つのベンチマークのうち6つのベースラインであるTransformerを上回った。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:57:50 GMT)
Context-Aware Synthesis of Optimization Pipelines for Warehouse Optimization [1.6] 本稿では,コンテキスト固有の最適化パイプラインの構築と評価を行うフレームワークを提案する。
このフレームワークは、研究者や実践者が倉庫の運用に有効な、高性能なアルゴリズムパイプラインを設計、自動、選択するのをサポートする。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:37:37 GMT)
LLM-based Models for Detecting Emerging Topics in Service Feedback [1.5] 本稿では,大規模言語モデル(LLM),統計技術,人間とAIのコラボレーションを統合し,多言語ユーザのフィードバック分析を改善する手法を提案する。
主な目的は、サービスデリバリの潜在的な不平等を明らかにする可能性のある、新興のサービス品質トピックを検出することである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:46:11 GMT)
3D Spatial Pattern Matching [1.5] 本稿では,距離関係上の3次元空間パターンを解くことのできる部分グラフマッチングアルゴリズムについて述べる。
そこで我々は,ドイツのハンブルクから3次元空間パターンマッチングデータセットを2つリリースした。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:00:49 GMT)
A 0.651-approximation to quantum Max Cut via Rydberg atoms [1.5] 量子マックスカット(英: Quantum Max Cut)または反強磁性ハイゼンベルク・ハミルトン(英: anti-ferromagnetic Heisenberg Hamiltonian)は、QMA完全問題である。
我々は,Rydberg原子系の量子力学を用いた量子カットに対するハイブリッド近似アルゴリズムを開発した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:13:27 GMT)
Learning Motion Feasibility from Point Clouds in Cluttered Environments [1.5] 運動実現可能性予測はロボット工学、特にタスクや運動計画や操作において中心的な役割を果たす。
既存の実現不可能性証明のアプローチは、低次元の設定空間に限られており、既知のパラメータを持つ原始オブジェクトで表される単純化された幾何学的環境を前提としている。
本研究では,リアルな乱雑なシーンで動作する7-DOFマニピュレータの生RGB-D観測から直接の動作実現可能性予測の相補的問題について検討する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:32:25 GMT)
Understanding Cross-Rig Generalization in Automotive Perception: a Multi-Rig Benchmark and Rig Variation Metrics [1.5] 現実世界の車両群は、カメラ配置、向き、視野、カメラ数に大きな変化を示す。
このミスマッチは、幾何学的観察プロセスのみが変化するクロスリグ領域ギャップを導入する。
Plentiful CARLA Camera Rigsは、14のシステマティックなカメラリグで同じ運転シーンをレンダリングするベンチマークだ。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:06:08 GMT)
Scalable Message-Passing Quantum Graph Neural Networks in the Weisfeiler-Leman Hierarchy [1.5] 量子グラフニューラルネットワークがいかにしてメッセージパッシングを行い、置換同変であり、Weisfeiler-Leman階層の選択レベルに座るかを示す。
3つのデータセットにまたがる56キュービットの大規模シミュレーションにおいて、このフレームワークを検証する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:58:29 GMT)
BOWConnect: Parallel Bayesian Optimization over Windows with Learned Local Cost Maps for Sample-Efficient Kinodynamic Motion Planning [1.4] 本稿では,並列キノダイナミックモーションプランナであるBOWConnectについて述べる。
これは、高次元状態空間におけるサンプル非効率性、信頼できないサンプリング、狭い空間における性能の3つの基本的な制限に対処する。
学習ベースの探索フレームワークとしてBOWを統合しており、各作業者はローカルマップと制約を学び、動的に実現可能で衝突のないコントロールへと導くことができる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:11:33 GMT)
Comparing BERT Sentence-Pair Classification and Few-Shot LLM Prompting for Detecting Threat and Solution Framing in German Climate News [1.4] 我々は,ドイツ語の気候ニュース記事から文を脅威指向,解決指向,両方,あるいは両方に分類する2つのアプローチを提案する。
第一のアプローチは、オープンウェイトな大規模言語モデル(Llama 4 Maverick)で、連鎖推論と信頼度スコアによる構造化アウトプットを採用した、数発のプロンプトを使用する。
第二のアプローチは、文ペア分類のためのドイツのBERTモデル(deepset/gbert-large)を微調整する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:48:40 GMT)
Recovering Governing Equations from Solution Data: Identifiability Bounds for Linear and Nonlinear ODEs [1.4] 観測された解データから支配方程式を学習することは、科学機械学習の基本的な課題である。
微分方程式を比較するための自然な計量として、解集合上のハウスドルフ距離を導入する。
我々は、幅広い構造方程式のクラスにわたってODEを管理するための識別可能性境界を確立する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:02:08 GMT)
Odyssey: Constructing Verifiable Local Truth-Preserving Foundation Models [1.3] 本稿では,ファウンデーションの合成として,検証可能な局所的真理保存基盤モデルを構築するためのODYSSEYという分類フレームワークを紹介する。
コンクリート製ファウンダリーは、エビデンス/問題、運用上の決定、制度的/財務的、市場の意味、科学的課題、研究プログラム、補助的構築、評価的ハーネスのファウンダリーなどの一般的なファウンダリーから構築されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:49:17 GMT)
Productionized Fairness Measurement Under Privacy Constraints [1.3] 人種や民族の信号は、公正度の測定に役立てるのが難しい信号の1つである。
本稿では、プライバシ保存型確率的人種・倫理性推定(PPRE)を、プライバシ保存方式で、米国LinkedInメンバーの人種・倫理性に関する公正度測定を可能にする方法として提示する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:20:03 GMT)
Beyond Surface Forms: A Comprehensive, Mechanism-Oriented Taxonomy of Indirect Linguistic Encoding for LLM-Based Coded Language Detection [1.2] 一部のソーシャルメディアユーザーは、カモフラージュに敏感な意味を持つ間接言語表現(ILE)を発明している。
本稿では,IL の包括的,メカニズム指向の分類法を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:29:45 GMT)
TruEye: Fine-Grained Detection of AI-Generated Human Subjects in Images [1.2] TruEyeは、AI生成した人間とシーンのきめ細かい検出と位置決めのための新しいモデルである。
単一の認証ラベルを割り当てる従来の検出器とは異なり、TruEyeは5つの合成内容の合成カテゴリーを初めて識別する。
6つのデータセットと新たにキュレーションされたFineSynデータセットの実験により、TruEyeはより精度が高く、推論が高速で、AIが生成または操作された画像に対してより強力な一般化を実現していることがわかった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:38:41 GMT)
RoboNav-Arm: Agentic AI-Driven Navigation and Obstacle Avoidance for Robotic Manipulator in Cluttered Environments [1.2] 本稿では,効果的な障害回避を伴う安全なタスク実行のためのフレームワークを提案する。
提案手法はGazebo Classicで評価され,動的シナリオにおけるロバスト性を示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:29:11 GMT)
Generative Models on Analog Hardware with Dynamics [1.2] 現代の生成モデルは柔軟でソフトウェア定義の力学を仮定するが、アナログハードウェアは近似能力に制限のある固定された物理学決定微分方程式を課す。
本稿では,ハードウェア実装可能な動的システムのための統合フレームワークであるAnalog Interaction Systemsを紹介する。
Wasserstein GANトレーニング手順は、特定の軌道に従うことなく、これらのモデルのトレーニングを可能にするために開発されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:13:00 GMT)
MIRROR: Novelty-Constrained Memory-Guided MCTS Red-Teaming for Agentic RAG [1.2] マルチモーダルエージェント検索拡張生成(RAG)システムは、即時注入を超えて攻撃面を拡大する。
既存のレッドチーム方式は通常、表面特異的であり、既知のアタックテンプレートを再利用する。
メモリ誘導型モンテカルロ木探索を行う統合型クロスサイトフレームワークMIRRORを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:26:49 GMT)
Analyzing and Encoding the Al-Mawrid Arabic-English Dictionary with the ISO Language Markup Framework and TEI Lex-0 [1.1] 本稿ではアラビア語辞書Al-Mawridの体系的デジタル化と符号化のための堅牢な方法論を提案する。
従来の印刷資源から標準化された計算語彙に変換する。
辞書のマクロ構造とミクロ構造に編集ビューを適用することにより、20世紀のバイリンガル辞書に典型的な構造的曖昧さと不整合を解消する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:19:04 GMT)
Modeling Local, Global, and Cross-Modal Context in Multimodal 3D MRI [1.1] 本稿では,モダリティ固有の表現と相互モーダル相互作用の両方を明示的にモデル化する3次元視覚変換器を提案する。
我々は3つの異種データセットの脳年齢予測におけるMICViTの評価を行った。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:26:57 GMT)
AO-ARC: Almost-Surely Asymptotically Optimal Multi-Robot Motion Planning with ARC [1.1] AO-ARCは、最先端のMRMP実現可能性解決器と同等の解解時間を実現するための、常時マルチロボットモーションプランニング(MRMP)手法である。
AO-ARCは、有界MRMPインスタンス上で元のARCメソッドを反復的に呼び出すことで、実現可能性ソルバを任意のアルゴリズムに変換するためにAO-xメタアルゴリズムを適用する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:20:26 GMT)
Agents That Know Too Much: A Data-Centric Survey of Privacy in LLM Agents [1.1] 大規模言語モデルエージェントは、データベースのクエリの増加、ドキュメントコレクションの検索、外部APIの呼び出し、過去のインタラクションの記憶、ユーザの代理として振る舞う。
質問に答えることから、機密データを操作することに移行するにつれ、プライバシの強制は難しくなる。
我々は, LLMエージェントのプライバシをデータ中心の視点から調査し, 攻撃タイプではなく, エージェントが触れるデータを中心としたフィールドを整理する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 05:44:18 GMT)
Tool Use Enables Undetectable Steganography in Multi-Agent LLM Systems [1.0] 自律的なエージェントAIシステムは、隠蔽通信チャネルを介して秘密の共謀のような、新たなマルチエージェントリスクを生じさせる。
本稿では,エージェントプログラミングモデルがすでに検出不能なステゴシステムを生成できるため,これらのスキームの複雑さはもはや安全障壁ではないことを実証する。
広義のスキーム群にかなり収束するが、厳密なワンショットコーディネートが限られており、共有アーチファクト、繰り返しのインタラクション、ツールによる検索が、秘密の通信リスクが最も急性な設定であることを示唆している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:42:39 GMT)
Unified Zero-Shot Time Series Forecasting: A Darts Foundation [1.0] ファウンデーションモデルは、ゼロショット予測の精度を最近改善したと主張している。
ファンデーションモデルは、しばしば断片化されたインターフェイスを持つ独立したパッケージとしてリリースされる。
Dartsは、最小限の外部依存関係を持つ標準化されたフルサイクルの予測インターフェイスを提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:00:37 GMT)
NuclearQAv2: A Structured Benchmark for Evaluating Domain-Science Competence in Large Language Models [1.0] 大規模言語モデル(LLM)は、幅広いタスクにわたって強力なパフォーマンスを示しているが、高度な技術的領域における信頼性を保証することは、依然として大きな課題である。
核工学の知識に基づいてLLMを評価するためのベンチマークであるNuclearQAv2を紹介する。
ベンチマークは、数値と動詞の3つのカテゴリにまたがる約1,240の質問応答ペアで構成されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:52:16 GMT)
On the Necessity of a Liquid Substrate for Mesh Intelligence [0.9] 共有クロックも、共有モデルも、データ収集や再トレーニングのためのコーディネータも存在しない。
そのような基質は何でなければならないのかを問うとともに、不規則に観測された自己進化性潜水剤の1つのモデルから2つの必要条件を証明する。
LSTMは、第1のフィルタ、第2の固定連続時間フィルタ、および第2のマルチスケール液体ネットワークを満たす。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:42:26 GMT)
Computational Analysis of Heart Rate Variability in Healthy Adults [0.9] 心拍変動(HRV)分析は、心臓生理状態の重要な指標であり、疾患診断の助けとなる。
本研究は, 健常成人40名を対象に, HRV指標の評価を行い, その臨床的有用性について検討した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:59:15 GMT)
Reservoir-independent lossless charging and protected storage of an open quantum battery [0.9] 損失のある中間状態を通して充電される量子電池は、充電速度と散逸の間の構造的トレードオフに直面している。
正確な代数的キャンセルは、駆動された3レベルセルから取り除くことを示す。
我々は中性アルカリ原子, 閉じ込められたイオン, トランスモン, 欠陥中心に対する実験的要件と代表的パラメータを詳述した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:06:17 GMT)
Tilikum: Transaction Fair Ordering on a DAG without Weak Edges [0.9] 我々はDAGベースの台帳プロトコルであるTilikumを紹介した。
Tilikumは、データ冗長性と堅牢なガベージコレクションを維持しながら、中央値ベースのタイムスタンプアグリゲーション(バッチ順序)を活用することで、線形化性を実現する。
以上の結果から, Tilikumは, 最先端DAG特異的リオーダー攻撃を完全にブロックしつつ, 他のフェアオーダベースラインよりも最大39倍高いスループットを実現していることがわかった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:34:44 GMT)
Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs [0.9] ディープラーニング(DL)プログラムは、多くの理由でトレーニング中に失敗する可能性がある。
このような障害を診断する技術は、プログラム内のクロスバリデーションを用いて一般的に評価される。
このギャップを実世界38のDLプログラムから5,542の故障注入訓練トレースをコーパスとしてDynFaultを用いて検討する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:52:22 GMT)
PersistentKV: Page-Aware Decode Scheduling for Long-Context LLM Serving on Commodity GPUs [0.8] ページアテンションシステムはKVキャッシュの断片化を減らし、FlashInferのような成熟したカーネルは高度に最適化されたネイティブページデコードアテンションを提供する。
本稿では、ネイティブブロックテーブルデコードアテンションエンジンPersistentKVと、グループクエリアテンションのためのページ認識スケジューリング研究について述べる。
キャリブレーション適応ポリシでは、小さなアクティブバッチに対してFlashInfer、B1長文ステップでPersistentKVシーケンス分割、B8長文ステップでPersistentKVジョブスケジューリングを選択する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:56:43 GMT)
DKVE: Decentralized Key Validation for End-to-End Encrypted Messaging [0.8] エンドツーエンドの暗号化メッセージングシステムは、man-in-the-middle(MitM)攻撃を防ぐために、真正の公開鍵配布に依存する。
アウト・オブ・バンド(OOB)検証は強力なセキュリティを提供するが、大きなコンタクトリストのスケーラビリティに欠ける。
本稿では,ユーザのソーシャルグラフ内でのプライバシー保護による公開鍵の検証を行うプロトコルであるDKVEを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:43:59 GMT)
Target-Aware Bandit Allocation for Scalable Surrogate Optimization in Chemical Space [0.8] 本稿では,全ライブラリ推論を排除した帯域幅誘導サロゲート最適化フレームワークBOBaを紹介する。
BOBaは、分割を多腕バンディットの武器として扱うことにより、経験的に有望な分割に対する推論と評価に集中する。
その結果,現在のライブラリに対する実用的な最適化を支援するため,スクリーニング性能とサロゲート推論コストの相違が明らかとなった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:44:15 GMT)
Tractography-Driven Synthetic Data Generation for Fiber Bundle Segmentation in Tracer Histology [0.8] マカクトレーサー組織学における自動繊維束分割のための合成データ拡張フレームワークを提案する。
本手法は,2次元画像パッチの合成に先立って,生体内dMRIトラクタグラフィーを用いた。
2D U-Netは、リアルパッチと合成パッチの混合で訓練される。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:29:46 GMT)
Scalable Operator Learning via Nyström Approximation With Denoising Applications [0.8] ベクトル値を持つカーネルヒルベルト空間におけるベクトル値回帰に対するNystrmサブサンプリングについて検討する。
関数出力に対応するNystrmサブサンプリングに基づく効率的な演算子学習アルゴリズムを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:28:52 GMT)
Computer Vision for MOBA Analytics: A Dataset and Baseline for Visibility Analysis in Dota 2 [0.7] この作業では、ビデオベースのデータセットであるDota2-Visと、プロのDota 2マッチの可視性分析のためのベースラインパイプラインが導入されている。
このデータセットは、両チームの観点から記録されたThe International 2025の144試合すべてで構成されている。
YOLO11l(大規模)は、細密で視覚的に散らばったミニマップシーンでも確実にプレイヤーアイコンを識別し、全体的なパフォーマンスを最高のものにした。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:43:05 GMT)
A Multi-Fidelity Convolutional Autoencoder-Transfer Learning Framework for Guided-Wave-Based Damage Diagnosis Using Large Simulated and Limited Experimental Datasets [0.7] 本研究では,誘導波を用いた構造的健康モニタリングのための多要素伝達学習フレームワークを提案する。
軽量な物理ベースのシミュレーション、畳み込みオートエンコーダ(CAE)ベースのディープ特徴学習、フィードフォワードニューラルネットワーク、限られた実験測定を統合している。
R2$スコアはダメージローカライゼーションで0.93ドル、ダメージサイズで0.99ドルを超える。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:25:13 GMT)
Heterogeneous Neural Predictivity from Language Models During Naturalistic Comprehension [0.6] 言語モデル表現は、自然言語刺激の構造化された高次元アノテーションを提供する。
低レベルのベースラインに対する肯定的な保留予測と利得は、ソースレベルの要約に広まっていた。
これらの結果から,言語モデル由来の量によって,自然言語やテキストの理解において,神経活動に注釈を付けることが可能であることが示唆された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:08:49 GMT)
Visualizing "We the People": Bridging the Perception Gap through Pluralistic Data Storytelling [0.6] 伝統的なビジュアルデータストーリーテリングは、競合する2つの単純化されたグループを描いたバイナリグラフィックスに依存している。
これにより、グループ内の不一致を単純化し、曖昧さを排除し、アイデアや価値観を共有することで、政治的分極を高めることができる。
AI対応デジタルプラットフォームのための意図的かつ多元的な設計選択は、ニュアンス、意見分布、グループ間共通性を強調する視覚化を生成することができる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:10:08 GMT)
Design and Performance Evaluation of Secure RF and WiFi-Based Communication in Drone Swarms via Testbed Implementation [0.6] 我々は,MAVLink通信のための軽量暗号化フレームワークであるMAVShieldを提案する。
RFおよびWiFiチャネル上でセキュアな通信リンクを確立するために、4つのカスタムビルドUAVに統合されている。
それらの性能は、UAVのSwarmテストベッドを用いて飛行実験によって評価される。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:36:12 GMT)
DeLux: Cross-Modal Local Artifact Restoration in Video Using Neuromorphic Data [0.5] 従来のRGBカメラはフレア、グレア、フリック、露出過多といった照明器具に悩まされており、情報が失われてしまう。
本稿では,新しいクロスモーダル修復パラダイムと,モジュール型概念実証パイプラインであるDeLuxを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:03:43 GMT)
Application of LLMs to Threat Assessment of Foreign Peacekeeping Missions [0.5] 本稿では,大規模言語モデル(LLM)を外国平和維持活動の文脈における脅威評価に適用するための新しいアプローチを提案する。
PINPOINTプロジェクトとそのユースケースであるジョージアのEU監視ミッションに基づいて、我々は、学際的リスクモデルとOSINTベースのメディアコレクションとLLMが支援する脅威抽出を組み合わせた。
メディア文書から抽出された脅威の評価は、自動生成結果と脅威やミッション関連性といった中核的な側面に対する人間の判断との間に高い一致を示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:43:42 GMT)
All you need is log [0.4] 次数 $in[0,infty]$ の Rényi の発散は、データ処理および独立製品への添加物の下でのユニークな族単調であることを示す。
マルチポピュレーションフェアネス、マルチプライオリティのPAC-Bayes境界、マルチハイプテシステスト、そして正しいマルチディストリビューションの一般化という2つ以上の分布を一度に比較することは、オープンな問題である。
カルモゴロフ=ナグモ(Kolmogorov-Nagumo)は、レニイのエントロピー公理学、古典的エントロピー的特徴、マルチヒポテシステスト誤差指数を持つことを意味する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:54:49 GMT)
PTStore (Prefix Tensor Store): Distributed Prefix Caching and Replication for High Throughput Inference Serving [0.4] PTStoreは、再利用可能なKVキャッシュプレフィックスを形成する人気のあるテンソルを配布し、複製する。
これにより、KVキャッシュにアクセスするレイテンシが減少し、負荷の不均衡が軽減される。
PTStoreは分散化により、LLM推論のためのKVキャッシュのサイズを桁違いに拡張することができる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:51:36 GMT)
On the Reproducibility of Quantum Software Defect Datasets: A Case Study of Bugs4Q [0.3] 本研究では、量子プログラムにおける実世界のバグのデータセットであるBugs4Qを用いて、以前の研究の複製研究を行う。
実験の結果、Bugs4Q は Qiskit v0.20.1 で62.2% から v2.3.1 で16.2% に低下した。
これらの発見は以前の研究と一致しているが、相違点も観察した。特に、Bugs4Qの複製失敗のほとんどは、依存バージョンを調整するだけでは解決できない。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:01:43 GMT)
Content-Based Smart E-Mail Dispatcher Using Large Language Models [0.3] 本研究の目的は,工学系大学における様々な学級の学生のWhatsAppグループに対して,その内容に基づいて電子メールを自動送信する機構を検討することである。
このディスパッチシステムは,大規模言語モデル (LLM) を問合せするエージェントを用いて構築され,電子メールの内容を分析し,関連する学生グループにルーティングして情報と消費を提供する。
提案システムはラベル付きデータセットに頼らず,生産性の向上やメール読取に伴う認知負荷の低減など,いくつかのメリットを提供している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:34:03 GMT)
Automated brain tumor detection in MRI images using CNN and ResNet architectures [0.3] この研究は、MRI画像から脳腫瘍を自動検出するためのディープラーニングに基づくアプローチを提案する。
実験は3,929個の脳MRI画像のデータセットを用いて行われ、モデル深度と微調整戦略の影響を評価する。
提案フレームワークは、早期診断と臨床的意思決定をサポートする高速で正確で費用効率の高い脳腫瘍検出を可能にする。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:41:19 GMT)
Boundary condition fidelity for bottom-hole pressure and CO2 plume prediction in geological carbon storage [0.3] 境界条件の忠実度がボトムホール圧力とCO2配管の予測にどのように影響するかを評価する。
コーナー調整シナリオは圧力誤差を大幅に減らし、IoUを0.94以上上昇させる。
均質貯水池では、均一な透過率調整により圧力の忠実度が向上する。
不均質貯水池では、可変透水性境界面を超制限的に流すことができる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:59:59 GMT)
EntMTP: Accelerating LLM Inference with Entropy Guided Multi Token Prediction [0.3] マルチトークン予測は、トレーニング中にデータ密度を増加させ、下流のテキスト生成品質を向上し、自己投機的復号化のためのデファクトアプローチとして機能することが示されている。
MTPヘッドを使用する既存の基盤モデルとオープンソースモデルは、生成シーケンス全体を通して静的なツリーベースのアテンショントポロジにコミットする。
本研究では,局所生成エントロピーを推定したタスク固有パーレト最適木の集合から,木に基づく注目トポロジを切り替える訓練不要なスケジューラであるエントロピー誘導型マルチトークン予測(EntMTP)を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 20:54:27 GMT)
Bipartite entanglement of the primordial Majorana during inflation [0.2] 我々は、インフレーション中の量子相関のフェルミオンプローブとして、原始マヨラナ場を用いる。
還元モードのフォン・ノイマンエントロピーとマヨラナ対の対数否定性を計算する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:55:03 GMT)
Simulation-based inference for rapid Bayesian parameter estimation in epidemiological models: a comparison with MCMC [0.2] メカニスティックSECIR疫学モデルのベイズ校正のスケーラブルな代替手段として,神経後部推定を用いたシミュレーションベース推論(SBI)について検討した。
我々は,31日間の推測窓と201日間の再建問題を用いて,複数の流行期におけるSBIの比較を行った。
SBIは、ベイズによる疫学モデルのキャリブレーションを迅速かつ効率的に行うためのフレームワークを提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:03:30 GMT)
A Multi-Level Validation and Traceability Framework for AI-Generated Telescope Scheduling Decisions [0.2] 本稿では,AI生成決定の系統的信頼性検証を行う多段階検証およびトレース可能な推論フレームワークを提案する。
実験によると、このフレームワークはAIスケジューリングの実行可能性と信頼性を改善し、一時的な機会の損失を減らす。
これらの結果は、高信頼の天文観測スケジューリングにAIを適用するための、実現可能で検証可能な経路を示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:17:39 GMT)
Just how sure are you? Improving Verbalized Uncertainty Calibration in Medical VQA [0.2] マルチモーダル大言語モデル (MLLM) を医用視覚質問回答 (VQA) に適用すると, 実際の正確性に関わらず, 自信過剰なアウトプットが生じる傾向にある。
本研究では、MLLMを微調整し、複合損失関数を用いて校正を改善するためのトレーニングベースフレームワークを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:33:58 GMT)
Quantum computer architecture with ions in tweezer arrays [0.2] 光ツイーザアレイに閉じ込められたイオンに基づく量子コンピュータアーキテクチャを提案する。
この結果は、スケーラブルなイオンツイーザー量子プロセッサへの現実的な経路を確立する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:34:28 GMT)
Noise robustness of three outcome Bell certified quantum randomness [0.1] 両部類シナリオにおけるベルの不等式違反に基づく大域的ランダム性のデバイス非依存的証明について検討する。
かなりの数の不等式が、かなりの量のミンエントロピーを証明していることがわかった。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:49:02 GMT)
RecallRisk-BERT: A Multi-Task Framework for Post-Report Medical Device Recall Triage [0.1] 54,165個のFDA医療機器のリコール記録を用いた自動リコールトリアージフレームワークを開発した。
RecallRisk-BERTは, PubMedBERTをベースとしたリコール物語のテキスト表現と, 階層的特徴の埋め込みに基づく表現を組み合わせたマルチタスクモデルである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:41:45 GMT)
Elimination of Flux Trapping in Superconducting Circuits in Ambient Magnetic Fields [0.1] 超伝導電子エレクトロニクスと超伝導量子ビットを用いた量子コンピューティングは、次世代コンピューティング技術として有望である。
非ゼロ背景磁場の存在下で冷却または操作される場合、超伝導薄膜は、回路や量子ビットの性能を低下させることができる磁気渦をトラップすることができる。
回路の超伝導膜における局所的な熱勾配とモート, エッチング孔を制御し, 周囲磁場中に捕捉されたフラックスを除去するための実用的解決策を報告する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:39:32 GMT)
A Causal Foundation Model for Structure and Outcome Prediction [0.1] TabPFN-CFMは、観測データから因果構造と結果の両方を予測する。
パールズ・コーサル・ヒエラルキー(Causal Hierarchy)の3つのレベルに関するクエリをサポートする。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:02:02 GMT)
Prompt Injection in Automated Résumé Screening with Large Language Models: Single and Multi-Injection Settings [0.1] 大規模言語モデル(LLM)は、求職者のスクリーニングやランク付けにますます利用されている。
本研究は, 自己感情の微妙なテキストとして定義される自動レサムスクリーニングにおけるプロンプトインジェクションについて検討する。
その結果,プロンプトインジェクションは,レサム品質が均質であり,候補者がほとんどいない場合に,応募者のランキングを確実に改善することを示した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:04:51 GMT)
Mapping Political-Elite Networks in Europe with a Multilingual Joint Entity-Relation Extraction Pipeline [0.0] 多言語共役関係抽出のためのモジュラーで完全オープンウェイトなパイプラインを提案する。
巨大な構造化されていないニュースコーパスから、署名付き時間的知識グラフを構築する。
3491-リレーショナルゴールド標準に対するフルカバーのスポットチェックは、高いテキストの正確性を示している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:51:59 GMT)
zQR: A Verifiable QR-Driven zkSNARK Proof Verification Framework for Mobile Platforms [0.0] 我々は,QRコードにエンコードされた証明を検証するために,オフライン検証を可能にする検証QRコードのアイデアを前進させる。
モバイルプラットフォーム向けの新しいQR駆動型zkSNARK証明フレームワーク(zQR)を構築した。
モバイルプラットフォーム上でのプライバシ保護検証のための概念実証フレームワークとしてのzQRの実現可能性を示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:29:35 GMT)
su(1,1) Symmetry and Exact Solutions of the Dunkl-Klein-Gordon Equation in Higher Dimensions [0.0] 我々は$mathfraksu (1,1)$ algebra の生成元を構築する。
Dunkl-Coulomb-like potential を用いて$d$-dimensional Dunkl--Klein-Gordon 方程式の境界状態セクターを解析する。
その結果、ダンクル変形は、系の空間構造にパリティ依存的な変化をもたらすことが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:41:04 GMT)
fTNN: a tensor neural network for fractional PDEs [0.0] 有界領域上の分数ラプラシアン問題に対する決定論的テンソルニューラルネットワーク部分空間法であるfTNNを開発した。
提案手法は,既存のfPINNやモンテカルロのベースラインよりも精度が高く,大幅に改善されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:13:55 GMT)
When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models [0.0] マルチモデルLPMシステムは単一モデルの精度を上回ります。
彼らの利益は、ほとんど報告されない量で占められていることを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:06:06 GMT)
Vector Representation of Exact Soliton Dynamics in Multi-component Nonlinear Schrödinger Systems [0.0] 完全可積分マナコフ系に対する広田双線型形式論のベクトル定式化を開発する。
基礎となるベクトル構造がそれらの非線形相互作用を統一的に記述する方法を示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:54:02 GMT)
Type-based information flow analysis for $π$-calculus with a dynamically extensible security lattice [0.0] 我々は,セキュリティ格子に新たなセキュリティレベルを動的に挿入可能な,セキュアな情報フローのための型システムを開発した。
本システムは,Milner's pi-calculusに対して,小林の型に基づくセキュア情報フロー解析を拡張して定式化した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:03:51 GMT)
Transformer-Based Classification of Bacterial Raman Spectra with LOOCV [0.0] トランスフォーマーベースのモデルはラマンスペクトル分類に注目が集まっている。
本研究では,Nested leave-one-replicate-out cross-validationフレームワークを用いて,トランスフォーマーに基づくアプローチを体系的に評価した。
この変圧器は、独立したテストレプリケータにまたがる最高の分類性能を一貫して達成し、従来の全ての手法よりも大幅に優れていた。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:34:19 GMT)
Training Observable Control Policies to Expose Agent State Through Actions [0.0] 政策可観測性はトレーニング報酬によって奨励され、訓練されたエージェントのシミュレーションを用いて分析される。
航空機追尾問題においては,観測可能性の向上が課題性能に与える影響を最小限に抑える。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 23:50:14 GMT)
Token-Level Cross-Modal Transformer with Contrastive Multi-Task Learning for Breast Cancer Subtype Classification and Survival Prediction [0.0] ジョイント癌サブタイプ分類と生存予測のための異種ゲノムおよび臨床モダリティの統合は、精度オンコロジーにおいて重要な課題である。
既存のアプローチでは,(1)モダリティをモノリシックな特徴ベクトルとして扱うこと,(2)モダリティ間のきめ細かいトークンレベルの相互作用を除外すること,(2) クロスモーダル融合は通常,構造化トークン交換よりも線形重み付けや遅延平均化によって行われること,(3) 生存と分類の目的は独立に最適化され,共同正規化信号が欠落すること,の3つの制限がある。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:53:06 GMT)
Three-Objective Integral R2 Subset Selection: NP-Hardness and Submodular Approximation [0.0] 本稿では3つの目的において積分R2インジケータの問題点を考察する。
任意の固定基底線に対する積分 R2 の改善は単調部分モジュラー集合函数であることを示す。
また, 完全積分 R2 値を部分分割で評価するグリージーな実装も提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:25:20 GMT)
The Spec Growth Engine: Spec-Anchored, Code-Coupled, Drift-Enforced Architecture for AI-Assisted Software Development [0.0] AIコーディングエージェントは、実装速度を劇的に加速するが、既存の仕様駆動アプローチでは完全に解決できない2つの構造的障害モードを導入する。
マシン可読な仕様グラフを通じて、両方の障害モードに対処するフレームワークであるSpec Growth Engineを紹介します。
この設計は、確立されたソフトウェアエンジニアリングの原則を、リーンでコード結合でマシン強化された全体へと合成する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:51:22 GMT)
The Observer World: A Cryptographic Extension of Impagliazzo's Five Worlds [0.0] インパグリアッツォの5つの世界は、計算仮定を1つの軸に沿って分類する。
5つの世界は、敵を含む全ての当事者が完全な入力を観察すると暗黙的に仮定する。
この研究は、第2の軸、観察軸を導入することで、明確にし、リラックスさせる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:13:44 GMT)
The Inattentional Gap: Task-Conditioned Language and Vision Models Omit the Safety-Critical Signals They Can Otherwise Report [0.0] 狭義のタスクで言語や視覚モデルを条件付けると、それ以外は報告できる共表現、安全クリティカルな信号の報告が抑制されることを示す。
我々はこの解離を意図的ギャップ(Inattentional Gap)と呼び、ベンチマークの安全性を現実世界の安全性から切り離すと主張している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:09:08 GMT)
The Geometry of Updates: Fisher Alignment at Vocabulary Scale [0.0] 共有語彙を持つLLMファミリーの訓練不要ソース選択は、科学領域で発生する。
共有出力ヘッド設定では、表現指標(例えば、CKA)が転送には識別できないことを示す。
鍵となるアイデンティティは、ヘッドフィッシャーアライメントは、カーネル間のコサインであり、共同アクティベーション・エラー空間に埋め込むことである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:30:27 GMT)
The Fungible Reserve Standard: A Deterministic Framework for Encoding Carrying Costs in Asset-Backed Tokens [0.0] ファンジブル・リザーブ・スタンダード(Fungible Reserve Standard, FRS)は、コストをオンチェーンロジックに透過的にエンコードする決定論的トークン設計フレームワークである。
このフレームワークは資産非依存であり、肯定的かつ予測可能な保持コストを持つ現実世界の資産に適用できる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 07:34:05 GMT)
The Failures of Marginal Influence-Based Attribution Methods for Global Time Series Explanations [0.0] このような手法の失敗モードはスカラー形式そのものではなく,基本的な計算ミスマッチであることが証明されている。
既存の方法は、境界条件付けまたはオフマンフォールド勾配によってスコアを計算し、どちらも自己相関の下で仲介されたものと直接時間的依存関係を分割する。
DAG-faithfulness も定義する: ある説明がDAG-faithful であるとは、それが符号化する時間依存グラフが、モデルによって暗黙的に学習された時間指向非巡回グラフ(DAG)と同値であるときにいう。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:40:49 GMT)
The Decision Geometry of Covariance Estimation for the Global Minimum-Variance Portfolio under Heavy Tails [0.0] 我々は、正確な後悔のアイデンティティと、決定の後悔を示す非漸近的境界が、推定誤差に依存することを証明した。
結果は、それらが欠落している正確な推定幾何と一貫性理論を供給することによって、最近の意思決定中心の学習アプローチを補完する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:35:30 GMT)
The Context-Ready Transformer [0.0] 我々は、D層トランスブロックから構築された新しいリカレントニューラルネットワークアーキテクチャである、コンテキストレディトランスを導入する。
補正ネットワークは、前の位置のブロック出力と現在のトークン埋め込みを結合し、トークンエンターは、既にコンテキスト化されたブロックを挿入する。
事前訓練された変換器は、ゼロd補正を加えることで文脈対応モデルに変換することもできる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 20:39:26 GMT)
Temporal Validity in Retrieval Memory: Eliminating Stale-Fact Errors for AI Agents over Evolving Knowledge [0.0] Retrieval-augmented generationは、エージェントに蓄積した知識へのアクセスを与えるが、時間のモデルを持たない。
本稿では,時間的妥当性を維持する検索メモリMemStrataを提案する。
6つのベンチマークは7Bモデルでローカルに実行され、MemStrataはRAGを静的知識で結び、進化する知識で0.95-1.00の精度に達する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:31:53 GMT)
Supersede: Diagnosing and Training the Memory-Update Gap in LLM Agents [0.0] 大規模言語モデル(LLM)エージェントは、事実が変化する長い多セッションの相互作用で機能する。
正しく行動するためには、事実の現在の値を使用し、置き換えられた値を捨てる必要がある。
この測定結果をトレーニング信号に変換するオープンな強化学習環境であるSupersedeをリリースする。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:50:32 GMT)
Stochastic Gradient Optimization with Model-Assisted Sampling [0.0] 本稿では, サーベイサンプリング理論を用いて, ミニバッチ勾配を解釈するモデル支援サンプリングフレームワークを提案する。
本研究の目的は,機械学習の最適化とサンプリング理論の橋渡しであり,サンプルベース推定と分散低減を両立させることである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:39:19 GMT)
State-Specific Respiratory Signatures for Affective and Stress Recognition: Interpretable Respiratory Markers, Autocorrelation Lags, and Compact CNN Models [0.0] 呼吸活動は、ウェアラブルストレスと情動状態認識のための直接的かつ解釈可能な生理学的チャネルである。
この研究は、RESPに基づく認識を共同予測および説明問題として再設計する。
本研究は,60 s窓の残量検証を行い,コンパクトな生信号1D-CNNと手技による呼吸シグネチャの2つの相補的な枝を組み合わせた。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:01:36 GMT)
Spectral Subsurface Scattering from RGB via Biophysical Skin Inversion [0.0] 地表面散乱の経路追跡に基づくレンダリングのための分光光インバージョンを提案する。
本稿では,1つのRGB拡散アルベドから全スペクトル散乱パラメータを予測するフレームワークを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 23:30:57 GMT)
Solarsystem: A Validated Lightweight Python Package for Planetary Positions and Solar-Lunar Event Calculations [0.0] 太陽系は惑星の位置と太陽月イベント計算のための検証済みのPythonパッケージである。
このパッケージは、主要な惑星、選択された準惑星、センター・チロン、月に対して、ヘリオセントリックで地球中心的な位置を提供する。
追加機能には、一般的に使用される天文学参照システム間の座標変換が含まれる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:59:57 GMT)
Soft QED as Open Quantum System: Infrared Cancellation and Soft-Shell Coarse Graining [0.0] I formulate unresolved soft-photon sector of QED as open quantum system。
固定ハードブランチ空間上でのスケールパラメタライズされたリンドブラッドの進化の明確な先進的QED実現を導出する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:32:28 GMT)
SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning [0.0] マルチモーダル会話における安全評価のためのポリシー適応型ガードレールモデルファミリーである textbfSingGuard を提案する。
SingGuardはアクティブポリシーをランタイム入力として扱う。
ターゲットコンテンツをアクティブポリシールールに対してルールでチェックし、安全ラベルとトリガルールの両方を予測する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:44:01 GMT)
Shallow Quantum Circuits for Deep Chemistry via Valence Bond Embeddings [0.0] 長期的には、より大きなシステムに対する信頼性の高い近似の需要が高まるだろう。
我々は、ハイブリッドフェルミオン-ボソニックエンコーディングと量子価結合理論の構造化アプローチを組み合わせて、可分に大きな分子系のための量子回路を直接構築する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:11:18 GMT)
Semantic Early-Stopping for Iterative LLM Agent Loops [0.0] 連続したドラフト埋め込みが意味を変えるのをやめたとき、ループは停止する。
各質問の完全な軌道を一度生成し、同じドラフトに対してすべての停止ポリシーを再生し、全てのLM-judgeコールをキャッシュします。
最良のラウンドを選択するオラクルは、すべての実用政策に対して+0.115インフォメーションスコアを得る。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:24:21 GMT)
Self-Sifting quantum key distribution [0.0] 本稿では,送信側と受信側で最大絡み合うベル状態の1キュービットを鍵交換用量子チャネルとして利用する,新しい双方向量子鍵分配プロトコルを提案する。
従来の2方向QKDプロトコルとは異なり、全てのシフティング操作とeavesdropper検出手順は、量子通信の段階が完了するまで延期される。
我々は、盗聴器が鍵に関する情報を得るために送信されたキュービットに補助システムを結合する広範囲なアンシラ攻撃の分析を行う。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:17:12 GMT)
Scattering theory for cavity-assisted spin-motion-photon interactions [0.0] キャビティアシスト光子散乱(CAPS)は、量子ビットと飛行光子の間の強い相互作用を実現するための強力なメカニズムである。
近年,原子量子ビットを用いた量子情報処理において,運動量子状態が重要な構成要素として出現している。
我々は、原子運動と反射光子のコヒーレント相互作用を組み込んだCAPSのための完全な分析フレームワークを開発する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:34:58 GMT)
Sampling the Schwinger Model with Gauge-Equivariant Diffusion [0.0] 拡散に基づく$N_f = 2$格子シュウィンガーモデルの高速化サンプリングに関する最初の研究を示す。
我々はU(1)-同変スコアベース生成モデルを訓練し、境界シュウィンガーモデルからゲージリンク構成をサンプリングする。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:00:56 GMT)
Ribbon: Scalable Approximation and Robust Uncertainty Quantification [0.0] リボンはディリクレ・リブートストラップの不確実性に対するスケーラブルな近似である。
リボンは、繰り返しのリフィットを、単一の装着モデルを中心とした影響関数線形化に置き換える。
リボンは, 正当性仕様の下での平面重み付きラプラス近似と同値であることを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:51:18 GMT)
Revisiting Action Factorization for Complex Action Spaces [0.0] 本稿では、4つの軽量環境(Platform、Hybrid-LunarLander、Hybrid-Shoot、CoopPush)上の3つの作用空間(離散化、ハイブリッド化、連続化)にまたがる3種類のアルゴリズム(PPO、SAC、DQN)のそれぞれに対する分解方法の断面的研究について述べる。
分岐デュエルアーキテクチャは計算と性能のバランスを最も効果的に保ち、オート・レグレッシブ・アクションは全体の最高性能に達し、ネイティブな連続SACは離散的およびハイブリッドなアルゴリズムより優れており、どちらも計算コストが増大している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:48:56 GMT)
Reproducibility Study of "AlphaEdit: Null-Space Constrained Knowledge Editing for Language Models" [0.0] そこで本研究では,AlphaEditについて検討し,その報告結果を元の実験環境下で再現する。
我々は、BooolQ、HellaSwag、XSTestという3つの余分なベンチマークで、編集されたモデルの評価を拡張した。
結果,AlphaEditはもともとのスコープで報告されたように動作することを確認した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:20:00 GMT)
Rate-2/3 Girth-8 (3,18)-Regular Quantum LDPC Codes from Two-Branch Finite-Field Bases and CPM Lifts [0.0] コードはCalderbank-Shor-Steane (CSS)コードでパラメータは[34542,23032,dle 310]]$である。
我々はこの上限を真の最小距離の見積もりとはみなしていないが、$dle310$は構造リフトとデコーダが生成する論理誤差から現在得られる最も厳密な上限である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:08:16 GMT)
Radical AI Interpretability [0.0] 我々はAIシステムをエージェントとして解釈するためのフレームワークを開発する。
我々は、急進的解釈の哲学的伝統と機械的解釈可能性の道具を描いている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:58:38 GMT)
Quantum group codes for non-Clifford logic: enhanced decoding, addressability and parallelizability [0.0] 量子CSS符号のクラスを定義するために,古典的準群符号に基づくフレームワークを導入する。
我々は、類体論から確立された古典AG符号の持ち上げ手順を用いて、優れた量子群符号を構築する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:03:59 GMT)
Prism Transformer: Progressive Head Schedules for Hierarchical Attention Processing [0.0] マルチヘッドアテンションは、すべての層におけるすべてのヘッドに等しく隠れた次元を分割し、モデル深度全体にわたって同じ表現的な部分空間次元を強制する。
静的な均一なヘッド構成をプログレッシブなヘッドスケジュールに置き換える新しいアーキテクチャパラダイムであるPrism Transformerを導入する。
Prism Transformerは、単調にレイヤー間のヘッダ数を増やすことで、ローカルからグローバルへの表現階層を自然に確立する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:18:32 GMT)
Photon avalanche triggered by a single photon in a bistable nonlinear optical cavity [0.0] 単一光子刺激による低光子数から高光子数状態へのジャンプの量子力学について検討した。
このシステムは、光ビスタビリティの位相遷移図に根ざした、この単一励起の量子に対する大きな応答を示すことができる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:10:34 GMT)
Particle-preserving fermionic shadows with mode-independent sample complexity [0.0] 我々は、未知の$$$$$$n$-modeフェルミオン状態に関して、粒子保存作用素の期待値の学習問題を考察する。
我々の主な応用は任意のスレーター行列状態との重なりを推定することである。
第1量子符号化では、近似ユニタリ設計により、モード数で回路深さが多値になる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:37:29 GMT)
PRISM: PE Relational Inter-Section Matrix. A 2D Section-Aware Dataset for Static PE Malware Detection [0.0] 我々は、Windows PEマルウェア検出ベンチマークのためのオープンデータセットと特徴表現であるPRISMを紹介する。
PRISMは全てのバイナリを、列が個々のPEファイル順である2次元行列としてエンコードし、グローバル行はEMBERスタイルのモデルとの互換性を保持する。
形式的分離性解析は、断面位置構造が平坦な表現が捉えられない離散的な情報を持っていることを示している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:44:10 GMT)
PEBS: Per-rater Empirical-Bayes Shrinkage for RLHF Reward-Model Calibration [0.0] PEBSは、RLHF報酬モデルにおけるアノテータ特異的アフィンキャリブレーションのためのクローズドフォーム推定器である。
モリス=ジェームズ=シュタイン経験的ベイズ縮合を集団平均に対して適用し、閉じた形で、報酬モデルを再訓練することなく適用する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:09:50 GMT)
Operator Learning for Cubic Nonlinear Schrödinger Equation on Periodic Domains [0.0] アスペクト比の異なる2次元平面トーラス上の3次非線形シュルディンガー(NLS)方程式を考察する。
本研究では,NLS方程式に対する幾何条件のフーリエニューラル演算子(FNO)を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:33:53 GMT)
On-board Remote-Sensing Foundation Models for Unsupervised Change Detection of Disaster Events [0.0] リモートセンシング基礎モデル(RSFM)は、地球観測のための教師付きモデルに代わる強力な代替品として登場した。
本稿では,ResNet(RSFM)+FPNに基づく新しい教師なし検出手法を提案する。
トレーニングされていないFPNアーキテクチャとその本質的な事前知識を頼りにすることで、最小限の努力で効率的な画像レベルの生成と高解像度マッピングを実現する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:30:51 GMT)
On the stability of scale-space metrics [0.0] 関数のガウススケール空間表現上で定義される古典的なメトリクスの族の安定性について検討する。
これらのメトリクスのロバスト性を幾何学的変形に定量化し、角度の変化に対して安定な回転不変バージョンを導入する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 23:32:43 GMT)
On the simple derivation of the Casimir effect [0.0] カシミール効果は最も単純な形で、電磁場の真空ゆらぎによる近接した距離で2つの平行導電板のアトラクションを記述する。
ここでは、カシミールによる元の論文に戻り、その導出の微妙なニュアンスを見つけ、その効果の数学的に健全な導出の完全な図面を与える価値がある。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:20:16 GMT)
On the Inseparability of Instructions and Data in Shared-Embedding Sequence Models [0.0] 我々は、制御権威行動を伴うプロンプトアクションモデルとして、誘導されたシステムを定式化する。
共有パイプライン内では,SFC(Semantic-Faithful Control)が実現不可能であることを示す。
根本原因とそれが要求するソリューションのクラスを特定します。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 21:52:29 GMT)
OSC2Runner: OpenSCENARIO 2.x Compliant High-Fidelity AV Simulation in CARLA [0.0] 既存の連続シミュレーションフレームワークは、最近成熟したv2.x Domain-Specific Languageのネイティブ実行サポートを欠いている。
OSC2はOpenSARIO v2.x DSLをCARLAにマッピングできる最初のオーケストレーションフレームワークを導入した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:17:39 GMT)
Neural Texture Compression using Hypernetworks [0.0] シェーディング中にリアルタイムでデコードできる、小さな、材料ごとのテクスチャ表現を学習することができる。
私たちは、潜伏する特徴とシェーディングの重みとバイアスの両方を出力する単一のハイパーネットワークをトレーニングします。
このアプローチを拡張して、複数のデコーダを一度に推論したり、超解像を学習するデコーダを生成する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:52:11 GMT)
Multi-Objective Molecular Generation with Frequency-Controlled Evolutionary Dynamics [0.0] SpectralMolは、化学構造をフーリエ係数のコンパクト行列として処理するアルゴリズムである。
より多くのドッキングヒットと、より多様な足場を生成しながら、競合する物理化学的特性を維持している。
結果は、周波数制御の進化力学が多目的分子設計への解釈可能、効率的、訓練不要な経路を提供するという証拠を支持する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:42:07 GMT)
MinGram: A Minimalist Unigram Tokenizer with High Compression and Competitive Morphological Alignment [0.0] トークンリストの表現は維持するが,BPE由来のシード語彙を用いたトレーニングを簡略化するMinGramを導入する。
下流言語モデルのトレーニングでは、MinGramが最良で、バイト単位のビット数でBPEを一貫して上回っている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:31:02 GMT)
MergeLLL: A Hierarchical Divide-and-Conquer Framework for LLL-Based Lattice Reduction [0.0] 格子基底還元アルゴリズムは、計算数理論や格子ベースの暗号に様々な応用がある。
マージソートとPotLLLスタイルの深い挿入を組み込んだマージソートとコンカマーの分離戦略により,mergeLLLを提案する。
このフレームワークでは、格子基底をサブベースに分割し、局所還元を独立に行い、階層的なマージによって全基底を再構築する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:20:03 GMT)
Memory Depth, Not Memory Access: Selective Parametric Consolidation for Long-Running Language Agents [0.0] メモリ深度:小さなパラメトリックストアに書き込まれた耐久性のあるゴール条件付き傾向について検討する。
我々は,作業環境がアンロードされている間,検索インデックスが無傷である制御ストレステストであるループドリフトプロトコルを導入する。
選択的凝縮は2つの制御可能な次元(選択とアクティベーション)に分解される。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:42:56 GMT)
MedDiffuseMix: Preserving Diagnostic Evidence with Saliency-Aware Diffusion Medical Image Data Augmentatio [0.0] 本稿では,医用画像拡張のための塩分誘導拡散混合フレームワークであるMedDiffuseMixを提案する。
本手法は、分類器由来の塩分マップを用いて、低塩分背景領域から高塩分診断領域を分離する。
実験により,MedDiffuseMixの精度,F1スコア,レシーバ動作特性曲線下の面積は,通常の拡張よりも向上することが示された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:57:12 GMT)
Loss-aware pulse sequence optimization for generating photonic Fock states [0.0] 非線形媒体と2レベルシステムからなるハイブリッドキャビティシステムにおける周波数可変フォトニックフォック状態の生成について検討した。
我々は,パルス振幅,位相,パルス間遅延を通じてシステムダイナミクスを制御するマルチパルス駆動プロトコルを構築した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:27:00 GMT)
Learning to Fold: prizewinning solution at LeHome Challenge 2026 (1st place online, 2nd offline) [0.0] LeHome Challenge 2026というICRA 2026のコンペティションのソリューションについて説明します。
このシステムは、オンライン(シミュレーション)ラウンドで62チーム中1位、実世界の決勝で2位にランクインした。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:31:23 GMT)
Lattice patch structure for fixed-frequency transmon quantum computer with high-fidelity CNOT gates [0.0] 超伝導トランスモンプロセッサは、大規模量子コンピューティングの主要なプラットフォームである。
本研究では、4つの固定周波数トランスモンを1つの固定周波数カプラに結合する新しい格子パッチアーキテクチャを提案する。
本研究は,将来のフォールトトレラント量子コンピュータの高効率で堅牢な構築ブロックとして,格子パッチアーキテクチャを確立した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 13:30:46 GMT)
LCAi: Life Cycle Assessment with big data fusion and retrieval-augmented generation-assisted interpretation [0.0] 本研究では,LCA解釈のための視点条件付き検索拡張生成フレームワークを提案する。
LCA解釈で大規模言語モデルを運用するために,視点融合型RAGアーキテクチャを開発した。
本フレームワークは, GPT-5ナノを推論モデルとして, イタリア製リンゴ製造施設の水素化ディーゼル還元使用事例を用いて実証した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:41:48 GMT)
Interaction-Enhanced Ergotropy in Phase-Driven Andreev Bound State Quantum Batteries [0.0] 2つの相互作用するAndreev束縛状態(ABS)ユニットからなる位相駆動型量子電池について検討する。
超伝導相ランプ下でのエルゴトロピーダイナミクスを解析することにより、避けられた交差励起と相互作用誘起ハイブリッド化との相互作用が充電過程を強く修飾することを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:58:14 GMT)
Inherited Circuits, Learned Semantics: How Fine-Tuning Creates Evasion Vulnerabilities Invisible to Standard Evaluation [0.0] セキュリティ分類のために微調整されたLLMは、通常、トレーニングデータと同じ分布から保持された例で評価される。
これは、微調整自体によって導入された脆弱性を見逃す可能性があることを示す。
セキュリティの微調整により,回避面を拡大しながらタスクの精度が向上することを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:29:03 GMT)
I-QMapper: Error-Aware Layout Optimization and Device Diagnostics for NISQ Hardware [0.0] 超伝導量子ハードウェア上でのノイズ対応レイアウトの選択、可視化、分析のためのJupyterベースのオープンソースツール。
I-QMapperは、NISQデバイス上でのラピッドレイアウトプロトタイピングとインフォームドノイズ対応の実験設計の両方をサポートすることを目的としている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 19:44:22 GMT)
How Surprising Is Historical Italian to Language Models? Tokenization Tax, Comprehension Tax, and a Simple Mitigation [0.0] 大規模言語モデル(LLM)はデジタルライブラリにとってますます重要になっているが、歴史的言語を処理する能力はいまだによく分かっていない。
本稿では,この難易度をトークン化コスト,予測の不確実性(前提),意味的堅牢性,コンテキスト感受性の4つの異なる次元に分解する診断フレームワークを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:52:21 GMT)
How Should a Simulation-to-Reality Transfer Budget Be Spent? [0.0] 本稿では,システム識別と領域ランダム化の間の実ロボット計測時間を割当てることに焦点をあてる。
私たちがテストした現実のギャップとノイズレベル全体にわたって、測定予算は作業の大部分を完了しました。
全体として,sim-to-realパイプラインは,まずパラメータを計測し,残されている不確実性に対してランダム化を予備的に行うべきである。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 14:18:48 GMT)
Graph Structures for Local Distinguishability of Quantum Product States [0.0] 量子積状態の集合を局所演算と古典通信(LOCC)で区別する問題を考える。
最近の研究はグラフ理論を用いて一方方向LOCCと区別可能な積状態の集合を同定している。
これらの取り組みを完全な双方向LOCCに拡張し、二部積状態に対応するグラフの集合を初めて有意に分析する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:09:25 GMT)
Graph Neural Networks Applications Across Domains: All Insights You Need [0.0] グラフニューラルネットワークは、ニッチな表現学習技術から、データがリレーショナル構造を持つ場合のデフォルトモデルクラスに移行した。
この調査は、単一設計空間の周囲の分野を整理し、共有された第一原理からスペクトルと空間の定式化を導出する。
提案するアプリケーションドメインは、リコメンデーションとソーシャルネットワーク、ナレッジグラフと言語モデルの統合、薬物発見と分子特性学習、医療と神経科学、コンピュータビジョン、交通と都市コンピューティング、電力と再生可能エネルギーシステム、無線と第6世代ネットワーク、詐欺とサイバーセキュリティ、産業の予後学、材料科学、気候モデリングなど12種類である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:00:11 GMT)
Global Explanations for Multivariate Time Series Forecasting Models via $K$-Order Markov Approximations [0.0] 我々は,マルコフ代理モデルを構築し,時系列予測器を説明する手法であるBeijingtextscKARMAを紹介する。
我々のアプローチは3つの主な側面を巻き起こす: モデルに十分である最小の履歴長$K$を同定する。
また、KARMAが制御実験により学習したデータ因果構造を復元する、既知の真の因果エッジを持つ複雑な合成データを用いて認証する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 23:09:03 GMT)
Glite ARF: Verifier-Driven Research with Parallel LLM Coding Agents [0.0] 我々は、LLMコーディングエージェントを並列に実行するオープンソースのPythonフレームワークであるGlite ARFを研究レポジトリで紹介する。
人間の研究者は、どの仮説をテストするかを選択し、コーディングエージェントは固定された構造の下で個々のタスクを実装し、決定論的Python検証スクリプトはタスク分離を実行する。
我々はGlite ARFを用いてBEA 2026語彙差分共有タスクに応募し、まずクローズドトラックに、そして3つのターゲット言語でオープントラックに配置した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:52:26 GMT)
Giant Second-Harmonic Generation in 3R-MoS2/MLM Hybrid Metasurfaces Cavities [0.0] 本稿では,ハイブリッド1次元畳み込みニューラルネットワークとディープニューラルネットワークオートエンコーダに基づく,AI駆動の逆設計フレームワークを提案する。
NanoPhotoNet-PINLは非線形多層相整合共振器のインテリジェント逆設計のための一般化可能なパラダイムを確立する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:36:07 GMT)
Geometric bulk-edge correspondence for $\mathbb{Z}_2$-topological insulators [0.0] 2次元のフェルミオン時間反転不変絶縁体、---------------------------------------------------------------------------------------------------- --------
曲面界面に対する幾何学的バルクエッジ対応を証明した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:31:56 GMT)
From Vajrayana Tara to Bengali Baul: A Computational Study of Lexical Transmission Across Buddhist, Shakta, and Vaishnava Traditions in Bengal [0.0] 我々は8世紀から19世紀にかけてのベンガル語とサンスクリット語の教義文学の8つの伝統層にまたがる語彙関係を研究した。
仏教・釈迦の語彙重複は、サンスクリット教義文学の一般的な性質ではなく、仏教・釈迦の伝達連鎖に特有のものであることが判明した。
これらの結果は、ベンガルにおける歴史的に主張された仏教=シャクタのシンクロレティズムの、最初の量的多段階のコロンボレーションをもたらす。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:40:13 GMT)
From Approximate Floquet Engineering to Full Floquet Theory: Coherent Control of Chiral Spin Systems in Spintronics [0.0] 時間周期駆動下での相互作用するスピンシステムのコヒーレント制御は、量子技術における中心的な課題である。
駆動結合電子スピンのダイナミクスをモデル化するためのフルフロケ空間形式の適用性を示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:47:24 GMT)
Foundation-Model Earth Representations Enable Regional-Scale Forest Aboveground Biomass Monitoring Across the Northeastern United States [0.0] 森林表層バイオマス(AGB)は、生態系の生産性と地球規模の炭素貯蔵の重要な指標である。
近年の地球観測基盤モデルは、多様なデータセットから導かれる地球空間のグローバルな表現を提供する。
AplphaEarth Foundation Modelによって生成されたGoogle Satellite Embeddings (GSE) を地域規模のAGB推定のために評価する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 15:07:38 GMT)
Explainable Ensemble-Based Machine Learning Models for Detecting the Presence of Cirrhosis in Hepatitis C Patients [0.0] C型肝炎はウイルスによる肝感染症であり、肝臓の軽度から重度の炎症を引き起こす。
肝硬変を発症する前に、何十年にもわたって中等度または無症状の肝疾患を患うことがある。
硬変の治療は、病気のさらなる進行を防ぐことに焦点を当てている。
機械学習は、いくつかの疾患の診断に使用される正確で正確な情報を提供するのに有効であることが示されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:13:37 GMT)
Exact subsystem dynamics in the deterministic Floquet-PXP model [0.0] Rule 201はFloquet-PXPモデルの決定論的バージョンである。
解決策とマルチ時間自己相関関数を提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 17:46:33 GMT)
Exact and Deterministic Patch Descriptor Retrieval via Hierarchical Normalization [0.0] 本稿では,完全ベクトル探索と同一に近い最寄りの近傍を確実に返すパッチ記述子検索手法を提案する。
これは、HNSW や IVF-PQ のような、速度の正確性と引き換えに、近似的近傍(ANN)アプローチとは対照的である。
キャッシュ最適化されたStructure-of-ArraysレイアウトとK=alpha=1/32により、検索はブルートフォース128ディミサーチよりも13.7x (trevi) / 12.7x (halfdome)スピードアップを達成する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:56:25 GMT)
Engineering of non-Hermitian interactions in digital qudit quantum simulators [0.0] 一次元の四重項鎖が一次元射影的進化する過程のダイナミクスについて研究する。
我々は、観測されたクォートリットの進化を好ましくは非エルミート的ハミルトニアンに結びつける解析的関係を導出する。
我々のスキームは、相互作用する非エルミート多体ハミルトニアンの大きなクラスを実現するための建設的な経路を提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:00:01 GMT)
Empirical Software Engineering TerraProbe: A Layered-Oracle Framework for Detecting Deceptive Fixes in LLM-Assisted Terraform [0.0] Terraformのインフラストラクチャ・アズ・コードにおけるセキュリティの誤設定は、クラウドデプロイメントのリスクが増大している。
既存の評価では、標的となる静的解析がなくなると、修復が成功することが多い。
本稿では,LDM支援Terraformセキュリティ修復を評価するための5層オラクルフレームワークであるTerraProbeについて述べる。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:21:15 GMT)
Distribution-based deep multiple instance learning for tumor proportion scoring in NSCLC [0.0] 非小細胞肺癌(NSCLC)における腫瘍の割合スコア(TPS)は、治療計画と予後に重要である。
主な課題は、各スライドに注釈をつけるのに必要な面倒な手作業と、このタスクで認定された専門家の限られた数だ。
複数のインスタンス学習(MIL)は、スライドレベルでのTPSスコアを予測する効果的なアプローチであることが証明されている。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 22:11:29 GMT)
Dissipation-Induced Deviations from Kibble-Zurek Scaling in Non-Hermitian Quantum Annealing [0.0] 非エルミート逆場イジングモデルにおける量子アニール問題を再検討する。
我々の結果は、欠陥生成がギャップ閉点付近のモードによって支配されるエルミート的な場合とは異なり、非エルミート力学は広い運動量セクターから重要な寄与を伴っていることを示している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 10:55:34 GMT)
Developmental approach reveals the statistical learning of Neural Language Models: Transformers generalize from the most abstract statistical patterns [0.0] ニューラルネットワークモデル(NLM)の統計的学習とメンタル表現について検討する。
我々はNLMが学習開始時に最も抽象的なグローバル統計知識を取得することを発見した。
我々はNLMの統計的学習と言語認知を説明する新しい枠組みを提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:34:56 GMT)
Data-Driven Duration Management -- Term Structure Forecasting Using Machine Learning [0.0] 我々は、米国と欧州のゼロクーポン国債の期間構造を予測する異なる方法の比較を行った。
予測性能を高めるため、マクロ経済変数が組み込まれている。
その結果、NNは予測精度とポートフォリオパフォーマンスの両方で従来のモデルより一貫して優れていた。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 09:58:28 GMT)
ConvMemory v3: A Validity Context Layer for Conversational Memory via Target-Conditioned Relation Verification [0.0] ConvMemory v3では、この更新エビデンスを検出し、サーフェスする妥当性コンテキスト層が追加されている。
コアメカニズムは、特定のターゲット命題に関する関係判断を条件とする二重証拠ゲートである。
合成マルチホップ検証ベンチマークでは、ゲートの精度は90.12% +/- 1.73である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:36:43 GMT)
Compositionality and the lexicon in evolutionary semantics [0.0] 進化的モデリングに形式的意味論を統合する枠組みを導入する。
最もよく知られた意味的普遍性、保守性は、効率的なシステム全体の抽象化として現れる。
このフレームワークは、文法圏内の大域的な圧縮を含む普遍性を研究するためのテンプレートを提供する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:16:08 GMT)
Coherent collective response in many-qubit systems for dark matter detection [0.0] 本研究では、波状暗黒物質を検出するラムゼー型干渉計のアレイを提案する。
結合に対する感度は$sim 1 / sqrtN$である。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 08:18:33 GMT)
Can Large Language Models Reliably Code Qualitative Humanitarian Data? A Benchmark Study Against Human Expert Adjudication [0.0] 大規模言語モデル(LLM)は人道的分析能力を拡大する可能性があるが、定性的人道データの符号化に対する信頼性は直接確立されていない。
このベンチマークでは、46個のLDMを150個の高忠実な人工人道書体を用いてヒトのゴールドスタンダードと比較した。
著者らは、複数のLLMが、経験豊富な人間のコーダに匹敵する信頼性レベルで演能的なコーディングを実行可能であることを発見した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 02:27:23 GMT)
CARVE: Content-Aware Recurrent with Value Efficiency for Chunk-Parallel Linear Attention [0.0] リカレントモデルは思い出すために忘れなければならないが、芸術の状態は保存されているものを参照せずに、何を削除するかを決定する。
このメモリブラインドゲーティングは、主要なデルタルールアーキテクチャ(GDN-2)における3つの結合欠陥の1つである。
我々はCARVEを導入し、鍵軸のみを消去するという3つの問題を1つの原理で解決する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 16:16:51 GMT)
Autoformalization of Agent Instructions into Policy-as-Code [0.0] 本稿では,エージェントプロンプト,MPPツール記述,自然言語ポリシー文書を公式なポリシーに変換する自動形式化パイプラインを提案する。
結果として得られたポリシーは、Cedar Policy Languageで書かれています。
MedAgentBenchベンチマークでは、手書きのシンボル適用よりも、手書きの自然言語仕様をかなりカバーしています。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 06:23:15 GMT)
Auditing Framing-Sensitive Behavioral Instability in Large Language Models for Mental Health Interactions [0.0] 大規模言語モデル(LLM)は、メンタルヘルスサポートツールやその他の心理的に敏感な会話アプリケーションに統合されつつある。
本研究では, フラーミングに関連する変動が, 整列言語モデルの内部表現にどのように反映されるかを検討する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:53:33 GMT)
Assessing Post-Reform Changes in Risk Disclosure Quality with a Multidimensional Text Analysis Approach [0.0] 日本語NLP測度抽出とペアテスト,シフト関数解析,計量間相関を組み合わせた長手テキスト解析手法を提案する。
このアプローチを適用して、2019年の開示改革の評価を行い、10年間にわたる19,770件の年次観測を分析した。
開示量は大幅に増加したが,読みやすさの低下が伴っていた。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 01:54:46 GMT)
An exploratory behavioral and electroencephalographic study of artificial intelligence-assisted learning modes in high school students [0.0] 本研究は,前頭葉脳波スペクトル活動に異なるAI相互作用モードが影響を及ぼすかどうかを考察する。
脳波データと定量化行動指標は48人の被験者から記録された。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 04:01:19 GMT)
Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models [0.0] AIシステムのアドリアリ評価は、4つの大きく切り離されたトラックに沿って成熟した。
それぞれ独自の語彙、脅威モデル、ベンチマークを開発した。
本調査はメタ検索レベルで情報融合演習を行う。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 03:32:12 GMT)
Adaptive Evaluation of Out-of-Band Defenses Against Prompt Injection in LLM Agents [0.0] 最近の研究は、間接的プロンプトインジェクションに対するツール使用 LLM エージェントの防御戦略に集約されている。
我々はこれらのアウト・オブ・バンド・ディフェンスを古典的整合性保護の事例として整理する。
我々は、このプロトコルを、Progent自身の適応攻撃解析の独立した複製と拡張として実行している。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 00:35:23 GMT)
Accelerated sampling using SamAdams variable timesteps and position-adaptive Langevin dynamics [0.0] 本稿では,2つの相補的なデバイスをベースとした高速化されたランゲヴィンに基づくサンプリング手法を提案する。
この方法は、緩和された剛性モニタを用いて、位相空間の剛性領域における有効積分ステップを自動的に縮小する。
局所的な力の方向に沿って摩擦を集中させ、正準分布を正確な不変量として保存する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:09:22 GMT)
A Quantum Method of Types [0.0] 経験分布の量子アナログとして機能する経験演算子を導入する。
この経験的作用素は、型を量子的に表すような、大きな偏差境界を満足することを示す。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 18:08:36 GMT)
A Pipeline for Generating Longitudinal Synthetic Clinical Notes Using Large Language Models [0.0] この研究は、臨床AIツールの開発を支援するために設計された、合成臨床ノートパイプラインとデータセットを導入している。
データセットは、構造化された患者生成、半構造化された患者旅行シミュレーション、非構造化された臨床ノート生成を組み合わせたモジュールパイプラインを使用して生成される。
本研究は,70名の総合患者を対象とし,全入院期間に20~50名の臨床ノートを添付したデータセットを作成した。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 11:08:40 GMT)
A Deterministic Control Plane for LLM Coding Agents [0.0] 10,008のGitHubリポジトリの公開調査では、エージェント構成が宣言されていない共有コンポーネントとして伝播していることがわかった。
本稿では,これらのギャップを1対1でマップするハーネス上の決定論的制御平面を提案する。
論文参考訳(メタデータ) (Thu, 25 Jun 2026 12:02:18 GMT)