全件ブラウズ

arXiv 研究論文 全件

AI/機械学習を中心とした arXiv の研究論文を全件で。分野(カテゴリ)・年で絞り込み・検索できます。

条件クリア

該当 334 件

論文分野著者数日付
ReToken: ビジョン言語モデルの視覚検索性能向上用トークン ↗ cs.CV 6 2026/07/30
ACE-Data-0: 具体化データエンジンとしての人間中心環境キャプチャ ↗ cs.CV 16 2026/07/30
PhiZero: 物理言語を中心に構築された世界モデル ↗ cs.CV 7 2026/07/30
Chimera: ハイブリッド視覚拡散トランスフォーマーの設計とChinchill... ↗ cs.CV 12 2026/07/30
Beacon: エージェント視覚推論を実行するタイミングと方法の認識 ↗ cs.CV 14 2026/07/30
VAD: マルチモーダルオンポリシー蒸留における目標再構成の視覚的証... ↗ cs.CV 12 2026/07/30
MixFrag: Vision Transformers向け脆性ガイド混合精度学習後量子化 ↗ cs.CV 3 2026/07/30
ROAD: 3D形状生成のための識別的意味論の相反目的アライメント ↗ cs.CV 8 2026/07/30
テキストから衛星アーカイブの変化を検出:前後画像を効率的に組み合... ↗ cs.CV 3 2026/07/30
MIND: 医療画像フュージョン用拡散変圧器によるマルチモーダル意図駆... ↗ cs.CV 6 2026/07/30
ScaFE:LLM生成臨床特徴プログラムによるデータ効率的傷痕分類 ↗ cs.CV 2 2026/07/30
MarkushGlyph と OCSRGlyph: 改善された化学構造認識 ↗ cs.CV 4 2026/07/30
何を除去するか、何を保存するか: 全合一画像復元のための二重曖昧性... ↗ cs.CV 9 2026/07/30
フレーム選択を超えて: 長尺動画理解のための生成潜在証拠集約 ↗ cs.CV 6 2026/07/30
RefCaptioner: マルチリファレンス画像グラウンデッドビデオキャプシ... ↗ cs.CV 19 2026/07/30
AuricularWorld: CTスキャンからの細粒度耳部構造セグメンテーション... ↗ cs.CV 9 2026/07/30
自動運転車向けリアルタイムPixOOD: 効率的な異常セグメンテーション ↗ cs.CV 4 2026/07/30
ビジョン言語モデルはAI編集画像について推論できるか? ↗ cs.CV 4 2026/07/30
VisualRouter: 長尺動画理解のためのクエリ根拠ビジュアルサンプリン... ↗ cs.CV 8 2026/07/30
ViewMind3D: 学習フリー3D-QAのためのモジュール型ビュー認識推論 ↗ cs.CV 6 2026/07/30
ネガティブコントロールによるラジオミクスとイメージングファウンデ... ↗ cs.CV 9 2026/07/30
大規模地域間リモートセンシング洪水監視フレームワーク: 運用的なマ... ↗ cs.CV 9 2026/07/30
大規模基盤モデルの時代における手と物体の相互作用: 再構成、生成、... ↗ cs.CV 9 2026/07/30
自動抽出された概念活性化ベクトルで画像類似性を説明する ↗ cs.CV 4 2026/07/30
ShadowDancer: ビデオとその影から統一的な動力学表現を学習して、任... ↗ cs.CV 3 2026/07/30
マルチモーダル大規模言語モデルにおけるトークン削減のための トー... ↗ cs.CV 7 2026/07/30
同じ枝、異なる木: 冠動脈セグメンテーション及び FFR-CT 判断一致性... ↗ cs.CV 6 2026/07/30
AdaAnchor4D: 単眼 UAV 4D 再構成のための アンカー条件付き時空間特... ↗ cs.CV 9 2026/07/30
ObjectStream: ストリーミングビデオ理解のための潜在オブジェクトメ... ↗ cs.CV 11 2026/07/30
MonoVoc:軽量単眼オープン語彙3D ガウシアンのためのジオメトリとセ... ↗ cs.CV 4 2026/07/30
RGB-D カメラを使用した組込デバイス上の Pareto 最適フロント充填可... ↗ cs.CV 5 2026/07/30
視覚的曖昧さを超えて:詳細な長キャプションによる困難なシナリオで... ↗ cs.CV 5 2026/07/30
MSCM-net:マルチスケール畳み込みと Mamba に基づくハイパースペクト... ↗ cs.CV 7 2026/07/30
Theia:大規模マルチモーダル・キャプショニングと Incidents1M デー... ↗ cs.CV 4 2026/07/30
TARS:3Dフリー動画リシューティングのためのタイムステップ認識型デ... ↗ cs.CV 8 2026/07/30
Space2Ground 2.0:ストリート・レベルと衛星画像の融合による農業監... ↗ cs.CV 5 2026/07/30
EgoGenesis:オンライン・アンカー付き射影メモリと Action-3D RoPE... ↗ cs.CV 12 2026/07/30
FaithEyes: マルチエージェントプロセス画像検証による忠実なツール... ↗ cs.CV 5 2026/07/30
ビジョン言語モデルのスケーリングはバイアス軽減に十分ではない ↗ cs.CV 3 2026/07/30
画像外情報活用: 時空間情報ゲインに駆動される農地分割エージェント ↗ cs.CV 7 2026/07/30
暗黙と明示的幾何を備えた3D認識VLM ↗ cs.CV 7 2026/07/23
世界状態レジスタを備えたストリーミングマルチエージェント自己回帰... ↗ cs.CV 5 2026/07/23
統一ビデオ密予測: 非結合データからの生成 ↗ cs.CV 5 2026/07/23
段階的シード刪減によるDiffusionモデルの推論時スケーリング ↗ cs.CV 2 2026/07/23
GraphVid: インタラクティブグラフ制御ビデオ生成 ↗ cs.CV 8 2026/07/23
グラビア印刷品質管理自動化のための合成データ生成フレームワーク ↗ cs.CV 4 2026/07/23
ビデオからの自己教師あり構造動力学学習 ↗ cs.CV 3 2026/07/23
微分可能光輸送による場面パラメータ顕著性 ↗ cs.CV 2 2026/07/23
Visual Contrastive Self-Distillation ↗ cs.CV 7 2026/07/23
SANA-Video 2.0: 注意残差を用いたハイブリッド線形注意による効率的... ↗ cs.CV 14 2026/07/23

出典:米国政府公式の公開データ。本サイトは収集・整理した索引で、米国政府公式ではありません。「解説あり」は当サイトの日本語解説ページ、それ以外は公式の一次情報へリンクします。

免責: 本サイトは各公式データソースをもとに独自に要約・分類したものです。最新・正確な情報は必ず公式ソースをご確認ください。金融・医療・法務・セキュリティに関する内容は情報整理であり、助言ではありません。本サイトは米国政府の公式サイトではありません。