コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

タグ: MLLM

8月 18 2026
0

病理画像の空間文脈を言語だけで扱うSLMP:重み更新なしで最大+19.6ポイント改善

投稿者: ユウ

TL;DR SLMPは、病理WSIをタイル分割し、各タイルのMLLMに…

8月 15 2026
0

MLLMが画像を振り分ける:複数モデルを賢く使い分けるARMDIL

投稿者: ユウ

TL;DR ARMDILは、MLLM(マルチモーダル大規模言語モデル)…

7月 30 2026
0

ByDeWay-V2:訓練不要で空間推論を強化、説明可能なマルチモーダルLLM

投稿者: ユウ

TL;DR ByDeWay-V2は、MLLMの空間推論と幻覚低減を訓練…

7月 30 2026
0

セパレータトークンで視覚トークンを刈り込み、MLLMを高速化するSepPrune

投稿者: ユウ

TL;DR SepPruneは、MLLMの入力シーケンス内にある「モダ…

7月 28 2026
0

医療画像の2D/3Dを統合する視覚中心MLLM「ClinFusion」の実装と評価

投稿者: ユウ

TL;DR ClinFusionは、2D・3D医療画像を統合処理するカ…

7月 16 2026
0

VisualRepair:画像タイプに応じたツール呼び分けと領域フォーカスでソフトウェアバグ修正

投稿者: ユウ

TL;DR VisualRepairは、ソフトウェアのバグ報告に添付さ…

7月 15 2026
0

スポーツ映像理解の新ベンチマーク:複数カメラを活用するエージェントフレームワーク

投稿者: ユウ

TL;DR 既存のMLLMは単一視点の動画理解に優れるが、スポーツでは…

Archives

  • 2026年8月
  • 2026年7月
  • 2026年3月
  • 2026年2月
  • 2026年1月
  • 2025年12月
  • 2025年1月
  • 2024年12月
  • 2024年11月
  • 2024年10月
  • 2024年9月
  • 2024年8月
  • 2024年7月
  • 2024年6月
  • 2024年5月
  • 2024年4月
  • 2024年3月

Categories

  • 3Dモデリング
  • AI
  • テキスト生成
  • 人物-物体相互作用
Proudly powered by WordPress | テーマ: Futurio