コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

タグ: VLM

7月 21 2026
0

ToolSciVer:科学論文の図表を読み解く、強化学習でツールを使い分ける検証フレームワーク

投稿者: ユウ

TL;DR ToolSciVerは、科学論文の図表やグラフを正確に読み…

7月 20 2026
0

VTM-Nav:階層的視覚トポロジカルメモリで同一シーンの物体探索を再利用する

投稿者: ユウ

TL;DR VTM-Navは、同一シーンを繰り返し探索する物体ゴールナ…

7月 19 2026
0

複数LLM協調で脳腫瘍MRIレポート生成、3D VLMを実現

投稿者: ユウ

TL;DR 脳腫瘍(グリオーマ・髄膜腫)の3D MRIとテキストのペア…

7月 13 2026
0

エッジVLM推論の真のエネルギー消費は「見ること」より「話すこと」が支配的

投稿者: ユウ

TL;DR エッジデバイス上のVLM(視覚言語モデル)のエネルギー消費…

7月 13 2026
0

VLMの内部表現に正しい数はあるのに出力がズレる——活性化プローブで検出・修正する手法

投稿者: ユウ

TL;DR VLMは物体カウントタスクで誤答しがちだが、中間層の活性化…

7月 12 2026
0

小規模VLM量子化の実践ガイド:コンポーネント別分析とエッジ展開の知見

投稿者: ユウ

TL;DR 3Bパラメータ以下のVLMをJetson Orinエッジデ…

7月 12 2026
0

思考連鎖エントロピーでVLMの幻覚を検出する実践手法

投稿者: ユウ

TL;DR 思考モードVLMでは回答トークンのエントロピーが幻覚検出に…

3月 06 2026
0

VLMの幻覚を生成前に検知する手法HALP:内部表現の軽量プローブで効率化

投稿者: ユウ

TL;DR Vision-Language Model (VLM) が…

Archives

  • 2026年7月
  • 2026年3月
  • 2026年2月
  • 2026年1月
  • 2025年12月
  • 2025年1月
  • 2024年12月
  • 2024年11月
  • 2024年10月
  • 2024年9月
  • 2024年8月
  • 2024年7月
  • 2024年6月
  • 2024年5月
  • 2024年4月
  • 2024年3月

Categories

  • 3Dモデリング
  • AI
  • テキスト生成
  • 人物-物体相互作用
Proudly powered by WordPress | テーマ: Futurio