コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

タグ: VLM

7月 30 2026
0

AnnoBench:可視化アノテーションの品質を測るベンチマークと評価フレームワーク

投稿者: ユウ

TL;DR AnnoBenchは、LLM/VLMが生成するチャートアノ…

7月 29 2026
0

DecoupleMix:VLMデータ混合比率を分解して最適化する実践手法

投稿者: ユウ

TL;DR VLMの継続事前学習データの混合比率を、能力カテゴリ間(i…

7月 28 2026
0

ER図からデータベーススキーマを復元するVLM評価ベンチマーク「ERUnderstand」

投稿者: ユウ

TL;DR ERUnderstandは、VLMがER図からデータベース…

7月 28 2026
0

化学実験ロボットの故障分析ベンチマークLabRobFail:自動故障注入と6次元評価

投稿者: ユウ

TL;DR LabRobFailは、化学自走実験室向けの故障分析フレー…

7月 23 2026
0

画像と質問の順序で精度が変わるVLMの弱点をテスト時間学習で修復

投稿者: ユウ

TL;DR Vision-Language Modelは画像→質問の順…

7月 22 2026
0

VLM画像改ざん検出のためのシンプルなドメイン汎化フレームワーク

投稿者: ユウ

TL;DR PIXAR-DGは、VLMが生成した画像のピクセルレベルの…

7月 21 2026
0

テキストで指定した側面に基づく画像類似度指標TPIPS

投稿者: ユウ

TL;DR 人間の視覚的類似性判断は文脈(色・形・背景など)に依存する…

7月 21 2026
0

ToolSciVer:科学論文の図表を読み解く、強化学習でツールを使い分ける検証フレームワーク

投稿者: ユウ

TL;DR ToolSciVerは、科学論文の図表やグラフを正確に読み…

7月 20 2026
0

VTM-Nav:階層的視覚トポロジカルメモリで同一シーンの物体探索を再利用する

投稿者: ユウ

TL;DR VTM-Navは、同一シーンを繰り返し探索する物体ゴールナ…

7月 19 2026
0

複数LLM協調で脳腫瘍MRIレポート生成、3D VLMを実現

投稿者: ユウ

TL;DR 脳腫瘍(グリオーマ・髄膜腫)の3D MRIとテキストのペア…

投稿のページ送り

前へ 1 2 3 次へ

Archives

  • 2026年8月
  • 2026年7月
  • 2026年3月
  • 2026年2月
  • 2026年1月
  • 2025年12月
  • 2025年1月
  • 2024年12月
  • 2024年11月
  • 2024年10月
  • 2024年9月
  • 2024年8月
  • 2024年7月
  • 2024年6月
  • 2024年5月
  • 2024年4月
  • 2024年3月

Categories

  • 3Dモデリング
  • AI
  • テキスト生成
  • 人物-物体相互作用
Proudly powered by WordPress | テーマ: Futurio