8月 16 2026 0 視覚言語モデルは「分からない」を内部で知っているのに答えを止められない——TRAPSBenchが示す表現ギャップ 投稿者: ユウ TL;DR 視覚言語モデル(VLM)は、映像から答えが確定できない状況…
8月 12 2026 0 画像キャプション評価の新手法CapProbe:領域単位の高密度QAで詳細記述を検証する 投稿者: ユウ TL;DR CapProbeは、画像キャプションの詳細な事実的正しさを…