コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

8月 12 2026
0

金融LLMの推論を検証するV-FiLLM:計算木で作る自動生成ベンチマーク

投稿者: ユウ

TL;DR V-FiLLMは、金融表データに対するLLMの推論能力を検…

8月 12 2026
0

アシスタントの性格が会話型情報検索に与える影響を実証

投稿者: ユウ

TL;DR LLMアシスタントの性格(外向的・誠実的・中立)を変えて2…

8月 12 2026
0

画像キャプション評価の新手法CapProbe:領域単位の高密度QAで詳細記述を検証する

投稿者: ユウ

TL;DR CapProbeは、画像キャプションの詳細な事実的正しさを…

8月 12 2026
0

実テーブル解析の盲点を可視化し、凍結パーサーを改善するDECフレームワーク

投稿者: ユウ

TL;DR 既存のテーブル解析モデルはベンチマークでは高スコアでも、実…

8月 12 2026
0

推論コストを増やさずに世界モデルの利点を取り込む「World Tokens」

投稿者: ユウ

TL;DR World Tokensは、訓練時のみビデオ世界モデルを使…

8月 12 2026
0

TTS評価の盲点を10次元で可視化:MOS予測とAudio-LLMの実力比較

投稿者: ユウ

TL;DR TTSの自然性を10の言語学的次元(音韻、韻律、パラ言語)…

8月 12 2026
0

高信頼度が逆効果?推論の探索と収束を両立する「Consilience」スコア

投稿者: ユウ

TL;DR 既存の信頼度最大化によるテスト時計算拡張は、難しい問題では…

8月 11 2026
0

パラメータ空間の探索でLLMのRL訓練を安定化する3PO手法

投稿者: ユウ

TL;DR LLMの強化学習(RLVR)では、温度調整などの行動空間で…

8月 11 2026
0

医療画像の言語理解と領域分割を統一するMedPixelの実装解説

投稿者: ユウ

TL;DR MedPixelは、医療画像の言語理解とピクセル単位の領域…

8月 11 2026
0

教師モデルとの不一致を活かす蒸留法TIDE:繰り返し崩壊を防ぎ数学推論を改善

投稿者: ユウ

TL;DR オンポリシー蒸留(OPD)では、生徒モデルが繰り返し文を生…

投稿のページ送り

1 2 … 273 次へ

Recent Posts

  • 金融LLMの推論を検証するV-FiLLM:計算木で作る自動生成ベンチマーク
  • アシスタントの性格が会話型情報検索に与える影響を実証
  • 画像キャプション評価の新手法CapProbe:領域単位の高密度QAで詳細記述を検証する
  • 実テーブル解析の盲点を可視化し、凍結パーサーを改善するDECフレームワーク
  • 推論コストを増やさずに世界モデルの利点を取り込む「World Tokens」

Recent Comments

表示できるコメントはありません。

過去30日間の人気記事

Proudly powered by WordPress | テーマ: Futurio