コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

タグ: LLM-as-Judge

8月 17 2026
0

要約の評価は「読者の情報満足度」で変わる:既存指標の限界と実務への示唆

投稿者: ユウ

TL;DR 要約の価値は読者の背景や目的に依存するのに、既存の評価指標…

7月 17 2026
0

BioASQで実証:再検索のコスト削減と複数LLM回答の選択・融合戦略

投稿者: ユウ

TL;DR BioASQタスク14Bで1位を獲得したシステム。2つの並…

7月 16 2026
0

LLM生成データの落とし穴:テストオラクル問題と検証プロトコル

投稿者: ユウ

TL;DR LLM-as-Judgeのバイアス研究で使われる合成データ…

7月 14 2026
0

LLM評価バイアスを内部表現から読み解く:幾何・因果・予測の統一フレームワーク

投稿者: ユウ

TL;DR LLM-as-Judgeのスコアリングバイアスは、入力の表…

Archives

  • 2026年8月
  • 2026年7月
  • 2026年3月
  • 2026年2月
  • 2026年1月
  • 2025年12月
  • 2025年1月
  • 2024年12月
  • 2024年11月
  • 2024年10月
  • 2024年9月
  • 2024年8月
  • 2024年7月
  • 2024年6月
  • 2024年5月
  • 2024年4月
  • 2024年3月

Categories

  • 3Dモデリング
  • AI
  • テキスト生成
  • 人物-物体相互作用
Proudly powered by WordPress | テーマ: Futurio