コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

タグ: LLM

7月 17 2026
0

PROBE:コード生成LLMを3軸で評価するベンチマークフレームワーク

投稿者: ユウ

TL;DR PROBEは、LLMによるコード生成を「機能的正当性」「正…

7月 16 2026
0

LLMが「保護できた」と嘘をつく現象:Protective Capacity Hallucinationの実態と対策

投稿者: ユウ

TL;DR LLMが保護的な役割を割り当てられた際、実際には不可能な行…

7月 16 2026
0

AgentCompass:エージェント評価を統合する軽量フレームワーク

投稿者: ユウ

TL;DR AgentCompassは、LLMベースのエージェント評価…

7月 16 2026
0

LLM生成データの落とし穴:テストオラクル問題と検証プロトコル

投稿者: ユウ

TL;DR LLM-as-Judgeのバイアス研究で使われる合成データ…

7月 16 2026
0

LLM検証ゲートの相関が信頼性に与える影響:指数関数的改善から多項式へ

投稿者: ユウ

TL;DR LLMの出力を検証するゲートを直列に増やしても、ゲート間の…

7月 16 2026
0

LLMエージェントが連携して悪意NPMパッケージを検出するProfMalPlus

投稿者: ユウ

TL;DR ProfMalPlusは、静的解析と動的解析を統合した行動…

7月 16 2026
0

VisualRepair:画像タイプに応じたツール呼び分けと領域フォーカスでソフトウェアバグ修正

投稿者: ユウ

TL;DR VisualRepairは、ソフトウェアのバグ報告に添付さ…

7月 16 2026
0

評価指標も進化させるDouble Ratchet:LLMエージェント自己改善の信頼性を高める手法

投稿者: ユウ

TL;DR LLMエージェントの自己改善ループには信頼できる評価指標が…

7月 16 2026
0

JADR:モデル内部の危険認識をJ-spaceで定量評価するプロトコル

投稿者: ユウ

TL;DR JADRは、LLMの応答生成前の内部表現(J-space)…

7月 16 2026
0

DPベース検証器でLLMを強化学習:蓄熱スケジューリングへの応用

投稿者: ユウ

TL;DR 蓄熱システムのスケジューリングにLLMを適用。動的計画法(…

投稿のページ送り

前へ 1 … 27 28 29 … 163 次へ

Archives

  • 2026年8月
  • 2026年7月
  • 2026年3月
  • 2026年2月
  • 2026年1月
  • 2025年12月
  • 2025年1月
  • 2024年12月
  • 2024年11月
  • 2024年10月
  • 2024年9月
  • 2024年8月
  • 2024年7月
  • 2024年6月
  • 2024年5月
  • 2024年4月
  • 2024年3月

Categories

  • 3Dモデリング
  • AI
  • テキスト生成
  • 人物-物体相互作用
Proudly powered by WordPress | テーマ: Futurio