コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

8月 18 2026
0

LLM強化学習の新手法:価値関数に特権情報を注入して性能向上

投稿者: ユウ

TL;DR LLMの強化学習では、GRPOなどのグループ比較方式が主流…

8月 18 2026
0

テスト駆動でコード生成を強化するTDD-Agentの仕組みと実装ポイント

投稿者: ユウ

TL;DR TDD-Agentは、LLMによるコード生成に「テスト駆動…

8月 18 2026
0

科学質問の価値を未来の文献で検証する「歴史バックテスト」評価プロトコル

投稿者: ユウ

TL;DR AIが生成した科学的研究質問の価値を、将来の文献が実際に取…

8月 18 2026
0

LLMによる計画生成を強化するPDDLCoder:自然言語からPDDLを自動生成するエージェント型フレームワーク

投稿者: ユウ

TL;DR PDDLCoderは、LLMが自然言語のタスク記述からPD…

8月 18 2026
0

入力文との対応関係を利用した幻覚スパン検出:軽量エンコーダで高再現率を実現

投稿者: ユウ

TL;DR LLMの出力に含まれる幻覚(ハルシネーション)を、入力テキ…

8月 18 2026
0

文字色が感情分析を左右する?VLMの視覚バイアスを検証

投稿者: ユウ

TL;DR 視覚言語モデル(VLM)は、画像内のテキストの色やコントラ…

8月 18 2026
0

内視鏡動画向け時間的視覚言語モデルの堅牢性評価と軽量適応手法

投稿者: ユウ

TL;DR 内視鏡手術動画を対象に、時間的視覚言語モデル(TVLM)が…

8月 18 2026
0

影響関数でコード生成プロンプトの汚染を検出するCodeSIFT

投稿者: ユウ

TL;DR CodeSIFTは、コード生成LLMに対する悪意あるプロン…

8月 18 2026
0

病理画像の空間文脈を言語だけで扱うSLMP:重み更新なしで最大+19.6ポイント改善

投稿者: ユウ

TL;DR SLMPは、病理WSIをタイル分割し、各タイルのMLLMに…

8月 18 2026
0

ミューテーションテストでLLM判定の信頼性を検証する

投稿者: ユウ

TL;DR LLMが生成するモデル評価(セマンティックジャッジ)の信頼…

投稿のページ送り

1 2 … 280 次へ

Recent Posts

  • LLM強化学習の新手法:価値関数に特権情報を注入して性能向上
  • テスト駆動でコード生成を強化するTDD-Agentの仕組みと実装ポイント
  • 科学質問の価値を未来の文献で検証する「歴史バックテスト」評価プロトコル
  • LLMによる計画生成を強化するPDDLCoder:自然言語からPDDLを自動生成するエージェント型フレームワーク
  • 入力文との対応関係を利用した幻覚スパン検出:軽量エンコーダで高再現率を実現

Recent Comments

表示できるコメントはありません。

過去30日間の人気記事

Proudly powered by WordPress | テーマ: Futurio