コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

8月 18 2026
0

影響関数でコード生成プロンプトの汚染を検出するCodeSIFT

投稿者: ユウ

TL;DR CodeSIFTは、コード生成LLMに対する悪意あるプロン…

8月 18 2026
0

病理画像の空間文脈を言語だけで扱うSLMP:重み更新なしで最大+19.6ポイント改善

投稿者: ユウ

TL;DR SLMPは、病理WSIをタイル分割し、各タイルのMLLMに…

8月 18 2026
0

ミューテーションテストでLLM判定の信頼性を検証する

投稿者: ユウ

TL;DR LLMが生成するモデル評価(セマンティックジャッジ)の信頼…

8月 17 2026
0

語彙の多様性が変える言語モデルの内部構造:ID推定の落とし穴と新たな知見

投稿者: ユウ

TL;DR 言語モデルの表現の複雑さを測る「内在次元(ID)」は、語彙…

8月 17 2026
0

LLMとルールでBPMNのセキュリティ注釈を自動生成するハイブリッド手法

投稿者: ユウ

TL;DR 本論文は、BPMNモデルと自然言語のセキュリティ要件から、…

8月 17 2026
0

要約の評価は「読者の情報満足度」で変わる:既存指標の限界と実務への示唆

投稿者: ユウ

TL;DR 要約の価値は読者の背景や目的に依存するのに、既存の評価指標…

8月 17 2026
0

AIが医師を選ぶとき、何を重視する?大規模言語モデルの推薦をランダム化比較で監査

投稿者: ユウ

TL;DR LLMに医師を選ばせると、評判(口コミ評価や料金)が最も強…

8月 17 2026
0

VLM強化学習を高速化するRollplex:GPU空間共有で推論と学習を同時実行

投稿者: ユウ

TL;DR Rollplexは、VLMのRL後訓練において、従来は直列…

8月 17 2026
0

LLM変換した科学計算コードの信頼性を故障注入で検証する

投稿者: ユウ

TL;DR LLMでモダナイズした科学計算ソフトウェア(GAMESS)…

8月 17 2026
0

GitHubから収集した5.7万件の実プロンプト分析:構造化オントロジーと実務への示唆

投稿者: ユウ

TL;DR 本論文は、GitHub上のソフトウェアに埋め込まれた「トラ…

投稿のページ送り

前へ 1 … 9 10 11 … 288 次へ

Recent Posts

  • LLMの回答を軽量な制約で検証する:知識グラフQAの新手法CES-PK
  • LLMで問題文の「うっかり重複」を検出する二重分析フレームワーク
  • プロンプト構造は脆弱性を減らさず「移動」させる:LLM生成コードのセキュリティ実証分析
  • 行動アノマリー検索を3段階で解決するActPair:ペア比較リランキングの実装ポイント
  • VLMの安全性を「理由」まで検証するEviSafe:最終応答だけでは見えない欠陥

Recent Comments

表示できるコメントはありません。

過去30日間の人気記事

Proudly powered by WordPress | テーマ: Futurio