コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

7月 16 2026
0

LLM検証ゲートの相関が信頼性に与える影響:指数関数的改善から多項式へ

投稿者: ユウ

TL;DR LLMの出力を検証するゲートを直列に増やしても、ゲート間の…

7月 16 2026
0

LLMエージェントが連携して悪意NPMパッケージを検出するProfMalPlus

投稿者: ユウ

TL;DR ProfMalPlusは、静的解析と動的解析を統合した行動…

7月 16 2026
0

VisualRepair:画像タイプに応じたツール呼び分けと領域フォーカスでソフトウェアバグ修正

投稿者: ユウ

TL;DR VisualRepairは、ソフトウェアのバグ報告に添付さ…

7月 16 2026
0

評価指標も進化させるDouble Ratchet:LLMエージェント自己改善の信頼性を高める手法

投稿者: ユウ

TL;DR LLMエージェントの自己改善ループには信頼できる評価指標が…

7月 16 2026
0

JADR:モデル内部の危険認識をJ-spaceで定量評価するプロトコル

投稿者: ユウ

TL;DR JADRは、LLMの応答生成前の内部表現(J-space)…

7月 16 2026
0

VLMのCoT推論は画像を最後まで見直していない:Visual Access Boundaryの発見

投稿者: ユウ

TL;DR Vision-Language Model (VLM) の…

7月 16 2026
0

DPベース検証器でLLMを強化学習:蓄熱スケジューリングへの応用

投稿者: ユウ

TL;DR 蓄熱システムのスケジューリングにLLMを適用。動的計画法(…

7月 16 2026
0

凍結小規模コードLLMの自己修復、エラー内容の効果は形式に埋もれる——PoPEによるプラセボ対照評価

投稿者: ユウ

TL;DR 0.5B〜1.5Bの凍結コードLLMにおいて、エラー情報を…

7月 15 2026
0

メモリ操作のライフサイクルで診断するLLM長期会話の弱点

投稿者: ユウ

TL;DR MemOpsは、LLMエージェントの長期記憶を「覚える」「…

7月 15 2026
0

LLM計画評価で「省略」がスコアを上げる脆弱性とその対策

投稿者: ユウ

TL;DR LLMが生成した戦略計画を評価するスコアラーは、計画が「必…

投稿のページ送り

前へ 1 … 38 39 40 … 288 次へ

Recent Posts

  • LLMの回答を軽量な制約で検証する:知識グラフQAの新手法CES-PK
  • LLMで問題文の「うっかり重複」を検出する二重分析フレームワーク
  • プロンプト構造は脆弱性を減らさず「移動」させる:LLM生成コードのセキュリティ実証分析
  • 行動アノマリー検索を3段階で解決するActPair:ペア比較リランキングの実装ポイント
  • VLMの安全性を「理由」まで検証するEviSafe:最終応答だけでは見えない欠陥

Recent Comments

表示できるコメントはありません。

過去30日間の人気記事

Proudly powered by WordPress | テーマ: Futurio