コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

8月 26 2026
0

プロンプト構造は脆弱性を減らさず「移動」させる:LLM生成コードのセキュリティ実証分析

投稿者: ユウ

TL;DR GPT-4oとLLaMA 3.1-8Bで424件のセキュリ…

8月 26 2026
0

行動アノマリー検索を3段階で解決するActPair:ペア比較リランキングの実装ポイント

投稿者: ユウ

TL;DR ActPairは、テキストベースの人物異常行動検索を3段階…

8月 26 2026
0

VLMの安全性を「理由」まで検証するEviSafe:最終応答だけでは見えない欠陥

投稿者: ユウ

TL;DR EviSafeは、VLMの安全性を「最終的な応答」だけでな…

8月 26 2026
0

LLMの価値観は測定方法で変わる?「STONIC」が示す評価契約の設計

投稿者: ユウ

TL;DR LLMの価値観を測る方法(評価・選択・自由記述)は、それぞ…

8月 26 2026
0

音楽推薦の新手法:マルチモーダル検索とLLM再ランキングの実践

投稿者: ユウ

TL;DR 本論文は、音楽推薦の会話システムにおいて、7つの埋め込み空…

8月 25 2026
0

バグ再現テスト生成を「分割・引き継ぎ・分離」で安定化するDPIAgent

投稿者: ユウ

TL;DR DPIAgentは、バグ再現テスト生成を「原因調査」と「テ…

8月 25 2026
0

推論ファインチューニングで安全性が低下する問題を、安全方向ペナルティで防ぐ

投稿者: ユウ

TL;DR 推論データ(数学・コードなど)だけでファインチューニングし…

8月 25 2026
0

LLMエージェント分割の最適粒度を探る:VAT判定タスクでの実証パイロット

投稿者: ユウ

TL;DR LLMエージェントを細かく分割しすぎると逆に精度が落ちる可…

8月 25 2026
0

LLMは文法工学をどこまで支援できるか?広東語ParGram資源と制御実験による評価

投稿者: ユウ

TL;DR 本論文は、LLM(gpt-oss-120bとGPT-5.4…

8月 25 2026
0

ロボット動作の意図を蒸留するINDI:行動デコーダの性能を20ポイント向上

投稿者: ユウ

TL;DR INDIは、ロボットの行動デコーダに「意図」を蒸留する手法…

投稿のページ送り

1 2 … 288 次へ

Recent Posts

  • プロンプト構造は脆弱性を減らさず「移動」させる:LLM生成コードのセキュリティ実証分析
  • 行動アノマリー検索を3段階で解決するActPair:ペア比較リランキングの実装ポイント
  • VLMの安全性を「理由」まで検証するEviSafe:最終応答だけでは見えない欠陥
  • LLMの価値観は測定方法で変わる?「STONIC」が示す評価契約の設計
  • 音楽推薦の新手法:マルチモーダル検索とLLM再ランキングの実践

Recent Comments

表示できるコメントはありません。

過去30日間の人気記事

Proudly powered by WordPress | テーマ: Futurio