コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

7月 18 2026
0

教師モデルのPythonコードを蒸留し、小型モデルで金融数値推論を高精度化

投稿者: ユウ

TL;DR 大規模言語モデル(教師)が生成したPythonプログラムを…

7月 18 2026
0

クエリのみからルーブリックを進化させる手法「RUBRICS ON TRIAL」

投稿者: ユウ

TL;DR RUBRICS ON TRIALは、クエリのみを入力として…

7月 18 2026
0

時間制約を考慮した知識グラフ質問生成ベンチマーク「ChronoQG」の構築手法

投稿者: ユウ

TL;DR ChronoQGは、時間的知識グラフから時間制約を正しく反…

7月 18 2026
0

LLMエージェントで連立交渉をシミュレート:SFT+DPO+RAGで党派性を維持する手法

投稿者: ユウ

TL;DR 本論文は、LLMエージェントを用いて政党間の連立交渉をシミ…

7月 18 2026
0

多言語プロンプトでコード生成、品質はどう変わる?LLMの言語バイアスを実タスクで検証

投稿者: ユウ

TL;DR LLMにコード生成を依頼する際、プロンプトの言語(英語・中…

7月 18 2026
0

ドライブレコーダー映像から因果推論:teLLMeによる探索的因果分析

投稿者: ユウ

TL;DR teLLMeは、ドライブレコーダー映像から生成したイベント…

7月 17 2026
0

ファームウェア再ホスティングをエビデンス駆動で改善するマルチエージェントフレームワーク

投稿者: ユウ

TL;DR FirmPilotは、IoTファームウェアをエミュレータ上…

7月 17 2026
0

推論グラフでLLMの著者を特定:頑健な著者推定手法

投稿者: ユウ

TL;DR LLMが生成したテキストの著者(モデル)を特定するタスクに…

7月 17 2026
0

画像付きIssueからコード位置を特定するベンチマーク「MM-IssueLoc」の紹介

投稿者: ユウ

TL;DR MM-IssueLocは、Issueに添付されたスクリーン…

7月 17 2026
0

最適化の推奨値を説明する:GradientSHAPと陰関数定理による高速SHAP計算とLLM活用

投稿者: ユウ

TL;DR 本論文は、最適化アルゴリズムが出力する制御パラメータの変更…

投稿のページ送り

前へ 1 … 36 37 38 … 288 次へ

Recent Posts

  • LLMの回答を軽量な制約で検証する:知識グラフQAの新手法CES-PK
  • LLMで問題文の「うっかり重複」を検出する二重分析フレームワーク
  • プロンプト構造は脆弱性を減らさず「移動」させる:LLM生成コードのセキュリティ実証分析
  • 行動アノマリー検索を3段階で解決するActPair:ペア比較リランキングの実装ポイント
  • VLMの安全性を「理由」まで検証するEviSafe:最終応答だけでは見えない欠陥

Recent Comments

表示できるコメントはありません。

過去30日間の人気記事

Proudly powered by WordPress | テーマ: Futurio