コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

7月 14 2026
0

LLM評価バイアスを内部表現から読み解く:幾何・因果・予測の統一フレームワーク

投稿者: ユウ

TL;DR LLM-as-Judgeのスコアリングバイアスは、入力の表…

7月 14 2026
0

E-VQA:動画の答えと根拠をピクセル単位で示す新タスク

投稿者: ユウ

TL;DR 既存のVideo LLMは回答のみを出力し、なぜその答えに…

7月 14 2026
0

エージェントLLMに共有選択的永続メモリを導入、タスク完了率96%を達成

投稿者: ユウ

TL;DR 本論文は、エージェントLLMシステムにおいて、セッション間…

7月 14 2026
0

LLMの「忘れる」を正しく評価する:非対称な汎化問題とSUITEプロトコル

投稿者: ユウ

TL;DR LLMのアンラーニング(特定知識の削除)は、忘れるべき事実…

7月 14 2026
0

AIエージェントがバグを直しやすいバグ報告書の書き方:情報タイプの影響を実証

投稿者: ユウ

TL;DR SWE-bench Verifiedの441件のバグ報告書…

7月 14 2026
0

CLIコーディングエージェントの失敗をプロセスとして解剖する大規模実証研究

投稿者: ユウ

TL;DR LLMコーディングエージェントの失敗を「最終結果」ではなく…

7月 14 2026
0

LLMで半導体フロントエンド設計を自動化する:課題と将来展望

投稿者: ユウ

TL;DR 本論文は、大規模言語モデル(LLM)を半導体のフロントエン…

7月 13 2026
0

大規模文学コーパスの自動テーマ索引付け:LLMファインチューニングの実践

投稿者: ユウ

TL;DR 本論文は、ヴォルテール全集の大規模サブコーパスを対象に、機…

7月 13 2026
0

バイナリ関数からソースコードを復元:アンカー検索とLLM推論の実践パイプライン

投稿者: ユウ

TL;DR 本論文は、ストリップされたバイナリ関数から元のソースコード…

7月 13 2026
0

コードレビューコメントの品質と多様性を両立するLLMキュレーションパイプライン

投稿者: ユウ

TL;DR 既存のコードレビューデータセットはノイズが多く、LLM学習…

投稿のページ送り

前へ 1 … 40 41 42 … 288 次へ

Recent Posts

  • LLMの回答を軽量な制約で検証する:知識グラフQAの新手法CES-PK
  • LLMで問題文の「うっかり重複」を検出する二重分析フレームワーク
  • プロンプト構造は脆弱性を減らさず「移動」させる:LLM生成コードのセキュリティ実証分析
  • 行動アノマリー検索を3段階で解決するActPair:ペア比較リランキングの実装ポイント
  • VLMの安全性を「理由」まで検証するEviSafe:最終応答だけでは見えない欠陥

Recent Comments

表示できるコメントはありません。

過去30日間の人気記事

Proudly powered by WordPress | テーマ: Futurio