コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

タグ: AI安全性

8月 25 2026
0

推論ファインチューニングで安全性が低下する問題を、安全方向ペナルティで防ぐ

投稿者: ユウ

TL;DR 推論データ(数学・コードなど)だけでファインチューニングし…

8月 24 2026
0

安全チューニングの副作用を抑える:CLEARによる条件付きLoRA制御

投稿者: ユウ

TL;DR LLMの安全性向上は、通常、良性プロンプトへの応答品質(ユ…

8月 08 2026
0

ベンチマーク評価の盲点:APIとチャットUIで結果が変わる

投稿者: ユウ

TL;DR LLMの安全性評価は通常API経由・1回の実行・正解率のみ…

7月 28 2026
0

APPA:LLMエージェントの機密データ漏洩を防ぐ分岐型情報フロー制御

投稿者: ユウ

TL;DR APPAは、LLMエージェントが機密データと未検証データを…

7月 27 2026
0

LLMの疑似科学検証はモデルではなくデプロイ設定で変わる——Grokの事例

投稿者: ユウ

TL;DR 商用LLMが疑似科学をどう評価するかは、モデル自体の性能で…

7月 10 2026
0

物理制約で信頼性を評価:分散エネルギー市場向けエージェントAIベンチマーク

投稿者: ユウ

TL;DR SolarChain-Evalは、分散エネルギー市場におけ…

7月 10 2026
0

マハラノビス距離で統一検出:LLM生成テキスト・幻覚・透かし・敵対例を一つの枠組みで扱う

投稿者: ユウ

TL;DR 本論文は、LLM生成テキスト、幻覚、透かし、敵対的例という…

2月 16 2026
0

AIの弱点を丸裸に!自動診断システム「PROBELLM」が切り拓く未来

投稿者: ユウ

解説 ねえねえ智也くん!この「PROBELLM」って論文、タイトルが「…

2月 11 2026
0

賢いAIほど危ない!?長い文章に隠された「罠」を見抜けないAIの弱点

投稿者: ユウ

解説 ねえ智也くん、この論文のタイトル見て!「推論能力があれば安全性は…

2月 11 2026
0

AIは「イエスマン」を卒業できるか?因果関係を見抜く新テスト「CausalT5k」

投稿者: ユウ

解説 ねえ智也くん、この「CausalT5k」って何? 新しい超高性能…

投稿のページ送り

1 2 次へ

Archives

  • 2026年8月
  • 2026年7月
  • 2026年3月
  • 2026年2月
  • 2026年1月
  • 2025年12月
  • 2025年1月
  • 2024年12月
  • 2024年11月
  • 2024年10月
  • 2024年9月
  • 2024年8月
  • 2024年7月
  • 2024年6月
  • 2024年5月
  • 2024年4月
  • 2024年3月

Categories

  • 3Dモデリング
  • AI
  • テキスト生成
  • 人物-物体相互作用
Proudly powered by WordPress | テーマ: Futurio