コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

タグ: 安全性

7月 18 2026
0

無害なデータでファインチューニングすると、LLMが過激なイデオロギーに傾く現象

投稿者: ユウ

TL;DR GPT-4.1を経済学のQ&A(右派・左派)で20…

7月 16 2026
0

LLMが「保護できた」と嘘をつく現象:Protective Capacity Hallucinationの実態と対策

投稿者: ユウ

TL;DR LLMが保護的な役割を割り当てられた際、実際には不可能な行…

7月 12 2026
0

AegisDx:鑑別診断の安全性を高める仮説演繹的AIフレームワーク

投稿者: ユウ

TL;DR AegisDxは、LLMを単なる予測モデルとして使うのでは…

7月 12 2026
0

LLM安全解析ツールを自己検証するConstitutional Meta-STPAの仕組み

投稿者: ユウ

TL;DR LLMを使った安全解析ツール自体が安全上重要なシステムであ…

3月 03 2026
0

ロボットに「安全第一」を学習させる新手法:言葉で指示するだけで危険を回避する計画を立てられるAI

投稿者: ユウ

解説 ねえねえ、智也くん!これ、『SafeGen-LLM: Enhan…

1月 27 2026
0

お医者さんAIを賢く育てる!採点表の革命「Health-SCORE」

投稿者: ユウ

解説 ねえねえ智也くん!この「Health-SCORE」って論文、何だ…

12月 21 2024
0

多言語の安全性を守る新しい挑戦!

投稿者: ユウ

解説 ねえ、トモヤ!この論文のタイトル「LLMs Lost in Tr…

12月 20 2024
0

自動運転の信頼性を考える!AUTOTRUSTの魅力

投稿者: ユウ

解説 ねえ、トモヤ!この『AUTOTRUST』っていう論文、面白そうだ…

12月 05 2024
0

AIの安全性を脅かす新手法?BoN Jailbreakingの秘密

投稿者: ユウ

解説 ねえ、トモヤ!この「Best-of-N Jailbreaking…

11月 30 2024
0

自動運転の未来を守るための敵対的攻撃の研究

投稿者: ユウ

解説 ねえ、トモヤ!この論文のタイトル『自動運転のための視覚的敵対的攻…

投稿のページ送り

1 2 … 4 次へ

Archives

  • 2026年8月
  • 2026年7月
  • 2026年3月
  • 2026年2月
  • 2026年1月
  • 2025年12月
  • 2025年1月
  • 2024年12月
  • 2024年11月
  • 2024年10月
  • 2024年9月
  • 2024年8月
  • 2024年7月
  • 2024年6月
  • 2024年5月
  • 2024年4月
  • 2024年3月

Categories

  • 3Dモデリング
  • AI
  • テキスト生成
  • 人物-物体相互作用
Proudly powered by WordPress | テーマ: Futurio