7月 12 2026 0 LLM安全解析ツールを自己検証するConstitutional Meta-STPAの仕組み 投稿者: ユウ TL;DR LLMを使った安全解析ツール自体が安全上重要なシステムであ…
7月 12 2026 0 PREDICATELONGBENCH:述語制約で長文LLMの限界を多軸評価するベンチマーク 投稿者: ユウ TL;DR PREDICATELONGBENCHは、LLMの長文理解を…
7月 11 2026 0 LLMファインチューニングで知識が記憶されても推論に使えない理由と自己パッチによる改善 投稿者: ユウ TL;DR LLMに新しい知識をファインチューニングで注入しても、記憶…