7月 16 2026 0 凍結小規模コードLLMの自己修復、エラー内容の効果は形式に埋もれる——PoPEによるプラセボ対照評価 投稿者: ユウ TL;DR 0.5B〜1.5Bの凍結コードLLMにおいて、エラー情報を…
12月 13 2025 0 「AIのアドバイス、あなたに合ってる?」〜同じ回答が“安全”にも“危険”にもなる驚きの研究〜 投稿者: ユウ 解説 ねえねえ、智也くん!これ見て!『Challenges of Ev…
12月 13 2025 0 AIの“指示通り動く力”を無限にテストせよ!~魔法のベンチマーク生成装置「PACIFIC」の秘密~ 投稿者: ユウ 解説 ねえねえ、智也くん!これ見て!『PACIFIC: a frame…