7月 14 2026 0 推論のボトルネックを構造化:Hourglass Reasoningによる帰納推論の強化 投稿者: ユウ TL;DR Hourglass Reasoningは、LLMの帰納推論…
7月 11 2026 0 LLMファインチューニングで知識が記憶されても推論に使えない理由と自己パッチによる改善 投稿者: ユウ TL;DR LLMに新しい知識をファインチューニングで注入しても、記憶…
7月 11 2026 0 非GPU AIアクセラレータの実運用限界:Huawei Ascend 910でMoE・マルチモーダル推論を動かす現場報告 投稿者: ユウ TL;DR Huawei Ascend 910 16台構成でDeepS…
3月 04 2026 0 LLMエージェントの探索能力を強化する新手法RAPO:外部知識を活用した強化学習フレームワーク 投稿者: ユウ TL;DR 既存のLLMエージェント向け強化学習(Agentic RL…