7月 29 2026 0 UniMem:境界不明瞭なタスクストリームでLLMエージェントの記憶を自律拡張するフレームワーク 投稿者: ユウ TL;DR UniMemは、LLMエージェントが未知のタスクをエピソー…
7月 18 2026 0 LLMエージェントで連立交渉をシミュレート:SFT+DPO+RAGで党派性を維持する手法 投稿者: ユウ TL;DR 本論文は、LLMエージェントを用いて政党間の連立交渉をシミ…
7月 16 2026 0 評価指標も進化させるDouble Ratchet:LLMエージェント自己改善の信頼性を高める手法 投稿者: ユウ TL;DR LLMエージェントの自己改善ループには信頼できる評価指標が…