7月 16 2026 0 凍結小規模コードLLMの自己修復、エラー内容の効果は形式に埋もれる——PoPEによるプラセボ対照評価 投稿者: ユウ TL;DR 0.5B〜1.5Bの凍結コードLLMにおいて、エラー情報を…
7月 13 2026 0 競合→協調:4つのフロンティアAI教師が検証可能なカリキュラムを構築し、模倣を超えるコード学習 投稿者: ユウ TL;DR 4つのフロンティアAI(Claude, Codex, Gr…
7月 10 2026 0 GPUクエリ実行の合成 vs エンジニアリング:LLM生成コードの性能を分解し移植可能エンジンへ応用 投稿者: ユウ TL;DR GPUデータベースにおいて、LLMがクエリごとに専用CUD…
3月 05 2026 0 LLMは人間レベルのコードリファクタリングを発見・実行できるか?CODETASTEベンチマークで検証 投稿者: ユウ TL;DR CODETASTEベンチマークの実験結果によると、最先端L…
3月 04 2026 0 LLMで自動生成するワークロード特化型OLAPエンジン:汎用性のオーバーヘッドを排除する手法 投稿者: ユウ TL;DR Bespoke OLAPは、固定されたワークロード(スキー…
3月 04 2026 0 LLMエージェントの探索能力を高める「戦略誘導探索」:難易度の高いUI操作やコーディングタスクへの適用 投稿者: ユウ TL;DR LLMエージェントの強化学習において、低レベルの行動探索で…