TL;DR

PRAXISは、LLMエージェントがドメイン固有コードを生成する際に欠落しがちな「暗黙知」(業務ルールやインターフェース契約など)を、実際にコードを書く練習を通じて抽出し、依存グラフ上に構造化して保存し、エージェントが関連コードに触れた瞬間に自動で注入するフレームワークです。既存手法よりPass@1で相対16.7%向上し、様々なLLMやエージェント基盤で一貫した改善を示しました。

解説

AMI CURIOUS

ねえ智也くん、このPRAXISって論文、タイトルに「暗黙知」ってあるけど、なんでそんなのが必要なの?

TOMOYA NEUTRAL

ああ、コード生成AIって、一般的なコードは書けるけど、特定の会社やプロジェクトのルールみたいな「暗黙知」は知らないんだ。それで、生成されたコードが実際の業務で使えないことが多いんだよ。

AMI INTERESTED

なるほどね。じゃあ、その暗黙知をどうやってAIに教えるの?

TOMOYA NEUTRAL

PRAXISは、AIエージェントに実際にコードを書く練習をさせるんだ。その過程で、業務ルールやインターフェース契約みたいな暗黙知を抽出して、依存グラフ上に構造化して保存するんだよ。

AMI CONFUSED

依存グラフって、コードの依存関係を表すグラフのこと?

TOMOYA NEUTRAL

そう。コードの構造をグラフで表して、そのノードに暗黙知を関連付けるんだ。そうすると、エージェントが関連するコードに触れた瞬間に、その知識を自動で注入できるんだよ。

AMI SURPRISED

へえ、すごい!でも、それって本当に効果あるの?

TOMOYA HAPPY

評価では、既存手法よりPass@1で相対16.7%向上したんだ。しかも、いろんなLLMやエージェント基盤で一貫して改善が見られたんだよ。

AMI CURIOUS

それはすごいね!でも、何か弱点とか限界はないの?

TOMOYA NEUTRAL

うーん、暗黙知を抽出するのに、最初に練習用のコードを用意する必要があるんだ。それに、依存グラフが複雑になると、管理が大変かもしれない。

AMI HAPPY

なるほどね。でも、実務で使えるコードを生成できるのは大きいよね。これで、AIがもっと実用的になるかもね!

TOMOYA NEUTRAL

そうだね。ただ、まだ研究段階だから、実用化にはもう少し時間がかかるかもしれないけどね。

AMI JOKING

でも、もしこれが完成したら、私の卒論もAIに書いてもらえるかな?

TOMOYA ANNOYED

それは無理だよ。卒論は自分で書きなさい。