コンテンツへスキップ

亜美と智也のAI論文解説

最新AI論文の知見を分かりやすく解説!

タグ: 推論

8月 06 2026
0

RAC: 分割LLM推論の通信ボトルネックを参照状態の圧縮で解消する手法

投稿者: ユウ

TL;DR RACは、エッジとクラウドに分割されたLLM推論において、…

8月 04 2026
0

Transformerの自己注意機構を回路として使う、新しいテスト時潜在推論手法GradCuit

投稿者: ユウ

TL;DR GradCuitは、LLMの推論時に中間層に最適化可能な潜…

7月 23 2026
0

PoTRE:4つの異なる推論エージェントを並列実行し軽量モデルで高精度を実現する手法

投稿者: ユウ

TL;DR PoTREは、LLMの推論を4つの異なる戦略(敵対的洗練、…

7月 22 2026
0

長文推論でモデルが入力を丸写しする問題と、証拠に注目させる報酬設計GEAR

投稿者: ユウ

TL;DR 長文推論タスクでLLMが入力をそのまま思考にコピーする「反…

7月 22 2026
0

OmniReasoner:長尺音声動画の推論を「ズームイン」ツールで効率化する手法

投稿者: ユウ

TL;DR OmniReasonerは、長い音声動画に対して、まず低コ…

7月 21 2026
0

不完全なOWLオントロジーでも推論可能に:NeurOWLによるニューラル記号推論フレームワーク

投稿者: ユウ

TL;DR NeurOWLは、不完全なOWLオントロジーに対して、LL…

7月 21 2026
0

MLIRでLLMを効率的にデプロイ:TopOpとTpuOpによる2段階コンパイル手法

投稿者: ユウ

TL;DR 本論文は、LLMを専用AIアクセラレータに効率よくデプロイ…

7月 19 2026
0

低ビットGEMMのCPU推論を効率化する探索フレームワークExaGEMM

投稿者: ユウ

TL;DR ExaGEMMは、低ビットGEMMをCPU上で効率的に実行…

7月 17 2026
0

LLMの確率推定は一貫しているか?「分割→集約」で検証する統計的自己整合性

投稿者: ユウ

TL;DR LLMが条件付き推論として振る舞うなら、確率の基本法則(全…

7月 14 2026
0

ARMTでLLMのコンテキストを拡張:定常メモリと30%省FLOPsを実現

投稿者: ユウ

TL;DR ARMTは、LLMに連想型リカレントメモリを追加し、コンテ…

投稿のページ送り

前へ 1 2 3 … 10 次へ

Archives

  • 2026年8月
  • 2026年7月
  • 2026年3月
  • 2026年2月
  • 2026年1月
  • 2025年12月
  • 2025年1月
  • 2024年12月
  • 2024年11月
  • 2024年10月
  • 2024年9月
  • 2024年8月
  • 2024年7月
  • 2024年6月
  • 2024年5月
  • 2024年4月
  • 2024年3月

Categories

  • 3Dモデリング
  • AI
  • テキスト生成
  • 人物-物体相互作用
Proudly powered by WordPress | テーマ: Futurio