Blog
運動シミュレーションと強化学習を組み合わせる — 自己対戦ドッグファイトAIの事例
6自由度の運動方程式で飛ぶ機体に自己対戦PPOを組み合わせ、2機のドッグファイトAIを学習させた事例を紹介します。運動方程式・制御入力の設計から、観測・報酬設計まで、運動シミュレーションと強化学習それぞれの視点で整理します。
LLMエージェントの設計パターンを選ぶ — RAG・ツール呼び出し・マルチエージェントの使い分け
RAG・ツール呼び出し・マルチエージェントというLLMアプリケーションの主要パターンを、LLM単体に何が足りないかという観点から整理し、それぞれの適用条件と限界をまとめます。
AIプロジェクトの進め方 — PoCで終わらせないために
AIプロジェクトがPoCどまりで終わってしまう典型的な原因を整理し、始める前に握っておくべきこと、本番化を見据えたPoC設計、運用フェーズで何をすべきかをまとめます。
