AIエージェントのレベル区分は、「どこまで人間の判断を介在させるか」という軸で整理するとわかりやすいです。
レベル1はチャットへの単発入力・単発出力、いわゆる一問一答の処理です。
レベル2は人間が都度プロンプトを書いて補助的に活用する段階で、まだ人間主導の色合いが強い形です。
レベル3になると、Claude Codeに2〜3行の簡単な指示を渡すだけで、システムの構築からデプロイまでを自律的に実行してくれます。
ただしアウトプットの最終チェックは人間が行う点がレベル2との違いです。
レベル4はA2A(エージェント・トゥ・エージェント)構成で、実行エージェントの出力を別のチェック用エージェントが自動で検証するため、人間の介在をほぼ排除できます。
`/goal`スラッシュコマンドで実現できるとされており、現状この段階が実用として最も現実的です。
レベル5はエージェントがさらに別のエージェントを呼び出すマトリョーシカ型の構成ですが、チューニングコストが高く、現時点ではレベル4が実装の着地点として推奨されています。