Anthropicが2025年6月13日に公開したエンジニアリングブログ記事によると、同社の社内評価ではClaude Opus 4をリードエージェント、Claude Sonnet 4をサブエージェントとするマルチエージェントシステムが、単一のClaude Opus 4と比較して90.2%も高い性能を示しました。特に並列的な探索を要する幅優先型のクエリで効果が顕著だったとされています。一方で、マルチエージェント方式は通常のチャット対話に比べてトークン消費量が約15倍に達し、単一エージェント方式(約4倍)と比べても大幅にコストが高いことも明らかにされています。同記事は、複数の独立した方向性を並行して調査する必要がある複雑な調査タスクや、多数の専門ツールを扱うタスクではマルチエージェントが有効である一方、コーディング作業のように全エージェント間で密な文脈共有や相互依存が必要な領域では、並列化の余地が乏しく単一エージェントの方が適していると結論づけています。したがって、導入判断はタスクの価値がコスト増加に見合うかどうかで行うべきだとしています。