比較軸 ・提供形態(事前最適化済みコンテナか、自前でのチューニングが必要な推論エンジンか) ・基盤技術 NVIDIA NIMは、Triton Inference Server・TensorRT-LLMを基盤に事前最適化されたコンテナとして提供される点が特徴で、開発者が自前で推論エンジンを個別最適化する手間を省く設計になっている。