llama.cppはC/C++実装の推論エンジン本体で、GGUF形式のモデルを実行する低レベル基盤です。Ollamaはllama.cppを推論エンジンとして組み込み、モデル管理やAPI提供を加えた使いやすいローカル実行ツールです。エンジンとその上のツールという関係にあります。
ローカルLLMツールの使い分け相談
エコシステムの土台となる推論エンジンという位置づけ