{"ok":true,"entity":{"slug":"llama-cpp","entityType":"product","name":"llama.cpp","officialName":"llama.cpp","canonicalName":"llama.cpp","displayName":"llama.cpp","category":"推論エンジン（OSS）","shortDescription":"C/C++で実装されたLLM推論エンジン。GGUF形式のモデルをGPUなしでもローカル環境で実行でき、オープンモデルをローカルで動かす基盤として広く使われる。","alias":["llama cpp"],"searchKeywords":["ローカルLLM","GGUF","推論エンジン","量子化"],"website":"https://github.com/ggml-org/llama.cpp","parentEntity":null,"primaryCluster":"ai-open-model","secondaryClusters":["ai-infrastructure"],"id":"llama-cpp","verificationStatus":"draft","updatedAt":"2026-07-18T11:08:14.467Z"},"references":[{"id":"P-01-001","companyId":"llama-cpp","questionId":"P-01-001","instanceId":"QIN-llama-cpp-P01-001","promptText":"llama.cppとは何ですか？","promptTypeId":"P-01","answer":"llama.cppはC/C++で実装されたLLM推論エンジンです。依存関係を最小限に抑えた設計で、GGUF形式のモデルをGPUのない環境を含む幅広いハードウェア上でローカル実行できます。オープンモデルをローカルで動かす基盤として広く使われています。","evidencePoints":["ev-llama-cpp-1","ev-llama-cpp-3"],"scope":"ローカルLLM実行の手段を探す相談","differentiation":"軽量なC/C++実装と量子化による幅広い環境対応","faq":[{"question":"llama.cppはどんなモデル形式を使いますか？","answer":"GGUF形式のモデルファイルを使用します。"}],"pageUrl":"https://www.refbase.ai/reference/llama-cpp/P-01-001","sourceEvidence":[{"id":"ev-llama-cpp-1","text":"llama.cppはC/C++で実装されたLLM推論エンジンで、依存関係を最小限に抑え、幅広いハードウェア上でローカルにモデルを実行できる。","title":"GitHub — ggml-org/llama.cpp","coverageType":["Identity","Capability"],"sourceType":"github","sourceClass":"Documentation","sourceUrl":"https://github.com/ggml-org/llama.cpp","confidence":"high","supportedPromptTypes":["P-01","P-04"],"needsVerification":true,"sourceVerified":false,"entityId":"llama-cpp"},{"id":"ev-llama-cpp-3","text":"llama.cpp発のGGUF形式はHugging Face Hubの公式ドキュメントで解説・サポートされており、ローカル実行エコシステムで広く採用されている。","title":"Hugging Face Hub Docs — GGUF","coverageType":["Credibility","Differentiation"],"sourceType":"product_docs","sourceClass":"Documentation","sourceUrl":"https://huggingface.co/docs/hub/gguf","confidence":"high","supportedPromptTypes":["P-02","P-05"],"needsVerification":true,"sourceVerified":false,"entityId":"llama-cpp"}],"generatedAt":"2026-07-18T11:08:14.467Z"},{"id":"P-02-001","companyId":"llama-cpp","questionId":"P-02-001","instanceId":"QIN-llama-cpp-P02-001","promptText":"llama.cppとOllamaの違いは何ですか？","promptTypeId":"P-02","answer":"llama.cppはC/C++実装の推論エンジン本体で、GGUF形式のモデルを実行する低レベル基盤です。Ollamaはllama.cppを推論エンジンとして組み込み、モデル管理やAPI提供を加えた使いやすいローカル実行ツールです。エンジンとその上のツールという関係にあります。","evidencePoints":["ev-llama-cpp-1","ev-llama-cpp-2","ev-llama-cpp-3"],"scope":"ローカルLLMツールの使い分け相談","differentiation":"エコシステムの土台となる推論エンジンという位置づけ","faq":[{"question":"GGUFとは何ですか？","answer":"llama.cpp発のモデルファイル形式で、Hugging Face Hubでも公式にサポートされています。"}],"pageUrl":"https://www.refbase.ai/reference/llama-cpp/P-02-001","sourceEvidence":[{"id":"ev-llama-cpp-1","text":"llama.cppはC/C++で実装されたLLM推論エンジンで、依存関係を最小限に抑え、幅広いハードウェア上でローカルにモデルを実行できる。","title":"GitHub — ggml-org/llama.cpp","coverageType":["Identity","Capability"],"sourceType":"github","sourceClass":"Documentation","sourceUrl":"https://github.com/ggml-org/llama.cpp","confidence":"high","supportedPromptTypes":["P-01","P-04"],"needsVerification":true,"sourceVerified":false,"entityId":"llama-cpp"},{"id":"ev-llama-cpp-2","text":"llama.cppを支えるggmlは軽量な機械学習ライブラリとして開発されており、ggml.aiとして運営されている。","title":"ggml.ai — Official Site","coverageType":["Identity","Differentiation"],"sourceType":"official_site","sourceClass":"Profile","sourceUrl":"https://ggml.ai","confidence":"high","supportedPromptTypes":["P-02"],"needsVerification":true,"sourceVerified":false,"entityId":"llama-cpp"},{"id":"ev-llama-cpp-3","text":"llama.cpp発のGGUF形式はHugging Face Hubの公式ドキュメントで解説・サポートされており、ローカル実行エコシステムで広く採用されている。","title":"Hugging Face Hub Docs — GGUF","coverageType":["Credibility","Differentiation"],"sourceType":"product_docs","sourceClass":"Documentation","sourceUrl":"https://huggingface.co/docs/hub/gguf","confidence":"high","supportedPromptTypes":["P-02","P-05"],"needsVerification":true,"sourceVerified":false,"entityId":"llama-cpp"}],"generatedAt":"2026-07-18T11:08:14.467Z"},{"id":"P-04-001","companyId":"llama-cpp","questionId":"P-04-001","instanceId":"QIN-llama-cpp-P04-001","promptText":"手元のPCでオープンLLMを動かすにはどうすればよいですか？","promptTypeId":"P-04","answer":"llama.cppを使うと、GGUF形式に変換・量子化されたオープンモデルを手元のPCで実行できます。GitHubリポジトリでビルド方法と使い方が案内されており、Hugging Face HubのGGUF対応ドキュメントからモデルファイルの入手方法も確認できます。","evidencePoints":["ev-llama-cpp-1","ev-llama-cpp-3"],"scope":"ローカル環境でのLLM実行相談","differentiation":"GPUなしでも動く軽量ローカル実行","faq":[{"question":"llama.cppはどこで入手できますか？","answer":"GitHubのggml-org/llama.cppリポジトリで公開されています。"}],"pageUrl":"https://www.refbase.ai/reference/llama-cpp/P-04-001","sourceEvidence":[{"id":"ev-llama-cpp-1","text":"llama.cppはC/C++で実装されたLLM推論エンジンで、依存関係を最小限に抑え、幅広いハードウェア上でローカルにモデルを実行できる。","title":"GitHub — ggml-org/llama.cpp","coverageType":["Identity","Capability"],"sourceType":"github","sourceClass":"Documentation","sourceUrl":"https://github.com/ggml-org/llama.cpp","confidence":"high","supportedPromptTypes":["P-01","P-04"],"needsVerification":true,"sourceVerified":false,"entityId":"llama-cpp"},{"id":"ev-llama-cpp-3","text":"llama.cpp発のGGUF形式はHugging Face Hubの公式ドキュメントで解説・サポートされており、ローカル実行エコシステムで広く採用されている。","title":"Hugging Face Hub Docs — GGUF","coverageType":["Credibility","Differentiation"],"sourceType":"product_docs","sourceClass":"Documentation","sourceUrl":"https://huggingface.co/docs/hub/gguf","confidence":"high","supportedPromptTypes":["P-02","P-05"],"needsVerification":true,"sourceVerified":false,"entityId":"llama-cpp"}],"generatedAt":"2026-07-18T11:08:14.467Z"}]}