オープンソース上級
llama.cpp
CPU と GPU でオープン LLM を効率的に動かす軽量 C/C++ 推論エンジン。多くのローカル AI ツールの土台。
概要
「llama.cpp」は AI Resource Hub が厳選した「オープンソース」リソースで、オープンソースツール カテゴリに属し、上級レベルの学習者に適しています。ggml community が提供し、最終更新日は 2026-07-24、編集部スコアは 4.8/5 です。右側の「リソースへ移動」から元のページを開けます。
タグ
ローカル LLM推論GGUF
主な機能
- ▹GGUF モデルの効率的な CPU/GPU 推論
- ▹量子化で控えめなハードでもモデルを実行
- ▹OpenAI 互換 API のサーバーモード
メリット
- +ほぼどこでも動き Python 不要
- +多くのツールが依拠する基盤エンジン
デメリット
- −CLI 中心で GUI は別ツール任せ
よくある質問
llama.cpp と Ollama のどちら?
Ollama は llama.cpp を手軽なモデル管理で包んだもの。最大の制御と軽量さなら llama.cpp 直接利用を。