コンテンツへスキップ
オープンソース上級

llama.cpp

CPU と GPU でオープン LLM を効率的に動かす軽量 C/C++ 推論エンジン。多くのローカル AI ツールの土台。

概要

「llama.cpp」は AI Resource Hub が厳選した「オープンソース」リソースで、オープンソースツール カテゴリに属し、上級レベルの学習者に適しています。ggml community が提供し、最終更新日は 2026-07-24、編集部スコアは 4.8/5 です。右側の「リソースへ移動」から元のページを開けます。

タグ

ローカル LLM推論GGUF

主な機能

  • GGUF モデルの効率的な CPU/GPU 推論
  • 量子化で控えめなハードでもモデルを実行
  • OpenAI 互換 API のサーバーモード

メリット

  • +ほぼどこでも動き Python 不要
  • +多くのツールが依拠する基盤エンジン

デメリット

  • CLI 中心で GUI は別ツール任せ

よくある質問

llama.cpp と Ollama のどちら?

Ollama は llama.cpp を手軽なモデル管理で包んだもの。最大の制御と軽量さなら llama.cpp 直接利用を。