コンテンツへスキップ

自分のマシンで LLM を動かす最良のツール

これらのツールで、オープンウェイトモデルをローカルにダウンロードして実行。データは完全非公開で、シンプルな CLI から洗練されたチャット UI まで対応。

おすすめツール

4.6

Ollama でローカル LLM をデプロイ

Llama、Mistral、Phi などのオープンソース LLM をローカルマシンにダウンロードして実行できるクロスプラットフォームツール。CLI、ローカル API サーバー、OpenAI 互換エンドポイントを提供し、GPU やクラウドアカウントなしでモデルをプライベートに試せる。オフライン AI 機能が必要な開発者や、本番デプロイ前にプロンプトをテストしたい人に最適。

オープンソース中級ローカルデプロイオープンソース
Ollama更新日 2026-06-25
4.6

LM Studio ローカルモデルクライアント

LM Studio はワンクリックでオープンソース LLM をローカルにダウンロード・実行できるデスクトップアプリ。チャット用 GUI、OpenAI 互換のローカル API サーバー、GGUF/GGML 形式に対応し、コマンドラインや GPU の専門知識は不要。

ツール初心者LM Studioローカルデプロイ
LM Studio更新日 2026-07-01
4.7

Open WebUI

Open WebUI は機能豊富なセルフホスト型 AI チャット UI で、Ollama と OpenAI 互換 API をすぐにサポートする。完全オフライン動作し、洗練されたマルチモデル会話体験、ロール管理、Markdown サポート、プラグイン拡張機能を備え、チームや個人に最適。

オープンソース中級Open WebUIインターフェース
Open WebUI更新日 2026-06-28
4.7

vLLM 高性能推論フレームワーク

vLLM は大規模言語モデル向けの高通率推論・サービングエンジンで、PagedAttention によりメモリ効率とスループットを劇的に向上させる。連続バッチング、テンソル並列、OpenAI 互換 API サービングに対応し、大規模 LLM デプロイの第一選択となっている。

オープンソース上級vLLM推論
vLLM更新日 2026-06-26
NEW4.8

llama.cpp

llama.cpp は CPU と一般向け GPU でオープン LLM を効率的に動かす軽量 C/C++ 推論エンジンで、Ollama や LM Studio など多くのローカル AI ツールの土台となっている。GGUF 量子化フォーマットにより、専用アクセラレータなしの控えめなハードウェアでも大規模モデルを動かせる。

オープンソース上級ローカル LLM推論
ggml community更新日 2026-07-24
NEW4.7

Meta Llama

Llama は Meta のオープンウェイト言語モデルファミリーで、オープンソース AI エコシステムの中核を担い、ローカルでも任意のクラウドでも展開できる。軽量からフロンティア級まで複数サイズを揃え、無数のファインチューニング派生モデルを生み出し、組織が AI スタックを完全にコントロールすることを可能にする。

オープンソース中級オープンウェイトMeta
Meta更新日 2026-07-24