本文へスキップ
fedi.software

ローカルLLMアプリ

自分のパソコンでモデルを動かすアプリ:対応OS、必要メモリ、GPU対応、当サイトのカタログからのダウンロード。

更新日

Ollama

オープンソース

Ollama は、オープンウェイトのモデルをコマンドラインやデスクトップアプリで手元のパソコンで動かすオープンソースのソフト(MIT)です。OpenAI 互換のローカル API を備えています。

対応OS
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
OpenAI互換API
はい
ライセンス
MIT
GitHubスター
181,947

LM Studio

無料

コマンドを使わずにローカルのモデルを探して試したい人には LM Studio が合っています。チャット画面とローカルの API サーバーがあり、無料ですがオープンソースではありません。

対応OS
Windows, macOS, Linux
最小RAM
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
OpenAI互換API
はい
ライセンス
Proprietary

Jan

オープンソース

Jan は、モデルをオフラインで動かし、必要ならクラウドの API にもつなげるオープンソース(Apache-2.0)のチャットアプリです。自分のパソコンで AI をプライベートに使えます。

対応OS
Windows, macOS, Linux
最小RAM
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
OpenAI互換API
はい
ライセンス
Apache-2.0
GitHubスター
44,717

GPT4All

オープンソース

手元の文書について会話できる LocalDocs が特徴の GPT4All は、Nomic のオープンソースアプリ(MIT)です。新しいリリースは少なくなっている点を踏まえて選びましょう。

対応OS
Windows, macOS, Linux
最小RAM
8 GB
GPU
Optional: Vulkan, Apple M-series
OpenAI互換API
はい
ライセンス
MIT
GitHubスター
77,386

AnythingLLM

オープンソース

AnythingLLM は、文書との会話、エージェント、ローカルやクラウドのモデルを一か所で扱えるオープンソース(MIT)のアプリです。デスクトップ版と Docker 版があります。

対応OS
Windows, macOS, Linux
最小RAM
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
ライセンス
MIT
GitHubスター
66,618

Open WebUI

オープンソース

Open WebUI は、Ollama や OpenAI 互換の API につなぐセルフホスト型の Web 画面です。Docker か pip で導入でき、複数の利用者でローカルモデルを共有できます。

対応OS
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
OpenAI互換API
はい
ライセンス
Open WebUI License
GitHubスター
153,609

llama.cpp

オープンソース

多くのローカルアプリの土台になっている llama.cpp は、GGUF のモデルを CPU と GPU で動かすオープンソースの推論エンジンです。設定を細かく制御したい人に向いています。

対応OS
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
OpenAI互換API
はい
ライセンス
MIT
GitHubスター
129,950

KoboldCpp

オープンソース

KoboldCpp は llama.cpp をもとにした一つのファイルで動くアプリで、チャットや物語づくりの Web 画面を備えています。ローカルのモデルでロールプレイや小説を楽しみたい人向けです。

対応OS
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
OpenAI互換API
はい
ライセンス
AGPL-3.0
GitHubスター
11,908

自分のパソコンで AI を動かす

ローカル LLM アプリを使うと、言語モデルを自分のパソコンの中で動かせます。質問の内容がパソコンの外に出ないのが最大の違いで、社外秘の資料や個人的なメモを扱うときに向いています。このページでは、対応 OS、最低限のメモリ、GPU への対応、ライセンス、GitHub のスターをカードで比べられます。当サイトのカタログにあるアプリには「ダウンロード」ボタンがあり、インストーラーの署名が有効であることを確認しています。

アプリの種類

  • デスクトップアプリ:Ollama、LM Studio、Jan、GPT4All、AnythingLLM。
  • Web インターフェース:Open WebUI。
  • エンジン:llama.cpp、KoboldCpp。

アプリとモデルは別もの

アプリ自体は無料でも、モデルは別にダウンロードするもので、それぞれにライセンスと容量があります。どのモデルを動かせるかを決めるのはメモリ(または GPU のメモリ)で、大きなモデルほど多くのメモリを必要とします。GPU がなくても CPU で動きますが、そのぶん遅くなります。

期待しすぎないために

速さや答えの質は、モデルとパソコンの組み合わせで大きく変わり、このページではどちらも約束していません。まずは小さなモデルで試し、足りなければ大きなモデルやクラウドの API を検討しましょう。モデルを選ぶ前に、リーダーボードで「オープンウェイト」の印が付いたモデルを探しておくと効率的です。

始め方の例

画面の操作で始めたいなら LM Studio や Jan、コマンドや API で使いたいなら Ollama、手元の文書と一緒に使いたいなら GPT4All や AnythingLLM が入り口になります。インストールしたら小さなモデルを一つ取得し、普段の質問をいくつか試して、速さと答えの感触を確かめましょう。