Ollama
オープンソースOllama は、オープンウェイトのモデルをコマンドラインやデスクトップアプリで手元のパソコンで動かすオープンソースのソフト(MIT)です。OpenAI 互換のローカル API を備えています。
- 対応OS
- Windows, macOS, Linux
- GPU
- Optional: CUDA, ROCm, Vulkan, Metal
- OpenAI互換API
- はい
- ライセンス
- MIT
- GitHubスター
- 181,947
自分のパソコンでモデルを動かすアプリ:対応OS、必要メモリ、GPU対応、当サイトのカタログからのダウンロード。
更新日
Ollama は、オープンウェイトのモデルをコマンドラインやデスクトップアプリで手元のパソコンで動かすオープンソースのソフト(MIT)です。OpenAI 互換のローカル API を備えています。
コマンドを使わずにローカルのモデルを探して試したい人には LM Studio が合っています。チャット画面とローカルの API サーバーがあり、無料ですがオープンソースではありません。
Jan は、モデルをオフラインで動かし、必要ならクラウドの API にもつなげるオープンソース(Apache-2.0)のチャットアプリです。自分のパソコンで AI をプライベートに使えます。
手元の文書について会話できる LocalDocs が特徴の GPT4All は、Nomic のオープンソースアプリ(MIT)です。新しいリリースは少なくなっている点を踏まえて選びましょう。
AnythingLLM は、文書との会話、エージェント、ローカルやクラウドのモデルを一か所で扱えるオープンソース(MIT)のアプリです。デスクトップ版と Docker 版があります。
Open WebUI は、Ollama や OpenAI 互換の API につなぐセルフホスト型の Web 画面です。Docker か pip で導入でき、複数の利用者でローカルモデルを共有できます。
多くのローカルアプリの土台になっている llama.cpp は、GGUF のモデルを CPU と GPU で動かすオープンソースの推論エンジンです。設定を細かく制御したい人に向いています。
KoboldCpp は llama.cpp をもとにした一つのファイルで動くアプリで、チャットや物語づくりの Web 画面を備えています。ローカルのモデルでロールプレイや小説を楽しみたい人向けです。
ローカル LLM アプリを使うと、言語モデルを自分のパソコンの中で動かせます。質問の内容がパソコンの外に出ないのが最大の違いで、社外秘の資料や個人的なメモを扱うときに向いています。このページでは、対応 OS、最低限のメモリ、GPU への対応、ライセンス、GitHub のスターをカードで比べられます。当サイトのカタログにあるアプリには「ダウンロード」ボタンがあり、インストーラーの署名が有効であることを確認しています。
アプリ自体は無料でも、モデルは別にダウンロードするもので、それぞれにライセンスと容量があります。どのモデルを動かせるかを決めるのはメモリ(または GPU のメモリ)で、大きなモデルほど多くのメモリを必要とします。GPU がなくても CPU で動きますが、そのぶん遅くなります。
速さや答えの質は、モデルとパソコンの組み合わせで大きく変わり、このページではどちらも約束していません。まずは小さなモデルで試し、足りなければ大きなモデルやクラウドの API を検討しましょう。モデルを選ぶ前に、リーダーボードで「オープンウェイト」の印が付いたモデルを探しておくと効率的です。
画面の操作で始めたいなら LM Studio や Jan、コマンドや API で使いたいなら Ollama、手元の文書と一緒に使いたいなら GPT4All や AnythingLLM が入り口になります。インストールしたら小さなモデルを一つ取得し、普段の質問をいくつか試して、速さと答えの感触を確かめましょう。