Приложения, которые запускают модели на вашем компьютере: поддерживаемые системы, требования к памяти, поддержка GPU и скачивание из нашего каталога.
Обновлено
Ollama
Открытый код
Запускает открытые модели на вашем компьютере из командной строки или небольшого приложения и отдаёт их через локальный API в формате OpenAI. Открытый код, лицензия MIT.
Системы
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
API, совместимый с OpenAI
да
Лицензия
MIT
Звёзды на GitHub
181 947
LM Studio
Бесплатно
Настольное приложение, чтобы находить, скачивать локальные модели и общаться с ними, со встроенным API-сервером для разработчиков. Бесплатно, но код закрыт.
Системы
Windows, macOS, Linux
Мин. RAM
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
API, совместимый с OpenAI
да
Лицензия
Proprietary
Jan
Открытый код
Открытый чат в стиле ChatGPT: модели работают офлайн, а в том же окне можно переключиться на облачный API. Заодно поднимает локальный сервер, совместимый с OpenAI.
Системы
Windows, macOS, Linux
Мин. RAM
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
API, совместимый с OpenAI
да
Лицензия
Apache-2.0
Звёзды на GitHub
44 717
GPT4All
Открытый код
Открытое приложение Nomic для локальных моделей на процессоре или видеокарте; известно функцией LocalDocs для вопросов по своим файлам. С февраля 2025 года новые версии почти не выходят.
Системы
Windows, macOS, Linux
Мин. RAM
8 GB
GPU
Optional: Vulkan, Apple M-series
API, совместимый с OpenAI
да
Лицензия
MIT
Звёзды на GitHub
77 386
AnythingLLM
Открытый код
Открытое рабочее пространство «всё в одном» — на компьютере или в Docker: документы, агенты, локальные и облачные модели. Подходит для приватной работы со своими файлами.
Системы
Windows, macOS, Linux
Мин. RAM
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
Лицензия
MIT
Звёзды на GitHub
66 618
Open WebUI
Открытый код
Веб-интерфейс для Ollama и API в формате OpenAI, который ставят на свой сервер через Docker или pip; несколько человек могут пользоваться им из браузера.
Системы
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
API, совместимый с OpenAI
да
Лицензия
Open WebUI License
Звёзды на GitHub
153 609
llama.cpp
Открытый код
Открытый движок на C/C++ для моделей GGUF на процессоре и видеокарте, с утилитами командной строки и сервером в формате OpenAI. На нём построено множество локальных приложений.
Системы
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
API, совместимый с OpenAI
да
Лицензия
MIT
Звёзды на GitHub
129 950
KoboldCpp
Открытый код
Программа в одном файле на основе llama.cpp с веб-интерфейсом для чата и сочинения историй, API в форматах KoboldAI и OpenAI; её любят за художественные тексты и ролевые игры.
Системы
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
API, совместимый с OpenAI
да
Лицензия
AGPL-3.0
Звёзды на GitHub
11 908
Модели на своём компьютере
Локальная программа скачивает модель с открытыми весами и запускает её на вашем ПК или ноутбуке. Запросы не покидают компьютер, счёта за токены нет, а после загрузки модели интернет не нужен. Здесь собраны такие программы: настольные приложения Ollama, LM Studio, Jan, GPT4All и AnythingLLM, веб-интерфейс для домашнего сервера Open WebUI и движки для тех, кому нужен полный контроль, — llama.cpp и KoboldCpp.
Что указано на карточках
поддерживаемые системы, минимальный объём памяти и поддержка видеокарт;
лицензия и, у проектов с открытым кодом, звёзды GitHub с еженедельным обновлением;
кнопка «Скачать», если программа есть в нашем каталоге: у этих установщиков проверена цифровая подпись.
Как выбрать программу
Нужно просто окно чата? У LM Studio и Jan встроен каталог моделей.
Нужен локальный API для своих инструментов? Его дают Ollama и llama.cpp, к ним подключаются многие другие приложения.
Хотите задавать вопросы по своим документам? На этом построены AnythingLLM и GPT4All.
Одна машина на несколько человек? Open WebUI работает в браузере поверх Ollama.
Всё решает память
Программа бесплатна, а модель — отдельная загрузка со своим размером и лицензией. Модель должна поместиться в оперативную память или, если работать будет видеокарта, в её видеопамять: чем крупнее модель, тем мощнее нужен компьютер. Без подходящей видеокарты модели работают на процессоре — это возможно, но медленнее. На карточках — данные производителей; конкретной скорости и качества ответов мы не обещаем, потому что они зависят от модели и железа.
Когда локального мало
Самые сильные модели не публикуются с открытыми весами и работают только в облаке. Если нужны они, посмотрите API-провайдеров или ИИ-приложения. Некоторые локальные программы, например Jan и AnythingLLM, умеют подключать облачный API рядом с локальными моделями.