Salt la conținut
fedi.software

Aplicații LLM locale

Aplicații care rulează modele pe propriul computer: sisteme acceptate, memorie necesară, suport GPU și descărcare din catalogul nostru.

Actualizat

Ollama

Open source

Ollama rulează local modele cu ponderi deschise, din linia de comandă și dintr-o aplicație desktop, și oferă un API HTTP local, compatibil și OpenAI. Open source (MIT), pentru programatorii care vor modele locale în spatele unui API.

Sisteme
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
API compatibil OpenAI
da
Licență
MIT
Stele pe GitHub
181.947

LM Studio

Gratuit

Aplicație desktop gratuită, dar nu open source, LM Studio vă ajută să găsiți, să descărcați și să discutați cu modele locale, cu server API local. Pentru cine vrea modele locale fără linia de comandă.

Sisteme
Windows, macOS, Linux
RAM min.
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
API compatibil OpenAI
da
Licență
Proprietary

Jan

Open source

Jan este o aplicație de chat open source (Apache-2.0), în stilul ChatGPT, care rulează modele offline și se poate conecta și la API-uri din cloud. Un asistent privat pe propriul calculator, cu server local compatibil OpenAI.

Sisteme
Windows, macOS, Linux
RAM min.
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
API compatibil OpenAI
da
Licență
Apache-2.0
Stele pe GitHub
44.717

GPT4All

Open source

Aplicația desktop open source (MIT) a Nomic, GPT4All, rulează modele locale pe procesor sau pe placa video și permite discuții cu propriile documente prin LocalDocs. Versiunile noi apar rar în ultima perioadă.

Sisteme
Windows, macOS, Linux
RAM min.
8 GB
GPU
Optional: Vulkan, Apple M-series
API compatibil OpenAI
da
Licență
MIT
Stele pe GitHub
77.386

AnythingLLM

Open source

AnythingLLM este o aplicație open source (MIT) totul-în-unu, pentru desktop sau Docker: chat cu documente, agenți și modele locale sau din cloud. Un spațiu de lucru privat pentru documente și agenți.

Sisteme
Windows, macOS, Linux
RAM min.
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
Licență
MIT
Stele pe GitHub
66.618

Open WebUI

Open source

Interfață web găzduită de dumneavoastră, Open WebUI se conectează la Ollama și la API-uri compatibile OpenAI și se instalează cu Docker sau pip. Suportă mai mulți utilizatori, deci servește drept chat comun pentru modele locale pe un server.

Sisteme
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
API compatibil OpenAI
da
Licență
Open WebUI License
Stele pe GitHub
153.609

llama.cpp

Open source

llama.cpp este motorul open source de inferență în C/C++ pentru modele GGUF, pe procesor și pe placa video, cu unelte de linie de comandă și server compatibil OpenAI. Multe aplicații locale sunt construite pe el; oferă control complet asupra setărilor.

Sisteme
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
API compatibil OpenAI
da
Licență
MIT
Stele pe GitHub
129.950

KoboldCpp

Open source

KoboldCpp este o aplicație dintr-un singur fișier, construită pe llama.cpp, cu interfață web pentru chat și scriere de povești și cu API-uri compatibile KoboldAI și OpenAI. Preferată pentru jocuri de rol și ficțiune cu modele locale.

Sisteme
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
API compatibil OpenAI
da
Licență
AGPL-3.0
Stele pe GitHub
11.908

Modele pe propriul calculator

Aplicațiile de pe această pagină rulează modele de limbaj direct pe calculator, nu în cloud. Local înseamnă că întrebările și documentele rămân pe calculator și nu ajung la un furnizor. Aplicația este gratuită, iar modelul se descarcă separat, cu licența și mărimea lui.

Pagina adună trei tipuri de instrumente: aplicații desktop (Ollama, LM Studio, Jan, GPT4All, AnythingLLM), o interfață web (Open WebUI) și motoare pe care se construiesc alte aplicații (llama.cpp, KoboldCpp).

Ce arată un card

  • „Sisteme” — pe ce sisteme de operare rulează;
  • „RAM min.” — memoria minimă indicată de producător;
  • „GPU” — ce plăci video sunt suportate;
  • „Licență” — open source sau proprietară;
  • „Stele pe GitHub” — actualizate săptămânal;
  • un buton de descărcare, când aplicația este în catalogul nostru; instalatorul a fost verificat pentru o semnătură validă.

Cât hardware vă trebuie

Memoria RAM, sau memoria plăcii video, decide ce modele puteți rula. Un model mai mare are nevoie de mai multă memorie. Fără placă video, modelele rulează pe procesor, doar mai încet. Nu există o regulă universală de viteză: ea depinde de model, de cantitatea de memorie și de hardware. Pagina nu promite nici viteză, nici calitate; ambele se verifică pe propriul calculator.

Cum alegeți aplicația

Dacă vreți o fereastră de chat și un catalog de modele, alegeți o aplicație desktop precum LM Studio sau Jan. Dacă aveți nevoie de un API local pentru propriile scripturi, Ollama este gândit pentru asta. Pentru discuții cu propriile documente, GPT4All și AnythingLLM au funcții dedicate. Dacă vreți să oferiți acces mai multor persoane din rețea, o interfață web ca Open WebUI se instalează pe un server. Descrierile detaliate sunt pe paginile programelor din catalog.

Surse

Datele vin din documentația producătorilor și din depozitele GitHub, cu link pe fiecare card. Pentru rularea unui model pe un server închiriat, vedeți VPS pentru IA.