Aplikacije, ki poganjajo modele na vašem računalniku: podprti sistemi, potreben pomnilnik, podpora za GPU in prenos iz našega kataloga.
Posodobljeno
Ollama
Odprta koda
Ollama zažene modele z odprtimi utežmi lokalno iz ukazne vrstice ali namizne aplikacije in odpre lokalni HTTP API, združljiv tudi z OpenAI. Odprta koda z licenco MIT, namenjena razvijalcem, ki želijo lokalne modele za svojimi programi.
Sistemi
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
API, združljiv z OpenAI
da
Licenca
MIT
Zvezdice na GitHubu
181.947
LM Studio
Brezplačno
Namizna aplikacija za iskanje, prenos in klepet z lokalnimi modeli, z lokalnim strežnikom API. LM Studio je brezplačen, a ni odprta koda, in je primeren za vse, ki se želijo izogniti ukazni vrstici.
Sistemi
Windows, macOS, Linux
Najm. RAM
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
API, združljiv z OpenAI
da
Licenca
Proprietary
Jan
Odprta koda
Jan je odprtokodni klepetalnik z licenco Apache, ki modele poganja brez povezave, po želji pa se poveže tudi z API v oblaku. Deluje kot zasebna aplikacija v slogu ChatGPT na vašem računalniku, z lokalnim strežnikom, združljivim z OpenAI.
Sistemi
Windows, macOS, Linux
Najm. RAM
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
API, združljiv z OpenAI
da
Licenca
Apache-2.0
Zvezdice na GitHubu
44.717
GPT4All
Odprta koda
Odprtokodna namizna aplikacija podjetja Nomic z licenco MIT za lokalne modele na procesorju ali grafični kartici, s klepetom nad lastnimi dokumenti (LocalDocs). Novih izdaj GPT4All že dolgo skoraj ni, zato je primeren predvsem za preprost lokalni klepet z datotekami.
Sistemi
Windows, macOS, Linux
Najm. RAM
8 GB
GPU
Optional: Vulkan, Apple M-series
API, združljiv z OpenAI
da
Licenca
MIT
Zvezdice na GitHubu
77.386
AnythingLLM
Odprta koda
AnythingLLM je odprtokodna aplikacija vse v enem z licenco MIT, na namizju ali v Dockerju: klepet z dokumenti, agenti ter lokalni ali oblačni modeli. Zasebni delovni prostor za dokumente in agente.
Sistemi
Windows, macOS, Linux
Najm. RAM
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
Licenca
MIT
Zvezdice na GitHubu
66.618
Open WebUI
Odprta koda
Spletni vmesnik, ki ga gostite sami, za Ollamo in API-je, združljive z OpenAI, nameščen z Dockerjem ali pipom. Open WebUI podpira več uporabnikov, zato je primeren za skupen klepet z lokalnimi modeli na strežniku.
Sistemi
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
API, združljiv z OpenAI
da
Licenca
Open WebUI License
Zvezdice na GitHubu
153.609
llama.cpp
Odprta koda
llama.cpp je odprtokodni pogon v C in C++ za modele GGUF na procesorju in grafični kartici, z orodji za ukazno vrstico in strežnikom API, združljivim z OpenAI. Na njem temelji veliko lokalnih aplikacij, sam pa daje poln nadzor.
Sistemi
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
API, združljiv z OpenAI
da
Licenca
MIT
Zvezdice na GitHubu
129.950
KoboldCpp
Odprta koda
Aplikacija v eni datoteki, zgrajena na llama.cpp, s spletnim vmesnikom za klepet in pisanje zgodb ter API-jema KoboldAI in OpenAI. KoboldCpp izberejo ljubitelji igranja vlog in leposlovja z lokalnimi modeli.
Sistemi
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
API, združljiv z OpenAI
da
Licenca
AGPL-3.0
Zvezdice na GitHubu
11.908
Lokalne aplikacije LLM zaženejo jezikovni model na vašem računalniku. Vprašanja in dokumenti tako ostanejo pri vas, za uporabo ne potrebujete računa v oblaku, po prenosu modela pa večina aplikacij deluje tudi brez interneta.
Kaj je na strani
Kartice prikazujejo podprte sisteme, »Najm. RAM«, podporo za grafične kartice, licenco in število zvezdic na GitHubu. Kadar je aplikacija v našem katalogu, ima kartica gumb za prenos, namestitveni program pa smo preverili, ali ima veljaven podpis. Zbrali smo tri vrste orodij:
namizne aplikacije – Ollama, LM Studio, Jan, GPT4All in AnythingLLM;
spletni vmesnik – Open WebUI, ki ga odprete v brskalniku;
pogoni – llama.cpp in KoboldCpp, ki jih uporabljajo naprednejši uporabniki in druge aplikacije.
Aplikacija je brezplačna, model je ločen
Aplikacija je samo okvir. Model prenesete posebej; vsak ima svojo licenco in svojo velikost na disku. Preden model uporabite v podjetju ali v izdelku, preberite njegovo licenco, saj se pogoji med modeli razlikujejo.
Kaj odloča o tem, kateri model bo tekel
Ključni sta pomnilnik RAM in pomnilnik grafične kartice. Večji model potrebuje več pomnilnika. Brez grafične kartice modeli tečejo na procesorju, a počasneje. Hitrosti in kakovosti stran ne obljublja, ker sta odvisni od modela in strojne opreme. Dober začetek je manjši model, ki pusti dovolj prostega pomnilnika za druge programe, nato pa postopoma preizkušate večje.
Kako izbrati aplikacijo
Za začetnike so primerne aplikacije z grafičnim vmesnikom, ki same predlagajo modele. Kdor želi lokalni strežnik za druge programe, bo raje izbral orodje z API, združljivim z OpenAI. Za klepet z lastnimi dokumenti so namenjene aplikacije s funkcijami za datoteke. Za zagon modela na strežniku si oglejte VPS za UI, za primerjavo z oblačnimi asistenti pa aplikacije UI.
Viri: dokumentacija proizvajalcev in repozitoriji na GitHubu (povezava je na vsaki kartici); zvezdice se osvežujejo tedensko.