Apps die modellen op je eigen computer draaien: ondersteunde systemen, geheugenbehoefte, GPU-ondersteuning en een download uit onze catalogus.
Bijgewerkt
Ollama
Open source
Opensourceprogramma met MIT-licentie dat open-weight-modellen lokaal draait via de opdrachtregel en een desktop-app. Ollama biedt ook een lokale HTTP-API, compatibel met OpenAI, voor ontwikkelaars.
Systemen
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
OpenAI-compatibele API
ja
Licentie
MIT
GitHub-sterren
181.947
LM Studio
Gratis
Desktop-app om lokale modellen te zoeken, te downloaden en ermee te chatten, met een lokale API-server. LM Studio is gratis maar geen opensource, en werkt zonder opdrachtregel.
Systemen
Windows, macOS, Linux
Min. RAM
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
OpenAI-compatibele API
ja
Licentie
Proprietary
Jan
Open source
Opensource chat-app onder de Apache-licentie die modellen offline draait en ook met cloud-API's kan verbinden. Jan is een privé alternatief in ChatGPT-stijl op je eigen computer.
Systemen
Windows, macOS, Linux
Min. RAM
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
OpenAI-compatibele API
ja
Licentie
Apache-2.0
GitHub-sterren
44.717
GPT4All
Open source
De opensource desktop-app van Nomic voor lokale modellen op processor of videokaart, met LocalDocs om over je eigen bestanden te chatten. Nieuwe versies van GPT4All verschijnen de laatste tijd zelden.
Systemen
Windows, macOS, Linux
Min. RAM
8 GB
GPU
Optional: Vulkan, Apple M-series
OpenAI-compatibele API
ja
Licentie
MIT
GitHub-sterren
77.386
AnythingLLM
Open source
Alles-in-één-app onder MIT-licentie, als desktop-app of in Docker: chatten met documenten, agents en lokale of cloudmodellen. AnythingLLM dient als privéwerkruimte voor je eigen bestanden.
Systemen
Windows, macOS, Linux
Min. RAM
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
Licentie
MIT
GitHub-sterren
66.618
Open WebUI
Open source
Zelf gehoste webinterface voor Ollama en API's die compatibel zijn met OpenAI, te installeren met Docker of pip. Open WebUI ondersteunt meerdere gebruikers en past bij een gedeelde chat op een server.
Systemen
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
OpenAI-compatibele API
ja
Licentie
Open WebUI License
GitHub-sterren
153.609
llama.cpp
Open source
Opensource inferentiemotor in C en C++ voor GGUF-modellen op processor en videokaart, met tools voor de opdrachtregel en een server met OpenAI-API. Veel lokale apps zijn op llama.cpp gebouwd.
Systemen
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
OpenAI-compatibele API
ja
Licentie
MIT
GitHub-sterren
129.950
KoboldCpp
Open source
App in één bestand, gebouwd op llama.cpp, met een webinterface voor chat en verhalen schrijven. KoboldCpp biedt API's in KoboldAI- en OpenAI-stijl en richt zich op rollenspel en fictie.
Systemen
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
OpenAI-compatibele API
ja
Licentie
AGPL-3.0
GitHub-sterren
11.908
AI op je eigen computer
De apps op deze pagina draaien taalmodellen lokaal, op je eigen pc of laptop. Het grote voordeel: je prompts en documenten blijven op de computer en gaan niet naar een clouddienst. Je vindt hier drie soorten software. Desktop-apps met een chatvenster, zoals Ollama, LM Studio, Jan, GPT4All en AnythingLLM. Een webinterface, Open WebUI, die je in de browser gebruikt bovenop een lokale motor. En motoren zoals llama.cpp en KoboldCpp, die het rekenwerk doen en waar andere programma's op bouwen.
Wat staat er op een kaart?
de ondersteunde systemen en het minimale werkgeheugen (“Min. RAM”);
of een videokaart wordt ondersteund, en welke;
de licentie en het aantal GitHub-sterren, wekelijks bijgewerkt;
een knop “Downloaden” als de app in onze catalogus staat; het installatiebestand is dan gecontroleerd op een geldige handtekening.
Zo kies je een app en een model
Kijk eerst hoeveel werkgeheugen je pc heeft, en of er een videokaart met eigen geheugen in zit.
Kies een app die bij je systeem en je manier van werken past: een chatvenster, een opdrachtregel of een webinterface.
Download daarna een model. Dat is een aparte download met een eigen licentie en grootte; de app zelf bevat geen model.
Begin klein en stap pas over op een groter model als je pc het bijhoudt.
Waarom geheugen zo belangrijk is
Het werkgeheugen, of het geheugen van de videokaart, bepaalt welke modellen draaien. Een groter model heeft meer geheugen nodig. Zonder videokaart draaien modellen op de processor; dat werkt, maar trager. De apps zelf zijn gratis, maar het model en je hardware bepalen hoe het resultaat uitvalt. Snelheid of kwaliteit belooft deze pagina daarom nergens: die hangen af van de combinatie van model en hardware. Wil je weten hoe een model zich verhoudt tot andere, zoek het dan op in de ranglijsten, bijvoorbeeld tekst, en filter op “Open gewichten”.
Bronnen
De gegevens komen uit de documentatie van de makers en hun GitHub-repository's; bij elke kaart staat een link. De sterren halen we wekelijks van GitHub. Wil je een model niet op je eigen pc maar op een server draaien, kijk dan bij VPS voor AI.