Hopp til innholdet
fedi.software

Lokale LLM-apper

Apper som kjører modeller på din egen datamaskin: støttede systemer, minnebehov, GPU-støtte og nedlasting fra katalogen vår.

Oppdatert

Ollama

Åpen kildekode

Med Ollama kjører du modeller med åpne vekter lokalt fra kommandolinjen og en skrivebordsapp, med et lokalt HTTP-API som også er OpenAI-kompatibelt. Åpen kildekode under MIT, for utviklere som vil ha lokale modeller bak et API.

Systemer
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
OpenAI-kompatibelt API
ja
Lisens
MIT
GitHub-stjerner
181 947

LM Studio

Gratis

LM Studio er en skrivebordsapp for å finne, laste ned og chatte med lokale modeller, med lokal API-server. Gratis, men ikke åpen kildekode – for deg som vil slippe kommandolinjen.

Systemer
Windows, macOS, Linux
Min. RAM
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
OpenAI-kompatibelt API
ja
Lisens
Proprietary

Jan

Åpen kildekode

Jan er en chatteapp med åpen kildekode under Apache-2.0 som kjører modeller uten nett og også kan kobles til sky-API-er. En privat app i ChatGPT-stil på din egen PC.

Systemer
Windows, macOS, Linux
Min. RAM
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
OpenAI-kompatibelt API
ja
Lisens
Apache-2.0
GitHub-stjerner
44 717

GPT4All

Åpen kildekode

GPT4All er Nomics skrivebordsapp med åpen kildekode for lokale modeller på prosessor eller grafikkort, der LocalDocs lar deg chatte om egne filer. Nye versjoner kommer nå sjelden.

Systemer
Windows, macOS, Linux
Min. RAM
8 GB
GPU
Optional: Vulkan, Apple M-series
OpenAI-kompatibelt API
ja
Lisens
MIT
GitHub-stjerner
77 386

AnythingLLM

Åpen kildekode

AnythingLLM er en alt-i-ett-app med åpen kildekode under MIT, som skrivebordsapp eller i Docker: chat med dokumenter, agenter og lokale eller skybaserte modeller i et privat arbeidsområde.

Systemer
Windows, macOS, Linux
Min. RAM
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
Lisens
MIT
GitHub-stjerner
66 618

Open WebUI

Åpen kildekode

Open WebUI er et nettgrensesnitt du drifter selv for Ollama og OpenAI-kompatible API-er, installert med Docker eller pip og med støtte for flere brukere. Et felles chattevindu for lokale modeller på en server.

Systemer
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
OpenAI-kompatibelt API
ja
Lisens
Open WebUI License
GitHub-stjerner
153 609

llama.cpp

Åpen kildekode

llama.cpp er en inferensmotor med åpen kildekode i C/C++ for GGUF-modeller på prosessor og grafikkort, med kommandolinjeverktøy og en OpenAI-kompatibel server. Mange lokale apper bygger på den.

Systemer
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
OpenAI-kompatibelt API
ja
Lisens
MIT
GitHub-stjerner
129 950

KoboldCpp

Åpen kildekode

KoboldCpp er en app i én fil, bygget på llama.cpp, med nettgrensesnitt for chat og historiefortelling og API-er kompatible med KoboldAI og OpenAI. For rollespill og fiksjon med lokale modeller.

Systemer
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
OpenAI-kompatibelt API
ja
Lisens
AGPL-3.0
GitHub-stjerner
11 908

Denne siden samler apper som kjører språkmodeller på din egen PC. Lokalt betyr at spørsmålene dine blir på maskinen og ikke sendes til en skytjeneste. Det passer når du jobber med følsomme tekster, vil eksperimentere uten abonnement eller trenger å kunne jobbe uten nett.

Hva kortene viser

  • støttede systemer, minste mengde RAM og støtte for grafikkort;
  • lisens og antall stjerner på GitHub, oppdatert ukentlig;
  • en knapp for nedlasting når appen finnes i vår katalog – installasjonsfilen er kontrollert for gyldig signatur.

Hvilke typer apper finnes?

Skrivebordsapper som Ollama, LM Studio, Jan, GPT4All og AnythingLLM er det enkleste stedet å begynne. Nettgrensesnittet Open WebUI passer når flere skal dele en server. Motorer som llama.cpp og KoboldCpp gir full kontroll for dem som vil justere alt selv.

Appen og modellen er to ulike ting

Appen er gratis, men modellen lastes ned separat, med egen lisens og egen størrelse. Det er mengden arbeidsminne, eller minnet på grafikkortet, som avgjør hvilke modeller du kan kjøre: en større modell krever mer minne. Uten grafikkort kjører modellene på prosessoren, noe som virker, men går tregere. Begynn derfor med en liten modell og gå opp hvis PC-en klarer det.

Forventninger

Hastighet og kvalitet avhenger av modellen og maskinvaren. Siden lover ingen av delene, og samme modell kan føles rask på en spill-PC og treg på en tynn bærbar. Opplysningene på kortene kommer fra produsentenes dokumentasjon og GitHub-repoer, med lenke på hvert kort.

Når skyen er bedre

Trenger du modellene som ligger helt i toppen på topplistene, og mangler kraftig maskinvare, er en skytjeneste eller en AI-assistent ofte mer praktisk. Mange kombinerer: lokalt for følsomt materiale, skyen for tunge oppgaver.