App che eseguono i modelli sul tuo computer: sistemi supportati, memoria richiesta, supporto GPU e download dal nostro catalogo.
Aggiornato
Ollama
Open source
Ollama esegue modelli con pesi aperti sul proprio computer, da riga di comando o con l'app desktop, ed espone un'API HTTP locale compatibile con OpenAI. Open source con licenza MIT, piace agli sviluppatori che vogliono modelli locali dietro un'API.
Sistemi
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
API compatibile con OpenAI
sì
Licenza
MIT
Stelle su GitHub
181.947
LM Studio
Gratis
App desktop per cercare, scaricare e usare in chat modelli locali, LM Studio include anche un server API locale. Gratuita ma non open source, è pensata per chi vuole i modelli locali senza riga di comando.
Sistemi
Windows, macOS, Linux
RAM min.
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
API compatibile con OpenAI
sì
Licenza
Proprietary
Jan
Open source
Chat in stile ChatGPT che gira sul proprio computer: Jan è un'app desktop open source che esegue i modelli offline, può collegarsi alle API cloud e offre un server locale compatibile con OpenAI.
Sistemi
Windows, macOS, Linux
RAM min.
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
API compatibile con OpenAI
sì
Licenza
Apache-2.0
Stelle su GitHub
44.717
GPT4All
Open source
App desktop open source di Nomic, GPT4All usa modelli locali su CPU o GPU e permette di chattare con i propri documenti tramite LocalDocs. Le nuove versioni sono diventate rare, ma resta utile per interrogare i propri file.
Sistemi
Windows, macOS, Linux
RAM min.
8 GB
GPU
Optional: Vulkan, Apple M-series
API compatibile con OpenAI
sì
Licenza
MIT
Stelle su GitHub
77.386
AnythingLLM
Open source
Tutto in un'unica app: AnythingLLM, open source e disponibile come app desktop o in Docker, unisce chat con i documenti, agenti e modelli locali o cloud in uno spazio di lavoro privato.
Sistemi
Windows, macOS, Linux
RAM min.
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
Licenza
MIT
Stelle su GitHub
66.618
Open WebUI
Open source
Interfaccia web self-hosted per Ollama e per le API compatibili con OpenAI, Open WebUI si installa con Docker o pip e supporta più utenti. Adatta a una chat condivisa su un server con modelli locali.
Sistemi
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
API compatibile con OpenAI
sì
Licenza
Open WebUI License
Stelle su GitHub
153.609
llama.cpp
Open source
Motore di inferenza open source in C e C++ per modelli GGUF su CPU e GPU, llama.cpp offre strumenti da riga di comando e un server con API compatibile con OpenAI, e fa da base a molte app locali.
Sistemi
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
API compatibile con OpenAI
sì
Licenza
MIT
Stelle su GitHub
129.950
KoboldCpp
Open source
Costruita su llama.cpp, KoboldCpp è un'app in un unico file con interfaccia web per chat e scrittura di storie, più API compatibili con KoboldAI e OpenAI. Molto usata per gioco di ruolo e narrativa con modelli locali.
Sistemi
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
API compatibile con OpenAI
sì
Licenza
AGPL-3.0
Stelle su GitHub
11.908
Cosa significa far girare un modello in locale?
Vuol dire che il modello linguistico lavora sul tuo computer, non sui server di un'azienda. I prompt restano sulla macchina, puoi lavorare anche senza internet e non paghi a consumo. Questa pagina raccoglie le app che rendono possibile tutto questo: le app desktop Ollama, LM Studio, Jan, GPT4All e AnythingLLM, un'interfaccia web come Open WebUI e i motori llama.cpp e KoboldCpp, su cui si appoggiano molti altri programmi.
Cosa trovo su ogni scheda?
i sistemi supportati, la RAM minima indicata dallo sviluppatore e il supporto alla GPU;
la licenza, per distinguere i progetti open source da quelli gratuiti ma proprietari;
le «Stelle su GitHub», aggiornate ogni settimana;
il pulsante «Scarica» quando l'app è nel nostro catalogo, con l'installer verificato per la firma digitale.
L'app è gratuita: e il modello?
L'app e il modello sono due cose diverse. L'app è il motore e l'interfaccia; il modello si scarica a parte, ha una propria licenza e un proprio peso su disco. Prima di usarlo per lavoro, leggi le condizioni di quella licenza: alcune limitano l'uso commerciale.
Il mio computer basta?
Decide la memoria. Ogni modello va caricato in RAM, o nella memoria della scheda video: più il modello è grande, più memoria serve. Senza GPU i modelli girano sul processore, solo più lentamente. Un buon approccio è partire da un modello piccolo, verificare come si comporta il PC e salire gradualmente. La pagina non promette velocità o qualità: dipendono dal modello scelto e dall'hardware che hai.
Da dove arrivano le informazioni?
Dalla documentazione degli sviluppatori e dai loro repository, con il link su ogni scheda, e da GitHub per le stelle. Se ti interessa sapere quali modelli aperti hanno buoni risultati, filtra la classifica di testo con «Pesi aperti».