Applications qui exécutent des modèles sur votre propre ordinateur : systèmes pris en charge, mémoire requise, prise en charge du GPU et téléchargement depuis notre catalogue.
Mis à jour
Ollama
Open source
Ollama fait tourner des modèles ouverts en local, en ligne de commande ou via une application de bureau, et expose une API HTTP compatible OpenAI. Outil open source sous licence MIT, destiné aux développeurs.
Systèmes
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
API compatible OpenAI
oui
Licence
MIT
Étoiles GitHub
181 947
LM Studio
Gratuit
Application de bureau pour trouver, télécharger et utiliser des modèles locaux, avec un serveur d'API intégré. LM Studio est gratuit mais n'est pas open source, et vise ceux qui évitent la ligne de commande.
Systèmes
Windows, macOS, Linux
RAM min.
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
API compatible OpenAI
oui
Licence
Proprietary
Jan
Open source
Jan est une application de discussion open source, dans l'esprit de ChatGPT, qui fait tourner les modèles hors ligne ou se connecte à des API cloud. Un assistant privé sur votre propre ordinateur.
Systèmes
Windows, macOS, Linux
RAM min.
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
API compatible OpenAI
oui
Licence
Apache-2.0
Étoiles GitHub
44 717
GPT4All
Open source
Application de bureau open source de Nomic pour les modèles locaux sur processeur ou carte graphique, avec LocalDocs pour discuter de vos propres fichiers. Les nouvelles versions se font rares depuis un moment.
Systèmes
Windows, macOS, Linux
RAM min.
8 GB
GPU
Optional: Vulkan, Apple M-series
API compatible OpenAI
oui
Licence
MIT
Étoiles GitHub
77 386
AnythingLLM
Open source
Tout-en-un open source, en application de bureau ou sous Docker : discussion avec vos documents, agents et modèles locaux ou cloud. AnythingLLM offre un espace de travail privé pour documents et agents.
Systèmes
Windows, macOS, Linux
RAM min.
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
Licence
MIT
Étoiles GitHub
66 618
Open WebUI
Open source
Interface web auto-hébergée pour Ollama et les API compatibles OpenAI, installée avec Docker ou pip et utilisable par plusieurs personnes. Open WebUI sert d'interface de discussion partagée sur un serveur.
Systèmes
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
API compatible OpenAI
oui
Licence
Open WebUI License
Étoiles GitHub
153 609
llama.cpp
Open source
Moteur d'inférence open source en C/C++ pour les modèles GGUF sur processeur et GPU, avec des outils en ligne de commande et un serveur compatible OpenAI. De nombreuses applications locales reposent sur llama.cpp.
Systèmes
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
API compatible OpenAI
oui
Licence
MIT
Étoiles GitHub
129 950
KoboldCpp
Open source
KoboldCpp tient en un seul fichier, repose sur llama.cpp et ajoute une interface web pour la discussion et l'écriture d'histoires. Un choix apprécié pour le jeu de rôle et la fiction avec des modèles locaux.
Systèmes
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
API compatible OpenAI
oui
Licence
AGPL-3.0
Étoiles GitHub
11 908
L'IA sur votre propre ordinateur
Les applications réunies ici font tourner des modèles de langage directement sur le PC, sans passer par un service en ligne. Principal intérêt : vos questions et vos documents restent sur la machine. On y trouve des applications de bureau (Ollama, LM Studio, Jan, GPT4All, AnythingLLM), une interface web à installer soi-même (Open WebUI) et des moteurs d'exécution (llama.cpp, KoboldCpp) sur lesquels reposent d'autres outils.
Ce que montre chaque carte
les systèmes pris en charge : Windows, macOS, Linux ;
la mémoire vive minimale indiquée par l'éditeur et la prise en charge des cartes graphiques ;
la licence, pour distinguer les logiciels open source des applications gratuites mais propriétaires ;
le nombre d'étoiles GitHub, actualisé chaque semaine ;
un bouton de téléchargement quand l'application figure dans notre catalogue, avec un installeur dont la signature a été vérifiée.
L'application est gratuite, le modèle est à part
Installer Ollama ou LM Studio ne suffit pas : il faut ensuite télécharger un modèle, qui est un fichier distinct, avec sa propre taille et sa propre licence. C'est la mémoire qui décide de ce que vous pouvez utiliser. Plus un modèle est gros, plus il demande de mémoire vive, ou de mémoire vidéo si vous avez une carte graphique. Sans GPU, les modèles tournent sur le processeur, plus lentement. Avant de choisir une application, regardez donc surtout la mémoire de votre ordinateur, puis sélectionnez des modèles à sa mesure.
Quelle application pour quel usage ?
LM Studio et Jan conviennent à ceux qui veulent une interface de discussion sans ligne de commande. Ollama s'adresse plutôt aux développeurs, avec son API locale que d'autres logiciels savent utiliser. GPT4All et AnythingLLM mettent l'accent sur la discussion avec vos propres documents. Open WebUI offre une interface dans le navigateur, souvent branchée sur Ollama, et llama.cpp ou KoboldCpp intéressent les utilisateurs qui veulent régler finement l'exécution.
Ce que la page ne promet pas
La vitesse et la qualité des réponses dépendent du modèle et du matériel : la page n'en garantit aucune. Les informations proviennent de la documentation des éditeurs et de leurs dépôts GitHub, dont le lien figure sur chaque carte. Pour un modèle trop lourd pour votre PC, un serveur VPS ou un fournisseur d'API sont les alternatives.