Aller au contenu
fedi.software

Applications LLM locales

Applications qui exécutent des modèles sur votre propre ordinateur : systèmes pris en charge, mémoire requise, prise en charge du GPU et téléchargement depuis notre catalogue.

Mis à jour

Ollama

Open source

Ollama fait tourner des modèles ouverts en local, en ligne de commande ou via une application de bureau, et expose une API HTTP compatible OpenAI. Outil open source sous licence MIT, destiné aux développeurs.

Systèmes
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
API compatible OpenAI
oui
Licence
MIT
Étoiles GitHub
181 947

LM Studio

Gratuit

Application de bureau pour trouver, télécharger et utiliser des modèles locaux, avec un serveur d'API intégré. LM Studio est gratuit mais n'est pas open source, et vise ceux qui évitent la ligne de commande.

Systèmes
Windows, macOS, Linux
RAM min.
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
API compatible OpenAI
oui
Licence
Proprietary

Jan

Open source

Jan est une application de discussion open source, dans l'esprit de ChatGPT, qui fait tourner les modèles hors ligne ou se connecte à des API cloud. Un assistant privé sur votre propre ordinateur.

Systèmes
Windows, macOS, Linux
RAM min.
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
API compatible OpenAI
oui
Licence
Apache-2.0
Étoiles GitHub
44 717

GPT4All

Open source

Application de bureau open source de Nomic pour les modèles locaux sur processeur ou carte graphique, avec LocalDocs pour discuter de vos propres fichiers. Les nouvelles versions se font rares depuis un moment.

Systèmes
Windows, macOS, Linux
RAM min.
8 GB
GPU
Optional: Vulkan, Apple M-series
API compatible OpenAI
oui
Licence
MIT
Étoiles GitHub
77 386

AnythingLLM

Open source

Tout-en-un open source, en application de bureau ou sous Docker : discussion avec vos documents, agents et modèles locaux ou cloud. AnythingLLM offre un espace de travail privé pour documents et agents.

Systèmes
Windows, macOS, Linux
RAM min.
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
Licence
MIT
Étoiles GitHub
66 618

Open WebUI

Open source

Interface web auto-hébergée pour Ollama et les API compatibles OpenAI, installée avec Docker ou pip et utilisable par plusieurs personnes. Open WebUI sert d'interface de discussion partagée sur un serveur.

Systèmes
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
API compatible OpenAI
oui
Licence
Open WebUI License
Étoiles GitHub
153 609

llama.cpp

Open source

Moteur d'inférence open source en C/C++ pour les modèles GGUF sur processeur et GPU, avec des outils en ligne de commande et un serveur compatible OpenAI. De nombreuses applications locales reposent sur llama.cpp.

Systèmes
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
API compatible OpenAI
oui
Licence
MIT
Étoiles GitHub
129 950

KoboldCpp

Open source

KoboldCpp tient en un seul fichier, repose sur llama.cpp et ajoute une interface web pour la discussion et l'écriture d'histoires. Un choix apprécié pour le jeu de rôle et la fiction avec des modèles locaux.

Systèmes
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
API compatible OpenAI
oui
Licence
AGPL-3.0
Étoiles GitHub
11 908

L'IA sur votre propre ordinateur

Les applications réunies ici font tourner des modèles de langage directement sur le PC, sans passer par un service en ligne. Principal intérêt : vos questions et vos documents restent sur la machine. On y trouve des applications de bureau (Ollama, LM Studio, Jan, GPT4All, AnythingLLM), une interface web à installer soi-même (Open WebUI) et des moteurs d'exécution (llama.cpp, KoboldCpp) sur lesquels reposent d'autres outils.

Ce que montre chaque carte

  • les systèmes pris en charge : Windows, macOS, Linux ;
  • la mémoire vive minimale indiquée par l'éditeur et la prise en charge des cartes graphiques ;
  • la licence, pour distinguer les logiciels open source des applications gratuites mais propriétaires ;
  • le nombre d'étoiles GitHub, actualisé chaque semaine ;
  • un bouton de téléchargement quand l'application figure dans notre catalogue, avec un installeur dont la signature a été vérifiée.

L'application est gratuite, le modèle est à part

Installer Ollama ou LM Studio ne suffit pas : il faut ensuite télécharger un modèle, qui est un fichier distinct, avec sa propre taille et sa propre licence. C'est la mémoire qui décide de ce que vous pouvez utiliser. Plus un modèle est gros, plus il demande de mémoire vive, ou de mémoire vidéo si vous avez une carte graphique. Sans GPU, les modèles tournent sur le processeur, plus lentement. Avant de choisir une application, regardez donc surtout la mémoire de votre ordinateur, puis sélectionnez des modèles à sa mesure.

Quelle application pour quel usage ?

LM Studio et Jan conviennent à ceux qui veulent une interface de discussion sans ligne de commande. Ollama s'adresse plutôt aux développeurs, avec son API locale que d'autres logiciels savent utiliser. GPT4All et AnythingLLM mettent l'accent sur la discussion avec vos propres documents. Open WebUI offre une interface dans le navigateur, souvent branchée sur Ollama, et llama.cpp ou KoboldCpp intéressent les utilisateurs qui veulent régler finement l'exécution.

Ce que la page ne promet pas

La vitesse et la qualité des réponses dépendent du modèle et du matériel : la page n'en garantit aucune. Les informations proviennent de la documentation des éditeurs et de leurs dépôts GitHub, dont le lien figure sur chaque carte. Pour un modèle trop lourd pour votre PC, un serveur VPS ou un fournisseur d'API sont les alternatives.