Apps que ejecutan modelos en tu propio ordenador: sistemas compatibles, memoria necesaria, soporte de GPU y descarga desde nuestro catálogo.
Actualizado
Ollama
Código abierto
Ollama ejecuta modelos de pesos abiertos en tu equipo desde la terminal o una app de escritorio y los sirve mediante una API HTTP local, también compatible con OpenAI. Es de código abierto con licencia MIT, pensado para desarrolladores.
Sistemas
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
API compatible con OpenAI
sí
Licencia
MIT
Estrellas en GitHub
181.947
LM Studio
Gratis
App de escritorio para buscar, descargar y chatear con modelos locales sin usar la terminal: LM Studio incluye además un servidor de API local. Es gratuita, pero no de código abierto.
Sistemas
Windows, macOS, Linux
RAM mín.
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
API compatible con OpenAI
sí
Licencia
Proprietary
Jan
Código abierto
Jan es una app de chat de código abierto al estilo ChatGPT que ejecuta modelos sin conexión en tu propio equipo. También se conecta a APIs en la nube e incluye un servidor local compatible con OpenAI.
Sistemas
Windows, macOS, Linux
RAM mín.
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
API compatible con OpenAI
sí
Licencia
Apache-2.0
Estrellas en GitHub
44.717
GPT4All
Código abierto
GPT4All, de Nomic, es una app de escritorio de código abierto para modelos locales en CPU o GPU, con LocalDocs para chatear sobre tus propios archivos. Hace tiempo que apenas publica versiones nuevas.
Sistemas
Windows, macOS, Linux
RAM mín.
8 GB
GPU
Optional: Vulkan, Apple M-series
API compatible con OpenAI
sí
Licencia
MIT
Estrellas en GitHub
77.386
AnythingLLM
Código abierto
Un espacio privado para documentos y agentes: AnythingLLM es una app de código abierto, de escritorio o en Docker, que chatea con tus archivos usando modelos locales o en la nube.
Sistemas
Windows, macOS, Linux
RAM mín.
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
Licencia
MIT
Estrellas en GitHub
66.618
Open WebUI
Código abierto
Open WebUI es una interfaz web autoalojada para Ollama y APIs compatibles con OpenAI, que se instala con Docker o pip. Admite varios usuarios, así que sirve como chat compartido en un servidor.
Sistemas
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
API compatible con OpenAI
sí
Licencia
Open WebUI License
Estrellas en GitHub
153.609
llama.cpp
Código abierto
Motor de inferencia de código abierto en C y C++ para modelos GGUF, llama.cpp funciona en CPU y GPU e incluye herramientas de terminal y un servidor compatible con OpenAI. Muchas apps locales se basan en él.
Sistemas
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
API compatible con OpenAI
sí
Licencia
MIT
Estrellas en GitHub
129.950
KoboldCpp
Código abierto
KoboldCpp es una app de un solo archivo basada en llama.cpp, con interfaz web para chat y escritura de historias. Ofrece APIs de KoboldAI y compatibles con OpenAI, y gusta a quien hace rol y ficción con modelos locales.
Sistemas
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
API compatible con OpenAI
sí
Licencia
AGPL-3.0
Estrellas en GitHub
11.908
Las apps de esta página ejecutan modelos de lenguaje en tu propio equipo. La ventaja principal es que los prompts no salen del ordenador: nadie más los lee ni los guarda. Aquí tienes cómo elegir una y qué necesitas para que funcione.
Qué tipos de app hay
Apps de escritorio: Ollama, LM Studio, Jan, GPT4All y AnythingLLM. Se instalan como cualquier programa e incluyen una ventana de chat.
Interfaz web: Open WebUI, que se abre en el navegador y suele usar un motor por detrás.
Motores: llama.cpp y KoboldCpp, para quien quiere control total o integrarlos en otras herramientas.
Qué muestra cada tarjeta
Los sistemas compatibles, la RAM mínima, el soporte de GPU, la licencia y las estrellas en GitHub, que se actualizan cada semana. Cuando la app está en nuestro catálogo aparece un botón de descarga; en ese caso comprobamos que el instalador tenga una firma válida. Cada tarjeta enlaza con la documentación del fabricante o con su repositorio.
Pasos para elegir
Mira tu memoria. La RAM, o la memoria de la tarjeta gráfica, decide qué modelos puedes ejecutar. Un modelo más grande necesita más memoria.
Comprueba la GPU. Sin tarjeta gráfica los modelos funcionan con el procesador, pero más despacio.
Elige el estilo. Si prefieres ventanas y botones, LM Studio, Jan o GPT4All. Si te manejas en la terminal o quieres un motor para otras apps, Ollama. Si trabajas con documentos y agentes, AnythingLLM.
Descarga el modelo aparte. La app es gratuita, pero el modelo es una descarga independiente, con su propio tamaño y su propia licencia.
Lo que no podemos prometer
La velocidad y la calidad de las respuestas dependen del modelo y del hardware, y esta página no garantiza ninguna de las dos. Un mismo modelo puede ir fluido en un equipo con GPU y resultar lento en un portátil sin ella. La forma más fiable de saberlo es probar un modelo pequeño primero e ir subiendo.
Local o en la nube
Si tu equipo se queda corto, tienes dos caminos: un servidor propio en VPS para IA o una API en la nube de los proveedores de API, algunos con acceso gratuito. Para elegir el modelo, las clasificaciones marcan con «Pesos abiertos» los que se pueden descargar.