Langsung ke konten
fedi.software

Aplikasi LLM lokal

Aplikasi yang menjalankan model di komputer Anda sendiri: sistem yang didukung, kebutuhan memori, dukungan GPU, dan unduhan dari katalog kami.

Diperbarui

Ollama

Sumber terbuka

Ollama menjalankan model berbobot terbuka secara lokal lewat baris perintah dan aplikasi desktop, serta menyediakan API HTTP lokal yang kompatibel dengan OpenAI. Open source berlisensi MIT.

Sistem
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
API kompatibel OpenAI
ya
Lisensi
MIT
Bintang GitHub
181.947

LM Studio

Gratis

LM Studio adalah aplikasi desktop untuk mencari, mengunduh, dan bercakap dengan model lokal, lengkap dengan server API lokal. Gratis, tetapi bukan open source.

Sistem
Windows, macOS, Linux
RAM min.
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
API kompatibel OpenAI
ya
Lisensi
Proprietary

Jan

Sumber terbuka

Jan adalah aplikasi chat desktop open source (Apache-2.0) yang menjalankan model secara offline dan bisa tersambung ke API cloud, seperti ChatGPT pribadi di komputer sendiri.

Sistem
Windows, macOS, Linux
RAM min.
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
API kompatibel OpenAI
ya
Lisensi
Apache-2.0
Bintang GitHub
44.717

GPT4All

Sumber terbuka

GPT4All adalah aplikasi desktop open source (MIT) dari Nomic untuk model lokal di CPU atau GPU, dengan LocalDocs untuk mengobrol tentang dokumen sendiri. Rilis barunya kini jarang terbit.

Sistem
Windows, macOS, Linux
RAM min.
8 GB
GPU
Optional: Vulkan, Apple M-series
API kompatibel OpenAI
ya
Lisensi
MIT
Bintang GitHub
77.386

AnythingLLM

Sumber terbuka

AnythingLLM adalah aplikasi open source (MIT) untuk desktop atau Docker yang memadukan chat dengan dokumen, agen, serta model lokal atau cloud dalam ruang kerja pribadi.

Sistem
Windows, macOS, Linux
RAM min.
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
Lisensi
MIT
Bintang GitHub
66.618

Open WebUI

Sumber terbuka

Open WebUI adalah antarmuka web yang di-host sendiri untuk Ollama dan API kompatibel OpenAI, dipasang lewat Docker atau pip dan mendukung banyak pengguna.

Sistem
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
API kompatibel OpenAI
ya
Lisensi
Open WebUI License
Bintang GitHub
153.609

llama.cpp

Sumber terbuka

Di balik banyak aplikasi lokal ada llama.cpp, mesin inferensi open source dalam C dan C++ untuk model GGUF di CPU dan GPU, dengan alat baris perintah dan server kompatibel OpenAI.

Sistem
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
API kompatibel OpenAI
ya
Lisensi
MIT
Bintang GitHub
129.950

KoboldCpp

Sumber terbuka

KoboldCpp adalah aplikasi satu berkas berbasis llama.cpp dengan antarmuka web untuk chat dan menulis cerita, serta API kompatibel KoboldAI dan OpenAI. Populer untuk role-play dengan model lokal.

Sistem
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
API kompatibel OpenAI
ya
Lisensi
AGPL-3.0
Bintang GitHub
11.908

Menjalankan AI di komputer sendiri

Halaman ini memuat aplikasi yang menjalankan model bahasa langsung di PC, tanpa mengirim pertanyaan ke cloud. Kartu menampilkan sistem yang didukung, RAM minimum, dukungan GPU, lisensi, dan bintang GitHub. Bila aplikasinya ada di katalog kami, tersedia tombol “Download” menuju penginstal resmi yang sudah diperiksa tanda tangan digitalnya.

Jenis alat yang tersedia

  • Aplikasi desktop: Ollama, LM Studio, Jan, GPT4All, dan AnythingLLM. Pasang, pilih model, lalu mulai bercakap.
  • Antarmuka web: Open WebUI, layar chat di peramban untuk model yang berjalan di komputer atau server Anda.
  • Mesin: llama.cpp dan KoboldCpp, fondasi teknis yang dipakai program lain dan bisa juga digunakan langsung.

Cara memulai langkah demi langkah

  1. Cek RAM komputer Anda. RAM atau memori kartu grafis menentukan model mana yang sanggup berjalan.
  2. Pilih satu aplikasi desktop dan pasang dari tombol “Download” atau situs resminya.
  3. Unduh model kecil lebih dulu. Aplikasinya gratis, tetapi model adalah unduhan terpisah dengan lisensi dan ukuran sendiri.
  4. Uji beberapa pertanyaan dan amati pemakaian memori.
  5. Jika lancar, coba model yang lebih besar secara bertahap.

Yang perlu diketahui

Model besar membutuhkan lebih banyak memori. Tanpa GPU, model berjalan di prosesor dan lebih lambat. Kecepatan dan mutu jawaban bergantung pada model dan perangkat keras; halaman ini tidak menjanjikan keduanya. Sebelum memakai model untuk pekerjaan komersial, baca lisensinya.

Jika ada masalah

Aplikasi terasa lambat? Pilih model lebih kecil. Model gagal dimuat? Periksa sisa RAM dan tutup program lain. GPU tidak terpakai? Perbarui driver kartu grafis. Masalah kecil seperti ini biasanya selesai tanpa perlu mengganti aplikasi.

Mengapa memilih lokal

Lokal berarti pertanyaan tetap berada di komputer. Ini berguna untuk dokumen sensitif, bekerja tanpa internet, dan mencoba model berbobot terbuka tanpa bayar per panggilan. Jika komputer Anda tidak punya memori yang cukup, alternatifnya adalah menyewa VPS untuk AI atau memakai model dengan API gratis. Data kartu berasal dari dokumentasi pembuat dan repositori GitHub, dengan bintang GitHub diperbarui setiap minggu.