ข้ามไปยังเนื้อหา
fedi.software

แอป LLM แบบโลคัล

แอปที่รันโมเดลบนคอมพิวเตอร์ของคุณเอง: ระบบที่รองรับ หน่วยความจำที่ต้องใช้ การรองรับ GPU และดาวน์โหลดได้จากแคตตาล็อกของเรา

อัปเดตเมื่อ

Ollama

โอเพนซอร์ส

Ollama รันโมเดลโอเพนเวตบนเครื่องของคุณผ่านคอมมานด์ไลน์และแอปเดสก์ท็อป พร้อม API ในเครื่องที่เข้ากับ OpenAI เป็นโอเพนซอร์สภายใต้ MIT สำหรับนักพัฒนาที่ต้องการโมเดลในเครื่อง

ระบบ
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
MIT
ดาวบน GitHub
181,947

LM Studio

ฟรี

แอปเดสก์ท็อป LM Studio ใช้ค้นหาดาวน์โหลดและแชตกับโมเดลในเครื่องพร้อมเซิร์ฟเวอร์ API ในเครื่อง ใช้ฟรีแต่ไม่ใช่โอเพนซอร์สและเหมาะกับคนที่ไม่อยากใช้คอมมานด์ไลน์

ระบบ
Windows, macOS, Linux
RAM ขั้นต่ำ
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
Proprietary

Jan

โอเพนซอร์ส

Jan เป็นแอปแชตโอเพนซอร์สหน้าตาคล้าย ChatGPT ที่รันโมเดลแบบออฟไลน์และเชื่อม API คลาวด์ได้ สำหรับคนที่อยากได้ผู้ช่วยส่วนตัวบนคอมพิวเตอร์ของตัวเอง

ระบบ
Windows, macOS, Linux
RAM ขั้นต่ำ
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
Apache-2.0
ดาวบน GitHub
44,717

GPT4All

โอเพนซอร์ส

แอปเดสก์ท็อปโอเพนซอร์สของ Nomic ชื่อ GPT4All รันโมเดลบน CPU หรือ GPU และคุยกับเอกสารในเครื่องผ่าน LocalDocs ได้ แต่ช่วงหลังแทบไม่มีรุ่นใหม่ออกมา

ระบบ
Windows, macOS, Linux
RAM ขั้นต่ำ
8 GB
GPU
Optional: Vulkan, Apple M-series
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
MIT
ดาวบน GitHub
77,386

AnythingLLM

โอเพนซอร์ส

AnythingLLM รวมแชตกับเอกสาร เอเจนต์และโมเดลในเครื่องหรือคลาวด์ไว้ด้วยกันในแอปที่ติดตั้งได้ทั้งบนเดสก์ท็อปและ Docker สำหรับพื้นที่ทำงานส่วนตัว

ระบบ
Windows, macOS, Linux
RAM ขั้นต่ำ
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
สัญญาอนุญาต
MIT
ดาวบน GitHub
66,618

Open WebUI

โอเพนซอร์ส

Open WebUI คือเว็บอินเทอร์เฟซที่โฮสต์เองสำหรับ Ollama และ API ที่เข้ากับ OpenAI ติดตั้งด้วย Docker หรือ pip และรองรับผู้ใช้หลายคนบนเซิร์ฟเวอร์เดียว

ระบบ
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
Open WebUI License
ดาวบน GitHub
153,609

llama.cpp

โอเพนซอร์ส

เอนจินโอเพนซอร์สภาษา C/C++ อย่าง llama.cpp รันโมเดล GGUF บน CPU และ GPU มีเครื่องมือคอมมานด์ไลน์และเซิร์ฟเวอร์ API แอปโลคัลหลายตัวสร้างบนเอนจินนี้

ระบบ
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
MIT
ดาวบน GitHub
129,950

KoboldCpp

โอเพนซอร์ส

KoboldCpp เป็นแอปไฟล์เดียวที่สร้างบน llama.cpp มีเว็บอินเทอร์เฟซสำหรับแชตและเขียนเรื่อง พร้อม API แบบ KoboldAI และ OpenAI เหมาะกับงานโรลเพลย์และนิยาย

ระบบ
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
AGPL-3.0
ดาวบน GitHub
11,908

แอปแบบโลคัลคืออะไร

แอปในหน้านี้รันโมเดลภาษาบนคอมพิวเตอร์ของคุณเอง พรอมต์และคำตอบอยู่ในเครื่อง ไม่ได้ส่งไปยังคลาวด์ของผู้ให้บริการ ตัวแอปใช้ฟรี แต่ตัวโมเดลเป็นไฟล์ที่ดาวน์โหลดแยก มีขนาดและสัญญาอนุญาตของตัวเอง

มีเครื่องมือแบบไหนบ้าง

  • แอปเดสก์ท็อป: Ollama, LM Studio, Jan, GPT4All และ AnythingLLM ติดตั้งแล้วเลือกโมเดลได้เลย
  • เว็บอินเทอร์เฟซ: Open WebUI สำหรับเปิดแชตผ่านเบราว์เซอร์ มักใช้คู่กับตัวรันโมเดล
  • เอนจิน: llama.cpp และ KoboldCpp สำหรับคนที่ต้องการควบคุมละเอียด

แต่ละการ์ดบอกระบบที่รองรับ หน่วยความจำขั้นต่ำ การรองรับ GPU สัญญาอนุญาต และจำนวนดาวบน GitHub ซึ่งอัปเดตทุกสัปดาห์ ถ้าแอปอยู่ในแคตตาล็อกของเรา จะมีปุ่มดาวน์โหลดที่พาไปยังตัวติดตั้งที่ตรวจลายเซ็นแล้ว เช่น Ollama หรือ LM Studio

เครื่องต้องแรงแค่ไหน

หน่วยความจำ หรือหน่วยความจำของการ์ดจอ เป็นตัวตัดสินว่ารันโมเดลขนาดไหนได้ โมเดลใหญ่ต้องใช้หน่วยความจำมากขึ้น ถ้าไม่มี GPU โมเดลยังรันบน CPU ได้แต่ช้ากว่า หน้านี้ไม่ได้รับประกันความเร็วหรือคุณภาพ เพราะทั้งสองอย่างขึ้นกับโมเดลและฮาร์ดแวร์ของคุณ

จะเริ่มจากตัวไหน

ถ้าไม่เคยใช้มาก่อน แอปที่มีหน้าต่างเลือกโมเดลอย่าง LM Studio หรือ Jan เริ่มง่าย ถ้าต้องการ API ในเครื่องสำหรับโปรแกรมอื่น Ollama เหมาะกว่า ส่วนงานคุยกับเอกสารของตัวเองดู GPT4All และ AnythingLLM ข้อมูลอ้างอิงมาจากเอกสารของผู้พัฒนาและคลังโค้ดบน GitHub ของแต่ละโครงการ

ข้อดีของการรันในเครื่องคือพรอมต์ไม่ออกจากคอมพิวเตอร์ เหมาะกับเอกสารภายในหรือข้อมูลส่วนตัว ข้อแลกคือคุณต้องดูแลพื้นที่ดิสก์ อัปเดตแอป และเลือกโมเดลเอง และโมเดลที่รันได้บนเครื่องทั่วไปมักเล็กกว่าโมเดลบนคลาวด์ ตรวจสัญญาอนุญาตของโมเดลก่อนนำไปใช้เชิงพาณิชย์ เพราะแต่ละตัวมีเงื่อนไขต่างกัน