ผู้ให้บริการ API
VPS สำหรับ AI
แอป LLM แบบโลคัล
ระบบอัตโนมัติ
เอเจนต์เขียนโค้ด
แอป AI
อัปเดตเมื่อ 5 ตุลาคม 2026
Ollama รันโมเดลโอเพนเวตบนเครื่องของคุณผ่านคอมมานด์ไลน์และแอปเดสก์ท็อป พร้อม API ในเครื่องที่เข้ากับ OpenAI เป็นโอเพนซอร์สภายใต้ MIT สำหรับนักพัฒนาที่ต้องการโมเดลในเครื่อง
ระบบ
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, Metal
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
MIT
ดาวบน GitHub
181,947
แอปเดสก์ท็อป LM Studio ใช้ค้นหาดาวน์โหลดและแชตกับโมเดลในเครื่องพร้อมเซิร์ฟเวอร์ API ในเครื่อง ใช้ฟรีแต่ไม่ใช่โอเพนซอร์สและเหมาะกับคนที่ไม่อยากใช้คอมมานด์ไลน์
ระบบ
Windows, macOS, Linux
RAM ขั้นต่ำ
16 GB
GPU
Optional: 4 GB+ VRAM, Apple Silicon
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
Proprietary
Jan เป็นแอปแชตโอเพนซอร์สหน้าตาคล้าย ChatGPT ที่รันโมเดลแบบออฟไลน์และเชื่อม API คลาวด์ได้ สำหรับคนที่อยากได้ผู้ช่วยส่วนตัวบนคอมพิวเตอร์ของตัวเอง
ระบบ
Windows, macOS, Linux
RAM ขั้นต่ำ
8 GB
GPU
Optional: NVIDIA, AMD, Intel Arc, Metal
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
Apache-2.0
ดาวบน GitHub
44,717
แอปเดสก์ท็อปโอเพนซอร์สของ Nomic ชื่อ GPT4All รันโมเดลบน CPU หรือ GPU และคุยกับเอกสารในเครื่องผ่าน LocalDocs ได้ แต่ช่วงหลังแทบไม่มีรุ่นใหม่ออกมา
ระบบ
Windows, macOS, Linux
RAM ขั้นต่ำ
8 GB
GPU
Optional: Vulkan, Apple M-series
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
MIT
ดาวบน GitHub
77,386
AnythingLLM รวมแชตกับเอกสาร เอเจนต์และโมเดลในเครื่องหรือคลาวด์ไว้ด้วยกันในแอปที่ติดตั้งได้ทั้งบนเดสก์ท็อปและ Docker สำหรับพื้นที่ทำงานส่วนตัว
ระบบ
Windows, macOS, Linux
RAM ขั้นต่ำ
16 GB
GPU
Optional: CUDA, ROCm, Vulkan, NPU
สัญญาอนุญาต
MIT
ดาวบน GitHub
66,618
Open WebUI คือเว็บอินเทอร์เฟซที่โฮสต์เองสำหรับ Ollama และ API ที่เข้ากับ OpenAI ติดตั้งด้วย Docker หรือ pip และรองรับผู้ใช้หลายคนบนเซิร์ฟเวอร์เดียว
ระบบ
Windows, macOS, Linux
GPU
Not needed: uses Ollama or an API
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
Open WebUI License
ดาวบน GitHub
153,609
เอนจินโอเพนซอร์สภาษา C/C++ อย่าง llama.cpp รันโมเดล GGUF บน CPU และ GPU มีเครื่องมือคอมมานด์ไลน์และเซิร์ฟเวอร์ API แอปโลคัลหลายตัวสร้างบนเอนจินนี้
ระบบ
Windows, macOS, Linux
GPU
Optional: CUDA, ROCm, Vulkan, SYCL, Metal
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
MIT
ดาวบน GitHub
129,950
KoboldCpp เป็นแอปไฟล์เดียวที่สร้างบน llama.cpp มีเว็บอินเทอร์เฟซสำหรับแชตและเขียนเรื่อง พร้อม API แบบ KoboldAI และ OpenAI เหมาะกับงานโรลเพลย์และนิยาย
ระบบ
Windows, macOS, Linux
GPU
Optional: CUDA, Vulkan, hipBLAS, Metal
API ที่เข้ากันได้กับ OpenAI
ใช่
สัญญาอนุญาต
AGPL-3.0
ดาวบน GitHub
11,908
แอปแบบโลคัลคืออะไร
แอปในหน้านี้รันโมเดลภาษาบนคอมพิวเตอร์ของคุณเอง พรอมต์และคำตอบอยู่ในเครื่อง ไม่ได้ส่งไปยังคลาวด์ของผู้ให้บริการ ตัวแอปใช้ฟรี แต่ตัวโมเดลเป็นไฟล์ที่ดาวน์โหลดแยก มีขนาดและสัญญาอนุญาตของตัวเอง
มีเครื่องมือแบบไหนบ้าง
แอปเดสก์ท็อป: Ollama, LM Studio, Jan, GPT4All และ AnythingLLM ติดตั้งแล้วเลือกโมเดลได้เลย
เว็บอินเทอร์เฟซ: Open WebUI สำหรับเปิดแชตผ่านเบราว์เซอร์ มักใช้คู่กับตัวรันโมเดล
เอนจิน: llama.cpp และ KoboldCpp สำหรับคนที่ต้องการควบคุมละเอียด
แต่ละการ์ดบอกระบบที่รองรับ หน่วยความจำขั้นต่ำ การรองรับ GPU สัญญาอนุญาต และจำนวนดาวบน GitHub ซึ่งอัปเดตทุกสัปดาห์ ถ้าแอปอยู่ในแคตตาล็อกของเรา จะมีปุ่มดาวน์โหลดที่พาไปยังตัวติดตั้งที่ตรวจลายเซ็นแล้ว เช่น Ollama หรือ LM Studio
เครื่องต้องแรงแค่ไหน
หน่วยความจำ หรือหน่วยความจำของการ์ดจอ เป็นตัวตัดสินว่ารันโมเดลขนาดไหนได้ โมเดลใหญ่ต้องใช้หน่วยความจำมากขึ้น ถ้าไม่มี GPU โมเดลยังรันบน CPU ได้แต่ช้ากว่า หน้านี้ไม่ได้รับประกันความเร็วหรือคุณภาพ เพราะทั้งสองอย่างขึ้นกับโมเดลและฮาร์ดแวร์ของคุณ
จะเริ่มจากตัวไหน
ถ้าไม่เคยใช้มาก่อน แอปที่มีหน้าต่างเลือกโมเดลอย่าง LM Studio หรือ Jan เริ่มง่าย ถ้าต้องการ API ในเครื่องสำหรับโปรแกรมอื่น Ollama เหมาะกว่า ส่วนงานคุยกับเอกสารของตัวเองดู GPT4All และ AnythingLLM ข้อมูลอ้างอิงมาจากเอกสารของผู้พัฒนาและคลังโค้ดบน GitHub ของแต่ละโครงการ
ข้อดีของการรันในเครื่องคือพรอมต์ไม่ออกจากคอมพิวเตอร์ เหมาะกับเอกสารภายในหรือข้อมูลส่วนตัว ข้อแลกคือคุณต้องดูแลพื้นที่ดิสก์ อัปเดตแอป และเลือกโมเดลเอง และโมเดลที่รันได้บนเครื่องทั่วไปมักเล็กกว่าโมเดลบนคลาวด์ ตรวจสัญญาอนุญาตของโมเดลก่อนนำไปใช้เชิงพาณิชย์ เพราะแต่ละตัวมีเงื่อนไขต่างกัน