本地 LLM 推理框架/工具對照(2026 年 8 月)

Ollama、LM Studio、llama.cpp、vLLM、MLX、SGLang——8 個主流本地/地端 LLM 推理工具對照:定位、平台、模型格式、授權與適用場景。分清「桌面 app / 推理引擎 / Apple 專屬 / 生產服務框架」四類。

工具類型平台模型格式授權適合場景
Ollama桌面 app + CLImacOS/Win/Linux;NVIDIA/AMD/AppleGGUF(可匯入 safetensors)MIT單機易上手,一行指令跑模型
LM Studio桌面 GUImacOS(Apple Silicon)/Win/LinuxGGUF + MLX閉源(免費);SDK 開源GUI 使用者;Mac 走 MLX 優化
llama.cpp推理引擎/函式庫跨硬體(CUDA/Metal/Vulkan/CPU)GGUF(此格式的源頭)MIT嵌入整合/CPU/邊緣;眾多 app 底層
vLLM生產服務框架NVIDIA/AMD/Intel GPU/CPUsafetensors + 多量化Apache-2.0高吞吐生產部署、GPU 叢集
MLX-LMApple 專屬套件僅 Apple SiliconMLX(可轉 HF)MITApple Silicon 推理與微調
SGLang生產服務框架NVIDIA/AMD/Intel/TPU/NPUHF 相容 + OpenAI APIApache-2.0低延遲高吞吐、分散式叢集
text-generation-webui桌面 app / Web UILinux/Win/macOS;多後端GGUF + safetensorsAGPL-3.0進階實驗、多後端切換
GPT4All桌面 appWin/macOS/Linux;Vulkan GPUGGUFMIT隱私本地使用、平價硬體

方法與來源

各工具定位/平台/授權取自其官方 GitHub repo 與官方文件(2026-08 現況),擷取日 2026-08-26。**分類**:桌面 app(Ollama、LM Studio、GPT4All、text-generation-webui)/ 推理引擎函式庫(llama.cpp、vLLM、SGLang)/ Apple 專屬(MLX-LM)。8 者皆提供 OpenAI 相容 API。授權/平台為易變欄位,以官方 repo 現況為準。**待註**:Ollama 的 GPU 逐條清單為依 llama.cpp 底層歸納(細項 medium);LM Studio app 本體為閉源(免費),其 SDK/CLI 開源。來源:llama.cpp https://github.com/ggml-org/llama.cpp ;Ollama https://github.com/ollama/ollama ;vLLM https://github.com/vllm-project/vllm ;MLX-LM https://github.com/ml-explore/mlx-lm ;LM Studio https://lmstudio.ai/ 。

來源:https://github.com/ggml-org/llama.cpp

擷取日期:2026-08-26

常見問題

「本地 LLM 推理框架/工具對照(2026 年 8 月)」涵蓋哪些對象?
本表涵蓋 Ollama、LM Studio、llama.cpp、vLLM、MLX-LM、SGLang、text-generation-webui、GPT4All,對照欄位包含:工具、類型、平台、模型格式、授權、適合場景。
這張表的資料來源與方法為何?
各工具定位/平台/授權取自其官方 GitHub repo 與官方文件(2026-08 現況),擷取日 2026-08-26。
資料最後更新於何時?
本表資料擷取/更新日為 2026-08-26。

相關數據集