AI 開源模型
mlx-serve
在您的Mac上本地運行任何LLM,比LM Studio或Ollama更快,支援聊天、編碼代理、圖片、影片和語音,完全離線且開源。
mlx-serve
什麼是 mlx-serve?
mlx-serve 是一款免費、開源的 macOS 應用程式,使用 Apple 的 MLX 框架在您的 Mac 上完全運行大型語言模型 (LLM),推理速度比 LM Studio 和 Ollama 等替代方案更快。它支援多種模型,包括 DeepSeek V4 Flash、Gemma 4、Qwen 等,並提供推測解碼、語音克隆、圖片生成和代理沙盒等功能。
mlx-serve 與相似工具比較
| 計價模式 | 免費 | 免費 | 免費 | 免費 |
| 免費額度 | ||||
| 主要功能 |
|
|
|
|
| 優點 |
|
|
|
|
| 缺點 |
|
|
|
|
| 適合對象 |
|
|
|
|
如何使用 mlx-serve?
- 1從 GitHub Releases 下載 MLX Core 應用程式,或透過 Homebrew 安裝。
- 2啟動應用程式,使用模型瀏覽器下載任何支援的模型。
- 3在內建介面中開始聊天,或透過與 OpenAI/Anthropic 相容的 API 連接外部應用程式。
- 4使用 ⌃Space 啟動器快速存取,或設定語音和 Telegram 機器人進行遠端控制。
mlx-serve 主要功能
- 在 Apple Silicon 上進行本地推理,原生 Metal 加速
- 推測解碼 (Prompt Lookup Decoding、起草模型、MTP) 最高可達 2 倍生成速度
- 圖片生成 (Krea-2-Turbo, FLUX.2) 以及根據文字指令進行照片編輯
- 影片生成 (LTX-Video 2.3),包含同步音訊和說話角色
- 語音克隆和文字轉語音 (Qwen3-TTS),僅需幾秒音訊
- 代理模式,內建 10 種工具 (shell、檔案、搜尋、瀏覽等) 並支援 MCP 伺服器
- 代理沙盒,使用 Apple 虛擬化技術進行隔離命令執行
- 與 Ollama 相容的 API,可無縫取代 Ollama 應用程式
- 整合 Claude Code,用於本地編碼代理
- KV 快取量化和連續批次處理,支援多個並發聊天
mlx-serve 使用情境
- 運行本地 LLM,無需網路即可獲得私密的 AI 輔助
- 開發和測試具備沙盒工具執行的 AI 代理
- 取代編碼代理的雲端 API (Claude Code、Cursor、Continue)
- 在裝置上生成圖片、影片和音訊,用於創意專案
- 建構具備語音控制和排程功能的客製化 AI 助理
mlx-serve 價格與免費點數
mlx-serve 目前採用 免費 模式。
此工具完全免費使用
mlx-serve 優缺點
優點
- 在相同模型上比 LM Studio 和 Ollama 更快
- 完全本地且私密——資料不會離開您的 Mac
- 支援大量模型 (MLX、GGUF、DeepSeek V4 Flash)
- 包含圖片、影片、語音生成和編輯
- 輕量級(約 4.5 MB),作為原生 Mac 應用程式易於安裝
- 透過 OpenAI/Anthropic/Ollama API 與現有工具無縫整合
缺點
- 僅限 Mac(需要 Apple Silicon)
- 某些進階功能(例如 DeepSeek V4)需要高記憶體(96 GB 以上)
- 無內建雲端同步或多裝置支援
mlx-serve 最適合哪些用途?
- 想要私密、高效能本地 AI 的 Mac 使用者
- 建構 AI 代理和編碼助手的開發者
- 需要離線圖片/影片/音訊生成的內容創作者
- 注重隱私的個人和組織