KI Open-Source-Modelle
mlx-serve
Führen Sie jedes LLM lokal auf Ihrem Mac aus, schneller als LM Studio oder Ollama, mit Chat, Codierungsagenten, Bildern, Videos und Sprache – alles komplett offline und Open Source.
mlx-serve
Was ist mlx-serve?
mlx-serve ist eine kostenlose Open-Source-macOS-Anwendung, die große Sprachmodelle (LLMs) vollständig auf Ihrem Mac mit Apples MLX-Framework ausführt und eine schnellere Inferenz als Alternativen wie LM Studio und Ollama bietet. Es unterstützt eine Vielzahl von Modellen, darunter DeepSeek V4 Flash, Gemma 4, Qwen und mehr, und bietet Funktionen wie spekulative Dekodierung, Sprachklonen, Bildgenerierung und Agenten-Sandboxing.
mlx-serve vs Ähnliche Tools
| Preismodell | Kostenlos | Kostenlos | Kostenlos | Kostenlos |
| Gratis-Credits | ||||
| Wichtige Funktionen |
|
|
|
|
| Vorteile |
|
|
|
|
| Nachteile |
|
|
|
|
| Geeignet für |
|
|
|
|
So nutzt du mlx-serve?
- 1Laden Sie die MLX Core App von GitHub Releases herunter oder installieren Sie sie über Homebrew.
- 2Starten Sie die App und verwenden Sie den Modellbrowser, um jedes unterstützte Modell herunterzuladen.
- 3Chatten Sie in der integrierten Oberfläche oder verbinden Sie externe Apps über die OpenAI/Anthropic-kompatible API.
- 4Verwenden Sie den ⌃Space-Launcher für schnellen Zugriff oder konfigurieren Sie Sprach- und Telegram-Bot für die Fernsteuerung.
mlx-serve Wichtige Funktionen
- Lokale Inferenz auf Apple Silicon mit nativer Metal-Beschleunigung
- Spekulative Dekodierung (Prompt Lookup Decoding, Drafter-Modelle, MTP) für bis zu 2x schnellere Generierung
- Bildgenerierung (Krea-2-Turbo, FLUX.2) und Fotobearbeitung per Textanweisung
- Videogenerierung (LTX-Video 2.3) mit synchronisiertem Audio und sprechenden Charakteren
- Sprachklonen und Text-to-Speech (Qwen3-TTS) aus wenigen Sekunden Audio
- Agentenmodus mit 10 integrierten Werkzeugen (Shell, Datei, Suche, Browser usw.) und MCP-Server-Support
- Agenten-Sandbox mit Apple Virtualization für isolierte Befehlsausführung
- Ollama-kompatible API als Ersatz für Ollama-Apps
- Claude Code-Integration für lokale Codierungsagenten
- KV-Cache-Quantisierung und kontinuierliches Batching für mehrere gleichzeitige Chats
mlx-serve Anwendungsfälle
- Ausführen lokaler LLMs für private KI-Assistenz ohne Internet
- Entwickeln und Testen von KI-Agenten mit sandboxed Werkzeugausführung
- Ersetzen von Cloud-APIs für Codierungsagenten (Claude Code, Cursor, Continue)
- Generieren von Bildern, Videos und Audio auf dem Gerät für kreative Projekte
- Erstellen benutzerdefinierter KI-Assistenten mit Sprachsteuerung und Zeitplanung
mlx-serve Preise und Gratis-Credits
mlx-serve arbeitet mit dem Modell Kostenlos.
Dieses Tool ist vollständig kostenlos
mlx-serve Vorteile und Nachteile
Vorteile
- Schneller als LM Studio und Ollama bei identischen Modellen
- Komplett lokal und privat – keine Daten verlassen Ihren Mac
- Unterstützt eine große Auswahl an Modellen (MLX, GGUF, DeepSeek V4 Flash)
- Enthält Bild-, Video- und Sprachgenerierung sowie Bearbeitung
- Leicht (~4,5 MB) und einfach als native Mac-App zu installieren
- Nahtlose Integration mit vorhandenen Tools über OpenAI/Anthropic/Ollama APIs
Nachteile
- Nur Mac (erfordert Apple Silicon)
- Einige erweiterte Funktionen (z. B. DeepSeek V4) benötigen viel Speicher (96 GB+)
- Kein integrierter Cloud-Sync oder Multi-Device-Support
Wofür eignet sich mlx-serve am besten?
- Mac-Nutzer, die eine private, leistungsstarke lokale KI wünschen
- Entwickler, die KI-Agenten und Codierungsassistenten erstellen
- Content-Ersteller, die offline Bild-/Video-/Audiogenerierung benötigen
- Datenschutzbewusste Einzelpersonen und Organisationen