KI Modelle & Agenten

Beste kostenlose Tools für KI Große Sprachmodelle (LLMs)

Entdecke 32 Tools für KI Große Sprachmodelle (LLMs). 88% bieten Gratisplan, Testphase oder Credits. Top-Auswahl: DwarfStar, LibArgus, colibri. Aktualisiert am 21.7.2026.

32 Tools88% mit Gratiszugang

32

32 Tools

28

Kostenlos

6

Freemium

2

Kostenlose Testversion

Top free AI tools in this category with free credits or a free plan.

DwarfStar logo

Eine spezialisierte lokale Inferenz-Engine für große Sprachmodelle, optimiert für Apple Silicon und SSD-Streaming auf speicherbegrenzten Systemen.

LibArgus logo

Einheitliche, null-allokierende native KI-Inferenz-Laufzeit für Java, die LLM-, Vision- und Sprach-Pipelines über Project Panama konsolidiert.

colibri logo

Eine ablauffreie C-Engine, die Expertengewichte von der Festplatte streamt, um das 744B-Parameter-Modell GLM-5.2 MoE auf Consumer-Hardware mit nur 25 GB RAM auszuführen.

Opper AI logo

Ein einheitliches KI-Gateway, das Zugriff auf über 300 führende Modelle über eine in der EU gehostete, DSGVO-konforme API mit einer OpenAI SDK-kompatiblen Schnittstelle bietet.

Kostenlos
L

Ein browserbasiertes Instrument, das die Jacobi-Linse nutzt, um interne Konzepte von Sprachmodellen in Echtzeit zu lesen.

Frugon logo

Frugon ist ein kostenloser Open-Source-LLM-Kostenanalysator, der erkennt, wo Ihre LLM-Rechnung undicht ist, indem er Ihre Anrufprotokolle lokal analysiert.

Swarm logo

Ein Swift-Framework zur Erstellung zustandsbehafteter, Multi-Agent-KI-Workflows mit typsicheren Werkzeugen, Crash-Resilienz und nativer Nebenläufigkeit.

mlx-serve logo

Führen Sie jedes LLM lokal auf Ihrem Mac aus, schneller als LM Studio oder Ollama, mit Chat, Codierungsagenten, Bildern, Videos und Sprache – alles komplett offline und Open Source.

AXIOM logo

AXIOM ist ein bootbarer Rust-Kernel, der die Transformer-Inferenz optimiert, indem er allgemeine Betriebssystemabstraktionen durch inferenzspezifische Primitive ersetzt.

Beste kostenlose Tools für KI Große Sprachmodelle (LLMs)

Alle Tools
DwarfStar logo

Eine spezialisierte lokale Inferenz-Engine für große Sprachmodelle, optimiert für Apple Silicon und SSD-Streaming auf speicherbegrenzten Systemen.

LibArgus logo

Einheitliche, null-allokierende native KI-Inferenz-Laufzeit für Java, die LLM-, Vision- und Sprach-Pipelines über Project Panama konsolidiert.

colibri logo

Eine ablauffreie C-Engine, die Expertengewichte von der Festplatte streamt, um das 744B-Parameter-Modell GLM-5.2 MoE auf Consumer-Hardware mit nur 25 GB RAM auszuführen.

Opper AI logo

Ein einheitliches KI-Gateway, das Zugriff auf über 300 führende Modelle über eine in der EU gehostete, DSGVO-konforme API mit einer OpenAI SDK-kompatiblen Schnittstelle bietet.

Kostenlos
Auriko logo

Eine einheitliche API-Plattform für LLM-Inferenz mit Kostenoptimierung, Routing, Beobachtbarkeit und automatischer Ausfallsicherung.

L

Ein browserbasiertes Instrument, das die Jacobi-Linse nutzt, um interne Konzepte von Sprachmodellen in Echtzeit zu lesen.

Frugon logo

Frugon ist ein kostenloser Open-Source-LLM-Kostenanalysator, der erkennt, wo Ihre LLM-Rechnung undicht ist, indem er Ihre Anrufprotokolle lokal analysiert.

Swarm logo

Ein Swift-Framework zur Erstellung zustandsbehafteter, Multi-Agent-KI-Workflows mit typsicheren Werkzeugen, Crash-Resilienz und nativer Nebenläufigkeit.

mlx-serve logo

Führen Sie jedes LLM lokal auf Ihrem Mac aus, schneller als LM Studio oder Ollama, mit Chat, Codierungsagenten, Bildern, Videos und Sprache – alles komplett offline und Open Source.

AXIOM logo

AXIOM ist ein bootbarer Rust-Kernel, der die Transformer-Inferenz optimiert, indem er allgemeine Betriebssystemabstraktionen durch inferenzspezifische Primitive ersetzt.

Lightning Rod logo

Lightning Rod trainiert kleine KI-Modelle auf unstrukturierten realen Daten, um Ergebnisse in Sport, Politik, Finanzen und mehr vorherzusagen und bietet eine kosteneffektive Alternative zu Spitzenmodellen.

discode.ai logo

Eine einheitliche Chat-Oberfläche, die Zugriff auf über 100 KI-Modelle bietet, automatisch das beste Modell für Ihre Aufgabe auswählt, den Energieverbrauch verfolgt und Ihre Privatsphäre schützt.

Kostenlos
NanoEuler logo

NanoEuler ist ein quelloffenes GPT-2-ähnliches Sprachmodell, das vollständig von Grund auf in C/CUDA mit handgeschriebenem Backprop, BPE-Tokenizer, FlashAttention und Trainingspipelines erstellt wurde.

PSI KV Governor logo

Eine Referenzimplementierung, die Linux Pressure Stall Information nutzt, um den KV-Cache von LLMs bei Speicherdruck zu trimmen.

Oxlo.ai logo

Oxlo.ai ist eine datenschutzorientierte KI-Inferenz-API, die eine anfragebasierte Preisgestaltung für über 45 Open-Source-Modelle bietet.

Kostenlos
Graphsignal logo

Graphsignal ist eine Produktions-Inferenz-Profiling-Plattform, die Ingenieuren hilft, die KI-Leistung über Modelle, Engines, GPUs und andere Beschleuniger hinweg zu optimieren.

Kostenlos
Transformer Primitives logo

Ein interaktiver visueller Minikurs, der die Transformer-Architektur von Grund auf erklärt, basierend auf dem Paper 'Attention Is All You Need'.

MyLLM Connect logo

Kostenloser Open-Source-Desktop-Begleiter, der ein privates KI-Backend auf Mac/PC betreibt und die MyLLM iOS App über vertrauenswürdiges HTTPS via Tailscale verbindet.

Quant Picker logo

Quant Picker hilft Ihnen, die optimale GGUF-Quantisierung für Ihr LLM auszuwählen, indem es Qualität, Kontextlänge und Geschwindigkeit basierend auf Ihrer Hardware abwägt.

ZeroGPU logo

ZeroGPU ist eine Compute-Effizienzschicht, die KI-Anwendungen und -Agenten hilft, Kosten zu senken, indem sie hochvolumige Inferenzaufgaben über ein Edge-gestütztes Netzwerk an spezialisierte kleine Sprachmodelle weiterleitet.

Claude Fable 5 logo

Anthropics Claude Fable 5 ist ein modernstes KI-Sprachmodell mit außergewöhnlicher Leistung in Programmierung, Analytik, Bilderkennung und Forschung, das fortschrittliche Sicherheitsklassifikatoren umfasst.

Ollama logo

Ollama ist eine Plattform zum lokalen Ausführen großer Sprachmodelle und zum Skalieren in die Cloud, die Zugriff auf schnellere, größere Modelle mit parallelen Anfragen und Echtzeit-Webinformationen bietet.

DeepSeek logo

Ein kostenloser KI-Chatbot, der von einem großen Sprachmodell für Konversation, Programmierung und kreative Aufgaben angetrieben wird.

Uncensored AI logo

Uncensored AI ist ein KI-Modell-Hub und eine Chat-Plattform mit Zugriff auf mehrere große Modelle, einschließlich uncensored Varianten, sowie einer API in privater Beta.

ApX Machine Learning logo

ApX Machine Learning ist eine Bildungsplattform zum Erlernen von maschinellem Lernen, großen Sprachmodellen und praktischer KI-Entwicklung durch Kurse, Anleitungen, Werkzeuge und Modellrankings.

ChatHub logo

ChatHub ermöglicht es dir, Antworten mehrerer führender KI-Modelle direkt nebeneinander in einer App zu vergleichen.

Atlas Cloud logo

Atlas Cloud ist eine Full-Modal AI Inference Platform, die eine API für Chat-, Bild-, Video- und Audio-Modelle bietet.

Kostenlos
CanIRun.ai logo

Ein browserbasiertes Tool, das schätzt, welche lokalen AI-Modelle dein Computer basierend auf den Gerätefähigkeiten ausführen kann.

Groq logo

Groq bietet schnelle, kostengünstige KI-Inferenz über GroqCloud und seinen eigenen LPU-Stack.

Kostenlos
Vast.ai logo

Vast.ai ist eine API-native GPU-Cloud zum Mieten von On-Demand-Compute mit Echtzeit-Preisen und Abrechnung pro Sekunde.

Arena AI logo

Arena AI ist eine offizielle Website zur Rangliste von KI-Modellen und ein LLM-Leaderboard, um die Leistung von Modellen zu vergleichen und zu verfolgen.

Recently Added Tools für KI Große Sprachmodelle (LLMs)

The newest Tools für KI Große Sprachmodelle (LLMs) added to our directory.

DwarfStar logo

Eine spezialisierte lokale Inferenz-Engine für große Sprachmodelle, optimiert für Apple Silicon und SSD-Streaming auf speicherbegrenzten Systemen.

LibArgus logo

Einheitliche, null-allokierende native KI-Inferenz-Laufzeit für Java, die LLM-, Vision- und Sprach-Pipelines über Project Panama konsolidiert.

colibri logo

Eine ablauffreie C-Engine, die Expertengewichte von der Festplatte streamt, um das 744B-Parameter-Modell GLM-5.2 MoE auf Consumer-Hardware mit nur 25 GB RAM auszuführen.

Popular Use Cases for Tools für KI Große Sprachmodelle (LLMs)

The most common use cases across 32 Tools für KI Große Sprachmodelle (LLMs).

Lokales Ausführen großer Sprachmodelle auf Apple Silicon MacsDatenschutzfreundliche Inferenz ohne Cloud-AbhängigkeitenEntwicklung und Testen von LLM-AnwendungenForschung zu Modellquantisierung und StreamingAufbau latenzarmer KI-Chatbots und virtueller Assistenten in JavaEntwicklung multimodaler Anwendungen, die Text, Bilder, Audio und Video verarbeitenErstellung von Sprach-zu-Text- und Text-zu-Sprache-Pipelines für UnternehmensanwendungenImplementierung von GC-freier Modellinferenz für Hochfrequenzhandel oder Echtzeitsysteme

Common Features in Tools für KI Große Sprachmodelle (LLMs)

The most frequently featured capabilities across Tools für KI Große Sprachmodelle (LLMs).

Natives Modell-Laden für DeepSeek V4, Qwen3.6 und GLM 5.2Adaptive Metal-Residency und SSD-Streaming für speicherbegrenzte SystemeHTTP-Server mit Tool-Aufruf und Coding-AgentRAM- und On-Disk-KV-ZustandsverwaltungGGUF-Tooling für Quantisierung und KalibrierungGemischte-Präzision-Routed-Expert-UnterstützungKorrektheits- und Geschwindigkeits-BenchmarksInferenz mit Null-Allokation über Project Panama FFM APIEinheitliche Laufzeit für LLM, ASR, TTS und multimodale ModelleProzessglobales Backend zur Beseitigung von VRAM-FragmentierungEntkoppelte Gewichte und Ausführung für gleichzeitige SitzungenSpekulative Dekodierung und Multi-Token-Prädiktionsunterstützung

Häufige Fragen zu kostenlosen Tools für KI Große Sprachmodelle (LLMs)

Vergleiche, ob ein Tool kostenlos, freemium oder testbasiert ist. Prüfe dann Funktionen, Einsatzbereiche, Preise und Alternativen.

Verwandte KI-Kategorien

Entdecke weitere kostenlose KI-Software in ähnlichen Kategorien.

Kategorien