Yapay Zeka API
llmproxy
Ollama, OpenAI ve llama.cpp API'lerini taklit eden, NVIDIA'nın uyumlu API'sine şeffaf yönlendirme yapan hafif ve yüksek performanslı bir LLM vekil sunucusu.
llmproxy
Nedir llmproxy?
llmproxy, Ollama, OpenAI ve llama.cpp'nin HTTP API'lerini taklit eden, istekleri NVIDIA'nın OpenAI uyumlu API'sine yönlendiren ve istemci tarafında değişiklik gerektirmeyen açık kaynaklı bir Flask sunucusudur.
llmproxy vs Benzer Araçlar
| Fiyatlandırma Modeli | Ücretsiz | Özel fiyatlandırma | Ücretsiz | Ücretsiz, Freemium |
| Ücretsiz Krediler | ||||
| Temel özellikler |
|
|
|
|
| Artılar |
|
|
|
|
| Eksiler |
|
|
|
|
| Kimler için uygun |
|
|
|
|
Nasıl kullanılır llmproxy?
- 1.env dosyasına NVIDIA API anahtarınızı yapılandırın.
- 2Docker Compose ile çalıştırın: docker compose up -d.
- 3curl ile test edin: curl http://localhost:11434/.
llmproxy Temel özellikler
- Ollama, OpenAI ve llama.cpp API'lerini taklit eder
- NVIDIA'nın OpenAI uyumlu API'sine şeffaf yönlendirme
- Yapılandırılabilir TTL ve boyut ile isteğe bağlı yanıt önbellekleme
- Geçici yukarı akış hatalarında otomatik yük devretme ve yeniden deneme
- Metrikler ve süreç izleme için canlı /stats panosu
- Gelen kimlik doğrulama desteği
- Çoklu model keşfi
- Sohbet ve tamamlama için akış desteği
llmproxy Kullanım senaryoları
- Yerel LLM araçlarını NVIDIA bulut modelleriyle istemci değişikliği olmadan entegre etme
- API maliyetlerini ve kullanımını istatistik panosuyla izleme ve takip etme
- Akış olmayan istekler için yanıt önbellekleme ile gecikmeyi ve API çağrılarını azaltma
llmproxy Fiyatlar ve ücretsiz krediler
llmproxy, Ücretsiz modeliyle çalışır.
Bu araç tamamen ücretsizdir
llmproxy Artılar ve eksiler
Artılar
- Hafif ve Docker ile kolay dağıtım
- API çağrılarını ve gecikmeyi azaltmak için yanıtları önbelleğe alır
- Otomatik yük devretme ve yeniden denemeler güvenilirliği artırır
- Maliyet takibi ve canlı metrikler sunar
- Mevcut istemcilerle değişiklik yapmadan çalışır
Eksiler
- Yalnızca NVIDIA API'sine yönlendirir; başka bulut sağlayıcı desteği yok
- Geçerli bir NVIDIA API anahtarı gerektirir
- Önbellekleme yalnızca akış olmayan yanıtlar içindir
llmproxy en çok ne için uygundur?
- NVIDIA LLM'lerini mevcut iş akışlarına entegre eden geliştiriciler
- NVIDIA modellerinden yararlanmak isteyen Open WebUI, curl veya SDK kullanıcıları
- LLM API çağrıları için maliyet takibi ve önbellekleme ihtiyacı olan ekipler