Yapay Zeka Büyük Dil Modelleri

colibri

Bağımlılıksız bir C motoru; 744B parametreli GLM-5.2 MoE modelini tüketici donanımında en az 25 GB RAM ile çalıştırmak için diskten uzman ağırlıklarını akışla aktarır.

colibri logo

colibri

Siteyi aç

Nedir colibri?

colibri, GLM-5.2 744B parametreli Uzman Karışımı modeli için hafif, saf C ile yazılmış bir çıkarım motorudur. Diskten uzman ağırlıklarını akışla aktarır ve çalışma zamanında Python, GPU veya harici bağımlılık gerektirmez, böylece ~25 GB RAM'e sahip bir makinede yerel çalıştırmaya olanak tanır.

colibri vs Benzer Araçlar

Fiyatlandırma ModeliÜcretsizÜcretsiz, FreemiumÜcretliÜcretli
Ücretsiz Krediler
Temel özellikler
  • Sıfır harici bağımlılıkla saf C uygulaması
  • Diskten uzman ağırlıklarının akışla aktarımı, LRU önbellek ve isteğe bağlı sabit sıcak depo
  • GLM-5.2 (glm_moe_dsa) ileri geçişi, token bazında doğrulanmış
  • Birden çok yapay zeka modeline erişim (GPT, Claude, Gemini, DeepSeek, Grok vb.)
  • Özel çalışma alanlarında ekip işbirliği
  • Bağlamsal anlama ile dosya yükleme desteği (PDF, kod, dokümanlar)
  • Tüm görevler için mod değiştirmeye gerek olmayan tek model
  • OpenAI uyumlu API
  • Değerlendirilen görevlerde Claude Fable seviyesinde kalite
  • Sınırsız token
  • Sınırsız bağlam penceresi
  • Sabit aylık fiyatlandırma
Artılar
  • Sadece 25 GB RAM ile tüketici donanımında 744B parametreli model çalıştırır
  • Açık kaynak ve tamamen şeffaf (C kodu, bağımlılık yok)
  • Tek bir platformda birden çok önde gelen yapay zeka modeline erişim
  • Yerleşik ekip işbirliği özellikleri
  • Claude Fable ile karşılaştırılabilir yüksek kalite
  • Sınır modellerine kıyasla önemli ölçüde düşük maliyet
  • Sınırsız token ve bağlam
  • Sabit öngörülebilir fiyatlandırma
Eksiler
  • Çok yavaş soğuk kod çözme (tipik NVMe'de 0,05-0,1 tok/s)
  • Dönüştürülmüş int4 modeli için ~370 GB disk alanı gerektirir
  • Ücretsiz planda sınırlı mesaj ve kredi
  • Gelişmiş özellikler ücretli abonelik gerektirir
  • Sınırlı bağımsız doğrulamaya sahip daha yeni model
  • Kesin fiyatlandırma herkese açık olarak detaylandırılmamış
  • Yüksek aylık maliyet (10.000$+)
  • 14 günlük sağlama süresi gerektirir
Kimler için uygun
  • Devasa modelleri yerel olarak çalıştırmak isteyen geliştiriciler
  • Sınırlı donanımda MoE mimarilerini keşfeden yapay zeka araştırmacıları
  • Farklı yapay zeka model erişimine ihtiyaç duyan ekipler
  • İçerik oluşturucular ve araştırmacılar
  • Düşük maliyetle yüksek kaliteli LLM arayan geliştiriciler
  • Tek bir çok yönlü modele ihtiyaç duyan ekipler
  • Yapay zeka ajanlarını ölçekli olarak çalıştıran kurumsal ekipler
  • Uzun vadeli kod üretimi gerektiren yazılım mühendisliği ekipleri

Nasıl kullanılır colibri?

  1. 1Depoyu klonlayın: git clone https://github.com/JustVugg/colibri.git
  2. 2Motoru derleyin: cd c && make
  3. 3FP8 modelini int4'e dönüştürün: ./coli convert --model /path/to/model
  4. 4Sohbeti başlatın: COLI_MODEL=/path/to/model ./coli chat
  5. 5(İsteğe bağlı) Grafik arayüz için web UI veya OpenAI uyumlu sunucuyu kullanın.

colibri Temel özellikler

  • Sıfır harici bağımlılıkla saf C uygulaması
  • Diskten uzman ağırlıklarının akışla aktarımı, LRU önbellek ve isteğe bağlı sabit sıcak depo
  • GLM-5.2 (glm_moe_dsa) ileri geçişi, token bazında doğrulanmış
  • Sıkıştırılmış KV önbellek ile MLA dikkat (57 kat daha küçük)
  • İleri geçiş başına 2,8 token'a kadar yerel MTP spekülatif kod çözme
  • AVX2 hızlandırmalı tamsayı nokta çekirdekleri (int8/int4)
  • Kullanım desenlerine uyum sağlayan çevrimiçi öğrenme önbelleği

colibri Kullanım senaryoları

  • Tüketici dizüstü veya masaüstü bilgisayarda 744B parametreli MoE modeli çalıştırma
  • Bulut bağımlılığı olmadan çevrimdışı sohbet ve çıkarım
  • Büyük MoE mimarileri ile araştırma ve deney yapma
  • Sınırlı donanımda sınır model yeteneklerinin eğitim amaçlı gösterimi

colibri Fiyatlar ve ücretsiz krediler

colibri, Ücretsiz modeliyle çalışır.

Açık Kaynak

Ücretsiz

Apache 2.0 lisansı. Kullanım veya değişiklik için ücret yok.

colibri Artılar ve eksiler

Artılar

  • Sadece 25 GB RAM ile tüketici donanımında 744B parametreli model çalıştırır
  • Açık kaynak ve tamamen şeffaf (C kodu, bağımlılık yok)
  • Önbellekleme ile verimli disk akışı uzun süreli kullanım sağlar
  • Aktif topluluk kıyaslamaları ve iyileştirmeleri

Eksiler

  • Çok yavaş soğuk kod çözme (tipik NVMe'de 0,05-0,1 tok/s)
  • Dönüştürülmüş int4 modeli için ~370 GB disk alanı gerektirir
  • Yalnızca GLM-5.2 modelini destekler (çoklu model esnekliği yok)
  • CUDA arka ucu deneysel ve sınırlıdır

colibri en çok ne için uygundur?

  • Devasa modelleri yerel olarak çalıştırmak isteyen geliştiriciler
  • Sınırlı donanımda MoE mimarilerini keşfeden yapay zeka araştırmacıları
  • Bulut maliyeti olmadan sınır model çıkarımıyla ilgilenen meraklılar

colibri hakkında SSS

colibri için ücretsiz alternatifler

Opper AI logo

300'den fazla lider modele tek bir API ile erişim sağlayan, AB'de barındırılan, GDPR uyumlu ve OpenAI SDK ile uyumlu birleşik bir AI ağ geçidi.

Ücretsiz
discode.ai logo

Tümleşik bir sohbet arayüzü ile 100'den fazla AI modeline erişim sağlar, göreviniz için en iyi modeli otomatik olarak seçer, enerji kullanımını izler ve gizliliğinizi korur.

Ücretsiz
Oxlo.ai logo

Oxlo.ai, 45'ten fazla açık kaynak model için istek tabanlı fiyatlandırma sunan, gizlilik öncelikli bir AI çıkarım API'sidir.

Ücretsiz
Graphsignal logo

Graphsignal, mühendislerin yapay zeka performansını modeller, motorlar, GPU'lar ve diğer hızlandırıcılar arasında optimize etmesine yardımcı olan üretim ölçeğinde bir çıkarım profilleme platformudur.

Ücretsiz

colibri için en iyi AI alternatifleri

Aymo AI logo

Ekipler için çoklu yapay zeka modellerine (GPT, Claude, Gemini vb.) güvenli ve işbirlikçi bir çalışma alanında erişim sağlayan hepsi bir arada yapay zeka platformu.

EB

Echo, Claude sınıfı performansı üçte bir maliyetle sunan, sohbet, kod ve ajan görevlerine uyarlanabilen açık ağırlıklı bir AI modelidir.

L

LiquidBrain.ai, sabit aylık fatura ile sınırsız token ve bağlam yapay zeka çıkarımı sunar; patentli dağıtık çıkarım motoru sayesinde özel, ölçeklenebilir model dağıtımı sağlar.

DwarfStar logo

Büyük dil modelleri için özel bir yerel çıkarım motoru, Apple Silicon ve bellek kısıtlı sistemlerde SSD akışı için optimize edilmiştir.

Opper AI logo

300'den fazla lider modele tek bir API ile erişim sağlayan, AB'de barındırılan, GDPR uyumlu ve OpenAI SDK ile uyumlu birleşik bir AI ağ geçidi.

Ücretsiz
Auriko logo

Birden çok LLM sağlayıcısına yönelik, maliyet optimizasyonu, yönlendirme, gözlemlenebilirlik ve otomatik yük devretme sunan birleşik bir API platformu.