واجهة برمجة تطبيقات الذكاء الاصطناعي

llmproxy

وكيل خفيف وعالي الأداء لـ LLM للتخزين المؤقت، وتجاوز الفشل، وتتبع التكاليف، والتكامل السلس بين موفري الذكاء الاصطناعي المحليين والسحابيين.

ما هو llmproxy؟

llmproxy هو خادم Flask مفتوح المصدر يحاكي واجهات HTTP الخاصة بـ Ollama وOpenAI وllama.cpp، ويعيد توجيه الطلبات إلى واجهة NVIDIA المتوافقة مع OpenAI للتكامل السلس دون تغييرات من جانب العميل.

llmproxy مقارنة بأدوات مماثلة

نموذج التسعيرمجانيتسعير مخصصمجانيمجاني, فريميوم
أرصدة مجانية
الميزات الرئيسية
  • محاكاة واجهات Ollama وOpenAI وllama.cpp
  • إعادة توجيه شفافة إلى واجهة NVIDIA المتوافقة مع OpenAI
  • تخزين مؤقت اختياري للاستجابات مع مدة صلاحية وحجم قابلين للتكوين
  • وقت تشغيل على مستوى المؤسسات مع توفر عالٍ
  • هوية ووصول مرنان (SAML, OAuth)
  • عزل المستأجرين مع أوقات تشغيل وبيانات اعتماد وسجلات تدقيق منفصلة
  • حقن شفاف لبيانات الاعتماد لعوامل الذكاء الاصطناعي
  • تخزين مشفر للأسرار باستخدام AES-256-GCM أثناء الثبات
  • مطابقة المضيف والمسار لتوجيه الأسرار إلى نقاط النهاية
  • تشفير من طرف إلى طرف باستخدام AES-256-GCM
  • نقل ملفات بين وكيل وآخر عبر MCP
  • رفع ملفات يصل إلى 100 ميجابايت
المزايا
  • خفيف وسهل النشر عبر Docker
  • يخزن الاستجابات مؤقتًا لتقليل استدعاءات API وزمن الانتقال
  • أمان وحوكمة على مستوى المؤسسات مدمجة
  • عزل متعدد المستأجرين لمقدمي الخدمات السحابية
  • مفتوح المصدر ومستضاف ذاتيًا، مما يمنح تحكمًا كاملاً في بيانات الاعتماد
  • إعداد سهل بتثبيت من سطر واحد أو Docker
  • تشفير من طرف إلى طرف
  • لا نصوص واضحة على الخادم
العيوب
  • يعيد التوجيه فقط إلى API NVIDIA؛ لا يدعم موفري سحابة آخرين
  • يتطلب مفتاح NVIDIA API صالحًا
  • التسعير غير شفاف ويتطلب الاتصال بالمبيعات
  • يتطلب خبرة فنية لإعداد وتكوين سير العمل
  • محدودة حاليًا إلى وضع مستخدم واحد محلي افتراضيًا؛ إعداد OAuth يتطلب تهيئة إضافية
  • تتطلب بنية تحتية للاستضافة الذاتية (Docker/PostgreSQL)
  • محدود بـ 100 ميجابايت في الطبقة المجانية
  • تنتهي صلاحية الروابط بعد 24 ساعة (قد تكون قصيرة جدًا للبعض)
مناسب لـ
  • المطورين الذين يدمجون نماذج NVIDIA LLM في سير العمل الحالي
  • مستخدمي Open WebUI أو curl أو SDKs الذين يرغبون في الاستفادة من نماذج NVIDIA
  • المؤسسات التي تحتاج إلى منصة تكامل آمنة وقابلة للحوكمة
  • شركات الخدمات السحابية التي تتطلب تكامل متعدد المستأجرين للعملاء
  • المطورون الذين يبنون عوامل ذكاء اصطناعي تحتاج إلى وصول آمن لواجهات برمجة التطبيقات
  • الفرق التي تدير نشر عوامل ذكاء اصطناعي متعددة بنطاقات مختلفة لبيانات الاعتماد
  • مطوري وكلاء الذكاء الاصطناعي
  • فرق DevOps لأتمتة نقل الملفات بين الوكلاء

طريقة استخدام llmproxy

  1. 1قم بتكوين مفتاح NVIDIA API في ملف .env.
  2. 2قم بتشغيله باستخدام Docker Compose: docker compose up -d.
  3. 3اختبر باستخدام curl: curl http://localhost:11434/.

الميزات الرئيسية في llmproxy

  • محاكاة واجهات Ollama وOpenAI وllama.cpp
  • إعادة توجيه شفافة إلى واجهة NVIDIA المتوافقة مع OpenAI
  • تخزين مؤقت اختياري للاستجابات مع مدة صلاحية وحجم قابلين للتكوين
  • تجاوز الفشل وإعادة المحاولة تلقائيًا عند أخطاء المصب المؤقتة
  • لوحة معلومات /stats للقياسات ومراقبة العملية
  • دعم المصادقة الواردة
  • اكتشاف نماذج متعددة
  • دعم البث للمحادثة والإكمال

حالات استخدام llmproxy

  • دمج أدوات LLM المحلية مع نماذج NVIDIA المستضافة على السحابة بدون تعديلات على العميل
  • مراقبة وتتبع تكاليف واستخدام API عبر لوحة المعلومات
  • تقليل زمن الانتقال واستدعاءات API باستخدام التخزين المؤقت للاستجابات لطلبات غير البث

أسعار llmproxy والأرصدة المجانية

يعمل llmproxy بنموذج مجاني.

هذه الأداة مجانية بالكامل

مجاني

$0

رخصة MIT مفتوحة المصدر

مزايا وعيوب llmproxy

المزايا

  • خفيف وسهل النشر عبر Docker
  • يخزن الاستجابات مؤقتًا لتقليل استدعاءات API وزمن الانتقال
  • تجاوز الفشل وإعادة المحاولة التلقائيان يحسنان الموثوقية
  • يوفر تتبع التكاليف وقياسات حية
  • يعمل مع العملاء الحاليين دون تغييرات

العيوب

  • يعيد التوجيه فقط إلى API NVIDIA؛ لا يدعم موفري سحابة آخرين
  • يتطلب مفتاح NVIDIA API صالحًا
  • التخزين المؤقت فقط للاستجابات غير البثية

لأي استخدام يناسب llmproxy أكثر؟

  • المطورين الذين يدمجون نماذج NVIDIA LLM في سير العمل الحالي
  • مستخدمي Open WebUI أو curl أو SDKs الذين يرغبون في الاستفادة من نماذج NVIDIA
  • الفرق التي تحتاج إلى تتبع التكاليف والتخزين المؤقت لاستدعاءات API LLM

أسئلة شائعة عن llmproxy

بدائل مجانية لـ llmproxy

TwelveLabs logo

TwelveLabs هي منصة ذكاء فيديو تمكن المطورين من البحث والتحليل وفهم محتوى الفيديو باستخدام نماذج ذكاء اصطناعي قوية عبر واجهة برمجة التطبيقات.

مجاني
Agentcard logo

توفر Agentcard بنية تحتية لإصدار البطاقات والمدفوعات صديقة للوكلاء للوكلاء الذكاء الاصطناعي، مما يتيح الإعداد في 5 دقائق والمشتريات المستقلة.

مجاني
Opper AI logo

بوابة ذكاء اصطناعي موحدة توفر الوصول إلى أكثر من 300 نموذج رائد عبر واجهة برمجة تطبيقات واحدة مستضافة في الاتحاد الأوروبي ومتوافقة مع اللائحة العامة لحماية البيانات (GDPR) مع واجهة متوافقة مع SDK من OpenAI.

مجاني
D

Dike هي بوابة امتثال لمنتجات الذكاء الاصطناعي في الاتحاد الأوروبي، توفر تسجيلاً على مستوى التدقيق، وإشرافًا بشريًا، وإبلاغًا عن الحوادث عبر وكيل بسيط.

مجاني

أفضل بدائل أدوات الذكاء الاصطناعي لـ llmproxy

Koodisi logo

كوديسي هي منصة تكامل المؤسسات (iPaaS) وأتمتة سير العمل التي تربط واجهات برمجة التطبيقات (APIs) وخوادم MCP ووكلاء الذكاء الاصطناعي مع أمان مدمج وحوكمة وعزل للمستأجرين.

OneCLI logo

بوابة اعتمادات مفتوحة المصدر وخزنة أسرار تسمح لعوامل الذكاء الاصطناعي بالوصول إلى واجهات برمجة التطبيقات دون كشف المفاتيح.

Millwright logo

Millwright هو موجه LLM مفتوح المصدر ومستضاف ذاتيًا يقوم بتوجيه طلبات الذكاء الاصطناعي إلى أرخص مزودي النماذج بناءً على السياسة، مع الحفاظ على ذاكرة التخزين المؤقت للاستفسارات والتحكم في الإنفاق.

TwelveLabs logo

TwelveLabs هي منصة ذكاء فيديو تمكن المطورين من البحث والتحليل وفهم محتوى الفيديو باستخدام نماذج ذكاء اصطناعي قوية عبر واجهة برمجة التطبيقات.

مجاني
FlexInference logo

موجه LLM يراعي المواعيد النهائية يقلل تكاليف استدلال الذكاء الاصطناعي عن طريق إيجاد مستويات خدمة أرخص تلقائيًا ضمن نافذة زمنية يحددها المستخدم.

Agentcard logo

توفر Agentcard بنية تحتية لإصدار البطاقات والمدفوعات صديقة للوكلاء للوكلاء الذكاء الاصطناعي، مما يتيح الإعداد في 5 دقائق والمشتريات المستقلة.

مجاني