نظرة عامة على الأداة
Inferless مدرجة ضمن بنية الذكاء الاصطناعي وعمليات تعلم الآلة ضمن أدوات الذكاء الاصطناعي.
ما هو Inferless؟
يجهز المطور النموذج أو الحاوية وينشر Endpoint ويضبط التوسع والتزامن ثم يدفع فقط أثناء تشغيل موارد GPU.
الأنسب لـ
المطورون الذين ينشرون نقاط نماذج GPU متقطعة
لمن تناسب؟
مهندسو تعلم الآلة مطورو الذكاء الاصطناعي التوليدي شركات AI الناشئة فرق المنصات
ملاحظة القرار
أُعيد بناء الصف من ملف التصدير الأصلي وفق مسار V412/V411 الكامل للتحقق من المصادر. يُستخدم Preview فقط. يبقى Apply محظورًا حتى تكون الإخفاقات والتحذيرات والحقول غير المعروفة والمفقودة صفرًا، وتُراجع عمليات المسح، ويُعطل استيراد الصور أو ينجح V380، وتُقارن شاشة تحرير ممثلة، ثم ينجح Preview صفري بعد Apply.
أبرز المميزات
فوترة GPU بالثانية
نسخ T4 وA10 وA100 جزئية أو مخصصة
توسع إلى الصفر وتزامن قابل للضبط
حاويات Docker مخصصة وتدفقات مستودعات النماذج
حالات الاستخدام
نشر واجهات نماذج توليدية وتعلم آلي
خدمة نماذج الصور واللغة والصوت والرؤية
تشغيل أحمال GPU متقطعة
استبدال نقاط GPU الدائمة
نقاط القوة
- يبدأ من 0.33 دولار لكل ساعة GPU
- رصيد حوسبة ترويجي دون بطاقة
- لا تكلفة عند عدم تشغيل العمال مع حد أدنى صفر
القيود
تعرض صفحة الأسعار عبارة عشر ساعات وعبارة رصيد 30 دولارًا؛ ينبغي تأكيد المنحة الحالية عند التسجيل.
لا يلغي العزل ضرورة حماية كود النموذج والبيانات ومفاتيح API.
تفاصيل التسعير
خيارات الدفع
استخدام GPU بالثانية رسوم تخزين إضافية اتفاقية حجم Enterprise
ملاحظة التسعير
يبدأ T4 المشترك من 0.000092 دولار في الثانية أو 0.33 دولار في الساعة، وA10 من 0.61 وA100 من 2.68. تعرض الصفحة حوسبة بداية ورصيد 30 دولارًا، ويجب تأكيد المنحة الفعلية في الحساب.
التكاملات
نماذج Hugging Face
مستودعات GitHub
حاويات Docker
تدفقات تخزين AWS
بيئات مخصصة
يرجى تسجيل الدخول للمشاركة في النقاش.