Deepinfra
100.00%السياق262.1 ألف
أقصى إخراج262.1 ألف
زمن p50270 ms
الإنتاجية104.5 t/s
سعر الإدخال0.05 US$
سعر الإخراج0.24 US$
لا يحتفظ بالبياناتدون تدريب
nvidia/nemotron-3-nano-30b-a3b
NVIDIA Nemotron 3 Nano هو نموذج استدلال مفتوح المصدر مُحسّن للاستدلال السريع والفعال من حيث التكلفة. تم بناؤه ببنية هجينة من MoE و Mamba وتم تدريبه على بيانات استدلال اصطناعية منسقة بواسطة NVIDIA، ويوفر استدلالًا قويًا متعدد الخطوات مع زمن انتقال مستقر وأداء يمكن التنبؤ به لأعباء عمل الوكلاء والإنتاج.
دولار أمريكي لكل مليون رمز، حسب بيانات المزوّد الحالية.
الوسيط p50 خلال الساعة الماضية بالمللي ثانية؛ الأقل أفضل.
نسبة الجاهزية المعلنة خلال آخر 24 ساعة، وليست ضماناً تعاقدياً.
قارن الأسعار والأداء والخصوصية لكل مزوّد متاح لهذا النموذج.
| المزوّد | أقصى سياق | أقصى إخراج | زمن p50 | الإنتاجية p50 | جاهزية 24 ساعة | إدخال / مليون رمز | إخراج / مليون رمز | الخصوصية |
|---|---|---|---|---|---|---|---|---|
Deepinfra | 262.1 ألف | 262.1 ألف | 270 ms | 104.5 t/s | 100.000% | 0.05 US$ | 0.24 US$ |
الوسائط والقدرات المتاحة عبر مزوّدي التشغيل.
nvidia/nemotron-3-nano-30b-a3bخيارات أخرى من نفس المطوّر أو الفئة.