deepseek/deepseek-v3.1
DeepSeek V3.1
DeepSeek-V3.1 نموذج مدرب لاحقًا انطلاقًا من DeepSeek-V3.1-Base، الذي بُني على نقطة التحقق الأساسية V3 عبر نهج من مرحلتين لتوسيع السياق الطويل وفق المنهجية الموضحة في تقرير DeepSeek-V3. وسعت DeepSeek بيانات التدريب بمستندات طويلة إضافية ومددت المرحلتين بدرجة كبيرة؛ فزادت مرحلة 32K بمقدار 10 أضعاف إلى 630 مليار رمز، ومرحلة 128K بمقدار 3.3 أضعاف إلى 209 مليارات رمز. كما دُرب النموذج باستخدام تنسيق بيانات UE8M0 FP8 لضمان التوافق مع تنسيقات القياس المصغر.
مقارنة الأسعار
دولار أمريكي لكل مليون رمز، حسب بيانات المزوّد الحالية.
زمن الاستجابة
الوسيط p50 خلال الساعة الماضية بالمللي ثانية؛ الأقل أفضل.
جاهزية المزوّد
نسبة الجاهزية المعلنة خلال آخر 24 ساعة، وليست ضماناً تعاقدياً.
مزوّدو التشغيل
قارن الأسعار والأداء والخصوصية لكل مزوّد متاح لهذا النموذج.
| المزوّد | أقصى سياق | أقصى إخراج | زمن p50 | الإنتاجية p50 | جاهزية 24 ساعة | إدخال / مليون رمز | إخراج / مليون رمز | الخصوصية |
|---|---|---|---|---|---|---|---|---|
Deepinfra | 163.8 ألف | 128 ألف | 758 ms | 11.5 t/s | 99.965% | 0.25 US$ | 0.95 US$ | |
Novita | 163.8 ألف | 163.8 ألف | — | — | 0.000% | 0.27 US$ | 1 US$ | |
Sambanova | 128 ألف | 128 ألف | — | — | 0.000% | 3 US$ | 4.5 US$ |
ما الذي يستطيع النموذج فعله؟
الوسائط والقدرات المتاحة عبر مزوّدي التشغيل.
المواصفات التقنية
- نوع النموذج
- نموذج لغوي
- تاريخ الإصدار
- 21 أغسطس 2025
- حد المعرفة
- —
- مناطق التشغيل
- —
- إصدارات API
- V2, V3, V4
- التحكم بالإبداع
- مدعوم
معرّف النموذج
deepseek/deepseek-v3.1نماذج مشابهة
خيارات أخرى من نفس المطوّر أو الفئة.
