DeepSeek V4.1 Flash يحلّ محلّ قصة البيتا القصيرة العمر بإصدار إنتاجي مبني على الحوسبة غير المتماثلة، وتعدد الوسائط الأصلي، ومعايير أقوى للوكلاء، وانخفاض حاد في أسعار الـ API.
TL;DR
DeepSeek V4.1 Flash صار الآن API رسمياً ونموذجاً مفتوح الأوزان، وليس نقطة نهاية بيتا ستنتهي صلاحيتها. تقول DeepSeek إنه نموذج Mixture-of-Experts بعدد 552B من المعاملات يستخدم معمارية Causal-Encoder-Decoder جديدة. لا يتم تفعيل سوى 8B من المعاملات أثناء معالجة الإدخال، فيما يتم تفعيل 16B أثناء توليد المخرجات. يهدف هذا التصميم غير المتماثل إلى إنفاق قدر أقل من الحوسبة على المطالبات الطويلة دون إضعاف مرحلة التوليد الذات الانحدار.
اسم نموذج الـ API الإنتاجي هو deepseek-flash. يدعم نافذة سياق 1M من الرموز، حتى 384K من رموز الإخراج، وضعي التفكير وغير التفكير، مخرجات JSON، استدعاء الأدوات، Responses API، الـ API المتوافق مع Anthropic، والإدخال البصري الأصلي. تُظهر جدول المقاييس الرسمي لدى DeepSeek مكاسب مادية مقارنة بكل من V4 Flash 0731 وV4 Pro 0813 في مهام البرمجة والوكلاء والأمن السيبراني والمهام متعددة الوسائط.
التغيير في التسعير مهم بالقدر نفسه. في أوقات الذروة، يكلف V4.1 Flash $0.006 لكل مليون رمز إدخال مخزّن مؤقتاً (cache-hit)، و$0.30 لكل مليون رمز إدخال غير مخزّن مؤقتاً (cache-miss)، و$1.20 لكل مليون رمز إخراج. الأسعار خارج أوقات الذروة أقل بنسبة 50%.
Key Takeaways
- DeepSeek V4.1 Flash نموذج مُطلق بأوزان مفتوحة؛ لم يعد المعرف المؤقت
deepseek-v4.1-flash-expires-on-0910مرجع الإنتاج الصحيح. - يعتمد تصميم MoE بسعة 552B مع تنشيط 8B للإدخال و16B للإخراج، ما يخلق ملف كفاءة مختلفاً عن معمارية V4 Flash ذات إجمالي 284B/نشط 13B.
- تعددية الوسائط الأصلية جزء من النموذج الرئيسي بدلاً من فرع Vision Exp منفصل.
- تُظهر المقارنة الرسمية أن V4.1 Flash يتقدم على V4 Pro 0813 في معظم معايير الوكلاء والبرمجة المختارة، رغم أنه لا يتصدر كل معايير المعرفة أو الطرفيات مقارنة بكل المنافسين المتقدمين.
- ينخفض التخزين المؤقت العالمي KV إلى 890 بايت لكل رمز، أي أصغر بنحو 3.9 مرات من V4 Flash وبحوالي ربع بصمته السابقة.
- أسعار API في أوقات الذروة هي $0.006 لإدخال cache-hit، و$0.30 لإدخال cache-miss، و$1.20 للإخراج لكل مليون رمز؛ الأسعار خارج الذروة أقل بنسبة 50%.
What Is DeepSeek V4.1 Flash?
DeepSeek V4.1 Flash هو نموذج الأساس الذي أطلقته DeepSeek في سبتمبر 2026 مع تركيز على الكفاءة في الاستدلال، والبرمجة، والوكلاء، وفهم الوسائط المتعددة. يصفه الإعلان الرسمي بأنه نموذج MoE بعدد 552B من المعاملات يعزز الإمكانات مع تقليل مقدار الحوسبة والذاكرة المطلوبة لمعالجة الإدخال.
التغيير الرئيس معماري. كان V4 Flash سابقاً يستخدم ميزانية المعاملات النشطة نفسها عبر عملية الاستدلال بأكملها. يفصل V4.1 Flash بين عبء الإدخال والإخراج: 8B معاملات نشطة عند ترميز المطالبة و16B معاملات نشطة أثناء توليد الإجابة. تطلق DeepSeek على هذا التصميم Causal-Encoder-Decoder.
| Date | Status | Model ID |
|---|---|---|
| Sep 8 | Limited beta | deepseek-v4.1-flash-expires-on-0910 |
| Sep 10 | Production release | deepseek-flash |
DeepSeek V4.1 Flash Specification:
| Specification | DeepSeek V4.1 Flash |
|---|---|
| Release status | إصدار API رسمي ونموذج مفتوح الأوزان |
| Architecture | Mixture-of-Experts مع بنية Causal-Encoder-Decoder |
| Total parameters | 552B |
| Activated parameters | 8B للإدخال؛ 16B للإخراج |
| Context window | 1M tokens |
| Maximum output | 384K tokens |
| Input modalities | نصوص وصور |
| Output modality | نص |
| Production API model name | deepseek-flash |
| Thinking modes | وضعا التفكير وغير التفكير |
| API features | مخرجات JSON، استدعاء الأدوات، Responses API، Anthropic API، إكمال prefix، وإكمال FIM |
| Open weights | مُصدرة على Hugging Face |
How Does the DeepSeek V4.1 Flash Work: Causal-Encoder-Decoder
تستخدم النماذج اللغوية ذات وحدات فك الترميز فقط عادةً المكدس الكبير نفسه لمعالجة المطالبة وتوليد الرموز. يخصص DeepSeek V4.1 Flash سعة نشطة مختلفة لهاتين المرحلتين.
أثناء مرحلة الإدخال، يعالج النموذج المطالبة ببصمة نشطة قدرها 8B. يمكن لهذه المرحلة فحص سياق النص أو الصورة المُقدم بكفاءة لأن الإجابة الكاملة لم تُولّد بعد. أثناء مرحلة الإخراج، يُفعّل النموذج 16B من المعاملات ويواصل التوليد السببي رمزاً تلو الآخر. يوفر التصميم بالتالي حوسبة في ترميز المطالبة مع الحفاظ على سعة نشطة أكبر للاستدلال وتوليد الاستجابة.
لم تنشر DeepSeek كل تفاصيل التنفيذ في الإعلان، لذا فإن الوصف الأكثر أماناً هو وصفي وظيفي: المعمارية غير متماثلة، تستخدم مرحلتا الإدخال والإخراج ميزانيات معاملات نشطة مختلفة، والنظام الناتج يقلل ذاكرة الاستدلال والكلفة.
KV Cache Reduction
النتيجة على مستوى الذاكرة قابلة للقياس. تفيد DeepSeek بأن التخزين المؤقت العالمي KV يبلغ 890 بايت لكل رمز في V4.1 Flash، مقارنة بـ 3,514 بايت في V4 Flash، و48,068 بايت في V3.2، و389,120 بايت في V1. يمثل رقم V4.1 انخفاضاً بنحو 3.9 مرات مقارنة بـ V4 Flash.
بالنسبة لوكلاء السياق الطويل، يتجاوز الأثر اختباراً واحداً. يقلل التخزين المؤقت KV الأصغر الضغط على ذاكرة النطاق العريض العالي أثناء الطلب ويخفض مقدار الحالة التي يجب نقلها إلى التخزين الأبطأ. تقول DeepSeek إن V4.1 Flash يحتاج تقريباً إلى ربع ذاكرة HBM وثُمن سعة SSD المطلوبة في النموذج السابق لأعباء التخزين المؤقت المماثلة.
DeepSeek V4.1 Flash Features
Native Multimodal Input
يدعم V4.1 Flash الصور ضمن API النموذج الرئيسي. يحل هذا محل الانقسام السابق بين V4 Flash النصي فقط ونقطة النهاية التجريبية V4 Flash Vision. يمكن للمطورين الآن بناء فهم المستندات، تحليل المخططات، تفسير لقطات الشاشة، وتدفقات عمل الوكلاء المرئية باستخدام العائلة الإنتاجية نفسها.
Long-Context Reasoning
يحافظ مواصفات الـ API الرسمية على نافذة سياق 1M رمز ويسمح حتى 384K رمز إخراج. يجعل ذلك النموذج مناسباً لبرمجة على مستوى المستودعات، تحليل متعدد المستندات، جلسات الوكلاء طويلة الأمد، وتدفقات العمل التي تحتاج إلى الحفاظ على سجل أدوات كبير.
Production API Features
يدعم النموذج وضعي التفكير وغير التفكير، مخرجات JSON المهيكلة، استدعاء الأدوات، Responses API، واجهة متوافقة مع Anthropic، إكمال بادئة المحادثة، وإكمال FIM في وضع غير التفكير. تجعل هذه القدرات V4.1 Flash بديلاً إنتاجياً مباشراً للعديد من أعباء عمل الوكلاء والبرمجة في V4 Flash.
Open Weights
أصدرت DeepSeek أوزان V4.1 Flash وتقارير تقنية. يحسن الإصدار قابلية التكرار، لكن النموذج لا يزال ضخماً للغاية: يطلب إعلان DeepSeek من المؤسسات المهتمة بنشرات واسعة التخطيط لحوالي 2,000 وحدة GPU بالإضافة إلى عنقود تخزين.
DeepSeek V4.1 Flash Benchmark Performance
تغيّر النتائج الرسمية التقييم السابق الذي رأى أن V4.1 بلا أدلة مقياسية. توفر DeepSeek الآن جدولاً واسعاً يغطي المعرفة، الرياضيات، البرمجة، وكلاء الطرفيات، الأمن السيبراني، الأتمتة، ومهام الوكلاء متعددة الوسائط.

| Benchmark | DeepSeek V4.1 Flash | V4 Pro 0813 | V4 Flash 0731 |
|---|---|---|---|
| GPQA Diamond | 90.9 | 92.4 | 89.9 |
| تصنيف Codeforces | 3471 | 3348 | 3289 |
| MathArena Apex | 65.6 | 65.3 | 58.6 |
| Terminal-Bench 2.1 | 90.6 | 87.9 | 82.7 |
| DeepSWE v1.1 | 74.2 | 62.7 | 54.4 |
| NL2Repo-Bench | 65.4 | 61.5 | 54.2 |
| CyberGym | 88.1 | 83.3 | 76.7 |
| Automation-Bench | 54.8 | 43.2 | 37.7 |
عبر هذه النظرة ذات المعايير الثمانية المختارة، يتفوق V4.1 Flash على V4 Pro 0813 في سبعة اختبارات ويتفوق على V4 Flash 0731 في جميع الثمانية. تظهر أكبر المكاسب في هندسة البرمجيات والوكلاء: يرتفع DeepSWE بمقدار 11.5 نقطة فوق V4 Pro و19.8 فوق V4 Flash، بينما يتحسن Automation-Bench بمقدار 11.6 و17.1 نقطة على التوالي.
لا تزال النتائج تحتاج تفسيراً حذراً. يسجل V4.1 Flash أقل من V4 Pro على GPQA Diamond، ويُظهر المخطط الرسمي الكامل أن Claude Opus 5 وGPT-5.6 Sol لا يزالان متقدمين في Terminal-Bench 3.0. الاستنتاج المفيد هو أن V4.1 Flash يحسّن بشكل مادي توازن الكفاءة-الإمكانات لدى DeepSeek؛ لكن الجدول لا يثبت قيادة عالمية مطلقة في كل مهمة.
DeepSeek V4.1 Flash API Pricing
تستخدم DeepSeek احتساباً لأوقات الذروة وغير الذروة. ساعات الذروة هي 01:00–04:00 و06:00–10:00 بالتوقيت العالمي، من الإثنين إلى الجمعة؛ جميع الفترات الأخرى، بما فيها عطلة نهاية الأسبوع، تستخدم سعر خارج الذروة. تنص وثائق التسعير الحالية على أن أسعار خارج الذروة تساوي نصف أسعار الذروة.
| Price per 1M tokens | V4.1 Flash off-peak | V4.1 Flash peak | V4 Pro 0813 off-peak | V4 Pro 0813 peak |
|---|---|---|---|---|
| Cache-hit input | $0.003 | $0.006 | $0.022 | $0.044 |
| Cache-miss input | $0.15 | $0.30 | $0.66 | $1.32 |
| Output | $0.60 | $1.20 | $1.98 | $3.96 |

التوفير كبير. لحمولة عمل تستخدم 100 مليون رمز إدخال cache-miss و10 ملايين رمز إخراج، يكلف V4.1 Flash تقريباً $21 خارج الذروة أو $42 في أوقات الذروة. أما المزيج نفسه من الرموز وفق أسعار V4 Pro 0813 المنشورة فيكلف تقريباً $85.80 خارج الذروة أو $171.60 في أوقات الذروة. V4.1 Flash أرخص بنحو 75.5% في هذا المثال.
يعزز التخزين المؤقت للمطالبات الميزة للوكلاء الذين يعيدون استخدام تعليمات النظام، وسياق المستودعات، أو المستندات مراراً. يبلغ سعر cache-hit في V4.1 خمسين مرة أقل من cache-miss في كلا الفترتين.
DeepSeek V4.1 Flash vs V4 Flash vs V4 Pro
| Dimension | DeepSeek V4.1 Flash | DeepSeek V4 Flash | DeepSeek V4 Pro |
|---|---|---|---|
| Total parameters | 552B | 284B | 1.6T |
| Activated parameters | 8B input / 16B output | 13B | 49B |
| Architecture focus | كفاءة غير متماثلة بين الإدخال/الإخراج | V4 MoE خفيف الوزن | أقصى قدرات V4 |
| Native vision | نعم | إصدار Vision Exp منفصل | لا |
| Context window | 1M | 1M | 1M |
| Maximum output | 384K | 384K | 384K |
| API status on DeepSeek | نموذج إنتاجي حالي | متقاعد؛ الاسم القديم يوجّه إلى V4.1 Flash | مُجدول للتوجيه إلى V4.1 Flash بدءاً من 14 سبتمبر 2026 |
| Best fit | وكلاء عامون، برمجة، رؤية، إنتاجية عالية | التوافق مع الهجرة فقط | أعباء عمل Pro الحالية أثناء الانتقال |
V4.1 Flash أكبر في إجمالي المعاملات من V4 Flash لكنه قد يكون أرخص تشغيلياً لأن مرحلة الإدخال تُفعّل 8B فقط وتستخدم تخزيناً مؤقتاً KV أصغر بكثير. مقارنةً بـ V4 Pro، يُفعّل معاملات أقل بكثير مع التفوق على Pro في معظم معايير الوكلاء والبرمجة المختارة أعلاه.
API Access and Migration
اسم نموذج الإنتاج لدى DeepSeek هو deepseek-flash. يمكن للتطبيقات القائمة الاحتفاظ بعنوان الأساس المتوافق مع OpenAI وهو https://api.deepseek.com أو عنوان الأساس المتوافق مع Anthropic وهو https://api.deepseek.com/anthropic.
- حدّث اسم النموذج إلى
deepseek-flash. - احتفظ بعنوان الأساس وطريقة المصادقة الحاليين لدى DeepSeek.
- أعد اختبار وضع التفكير، واستدعاء الأدوات، ومدخلات الرؤية، والزمنيات، واستخدام الرموز باستخدام مطالبات الإنتاج.
- راقب الأسماء المستعارة القديمة:
deepseek-v4-flashوdeepseek-v4-flash-vision-expيُوجِّهان الآن إلى V4.1 Flash، فيما من المقرر أن يُوجّهdeepseek-v4-proإلى V4.1 Flash اعتباراً من 14 سبتمبر 2026 حتى إصدار V4.1 Pro مستقبلاً.
لمستخدمي CometAPI، أصبح DeepSeek V4.1 API في CometAPI متاحاً الآن إلى جانب DeepSeek V4 Flash API. قبل تحويل حركة الإنتاج، أكد الاسم النهائي للنموذج، التسعير، وتعيين الأسماء المستعارة في لوحة تحكم CometAPI، إذ قد تختلف مزودات الطرف الثالث عن تسمية الـ API الرسمية وأسعار الفوترة لدى DeepSeek.
Who Should Use DeepSeek V4.1 Flash?
يُلائم V4.1 Flash بقوة وكلاء البرمجة، تحليل المستودعات، أتمتة الطرفيات، تدفقات عمل المستندات متعددة الوسائط، مساعدي السياق الطويل، وأنظمة استخدام الأدوات عالية الحجم. تتركز مكاسبه المعيارية في الأعباء نفسها التي تستفيد أكثر من ذاكرة التخزين المؤقت الأصغر وأسعار الرموز الأقل.
على الفرق التي تستخدم V4 Flash بالفعل اعتباره مرشح هجرة مباشر. أما فرق V4 Pro فعليها الاختبار بعناية، لكن بيانات المقاييس والتسعير لدى DeepSeek تجعل V4.1 Flash الافتراضي الأكثر اقتصاداً للعديد من أعباء عمل فئة Pro.
الاستضافة الذاتية قرار مختلف. الأوزان المفتوحة لا تجعل نموذجاً بحجم 552B خفيفاً. ينبغي على المؤسسات مقارنة كلفة نشر GPU كبيرة وعنقود تخزين مقابل استخدام API مستضاف قبل الالتزام باستدلال محلي.
Limitations and Open Questions
- تأتي نتائج المقاييس من إعداد التقييم الرسمي لدى DeepSeek؛ ستكون هناك حاجة لتكرارات مستقلة لقياس الأداء عبر تسهيلات وأدوات مختلفة.
- تم تأكيد دعم تعددية الوسائط الأصلي، لكن على فرق التطبيقات التحقق من صيغ الصور المدعومة، احتساب الرموز، وسلوك الرؤية مقابل الـ API الحية.
- الأسماء المستعارة للنماذج القديمة تغير الآن النموذج الفعلي وراء الاسم القائم، ما قد يغير المخرجات دون تغيير في كود التطبيق.
- يقلل V4.1 Flash متطلبات البنية التحتية مقارنة بنماذج DeepSeek السابقة، لكن نشر الأوزان المفتوحة لا يزال يتطلب حوسبة وتخزيناً كبيرين.
- يجب تأكيد نقطة النهاية المخصصة لـ V4.1 لدى CometAPI وتسعيرها النهائي في وحدة التحكم الحية قبل الاستخدام الإنتاجي.
Final Verdict
DeepSeek V4.1 Flash تحديث كبير على مستوى المعمارية والمنتج. يجمع نموذج MoE بسعة 552B بين مرحلة إدخال نشطة 8B، ومرحلة إخراج نشطة 16B، ورؤية أصلية، ونافذة سياق 1M، وتخزين مؤقت KV مضغوط بشدة. تُترجم هذه الخيارات إلى معايير أقوى في البرمجة والوكلاء بأسعار API أقل بكثير من V4 Pro 0813.
التغيير الأكثر عملية هو التوحيد. يجلب V4.1 Flash النص والرؤية والاستدلال واستخدام الأدوات وتشغيل السياق الطويل تحت اسم نموذج إنتاجي واحد. بالنسبة لمعظم تكاملات DeepSeek الجديدة، يعد deepseek-flash نقطة الانطلاق المنطقية الآن؛ بينما يصبح V4 Pro مقارنة للهجرة بدلاً من الخيار التلقائي للأعمال الصعبة.
FAQ
Is DeepSeek V4.1 Flash officially released?
نعم. يتوفر عبر API من DeepSeek تحت اسم النموذج deepseek-flash، وقد أصدرت DeepSeek الأوزان المفتوحة وتقريراً تقنياً.
Is the temporary V4.1 beta model ID still required?
لا. كان deepseek-v4.1-flash-expires-on-0910 معرف بيتا قصير العمر. ينبغي أن تستخدم تطبيقات الإنتاج deepseek-flash.
How many parameters does DeepSeek V4.1 Flash have?
لدى النموذج 552B من المعاملات الإجمالية. يُفعّل 8B أثناء معالجة الإدخال و16B أثناء توليد الإخراج.
Does DeepSeek V4.1 Flash support images?
نعم. الإدخال البصري أصلي في نموذج الإنتاج، لذا لم تعد هناك حاجة لنقطة نهاية V4 Flash Vision Exp المنفصلة.
Is V4.1 Flash better than V4 Pro?
يتقدم على V4 Pro 0813 في معظم مقارنات البرمجة والوكلاء والأتمتة والأمن السيبراني المنشورة لدى DeepSeek، لكن V4 Pro يظل متقدماً في GPQA Diamond. على الفرق تقييم الاثنين مقابل مطالباتها قبل الهجرة.
How much does the API cost?
في أوقات الذروة، الأسعار لكل مليون رمز هي $0.006 لإدخال cache-hit، و$0.30 لإدخال cache-miss، و$1.20 للإخراج. أسعار خارج الذروة نصف هذه القيم.
What happens to the old V4 model names?
توجّه الأسماء القديمة deepseek-v4-flash وdeepseek-v4-flash-vision-exp إلى V4.1 Flash. تقول DeepSeek إن deepseek-v4-pro سيوجّه كذلك إلى V4.1 Flash بدءاً من 14 سبتمبر 2026 حتى إصدار V4.1 Pro.
Can I use DeepSeek V4.1 Flash through CometAPI?
نعم. توفر CometAPI الآن نقطة نهاية DeepSeek V4.1 API. قبل إرسال حركة إنتاجية، أكد الاسم الدقيق للنموذج، التسعير، والميزات المدعومة في وحدة تحكم CometAPI، إذ قد تستخدم مزودات الطرف الثالث اصطلاحات تسمية أو معدلات فوترة تختلف عن الـ API الرسمي لدى DeepSeek.
