أطلقت DeepSeek نموذج V4.1-Flash يوم الخميس، مقدمةً بنية مزيج من الخبراء تضم 552B من المعاملات، مع 8B من المعاملات النشطة للإدخال و16B للإخراج.

ويستخدم النموذج بنية جديدة من نوع Causal Encoder-Decoder، ويدعم المدخلات الأصلية متعددة الوسائط، بما في ذلك الفهم البصري، وفقًا لبيانٍبيان. وقالت DeepSeek إن V4.1-Flash هو أصغر نموذج في عائلة بنيتها الجديدة.

وأشارت الشركة إلى أن أحد التغييرات الرئيسية يتمثل في تقليص حجم ذاكرة التخزين المؤقت KV، مضيفةً أن V4.1-Flash يحتاج إلى ربع سعة HBM وثُمن مساحة تخزين SSD التي استخدمها الجيل السابق.

وبحسب الشركة، تقلل ذاكرة التخزين المؤقت الأصغر متطلبات التخزين لأعباء العمل المعتمدة على الوكلاء، حيث يمكن أن تمثل تكاليف الاستفادة من الذاكرة المؤقتة حصة كبيرة من إجمالي تكاليف الاستخدام.

أصبح V4.1-Flash متاحًا الآن عبر واجهة API الخاصة بـ DeepSeek، في حين أُوقف نموذجا V4-Flash وV4-Flash-Vision-Exp الأقدم. وستوجه أسماؤهما في واجهة API الطلبات مؤقتًا إلى V4.1-Flash لضمان التوافق.

واللافت أن V4.1-Flash تفوق على V4-Pro من حيث الأداء والتكلفة والسرعة ووقت التشغيل الإجمالي في اختبارات أجرتها جهات متعددة، ولذلك بدأت الشركة التخلي عن الأخير.

ابتداءً من الأسبوع المقبل، في 14 سبتمبر عند الساعة 04:00 بالتوقيت العالمي المنسق، ستوجه DeepSeek جميع الطلبات المقدمة إلى V4 Pro إلى V4.1-Flash، وستحاسب عليها وفق أسعار النموذج الأحدث. وسيظل هذا الترتيب قائمًا إلى أن تطلق DeepSeek نموذج V4.1-Pro، وفقًا للبيان.

عدّلت الشركة أسعار واجهة API الخاصة بـ V4.1-Flash، مع تحديد أسعار فترات خارج أوقات الذروة عند نصف أسعار الذروة. ودخلت الأسعار الجديدة حيز التنفيذ عند الساعة 04:00 بالتوقيت العالمي المنسق في 10 سبتمبر. وأصبحت WorkBuddy وCodeBuddy التابعَتان لـ Tencent، إلى جانب OpenCode، تدعم النموذج.