الإجابة المختصرة
لم تُؤكّد DeepSeek أن هذه النسخ هي V4. كل ما لدينا موجة كبيرة وغير معتادة الاتّساق من مخرجات يُشتبه أنها من الاختبار التدريجي (gray-test): 121 فيديو على Bilibili من 53 مُبدعًا بين 7 و 19 يوليو 2026، فضلًا عن 40 محادثة OpenCode مشتركة وحفنة من المشاريع القابلة للتنزيل. هذا يكفي لرصد الأنماط — لكنه لا يكفي لإثبات معرّف النموذج أو تشغيل معيار مُضبوط.
اقرأ الأدلّة على هذا الأساس والصورة واضحة: يبدو V4 متأخّرًا قليلًا عن Kimi K3 و GPT-5.6 و Fable 5.0 في أقوى مناطقها، لكن الفارق بات صغيرًا بما يكفي ليجعل المطور الحريص على التكلفة يعتمد V4 افتراضيًا في معظم برمجته اليومية، ويحتفظ باشتراك مميّز خفيف واحد لمراجعة الشيفرة، والأخطاء العنيدة، وآخر 10% من الأعمال متعدّدة الجولات الطويلة.
لمعرض لقطات الشاشة وروابط المحادثات من الموجة السابقة، طالِع تجميعة أدلّة الإصدار التدريجي لـ DeepSeek V4.
فهرس المصادر الكامل أدلّة رئيسية
الأدلّة الخام وراء كل ادّعاء في هذا المقال — منسوخة من مستودع YunhaoFu/dsv4ga-news-gather المفتوح. وسّع القائمة للتصفّح حسب المُبدع أو التاريخ أو الكلمة المفتاحية. العناوين تربط مباشرةً بـ Bilibili.
انقر لعرض كل سجلّات الـ 136
تلميح: العنوان هو الرابط إلى Bilibili. أخضر = جلسة محادثة مشتركة، برتقالي = تنزيل المشروع. مرّر فوق المُبدع لرؤية الاسم كاملًا.
ماذا تُظهر 121 اختبارًا فعلًا
البيانات من مستودع dsv4ga-news-gather المفتوح، الذي يفهرس المنشورات العامة على Bilibili ويحفظ العناوين وأسماء المُبدعين والطوابع الزمنية والأوصاف والتعليقات والمحادثات المشتركة وروابط التنزيل. تنقسم لقطة 19 يوليو على النحو التالي:
المنشورات يوميًا
تسرّب بطيء حتى 15 يوليو، ثم جدار من الإصدارات بلغ ذروته في 18 يوليو.
أفضل 10 مُبدعين
فقط kdzzzds و Delight-linger شاركا سجلّات جلسات كبيرة. الأخضر = 5 جلسات مشتركة فأكثر، البرتقالي = 1–4، الأزرق = بلا.
ما الذي اختبره الناس فعلًا
مُصنَّف من 136 عنوانًا. الألعاب تسيطر — المشاريع الخلفية للإنتاج والأمن والأعمال طويلة الأجل بالكاد تظهر.
التحيّزان يهمّان أكثر من أي رقم مفرد. التحيّز في الاختيار: معظم هذه المهام "برمجة بالأمنيات" — ألعاب متصفّح، ومشاهد ثلاثية الأبعاد، وحركات SVG، وألعاب فيزيائية، وأدوات موسيقية. تمثّل المجموعة دليلًا قويًا على النماذج الأولية السريعة وتوليد الواجهات الأمامية؛ لكنها دليل ضعيف على المشاريع الخلفية للإنتاج أو الأمن أو صيانة المستودعات الكبيرة أو أي عمل يستغرق أشهرًا. التحيّز في الشفافية: 3 فقط من أفضل 10 مُبدعين شاركوا مطالباتهم أو سجلّات محادثاتهم. تعامل مع عناوين الفيديوهات التي تقول "النسخة الرسمية" بوصفها تسويقًا — المُبدع غالبًا يشتبه فقط في مسار تدريجي. نستخدم عبارة نسخة V4 التدريجية المشتبه بها في كل مكان.
في ما يبدع V4 فعلًا
تطبيقات المطالبة الواحدة باتت تعمل بدلًا من أن تكون مجرّد عرض جميل
أقوى نمط هو التنفيذ الواسع من مواصفة رفيعة. تشمل المجموعة عوالم Voxel، وألعاب إطلاق نار، وألعاب إيقاعية، وألعاب بقاء، ومشاهد three.js، ومولّدات موسيقى، وتصوّرات هندسية. عرض SVG بأسلوب GTA تمثيلي وُصف بأنه توليد رئيسي واحد بالإضافة إلى جولة إصلاح أخطاء واحدة، مع محادثة مشتركة مرفقة. هذا ليس "جملة واحدة، لعبة مُسلَّمة". بل "النموذج يختار بنيةً، يربط ما يكفي منها لإظهار الفكرة، ولم يعد يعيد غلافًا فارغًا".
قوة في ثلاثية الأبعاد و SVG والمحاكاة الخفيفة
تتكرّر مشاهد three.js وأصول SVG المخصّصة وفيزياء الألعاب والمحاكاكات التفاعلية عبر المجموعة. صفحة بأسلوب CFD هواء-سائل يُقال إنها استخدمت PBF للسائل و LBM للغاز في جولتين. كما أشار المُبدع إلى ديناميكا هوائية غير واقعية والحاجة إلى مزيد من الإصلاح — وهذا بالضبط الخطّ الفاصل بين نموذج أولي مبهر وأداة هندسية موثوقة.
السعر قد يكون العنوان الحقيقي
تصف المقارنات المجتمعية V4 و Kimi K3 متكرّرًا بأنهما متقاربان في المشاريع العملية. إذا حافظت API النهائية على أفضلية السعر المعتادة لـ DeepSeek، فإن "قدرة قريبة من الحدود الأمامية بسعر البنية التحتية" أهمّ من الفوز بأي عرض توجيهي مباشر. طالِع مقارنة أسعار واجهات الذكاء الاصطناعي للسياق الحالي.
أين ما زال V4 يتعثّر
- الصقل والذوق. يُفضَل Kimi K3 غالبًا في تكوين الواجهات الأمامية والصياغة الطويلة. قد تكون مخرجات V4 بصريًا مبهرة، لكن جودتها تتأرجح حدّيًا مع تصميم المطالبة.
- حدود التعليمات. عرض توضيحي واحد طلب من النموذج حذف التعليقات؛ فأصلح أيضًا خطأً في اللعبة من تلقاء نفسه. هذه المبادرة تبدو ساحرة في لعبة، وهي خطر مراجعة في مستودع حقيقي. راجِع كل فرق (diff) — لا تقبَل "إنه يعمل" بوصفه كافيًا.
- موثوقية الجولات الطويلة. ما زالت الجلسات تتحطّم، أو تفقد الاتجاه، أو تتراكم ديونًا معمارية عبر جولات كثيرة. الجولة الأولى القوية لا تضمن الجولة العشرين.
- صحّة الفيزياء. محاكاة سوائل أو جاذبية مقنعة ليست CFD أو ميكانيكا صحيحة. صحيح بصريًا ≠ صحيح عدديًا.
- إمكانية التكرار. يبدو التوجيه التدريجي غير متّسق. قد يكون مستخدمون مختلفون قد وصلوا إلى نماذج أو مستويات أو سلوك أخذ عيّنات مختلف.
- جودة الأدلّة. كثير من الفيديوهات تُسقط المطالبة الكاملة ومعرّف النموذج وعدد الإخفاقات واستخدام التوكنز والتعديلات اليدوية.
الوصف الصادق هو "مولّد نماذج أولية بسقف مرتفع مع قدرة برمجة حقيقية" — لا "مهندس كبير لم يعد بحاجة إلى مراجعة".
V4 مقابل Kimi K3 مقابل GPT-5.6 مقابل Fable 5.0
لا يوجد هنا معيار مُضبوط لأربعة نماذج. الجدول التالي تركيب موجَّه نحو سير العمل لأدلّة الاختبار التدريجي وشهادات المستخدمين المحيطة بها — لا لوحة تصنيف.
| النموذج | الميزة المرجّحة | موقع V4 | الدور الأنسب |
|---|---|---|---|
| DeepSeek V4 | التكلفة، التنفيذ الواسع، النماذج الأولية السريعة | الخط الأساسي | البرمجة اليومية الافتراضية والتنفيذ الأول |
| Kimi K3 | صقل الواجهة الأمامية، العرض، الكتابة | V4 أقل صقلًا قليلًا لكنه غالبًا مكافئ وظيفيًا | تجويد الواجهة، نصوص المنتج، التنقيح البصري |
| GPT-5.6 | اتّساق المراجعة، منظومة الأدوات، الاستدلال عبر الملفات | قد يكون V4 البديل الأرخص للأعمال الروتينية؛ لا أدلّة كافية لفوز عام | مراجعة الشيفرة، التحقّق، الأخطاء العنيدة |
| Fable 5.0 | التنفيذ طويل الأفق، التعافي في الجولات المتعددة | V4 يبدو قريبًا في عروض مختارة لكنه أقل موثوقية على الحافة | نموذج التصعيد لأصعب الأعمال المتبقّية |
V4 مقابل Kimi K3: المادة المباشرة الأكثر مصداقية تشير إلى منافسة متقاربة. يبدو K3 أفضل في الواجهة الأمامية والكتابة؛ وقد يكون V4 أفضل قيمة ومنافسًا في التنفيذ. بلغ أحد مقاطع المقارنة عشرات الآلاف من المشاهدات، لكن دون مطالبات أو تسجيل قياسي موحّد.
V4 مقابل GPT-5.6: تعليقات متفرّقة تدّعي فوزًا وخسارة في مشاريع ويب بعينها. هذه أفكار اختبار لا نتائج معايير. السؤال المفيد هو ما إذا كان V4 يستطيع اجتياز مجموعة اختبارات مستودعك بتكلفة أقل.
V4 مقابل Fable 5.0: عروض الألعاب المبهرة تجعل المقارنة مغرية، لكن المجموعة لا تُثبت تكافؤًا في قواعد الأكواد الكبيرة أو مراجعة الأمن أو التشغيل المستقل الطويل. تعامل مع Fable 5.0 بوصفه خيار تصعيد حتى تقول اختبارات قابلة للتكرار غير ذلك.
إعداد عملي
أرخص إعداد لا ينقلب عليك لاحقًا:
- دع V4 يتولّى أول 80–90%. التخطيط، والهيكل، والتنفيذ، والاختبارات، والوثائق، وإصلاح الأخطاء العادية.
- التحقّق محليًا. Lint، وفحص الأنواع، واختبارات الوحدة والتكامل، ومراجعة فرق (diff) بشرية. غير قابل للتفاوض.
- التصعيد بالأدلّة. عند الجمود، أرسل الفرق والاختبارات الفاشلة وسؤالًا محدّدًا إلى Kimi K3 أو GPT-5.6 أو Fable 5.0 — لا المطالبة الغامضة نفسها ثانيةً.
- احتفظ بخطة مميّزة خفيفة واحدة، لا عدّة اشتراكات كاملة. استخدمها بوصفها مراجِعًا ونموذج تعافٍ، لا حارقة التوكنز الافتراضية.
هذا لا يعمل إلّا إذا حصل النموذج الثاني على أدلّة — الفرق والسجلّات والاختبارات الفاشلة. طرح السؤال الغامض نفسه على نموذجين يضاعف التكلفة عادةً دون تحسين الموثوقية.
ما يجب التحقّق منه عند الإطلاق الرسمي لـ V4
احكُم على الإصدار الرسمي بإمكانية التكرار، لا عروض يوم الإطلاق. تحقّق من:
- معرّف نموذج API الدقيق، وما إذا كان الويب والتطبيق و API يستخدمون المستوى نفسه؛
- نافذة السياق، وحدّ الإخراج، واستدعاء الأدوات ودعم المخرجات المهيكلة؛
- السعر لكلّ توكن إدخال وإدخال مخزّن وإخراج؛
- حدود المعدّل، وتوجيه ساعات الذروة، وما إذا كانت مستويات "Pro/Flash/Max" تتصرّف باختلاف؛
- التحرير بمقياس المستودع، وإكمال الاختبارات، والالتزام بالتعليمات؛
- مدى تكرار المطالبات المتطابقة لإعادة إنتاج جودة الاختبار التدريجي؛
- الترخيص، والاحتفاظ بالبيانات، وخيارات النشر.
سنحدّث هذه الصفحة عندما تنشر DeepSeek بطاقات النماذج الرسمية ووثائق API والتسعير. حتى ذلك الحين، تبقى الادّعاءات حول النموذج النهائي مؤقّتة.
الأسئلة الشائعة
هل النسخة الرسمية متاحة الآن؟
توثّق المجموعة توجيهًا تدريجيًا مشتبهًا به، لا إصدارًا مؤكّدًا. الفيديو الذي يحمل عنوان "النسخة الرسمية" ليس تأكيدًا رسميًا من DeepSeek.
ما مدى جودة V4 في البرمجة؟
الأدلّة أقوى ما تكون في نماذج الويب الأولية السريعة والألعاب و SVG و three.js وإصلاح الأخطاء التكراري. وهي أرقّ ما تكون في المستودعات الإنتاجية الكبيرة والشيفرة الحسّاسة أمنيًا والأعمال المستقلة الطويلة.
هل V4 أفضل من Kimi K3؟
ليس في كل المهام. يبدو V4 قريبًا وقد يقدّم قيمة أفضل؛ وكثيرًا ما يكون لـ Kimi K3 تفوّق في صقل الواجهة الأمامية والكتابة. شغّل المطالبة نفسها وزمن التشغيل واختبارات القبول نفسها قبل الاختيار.
هل ينبغي عليّ إلغاء اشتراكي المميّز في البرمجة؟
لكثير من المستخدمين، التنزّل إلى خطة مميّزة خفيفة واحدة منطقي أكثر من إلغاء كل شيء. دع V4 يتولّى الحجم واحتفظ بنموذج مستقل للمراجعة والتصعيد.
أين يمكنني فحص الاختبارات التدريجية الأصلية؟
ابدأ بـ فهرس GitHub لكل مقاطع الـ 121. حالات تمثيلية: اختبار واسع لـ V4 و Kimi K3، ومقارنة فيزياء ثلاثية الأبعاد، واختبار Minecraft بـ 8192 كتلة، ومثال إصلاح أخطاء استباقي.