DeepSeek جاري ڪيو آهي ۽ اوپن سورس ڪيو آهي پنهنجو جديد لائٽ ويٽ ماڊل، V4 فليش، جيڪو قيمت جي هڪ حصي تي مٿين ماڊل جهڙوڪ GLM 5.2 کي مات ڏئي ٿو. اهو ڪيترن ئي بينچ مارڪ ٽيسٽن ۾ ڪلاڊ اوپس 4.8 جي ويجهو پڻ آهي.
ان جي قيمت ڪلاڊ فيبل 5 کان 100 ڀيرا گهٽ آهي.
ماهرن جي بنيادي نموني ماڊل ۾ 284 بلين پيرا ميٽرز آهن، جن ۾ 13 بلين في ٽوڪن چالو آهي، ۽ هڪ ملين ٽوڪن جي حوالي سان ونڊو کي سپورٽ ڪري ٿو. هگنگ فيس 304 بلين پيرا ميٽرز تي مڪمل مخزن جي فهرست ڪري ٿو ڇاڪاڻ ته چيڪ پوائنٽ ۾ ڊي ايس اسپارڪ قياس آرائي واري ڊيڪوڊنگ ماڊل پڻ شامل آهي.
DeepSeek وزن جاري ڪيو بغير رسائي جي پابنديون MIT لائسنس تحت، تجارتي ۽ بنياد تي مقرري جي اجازت ڏئي ٿي.
DeepSeek ٻڌايو ته V4-Flash-0731 هر شايع ٿيل ايجنٽ بينچ مارڪ تي V4-Flash ڏيک ۽ V4-Pro ڏيک ٻنهي کي مات ڏئي ٿو. اهو پڻ سڀني نون ٽيسٽن ۾ GLM-5.2 کان وڌيڪ سکور ڪيو.
V4-Flash ڪلاڊ اوپس 4.8 جي ويجهو آيو ٽرمينل بينچ 2.1 تي، ڊيپ ايس ڊبليو اي، ايجنٽن جو آخري امتحان، آٽوميشن بينچ پبلڪ ۽ ڊي ايس بينچ-فل اسٽيڪ. Claude NL2Repo، Cybergym، Toolathlon-Verified ۽ DSBench-Hard تي وڏين ليڊز کي برقرار رکيو.
بهرحال، سڀئي نتيجا وينڊر-رپورٽ ٿيل آهن. ڊيپ سيڪ پنهنجي غير رليز ٿيل ڊيپ سيڪ هارنس فريم ورڪ جي گهٽ ۾ گهٽ موڊ سان پبلڪ ڪوڊ-ايجنٽ ٽيسٽ هلائي، وڌ ۾ وڌ دليل استعمال ڪندي، 1.0 جي درجه حرارت، ۽ 0.95 جي مٿين پي قيمت. DSBench-FullStack ۽ DSBench-Hard اندروني DeepSeek ڊيٽا سيٽ آهن، تنهنڪري آزاد نتيجا مختلف ٿي سگهن ٿا.
DeepSeek $0.14 في ملين غير محفوظ ٿيل انپٽ ٽوڪن، $0.0028 في ملين ڪيش ٿيل ان پٽ ٽوڪن، ۽ $0.28 في ملين آئوٽ پٽ ٽوڪنن تي چارج ڪري ٿو.
V4-Pro جي قيمت $0.435 في ملين غير محفوظ ٿيل انپٽ ٽوڪن ۽ $0.87 في ملين آئوٽ پٽ ٽوڪن جي آهي، جيڪا V4-فليش آئوٽ پُٽ کي لڳ ڀڳ هڪ ٽيون مهانگو بڻائي ٿي.
V4-Flash API هر اڪائونٽ تائين 2500 سمورو درخواستن کي سپورٽ ڪري ٿو، مقابلي ۾ V4-Pro لاءِ 500. اهو سوچڻ ۽ غير سوچڻ واري طريقن کي پڻ سپورٽ ڪري ٿو، هڪ ملين ٽوڪن جي حوالي سان ونڊو، اوو ۽ 384000 ٽوڪن تائين آئوٽ.
API ھاڻي اصلي طور تي جوابن جي API فارميٽ کي سپورٽ ڪري ٿو ۽ ڪوڊڪس لاءِ ترتيب ڏني وئي آھي. جولاءِ 31 اپڊيٽ صرف V4-Flash تي لاڳو ڪئي وئي. DeepSeek کي اپڊيٽ نه ڪيو ويو V4-Pro API يا ماڊل جيڪي ان جي ويب ۽ موبائل ايپليڪيشنن ۾ استعمال ڪيا ويا.
DeepSeek تصديق ڪئي آهي ته سرڪاري V4-Pro ماڊل ترقي ۾ آهي پر ڇڏڻ جي تاريخ جو اعلان نه ڪيو آهي.
V4-Flash ۾ 43 ٽرانسفارمر پرت آهن ۽ هر بلاڪ ۾ ماهرن جو هڪ ميلاپ سسٽم استعمال ڪري ٿو. هر MoE پرت ۾ هڪ گڏيل ماهر ۽ 256 روٽ ٿيل ماهر شامل آهن جن جي وچ ۾ 2048 جي وچولي طول و عرض سان. ڇهه روٽ ٿيل ماهر في ٽوڪن کي چالو ڪندا آهن، جڏهن ته پهرين ٽي MoE ليئر هيش روٽنگ استعمال ڪندا آهن. ان جي گھڻن ٽوڪن جي اڳڪٿي جي کوٽائي هڪ آهي.
ماڊل گڏ ڪري ٿو ڪمپريسڊ اسپارس توجهه ۽ بھترين دٻايل ڌيان. اهو چار ۽ 20 Sinkhorn-Knopp جي توسيع واري عنصر کي استعمال ڪندي Manifold-Constrained Hyper-Connections سان معياري بقايا ڪنيڪشن کي پڻ تبديل ڪري ٿو.
DeepSeek 32 ٽريلين کان وڌيڪ ٽوڪن تي ماڊل کي تربيت ڏني. اهو استعمال ڪيو Muon optimizer اڪثر پيٽرولن لاءِ ۽ AdamW لاءِ ايمبيڊنگ، اڳڪٿي سر، ۽ RMSNorm وزن.
هڪ ملين ٽوڪن جي حوالي سان، ڊيپ سيڪ چوي ٿو V4-Flash استعمال ڪري ٿو 10 سيڪڙو سنگل ٽوڪن انفرنس ڪمپيوٽنگ آپريشنز ۽ 7 سيڪڙو ڪي وي ڪيش جو ڊيپ سيڪ-V3.2 پاران گهربل. 27 سيڪڙو ڪمپيوٽنگ آپريشنز ۽ 10 سيڪڙو KV ڪيش جا الڳ انگ V4-Pro تي لاڳو ٿين ٿا، نه V4-Flash تي.
چيڪ پوائنٽ ۾ DSpark قياس آرائي واري ڊيڪوڊنگ شامل آهي، جيڪو هڪ مسودو جزو استعمال ڪري ٿو ڪيترن ئي ٽوڪن جي اڳڪٿي ڪرڻ کان اڳ جو مکيه ماڊل انهن کي گڏ ڪري تصديق ڪري.
ڊيپ سيڪ سفارش ڪري ٿو ست قياس آرائي واري ٽوڪن سان لالچي مسودي جي نموني سان. ان جو DSpark پيپر رپورٽ ڪري ٿو 60 کان 85 سيڪڙو تيز في صارف نسل ان جي اڳوڻي MTP-1 سسٽم جي ڀيٽ ۾ ساڳئي مجموعي ذريعي.
ميزباني ڪيل API استعمال ڪرڻ لاءِ وقف ٿيل AI هارڊويئر جي ضرورت ناهي. خود ميزباني وڌيڪ گهربل آهي ڇو ته سڀني ماڊل ماهرن کي ياداشت ۾ رهڻ گهرجي، جيتوڻيڪ صرف 13 بلين پيرا ميٽر هر ٽوڪن لاءِ چالو ٿين ٿا.
DeepSeek جو vLLM مثال هڪ نوڊ تي مڪمل ماڊل هلائي ٿو چار Nvidia GB300 GPUs سان. Unsloth 8-bit GGUF نسخو 162GB تي ۽ 3-bit ورزن 103GB تي لسٽ ڪري ٿو. رن ٽائم اوور هيڊ کان پوءِ ننڍو ورزن 103GB کان وڌيڪ گڏيل سسٽم ميموري ۽ گرافڪس ميموري جي ضرورت آهي.
مڪمل خود ميزباني ان ڪري وڌيڪ موزون آهي تنظيمن لاءِ ملٽي GPU سرورز، انفرنس ڪلسٽرز يا هاءِ ميموري ورڪ اسٽيشنن سان.
ماڊل هڪ معياري جنجا چيٽ ٽيمپليٽ استعمال نٿو ڪري. DeepSeek بدران هڪ انڪوڊنگ فولڊر مهيا ڪري ٿو اوزارن سان گڏ OpenAI-مطابقت رکندڙ پيغامن کي تبديل ڪرڻ ۽ مڪمل ٿيل آئوٽ پٽن کي پارس ڪرڻ لاءِ. V4-Flash پيش ڪري ٿو گھٽ، مٿاھين ۽ وڌ ۾ وڌ دليل جي سيٽنگون. DeepSeek 1.0 جي درجه حرارت جي سفارش ڪري ٿو، ايجنٽ جي ڪم لاء 0.95 جي مٿين پي قيمت سان ۽ ٻين ڪم لوڊ لاء 1.0. اعليٰ ۽ وڌ ۾ وڌ استدلال جا طريقا 384000 ٽوڪن تائين پيداوار جي حمايت ڪن ٿا.
DeepSeek-V4-Flash-0731 بنيادي فن تعمير کي تبديل ڪرڻ کان سواءِ ڏيک ۾ وڏيون واڌايون پيش ڪري ٿو. اهو ڊيپ سيڪ پاران شايع ٿيل هر ايجنٽ بينچ مارڪ تي V4-Pro ڏيکيو کي مات ڏئي ٿو جڏهن ته V4-Pro جي پيداوار جي قيمت جو هڪ ٽيون حصو چارج ڪري ٿو.
بهرحال، ڊولپرز کي ماڊل کي انهن جي پنهنجي ڪم جي لوڊ تي جانچڻ گهرجي ڇو ته نتيجا وينڊر-رپورٽ ٿيل رهندا آهن؛ ڪجھ ٽيسٽ استعمال ڪيا ويا اڻ ڇپيل تشخيصي فريم ورڪ، ۽ ٻه معيار اندروني آھن.
تازه ترين ٽيڪني خبرن، ٽيليڪم بصيرت، ۽ پراڊڪٽ لانچ حاصل ڪريو جتي توهان چاهيو ٿا.
ProPakistani کي ترجيحي ذريعن ۾ شامل ڪريو ۽ ڏسو اسان جون وڌيڪ ڪهاڻيون گوگل سرچ ۽ ٽاپ اسٽوريز ۾.
ٽيڪنالاجي ۽ گاڏين جو ماهر جديد ڪارن، اسمارٽ فونز، AI ڪاميابين، ۽ ...
شيئرز