ډیپ سیک خپل وروستي سپک وزن لرونکي ماډل ، V4 فلش خپور او خلاص کړی ، کوم چې د لګښت په یوه برخه کې غوره ماډلونه لکه GLM 5.2 ماتوي. دا په څو بنچمارک ازموینو کې کلاډ اوپس 4.8 ته هم نږدې دی.

دا د کلاډ فیبل 5 څخه 100 ځله لږ لګښت لري.

د متخصصینو لاندې مخلوط ماډل 284 ملیارد پیرامیټرې لري، په هر ټوکن کې 13 ملیارد فعال شوي، او د یو ملیون ټوکن شرایطو کړکۍ ملاتړ کوي. هګینګ فیس په 304 ملیارد پیرامیټرو کې بشپړ ذخیره لیست کوي ځکه چې په پوسته کې د DSpark قیاس کوډ کولو ماډل هم شامل دی.

ډیپ سیک د MIT لایسنس لاندې د لاسرسي محدودیتونو پرته وزنونه خپاره کړل ، د سوداګریزو او پریمیس ګمارلو ته اجازه ورکوي.

ډیپ سیک راپور ورکړی چې V4-Flash-0731 د هر خپاره شوي اجنټ بنچمارک په اوږدو کې د V4-Flash مخکتنه او V4-Pro لید دواړه مات کړل. دا په ټولو نهو ټیسټونو کې د GLM-5.2 څخه هم لوړه نمرې اخیستې.

V4-Flash په ټرمینل بنچ 2.1 کې Claude Opus 4.8 ته نږدې شو، DeepSWE، د اجنټانو وروستی ازموینه، د اتومات بینچ عامه او DSBench-FullStack. کلاډ په NL2Repo، Cybergym، Toolathlon-verified او DSBench-Hard کې لوی لیډونه ساتلي.

په هرصورت، ټولې پایلې د پلورونکي لخوا راپور شوي. ډیپ سیک د عامه کوډ اجنټ ازموینې د خپل نه خپاره شوي ډیپ سیک هارنس چوکاټ لږترلږه حالت سره ترسره کړې ، د اعظمي دلیل په کارولو سره ، د تودوخې درجه 1.0 ، او د 0.95 لوړ p ارزښت. DSBench-FullStack او DSBench-Hard داخلي DeepSeek ډیټاسیټونه دي، نو خپلواکې پایلې ممکن توپیر ولري.

ډیپ سیک په هر ملیون غیر کیچ شوي ان پټ ټوکنونو کې 0.14 ډالر، په هر ملیون کیچ شوي ان پټ ټوکنونو کې 0.0028 ډالر، او په هر ملیون آوټ پوټ ټوکن کې 0.28 ډالر چارج کوي.

V4-Pro په هر ملیون غیر محفوظ شوي ان پټ ټوکن $0.435 او $0.87 په هر ملیون محصول ټوکن لګښت لري، د V4-Flash محصول تقریبا یو پر دریمه برخه ګران کوي.

د V4-Flash API په هر حساب کې تر 2500 پورې همغږي غوښتنې ملاتړ کوي، د V4-Pro لپاره د 500 په پرتله. دا د فکر کولو او غیر فکر کولو حالتونو ملاتړ هم کوي، د یو ملیون ټوکن شرایطو کړکۍ، اوو او تر 384000 ټوکونو پورې محصول.

API اوس په اصلي توګه د ځوابونو API بڼه ملاتړ کوي او د کوډیکس لپاره تطبیق شوی. د جولای 31 تازه معلومات یوازې په V4-Flash کې پلي شوي. DeepSeek د V4-Pro API یا هغه ماډلونه چې د هغې په ویب او ګرځنده غوښتنلیکونو کې کارول شوي نوي ندي کړي.

ډیپ سیک تایید کړې چې د V4-Pro رسمي ماډل د پراختیا په حال کې دی مګر د خوشې کیدو نیټه یې نه ده اعلان کړې.

V4-Flash 43 ټرانسفارمر پرتونه لري او په هر بلاک کې د متخصصینو مخلوط سیسټم کاروي. د پوهنې وزارت هر پرت کې یو شریک کارپوه او 256 روټ شوي متخصصین شامل دي چې د 2048 منځمهاله اړخ لري. شپږ روټ شوي متخصصین په هر ټوکن کې فعالوي، پداسې حال کې چې د پوهنې وزارت لومړۍ درې پرتونه د هش روټینګ کاروي. د دې څو ټوکن وړاندوینې ژوروالی یو دی.

ماډل د فشار شوي سپارس پاملرنه او خورا ډیر فشار شوي پاملرنه ترکیب کوي. دا د څلور او 20 Sinkhorn-Knopp تکرارونو د پراختیا فاکتور په کارولو سره د معیاري پاتې کیدو اړیکې د Manifold-Constrained Hyper-Connections سره ځای په ځای کوي.

ډیپ سیک دا ماډل له 32 ټریلیون څخه ډیر ټوکنونو کې روزلی. دا د ډیری پیرامیټونو لپاره د Muon اصلاح کونکی کارولی او د امبیډینګونو ، وړاندوینې سرونو ، او RMSNorm وزنونو لپاره AdamW.

په یو ملیون ټوکن شرایطو کې، ډیپ سیک وايي چې V4-فلیش د واحد ټوکن انفرنس کمپیوټري عملیاتو 10 سلنه او د ډیپ سیک-V3.2 لخوا اړین 7 سلنه KV کیچ کاروي. د کمپیوټري عملیاتو 27 سلنه او د KV کیچ 10 سلنه جلا ارقام په V4-Pro کې پلي کیږي ، نه V4-Flash.

په پوسته کې د DSpark قیاس کوډ کول شامل دي، کوم چې د مسودې اجزا کاروي ترڅو د څو ټوکونو وړاندوینه وکړي مخکې لدې چې اصلي ماډل دوی سره یوځای تصدیق کړي.

ډیپ سیک د لالچ مسودې نمونې کولو سره اوه قیاس لرونکي ټوکن وړاندیز کوي. د دې DSpark کاغذ په ورته ټولیز ډول کې د خپل پخواني MTP-1 سیسټم په پرتله د هر کارونکي 60 څخه تر 85 سلنې ګړندی نسل راپور ورکوي.

د کوربه شوي API کارول وقف شوي AI هارډویر ته اړتیا نلري. د ځان کوربه توب ډیر غوښتنه کوي ځکه چې د ماډل ټول متخصصین باید په حافظه کې پاتې شي، پداسې حال کې چې یوازې 13 ملیارد پیرامیټونه د هر ټوک لپاره فعالوي.

د ډیپ سیک vLLM مثال د څلورو Nvidia GB300 GPUs سره په یو نوډ کې بشپړ ماډل پرمخ وړي. Unsloth د 8-bit GGUF نسخه په 162GB کې او د 3-bit نسخه په 103GB کې لیست کوي. کوچنۍ نسخه له 103GB څخه ډیر ګډ سیسټم حافظې او ګرافیک حافظې ته اړتیا لري د رن ټایم اوور هیډ وروسته.

له همدې امله بشپړ ځان کوربه توب د هغو سازمانونو لپاره ډیر مناسب دی چې د څو-GPU سرورونو، انفرنس کلسترونو یا د لوړې حافظې ورک سټیشنونو سره.

ماډل د معیاري جنجا چیٹ ټیمپلیټ نه کاروي. ډیپ سیک پرځای د OpenAI - مطابقت لرونکي پیغامونو بدلولو او بشپړ شوي محصولات پارس کولو لپاره د وسیلو سره کوډ کولو فولډر چمتو کوي. V4-Flash ټیټ، لوړ او اعظمي استدلال ترتیبات وړاندې کوي. DeepSeek د تودوخې 1.0 وړاندیز کوي، د اجنټ دندو لپاره د 0.95 لوړ p ارزښت سره او د نورو کاري بارونو لپاره 1.0. د لوړ او اعظمي استدلال طریقې تر 384000 ټوکن پورې د محصول ملاتړ کوي.

DeepSeek-V4-Flash-0731 د اصلي جوړښت بدلولو پرته د مخکتنې لپاره لوی پرمختګونه وړاندې کوي. دا د ډیپ سیک لخوا خپاره شوي د هر اجنټ بنچمارک په اوږدو کې د V4-Pro لید ته ماتې ورکوي پداسې حال کې چې د V4-Pro محصول قیمت شاوخوا دریمه برخه چارج کوي.

په هرصورت، پراختیا کونکي باید ماډل په خپل کاري بار کې ازموینه وکړي ځکه چې پایلې د پلورونکي راپور شوي پاتې دي؛ ځینې ​​​​ازموینې د ارزونې یو نه خپور شوی چوکاټ کارولی، او دوه بنچمارکونه داخلي دي.

وروستي تخنیکي خبرونه، د مخابراتو بصیرت، او د محصول لانچ هرچیرې چې تاسو غوره کوئ ترلاسه کړئ.

په غوره سرچینو کې پروپاکستاني اضافه کړئ او زموږ نور کیسې په ګوګل لټون او غوره کیسو کې وګورئ.

د ټیکنالوژۍ او موټرو متخصص وروستي موټرې، سمارټ فونونه، د AI بریالیتوبونه، او ...

ونډې