مَنگَل کو ہاٹ چپس کانفرنس میں، OpenAI نے Jalapeño پر ایک مزید تفصیلی نظر کا اشتراک کیا، جس میں نئے سسٹم کے لیے بینچ مارک کے نتائج کی پہلی کھیپ بھی شامل ہے۔ SemiAnalysis کے InferenceX بینچ مارک پر تجربہ کیا گیا، Jalapeño نے فی صارف زیادہ ٹوکنز اور فی کلو واٹ زیادہ تھرو پٹ فی الحال دستیاب جدید ترین انفرنس پروسیسرز کے مقابلے میں رجسٹر کیا۔
اوپن اے آئی کے ہارڈ ویئر کے سربراہ رچرڈ ہو نے ایک پریس کال میں کہا، "سب سے اہم بات یہ ہے کہ نتائج آرٹ کے لحاظ سے ایک بہت، بہت اہم کارکردگی پیش کرتے ہیں۔" "Jalapeño فی یونٹ پاور کے زیادہ AI کام کی خدمت کر سکتا ہے، جبکہ جوابات بھی زیادہ تیزی سے واپس کر سکتا ہے۔ بہت سارے صارفین کی خدمت کرنا بہت کارآمد ہے، لیکن یہ بہت کم تاخیر کا باعث بھی ہو سکتا ہے۔"
خاص طور پر، یہ موازنہ Nvidia Blackwell سسٹم کے خلاف ہے — لیکن جب Jalapeño مکمل تعیناتی تک پہنچ جائے گا، مقابلہ نمایاں طور پر آگے بڑھ چکا ہوگا۔ ہو نے اندازہ لگایا کہ Jalapeño 2026 کے آخر میں "بہت چھوٹی مقداروں میں" تعینات کرے گا، اور 2027 میں مزید نمایاں تعیناتی آئے گی۔
گزشتہ اکتوبر میں پہلی بار اعلان کیا گیا تھا، Jalapeño کو OpenAI نے Broadcom کے قریبی تعاون سے تیار کیا تھا، جس میں OpenAI کے اپنے ماڈلز ترقی کے عمل میں معاون تھے۔ کمپنی Jalapeño کو ایک کثیر الجہتی پلیٹ فارم بنانے کا ارادہ رکھتی ہے، جس سے AI پروڈکٹس، ماڈلز، چپس اور میموری کو کنسرٹ میں تیار کیا گیا ہے۔
اس مکمل اسٹیک اپروچ کی وجہ سے، اوپن اے آئی انفرنس پروسیسنگ کے مخصوص مراحل کو حل کرنے کے قابل تھا جو اکثر انفرنس پروسیسنگ کے دوران رگڑ کا باعث بنتے ہیں۔ خاص طور پر، Jalapeño کو پروسیسنگ کے پری فل اور کمیونیکیشن کے مراحل کے دوران تاخیر کو کم کرنے کے لیے ڈیزائن کیا گیا ہے، جسے OpenAI کا کہنا ہے کہ اکثر رکاوٹوں کے طور پر کام کرتا ہے۔
"ہم نے Jalapeño کو ڈیٹا کی نقل و حرکت اور مواصلات میں تاخیر کو کم کرنے کے لیے ڈیزائن کیا،" کمپنی نے نتائج پیش کرتے ہوئے ایک بلاگ پوسٹ میں کہا۔ "اس کا مطلب یہ ہے کہ ماڈل اسٹیٹ، بشمول ردعمل پیدا کرنے کے دوران استعمال ہونے والے KV کیشے، کو واضح طور پر رکھا جا سکتا ہے اور مقامی رکھا جا سکتا ہے جب کہ سسٹم کمپیوٹ، میموری، اور نیٹ ورکنگ کے صحیح امتزاج کو ہر تخمینہ کے مرحلے کے لیے چالو کرتا ہے۔"