اڱارو ڏينهن گرم چپس ڪانفرنس ۾، OpenAI Jalapeño تي وڌيڪ تفصيلي نظر ورهايو، جنهن ۾ نئين سسٽم لاء معيار جي نتيجن جي پهرين بيچ شامل آهي. SemiAnalysis جي InferenceX بينچ مارڪ تي آزمايو ويو، Jalapeño رجسٽرڊ ڪيو وڌيڪ ٽوڪن في يوزر ۽ في ڪلواٽ کان وڌيڪ throughput في الحال موجود جديد انفرنس پروسيسرز کان.
"هيٺيون لڪير اهو آهي ته نتيجا ڏيکارين ٿا هڪ تمام، تمام اهم ڪارڪردگي پيش رفت آرٽ جي رياست تي،" رچرڊ هو، اوپن اي آئي جي هارڊويئر جي سربراهه، هڪ پريس ڪال ۾ چيو. "Jalapeño وڌيڪ AI ڪم جي في يونٽ پاور جي خدمت ڪري سگهي ٿو، جڏهن ته جوابن کي وڌيڪ جلدي موٽائي ٿو. ڪيترن ئي گراهڪن جي خدمت ڪرڻ لاء اهو تمام ڪارائتو آهي، پر اهو پڻ تمام گهٽ دير سان ٿي سگهي ٿو."
خاص طور تي، اهو مقابلو هڪ Nvidia Blackwell سسٽم جي خلاف آهي - پر وقت جي ذريعي Jalapeño مڪمل تعیناتي تائين پهچي ٿو، مقابلو شايد ترقي يافته ٿي چڪو هجي. هو اندازو لڳايو ته Jalapeño 2026 جي آخر ۾ "تمام ننڍي مقدار ۾" مقرر ڪندو، 2027 ۾ وڌيڪ اهم تعينات سان گڏ.
پهريون ڀيرو اعلان ڪيو ويو گذريل آڪٽوبر، Jalapeño OpenAI پاران ترقي ڪئي وئي براڊڪم سان ويجهي تعاون ۾، OpenAI جي پنهنجي ماڊل سان ترقي جي عمل ۾ مدد ڪندي. ڪمپني جو منصوبو آهي Jalapeño کي هڪ ملٽي جنريشنل پليٽ فارم، اجازت ڏئي ٿو اي آءِ پروڊڪٽس، ماڊلز، چپس ۽ ياداشت سڀني کي ڪنسرٽ ۾ ترقي ڪئي.
انهي مڪمل اسٽيڪ واري طريقي جي ڪري، OpenAI انفرنس جي عمل ۾ مخصوص مرحلن کي خطاب ڪرڻ جي قابل هئي جيڪي اڪثر ڪري انفرنس پروسيسنگ دوران رگڙ جو سبب بڻجن ٿا. خاص طور تي، Jalapeño پروسيسنگ جي پريفيل ۽ ڪميونيڪيشن مرحلن دوران دير کي گهٽائڻ لاءِ ٺهيل آهي، جنهن کي OpenAI چوي ٿو اڪثر رڪاوٽن جي طور تي ڪم ڪري ٿو.
"اسان ڊيٽا جي حرڪت ۽ مواصلاتي دير کي گهٽائڻ لاءِ Jalapeño ڊزائين ڪيو ،" ڪمپني هڪ بلاگ پوسٽ ۾ نتيجن کي پيش ڪندي چيو. "هن جو مطلب اهو آهي ته ماڊل اسٽيٽ، بشمول جواب پيدا ڪرڻ دوران استعمال ڪيل KV ڪيش، واضح طور تي رکيل ۽ مقامي رکي سگهجي ٿو جڏهن ته سسٽم هر انفريشن مرحلي لاءِ ڪمپيوٽ، ميموري، ۽ نيٽ ورڪنگ جي صحيح ميلاپ کي چالو ڪري ٿو."