OpenAI показала результаты своего inference-чипа Jalapeño: он обошел системы на NVIDIA

Wait 5 sec.

OpenAI опубликовала первые результаты тестирования Jalapeño — собственного ASIC для инференса языковых моделей. На публичном бенчмарке InferenceX чип показал более высокую производительность на ватт и меньшую задержку по сравнению с коммерческими системами на NVIDIA GB200 и GB300. Читать далее