Forklog
2026-08-26 07:34:38

OpenAI заявила о превосходстве Jalapeño над Nvidia Blackwell

25 августа OpenAI опубликовала первые измеренные результаты собственного чипа для инференса Jalapeño. В тестах компании ускоритель показал в 1,5–1,9 раза больше вычислительной работы на ватт и в 1,7–3,6 раза меньшую задержку, чем системы на базе Nvidia GB200 и GB300. Since announcing Jalapeño, our first custom inference chip, we’ve been testing it and the system around it.The results show a major advance: more intelligence from every watt and faster responses, delivering both higher throughput and lower latency in one architecture without… pic.twitter.com/vj7VOrA8pP— OpenAI (@OpenAI) August 25, 2026 Для наиболее интерактивных нагрузок производительность Jalapeño оказалась выше в 2,1–4,1 раза. OpenAI намерена начать развертывание процессора в собственной инфраструктуре до конца 2026 года. Jalapeño протестировали на трех ИИ-моделях Компания протестировала ускоритель с помощью публичного бенчмарка InferenceX от SemiAnalysis. Он измеряет весь процесс обработки запроса и позволяет одновременно оценивать пропускную способность, энергопотребление и задержку. Для GPT-OSS 120B OpenAI сравнила Jalapeño с Nvidia GB200. Собственный процессор показал примерно в 1,9 раза большую пиковую производительность на киловатт: 85 448 против 44 960 mixed TPS/кВт. Полная задержка составила 1,03 секунды против 1,8 секунды. На DeepSeek R1 670B соперником стал GB300. Jalapeño обеспечил 19 641 mixed TPS/кВт против 11 781, что соответствует преимуществу примерно в 1,7 раза. Задержка оказалась в 3,6 раза ниже: 1,65 секунды против 5,99 секунды. На Kimi K2.5 1T собственный чип OpenAI показал 18 195 mixed TPS/кВт против 11 862 у GB300. Задержка составила 1,56 секунды против 5,31 секунды. Таким образом, преимущество достигло примерно 1,5 и 3,4 раза соответственно. Источник: OpenAI. При сравнении энергопотребления OpenAI использовала заявленную производителями мощность ускорителей. Для Jalapeño показатель составляет 700 Вт, для GB200 — 1200 Вт, для GB300 — 1400 Вт. Компания добавила, что фактическое устойчивое энергопотребление ее чипа в проведенных тестах не превышало 550 Вт. ИИ помог спроектировать собственный чип При создании Jalapeño OpenAI применяла свои ИИ-модели. По словам разработчиков, это помогло пройти путь от первоначального проекта до передачи финального дизайна в производство за девять месяцев. Нейросети участвовали в поиске вариантов реализации, проверке решений и оптимизации арифметических блоков. ИИ продолжили использовать после создания процессора. С помощью Codex на базе GPT-Astra инженеры менее чем за два месяца добились высокой производительности Jalapeño на трех моделях с открытыми весами, которые не входили в первоначальный производственный план. https://forklog.com/news/ai/openai-zayavila-o-10-rezultatah-astra-v-matematike Для отдельных блоков attention и mixture-of-experts в GPT-OSS сгенерированные ИИ реализации оказались в 1,5–1,8 раза быстрее решений, написанных инженерами. OpenAI подчеркнула, что преимущество относится только к выбранным компонентам, а не ко всей модели. OpenAI расширила собственный ИИ-стек В отдельной публикации о вычислительной стратегии финансовый директор OpenAI Сара Фрайар назвала Jalapeño частью более широкой вертикально интегрированной инфраструктуры. Она включает дата-центры, процессоры, память, сети, ИИ-модели, программное обеспечение и конечные продукты. По словам Фрайар, собственный чип дает OpenAI больше контроля над стоимостью инференса и позволяет выбирать оборудование под конкретные задачи. Компания намерена направлять нагрузки туда, где получает лучшее соотношение производительности и цены, и сохранять «ценовую дисциплину» при работе с поставщиками. В вычислительный портфель OpenAI входят Microsoft и Nvidia, а также AWS, AMD, Broadcom, Cerebras, CoreWeave, Oracle, SB Energy и SoftBank. Компания подчеркнула, что создание Jalapeño не означает отказа от сторонних ускорителей. Она продолжит широко использовать процессоры партнеров как для обучения, так и для инференса. Экономическая ставка заключается в снижении стоимости единицы вычислений. OpenAI рассчитывает, что увеличение производительности оборудования позволит обслуживать больше запросов при тех же ресурсах и улучшит соотношение выручки к затратам на инфраструктуру. Фрайар ожидает и обратного эффекта. Она сослалась на парадокс Джевонса: повышение эффективности способно не сократить общее потребление вычислений, а увеличить его за счет появления новых экономически оправданных задач для ИИ. Jalapeño станет первым поколением собственной платформы OpenAI. Процессор второго поколения уже находится на продвинутой стадии разработки, а компания начала проектирование третьего. Первые Jalapeño планируют внедрить в инфраструктуру OpenAI до конца года. Напомним, в августе OpenAI временно замедлила масштабирование новых ИИ-моделей и на две недели приостановила обучение с подкреплением последних систем, предназначенных для последующего развертывания. https://forklog.com/exclusive/ai/kak-chelovek-stal-telom-dlya-mashiny

获取加密通讯
阅读免责声明 : 此处提供的所有内容我们的网站,超链接网站,相关应用程序,论坛,博客,社交媒体帐户和其他平台(“网站”)仅供您提供一般信息,从第三方采购。 我们不对与我们的内容有任何形式的保证,包括但不限于准确性和更新性。 我们提供的内容中没有任何内容构成财务建议,法律建议或任何其他形式的建议,以满足您对任何目的的特定依赖。 任何使用或依赖我们的内容完全由您自行承担风险和自由裁量权。 在依赖它们之前,您应该进行自己的研究,审查,分析和验证我们的内容。 交易是一项高风险的活动,可能导致重大损失,因此请在做出任何决定之前咨询您的财务顾问。 我们网站上的任何内容均不构成招揽或要约