OpenAI впервые показала практические результаты разработки собственного инфер-чипа Jalapeño. По бенчмарку SemiAnalysis InferenceX компания зафиксировала заметное преимущество над актуальными решениями Nvidia — выше tokens per user, выше throughput на киловатт, ниже латенс. На пресс-коле Ричард Хо, глава аппаратного отдела OpenAI, сравнил это с «очень значительным скачком производительности» и подчеркнул двойное преимущество: эффективность на больших объёмах и низкая задержка ответа одновременно.
Но сразу оговорка: эти цифры набиты против Blackwell. К концу 2026 года, когда Jalapeño выйдет в небольших объёмах (масштабное развёртывание отложено на 2027), конкуренция наверняка шагнёт вперёд. Nvidia не стоит на месте, AMD тоже раскручивает свой инфер-направление, Intel что-то делает. То есть «лучше всех на момент бенчмарка» — это не гарантия лучшего в реальных датацентрах через полтора года.
В целом идея понятна: OpenAI разрабатывала Jalapeño совместно с Broadcom как полностью интегрированное решение (чип, память, софт, модели) специально под задачи вывода. Главный фокус — убрать узкие места на этапах prefill (обработка контекста перед генерацией) и коммуникации между узлами. Компания явно гордится, что спроектировала специальную архитектуру хранения KV-кэша и маршрутизации вычислений под каждую фазу инфера.
Это логичный ход: массовый спрос на ИИ уже давно упирается не в обучение больших моделей, а в дешевый и быстрый вывод на масштабе. Nvidia разбогатела на этом, но её чипы — универсальный инструмент, не оптимизированный под инфер специально. OpenAI ставит свой стек и играет на узкой специализации. Если это действительно будет работать при развёртывании, это подстегнёт конкурентов на кастомные решения.
Для российских компаний, работающих с ИИ-приложениями (поиск, рекомендации, обработка текста в реальном времени), такие чипы когда-нибудь повысят доступность облачного инфера — дешевле операции будут, значит, больше сценариев окупятся. Но сейчас это история про OpenAI и её инфраструктуру. Отечественным разработчикам пока это не касается напрямую; практическое воздействие на цены облачных API наступит не раньше 2027 года, когда Jalapeño войдёт в серийное производство.
На практике интерес к Jalapeño показывает, как перетекает инвестиция в отрасли ИИ: от гонки в размере моделей и качестве обучения к гонке в инфраструктуре. OpenAI уже давно не просто компания с моделью, а полноценный стэк-разработчик. То же самое делают Google (TPU), Amazon (Trainium/Inferentia), Meta тоже пиши-мажет свои ASIC. Индустрия зреет в сторону вертикальной интеграции: у кого свой чип и оптимизированный софт, тот владеет себестоимостью и набирает масштаб быстрее, чем те, кто полагается на Nvidia.
Одна оговорка к бенчмаркам: обычно такие цифры несут маркетинговый заряд. OpenAI выбрала SemiAnalysis, известную своей ориентированностью на поддержку новых игроков. Третьи тесты от независимых сторон, когда Jalapeño попадёт в природный датацентр, покажут реальность. Спешить верить в революцию не стоит, но признать, что компания движется по разумному направлению, можно.
Meta Platforms Inc. признана экстремистской организацией, её деятельность запрещена на территории РФ; это относится и к принадлежащим ей социальным сетям Instagram и Facebook.