Компания OpenAI заявила, что её новый чип Jalapeno превзошёл процессор Nvidia GB300 по двум ключевым показателям производительности в ходе тестирования. Разработчик ChatGPT планирует начать использовать собственные процессоры для работы моделей искусственного интеллекта уже в этом году, чтобы снизить затраты на инфраструктуру, сообщил руководитель подразделения по разработке чипов OpenAI Ричард Хо в интервью Bloomberg.
Новый процессор предназначен для этапа инференции — работы уже обученных моделей с запросами пользователей, а не для их обучения. Именно это направление OpenAI считает критически важным для масштабирования сервисов вроде ChatGPT.
По словам Хо, Jalapeno продемонстрировал лучшую энергоэффективность и скорость ответов по сравнению с Nvidia GB300, который был лидером в системе публичного тестирования, использованной в исследовании. Разработчик добавил, что главное преимущество Jalapeno заключается в сочетании высокой пропускной способности и низкой задержки, что обычно достигается с помощью различных типов чипов.
Процессор потребляет около 700 Вт, что, по оценкам OpenAI, поможет сократить расходы центров обработки данных на электроэнергию. Компания рассчитывает выполнять всё больше задач с помощью собственных чипов при условии масштабирования производства Jalapeno.
OpenAI создала процессор в партнерстве с Broadcom. Компании объявили о сотрудничестве в прошлом году, а в июне сообщили, что разработка чипа завершилась в рекордные сроки.
Во время публичных тестов Jalapeno работал с открытой моделью OpenAI, а также с моделями китайских компаний DeepSeek и Moonshot AI. Наилучшие результаты он продемонстрировал с Kimi от Moonshot — самой большой моделью среди тех, что использовались в испытаниях.
В компании также сообщили, что внутренние тесты показали высокую производительность с еще не представленными крупными языковыми моделями OpenAI. В блоге компании отметили, что архитектура процессора «становится более ценной по мере роста объемов и сложности рабочих нагрузок».
В то же время OpenAI признает ограничения нового чипа. Jalapeno не тестировали в сравнении с новым поколением процессоров Nvidia Vera Rubin, поставки которых только начались, а также он не предназначен для обучения моделей — сегмента, где Nvidia остается лидером рынка.
«Потребность в вычислительных мощностях огромна, именно поэтому мы привлекли так много разных поставщиков. И так будет продолжаться еще некоторое время», — отметил Хо.
OpenAI уже работает над вторым поколением Jalapeno, которое планирует запустить в производство в ближайшие месяцы. Параллельно компания разрабатывает концепцию третьей версии процессора, рассчитывая постепенно снизить стоимость глобальной инфраструктуры ИИ. И, несмотря на амбициозные планы, OpenAI называет Nvidia стратегическим партнером и не ожидает скорой замены её решений собственными разработками.
В то же время Nvidia стремительно теряет доминирующее положение на китайском рынке, где до введения экспортных ограничений США контролировала около 95% сегмента чипов для ИИ. Благодаря переходу разработчиков в Китае на линейку отечественных процессоров Ascend от Huawei доля китайской компании на рынке ИИ-чипов вырастет до примерно 50%.
