OpenAI показала свой inference-чип Jalapeño — и замахнулась на NVIDIA…
OpenAI показала свой inference-чип Jalapeño — и замахнулась на NVIDIA
OpenAI раскрыла первые результаты своего чипа для инференса Jalapeño. По внутренним тестам компании, он обходит NVIDIA GB200/GB300 по нескольким ключевым метрикам.
Чип прогоняли на крупных моделях: GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T.
Что заявляют:
— производительность на ватт выше в 1,5–1,9×
— end-to-end latency ниже в 1,7–3,6×
— скорость в интерактивных сценариях выше до 4,1×
— до 1459 токенов/с на пользователя на GPT-OSS 120B
— до 700 токенов/с на DeepSeek R1
Формальный TDP Jalapeño — 700 Вт, но в тестах потребление не поднималось выше 550 Вт. Если цифры подтвердятся в реальной эксплуатации, это уже не просто «свой чип для оптимизации расходов», а серьёзная заявка на контроль всей inference-инфраструктуры.
OpenAI планирует начать развёртывание Jalapeño до конца 2026 года. При этом Gen 2 уже находится в разработке, а Gen 3 — на стадии формирования.
Похоже, OpenAI всё меньше хочет быть просто покупателем чужих ускорителей. Сначала модели, потом продукты, теперь железо. NVIDIA, конечно, пока никто не отменял, но в дата-центрах явно начинается новая игра: кто контролирует чипы, тот контролирует скорость, стоимость и лимиты.0
Похожие записи
Оцените материал:
Похожие записи
OpenAI выпустила подробный гайд по GPT-6 Astra API В гайде…
06.09.2026
DeepSeek собирает огромный AI-кластер на чипах Huawei Компания планирует развернуть…
06.09.2026
Важное о Claude За эти недели вышло ещё несколько важных…
06.09.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
