OpenAI показала свой inference-чип Jalapeño — и замахнулась на NVIDIA…
OpenAI показала свой inference-чип Jalapeño — и замахнулась на NVIDIA
OpenAI раскрыла первые результаты своего чипа для инференса Jalapeño. По внутренним тестам компании, он обходит NVIDIA GB200/GB300 по нескольким ключевым метрикам.
Чип прогоняли на крупных моделях: GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T.
Что заявляют:
— производительность на ватт выше в 1,5–1,9×
— end-to-end latency ниже в 1,7–3,6×
— скорость в интерактивных сценариях выше до 4,1×
— до 1459 токенов/с на пользователя на GPT-OSS 120B
— до 700 токенов/с на DeepSeek R1
Формальный TDP Jalapeño — 700 Вт, но в тестах потребление не поднималось выше 550 Вт. Если цифры подтвердятся в реальной эксплуатации, это уже не просто «свой чип для оптимизации расходов», а серьёзная заявка на контроль всей inference-инфраструктуры.
OpenAI планирует начать развёртывание Jalapeño до конца 2026 года. При этом Gen 2 уже находится в разработке, а Gen 3 — на стадии формирования.
Похоже, OpenAI всё меньше хочет быть просто покупателем чужих ускорителей. Сначала модели, потом продукты, теперь железо. NVIDIA, конечно, пока никто не отменял, но в дата-центрах явно начинается новая игра: кто контролирует чипы, тот контролирует скорость, стоимость и лимиты.0
Похожие записи
Оцените материал:
Похожие записи
Компании хотят, чтобы вашу переписку читал ИИ Руководители технологических компаний…
26.08.2026
Исследование Бостонского колледжа показало, что после появления ChatGPT сотрудники старше…
18.07.2026
Figma выкатили зверя: генератор сайтов, который делает всё сам —…
25.07.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
