OpenAI показала свой inference-чип Jalapeño — и замахнулась на NVIDIA…
OpenAI показала свой inference-чип Jalapeño — и замахнулась на NVIDIA
OpenAI раскрыла первые результаты своего чипа для инференса Jalapeño. По внутренним тестам компании, он обходит NVIDIA GB200/GB300 по нескольким ключевым метрикам.
Чип прогоняли на крупных моделях: GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T.
Что заявляют:
— производительность на ватт выше в 1,5–1,9×
— end-to-end latency ниже в 1,7–3,6×
— скорость в интерактивных сценариях выше до 4,1×
— до 1459 токенов/с на пользователя на GPT-OSS 120B
— до 700 токенов/с на DeepSeek R1
Формальный TDP Jalapeño — 700 Вт, но в тестах потребление не поднималось выше 550 Вт. Если цифры подтвердятся в реальной эксплуатации, это уже не просто «свой чип для оптимизации расходов», а серьёзная заявка на контроль всей inference-инфраструктуры.
OpenAI планирует начать развёртывание Jalapeño до конца 2026 года. При этом Gen 2 уже находится в разработке, а Gen 3 — на стадии формирования.
Похоже, OpenAI всё меньше хочет быть просто покупателем чужих ускорителей. Сначала модели, потом продукты, теперь железо. NVIDIA, конечно, пока никто не отменял, но в дата-центрах явно начинается новая игра: кто контролирует чипы, тот контролирует скорость, стоимость и лимиты.0
Похожие записи
Оцените материал:
Похожие записи
Новый подход к Claude Opus 4.6: меньше «магии», больше структуры…
03.03.2026
Скандал вокруг Пентагона: пользователи массово удаляют ChatGPT В США разгорелась…
04.03.2026
GPT-5.1-Codex-Max превращает ChatGPT в полноценного разработчика, а не подсказчика —…
27.11.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
