Архив рубрики ~Лента новостей~

Nvidia представляет новую мощную архитектуру чипа Rubin.

Nvidia представляет новую мощную архитектуру чипа Rubin.
Дженсен Хуанг
Источник изображения: Chesnot / Getty Images

Сегодня на выставке CES генеральный директор Nvidia Дженсен Хуанг официально представил новую вычислительную архитектуру Rubin, которую он назвал передовой в области аппаратного обеспечения для искусственного интеллекта. Новая архитектура в настоящее время находится в производстве, и ожидается, что ее выпуск будет продолжен во второй половине года.

«Vera Rubin разработана для решения этой фундаментальной проблемы: объем вычислительных ресурсов, необходимых для ИИ, стремительно растет», — сказал Хуанг аудитории. «Сегодня я могу сказать вам, что Vera Rubin находится в стадии полномасштабного производства».

Архитектура Rubin, впервые анонсированная в 2024 году, является последним результатом неустанного цикла разработки аппаратного обеспечения Nvidia, который превратил компанию в самую дорогую корпорацию в мире. Архитектура Rubin заменит архитектуру Blackwell, которая, в свою очередь, заменила архитектуры Hopper и Lovelace.

Чипы Rubin уже запланированы к использованию практически всеми крупными поставщиками облачных услуг, включая громкие партнерские соглашения Nvidia с Anthropic, OpenAI и Amazon Web Services. Системы Rubin также будут использоваться в суперкомпьютере HPE Blue Lion и в готовящемся к запуску суперкомпьютере Doudna в Национальной лаборатории имени Лоуренса в Беркли.

Архитектура Rubin, названная в честь астронома Веры Флоренс Купер Рубин, состоит из шести отдельных чипов, предназначенных для совместного использования. В центре архитектуры находится графический процессор Rubin, но она также решает растущие проблемы с хранением данных и межсоединениями благодаря новым улучшениям в системах Bluefield и NVLink соответственно. Архитектура также включает в себя новый центральный процессор Vera, разработанный для агентного мышления.

Объясняя преимущества нового хранилища, старший директор Nvidia по решениям для инфраструктуры ИИ Дион Харрис указал на растущие потребности современных систем ИИ в памяти, связанной с кэшированием.

«Когда вы начинаете внедрять новые типы рабочих процессов, такие как агентный ИИ или долгосрочные задачи, это создает большую нагрузку и предъявляет высокие требования к вашему кэшу ключ-значение», — сказал Харрис журналистам во время телефонного разговора, имея в виду систему памяти, используемую моделями ИИ для сжатия входных данных. «Поэтому мы ввели новый уровень хранения, который подключается к вычислительному устройству извне, что позволяет гораздо эффективнее масштабировать ваш пул хранения».

Как и ожидалось, новая архитектура также представляет собой значительный шаг вперед в скорости и энергоэффективности. Согласно тестам Nvidia, архитектура Rubin будет работать в три с половиной раза быстрее, чем предыдущая архитектура Blackwell, в задачах обучения моделей и в пять раз быстрее в задачах вывода, достигая производительности до 50 петафлопс. Новая платформа также обеспечит в восемь раз большую вычислительную мощность на ватт при выполнении задач вывода.

Новые возможности компании Rubin появились на фоне ожесточенной конкуренции за создание инфраструктуры искусственного интеллекта, в результате которой как лаборатории ИИ, так и облачные провайдеры борются за чипы Nvidia, а также за необходимые для их работы ресурсы. В ходе телефонной конференции по итогам финансового года в октябре 2025 года Хуанг оценил, что в течение следующих пяти лет на инфраструктуру ИИ будет потрачено от 3 до 4 триллионов долларов.

Следите за всеми материалами TechCrunch о ежегодной конференции CES здесь.

Источник: techcrunch.com

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Коротко из Telegram~ Нейронку БЕЗ ЦЕНЗУРЫ выпустили в открытый доступ — Gemma 4… Архив рубрики ~Коротко из Telegram~ Нашли комбайн для скачивания видео и музыки практически отовсюду —… Архив рубрики ~Коротко из Telegram~ Инструменты дня 🔍 Кьюи Перепроверяет ChatGPT, Claude и Gemini перед отправкой, потому… Архив рубрики ~Коротко из Telegram~ Kimi K3 нашла уязвимость в Redis за 27 минут Исследователь… Архив рубрики ~Коротко из Telegram~ Alibaba представила мощный движок синтеза речи Qwen-Audio-3.0-TTS Команда Qwen выпустила… Архив рубрики ~Коротко из Telegram~ Lightricks научила ИИ убирать лишних людей и машины с видео… Архив рубрики ~Коротко из Telegram~ Copilot теперь живет в «Проводнике» Windows 11 Microsoft продолжает встраивать… Архив рубрики ~Коротко из Telegram~ GitHub Copilot теперь поддерживает модель Gemini 3.6 Flash GitHub начал… Архив рубрики ~Коротко из Telegram~ Anthropic представила плагин Claude Security для поиска уязвимостей Anthropic выпустила… Архив рубрики ~Коротко из Telegram~ Cursor Router: снижение стоимости запросов к ИИ на 60% Команда… Архив рубрики ~Коротко из Telegram~ Российский разработчик СУБД Postgres Pro может сократить до 30% сотрудников…. Архив рубрики ~Коротко из Telegram~ Veon досрочно выкупил облигации на $886 млн, одновременно разместив новый… Архив рубрики ~Коротко из Telegram~ 💢 Иван Паломарес Каррaскоса (Machine Learning Mastery) разбирает пять стратегий… Архив рубрики ~Коротко из Telegram~ ✅ CEO Cloudflare Мэттью Принс на мероприятии Axios в Каннах… Архив рубрики ~Коротко из Telegram~ Нейронку БЕЗ ЦЕНЗУРЫ выпустили в открытый доступ — Gemma 4… Архив рубрики ~Коротко из Telegram~ Нашли комбайн для скачивания видео и музыки практически отовсюду —… Архив рубрики ~Коротко из Telegram~ Инструменты дня 🔍 Кьюи Перепроверяет ChatGPT, Claude и Gemini перед отправкой, потому… Архив рубрики ~Коротко из Telegram~ Kimi K3 нашла уязвимость в Redis за 27 минут Исследователь… Архив рубрики ~Коротко из Telegram~ Alibaba представила мощный движок синтеза речи Qwen-Audio-3.0-TTS Команда Qwen выпустила… Архив рубрики ~Коротко из Telegram~ Lightricks научила ИИ убирать лишних людей и машины с видео… Архив рубрики ~Коротко из Telegram~ Copilot теперь живет в «Проводнике» Windows 11 Microsoft продолжает встраивать… Архив рубрики ~Коротко из Telegram~ GitHub Copilot теперь поддерживает модель Gemini 3.6 Flash GitHub начал… Архив рубрики ~Коротко из Telegram~ Anthropic представила плагин Claude Security для поиска уязвимостей Anthropic выпустила… Архив рубрики ~Коротко из Telegram~ Cursor Router: снижение стоимости запросов к ИИ на 60% Команда… Архив рубрики ~Коротко из Telegram~ Российский разработчик СУБД Postgres Pro может сократить до 30% сотрудников…. Архив рубрики ~Коротко из Telegram~ Veon досрочно выкупил облигации на $886 млн, одновременно разместив новый… Архив рубрики ~Коротко из Telegram~ 💢 Иван Паломарес Каррaскоса (Machine Learning Mastery) разбирает пять стратегий… Архив рубрики ~Коротко из Telegram~ ✅ CEO Cloudflare Мэттью Принс на мероприятии Axios в Каннах…