Архитектура Vera Rubin от NVIDIA обещает удешевить вывод данных для ИИ в десять раз

Архитектура Vera Rubin от NVIDIA обещает удешевить вывод данных для ИИ в десять раз

Arkadiy Andrienko

На выставке CES 2026 генеральный директор NVIDIA Дженсен Хуанг (Jensen Huang) представил следующее поколение вычислительной архитектуры для искусственного интеллекта — Vera Rubin, которая в будущем может стать основой для новых игровых видеокарт. Компания уже начала полномасштабное производство новых чипов, а их поставки клиентам начнутся во второй половине этого года.

Новая платформа позиционируется как преемник текущего поколения Blackwell. По заявлению NVIDIA, графический процессор Rubin обеспечивает пятикратный рост производительности в задачах вывода данных (инференса) по сравнению с предшественником. При обучении крупных языковых моделей эффективность повышается в 3.5 раза, что позволит сократить количество требуемых GPU в четыре раза для аналогичных задач.

Архитектура Vera Rubin базируется на шести специализированных компонентах:

  • Центральный процессор Vera с 88 ядрами на архитектуре Armv9.2;
  • Графический процессор Rubin с производительностью 50 петафлопс при работе с форматом NVFP4;
  • Коммутатор NVLink 6-го поколения с пропускной способностью 3.6 ТБ/с на один GPU;
  • Сетевой адаптер ConnectX-9 SuperNIC и блок обработки данных BlueField-4;
  • Коммутатор Ethernet Spectrum 6.

Особое внимание уделено энергоэффективности и надёжности. Новая технология Spectrum-X Ethernet Photonics с интегрированной оптикой, по данным компании, снижает энергопотребление в пять раз при десятикратном росте надёжности соединений. Дженсен Хуанг подчеркнул, что переход на новый техпроцесс позволил добиться такого скачка при увеличении количества транзисторов на чипе лишь в 1.6 раза. Одними из первых новую платформу получат облачные провайдеры CoreWeave и Microsoft Azure.

Архитектура Vera Rubin от NVIDIA обещает удешевить вывод данных для ИИ в десять раз

Анонс состоялся на фоне роста конкуренции на рынке ИИ-ускорителей. Помимо традиционного соперника AMD, Nvidia также противостоят крупные клиенты, такие как Google, разрабатывающие собственные чипы. В ответ компания делает ставку на существенный прирост производительности и экономической эффективности: стоимость генерации токенов при выводе данных, как ожидается, снизится в десять раз.

🥳 Кризис памяти даёт свои плоды: Microsoft хочет ускорить Windows 11 на системах с 8 Гб оперативы (и выше)
    Об авторе
    Комментарии0