Спецификации Rubin Ultra Cuts: сможет ли Nvidia справиться с растущими ценами на память?

By: rootdata|2026/08/03 04:57:59
0
Поделиться
copy
Оценить в GoogleОценить в Google

Оригинал | Odaily Planet Daily (++@OdailyChina++)

Автор | Azuma (++@azuma_eth++)

На прошлых выходных отчет известной исследовательской компании SemiAnalysis вызвал значительные обсуждения в индустрии ИИ.

Основное содержание отчета гласит, после того как SemiAnalysis в конце июня сообщила, что оригинальный дизайн Rubin Ultra от Nvidia (NVIDIA) будет сокращен вдвое, исследовательская компания теперь раскрыла, что Nvidia предоставила предварительный просмотр Rubin Ultra основным клиентам, но его спецификации еще больше снизились по сравнению с предыдущими ожиданиями.

Скриншоты информации, связанной с Rubin Ultra, утекшие в отчете SemiAnalysis, следующие:

  • Rubin Ultra сохранит ту же теоретическую пик производительность, что и Rubin, обе на уровне 35 PFLOPs;
  • Объем памяти был значительно уменьшен, спецификации упали до 192 ГБ с 8-слойной упаковкой (8-Hi), даже ниже, чем у Rubin с 288 ГБ и 12-слойной упаковкой (12-Hi);
  • Изменение пропускной способности памяти незначительно, увеличившись всего на 1 ТБ/с, что в основном можно игнорировать при фактических вычислениях с высокой пропускной способностью;
  • Потребление энергии на уровне чипа даже немного увеличилось, минимальное потребление энергии такое же, как у Rubin (1800 Вт), но максимальное потребление энергии выше (2600 Вт);
  • Единственное значительное улучшение — это "масштабирование размера мира", которое увеличилось с 72 GPU до 576 GPU, что означает, что Nvidia сместила реальную точку продажи на кластерную сеть, позволяя подключать до 576 GPU Rubin Ultra в огромный "супер логический GPU" (Rubin поддерживает соединение только до 72 карт).

Первоначально позиционированный как флагманская версия Nvidia, объявленная на GTC 2026, Rubin Ultra был разработан для интеграции большего количества чипов и высокоскоростной памяти, чтобы удовлетворить экстремальные масштабы обучения и вывода ИИ моделей. Однако, основываясь на последних спецификациях, раскрытых SemiAnalysis, очевидно, что Nvidia скорректировала концепцию дизайна Rubin Ultra.

Резкое увеличение цен на HBM заставляет Nvidia пересмотреть свои планы

За последние два года одним из самых критических компонентов в расширении индустрии ИИ, безусловно, стал HBM.

С взрывным спросом на ускорители ИИ, такие как Nvidia H100, H200 и Blackwell, высокоскоростная память перешла от относительно нишевого высококлассного продукта хранения к самому дефицитному компоненту во всей инфраструктуре ИИ. SK Hynix, Samsung и Micron постоянно увеличивают свои инвестиции в HBM, одновременно обновляя свои характеристики, но дисбаланс между предложением и спросом продолжает поднимать цены на HBM.

Для производителей чипов важность HBM очевидна — GPU обрабатывают вычисления, в то время как HBM обеспечивает высокоскоростную передачу данных, и вместе они определяют эффективность обучения и вывода ИИ моделей. Однако проблема в том, что HBM стал настолько дорогим, что начинает влиять на общую экономику ИИ систем. Например, цена HBM3 в своем низком уровне во втором квартале 2025 года составляла всего 180-220 долларов, но она выросла до 600-700 долларов в первом квартале этого года (контрактная цена) и даже выше до 700-850 долларов во втором квартале (спотовая цена).

Согласно оценкам SemiAnalysis, по мере роста цен на HBM, чистая стоимость материалов (BOM) одного стойки Rubin Ultra увеличилась с примерно 6,6 миллиона долларов до 8 миллионов долларов, но после корректировки спецификаций дизайна стоимость может снизиться до примерно 6,4 миллиона долларов.

Для Nvidia такая значительная разница в стоимости поднимает очень реальный вопрос — если они продолжат увеличивать объем HBM в соответствии с оригинальным дизайном, принесет ли это все еще улучшения производительности, соответствующие затратам? Есть ли другие лучшие варианты?

SemiAnalysis предоставила ответ в отчете, заявив, что корректировки Rubin Ultra по сути представляют собой оптимизацию Nvidia структуры затрат ИИ системы в условиях ограниченных ресурсов, снижая относительно дорогую конфигурацию HBM (доля затрат снижается с почти 40% до 28%) и перераспределяя ресурсы на более ценные возможности масштабирования межсоединений (доля затрат увеличивается с 4% до 12%).

Как уже упоминалось, основное направление обновления Rubin Ultra теперь сместилось на "возможности масштабирования межсоединений на уровне системы". Архитектура NVL576, поддерживаемая Rubin Ultra, может соединять до 576 GPU в единое вычислительное пространство через NVLink, стремясь компенсировать корректировки в спецификациях отдельных чипов более крупными системными расширениями.

Акции производителей памяти падают, рынок беспокоится о пике спроса

В ответ на эту новость акции, связанные с памятью, коллективно упали после открытия корейского фондового рынка этим утром. На 11:45 по пекинскому времени, SK Hynix и Samsung, две ведущие компании по производству HBM, упали примерно на 8%, а индекс KOSPI также снизился примерно на 5%.

Рынок начал беспокоиться о том, что если корректировки спецификаций для Rubin Ultra, раскрытые SemiAnalysis, верны (Nvidia не подтвердила эту информацию публично), означает ли это, что Nvidia, как основной покупатель в инфраструктуре ИИ, снижает свой спрос на HBM?

За последние два года, с быстрым ростом спроса на расширение ИИ, HBM стал самым дефицитным элементом инфраструктуры ИИ. Производители чипов, такие как Nvidia и AMD, постоянно увеличивали конфигурации HBM в ускорителях ИИ, что способствовало росту производительности таких компаний, как SK Hynix, Samsung и Micron, одновременно усиливая их ценовую власть по всей цепочке поставок.

Выбор Nvidia может указывать на то, что производители чипов ИИ рассматривают возможность оптимизации дизайна аппаратного обеспечения, чтобы снизить зависимость от высокоемкого HBM для отдельных чипов. Если этот путь окажется жизнеспособным, возможности для производителей HBM продолжать повышать цены, вероятно, будут ограничены.

Строительство инфраструктуры ИИ в конечном итоге уйдет от эпохи "безумного наращивания и бездумного повышения цен", и теперь даже Nvidia, сидя на троне вычислительной мощности, начала ужесточать свой бюджет.

Цена --

--

Этот контент предоставляется исключительно в общих информационных целях и не является финансовым, инвестиционным, юридическим или налоговым советом. Любые мероприятия, вознаграждения, онлайн-акции или связанная с ними информация, упомянутые в настоящем документе, не должны рассматриваться как рекомендация, приглашение к покупке, продаже, торговле или иной сделке с какими-либо криптоактивами. Криптоактивы очень волатильны и могут привести к убыткам. Доступность услуг, продуктов WEEX и связанных с ними событий может варьироваться в зависимости от региона. Вы несете ответственность за обеспечение того, чтобы ваше участие соответствовало применимым местным законам и нормативным актам.

Вам также может понравиться

Содержание

Свежие статьи

Еще

Свежие листинги на WEEX

iconiconiconiconiconiconiconiconicon
Служба поддержки:@weikecs
Деловое сотрудничество:@weikecs
Количественная торговля и ММ:bd@weex.com
VIP-программа:support@weex.com