Bitget App
Торгуйте разумнее
Купить криптовалютуРынкиТорговляФьючерсыEarnAISquareПодробнее
Мин-Чи Куо: Nvidia возобновила проект оптимизации чипа для инференса Rubin CPX

Мин-Чи Куо: Nvidia возобновила проект оптимизации чипа для инференса Rubin CPX

华尔街见闻华尔街见闻2026/09/01 11:01
Показать оригинал
Автор:华尔街见闻

Согласно исследованию известного аналитика Мин-Чи Куо, Nvidia возобновляет проект чипа для AI-инференса предварительного заполнения "Rubin CPX", массовое производство которого ожидается в начале 2027 года. Новая версия снабжена 168 ГБ видеопамяти HBM4, энергопотребление составляет 2300 Вт, а вычислительная мощность близка к стандартному Rubin GPU. Данный чип использует отдельную модульную стойку и многоуровневую архитектуру соединений, распределяется совместно с Rubin GPU в пропорции 1:1, специализируется на предварительном заполнении и генерации KV Cache, чтобы снизить стоимость вывода при работе с длинным контекстом.

Nvidia тихо возобновила проект по разработке чипа, который ранее считался рынком заброшенным, цель которого — снижение затрат на AI-инференс в наиболее затратной фазе предзаполнения (Prefill).

Согласно последнему отраслевому исследованию известного аналитика Мина-Чи Куо, Nvidia вновь начала проект по созданию ускоряющего GPU для предзаполнения AI-инференса “Rubin CPX” и значительно изменила его продуктовый дизайн. По текущему плану, обновленный Rubin CPX предполагается запустить в производство в первом квартале 2027 года.

Возобновление проекта является ясным сигналом: Nvidia значительно усиливает фокус на решении проблемы производительности и стоимости этапа предзаполнения в AI-инференсе. По мере того как длина контекста у больших моделей постоянно увеличивается, этап предзаполнения вынужден обрабатывать огромные объемы входной информации и создавать KV Cache, эффективность чего напрямую влияет на общую стоимость и экономику внедрения AI-инференса.

По словам Мина-Чи Куо, в настоящее время более 50% нагрузки AI-инференса приходится на обработку входного контекста и построение KV Cache.

Значительное изменение спецификаций чипа, вычислительная мощность близка к стандартному Rubin

Ключевые характеристики обновленного Rubin CPX значительно изменились по сравнению с предыдущей версией.

По вычислительной мощности и энергопотреблению обновленный CPX теперь почти сравнялся со стандартным GPU Rubin, максимальное потребление одной карты также достигает 2300 ватт. Что касается памяти, новый CPX теперь оснащается 168 ГБ HBM4, что является значительным обновлением по сравнению с предыдущими 128 ГБ GDDR7, но все же уступает стандартному Rubin GPU с 288 ГБ HBM4.

По словам Куо Мина-Чи, суммарная емкость HBM4 для восьми GPU CPX в вычислительном лотке составляет примерно 1,34 ТБ, чего достаточно для большинства задач длинноконтекстного предзаполнения и соответствующих KV Cache. Это означает, что Rubin CPX ориентирован не только на повышение универсальной мощности, а на переработку видеопамяти и эффективности предзаполнения для работы с длинными контекстами.

Переход от совместных стоек к независимой развертке, более гибкая конфигурация

Архитектура стоек также стала ключевым моментом данного обновления.

В предыдущем проекте CPX задумывался как часть общей стойки с Rubin GPU; в новой версии предлагается использовать отдельные стойки MGX ETL, что позволяет клиентам независимо масштабировать мощности CPX, исходя из реальных нужд.

Подробно: клиенты могут выбрать масштабы развертывания с 64, 128, 192 или 256 GPU CPX. Каждый модуль стойки на 64 GPU CPX состоит из 8 вычислительных лотков, в каждом из которых установлено по 8 GPU CPX, а также одного лотка-коммутатора.

Модульный дизайн означает, что заказчикам не требуется делать закупки крупных стоек Rubin, а можно гибко увеличивать мощности CPX по мере роста потребностей в предзаполнении.

Многоуровневая сетевая архитектура снижает стоимость внедрения предзаполнения

Что касается сетевой архитектуры, Rubin CPX реализует многоуровневый подход, балансируя между производительностью и затратами.

Внутри вычислительного лотка 8 GPU CPX соединены через NVLink для расширения Scale-up. Пропускная способность NVLink на одну GPU CPX составляет 1–1,5 ТБ/с, что ниже, чем у стандартной Rubin GPU, которая достигает 3,6 ТБ/с.

На уровне коммуникации между лотками и внутри модулей стоек (Scale-out) CPX использует полностью медные Ethernet-линии Spectrum-6 L1; для соединения между модулями стоек применяется коммутатор Spectrum-6 с использованием оптоволоконных линий OSFP.

В отличие от систем, полностью основанных на высокоскоростных соединениях между GPU, эта многоуровневая архитектура ориентирована на оптимизацию затрат именно для сценариев предзаполнения.

В связке с Rubin GPU, нацелено на длинноконтекстный инференс

Rubin CPX — это не самостоятельный универсальный GPU, а ускоритель предзаполнения, предназначенный для совместной работы с Vera Rubin NVL72.

По словам Мина-Чи Куо, Nvidia рекомендует развертывать CPX и Rubin GPU в соотношении 1:1: CPX отвечает за вычисления и формирование KV Cache на этапе предзаполнения, после чего по Ethernet RDMA KV Cache передается Rubin GPU, который выполняет дальнейшее декодирование.

С точки зрения позиционирования продукта, главное назначение Rubin CPX — не замена стандарных Rubin GPU, а дальнейшее разделение процессов AI-инференса, в котором разные GPU берут на себя задачи предзаполнения и декодирования.

Мина-Чи Куо считает Rubin CPX «лучшим по соотношению цена/качество решением для длинноконтекстного предзаполнения». По мере расширения окон контекста AI-моделей, вычислительная нагрузка и объем KV Cache этапа предзаполнения продолжают расти. Возобновляя проект CPX, Nvidia, вероятно, пытается с помощью специализированного оборудования и гетерогенного развертывания еще сильнее снизить стоимость длинноконтекстного инференса.

0
0

Дисклеймер: содержание этой статьи отражает исключительно мнение автора и не представляет платформу в каком-либо качестве. Данная статья не должна являться ориентиром при принятии инвестиционных решений.

PoolX: вносите активы и получайте новые токены.
APR до 12%. Аирдропы новых токенов.
Внести!

Вам также может понравиться

Кук ушёл, но остался в деле: новый CEO Apple сталкивается с главным испытанием — как управлять AI-трансформацией под пристальным взором «бывшего босса»?

Генеральный директор Apple Тим Кук официально покинет пост 1 сентября. Его преемником станет руководитель аппаратного подразделения Джефф Уильямс, а сам Кук перейдёт на должность исполнительного председателя и продолжит заниматься внешними вопросами. 51-летний Уильямс известен своим опытом в разработке продуктов, что соответствует потребности Apple в инновационном оборудовании для перехода к AI, однако у него недостаточно опыта в политико-деловых отношениях. Аналитики считают, что пребывание Кука в компании поможет обеспечить плавный переход, но это также может ограничить самостоятельность нового CEO. Настоящее испытание заключается в том, сможет ли Уильямс, опираясь на опыт Кука, постепенно выстроить собственное лидерство и успешно провести Apple через трансформацию в сфере искусственного интеллекта.

华尔街见闻2026/09/01 13:41

Salesforce (CRM.US) возглавила последний раунд финансирования единорога “AI + HR” HiBob, вложив реальные средства и опровергнув “конец SaaS-эпохи”.

Компания Salesforce инвестировала в компанию по разработке программного обеспечения для управления персоналом HiBob, оценённую в 3,2 миллиарда долларов.

智通财经2026/09/01 12:36
Salesforce (CRM.US) возглавила последний раунд финансирования единорога “AI + HR” HiBob, вложив реальные средства и опровергнув “конец SaaS-эпохи”.

Citadel: в сентябре на американском фондовом рынке возможна «тактическая фаза снижения», рекомендуется сокращать позиции на росте и покупать защитные инструменты по низким ценам.

Главный стратег по акциям Citadel Securities предупреждает, что с завершением позитивных квартальных отчетов американских компаний, сезонным ослаблением спроса со стороны розничных инвесторов и обратного выкупа акций, а также массовым истечением опционов и возвращением макроэкономических рисков, в сентябре повышается тактический риск снижения американского рынка акций. Учитывая, что стоимость хеджирования сейчас находится на низком уровне, он советует инвесторам «продавать на подъеме и покупать защиту по низкой цене», ожидая более конструктивных возможностей для инвестиций в середине октября.

华尔街见闻2026/09/01 12:06