Bitget App
Торгуйте разумнее
Купить криптовалютуРынкиТорговляФьючерсыEarnAISquareПодробнее
NVIDIA объявила о полном запуске Groq 3 LPX, эффективность вывода Vera Rubin увеличилась в несколько раз, SpaceXAI усиливает инвестиции в агентов и космический искусственный интеллект.

NVIDIA объявила о полном запуске Groq 3 LPX, эффективность вывода Vera Rubin увеличилась в несколько раз, SpaceXAI усиливает инвестиции в агентов и космический искусственный интеллект.

华尔街见闻华尔街见闻2026/08/24 17:01
Показать оригинал
Автор:华尔街见闻

Компания Nvidia заявила, что на основе рабочей нагрузки AgentX от SemiAnalysis и модели DeepSeek V4 Pro, пропускная способность Vera Rubin на один мегаватт достигает в 30 раз больше, чем у предыдущего поколения GB300 NVL72, а стоимость за один токен снижена до 35 раз. SpaceXAI будет использовать процессоры Vera для ускорения приложений следующего поколения intelligent agents на базе AI, а также расширять платформу на основе Vera Rubin. SpaceXAI планирует вывести оптимизированную Vera Rubin NVL72 в космос для использования в первом поколении спутников Starmind AI.

Nvidia ускоряет конкуренцию в области инфраструктуры AI, переводя ее от традиционной производительности обучения моделей и вывода к новому этапу, сконцентрированному вокруг скорости генерации Token, энергопотребления и стоимости для агентных AI (Agentic AI).

В понедельник, 24 числа по восточному времени США, Nvidia объявила о полномасштабном запуске Groq 3 LPX, ориентированного на интерактивный AI inference. Как важный компонент платформы Vera Rubin, Groq 3 LPX специализируется на сверхнизкой задержке генерации Token. Nvidia заявляет, что в тестировании Artificial Analysis при использовании модели Gemma 4 31B и контексте из 100 000 Token, Groq 3 LPX достиг 3400 выходных Token в секунду, что стало рекордом для этой модели; для рабочих нагрузок с низкой задержкой, таких как программирование агентных AI, его скорость отклика достигает максимума в 4 раза выше по сравнению с ближайшими конкурентными платформами.

Одновременно Nvidia представила новые результаты тестирования Vera Rubin NVL72 на реальных агентных рабочих нагрузках: на основе рабочей нагрузки AgentX от SemiAnalysis и модели DeepSeek V4 Pro платформа Vera Rubin достигла максимальной производительности до 30 раз выше по сравнению с предыдущим поколением GB300 NVL72 при расчёте на мегаватт (MW), а стоимость за Token снизилась до 35 раз. В Nvidia подчеркивают, что агентные задачи отличаются от традиционного чата или резюмирования — контекст задачи увеличивается сотнями шагов и может достигать десятков тысяч Token.

NVIDIA объявила о полном запуске Groq 3 LPX, эффективность вывода Vera Rubin увеличилась в несколько раз, SpaceXAI усиливает инвестиции в агентов и космический искусственный интеллект. image 0

В тот же день Nvidia также сообщила, что SpaceXAI будет использовать Vera CPU для ускорения следующего поколения агентных AI-приложений, а также расширит строительство платформы на базе Vera Rubin с увеличением мощности до нескольких ГВт; кроме того, SpaceXAI планирует адаптировать оптимизированный Vera Rubin NVL72 для использования на первом поколении спутников Starmind AI.

Groq 3 LPX в полномасштабном производстве — Nvidia завершает “последнюю милю” для агентных систем

Запуск Groq 3 LPX в полномасштабное производство имеет ключевую цель не заменить GPU специализированными чипами inference, а дополнить Vera Rubin возможностями традиционной GPU-архитектуры для низкозадержанной генерации Token.

Для агентных систем одна задача часто перестаёт быть “вопрос-ответ”: агент должен читать файлы, вызывать инструменты, выполнять код, проверять результаты и затем продолжать рассуждение по результатам, повторяя это сотни или даже тысячи раз. В этом процессе скорость генерации Token на каждом этапе напрямую влияет на общее время выполнения всей задачи.

Nvidia отмечает, что Agentic AI порождает две вычислительные задачи: эффективная обработка постоянно растущего большого контекста и генерация Token с крайне малой задержкой. Vera Rubin NVL72 отвечает за широкое обучение, inference и обработку контекста, а Groq 3 LPX оптимизирован для максимизации скорости взаимодействия с одним пользователем, ускоряя генерацию Token.

Последние тесты Nvidia показывают, что Groq 3 LPX способен достигать 3400 выходных Token/сек в условиях Gemma 4 31B и контекста 100K; при агентных задачах и других нагрузках с чувствительностью к задержке время отклика в 4 раза опережает ближайших конкурентов. Nvidia отмечает, что такая скорость позволяет агенту быстрее завершать цепочки задач, таких как написание кода, тестирование, вызов инструментов и проверка результатов.

В части коммерциализации Nebius, облачный AI-сервис, станет первым облачным провайдером, который интегрирует Groq 3 LPX, планируя развернуть его на своей платформе Nebius Token Factory для inference-продукции. Groq также станет одним из первых пользователей этой платформы.

Это означает, что с полным запуском Groq 3 LPX возможности, появившиеся после приобретения Groq компанией Nvidia, начинают реально интегрироваться в продуктовую линейку дата-центров Vera Rubin.

30-кратный рост — не “скорость”, а количество задач агентных AI на каждый мегаватт

В отличие от 3400 Token/сек как отдельного показателя производительности, в этот раз Nvidia делает акцент на пропускной способности на мегаватт и стоимости за Token.

По тестам Nvidia, на рабочей нагрузке SemiAnalysis AgentX Vera Rubin NVL72 обеспечивает до 30 раз выше пропускную способность на мегаватт по сравнению с GB300 NVL72 и до 35 раз меньшую стоимость за Token. Тест использует реальные сценарии программирования агентных систем, включая рост контекста, вызовы инструментов и генерацию подагентов.

NVIDIA объявила о полном запуске Groq 3 LPX, эффективность вывода Vera Rubin увеличилась в несколько раз, SpaceXAI усиливает инвестиции в агентов и космический искусственный интеллект. image 1

Таким образом, 30-кратный рост пропускной способности на мегаватт отражает не столько простое увеличение скорости inference чипа, сколько радикальное повышение общей эффективности inference AI.

Этот показатель особенно критичен для AI-дата-центров.

Традиционные сервисы больших моделей в большей степени ориентируются на задержку и пропускную способность каждого запроса, в то время как агентные рабочие нагрузки потребляют Token на постоянной основе. По данным Nvidia (ссылка на OpenRouter), агентные AI нагрузки могут использовать в 15 раз больше Token, чем простой чат. Причина в том, что агент может сначала опрашивать базу данных, затем искать новости и документы, вызывать подагентов для анализа, выполнять код и неоднократно проверять результаты, всё время увеличивая контекст.

Это приводит к изменению способа оценки экономической эффективности AI-инфраструктуры: сколько полезных задач агентных AI можно выполнить на один мегаватт мощности?

В условиях, когда электричество и ресурсы дата-центров становятся основным ограничением для AI, увеличение количества Token, генерируемых на единицу энергии, может быть важнее, чем просто наращивание пиковой вычислительной мощности.

Vera Rubin трансформируется из “GPU платформы” в полноценную AI-фабрику

С архитектурной точки зрения, Groq 3 LPX — не изолированный продукт, а часть “максимально координирированного дизайна” Nvidia Vera Rubin.

NVIDIA объявила о полном запуске Groq 3 LPX, эффективность вывода Vera Rubin увеличилась в несколько раз, SpaceXAI усиливает инвестиции в агентов и космический искусственный интеллект. image 2

Nvidia ранее уже обозначила Vera Rubin как платформу AI-фабрики для эпохи агентных AI. Система построена не только на GPU, а спроектирована как координированный комплекс вычислений, сетей, хранения и ПО, включая Rubin GPU, Vera CPU, Groq 3 LPX, BlueField-4 DPU, Spectrum-6 SPX и другие компоненты.

Rubin GPU отвечает за крупномасштабное обучение, inference и обработку контекста; Groq 3 LPX — за высокоскоростную генерацию Token; Vera CPU обрабатывает массивные нагруженные задачи между вызовами моделей, такие как организация инструментов, выполнение кода, обработка данных и моделирование.

По ранее опубликованным данным Nvidia, платформа Vera Rubin использует семь типов чипов и пять видов специализированных стоек для координированного/projectного дизайна, что означает: разные типы “железа” исполняют свои задачи, не перекладывая всю нагрузку на один процессор.

Иначе говоря, Nvidia трансформирует AI-инфраструктуру от “кластеров GPU” к гетерогенной вычислительной системе.

Для облачных AI-провайдеров это означает, что можно динамично оптимизировать ресурсы на каждом этапе — обучение, длинный контекст, генерация Token, вызовы инструментов — для повышения загрузки и экономической отдачи всего дата-центра.

SpaceXAI увеличивает ставку на Vera: агентные AI переходят из дата-центров в космос

Параллельно с запуском Groq 3 LPX в промышленное производство, SpaceXAI объявила о дальнейшем внедрении системы Vera Rubin от Nvidia.

24 августа Nvidia сообщила, что SpaceXAI внедрит Vera CPU для приложений следующего поколения агентных AI. Vera специально оптимизирована под рабочие нагрузки для CPU вне inference моделей — включая вызовы инструментов, выполнение кода, обработку данных, организацию задач и моделирование.

Vera построена на 88 собственных ядрах Olympus от Nvidia и оборудована оперативной памятью LPDDR5X с пропускной способностью до 1,2 ТБ/с. Как утверждает Nvidia, на рабочих нагрузках агентных AI, reinforcement learning и обработке данных производительность Vera может превышать CPU x86 до 1,8 раз.

Для SpaceXAI ценность Vera не только в ускорении CPU.

В процессе работы агентных систем большинство задач происходят между inference на GPU, например, выполнение кода, обработка данных, вызовы инструментов и координация нескольких агентов. Недостаточная производительность CPU для этих операций приводит к простоям GPU и снижению общей эффективности AI-фабрики.

Именно поэтому SpaceXAI рассчитывает, что Vera возьмёт на себя обработку таких “вне-модельных” задач, позволяя GPU больше сосредоточиться на обучении и inference для поднятия эффективности всей системы.

SpaceXAI также планирует расширить инфраструктуру Grok AI на базе Vera Rubin, масштабируя вычисления до уровня нескольких гигаватт; более того, компания намерена перенести оптимизированную Vera Rubin NVL72 на первый спутник Starmind AI.

Это означает, что комплекс ускоренных вычислений Nvidia выходит за пределы наземных дата-центров, переходя в орбитальные вычисления.

От “чат-ботов” к “самостоятельному исполнению” — запросы к AI-вычислениям меняются

От масштабного выхода Groq 3 LPX до публикации 30-кратной производительности за мегаватт Vera Rubin и запуска Vera Rubin в космос с помощью SpaceXAI — все эти шаги Nvidia отражают одно общее изменение: AI-приложения трансформируются от генерации контента к самостоятельному выполнению задач.

В сценариях чата и резюмирования пользователю достаточно быстро получить текст от модели; в агентных режимах модели требуется постоянное рассуждение, вызовы инструментов, выполнение кода, обращение к внешним данным и регулярная валидация результатов.

Таким образом, ключевые показатели AI-инфраструктуры в будущем также будут меняться — фокус сместится от “тренировки более крупной модели” к отслеживанию количества эффективных Token на единицу энергии, стоимости отдельных задач и времени, затраченного агентом на выполнение сложной работы.

Nvidia объединяет Groq 3 LPX, Vera CPU и Rubin GPU в одну AI-фабрику, чтобы адаптировать инфраструктуру к этим изменениям.

В то же время SpaceXAI предлагает ещё более амбициозное направление: если эта система сможет выйти из стен дата-центров на орбиту, границы AI-вычислений перестанут ограничиваться традиционными ЦОДами.

0
0

Дисклеймер: содержание этой статьи отражает исключительно мнение автора и не представляет платформу в каком-либо качестве. Данная статья не должна являться ориентиром при принятии инвестиционных решений.

PoolX: вносите активы и получайте новые токены.
APR до 12%. Аирдропы новых токенов.
Внести!

Вам также может понравиться

Первая серия финансирования Xpeng Robotics составила 900 миллионов долларов, стоимость компании достигла рекордных 6,3 миллиарда долларов, однако чистый убыток во втором квартале увеличился почти в 1,8 раза по сравнению с прошлым годом.

Раунд финансирования возглавил IDG Capital, стратегическими инвесторами выступили Tencent и Alibaba. В то же время чистый убыток компании во втором квартале составил 1,34 млрд юаней, прогнозы на третий квартал также оказались ниже ожиданий рынка, из-за чего акции на американском рынке упали более чем на 8%. Руководство рассматривает роботов и Robotaxi как основные движущие силы трансформации компании в сферу физического ИИ и четко обозначило цель — достичь коммерческой эксплуатации беспилотных перевозок без водителя к 2027 году. В то же время, рынок капитала по-прежнему сохраняет осторожность в отношении перспектив этой трансформации.

华尔街见闻2026/08/24 21:31

Министерство финансов США собирается использовать почти триллион со счета Казначейства? Бессент подчеркнул повторный обратный выкуп облигаций 9 сентября

9 сентября вступает в силу усиленная программа обратного выкупа долгосрочных облигаций, объявленная на прошлой неделе Министерством финансов США. На прошлой неделе Бэсент заявил, что объем одного обратного выкупа может превысить 4 миллиарда долларов.

华尔街见闻2026/08/24 19:21

Телефонная конференция Pinduoduo: продолжаем укреплять цепочку поставок, продвижение собственных брендов идет медленнее, чем ожидалось, но цель «создать ещё одну Pinduoduo за три года» остаётся неизменной

Руководство на конференц-звонке чётко указало, что стратегический фокус смещается на глубокую трансформацию цепочки поставок, а специальная программа «Экотехнологическая стоимостная цепочка 100 млрд юаней» расширяется на аграрные регионы, промышленные кластеры и логистическую инфраструктуру. Хотя развитие собственных брендов идёт медленнее ожидаемого, это по-прежнему ключевая стратегия «трёхлетнего обновления PDD», при этом будет уделяться внимание долгосрочному совместному развитию приоритетных товарных категорий платформы и производителей. В ответ на новые таможенные тарифы Евросоюза в глобальном бизнесе компания переходит на сотрудничество с местными продавцами и послепродажное обслуживание на местах для повышения устойчивости. Компания подчёркивает приверженность долгосрочным целям и не стремится к быстрому увеличению масштабов.

华尔街见闻2026/08/24 16:21

Снижение доходности казначейских облигаций США может иметь обратный эффект? Citadel предупреждает Министерство финансов США, что "финансовые ограничения" могут ослабить доллар и способствовать инфляции

В последнее время Министерство финансов США расширяет масштабы обратного выкупа долгосрочных государственных облигаций, чтобы снизить стоимость долгосрочного финансирования. Однако эта мера вызывает предупреждения на Уолл-стрит о потенциальных побочных эффектах.

智通财经2026/08/24 16:16
Снижение доходности казначейских облигаций США может иметь обратный эффект? Citadel предупреждает Министерство финансов США, что "финансовые ограничения" могут ослабить доллар и способствовать инфляции