Bitget App
Cмартторгівля для кожного
Купити криптуРинкиТоргуватиФ'ючерсиEarnAIЦентрБільше
Nvidia оголосила про повний запуск у виробництво Groq 3 LPX, ефективність міркувань Vera Rubin зросла у кілька разів, SpaceXAI посилює інвестиції в агентів та космічний AI

Nvidia оголосила про повний запуск у виробництво Groq 3 LPX, ефективність міркувань Vera Rubin зросла у кілька разів, SpaceXAI посилює інвестиції в агентів та космічний AI

华尔街见闻华尔街见闻2026/08/24 17:01
Переглянути оригінал
-:华尔街见闻

Nvidia заявила, що на основі робочого навантаження AgentX від SemiAnalysis та моделі DeepSeek V4 Pro продуктивність Vera Rubin на мегават у 30 разів вища за попереднє покоління GB300 NVL72, а вартість на один токен знижена у 35 разів. SpaceXAI використає Vera CPU для прискорення наступного покоління додатків штучного інтелекту-агентів, а також розширить платформу на основі Vera Rubin. SpaceXAI планує розмістити оптимізовану версію Vera Rubin NVL72 у космосі для першого покоління супутників Starmind AI.

Nvidia пришвидшує конкуренцію у сфері інфраструктури AI, переводячи її від традиційної продуктивності тренування та виведення моделей до нового етапу, зосередженого на швидкості генерації Token, енергоспоживанні та собівартості в Agentic AI.

24-го числа за східноамериканським часом, у понеділок, Nvidia оголосила про повномасштабне виробництво Groq 3 LPX для інтерактивного AI виведення. Як важлива складова Vera Rubin платформи, Groq 3 LPX орієнтований на наднизьку затримку генерації Token; за даними Artificial Analysis, на моделі Gemma 4 31B при контексті 100,000 Token Groq 3 LPX досяг 3400 Token/сек — це рекорд для даної моделі; для навантажень типу агентного програмування відповідь була максимально у 4 рази швидшою від найближчої конкурентної платформи.

Одночасно Nvidia оприлюднила нові результати тестування Vera Rubin NVL72 з реальними агентними навантаженнями: на робочому навантаженні SemiAnalysis AgentX, з використанням моделі DeepSeek V4 Pro, Vera Rubin досягла максимальної пропускної здатності на мегават (MW) у 30 разів більшої за попереднє покоління GB300 NVL72, а собівартість Token знизилася максимально у 35 разів. Nvidia підкреслює, що завдання агентів відрізняються від традиційних чатів та резюме: контекст завдання накопичується протягом сотень кроків, навіть досягаючи сотень тисяч Token.

Nvidia оголосила про повний запуск у виробництво Groq 3 LPX, ефективність міркувань Vera Rubin зросла у кілька разів, SpaceXAI посилює інвестиції в агентів та космічний AI image 0

Того ж дня Nvidia також повідомила, що SpaceXAI використовуватиме Vera CPU для прискорення застосування AI-агентів нового покоління та розширить побудову платформ на основі Vera Rubin у міру зростання обчислювальної потужності до кількох GW; крім того, SpaceXAI планує впровадити оптимізовану версію Vera Rubin NVL72 на орбіті для першої серії AI-супутників Starmind.

Groq 3 LPX повномасштабно виробляється: Nvidia завершує “останню милю” для агентів

Nvidia тепер офіційно випускає Groq 3 LPX у виробництво, не для заміни GPU як окремого чипа для виведення, а для доповнення Vera Rubin можливостями традиційної GPU-архітектури спеціально в генерації Token з низькою затримкою.

Для агентів виконання задачі часто не обмежується одним питанням-відповіддю: агент має читати файли, викликати інструменти, виконувати код, перевіряти результати, продовжуючи міркування згідно результатів, що може повторюватись сотні або тисячі разів. У цьому процесі швидкість генерації Token на кожному кроці впливає на час виконання всієї задачі.

Nvidia зазначає: AI-агенти створюють дві різних обчислювальних проблеми — треба ефективно працювати з великим і зростаючим контекстом і одночасно безперервно генерувати Token з наднизькою затримкою. Vera Rubin NVL72 забезпечує широке тренування, виведення та обробку контексту, а Groq 3 LPX оптимізований для швидкості інтерактивного користувача, підвищуючи пропускну здатність генерації Token.

Останнє тестування Nvidia показує, що Groq 3 LPX на Gemma 4 31B з контекстом 100K досягає 3400 Token/сек; для агентних і інших затримково-чутливих навантажень швидкість відповіді сягає 4 разів перевищення конкурентних платформ. За словами Nvidia, така швидкість дозволяє агентам швидше завершувати такі послідовні завдання як написання коду, тестування, виклик інструментів і верифікація результатів.

У бізнесі AI-хмарний сервіс Nebius стане першим використовуючим Groq 3 LPX у хмарних платформах, з планами впровадження в Nebius Token Factory. Groq також планує бути серед перших користувачів цієї платформи.

Це означає, що з масовим запуском Groq 3 LPX — можливості, отримані Nvidia через купівлю Groq, справді інтегруються в продуктові системи дата-центрів Vera Rubin.

30 разів — це не “швидкість” у 30 разів, а кількість агентних задач на мегават

Навіть важливішим, ніж показник 3400 Token/сек, є акцент Nvidia на пропускній здатності та собівартості Token на мегават.

Результати тестування показують: під навантаженням SemiAnalysis AgentX Vera Rubin NVL72 на мегават досягає у 30 разів більшої пропускної здатності, ніж GB300 NVL72, а собівартість Token найменша у 35 разів. Тестування проводиться на реальних агентних програмних сценаріях, враховуючи приріст контексту, виклики інструментів та генерацію субагентів.

Nvidia оголосила про повний запуск у виробництво Groq 3 LPX, ефективність міркувань Vera Rubin зросла у кілька разів, SpaceXAI посилює інвестиції в агентів та космічний AI image 1

Тому збільшення пропускної здатності на мегават у 30 разів — це прояв різкого покращення ефективності AI-виведення, але не означає просто підвищення швидкості виведення чипа у 30 разів.

Цей показник має особливу значимість для AI-дата-центрів.

Традиційні сервіси великих моделей більше зосереджувалися на затримці одного запиту та пропускній здатності; агентні навантаження постійно витрачають Token. Nvidia, посилаючись на дані OpenRouter, каже: споживання Token у навантаженнях агентного AI може бути у 15 разів більшим, ніж у простих чатах. Причина — агент може спочатку звертатися до бази даних, шукати новини і файли, викликати субагентів для аналізу, запускати код і проводити повторну верифікацію — за цей час контекст суттєво збільшується.

Це призводить до появи нового підходу до оцінки економічної ефективності AI-інфраструктури: скільки корисних агентних задач можна виконати на одному мегаваті електроенергії?

В умовах, коли електроенергія та дата-центр-ресурси стають вузьким місцем розширення AI, збільшення числа Token на одиницю електроенергії може бути важливішим за просто підвищення пікової обчислювальної потужності.

Vera Rubin: від “GPU-платформи” до цілісної AI-фабрики

З погляду архітектури, Groq 3 LPX не є самостійним продуктом, а частиною стратегії “максимальної координації” Nvidia в межах Vera Rubin.

Nvidia оголосила про повний запуск у виробництво Groq 3 LPX, ефективність міркувань Vera Rubin зросла у кілька разів, SpaceXAI посилює інвестиції в агентів та космічний AI image 2

Nvidia раніше визначила Vera Rubin як AI-фабрику для епохи Agentic AI. Система складається не лише із GPU, а побудована навколо обчислень, мереж, зберігання та програмних рішень з координацією різних компонентів: Rubin GPU, Vera CPU, Groq 3 LPX, BlueField-4 DPU, Spectrum-6 SPX тощо.

Rubin GPU відповідає за масове тренування, виведення і обробку контексту; Groq 3 LPX забезпечує швидку генерацію Token; Vera CPU обробляє великі CPU-інтенсивні завдання між запуском моделей агентів, зокрема оркестрацію інструментів, виконання коду, обробку даних та моделювання.

За попередніми архітектурними даними Nvidia, платформа Vera Rubin використовуючи сім чипів і п’ять типів спеціалізованих стійок для максимальної координації, дозволяє кожному апаратному компоненту виконувати найбільш оптимальні завдання, а не покладати всі AI-навантаження на один вид процесора.

Це означає, що Nvidia піднімає AI-інфраструктуру з “GPU-кластеру” до гетерогенної обчислювальної системи.

Для AI-хмарних провайдерів така архітектура дозволяє оптимально налаштовувати ресурси під різні етапи — тренування, довгий контекст, генерацію Token, виклики інструментів — підвищуючи ефективність і економічну дохідність дата-центру в цілому.

SpaceXAI інвестує у Vera: агентний AI з датацентру виходить у космос

Під час повномасштабного запуску Groq 3 LPX компанія SpaceXAI також оголосила про подальше впровадження системи Vera Rubin Nvidia.

24 серпня Nvidia оголосила: SpaceXAI розгорне Vera CPU для застосування AI-агентів нового покоління. Vera спроектована для навантажень на CPU поза межами виведення моделей — таких як оркестрація інструментів, виконання коду, обробка даних, управління завданнями та моделювання.

Vera використовує 88 власних ядер Olympus від Nvidia та високошвидкісну пам’ять LPDDR5X з максимальною пропускною здатністю 1.2 TB/s. Nvidia повідомляє, що для AI-агентів, навчання із підкріпленням та обробки даних швидкість виконання Vera максимально у 1.8 рази більша за x86 CPU.

Для SpaceXAI цінність Vera полягає не тільки у підвищенні продуктивності CPU.

У процесі роботи агентів багато завдань виконуються між виведенням GPU — наприклад, запуск коду, обробка даних, виклики інструментів та координація агентів. Якщо CPU справляється повільно, GPU змушена чекати, знижуючи ефективність AI-фабрики.

SpaceXAI прагне використовувати Vera для обробки таких “дозапускових” завдань, щоб GPU могла більше фокусуватися на тренуванні і виведенні моделей, підвищуючи ефективність системи.

SpaceXAI також планує розширити Grok AI-інфраструктуру на основі Vera Rubin, нарощуючи потужності до кількох GW; і також використовувати оптимізовану Vera Rubin NVL72 для першої серії супутників Starmind AI.

Це означає, що прискорена обчислювальна система Nvidia розширюється від наземних дата-центрів до орбітальних обчислень.

Від “чат-бота” до “автоматичного виконання” — змінюється попит на AI-потужності

Groq 3 LPX повномасштабне виробництво, Vera Rubin із 30-кратною пропускною здатністю на мегават, SpaceXAI розширює Vera Rubin до Starmind-супутників — усі ці новини Nvidia відображають одну тенденцію: AI-застосування переходить від генерації контенту до автономного виконання завдань.

У чатах та резюме користувачі зазвичай чекають швидкої текстової відповіді від моделі; у агентних сценаріях модель має прогнозувати, викликати інструменти, виконувати код, доступитися до зовнішніх даних і знову перевіряти результати.

Це означає, що основні показники для інфраструктури AI у майбутньому можуть змінитися — замість “навчити більшу модель” акцент перейде на кількість ефективних Token на одиницю електроенергії, численні виконані задачі на одиницю вартості та час на виконання складних завдань агентами.

Nvidia об’єднує Groq 3 LPX, Vera CPU і Rubin GPU в єдину AI-фабрику, щоб врахувати ці зміни у дизайні інфраструктури.

А SpaceXAI пропонує ще більш креативний напрям застосування: якщо система справді розшириться із наземних дата-центрів до орбіти, межі AI-обчислень більше не обмежуватимуться традиційними серверними приміщеннями.

0
0

Відмова від відповідальності: зміст цієї статті відображає виключно думку автора і не представляє платформу в будь-якій якості. Ця стаття не повинна бути орієнтиром під час прийняття інвестиційних рішень.

PoolX: Заробляйте за стейкінг
До понад 10% APR. Що більше монет у стейкінгу, то більший ваш заробіток.
Надіслати токени у стейкінг!

Вас також може зацікавити

Xpeng Robotics залучила $900 мільйонів в першому раунді фінансування, оцінка компанії сягнула $6,3 мільярда, встановивши новий рекорд, однак чистий збиток у другому кварталі збільшився майже в 1,8 раза в річному вимірі

Раунд фінансування очолювала компанія IDG Capital, а стратегічними інвесторами виступили Tencent та Alibaba. Тим часом, чистий збиток компанії за другий квартал склав 1,34 млрд юанів, а прогноз на третій квартал також виявився нижчим за очікування ринку, що спричинило падіння акцій на біржі США більш ніж на 8%. Керівництво визначає роботи та Robotaxi як основні рушії трансформації компанії у фізичну AI-технологічну компанію та чітко позначило ціль — здійснювати перевезення пасажирів без операторів безпеки до 2027 року. Однак ринок капіталу залишається обережним щодо перспектив трансформації.

华尔街见闻2026/08/24 21:31

Міністерство фінансів США збирається використати майже трильйон доларів з казначейського рахунку? Бессент наголошує на повторному викупі облігацій 9 вересня

9 вересня є датою набуття чинності плану розширення зворотного викупу довгострокових облігацій, оголошеного Міністерством фінансів США минулого тижня. Минулого тижня Бесент повідомив, що обсяг одного зворотного викупу може перевищити 4 мільярди доларів.

华尔街见闻2026/08/24 19:21

Телефонна конференція Pinduoduo: Подальше посилення ланцюга постачання, розвиток власного бренду просувається повільніше, ніж очікувалося, але мета "створити ще один Pinduoduo за три роки" залишається незмінною

Керівництво на телефонній конференції чітко зазначило, що стратегічний акцент зміщується на глибоку трансформацію ланцюга постачання, а спеціальна ініціатива "Екосистема на сто мільярдів" розширюється до сільськогосподарських регіонів, промислових кластерів і логістичної інфраструктури. Хоча розвиток власного бренду просувається повільніше, ніж очікувалося, він все ще є ключовою стратегією "три роки на перебудову PDD", зосереджуючись на спільних довгострокових дослідженнях з виробниками у категоріях, де платформа має перевагу. Глобальний бізнес, зіштовхнувшись з новою тарифною політикою ЄС, перемикається на місцевих продавців та виконання замовлень зі складів задля підвищення стійкості. Компанія наголошує на прихильності до довгострокової стратегії та не женеться за короткостроковим зростанням.

华尔街见闻2026/08/24 16:21

Зниження дохідності держоблігацій США може мати зворотний ефект? Citadel попереджає Міністерство фінансів США, що "фінансові обмеження" можуть послабити долар і підштовхнути інфляцію

Міністерство фінансів США нещодавно знизило довгострокові витрати на фінансування за рахунок розширення масштабів зворотного викупу довгострокових державних облігацій, але цей крок викликає попередження з боку Уолл-стріт щодо потенційних побічних ефектів.

智通财经2026/08/24 16:16
Зниження дохідності держоблігацій США може мати зворотний ефект? Citadel попереджає Міністерство фінансів США, що "фінансові обмеження" можуть послабити долар і підштовхнути інфляцію