Bitget App
Trade smarter
Comprar criptomoedasMercadosTradingFuturosEarnAICentroMais
Desafio de velocidade do Token ultrapassa GPU em 30 vezes! BNP Paribas elogia o Cerebras (CBRS.US) CS-4 por inaugurar a era de "Wafer-Level + Inferência Desacoplada"

Desafio de velocidade do Token ultrapassa GPU em 30 vezes! BNP Paribas elogia o Cerebras (CBRS.US) CS-4 por inaugurar a era de "Wafer-Level + Inferência Desacoplada"

智通财经智通财经2026/08/20 06:46
Show original

Após o evento Supernova Day realizado pela Cerebras Systems, uma empresa de chips de inteligência artificial (AI), na terça-feira, o BNP Paribas afirmou que ficou profundamente impressionado com os parceiros apresentados e os anúncios relacionados feitos pela companhia.

O APP da Jinse Finance informou que, após o evento Supernova Day realizado pela empresa de chips de inteligência artificial (IA) Cerebras Systems (CBRS.US) nesta terça-feira, o BNP Paribas afirmou que ficou profundamente impressionado com os parceiros anunciados e as notícias apresentadas pela empresa.

Karl Ackerman, analista do BNP Paribas, escreveu em um relatório enviado aos clientes: “Assim como o LPU da NVIDIA (NVDA.US), as novas colaborações da Cerebras com OpenAI, Amazon (AMZN.US) AWS e AMD (AMZ.US) destacam a crescente demanda do mercado por melhorar a etapa de decodificação, altamente sensível à latência, durante o processo de inferência.”

O analista acrescentou que, para inferência rápida, o recém-anunciado Wafer-Scale Engine baseado em SRAM, CS-4, oferece uma “impressionante largura de banda de memória on-chip de 43,2 PB/s” e está equipado com uma nova interface I/O de wafer utilizando RDMA. A Cerebras orgulha-se de afirmar que o sistema CS-4 gera tokens 30 vezes mais rápido do que os sistemas GPU atualmente utilizados em ambientes de produção.

Além disso, o analista destacou que o roteiro de produtos da Cerebras, que duplica o desempenho anualmente e prevê aumentar a capacidade em 20 vezes até 2027, é admirável. Segundo o analista: “A Cerebras está focada em inferência desacoplada, posicionando o seu Wafer-Scale Engine como um motor de decodificação ultrarrápido para geração rápida de tokens, e colaborando com sistemas intensivos em computação como AWS Trainium ou AMD Helios. A Cerebras indica que o seu sistema de inferência desacoplada será até 10 vezes mais rápido que GPU, e com desempenho 5 vezes maior em comparação com configurações que utilizam apenas WSE.”

Por fim, o analista comentou que Arista Networks (ANET.US) já se tornou um parceiro de rede “crucial” para a Cerebras, e prevê que, ao longo do tempo, essa colaboração ajudará a Arista a expandir para novos cenários de aplicação junto aos clientes.

A Cerebras lançou oficialmente na terça-feira, durante o Supernova Day, o novo sistema de IA de rack Cerebras CS-4, reivindicando-o como o “acelerador de IA mais rápido do setor”. O sistema é voltado para grandes modelos de inferência e compete diretamente com produtos de servidores GPU da NVIDIA. Além disso, durante o evento, a Cerebras anunciou parcerias com empresas como OpenAI, AMD, Arista Networks, AWS, Figma, Cognition e CrowdStrike.

O CS-4 é o primeiro produto da nova arquitetura de plataforma de rack Nexus da Cerebras, impulsionado por três novos processadores Wafer Scale Engine 3 Turbo (WSE-3T). O WSE-3T é o maior processador de IA já desenvolvido, com cada chip integrando 4 trilhões de transístores e 900 mil núcleos otimizados para IA, cobrindo uma área de 46.225 mm² de silício, e contendo 44 GB de SRAM. O sistema CS-4 oferece 750 PFLOPs de potência computacional de IA, largura de banda de memória de 129,6 PB por segundo e uma taxa de transferência de I/O de 7,2 Tbps por segundo. O desempenho de IA de cada chip WSE-3T duplicou em relação à geração anterior, passando de 125 PFLOPS para 250 PFLOPS; e a largura de banda de memória dobrou, de 21,6 PB/s para 43,2 PB/s.

A Cerebras afirma que o CS-4 estabelece um novo padrão de velocidade de inferência na indústria. Em testes comparativos diretos com o modelo GPT-OSS-120B, o CS-4 pode gerar mais de 4.400 tokens por usuário por segundo, atingindo até 30 vezes a performance das soluções GPU. O sistema pode suportar modelos com mais de 50 trilhões de parâmetros. Em comparação com o CS-3 da geração anterior, o CS-4 é duas vezes mais rápido e possui uma taxa de transferência por watt 10 vezes maior, resultando em melhorias substanciais na eficiência econômica dos centros de dados.

0
0

Disclaimer: The content of this article solely reflects the author's opinion and does not represent the platform in any capacity. This article is not intended to serve as a reference for making investment decisions.

PoolX: Bloqueie e ganhe
Pelo menos 12% de APR. Quanto mais bloquear, mais pode ganhar.
Bloquear agora!

You may also like

A desenvolvedora de sistemas orbitais Gravitics (GVTX.US) define preço do IPO entre US$ 14 e US$ 17 por ação, com intenção de captar US$ 125 milhões

A Gravitics Holdings, que se dedica ao desenvolvimento de grandes estruturas espaciais e sistemas orbitais, planeja emitir 8,1 milhões de ações a um preço entre 14 e 17 dólares por ação, visando arrecadar 125 milhões de dólares.

智通财经2026/08/21 08:16
A desenvolvedora de sistemas orbitais Gravitics (GVTX.US) define preço do IPO entre US$ 14 e US$ 17 por ação, com intenção de captar US$ 125 milhões

A seguradora norte-americana Orion180 (OIG.US) solicita listagem nos Estados Unidos e pretende arrecadar 100 milhões de dólares.

A companhia de seguros norte-americana Orion180 Insurance Group planeja listar-se na Nasdaq sob o código de ações "OIG" e pretende arrecadar até 100 milhões de dólares por meio de uma oferta pública inicial (IPO).

智通财经2026/08/21 08:01
A seguradora norte-americana Orion180 (OIG.US) solicita listagem nos Estados Unidos e pretende arrecadar 100 milhões de dólares.