O que é Blackwell: a arquitetura de GPUs de IA da geração atual da Nvidia

Blackwell é a arquitetura de GPU por trás dos chips B200, GB200 e Blackwell 300 da Nvidia, que hoje respondem pela maior parte de sua receita de data center. Veja o que há nela e por que isso importa.

O que é Blackwell: a arquitetura de GPUs de IA da geração atual da Nvidia

O que é. Blackwell é o nome da arquitetura de GPU da geração atual da Nvidia, anunciada em março de 2024 e hoje entregue em volume. Ela sucede a arquitetura Hopper (as H100 e H200), que definiu a primeira onda de treinamento de IA generativa. Os produtos da classe Blackwell incluem as GPUs B100 e B200, o superchip GB200 Grace-Blackwell (uma CPU Grace mais duas B200 em uma placa) e o rack GB200 NVL72, que interliga 72 GPUs B200 em um único domínio de computação coeso por meio da malha NVLink da Nvidia. A atualização de meio de ciclo, chamada Blackwell Ultra ou Blackwell 300, leva ainda mais longe a largura de banda de memória e a capacidade de HBM.

Por que importa. Dois motivos. Primeiro, o salto por GPU na vazão de treinamento em relação à Hopper é de cerca de 2,5x para cargas de trabalho em FP8 e significativamente maior no novo caminho FP4 que a Blackwell introduz. Isso muda a economia unitária do treinamento de modelos de fronteira. Segundo, o projeto em escala de rack do NVL72 permite que um único domínio abrigue pesos de modelo que antes exigiam uma rede lenta entre racks, e é isso que torna viável treinar, em tempo razoável, modelos com mais de um trilhão de parâmetros.

Quem compra. Quase tudo vai para um punhado de compradores: Microsoft, Meta, Google, Amazon, Oracle, CoreWeave e os projetos de IA soberana nos Emirados Árabes Unidos e na Arábia Saudita. Juntos, eles respondem pela esmagadora maioria da receita de data center da Nvidia, que por sua vez é a esmagadora maioria da receita total. Os sistemas da classe Blackwell eram mais de 70% do negócio de data center da Nvidia no balanço do 1º trimestre tratado na nossa cobertura de resultados.

O que vem a seguir. O roadmap declarado da Nvidia tem cadência de um ano: Rubin em 2026, Feynman depois. Espera-se que cada geração mantenha o mesmo padrão de rack NVL, mas aumente a computação e a memória por rack. A implicação de capex para os hyperscalers é que o ciclo de renovação de GPUs acaba de ficar mais curto, o que é parte do que impulsiona a cobertura de capex elevado neste site.

Blackwell é o chip que o seu capex de IA está comprando neste momento. Quando você ler "receita de data center da Nvidia", "backlog de GB200" ou "cluster de treinamento de IA", imagine um rack desses.