Fábrica de IA: O que os XPUs mudam.

A NVIDIA DESBLOQUEOU O FUTURO DA IA? Conheça o NVLink Fusion e Entenda Tudo!

Olá, pessoal! Aqui é o Lucas Tech e hoje a gente vai mergulhar em uma novidade da NVIDIA que pode simplesmente mudar o jogo para o futuro da Inteligência Artificial. O mundo da IA está correndo em uma velocidade incrível, né? E para a gente conseguir gerar inteligência em grande escala, com modelos gigantescos e aplicações cada vez mais complexas, não basta ter só um chip potente. A gente precisa de verdadeiras ‘fábricas de IA’ funcionando 24/7! Mas construir essas mega estruturas é um desafio gigante, cheio de complexidades e custos altíssimos. Por isso, a NVIDIA, que já é mestra no assunto, acaba de apresentar uma solução que promete virar o jogo: o NVLink Fusion. Vem comigo que vou te explicar tintim por tintim como essa tecnologia pode mudar o futuro da IA!

Fábricas de IA: A Revolução da Inteligência em Escala!

Imaginem só: para a IA ser realmente "inteligente" em grande escala, precisamos de ‘fábricas de IA’ rodando sem parar. O sucesso delas é medido por coisas como a quantidade de informações que processam por segundo (os famosos "tokens por segundo"), a energia que consomem (tokens por watt), o custo de cada processamento, a utilização e o tempo que ficam ativas. É tipo uma linha de produção super avançada, mas para inteligência!

E a grande sacada é que a infraestrutura para isso não pode ser só um monte de aceleradores (tipo as GPUs ou outros processadores especializados, os XPUs) jogados ali. Precisa ser pensada e construída como uma fábrica completa, do chão ao teto, com tudo conectado e otimizado.

O Desafio dos Gigantes

Grandes empresas de nuvem (os famosos hyperscalers) e companhias focadas em IA que querem criar seus próprios XPUs (aqueles processadores feitos sob medida, sabe?) não podem se preocupar só com o design do chip em si. Eles precisam planejar a plataforma de IA inteira! Isso inclui desde a rede que conecta tudo (tanto para escalar para cima, dentro de um mesmo nó, quanto para fora, entre vários racks), a arquitetura dos racks, o software de produção e até um ecossistema de fornecedores super robusto.

Acreditem, no nível de uma fábrica de IA, esse caminho é complexo, caro e acaba sendo um obstáculo enorme para levar esses XPUs customizados ao mercado rapidamente. É aí que a NVIDIA entra com uma ideia genial!

NVLink Fusion: A Chave para Desbloquear o Potencial da IA Customizada!

A solução para quebrar essa barreira? É simples (na teoria, claro!): combinar esses XPUs customizados, feitos sob medida, com uma infraestrutura de IA que já é super provada e madura. Isso permite que os desenvolvedores foquem no que realmente importa – a inovação no XPU – enquanto aproveitam uma tecnologia já estabelecida para o resto. É como construir uma casa: você foca no design único da sua sala, mas usa uma fundação e encanamento que já se sabe que funcionam!

E é exatamente isso que o NVLink Fusion entrega! Ele conecta os XPUs à infraestrutura de IA líder de mercado da NVIDIA, o NVLink. O resultado? Um aumento absurdo de performance, aceleração do tempo de lançamento no mercado e, o melhor de tudo, uma redução de riscos para essas "fábricas de IA" semi-customizadas. É o melhor dos dois mundos!

Turbinando o Desempenho com Conexões Ultra-Rápidas!

Para cargas de trabalho super modernas, tipo aquelas que rodam modelos de IA com trilhões de parâmetros, arquiteturas como ‘mixture-of-experts’ (que usam vários modelos menores para resolver uma tarefa) e a tal da IA agêntica, a rede que conecta tudo precisa ser VELOZ. Se a rede de ‘scale-up’ (que conecta os componentes dentro de um mesmo sistema, tipo GPUs no mesmo servidor) não consegue acompanhar, a utilização dos processadores cai e o custo por ‘token’ (a unidade de processamento da IA) sobe. Ninguém quer isso, né?

Uma solução de rede para ‘scale-up’ precisa ser fera em três coisas:

  • Performance Absoluta: Isso significa desempenho de ponta a ponta na rede, capacidade de processamento dentro da própria rede e uma integração de software super madura.
  • Resiliência da Fábrica: Garantir que tudo fique ligado, com monitoramento contínuo de saúde, telemetria (dados de desempenho) e a possibilidade de fazer manutenção em componentes enquanto a fábrica continua a todo vapor.
  • Maturidade da Plataforma: Reduzir riscos operacionais usando uma tecnologia que já tem um histórico comprovado de grandes implementações e que já deu retorno sobre o investimento.

Aqui, o NVLink Fusion brilha! Ele traz os XPUs para dentro do domínio de ‘scale-up’ do NVIDIA NVLink. A sexta geração do NVLink oferece uma rede de altíssima largura de banda e baixa latência que abrange até 72 XPUs. A latência de ponta a ponta para a comunicação entre XPUs é 3x menor que as alternativas baseadas em Ethernet padrão de mercado, e a taxa de pacotes é 10x maior! Isso é GIGANTESCO!

Para vocês terem uma ideia do impacto, os sistemas NVIDIA GB300 NVL72 entregam um desempenho (throughput) e interatividade MUITO maiores em comparação com configurações que não usam o NVL72. E as futuras versões do NVLink prometem domínios com até 1.152 aceleradores e ópticas co-empacotadas. É potência que não acaba mais!
(A própria NVIDIA mostrou que o GB300 NVL72 tem um desempenho de inferência em DeepSeek-V4-Pro mais de 10x superior ao B300 em várias interações, segundo os benchmarks de IA da empresa.)

O NVLink Fusion também inclui o NVIDIA NVLink-C2C, que conecta XPUs aos CPUs NVIDIA Vera ou a outros CPUs do ecossistema. Isso traz uma eficiência energética até 6 vezes maior do que a interface PCIe! É uma forma incrível de remover as barreiras entre o controle e o processamento em sistemas de IA agêntica.

Plataforma Robusta e Ecossistema: Menos Dor de Cabeça para os Construtores!

Muita gente que desenvolve XPUs customizados acaba subestimando o trampo e a complexidade de transformar a inovação do chip em algo que realmente funcione em um data center. Isso envolve um monte de etapas que vão muito além do silício:

  • Integrar CPUs de alta velocidade e interfaces de ‘scale-up’.
  • Encontrar e validar uma solução de rede para ‘scale-up’.
  • Projetar as bandejas dos computadores e dos switches.
  • Projetar e validar a arquitetura do rack inteiro, incluindo o sistema de refrigeração e energia.
  • Integrar segurança e armazenamento.
  • Gerenciar um ecossistema complexo de fornecedores.

A plataforma ideal cuida de tudo isso, permitindo que as equipes se concentrem na inovação que importa, usando soluções já consagradas para o resto. E adivinhem? O NVLink Fusion oferece exatamente isso! Ele é apoiado por um ecossistema feito para desenvolvimento, integração e implementação rápidos, envolvendo parceiros de design de ASIC, CPUs e de interconexões ópticas e de IP.

Como disse o Tim Wilson, vice-presidente e gerente geral de engenharia de silício para data centers da Intel: "O NVLink Fusion dá aos clientes a capacidade de escolher a arquitetura de CPU, o nível de desempenho, as capacidades de software que melhor atendem às suas necessidades para as cargas de trabalho que lhes interessam."

Quem adota o NVLink Fusion também pode usar a arquitetura de rack NVIDIA MGX e a mesma cadeia de suprimentos de sistemas baseados em MGX, como o NVIDIA Vera Rubin NVL72. Os parceiros de fabricação gerenciam o design e a integração, enquanto os fornecedores MGX entregam os blocos de construção para rack, refrigeração, energia e os novos designs de 800 VCC.

O Jack Luoh, chefe de produtos e soluções da QCT e Quanta Computer, ressaltou: "Com o Vera Rubin [NVL72], estamos buscando quase 100% de automação na construção de sistemas na linha de fabricação. A maioria desses investimentos pode ser aproveitada se o XPU utilizar o NVLink Fusion." Muita economia de tempo e recurso, hein?

Padronização: A Receita para Reduzir Riscos e Acelerar!

O planejamento de uma fábrica de IA não espera o chip ficar pronto. A compra de energia, o design das instalações, a refrigeração, o layout dos racks e a arquitetura de rede começam muito antes da lista final de aceleradores estar disponível. Ficar ‘preso’ a um único tipo de chip pode se tornar um baita risco para o cronograma.

Diferentes cargas de trabalho podem preferir aceleradores diferentes, incluindo XPUs, GPUs, CPUs e LPUs. Sistemas com GPUs podem trabalhar lado a lado com sistemas semi-customizados para treinamento, pós-treinamento, raciocínio, recuperação de informações e serviço. A flexibilidade é essencial!

O Vince Hu, vice-presidente sênior corporativo e gerente geral do grupo de negócios de data centers e computação da MediaTek, comentou: "O valor do programa NVLink Fusion é… [os clientes] podem implantar sua solução de nível de rack com a GPU NVIDIA, e então podem desacoplar o desenvolvimento de seu XPU e colocá-lo em um ritmo diferente."

O NVLink Fusion resolve esses desafios através de uma arquitetura unificada. Sistemas baseados em XPU e GPU, como o Vera Rubin NVL72, podem compartilhar o mesmo espaço no rack, rede, refrigeração, sistemas de energia e gerenciamento. Isso significa que as operadoras podem seguir em frente com a construção, deixando para depois a decisão exata sobre a ‘mistura’ de chips, e então reconfigurar a capacidade conforme a demanda da carga de trabalho, a oferta de chips e as prioridades do negócio mudam. Que jogada inteligente!

O Lie-Szu Juang, presidente e diretor de estratégia da GUC, adicionou: "O NVLink Fusion permite que os hyperscalers ou os designers de ASIC customizados integrem sua própria CPU ou XPU customizada e une a tecnologia NVIDIA com um processo de terceiros para criar uma arquitetura unificada em escala de rack." É uma verdadeira ponte para a inovação!

Projetado para Ser uma Fábrica, do Chão ao Software!

Construir uma fábrica é caro, e erros podem gerar um retrabalho custoso. Por isso, a infraestrutura precisa ser validada ANTES que a construção comece. O NVLink Fusion está alinhado com a arquitetura de referência NVIDIA DSX para fábricas de IA, que co-projeta edifícios, energia, refrigeração, computação e rede. O ‘NVIDIA Omniverse DSX AI Factory Blueprint’ oferece um gêmeo digital e um design de referência aberto para fábricas de IA em escala de gigawatts, permitindo que os parceiros modelem as instalações e a tecnologia juntas antes da implementação real. É uma garantia de que tudo vai funcionar perfeitamente!

No nível do rack, a facilidade de manutenção faz parte do desempenho. As bandejas de computação de referência têm 100% de refrigeração líquida, sem ventoinhas, cabos ou mangueiras, e permitem que as bandejas sejam removidas enquanto o resto do rack continua funcionando! As bandejas do NVLink Switch também são refrigeradas a líquido e suportam operação contínua durante a manutenção. Um espetáculo de engenharia!

O CC Lee, gerente sênior de desenvolvimento de hardware da Annapurna Labs (uma empresa da Amazon), disse: "Com o NVLink Fusion, podemos usar o design de rack NVL72 comprovado para ter um tempo de lançamento no mercado e podemos ter acesso a vários fornecedores para nos ajudar a entregar mais nas mãos de nossos clientes."

E para completar a fábrica, o software é essencial! O NVIDIA NCCL para cargas de trabalho distribuídas, o NVIDIA Dynamo e NIXL para desagregação, e o NVIDIA Mission Control para gerenciamento de cluster, telemetria e depuração ajudam os operadores a rodar uma infraestrutura de IA mista como um sistema coordenado.

Com o NVLink Fusion, os XPUs agora podem se encontrar com uma plataforma de IA de nível mundial. Isso permite que os hyperscalers e as empresas nativas de IA construam fábricas de IA unificadas e semi-customizadas, combinando as forças de muitos construtores em uma infraestrutura que nenhuma empresa conseguiria construir sozinha. É o poder da colaboração levado ao extremo!

Saiba mais sobre o NVLink Fusion.


Minha Visão

Minha visão sobre o NVLink Fusion? Galera, isso não é só mais uma tecnologia nova, é uma mudança de paradigma! A NVIDIA, com essa jogada, não está apenas vendendo um produto; está resolvendo um dos maiores gargalos para o avanço da IA em grande escala. Pensem bem: antes, se você quisesse inovar com seu próprio chip (XPU), teria que construir um ‘planeta’ inteiro de infraestrutura do zero, com todos os custos e riscos que isso acarreta. Agora, com o NVLink Fusion, você pluga sua inovação em uma fundação sólida e comprovada.

Isso significa que empresas menores, startups ou até grandes companhias com ideias muito específicas para processadores de IA podem acelerar brutalmente seu tempo de lançamento, focar no que realmente faz a diferença e democratizar o acesso a essa infraestrutura de ponta. É como ter um atalho para o futuro da IA, onde a colaboração e a padronização impulsionam a criatividade. Estou super empolgado para ver as inovações que virão dessa sinergia!

E aí, o que vocês acham dessa novidade incrível da NVIDIA? Será que o NVLink Fusion vai ser o motor que faltava para a próxima revolução da IA, permitindo que mais e mais empresas criem suas próprias ‘fábricas de inteligência’? Deixem suas opiniões nos comentários!

Referência: Matéria Original

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *

Rolar para cima
Tutorial Elevenlabs