book_icon

Broadcom lança switch Ethernet Tomahawk Ultra para aplicações HPC e IA

Com comutação de latência ultrabaixa e cabeçalhos Ethernet otimizados adaptáveis, o novo switch fornece desempenho previsível e de alta eficiência para simulações em larga escala

Broadcom lança switch Ethernet Tomahawk Ultra para aplicações HPC e IA

A Broadcom, empresa global de soluções de software de infraestrutura, apresentou o seu switch Ethernet Tomahawk Ultra, projetado para transformar o switch Ethernet para computação de alto desempenho (HPC) e cargas de trabalho de IA, com latência ultrabaixa, taxa de transferência massiva e rede sem perdas. “O Tomahawk Ultra é uma prova de inovação, envolvendo um esforço de vários anos de centenas de engenheiros que reimaginaram todos os aspectos do switch Ethernet”, disse Ram Velaga, vice-presidente sênior e gerente-geral do Core Switching Group da Broadcom. “Isso destaca o compromisso da Broadcom em investir no avanço da Ethernet para redes de alto desempenho e expansão de IA”, completou.

Construído desde o início para atender às demandas extremas de ambientes HPC e clusters de IA fortemente acoplados, o Tomahawk Ultra redefine o que um switch Ethernet pode oferecer. Há muito percebida como de maior latência e perdas, a Ethernet assume um novo papel:

Projetado com inovações em roteamento com reconhecimento de topologia para oferecer suporte a topologias HPC avançadas, incluindo Dragonfly, Mesh e Torus, o Tomahawk Ultra também é compatível com o padrão UEC e abraça a abertura e o rico ecossistema da rede Ethernet

Latência ultrabaixa: atinge latência de switch de 250ns com taxa de transferência total de 51,2 Tbps.

Alto desempenho: oferece desempenho de comutação de taxa de linha mesmo em tamanhos mínimos de pacotes de 64 bytes, suportando até 77 bilhões de pacotes por segundo.

Cabeçalhos Ethernet adaptáveis e otimizados: reduz a sobrecarga do cabeçalho de 46 bytes para até 10 bytes, mantendo a conformidade total com Ethernet, aumentando a eficiência da rede e permitindo otimizações flexíveis e específicas do aplicativo.

Malha sem perdas: implementa a repetição da camada de enlace (LLR) e o controle de fluxo baseado em crédito (CBFC) para eliminar a perda de pacotes e garantir a confiabilidade.

Criado para HPC e IA Scale-Up

O Tomahawk Ultra é otimizado para os padrões de comunicação de baixa latência e fortemente acoplados encontrados em sistemas de computação de alto desempenho e clusters de IA. Com comutação de latência ultrabaixa e cabeçalhos Ethernet otimizados adaptáveis, ele fornece desempenho previsível e de alta eficiência para simulações em larga escala, computação científica e treinamento e inferência de modelos de IA sincronizados.

Quando implementado com Scale-Up Ethernet (especificação SUE disponível ao público aqui), o Tomahawk Ultra permite latência de comunicação XPU para XPU abaixo de 400ns, incluindo o tempo de trânsito do switch – estabelecendo uma nova referência para computação de IA totalmente sincronizada em escala.

Ao reduzir a sobrecarga do cabeçalho Ethernet de 46 bytes para apenas 10 bytes, mantendo a conformidade total com Ethernet, o Tomahawk Ultra melhora drasticamente a eficiência da rede. Esse cabeçalho otimizado é adaptável por aplicativo, oferecendo flexibilidade e ganhos de desempenho em diversas cargas de trabalho de HPC e IA.

O Tomahawk Ultra incorpora tecnologia de malha sem perdas que elimina quedas de pacotes durante a transferência de dados de alto volume. Incorporando LLR, o switch detecta erros de link usando a correção de erros de encaminhamento e retransmite automaticamente os pacotes, evitando quedas no nível do fio. Simultaneamente, o CBFC evita estouros de buffer que tradicionalmente causavam perda de pacotes. Juntos, esses mecanismos criam uma malha Ethernet verdadeiramente sem perdas, oferecendo o nível de confiabilidade exigido pelas cargas de trabalho com uso intensivo de dados de hoje.

O Tomahawk Ultra também acelera o desempenho por meio de coletivos na rede, resolvendo um dos gargalos mais persistentes nas cargas de trabalho de IA e aprendizado de máquina. Em vez de sobrecarregar as XPUs com operações coletivas como AllReduce, Broadcast ou AllGather, o Tomahawk Ultra as executa diretamente no chip do switch. Isso pode reduzir o tempo de conclusão do trabalho e melhorar a utilização de recursos de computação caros. É importante ressaltar que esse recurso é independente de endpoint, permitindo a adoção imediata em uma ampla variedade de arquiteturas de sistema e ecossistemas de fornecedores.

Projetado com inovações em roteamento com reconhecimento de topologia para oferecer suporte a topologias HPC avançadas, incluindo Dragonfly, Mesh e Torus, o Tomahawk Ultra também é compatível com o padrão UEC e abraça a abertura e o rico ecossistema da rede Ethernet.

Apresentando o SUE-Lite

Como parte da estratégia de avanço de Ethernet da Broadcom para expansão de IA, a empresa introduziu o SUE-Lite – uma versão otimizada da especificação SUE adaptada para aplicações de aceleradores sensíveis à energia e à área. O SUE-Lite mantém as principais características de baixa latência e sem perdas do SUE completo, reduzindo ainda mais o consumo de silício e o consumo de energia das interfaces Ethernet em XPUs e CPUs de IA.

Essa variante leve permite uma integração mais fácil de malhas Ethernet compatíveis com padrões em plataformas de IA, promovendo uma adoção mais ampla da Ethernet como a interconexão preferida em arquiteturas de expansão.

 

As opiniões dos artigos/colunistas aqui publicados refletem exclusivamente a posição de seu autor, não caracterizando endosso, recomendação ou favorecimento por parte da Infor Channel ou qualquer outros envolvidos na publicação. Todos os direitos reservados. É proibida qualquer forma de reutilização, distribuição, reprodução ou publicação parcial ou total deste conteúdo sem prévia autorização da Infor Channel.
Revista Digital