
A AMD e a Oracle anunciaram nesta terça-feira (14/10) uma grande expansão de sua colaboração de longa data e de várias gerações para ajudar os clientes a dimensionar significativamente seus recursos e iniciativas de IA. Com base em anos de coinovação, a Oracle Cloud Infrastructure (OCI) será uma parceira de lançamento para o primeiro supercluster de IA disponível publicamente com GPUs AMD Instinct MI450 Series – com uma implementação inicial de 50 mil GPUs começando no terceiro trimestre de 2026 e expandindo em 2027 e além.
Este anúncio se baseia no trabalho conjunto da Oracle e da AMD para fornecer plataformas de GPU AMD Instinct na OCI para clientes finais, começando com o lançamento das formas com tecnologia AMD Instinct MI300X em 2024 e estendendo-se à disponibilidade geral do OCI Compute com GPUs AMD Instinct MI355X. Eles estarão disponíveis no zettascale OCI Supercluster.
A demanda por capacidade de IA em larga escala está acelerando à medida que os modelos de IA de próxima geração superam os limites dos clusters de IA atuais. Para treinar e executar essas cargas de trabalho, os clientes precisam de soluções de computação flexíveis e abertas, projetadas para escala e eficiência extremas. Os novos superclusters de IA planejados pela OCI serão alimentados pelo design de rack AMD “Helios”, que inclui GPUs AMD Instinct MI450 Series, CPUs AMD Epyc de próxima geração com o codinome “Venice” e rede avançada AMD Pensando de próxima geração com o codinome “Vulcano”. Essa arquitetura em escala de rack otimizada verticalmente foi projetada para oferecer desempenho, escalabilidade e eficiência energética máximos para treinamento e inferência de IA em larga escala.
GPUs AMD Instinct MI450 Series chegando à OCI
Os formatos baseados em GPU AMD Instinct MI450 Series são projetados para oferecer opções flexíveis de implementação em Nuvem de alto desempenho e fornecer amplo suporte de código aberto. Isso fornece a base ideal para clientes que executam os modelos de linguagem mais avançados da atualidade, IA generativa e cargas de trabalho de computação de alto desempenho. Com as GPUs AMD Instinct MI450 Series na OCI, os clientes poderão se beneficiar de:
Computação e memória inovadoras: ajuda os clientes a obter resultados mais rápidos, lidar com cargas de trabalho mais complexas e reduzir a necessidade de particionamento de modelos, aumentando a largura de banda da memória para modelos de treinamento de IA. Cada GPU AMD Instinct MI450 Series fornecerá até 432 GB de HBM4 e 20 TB/s de largura de banda de memória, permitindo que os clientes treinem e inferam modelos 50% maiores do que as gerações anteriores inteiramente na memória.
Design de rack “Helios” otimizado pela AMD: permite que os clientes operem em escala enquanto otimizam a densidade de desempenho, o custo e a eficiência energética por meio de racks densos e refrigerados a líquido de 72 GPUs. O design do rack AMD “Helios” integra a conectividade escalável UALoE e a rede escalável alinhada ao Ultra Ethernet Consortium (UEC) baseada em Ethernet para minimizar a latência e maximizar a taxa de transferência entre pods e racks.
CPUs AMD Venice: ajuda os clientes a maximizar a utilização do cluster e simplificar fluxos de trabalho em grande escala, acelerando a orquestração de tarefas e o processamento de dados em uma arquitetura que consiste em CPUs AMD Epyc de última geração, codinome “Venice”. Além disso, essas CPUs Epyc oferecerão recursos de computação confidenciais e recursos de segurança integrados para ajudar a proteger cargas de trabalho confidenciais de IA de ponta a ponta.
Rede convergente acelerada por DPU: potencializa a ingestão de dados de taxa de linha para melhorar o desempenho e aprimorar a postura de segurança para IA em larga escala e infraestrutura de nuvem. Construída com base na tecnologia AMD Pensando DPU totalmente programável, a rede convergente acelerada por DPU oferece a segurança e o desempenho necessários para que os Data Centers executem a próxima era de treinamento de IA, inferência e cargas de trabalho em Nuvem.
Rede escalável para IA: permite que os clientes aproveitem o treinamento distribuído ultrarrápido e a comunicação coletiva otimizada com uma malha de rede aberta pronta para o futuro. Cada GPU pode ser equipada com até três AI-NICs AMD Pensando “Vulcano” de 800 Gbps, fornecendo aos clientes conectividade sem perdas, de alta velocidade e programável que suporta padrões avançados RoCE e UEC.
UALink and UALoE fabric: ajuda os clientes a expandir cargas de trabalho com eficiência, reduzir gargalos de memória e orquestrar grandes modelos de vários trilhões de parâmetros. A arquitetura escalável minimiza saltos e latência sem roteamento por CPUs e permite rede direta e coerente com hardware e compartilhamento de memória entre GPUs dentro de um rack via protocolo UALink transportado por uma malha UALoE. O UALink é um padrão de interconexão aberto e de alta velocidade criado especificamente para aceleradores de IA e suportado por um amplo ecossistema do setor. Como resultado, os clientes obtêm a flexibilidade, a escalabilidade e a confiabilidade necessárias para executar suas cargas de trabalho de IA mais exigentes em infraestrutura baseada em padrões abertos.
Pilha de software AMD ROCm de código aberto: permite inovação rápida, oferece liberdade de escolha de fornecedor e simplifica a migração de cargas de trabalho de IA e HPC existentes, fornecendo aos clientes um ambiente de programação aberto e flexível, incluindo estruturas, bibliotecas, compiladores e tempos de execução populares.
Particionamento e virtualização avançados: permite que os clientes compartilhem clusters com segurança e aloquem GPUs com base nas necessidades de carga de trabalho, facilitando o uso seguro e eficiente de recursos por meio de particionamento refinado de GPU e pod, virtualização SR-IOV e multilocação robusta.
Para oferecer aos clientes que criam, treinam e inferem IA em escala mais opções, a OCI também anunciou a disponibilidade geral do OCI Compute com GPUs AMD Instinct MI355X. Eles estarão disponíveis no zettascale OCI Supercluster, que pode ser dimensionado para 131.072 GPUs. As formas com tecnologia AMD Instinct MI355X são projetadas com valor superior, flexibilidade de Nuvem e compatibilidade de código aberto.



















