A corrida pela infraestrutura de inteligência artificial em escala industrial ganhou um novo capítulo estratégico. A AMD e a Celestica anunciaram uma colaboração para desenvolver e levar ao mercado a plataforma “Helios”, uma solução de rack-scale projetada especificamente para clusters de IA de grande porte. O movimento coloca as duas empresas em competição direta com os principais fornecedores de infraestrutura de data center, como Nvidia e Broadcom, no crescente mercado de hardware especializado para treinamento e inferência de modelos de linguagem e visão computacional.
Arquitetura Aberta e Padrões da Indústria Como Diferencial
Um dos pilares centrais da plataforma Helios é sua adesão a padrões abertos da indústria. A arquitetura é baseada no Open Compute Project (OCP) e no formato Open-Rack-Wide (ORW), decisões estratégicas que visam oferecer maior flexibilidade e interoperabilidade para os clientes. Em um mercado onde soluções proprietárias e ecossistemas fechados têm dominado, a aposta da AMD e da Celestica em uma abordagem mais aberta representa uma tentativa clara de capturar uma fatia de empresas e provedores de nuvem que buscam evitar o vendor lock-in e manter custos sob controle através da padronização.
Escalabilidade Horizontal e Conectividade de Alta Velocidade
A plataforma é projetada para conectar milhares de GPUs da próxima geração AMD Instinct MI450 Series em um único cluster coeso. O segredo para essa escalabilidade massiva está nos switches de rede “scale-up” que serão projetados e fabricados pela Celestica. Esses switches não são componentes de rede comuns; eles são otimizados para o tráfego específico de workloads de IA, onde a latência e a largura de banda entre GPUs são fatores críticos que determinam diretamente o tempo de treinamento de modelos e o custo operacional.
UALoE: O Protocolo que Conecta as GPUs da Próxima Geração
Para a conectividade scale-up entre as GPUs MI450, a plataforma Helios adotará a arquitetura Ultra Accelerator Link over Ethernet (UALoE). Este protocolo é uma evolução dos interconectores proprietários, projetado para oferecer a eficiência de uma solução dedicada com a ubiquidade e a economia de escala do Ethernet. A UALoE promete reduzir significativamente os gargalos de comunicação em clusters de IA, permitindo que as GPUs compartilhem dados e coordenem tarefas com uma eficiência próxima à de um sistema integrado em um único chip, mas em uma escala de dezenas de racks.
Divisão Estratégica de Competências Entre as Empresas
A colaboração estabelece uma divisão clara de responsabilidades que aproveita os pontos fortes de cada empresa. A AMD concentra seu foco no coração computacional da plataforma: as GPUs Instinct MI450, seus drivers de software, bibliotecas de IA como ROCm e a otimização do stack de software para desempenho máximo. A Celestica, por sua vez, assume toda a responsabilidade pelo ciclo de vida do subsistema de rede, desde a pesquisa e desenvolvimento (P&D) e design até a manufatura e integração dos switches scale-up no rack Helios. Essa especialização permite que cada parceiro faça o que faz de melhor.
O Mercado-Alvo: Nuvens Públicas, Hyperscalers e IA Empresarial
O lançamento da plataforma Helios, previsto para o final de 2026, tem um público-alvo bem definido. As grandes nuvens públicas (hyperscalers) que operam data centers com dezenas de milhares de GPUs são o mercado primário, buscando alternativas para diversificar seus fornecedores e reduzir custos. Empresas de tecnologia que desenvolvem modelos fundacionais próprios também são um alvo estratégico. Por fim, a plataforma mira o crescente segmento de IA empresarial, onde companhias de setores como finanças, saúde e energia começam a construir infraestrutura própria para modelos sensíveis ou especializados.
Impacto no Ecossistema de Fornecedores de Data Center
A entrada da dupla AMD-Celestica com uma plataforma completa de rack-scale deve causar um reordenamento competitivo no mercado de infraestrutura para IA. Fabricantes de switches tradicionais, como Arista e Cisco, podem ver uma parte de seu mercado de borda de rack ser absorvida por soluções integradas como a Helios. Simultaneamente, a colaboração fortalece o ecossistema OCP, podendo atrair mais fabricantes de servidores bare-metal a oferecer soluções compatíveis, criando um padrão de facto para racks de IA de alto desempenho.
Desafios e Oportunidades no Caminho para 2026
O anúncio estabelece uma visão clara, mas o caminho até a disponibilidade geral no final de 2026 está repleto de desafios. A AMD precisa não apenas finalizar o desenvolvimento das GPUs MI450, mas também garantir que seu stack de software ROCm atinja a maturidade e a estabilidade que os clientes empresariais exigem para missões críticas. A Celestica, por outro lado, tem o desafio de entregar switches com a confiabilidade carrier-grade que suporte operações 24/7 em data centers, ao mesmo tempo em que maximiza a eficiência energética, um fator de custo decisivo nesse segmento.
A Corrida pelo Desempenho por Watt em IA
Além do desempenho bruto em TFLOPS, uma métrica que se tornará cada vez mais decisiva para a adoção da plataforma Helios é a eficiência energética, ou desempenho por watt. Os custos com energia já são o maior componente do TCO (Custo Total de Propriedade) para data centers de IA. A arquitetura da Helios, com sua rede UALoE otimizada para reduzir o overhead de comunicação, e a promessa de eficiência das GPUs MI450, serão postas à prova contra essa métrica. A vitória no mercado poderá ser determinada não por quem tem o chip mais rápido, mas por quem entrega mais inteligência artificial por kilowatt-hora.
A colaboração entre AMD e Celestica representa mais do que um novo produto; é uma movimentação estratégica que busca redefinir as regras do jogo na infraestrutura de IA. Ao combinar o poder computacional de ponta com uma filosofia de design aberta e uma cadeia de suprimentos especializada, a dupla não está apenas vendendo hardware. Está oferecendo um caminho alternativo para a escalabilidade da inteligência artificial, um que prioriza a escolha do cliente, a eficiência de custos e a interoperabilidade de longo prazo em um mercado que, até agora, tem sido dominado por visões mais fechadas e proprietárias. O sucesso dessa empreitada poderá ditar o ritmo de inovação e os custos de operação da próxima geração de aplicações de IA global.

