A notícia saiu de Redmond, não de São Francisco
A 20 de julho de 2026, Scott Guthrie, vice-presidente executivo de Nuvem e IA na Microsoft, publicou um texto intitulado "Microsoft expands Azure AI and HPC infrastructure with AMD". Confirmava que o Azure passará a oferecer máquinas virtuais ND MI455X v7 assentes na solução de bastidor AMD Helios, dirigidas a inferência de IA à escala de produção. A AMD descreve o Helios como uma plataforma construída de propósito que reúne os aceleradores Instinct MI455X, processadores EPYC de nova geração, rede Pensando e a pilha de software ROCm.
O calendário é a primeira coisa a reparar. A AMD realiza o seu evento Advancing AI 2026 no Moscone Center, em São Francisco, a 23 de julho, ou seja, três dias depois. O fornecedor tinha palco reservado e lançamento agendado. Ainda assim, o anúncio saiu primeiro de Redmond. Quando um comprador da dimensão da Microsoft opta por dar a notícia por sua iniciativa, não está a fazer um favor ao fornecedor. Está a reclamar o mérito de ter uma segunda fonte.
O que entrou de facto no catálogo
O texto da Microsoft tratava duas coisas distintas e a maioria da cobertura só apanhou uma. Do lado da IA, a série ND MI455X v7 traz bastidores Helios para o Azure, destinados a inferência à escala de produção. O texto da própria Microsoft não dava data de disponibilidade geral nem números de desempenho ao nível do bastidor. O comunicado da AMD do mesmo dia forneceu ambos, e vale a pena ler os dois documentos um contra o outro.
Do lado do cálculo clássico, os números eram concretos. As máquinas Azure HDv2 levam quase 500 núcleos físicos EPYC da sexta geração da AMD, 4 terabytes de memória, 32 terabytes de armazenamento NVMe local e rede Azure Boost de 400 Gb. O Azure HXv2 leva 176 núcleos EPYC acima dos 5 GHz, com mais 50 por cento de cache endereçável por núcleo, e é oferecido com cerca de 2 ou 4 terabytes de memória e 800 Gb de InfiniBand. O diretor de tecnologia da AMD, Mark Papermaster, chamou ao Azure HX "uma plataforma importante para escalar cargas EDA complexas", e Shankar Krishnamoorthy, diretor de desenvolvimento de produto da Synopsys, afirmou que estes sistemas permitem aos seus clientes "tirar partido do cálculo na nuvem de forma fiável e eficiente".
O comunicado da AMD, divulgado a 20 de julho pelo canal de relação com investidores, dá data e forma ao acordo. O Helios será entregue a clientes, Microsoft incluída, na segunda metade de 2026. Um bastidor Helios aloja 72 aceleradores Instinct MI455X e a AMD cifra-o em até 3 exaflops de IA, a par de processadores EPYC "Venice", rede Pensando e da pilha de software ROCm. A AMD delimitou ainda as cargas com mais rigor do que a Microsoft: o HDv2 aponta a IA agêntica e a canalizações de dados, o HXv2 ao desenho de semicondutores, e a própria implantação do Helios é descrita como inferência e não treino. Lisa Su chamou às implantações "um marco importante", e Satya Nadella apresentou a ampliação como dar aos clientes "desempenho, escala e escolha". Esse enquadramento na inferência conta para o teste proposto mais abaixo, porque o que este SKU lhe compra de facto é portabilidade na inferência, não no treino.
A segunda fonte é real. A portabilidade não é automática
Eis a parte que nenhum anúncio lhe conta. Um segundo fornecedor no catálogo não é o mesmo que um segundo fornecedor que possa realmente usar. Os aceleradores da AMD correm sobre ROCm. Se o seu percurso de inferência foi escrito para as ferramentas de outro fabricante, a existência de uma referência MI455X ao lado na lista de preços não lhe traz nada na renovação, porque não pode ameaçar sair de forma credível.
O poder negocial nas compras depende do custo de mudança, não da amplitude do catálogo. É a mesma armadilha em que os compradores europeus caíram há uma década com o armazenamento na nuvem: três fornecedores na lista restrita, um único modelo de saída de dados e nenhuma saída verdadeira. Os fornecedores eram, de facto, empresas diferentes. As cargas de trabalho é que não eram verdadeiramente portáveis. A negociação acabou exatamente como acaba uma negociação com um fornecedor único.
Por isso, a pergunta útil não é se a AMD é competitiva no papel. É se o modelo concreto que serve em produção, na estrutura com que o serve, corre sobre ROCm sem reescrita. Para uma parcela crescente de modelos de pesos abertos servidos através de ambientes de inferência comuns, a resposta é hoje sim. Para cadeias feitas à medida sobre bibliotecas proprietárias de um fabricante continua a ser não, e nenhuma diversidade de fornecedores no catálogo do Azure resolve isso por si.
A metade do texto dedicada aos processadores é o verdadeiro sinal
A Microsoft anunciou os aceleradores de IA e as máquinas EPYC de cálculo geral no mesmo fôlego, e esse emparelhamento transporta mais informação do que qualquer um dos pontos isolado. Um hiperescalador que se protege de um fornecedor dominante compra uma quantidade pequena da alternativa e fala pouco dela. Um hiperescalador que se normaliza sobre um fornecedor estende-o também às cargas correntes, aos trabalhos de EDA e ao processamento de dados, onde o volume é pouco vistoso e o compromisso é longo.
A Meta chegou a conclusão semelhante no início deste ano, comprometendo-se ao longo do tempo com até 6 gigawatts de capacidade AMD Instinct, estando o primeiro gigawatt previsto para a segunda metade de 2026. A Tata Consultancy Services assinou pelo Helios em fevereiro. O padrão entre estes compradores não é entusiasmo por um candidato a rival. É a recusa de deixar que um único fornecedor fixe as condições de uma década de despesa em capacidade de cálculo.
O que convém resolver antes da renovação
A ação aqui é pequena, barata e vale a pena fazer ainda neste trimestre. Pegue na sua principal carga de inferência em produção e determine, em concreto, se corre sobre ROCm. Não se um fornecedor diz que consegue. Mas se a sua equipa a consegue montar numa instância AMD e servir tráfego real. Esse teste custa uns dias de trabalho de engenharia e transforma um anúncio do setor num número que pode utilizar.
Se a resposta for sim, entra na próxima negociação de nuvem com uma alternativa autêntica e deve fixar preços em conformidade. Se for não, encontrou o custo efetivo da sua decisão de arquitetura, expresso no desconto que não vai receber. Em qualquer dos casos, passa a saber algo que a sua fatura nunca lhe iria contar.
Leia a seguir: Um data center de IA custa agora 50 mil milhões de dólares | Meta quer alugar seu cómputo de IA excedente



