Nyheden kom fra Redmond, ikke fra San Francisco
Den 20. juli 2026 offentliggjorde Scott Guthrie, executive vice president for Cloud og AI hos Microsoft, et indlæg med titlen "Microsoft expands Azure AI and HPC infrastructure with AMD". Det bekræftede, at Azure vil tilbyde virtuelle maskiner af typen ND MI455X v7 drevet af AMD Helios-rackløsningen, målrettet AI-inferens i produktionsskala. AMD beskriver Helios som en formålsbygget platform, der samler Instinct MI455X-acceleratorer, næste generation af EPYC-processorer, Pensando-netværk og ROCm-softwarestakken.
Tidspunktet er det første, der er værd at bemærke. AMD afholder sit arrangement Advancing AI 2026 i Moscone Center i San Francisco den 23. juli, altså tre dage senere. Leverandøren havde en scene booket og en lancering planlagt. Meddelelsen kom alligevel først fra Redmond. Når en indkøber af Microsofts størrelse vælger selv at bringe nyheden, gør den ikke leverandøren en tjeneste. Den tager æren for selv at have en anden kilde.
Hvad der reelt kom i kataloget
Microsofts indlæg dækkede to adskilte ting, og de fleste omtaler fangede kun den ene. På AI-siden bringer ND MI455X v7-serien Helios-racks ind i Azure til inferens i produktionsskala. Microsofts eget indlæg gav hverken dato for generel tilgængelighed eller ydelsestal på rackniveau. AMD's meddelelse samme dag leverede begge dele, og det er værd at læse de to dokumenter op mod hinanden.
På den klassiske regneside var tallene til gengæld præcise. Azure HDv2-maskiner rummer næsten 500 fysiske EPYC-kerner af AMD's sjette generation, 4 terabyte hukommelse, 32 terabyte lokal NVMe-lagring og 400 Gb Azure Boost-netværk. Azure HXv2 rummer 176 EPYC-kerner over 5 GHz med 50 procent mere adresserbar cache pr. kerne og tilbydes med omkring 2 eller 4 terabyte hukommelse og 800 Gb InfiniBand. AMD's teknologidirektør Mark Papermaster kaldte Azure HX "en vigtig platform til at skalere komplekse EDA-arbejdsbyrder", og Shankar Krishnamoorthy, chief product development officer hos Synopsys, sagde, at systemerne gør det muligt for kunderne at "udnytte skybaseret regnekraft pålideligt og effektivt".
AMD's meddelelse, udsendt den 20. juli via selskabets investorkanal, giver aftalen en dato og en form. Helios leveres til kunder, Microsoft inklusive, i anden halvdel af 2026. Et Helios-rack rummer 72 Instinct MI455X-acceleratorer, og AMD sætter det til op til 3 AI-exaflops, sammen med EPYC "Venice"-processorer, Pensando-netværk og ROCm-softwarestakken. AMD afgrænsede desuden arbejdsbyrderne skarpere end Microsoft: HDv2 sigter mod agentisk AI og datapipelines, HXv2 mod halvlederdesign, og selve Helios-udrulningen beskrives som inferens og ikke træning. Lisa Su kaldte udrulningerne "en vigtig milepæl", og Satya Nadella fremstillede udvidelsen som at give kunderne "ydelse, skala og valgmulighed". Den afgrænsning til inferens betyder noget for den test, der foreslås nedenfor, for det, denne SKU reelt køber dig, er portabilitet ved inferens, ikke ved træning.
Den anden kilde er virkelig. Flytbarheden er ikke automatisk
Her er den del, ingen meddelelse fortæller jer. En anden leverandør i kataloget er ikke det samme som en anden leverandør, I faktisk kan bruge. AMD-acceleratorer kører på ROCm. Er jeres vej til inferens skrevet til en anden producents værktøj, giver et MI455X-varenummer ved siden af på prislisten jer intet ved fornyelsen, for I kan ikke troværdigt true med at flytte.
Forhandlingsstyrke i indkøb er en funktion af skifteomkostninger, ikke af katalogets bredde. Det er den samme fælde, europæiske indkøbere gik i for ti år siden med skylagring: tre udbydere på den korte liste, én model for udgående data og ingen reel udgang. Udbyderne var virkelig forskellige virksomheder. Arbejdsbyrderne var ikke virkelig flytbare. Forhandlingen endte nøjagtigt, som en forhandling med én leverandør ender.
Det nyttige spørgsmål er derfor ikke, om AMD er konkurrencedygtig på papiret. Det er, om netop den model, I kører i produktion, i det framework I bruger, kører på ROCm uden at skulle skrives om. For en voksende andel af modeller med åbne vægte, der serveres gennem udbredte inferensmiljøer, er svaret nu ja. For skræddersyede kæder bygget på én producents lukkede biblioteker er det fortsat nej, og ingen leverandørbredde i Azures katalog løser det for jer.
Processordelen af indlægget er det egentlige tegn
Microsoft annoncerede AI-acceleratorerne og EPYC-maskinerne til almindelig regnekraft i samme ombæring, og den sammenkobling bærer mere information end nogen af delene hver for sig. En hyperscaler, der afdækker sig mod en dominerende leverandør, køber en lille mængde af alternativet og siger ikke meget om det. En hyperscaler, der standardiserer på en leverandør, udvider den også til de almindelige arbejdsbyrder, til EDA-opgaver og databehandling, hvor mængden er uglamourøs og bindingen lang.
Meta nåede en tilsvarende slutning tidligere på året og forpligtede sig over tid på op til 6 gigawatt AMD Instinct-kapacitet, med det første gigawatt ventet i anden halvdel af 2026. Tata Consultancy Services skrev under på Helios i februar. Mønstret hos disse købere er ikke begejstring for en udfordrer. Det er en afvisning af at lade én leverandør fastsætte vilkårene for et årtis udgifter til regnekraft.
Hvad I bør afklare inden fornyelsen
Handlingen her er lille, billig og værd at gennemføre i dette kvartal. Tag jeres største produktionsbyrde til inferens og fastslå konkret, om den kører på ROCm. Ikke om en leverandør siger, at den kan. Men om jeres team kan sætte den op på en AMD-instans og betjene reel trafik. Den test koster nogle få dages udviklingstid og forvandler en brancheannoncering til et tal, I kan bruge.
Er svaret ja, går I ind i næste cloudforhandling med et ægte alternativ og bør prissætte derefter. Er svaret nej, har I fundet den faktiske pris på jeres arkitekturbeslutning, udtrykt i den rabat, I ikke kommer til at få. Under alle omstændigheder ved I nu noget, som jeres faktura aldrig ville have fortalt jer.
Læs videre: Et AI-datacenter koster nu 50 milliarder dollar | Meta vil udleje sin ledige AI-regnekraft



