Amazon Web Services og NVIDIA udvider deres mangeårige samarbejde med planer om yderligere to millioner grafikprocessorer, også kaldet GPU'er, i AWS' globale datacentre. De nye chips skal installeres i løbet af 2027 og 2028 og skal give virksomheder mere regnekraft til blandt andet AI-agenter, forskning, automatisering og robotter.
Der er tale om NVIDIA Blackwell Ultra, Rubin og Rubin Ultra. Det er flere generationer af AI-chips, som skal sættes i drift over en periode og derfor ikke bliver tilgængelige på én gang. AWS og NVIDIA beskriver udvidelsen som et svar på en efterspørgsel, der er vokset hurtigere end forventet.
To millioner oven i den tidligere plan
AWS annoncerede tidligere i 2026, at selskabet ville tilføje mere end én million NVIDIA-GPU'er fra samme år. Den nye aftale kommer oven i den plan. Hvis begge udbygninger gennemføres som beskrevet, vil AWS dermed udvide sin kapacitet med mere end tre millioner NVIDIA-chips over flere år.
Det er en markant udbygning af den del af skyen, som bruges til at træne og drive store AI-modeller. Kunderne køber ikke nødvendigvis selv chipudstyret, men lejer adgang gennem AWS' tjenester. Det gør det muligt at skrue op og ned for regnekraften uden at bygge egne datacentre.
Planen er stadig fremadrettet. NVIDIA og AWS oplyser tidsvinduet 2027-2028, men har ikke offentliggjort en detaljeret kalender for, hvornår de enkelte chiptyper eller datacentre får den nye kapacitet.
Samarbejdet går længere end grafikchips
Aftalen handler også om de øvrige dele, der skal få store AI-systemer til at fungere som en samlet maskine. AWS arbejder på at bringe NVIDIAs Vera-processorer ind i sin infrastruktur. De er beregnet til opgaver, hvor almindelig processorkraft skal arbejde tæt sammen med de specialiserede AI-chips.
Samtidig skal NVIDIAs NVLink Fusion-teknologi skabe hurtige forbindelser mellem forskellige typer processorer. Det er vigtigt, fordi tusindvis af chips i et stort AI-anlæg løbende skal udveksle data. En langsom forbindelse kan blive en flaskehals, selv når de enkelte chips er meget hurtige.
Amazons chipafdeling Annapurna Labs skal som den første samarbejde med NVIDIA om en ny hukommelsesteknologi kaldet NVHBM. Den skal blandt andet kunne kobles til AWS' egne Trainium-chips, så de kan indgå i samme større system som NVIDIA-GPU'er.
Ny hukommelse skal give mere plads og bruge mindre strøm
NVHBM flytter en del af styringen af hukommelsen væk fra selve AI-processoren og ind i hukommelsespakken. Ifølge NVIDIA kan det give op til 30 procent større hukommelsesbåndbredde og 15 procent lavere strømforbrug i hukommelsen sammenlignet med standarden HBM4E. Det kan samtidig frigøre op til 25 procent mere plads på selve processoren til beregninger.
Tallene er NVIDIAs egne forventninger til den kommende teknologi og er ikke resultater fra færdige AWS-systemer. Hukommelsen skal først valideres og leveres sammen med flere hukommelsesproducenter. Annapurna Labs bliver den første offentliggjorte samarbejdspartner, men NVIDIA vil gøre løsningen tilgængelig for flere kunder i sit NVLink Fusion-program.
Kapaciteten bliver en konkurrencefordel
Udbygningen viser, at konkurrencen om AI ikke kun handler om at udvikle den bedste model. Adgang til chips, strøm, hukommelse og hurtige netværk er blevet lige så afgørende. For AWS kan flere NVIDIA-chips gøre det lettere at tiltrække virksomheder, der vil træne store modeller eller drive mange AI-tjenester samtidig.
For NVIDIA udvider aftalen selskabets rolle fra leverandør af GPU'er til partner på tværs af processorer, hukommelse, netværk og software. Samtidig får AWS mulighed for at blande NVIDIAs teknologi med sine egne Trainium-chips. Den praktiske effekt for kunderne kommer dog gradvist, fordi hovedparten af den nye GPU-kapacitet først er planlagt til 2027 og 2028.
Der er benyttet AI til at skrive denne artikel.
