Neki od najvećih Nvidijinih kupaca dobili su obavijest da bi cijene servera s AI čipovima u mnogim konfiguracijama mogle porasti više od 15 posto zbog sve skuplje memorije,. Promjena bi zahvatila sustave koji se isporučuju početkom 2027., među njima platforme Vera Rubin i Grace Blackwell, no Nvidia navod još nije službeno potvrdila.
Prema osobama upoznatima s postupkom, postotak neće biti jednak za svaki proizvod. Ovisit će o generaciji procesora i količini te vrsti memorije ugrađene u konfiguraciju. Ugovorni proizvođači servera koji opskrbljuju operatore velikih podatkovnih centara, uključujući Microsoft, Google i Oracle, već su prenijeli nove cjenovne informacije svojim kupcima. Reuters nije uspio samostalno potvrditi izvještaj, a kompanija nije odgovorila na upit izvan uobičajenog radnog vremena.
AI server nije samo kartica s grafičkim procesorom. Sustav na razini police spaja desetke akceleratora, procesore, velike količine memorije visoke propusnosti, mrežne sklopke, optičke veze, pohranu, napajanje i hlađenje. HBM memorija mora podatke dostavljati akceleratoru iznimno velikom brzinom; bez nje skupi procesor čeka umjesto da računa. Zato poskupljenje jednog ograničenog dijela lanca može podignuti račun za čitavu tvornički integriranu policu.
Vera Rubin je Nvidijina sljedeća velika platforma za podatkovne centre, dok Grace Blackwell kombinira procesore i akceleratore sadašnje generacije u gusto povezanim sustavima. Kupci ih ne naručuju kao izolirane čipove nego kao unaprijed usklađene računalne cjeline. To smanjuje vrijeme integracije, ali proizvođaču daje veću kontrolu nad sastavnicama i cijenom. Razlika od 15 posto na višemilijunskom sustavu brzo postaje višestotisućni dodatak prije troška zgrade, električne energije i mreže.
Za hiperskalere je važan trenutak isporuke. Proračuni za kampuse i cloud regije ugovaraju se mjesecima unaprijed, pa promjena početkom 2027. može pogoditi projekte čiji su zakupci, priključci i rokovi već dogovoreni. Kupac može pokušati zaključati cijenu ranijom narudžbom, smanjiti broj sustava ili odgoditi dio kapaciteta. Svaka opcija nosi posljedicu: veći avans, slabiju dostupnost računalne snage ili kasniji prihod od usluge.
Memorijski dobavljači istodobno preusmjeravaju proizvodnju prema HBM-u, gdje je potražnja AI industrije velika, a napredno pakiranje složeno. Veći kapacitet ne nastaje trenutačno jer traži opremu, kvalifikaciju procesa i ugovore za silicijske pločice. Kada se usko grlo pojavi u memoriji, proizvođači servera imaju manje prostora da rast cijene apsorbiraju vlastitom maržom. Izvještaj upravo taj pritisak navodi kao razlog upozorenja kupcima.
Poskupljenje bi se moglo preliti na cloud kroz višu cijenu rezerviranih instanci ili sporije snižavanje cijene starijih generacija. Operatori mogu dio povećanja prikriti dugoročnim ugovorima, popustima i vlastitim dizajnom mreže, ali račun naposljetku mora pokriti kapital, energiju i financiranje. Korisniku AI aplikacije to se pojavljuje kao viša cijena sata akceleratora ili tokena, osobito ako model zahtijeva veliku memoriju i ne može se lako premjestiti na jeftiniji čip.