Grote aanbieders van clouddiensten zoals Amazon, Microsoft en Oracle proberen minder afhankelijk te worden van de dure ai-chips van Nvidia. Ze ontwikkelen steeds vaker zelf chips.
Dat schetst Jean-Paul van Oudheusden van beleggingsplatform Etoro in een marktcommentaar. Hij wijst hierbij op de opkomst van ai‑inference. Dat is het proces waarbij een al getraind ai-model nieuwe, onbekende data analyseert om voorspellingen, beslissingen of antwoorden te genereren. Het model leert hierbij niet meer bij, maar past de eerder geleerde patronen direct toe in de praktijk.
Uit aangehaalde cijfers van onderzoeksinstituut Epoch AI blijkt dat Amazon inmiddels bijna de helft van zijn rekenkracht uit eigen chips haalt. Google gaat nog verder: het grootste deel van zijn ai‑capaciteit draait op zelf ontworpen chips. Microsoft, Meta, Oracle, CoreWeave en xAI leunen nog sterk op Nvidia‑hardware.
Ai-inference groeit snel door de opkomst van ai‑agents, die zelfstandig meerdere stappen uitvoeren. Daardoor wordt de prijs per berekening belangrijker dan maximale flexibiliteit, wat kansen biedt voor gespecialiseerde zogenoemde asic‑chips (application-specific integrated circuit), vat Van Oudheusden samen.
Waarom Amazon al tien jaar zelf chips ontwikkelt
Amazon zag die verschuiving vroeg aankomen, schrijft Van Oudheusden. Het bedrijf kocht in 2015 chipontwerper Annapurna Labs voor naar schatting 350 miljoen dollar en ontwikkelt inmiddels eigen chips zoals de Graviton-processoren en de Trainium-chips voor ai.
Die strategie werpt vruchten af: de verkoop en het gebruik van eigen chips leveren AWS op jaarbasis al meer dan 25 miljard dollar op, met een groei van ruim 100 procent op jaarbasis. De logica erachter is simpel: voor elke Nvidia-GPU die Amazon koopt, betaalt het mee aan de hoge marges van de chipmaker. Met eigen chips houdt AWS een groter deel van die waarde binnen de eigen clouddivisie, en kan het de miljardenkosten van chipontwikkeling spreiden over enorme volumes rekenwerk.
Nvidia laat zich intussen niet zomaar opzij zetten. Het bedrijf verdedigt zijn marges met een steeds hoger productietempo: na Hopper volgden Blackwell en Blackwell Ultra, en met Vera Rubin dient zich de volgende generatie aan, gericht op lagere kosten per token.
Daarnaast breidt Nvidia zijn aanbod uit met cpu’s, netwerkchips en complete serverkasten, en laat het via NVLink Fusion zelfs toe dat concurrerende chips zoals Amazons Trainium aansluiten op zijn eigen infrastructuur. Zo blijft Nvidia meeverdienen, ook als klanten voor eigen hardware kiezen.
