Inference
Het dagelijks dráaien van een AI-model, inmiddels meer dan de helft van alle AI-uitgaven.
AI-rekenwerk kent twee fasen. Training is het eenmalig leren: een model wekenlang op bergen data laten kauwen, een megaproject. Inference is het gebruiken: elke chatvraag, elke gegenereerde afbeelding, elke AI-agent die iets opzoekt, draait als inference op een chip in een datacenter.
De verhouding kantelt hard: meer dan 55% van de AI-uitgaven gaat inmiddels naar inference. Dat verandert het karakter van de markt, training is een sprint die stopt, inference is een nutsvoorziening die elke maand een stroomrekening stuurt.
Voor de keten betekent dit een verschuiving van "de snelste chip" naar "de laagste kosten per antwoord": goedkope stroom, efficiënte koeling en zuinige chips worden de winnende factoren. Wie de inference-verschuiving snapt, snapt waarom de buitenring van de keten (stroom, koeling, water) structureel belangrijker wordt.