Quick answer: Inferentie is een kostprijs van de omzet (COGS), geen eenmalige ontwikkelingsinvestering. Het wordt aangeroepen bij elke klantactie, schaalt direct mee met het gebruik en belandt op dezelfde factuur...

Brutomarge van een AI-feature meten voor release

Updated September 2, 2026 · first published September 2, 2026

Inferentie is een kostprijs van de omzet (COGS), geen eenmalige ontwikkelingsinvestering. Het wordt aangeroepen bij elke klantactie, schaalt direct mee met het gebruik en belandt op dezelfde factuur als de productie-infrastructuur. Wie dit tot de livegang behandelt als R&D, ontdekt de werkelijke brutomarge pas bij de eerste volledige factuurcyclus — het meest ongunstige moment om operationele margedruk vast te stellen.

Instrumenteer vóór de release, niet erna

Tag in staging elke modelaanroep met account-, workflow- en uitkomstlabels en speel realistisch verkeer af in plaats van een synthetische lus. Wat u nodig heeft is een verdeling: kosten per geslaagde taak op p50, p90 en p99, plus het percentage van de uitgaven dat opgaat aan mislukte en herhaalde taken waarvoor u wel providerkosten betaalt. Een enkel gemiddelde maskeert de accounts die de marge vernietigen.

Herleid naar kosten per account

Vermenigvuldig de kosten per geslaagde taak met het verwachte aantal maandelijkse taken per account en tel de faalverhouding erbij op. Vergelijk die uitkomst met de abonnementsprijs van het plan. Voer dit uit bij mediaan gebruik, op het 90e percentiel en voor het zwaarste account dat u commercieel nog toestaat. Vaste abonnementen falen in de staart, omdat modelkosten blijven stijgen terwijl de omzet begrensd is.

Vier kritieke kostendrijvers

Koppel cijfers direct aan een beleidskeuze

De uitkomst moet een vooraf genomen besluit zijn: een verbruiksplafond in het abonnement, een variabele verbruikscomponent in de prijsstructuur, een voordeliger standaardmodel met slimme escalatie, of een bewust geaccepteerde marge met een herzieningsdatum.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research