Open modellen verwerken nu het meeste AI-werk: wat heb jij daaraan

Inhoudsopgave
Wat Vercel heeft gemeten
Het Amerikaanse Vercel levert software waarmee ontwikkelaars hun apps met allerlei AI-modellen laten praten, de AI Gateway. Uit de nieuwste Production Index van dat platform blijkt dat open-weight modellen in augustus 56 procent van alle verwerkte tekst voor hun rekening namen, tegen 13 procent in april. Emerce meldt daarnaast dat die open modellen maar 14 procent van de uitgaven vormden en dat de gemiddelde prijs per eenheid tekst in augustus met 23,2 procent daalde.
Het gaat hier om het gebruik via één platform, met vooral ontwikkelaars en bedrijven wereldwijd als klant. Het zegt dus niets direct over wat Nederlandse consumenten in hun chat-app gebruiken. Het laat wel een duidelijke trend zien. Teams kiezen vaker het goedkoopste model dat de klus aankan. Dat zie je ook binnen de gesloten modellen. Volgens dezelfde cijfers stapten veel teams bij Anthropic over van Fable 5 naar het goedkopere Opus 5, een beweging die we eerder beschreven bij de komst van Opus 5.5.
Wat een open model is
Een AI-model bestaat uit een enorme verzameling getallen, de gewichten, die tijdens de training zijn bepaald. Bij een gesloten model, zoals dat achter ChatGPT of Gemini, blijven die gewichten bij het bedrijf. Je gebruikt het model alleen via hun website, app of betaalde koppeling. Bij een open-weight model publiceert de maker die gewichten. Iedereen mag ze dan downloaden en het model op eigen hardware draaien, binnen de voorwaarden van de licentie.
Open-weight is niet hetzelfde als volledig open source. Vaak blijft geheim met welke data het model is getraind, en sommige licenties stellen grenzen aan commercieel gebruik. Voor de gebruiker is het belangrijkste verschil praktisch. Je bent niet afhankelijk van één aanbieder en je gegevens hoeven je eigen computer of server niet te verlaten.
Bekende families van open modellen zijn onder meer Llama van Meta, de modellen van het Franse Mistral, Gemma van Google, Qwen van Alibaba en de modellen van DeepSeek. Ook OpenAI bracht met gpt-oss open gewichten uit. Ze verschillen sterk in grootte. De grootste versies hebben serverhardware nodig, de kleinste draaien op een gewone laptop.
Waarom bedrijven overstappen
De cijfers van Vercel wijzen vooral op geld. Een open model kun je laten draaien bij de goedkoopste aanbieder, of op eigen hardware, en voor veel routinewerk is het goed genoeg. Denk aan teksten samenvatten, e-mails sorteren, gegevens uit documenten halen of een klantvraag naar de juiste afdeling sturen. Voor dat soort taken hoef je niet het duurste model te gebruiken. Het zware werk, zoals lastige analyses of lange stukken code, gaat bij veel teams nog steeds naar een betaald topmodel.
Een tweede reden is controle. Een bedrijf dat met privacygevoelige gegevens werkt, kan een open model binnen de eigen omgeving draaien, zodat klantdata niet naar een Amerikaanse dienst gaat. En omdat de gewichten vastliggen, verandert het model niet ineens als de aanbieder een update doorvoert.
Zelf een open model gebruiken, gratis
Je hoeft geen ontwikkelaar te zijn om een open model uit te proberen. Er zijn twee makkelijke routes.
- Via een programma op je eigen computer. LM Studio is een gratis app voor Windows, macOS en Linux met een gewoon chatvenster. Je zoekt in de app een model op, downloadt het en begint te typen. Wie liever met de opdrachtregel werkt, gebruikt Ollama. Alles draait dan lokaal, ook zonder internetverbinding.
- Kies een klein model om mee te beginnen. Een model met een paar miljard parameters draait op de meeste recente laptops met minstens 16 gigabyte werkgeheugen. Grotere modellen geven betere antwoorden, maar vragen veel meer geheugen en worden op een gewone laptop traag. Een Mac met Apple-chip of een pc met een stevige videokaart heeft hier duidelijk een voordeel.
- Test met je eigen werk. Laat het model een lange mail samenvatten, een tekst herschrijven of een lijstje ordenen. Zo merk je snel waar het goed genoeg is en waar je toch liever een groot model gebruikt.
- Via een website. Wil je niets installeren, dan bieden verschillende diensten open modellen aan in de browser. Je gegevens gaan dan wel weer naar die dienst, dus het privacyvoordeel valt weg.
Wat je van een lokaal model mag verwachten
Verwacht van een klein model op je laptop niet hetzelfde als van de nieuwste versie van ChatGPT of Claude. Het maakt vaker feitelijke fouten, zijn Nederlands is soms wat stijver en hij zoekt niet op internet. Voor privétaken waarbij je geen gegevens wilt delen, zoals een persoonlijke brief, notities of een document van je werk, is dat vaak een prima ruil. Je betaalt niets per vraag en niemand leest mee.
De verschuiving die Vercel ziet, maakt de open modellen in rap tempo beter en goedkoper om te draaien. Voor de gemiddelde gebruiker verandert er vandaag weinig in de chat-app die je al kent. Maar wie de privacy of de kosten van AI belangrijk vindt, heeft er een serieus alternatief bij dat je zonder veel moeite op je eigen computer zet.





