Wat je nodig hebt voor lokaal AI
Een lokaal taalmodel draaien vraagt drie dingen: een GPU met voldoende VRAM (minimaal 8GB, liever 16GB of meer), voldoende systeem-RAM (16GB minimum, 32GB comfortabel), en opslag voor het model (5-20GB per model).
Wat werkt op een lokale computer
Kleine modellen (7B parameters of minder) draaien op een computer met een degelijke GPU. Ze zijn bruikbaar voor eenvoudige taken: samenvatten, vertalen, eenvoudige vragen beantwoorden. Maar wie een model wil dat echt goed meekan met cloud-alternatieven, heeft meer nodig dan een mini-pc.
Wat goede kwaliteit echt kost
Om een lokaal taalmodel echt goed te laten draaien, wil je niet baseren op die kleine modellen. Je hebt een model nodig zoals GLM 5.2 — een groot model dat concurreert met de beste cloud-modellen in kwaliteit. Dat soort modellen heeft 100 tot 400 GB RAM nodig. De computers die dat aankunnen kosten tussen de 70.000 en 100.000 euro.
Dat is voor de meeste kmo's geen realistische investering. Het is eerlijk om dat zo te stellen: een lokale computer is fantastisch voor hybride opstellingen, maar een volledig lokaal model met cloud-kwaliteit vereist enterprise-hardware.