De cover van dit artikel is op mijn eigen laptop gemaakt. Mijn dictaat gaat ook nergens heen: ik houd een sneltoets ingedrukt, praat, en de tekst verschijnt zonder dat er iets is geüpload. Tegelijk draait er ‘s nachts een geplande taak op de servers van Anthropic, terwijl mijn laptop dicht is. Dat is geen inconsequentie maar een afweging per taak, en de vuistregel die eruit volgt is kort: lokaal als de invoer gevoelig is of de latency telt, cloud als het door moet lopen terwijl jij er niet bent.
De drie aanpakken naast elkaar
| Aanpak | Waar je invoer blijft | Wat het kost | Wat het je oplevert | Wat er bij mij brak |
|---|---|---|---|---|
| Volledig lokaal | Verlaat je apparaat niet, ook je prompt niet | Schijfruimte en accu: ongeveer 1 GB voor een spraakmodel en 3,5 GB voor de opschoning, plus hardware die het aankan | Geen teller, geen dienst die morgen je stijl kan verbieden, en het werkt zonder internet | Een half geïnstalleerde omgeving, een onderdeel dat werkte afhankelijk van in welke map ik stond, en een model dat zweeg in plaats van een foutmelding gaf |
| Volledig cloud | Op de server van de aanbieder, samen met je opdracht | Een abonnement per maand, en de zwaarste functies beginnen bij het duurste plan | Het draait door terwijl jij offline bent, en je hoeft niets te installeren | De gebruikslimiet die je op een productieve dag raakt, en functies die pas later doordruppelen naar goedkopere abonnementen |
| Aansturing cloud, uitvoering lokaal | Je bestanden blijven op je machine, de aansturing loopt langs een dienst | Zit meestal in hetzelfde abonnement, geen aparte prijs | Je kunt vanaf je telefoon iets starten dat op je eigen spullen werkt | Als je machine uit staat gebeurt er niets, dus het verplaatst de bediening en niet de uitvoering |
Waar je op let bij de keuze
Hoe gevoelig is de invoer? Dit is de eerste vraag, niet de laatste. Bij een losse cover maakt het weinig uit. Bij werk dat nog niet naar buiten mag, of bij dictaat waarin je halverwege de naam van een collega noemt, maakt het alles uit. Bij praten lekt er meer dan bij typen: de aarzeling, de terzijde, de zin die je opnieuw begint.
Telt de vertraging? Voice die boven de zevenhonderd milliseconden uitkomt, gaat stroef voelen. Haal je het netwerk uit de keten, dan valt een deel van die vertraging weg zonder dat je iets optimaliseert. Voor een taak die ‘s nachts draait is latency juist irrelevant.
Moet het doorlopen als jij er niet bent? Dan valt lokaal af. Een model op je laptop doet niets met de klep dicht.
Wat kost het, en aan wie ben je dan gebonden? Een abonnement is voorspelbaar maar het is ook een afhankelijkheid: de prijs, de limieten en de functieverdeling veranderen zonder dat jij erover gaat. Lokaal draaien vraagt hardware en avonden, maar het model op je schijf blijft doen wat het deed.
Wat lokaal draaien echt kost
Het genereren zelf is het probleem niet. Het model dat ik voor beeld gebruik, Bonsai Image, is zo ver platgedrukt dat het op een laptop past en op een M4 Pro in zo’n zes seconden een beeld maakt. Het draait zelfs op een telefoon.
De tijd zit in de gereedschapskist eromheen. Ik schreef eerder waarom ik het toch zo doe: omdat ik het bezit, omdat ik er een vaste stijl mee kan vasthouden, en omdat je een gereedschap pas begrijpt als je er een keer mee bent vastgelopen. Dat laatste is geen bijvangst maar de kern.
Bij dictaat ligt het net anders. FluidVoice draait het spraakmodel én de opschoning lokaal, en dat tweede hield ik het langst voor onmogelijk. Ruwe dictatie is rommelig, en de meeste apps sturen die rommel naar een server om er nette zinnen van te maken. Precies daar zit de gevoeligste tekst.
Wat de cloud koopt
Eén ding, en dat is een groot ding: het draait door terwijl jij er niet bent. Toen Cowork van het bureau af ging veranderde daarmee ook waar het nuttig voor is, en in dat stuk staat waarom een taak die zichzelf ‘s nachts uitvoert een ander soort gereedschap is dan een taak die op jou wacht.
De prijs is dat het werk verhuist naar de machine van iemand anders. Voor een nieuwsoverzicht is dat prima. Voor materiaal waar ik zelf niet over ga, is het de verkeerde plek.
De kanttekening: open source verplaatst de afhankelijkheid, het lost hem niet op
Wie lokaal draait, denkt makkelijk dat hij daarmee onafhankelijk is. Dat klopt niet helemaal. In het stuk over dicteren rekende ik het al voor: de app mag open zijn, de modellen eronder komen van dezelfde handvol grote partijen als in de cloud. Gratis te gebruiken, niet door mij gemaakt en niet door mij te onderhouden. De afhankelijkheid is verschoven van een dienst naar een modelgewicht, en dat is winst, geen bevrijding.
Er zit ook een toegangskant aan. Lokaal is niet gratis: het kost schijfruimte, accu en hardware die goed genoeg is. Wie een oudere laptop heeft, kan deze keuze simpelweg niet maken, en dan is “draai het gewoon zelf” een advies dat alleen werkt voor wie het zich kan veroorloven.
En één die specifiek voor lokale apps geldt: om in elk tekstveld te kunnen typen, vraagt zo’n app om toegang tot je toetsenbord en je microfoon. Een app die je van GitHub haalt mag dan permanent meekijken. Dat het lokaal draait maakt die rechten niet kleiner, alleen beter uitlegbaar.
Dat ik hier scherp op ben komt ergens vandaan. Ik werk overdag aan digitale soevereiniteit, aan de vraag wie er eigenaar is van welke data. Het zou raar zijn om dat te betogen en er ‘s avonds anders naar te handelen.
Veelgestelde vragen
Is lokaal draaien altijd veiliger?
Voor je invoer wel: die verlaat je apparaat niet. Maar een lokale app vraagt vaak wel toegang tot je toetsenbord en microfoon, en dat is een reëel risico dat je bij een webdienst niet hebt. Veiliger op het ene punt betekent dus niet veiliger op alle punten.
Heb ik dure hardware nodig om een model lokaal te draaien?
Voor beeld niet meer per se: er zijn modellen die zo ver zijn verkleind dat ze op een laptop en zelfs op een telefoon draaien. Voor snelle, goede resultaten helpt recente Apple Silicon wel. Reken op enkele gigabytes schijfruimte per model.
Wat kies je als je maar één ding lokaal kunt doen?
Dictaat. Daar is de invoer het gevoeligst, want bij praten zeg je meer dan je zou typen, en de vertraging is er het meest voelbaar. Beeldgeneratie is de leukste om zelf te draaien, maar zelden de meest urgente.
Is de cloud dan slechter?
Nee. Voor werk dat door moet lopen terwijl jij offline bent, is er geen lokaal alternatief. Welke van de twee je pakt, hangt af van de taak.
Cijfers en modelnamen komen uit mijn eigen stukken over deze opstelling, geschreven tussen juni en augustus 2026. Prijzen en limieten van clouddiensten veranderen regelmatig; controleer ze bij de aanbieder voordat je erop rekent.
