Lokale AI op je pc: draai een model offline
Een AI-model op je eigen computer: privé, gratis en offline. We leggen eerlijk uit wat je nodig hebt, welke open modellen bestaan en waar lokale AI het aflegt tegen de cloud.

Een AI-model op je eigen computer: privé, gratis en offline. We leggen eerlijk uit wat je nodig hebt, welke open modellen bestaan en waar lokale AI het aflegt tegen de cloud.

Als je ChatGPT of Claude gebruikt, draait het rekenwerk op de servers van het bedrijf en gaat jouw tekst het internet op. Bij lokale AI draait het model op je eigen computer: niets verlaat je apparaat, je hebt geen abonnement en zelfs geen internet nodig. Klinkt ideaal — en voor sommige situaties is het dat ook.
Deze gevorderde gids legt uit hoe het werkt, wat je aan hardware en software nodig hebt, welke open modellen er globaal bestaan, en — net zo belangrijk — waar lokale AI eerlijk gezegd tekortschiet tegenover de cloud. Zo bepaal je zelf of het de moeite waard is.
Lokale AI betekent dat het taalmodel — het "brein" — als bestand op jouw computer staat en dat de berekeningen ook door jouw processor of videokaart worden gedaan. Je hebt twee dingen nodig: het modelbestand (een download van soms enkele gigabytes) en een programma dat dat model laadt en er een chatvenster omheen zet.
Het contrast met de bekende chatbots is fundamenteel. ChatGPT, Claude en Gemini zijn cloud-diensten: jij typt een bericht, dat gaat naar een datacenter, daar rekent een enorm model het antwoord uit en dat komt terug. Bij lokale AI slaat die hele reis over — de tekst blijft binnen de vier muren van je eigen machine. Dat is precies het aantrekkelijke, en meteen de kern van waarom mensen ervoor kiezen.
Er zijn vier redenen die telkens terugkomen:
Daar komt een vijfde, zachtere reden bij: controle en leren. Je bepaalt zelf welk model je draait en je snapt beter hoe de techniek werkt. Voor wie graag onder de motorkap kijkt, is dat op zichzelf al de moeite waard.
De drempel is de afgelopen jaren flink gezakt. Waar je vroeger met de commandoregel moest werken, zijn er nu gebruiksvriendelijke programma's die het model downloaden én een net chatvenster bieden. Twee bekende, gratis categorieën:
Belangrijker dan de software is je hardware. Een model draait op je processor (CPU) of, veel sneller, op je videokaart (GPU). De vuistregel: hoe meer werkgeheugen (RAM) en videogeheugen (VRAM), hoe groter en beter het model dat je vloeiend kunt draaien. Een moderne laptop met 16 GB RAM draait prima een middelgroot model; een aparte GPU maakt het merkbaar sneller. Mac-computers met "unified memory" doen het vaak verrassend goed. Reken ook op wat vrije schijfruimte: modelbestanden zijn al gauw enkele gigabytes.
| Modelgrootte (indicatie) | Vuistregel werkgeheugen | Wat je mag verwachten |
|---|---|---|
| Klein (± 3-4 miljard parameters) | 8 GB RAM | Snel, prima voor samenvatten en eenvoudige taken |
| Middel (± 7-8 miljard) | 16 GB RAM of instap-GPU | Goede balans, dagelijks bruikbaar |
| Groot (± 13 miljard) | 32 GB RAM of 12+ GB VRAM | Duidelijk sterker, traag zonder losse videokaart |
| Zeer groot (30 miljard en meer) | 32-64 GB RAM en stevige GPU | Beste kwaliteit lokaal, zware hardware-eisen |
Dit zijn vuistregels, geen wetten
De echte eisen hangen af van de mate van compressie (kwantisatie) van het model. Gecomprimeerde versies draaien op lichtere hardware, met een klein kwaliteitsverlies. Begin klein, kijk of het soepel loopt, en schaal daarna pas op.
Lokaal draaien kan alleen met open modellen (ook wel open-weight): modellen waarvan de makers de bestanden vrij beschikbaar stellen, zodat jij ze mag downloaden en draaien. De grote cloud-modellen van OpenAI en Anthropic zijn dat juist níet — die draaien alleen op hun eigen servers.
Een paar bekende families, op hoofdlijnen (we noemen bewust geen versienummers, want die verouderen snel):
Daarnaast bestaan er nog meer families, elk met eigen sterke punten voor talen, code of redeneren. In tools als Ollama en LM Studio kies je gewoon uit een lijst; je hoeft de onderliggende verschillen niet uit je hoofd te kennen. Een handige aanpak: download een klein en een middelgroot model, en vergelijk zelf welke voor jouw taken het beste voelt. Voor programmeerwerk zijn er speciale code-varianten — daarover meer in AI voor programmeurs.
Hier scheiden we de hype van de praktijk. Lokale AI is prachtig, maar het is geen gratis ChatGPT-killer. Reken op deze nadelen:
Kortom: je ruilt een deel van de kwaliteit en het gemak in voor privacy, controle en nul gebruikskosten. Of dat een goede ruil is, hangt volledig af van wat je ermee wilt. Twijfel je tussen lokaal en cloud, vergelijk dan ook onze gratis AI-tools en de grote chatbots naast elkaar.
Lokale AI is de moeite waard als je met gevoelige of vertrouwelijke gegevens werkt en die niet naar een cloud wilt sturen, als je vaak offline of op een afgeschermd netwerk werkt, als je grote hoeveelheden tekst wilt verwerken zonder limieten of kosten, of simpelweg als je graag zelf de techniek in handen hebt en wilt leren hoe het werkt.
Het is waarschijnlijk niets voor jou als je gewoon af en toe een tekst wilt laten schrijven of samenvatten, als je de best mogelijke kwaliteit wilt, als je hardware aan de lichte kant is, of als je geen zin hebt om iets in te stellen en te onderhouden. In die gevallen is een gratis of goedkoop cloud-abonnement sneller, makkelijker en beter. Er is geen schaamte in de makkelijke weg — kies wat bij je situatie past.
Feiten en prijzen gecontroleerd op de vermelde bronnen. AI verandert snel; kom je iets tegen dat niet meer klopt? Laat het ons weten.
De privacyregels rond AI, en waarom lokaal draaien daar een oplossing voor kan zijn.
Liever meteen aan de slag in de cloud? De beste gratis AI-tools op een rij.
Code-modellen, lokaal of in de cloud: wat werkt voor ontwikkelaars?
Lees welke regels gelden bij AI en persoonsgegevens — of vergelijk eerst de gratis cloud-opties.