Wat betekent AI lokaal draaien?
AI lokaal draaien betekent dat het taalmodel op je eigen hardware werkt: een laptop, een werkstation of een server die jij beheert. Je vragen, documenten en klantdata blijven op die machine en gaan niet naar een externe AI-aanbieder.
Bij cloud-AI, zoals ChatGPT of Claude in de browser, stuur je elke vraag naar de servers van de aanbieder. Bij lokaal draaien download je een open model en voer je het zelf uit. Jij bent dan je eigen aanbieder, met de controle en het beheer die daarbij horen.
Waarom draaien bedrijven AI lokaal?
Bedrijven draaien AI lokaal om vier redenen: controle over data, voorspelbare kosten, beschikbaarheid en onafhankelijkheid van één aanbieder.
Controle over data. Een lokaal model verwerkt je invoer op je eigen machine. Er is voor die verwerking geen externe AI-aanbieder die je data ontvangt. Voor zorg, juridische dienstverlening en finance weegt dat zwaar. Meer hierover lees je in AI en privacy.
Voorspelbare kosten. Cloud-AI betaal je per gebruiker of per gebruik. Een lokaal model kost je hardware, stroom en beheer, en daarna geen bedrag per vraag.
Beschikbaarheid. Een lokaal model werkt zonder internetverbinding zodra de modelbestanden op je machine staan. LM Studio beschrijft dit in de eigen documentatie als volledig offline werken.
Onafhankelijkheid. Prijzen, voorwaarden en modelversies van een cloud-aanbieder kunnen wijzigen. Een model dat je zelf hebt gedownload blijft werken zoals je het hebt getest.
Wat heb je nodig om AI lokaal te draaien?
Om AI lokaal te draaien heb je drie dingen nodig: hardware, een model en software die het model uitvoert.
Hardware. Werkgeheugen is de bepalende factor: het model moet in het geheugen van je machine of je videokaart passen. De makers van LM Studio noemen deze eisen (peildatum oktober 2026):
| Systeem | Wat LM Studio vraagt |
|---|---|
| Mac | Apple Silicon (M1 of nieuwer), macOS 14 of nieuwer, 16 GB werkgeheugen of meer aanbevolen |
| Windows | Processor met AVX2 of een ARM-systeem (Snapdragon X Elite), minimaal 16 GB werkgeheugen aanbevolen, videokaart met minimaal 4 GB eigen geheugen aanbevolen |
| Linux | x64 of ARM64, Ubuntu 20.04 of nieuwer |
Op een Mac met 8 GB werkt het volgens LM Studio ook, met kleinere modellen en een beperkte context. Intel-Macs ondersteunt LM Studio niet. Voor grotere modellen en meerdere gebruikers tegelijk kom je uit bij een werkstation of server met een zware videokaart.
Een model. Je kiest een open model dat je zelf mag downloaden en uitvoeren. Bekende families zijn Mistral van het Franse Mistral AI, Llama van Meta, Gemma van Google en Qwen van Alibaba. OpenAI biedt met gpt-oss ook open modellen aan. Elke familie heeft een eigen licentie: lees die voordat je een model zakelijk inzet. De families naast elkaar vind je in onze vergelijking van open-source LLM's voor bedrijven.
Software. Een programma laadt het model en maakt het bruikbaar. Twee veelgebruikte opties:
- Ollama: open-source software waarmee je een model met één opdracht start, bijvoorbeeld Gemma 4. Ollama heeft een REST API, zodat je eigen applicaties en agents het model kunnen aanroepen.
- LM Studio: een desktopprogramma met een chatvenster waarin je modellen downloadt en gebruikt, geschikt als je zonder terminal wilt starten.
Lokaal of cloud: wat is het verschil?
Het verschil tussen lokaal en cloud zit in waar je data wordt verwerkt, hoe je betaalt en wie het beheer doet.
| Aspect | Lokaal | Cloud |
|---|---|---|
| Data | Blijft op je eigen machine | Gaat naar de aanbieder |
| Kosten | Hardware, stroom en beheer | Per gebruiker of per gebruik |
| Modellen | Open modellen die op je hardware passen | Ook de grootste modellen van de aanbieder |
| Beschikbaarheid | Werkt zonder internet | Afhankelijk van internet en aanbieder |
| Beheer | Bij jou of je IT-partner | Bij de aanbieder |
De grootste modellen van aanbieders als OpenAI, Anthropic en Google draaien in hun eigen cloud en kun je niet downloaden. Een lokaal model is kleiner. Test daarom met je eigen praktijkcases of de kwaliteit voldoet voor de taak die je voor ogen hebt.
Wanneer is AI lokaal draaien de juiste keuze?
AI lokaal draaien past bij je bedrijf als een van deze vier situaties geldt:
- Je verwerkt gevoelige gegevens, zoals medische, juridische of financiële dossiers
- Je sector of je opdrachtgevers stellen eisen aan waar data staat en wie erbij kan
- Je gebruikt AI dagelijks zo intensief dat kosten per gebruik oplopen
- Je wilt dat een kernproces blijft werken als een aanbieder zijn prijzen of voorwaarden wijzigt
Gebruik je AI af en toe en zonder gevoelige data, dan is een zakelijk cloud-abonnement eenvoudiger. Combineren kan ook: werk met gevoelige data lokaal, de rest in de cloud. Wat je bij cloud-AI vastlegt lees je in AVG-proof AI gebruiken.
Hoe begin je met AI lokaal draaien?
Je begint met een proef op een computer die je al hebt en schaalt pas op als de proef slaagt.
Stap 1: installeer een runner. Download Ollama of LM Studio op een machine die aan de eisen voldoet.
Stap 2: kies één taak. Neem werk dat vaak terugkomt en waar je de uitkomst makkelijk van beoordeelt, zoals het samenvatten van lange documenten of het opstellen van conceptantwoorden.
Stap 3: test met eigen voorbeelden. Leg tien echte voorbeelden voor aan het model en vergelijk de uitkomst met wat je zelf zou schrijven. Probeer een tweede model als de kwaliteit tegenvalt.
Stap 4: beslis over de volgende stap. Voldoet het model, dan kijk je of meer collega's ermee gaan werken en of een centrale machine nodig is. Hoe dat werkt lees je in AI op een eigen server.
Een proef op één computer kost je software niets: Ollama is open source en veel open modellen download je gratis. Je investering zit in tijd en, bij opschalen, in hardware.
Veelgestelde vragen
Is een lokaal AI-model minder goed dan ChatGPT? De grootste modellen draaien in de cloud en zijn sterker in complexe redeneertaken. Voor afgebakende taken zoals samenvatten, classificeren en conceptteksten kan een open model voldoen. Test dat met je eigen voorbeelden voordat je kiest.
Wat kost AI lokaal draaien? De software en veel open modellen zijn gratis te downloaden. Je betaalt voor hardware, stroom en beheer. Een proef op een bestaande computer met 16 GB werkgeheugen kost alleen tijd.
Heb ik een videokaart nodig om AI lokaal te draaien? Voor Windows raadt LM Studio een videokaart met minimaal 4 GB eigen geheugen aan (peildatum oktober 2026). Macs met Apple Silicon gebruiken hun gedeelde geheugen. Grotere modellen vragen meer geheugen.
Blijft de AVG gelden als ik AI lokaal draai? Ja. Lokaal draaien neemt de doorgifte van data naar een externe AI-aanbieder weg. Voor alles wat je met persoonsgegevens doet blijven de AVG-regels gelden, zoals een grondslag, beveiliging en bewaartermijnen.
Welke software gebruik je om AI lokaal te draaien? Ollama en LM Studio zijn twee veelgebruikte opties. Ollama start je vanuit de terminal en heeft een REST API voor koppelingen. LM Studio is een desktopprogramma met een chatvenster.
Verder lezen en hulp bij de start
Lees hoe AI op een eigen server werkt, bekijk onze AI agent implementatie op eigen infrastructuur of plan een vrijblijvend gesprek. Wil je doorlopend begeleiding bij het inrichten en bijhouden van je AI-gebruik, kijk dan naar 1-op-1 AI coaching: €399 per maand ex btw, als jaarabonnement met de eerste maand als proefmaand.
