Ollama installeren: een AI-model lokaal draaien op je eigen computer
Wil je een AI-taalmodel gebruiken zonder dat je tekst naar een cloudserver van een groot bedrijf gaat? Met Ollama draai je een model gratis op je eigen machine — Mac, Windows of Linux. Hieronder loop je de installatie af en praat je binnen tien minuten met je eerste model, zonder programmeerkennis.
💡 Beginner-tip: Een “lokaal model” betekent dat de AI volledig op jouw computer draait. Geen account, geen abonnement, geen data die het internet op gaat. De prijs die je betaalt is schijfruimte en wat rekenkracht van je eigen machine.
Wat Ollama is en voor wie
Ollama is een gratis, open source programma dat grote taalmodellen (LLM’s) lokaal draait. Het is bedoeld voor iedereen die AI wil gebruiken zonder cloud: ontwikkelaars die offline willen bouwen, professionals die met gevoelige documenten werken, of nieuwsgierige gebruikers die geen maandbedrag willen betalen. De enige echte voorwaarde is voldoende werkgeheugen — daarover zo meer.
De stappen: installeren en je eerste model
- Installeer Ollama voor jouw systeem. Op de Mac gaat dat met Homebrew:
brew install ollama(of download de app via ollama.com/download). Op Linux draai je één script:curl -fsSL https://ollama.com/install.sh | sh. Op Windows download je de officiële installer van ollama.com en klik je hem door. Je herkent een geslaagde installatie doordat hetollama-commando in je terminal reageert. - Controleer dat Ollama draait. Typ
ollama listin je terminal. Een lege lijst is prima — het betekent dat Ollama werkt maar nog geen modellen heeft. Start eventueel de achtergronddienst metollama serve. - Haal je eerste model op en start een gesprek. Draai
ollama run llama3.2. Ollama downloadt het model (dit is de enige stap die even duurt — reken op een paar minuten, afhankelijk van je internet) en zet je daarna direct in een chat. Typ een vraag en je krijgt lokaal antwoord. Stoppen doe je met/bye.
⚡ Gevorderden: Zodra Ollama draait, staat er een lokale API klaar op
http://localhost:11434. Daarmee koppel je je eigen scripts, een chat-frontend of een editor aan je lokale model — dezelfde aanpak die veel zelfbouw-AI-projecten gebruiken in plaats van een betaalde cloud-API.
Kies een model dat bij je hardware past
De grootste beginnersfout is meteen het zwaarste model pakken. Je RAM is de bottleneck:
| Werkgeheugen | Verstandige start |
|---|---|
| 8 GB | Klein 3B-model, bv. llama3.2 |
| 16 GB | 7- tot 8B-model, bv. qwen3 |
| 32 GB+ | Grotere modellen, ruimte voor meerdere naast elkaar |
Een aparte GPU versnelt alles fors. Op de Mac benut Ollama de Apple-chip automatisch; op een NVIDIA-kaart heb je driver 525 of nieuwer nodig. Welke modellen er zijn, en hoe zwaar ze wegen, vind je in de modellenbibliotheek op ollama.com.
Let op je schijfruimte
Modellen zijn geen kleine bestanden — een enkel model kost al snel enkele gigabytes, en voor je het weet staan er vijf. Houd overzicht met ollama list en ruim op met ollama rm <modelnaam>. Wil je dieper de wereld van vrij te draaien modellen in, lees dan onze uitleg over open-weight modellen lokaal draaien en hoe je modellen veilig downloadt. Voor de bredere context waaróm lokale, open modellen er juist nu toe doen, is er duiding in het AI-nieuws op hetlaatsteainieuws.nl.
Checklist: draait je lokale model?
- Ollama geïnstalleerd en het
ollama-commando reageert -
ollama listgeeft output (leeg of met modellen) - Een eerste model opgehaald met
ollama run <model> - Gesprek gestart en lokaal antwoord gekregen
- Model passend bij je RAM gekozen (niet te zwaar)
- Weet hoe je met
ollama rmruimte terugwint
Bronnen
- Ollama — Download — officiële installers en commando’s per besturingssysteem
- Ollama — Model library — overzicht van beschikbare modellen en hun grootte
- Ollama — GitHub — open source project, documentatie en API-referentie
