# gids.llmnet.nl > Lokale LLM-gids — Nederlandstalige artikelen over AI en LLM's. Onderdeel van het llmnet.nl-netwerk: 10 Nederlandstalige AI-specialisaties (met /en/ Engelse versie). ## Belangrijkste artikelen (NL) - [AI-antwoorden fact-checken: hoe controleer je of het klopt?](https://gids.llmnet.nl/ai-antwoorden-factchecken.md): Ontdek hoe je de output van ta modellen betrouwbaar controleert. Leer praktische stappen om hallucinaties te ontdekken en feiten te verifiëren. - [AI Veilig Gebruiken Thuis: Praktische Tips voor Gezinnen](https://gids.llmnet.nl/ai-veilig-thuis.md): Ontdek hoe je als gezin slim en veilig omgaat met kunstmatige intelligentie. Praktische tips over privacy, afspraken met kinderen en betrouwbare antwoorden. - [Als het niet werkt: out-of-memory, trage tokens en een GPU die niet meedoet](https://gids.llmnet.nl/als-het-niet-werkt-out-of-memory-trage-tokens-en-een-gpu-die-niet-meed.md): Foutzoek-artikel voor lokale LLM-opstellingen: out-of-memory, trage tokens en een GPU die niet meedoet, met diagnose-stappenplan en oplossingen per platform. - [AnythingLLM als desktop-werkplek inrichten](https://gids.llmnet.nl/anythingllm-opzetten-als-complete-desktop-werkplek.md): Complete handleiding voor AnythingLLM als desktop-werkplek. Koppel lokale modellen, beheer vectoropslag en doorzoek documenten 100% privé. - [AVG-proof met AI: privacy-checklist voor Nederlandse](https://gids.llmnet.nl/avg-privacy-checklist.md): Ontdek hoe u AI veilig en AVG-proof inzet in uw organisatie met deze praktische privacy-checklist. Inclusief DPIA, lokale modellen en dataminimalisatie. - [Backup-strategie voor lokale LLM's & data](https://gids.llmnet.nl/backup-strategie-voor-lokale-modellen.md): Een praktische 3-2-1 backup-strategie voor lokaal gedraaide taalmodellen, vectordatabases, prompts en configuraties. Voorkom dataverlies. - [Je AI beter laten presteren in het Nederlands](https://gids.llmnet.nl/beter-nederlands.md): Ontdek hoe je Large Language Models beter laat presteren in het Nederlands. Leer over effectieve systeemprompts, toon, register en het vermijden van… - [Contextlengte Instellen bij Lokale LLM's | Gids llmnet.nl](https://gids.llmnet.nl/context-window-optimaliseren-lokaal.md): Ontdek hoe je de contextlengte optimaal instelt bij het lokaal draaien van LLM's, voorkom geheugenproblemen en balanceer GPU- en RAM-geheugen. - [AI-taken slim uitbesteden via een proxy en routering](https://gids.llmnet.nl/deepseek-harness-kimi-claude-uitbesteding.md): Leer hoe je als indie developer programmeertaken delegeert aan gespecialiseerde modellen via een OpenAI-proxy, inclusief logging en kostenbeheersing per taak. - [Je Eigen Documenten Doorzoeken met Lokale AI (Privé RAG)](https://gids.llmnet.nl/documenten-doorzoeken-lokaal.md): Ontdek hoe je privé en lokaal je eigen documenten en notities kunt doorzoeken met AI. Leer alles over RAG, tools, hardware en privacy zonder cloud. - [ExLlamaV2 configureren voor maximale EXL2-snelheid](https://gids.llmnet.nl/exllamav2-configureren-voor-maximale-exl2-snelheid.md): Optimaliseer ExLlamaV2 en EXL2-kwantisatie voor maximale token-snelheid op Nvidia GPU's met FlashAttention-2, cache-tuning en speculatieve sampling. - [Persoonsgegevens automatisch anonimiseren met AI](https://gids.llmnet.nl/gevoelige-persoonsgegevens-automatisch-anonimiseren-met-ai.md): Automatisch persoonsgegevens anonimiseren en pseudonimiseren met lokale AI, Microsoft Presidio, NER en LLM's conform de AVG. - [Welke hardware heb je nodig om LLM's lokaal te draaien?](https://gids.llmnet.nl/hardware-voor-lokale-llm.md): Ontdek welke hardware je exact nodig hebt voor lokale LLM's. Leer over RAM, VRAM, GPU versus CPU en kwantisatie. Praktische gids voor lokale AI-bouwers. - [Jan AI op Windows installeren en configureren](https://gids.llmnet.nl/jan-ai-installeren-en-lokaal-configureren-op-windows.md): Handleiding voor Jan AI op Windows: installeer de desktop-app, configureer Vulkan of CUDA GPU-offloading en beheer lokale open-source modellen. - [Kobold.cpp installeren voor lokale GGUF-inferentie](https://gids.llmnet.nl/kobold-cpp-installeren-voor-lokale-gguf-inferentie.md): Handleiding voor Kobold.cpp: installeer de zelfstandige GGUF-engine, configureer GPU-offloading en draai lokale taalmodellen met context-optimalisatie. - [KV-cache kwantisatie in llama.cpp en vLLM](https://gids.llmnet.nl/kv-cache-kwantisatie-instellen-in-llama-cpp-en-vllm.md): Bespaar VRAM en vergroot je contextlengte door KV-cache te kwantiseren naar FP8 of INT4 in llama.cpp en vLLM met concrete runtime-parameters en instructies. - [Kwantisatie uitgelegd: grote modellen op kleine hardware](https://gids.llmnet.nl/kwantisatie-uitgelegd.md): Ontdek wat LLM kwantisatie is, hoe GGUF werkt, en hoe je de ideale balans vindt tussen modelkwaliteit en geheugengebruik op bescheiden hardware. - [Llama.cpp compileren met CUDA: maximale prestaties](https://gids.llmnet.nl/llama-cpp-compileren-met-cuda-voor-maximale-prestaties.md): Leer stap voor stap llama.cpp compileren met Nvidia CUDA ondersteuning voor maximale tokendoorvoer en minimale latency op een Linux-systeem. - [GPU Passthrough Configureren in Proxmox voor LLM's](https://gids.llmnet.nl/llm-gpu-passthrough-proxmox.md): Leer hoe je GPU passthrough configureert in Proxmox VE voor lokale LLM's. Volledige stappenplan voor IOMMU, VFIO en PCIe toewijzing. - [Een lokaal taalmodel (LLM) in Docker draaien](https://gids.llmnet.nl/llm-in-docker-draaien.md): Leer waarom en hoe je een lokaal AI-taalmodel in Docker draait. Inclusief uitleg over GPU-versnelling, volumes, netwerken en prestatieverschillen per OS. - [Een LLM lokaal draaien op je eigen machine | LLM Gids](https://gids.llmnet.nl/llm-lokaal-draaien.md): Leer hoe je eenvoudig een Large Language Model (LLM) lokaal draait. Ontdek de hardware-eisen, privacyvoordelen en tools zoals Ollama en LM Studio. - [LLM draaien op oudere hardware: optimalisatiegids](https://gids.llmnet.nl/llm-op-oude-hardware-optimaliseren.md): Ontdek hoe u bruikbare prestaties haalt uit een lokaal taalmodel op oudere hardware. Praktische gids voor RAM-beheer, kwantisatie en instellingen. - [Een LLM draaien op een Synology NAS](https://gids.llmnet.nl/llm-op-synology-nas.md): Kun je een Large Language Model lokaal draaien op een Synology NAS? Ontdek de mogelijkheden, RAM-eisen en beperkingen van CPU-inference via Docker. - [LM Studio Headless als Server Inzetten | Gids llmnet.nl](https://gids.llmnet.nl/lm-studio-headless-server.md): Lees hoe je LM Studio zónder grafische interface gebruikt als OpenAI-compatibele API-server op macOS en Linux. Met achtergronddiensten en CLI-beheer. - [Een Lokaal Model Kiezen: Welke Variant Past Bij Jouw Doel?](https://gids.llmnet.nl/lokaal-model-kiezen.md): Ontdek hoe je het juiste lokale AI-model kiest voor jouw doel, zoals coderen of chatten. Leer alles over modelgrootte, snelheid en Nederlandse ondersteuning. - [Lokaal of via een API? De rekensom over drie jaar](https://gids.llmnet.nl/lokaal-of-via-een-api-de-rekensom-over-drie-jaar.md): Lokaal of via een API? Een kostenrekensom over drie jaar: afschrijving, stroom en beheer tegenover prijs per miljoen tokens. Gecontroleerd op 2026-08-07. - [Lokaal RAG draaien: van embedding tot antwoord](https://gids.llmnet.nl/lokaal-rag-draaien-van-embedding-tot-antwoord.md): Bouw een complete lokale RAG-pijplijn zonder cloud. Van tekstparsing en embeddingmodellen tot vectoropslag, reranking en contextuele synthese. - [Lokale Beeldgeneratie: Zelf AI-afbeeldingen maken op je](https://gids.llmnet.nl/lokale-beeldgeneratie.md): Een complete gids voor het lokaal genereren van beelden met AI. Leer alles over de hardwarevereisten, modellen, softwaretools en prompt-instellingen. - [Continue.dev Instellen met Lokale Modellen in VS Code](https://gids.llmnet.nl/lokale-code-assistent-continue-dev.md): Leer hoe je Continue.dev instelt in VS Code met lokale open-weight taalmodellen via Ollama voor maximale privacy en gratis code-generatie. - [Lokale Function Calling met Ollama en Python Bouwen](https://gids.llmnet.nl/lokale-function-calling-bouwen-met-ollama-en-python.md): Bouw betrouwbare lokale function calling met Ollama en Python. Leer schema-validatie, Pydantic-modellen, foutafhandeling en tool calling pipelines. - [Energieverbruik van je lokale LLM-opstelling meten](https://gids.llmnet.nl/lokale-llm-energieverbruik-meten.md): Leer stap voor stap hoe je het exacte energieverbruik van je lokale LLM-opstelling meet op hardwareniveau, via de CLI en met slimme stekkers. - [Lokaal finetunen met LoRA: praktische gids | LLMnet](https://gids.llmnet.nl/lokale-llm-fine-tuning-lora.md): Praktische gids voor het lokaal finetunen van LLM's met LoRA. Leer alles over datapreparatie, hyperparameterinstellingen en het evalueren van adapters. - [Een lokale LLM koppelen aan VS Code als codeassistent](https://gids.llmnet.nl/lokale-llm-in-vscode.md): Leer hoe je een lokaal AI-model koppelt aan VS Code. Ontdek de beste extensies, instellingen voor Apple Silicon, en tips voor privacyvriendelijk coderen. - [Lokale LLM-servers veilig in je netwerk | Gids](https://gids.llmnet.nl/lokale-llm-netwerk-beveiliging.md): Lees hoe je lokale LLM-servers veilig binnen je netwerk configureert. Voorkom onbevoegde toegang, koppel een omgekeerde proxy en regel netwerkscheiding. - [Lokale LLM's draaien op Linux: De ultieme gids voor Ollama](https://gids.llmnet.nl/lokale-llm-op-linux.md): Leer hoe je een lokale LLM draait op Linux. Stap-voor-stap handleiding voor Ollama, llama.cpp, GPU-drivers (NVIDIA/AMD) en headless server configuraties. - [Lokale LLM's draaien op Windows met LM Studio en Ollama](https://gids.llmnet.nl/lokale-llm-op-windows.md): Leer stap-voor-stap hoe je lokale LLM's zoals Llama 3 en Mistral op Windows installeert met LM Studio of Ollama. Inclusief tips voor CPU en GPU optimalisatie. - [Lokale LLM's op Apple Silicon: unified memory, MLX en Ollama vergeleken](https://gids.llmnet.nl/lokale-llm-s-op-apple-silicon-unified-memory-mlx-en-ollama-vergeleken.md): Hoe unified memory de VRAM-redenering voor lokale LLM op Apple Silicon verandert: Ollama, MLX en LM Studio vergeleken voor installatie en modelkeuze. - [Lokale LLM's op Windows/WSL: installatie en verschillen](https://gids.llmnet.nl/lokale-llm-s-op-windows-wsl-installatie-en-verschillen.md): Ontdek of je lokale LLM's beter draait op native Windows of via WSL2. Vergelijk prestaties, installatiestappen en hardware-integratie. - [Lokale LLM op afstand veilig benaderen via Tailscale | LLMNet Gids](https://gids.llmnet.nl/lokale-llm-via-tailscale-op-afstand.md): Lokaliseer je AI-modellen thuis of op kantoor en benader ze veilig vanaf elke plek ter wereld via Tailscale VPN. Stap-voor-stap handleiding voor Ollama en LM Studio. - [Lokale modellen in Docker: containers zonder gedoe](https://gids.llmnet.nl/lokale-modellen-in-docker-containers-zonder-gedoe.md): Draai lokale AI-modellen geïsoleerd in Docker met GPU-doorvoer via NVIDIA Container Toolkit. Complete gids met compose-bestanden en optimalisaties. - [Een lokaal model koppelen aan je eigen documenten (RAG) op](https://gids.llmnet.nl/lokale-rag-mac.md): Leer hoe je lokaal op je Mac een taalmodel (LLM) koppelt aan je eigen documenten via RAG. Veilig, met tools zoals Ollama en vector-databases, voor 100%… - [Lokale re-ranking toevoegen aan je RAG-zoekpipeline](https://gids.llmnet.nl/lokale-re-ranking-toevoegen-aan-je-rag-zoekpipeline.md): Verbeter de precisie van je lokale RAG-pipeline met cross-encoders en lokale re-ranking via FlashRank en ONNX zonder data naar de cloud te sturen. - [Lokale vectordatabase opzetten: Qdrant en Chroma](https://gids.llmnet.nl/lokale-vector-database-opzetten.md): Praktische gids voor het lokaal opzetten en configureren van Chroma en Qdrant. Leer over databases versus bestanden, docker-opstellingen en metadata. - [Lokale Vision-Modellen Draaien voor Beeldanalyse](https://gids.llmnet.nl/lokale-vision-modellen-draaien-voor-beeldanalyse.md): Complete handleiding voor het lokaal draaien van vision-modellen via Ollama en vLLM voor OCR, diagramanalyse en privacyvriendelijke beeldverwerking. - [Model-updates lokaal bijhouden: versiebeheer van LLM's](https://gids.llmnet.nl/model-updates-lokaal-bijhouden-van-welke-versie-draai-je.md): Leer hoe je lokale modelversies, GGUF-hashes en Ollama-tags beheert, update-regressie voorkomt en geautomatiseerd terugrolt op je eigen hardware. - [Lokale modellen downloaden en beheren: De complete gids](https://gids.llmnet.nl/modellen-downloaden-en-beheren.md): Leer hoe je lokale LLM-modellen veilig downloadt, GGUF- en kwantisatieformaten kiest, en je opslagruimte efficiënt beheert zonder chaos. - [Modellen eerlijk vergelijken op je eigen hardware](https://gids.llmnet.nl/modellen-vergelijken-op-eigen-hardware.md): Stappenplan om LLM's objectief te testen op je eigen hardware: variabelen vastzetten, snelheid en kwaliteit meten en foute vergelijkingen voorkomen. - [Nederlandse en Europese open modellen lokaal draaien](https://gids.llmnet.nl/nederlandse-en-europese-open-modellen-lokaal-draaien.md): Nederlandse en Europese open modellen lokaal draaien: wat bestaat er, hoe test je of een model echt goed Nederlands spreekt. Gecontroleerd op 2026-08-07. - [Nginx reverse proxy met authenticatie voor je LLM](https://gids.llmnet.nl/nginx-reverse-proxy-met-authenticatie-voor-je-lokale-llm.md): Beveilig je lokale LLM-server met Nginx, Bearer API-sleutels, TLS-encryptie, streamingondersteuning en rate limiting tegen overbelasting. - [Ollama installeren en je eerste lokale model draaien op](https://gids.llmnet.nl/ollama-macos-installeren.md): Ontdek stap voor stap hoe je Ollama installeert en lokale taalmodellen draait op macOS. Inclusief hardware-eisen, terminal-commando's en handige tips. - [Ollama Modelfile aanpassen: systeemprompt en parameters](https://gids.llmnet.nl/ollama-model-file-aanpassen.md): Leer hoe je met een Ollama Modelfile de systeemprompt en parameters instelt. Uitgebreide gids met voorbeelden, parameteruitleg en beheer. - [Open WebUI opzetten: een prettige chat-interface voor je](https://gids.llmnet.nl/open-webui-opzetten.md): Ontdek hoe je Open WebUI opzet als gebruiksvriendelijke chat-interface voor je lokale LLM's via Ollama. Praktische gids voor installatie en configuratie. - [Power limits en fancurves voor GPU-servers](https://gids.llmnet.nl/power-limits-en-fancurves-instellen-voor-gpu-servers.md): Praktische handleiding voor power limits, persistentie en fancurves op Linux GPU-servers voor energiezuinige, stille en thermisch stabiele AI-inferentie. - [Privacyvriendelijk AI gebruiken in het dagelijks werk](https://gids.llmnet.nl/privacyvriendelijk-ai.md): Praktische gids voor veilig AI-gebruik op werk. Ontdek welke data u beter lokaal houdt, essentiële privacy-instellingen en gratis privacy-bewuste tools. - [Quantisatie in de praktijk: zelf comprimeren](https://gids.llmnet.nl/quantisatie-in-de-praktijk-zelf-een-model-comprimeren.md): Leer stap voor stap hoe je zelf open-source taalmodellen converteert naar GGUF en kwantiseert met llama.cpp voor optimale lokale prestaties. - [Speculative decoding instellen voor snellere LLM-tokens](https://gids.llmnet.nl/speculative-decoding-instellen-voor-snellere-llm-tokens.md): Praktische handleiding voor het configureren van speculative decoding in llama.cpp, vLLM en Ollama met draft-modellen voor maximale token-doorvoer. - [Spraak lokaal omzetten naar tekst](https://gids.llmnet.nl/spraak-naar-tekst-lokaal.md): Leer hoe je spraak lokaal en privacyvriendelijk omzet naar tekst op je eigen Mac. Ontdek de beste modellen, hardware-eisen en diarization-technieken. - [Wat kost het stroomverbruik van lokale AI? (GPU/CPU Rekensom](https://gids.llmnet.nl/stroomverbruik-lokale-ai.md): Bereken exact wat het stroomverbruik van lokale AI-modellen kost. Praktische formules voor GPU/CPU inferentie, sluimerverbruik en een cloud-vergelijking. - [Gevormde JSON Outputs Afdwingen bij Lokale LLM's](https://gids.llmnet.nl/structured-outputs-lokale-llm.md): Dwing geldige JSON af bij lokale LLM's: JSON-schema's in Ollama, LM Studio en vLLM, GBNF-grammatica's in llama.cpp, plus schema-ontwerp en foutafhandeling. - [Tabby als lokale code-assistent met Docker installeren](https://gids.llmnet.nl/tabby-als-lokale-code-assistent-installeren-met-docker.md): Leer stap voor stap hoe je Tabby als zelf-gehoste AI-code-assistent installeert met Docker en GPU-ondersteuning voor VS Code en JetBrains. - [Text Generation WebUI installeren op Linux](https://gids.llmnet.nl/text-generation-webui-installeren-op-een-linux-server.md): Installeer Text Generation WebUI (oobabooga) op een Linux-server. Praktische handleiding met CUDA, loaders, CLI-vlaggen en netwerkconfiguratie. - [Twee GPU's combineren voor lokale taalmodellen](https://gids.llmnet.nl/twee-gpu-s-combineren-voor-grotere-lokale-taalmodellen.md): Praktische gids voor dual-GPU setups: tensor en pipeline parallelism, PCIe-bandbreedte, VRAM poolen en configuratie in llama.cpp en vLLM. - [vLLM configureren voor hoge doorvoer op Linux](https://gids.llmnet.nl/vllm-server-configureren.md): Lees hoe je vLLM op Linux instelt voor optimale doorvoer bij meerdere gelijktijdige verzoeken. Een gids over geheugenbeheer, batching en beveiliging. - [VRAM-rekenhulp: hoeveel geheugen heeft een model nodig?](https://gids.llmnet.nl/vram-rekenhulp-hoeveel-geheugen-heeft-welk-model-nodig.md): Bereken exact hoeveel VRAM een lokaal LLM vereist. Formules voor modelparameters, kwantisatie, contextlengte, KV-cache en CUDA-overhead. - [Embeddingmodel voor Nederlandse Documenten Kiezen](https://gids.llmnet.nl/welk-embeddingmodel-kies-je-voor-nederlandse-documenten.md): Ontdek welk embeddingmodel het beste presteert voor Nederlandstalige documenten in een lokale RAG-opstelling. Met benchmarks, geheugeneisen en praktijktips.