Een lokale AI-workstation bouwen? Kijk niet alleen naar GPU’s, maar naar lanes, RAM en platformrisico

Waarom lokale AI-builds weer aantrekkelijk zijn
Lokale AI is niet alleen een hobbythema meer. Voor builders, kleine teams en technische ondernemers kan een eigen workstation aantrekkelijk zijn wanneer cloudkosten moeilijk voorspelbaar worden, data niet zomaar naar externe omgevingen mag of experimenten veel iteraties vragen. Een lokale machine geeft controle: je bepaalt wanneer je draait, welke modellen je test en welke data binnen je eigen omgeving blijft.
Maar controle is niet hetzelfde als eenvoud. Een lokale AI-workstation is geen gewone kantoor-pc met een zwaardere videokaart. Zodra je meerdere GPU’s wilt gebruiken, verschuift de complexiteit naar het platform: PCIe-lanes, moederbordindeling, geheugen, voeding, koeling, risers, behuizing en driverstabiliteit. De goedkoopste onderdelencombinatie kan op papier slim lijken en in de praktijk alsnog lastig worden.
Daarom is de belangrijkste vraag niet: welke GPU is het beste? De betere vraag is: welke workload wil je lokaal draaien en welk platform beperkt die workload het minst? Pas daarna kun je bepalen of een budget multi-GPU-build logisch is, of dat een eenvoudiger single-GPU-systeem, gebruikte workstation of cloudhybride aanpak verstandiger is.
De kern van de build: CPU, moederbord en lanes
Bij multi-GPU AI-builds krijgt de CPU vaak te weinig aandacht. Niet omdat de CPU altijd de rekentaak uitvoert, maar omdat het platform bepaalt hoeveel uitbreidingsruimte je hebt. Een workstationplatform met veel PCIe-lanes kan aantrekkelijk zijn als je meerdere GPU’s wilt plaatsen. Zeker wanneer je bestaande DDR4-geheugenmodules kunt hergebruiken, ontstaat er een budgetargument: meer platform voor minder geld.
Een combinatie rond een oudere high-end workstationprocessor en serverachtig moederbord kan daarom interessant lijken. Het idee is simpel: gebruik een platform met veel lanes, plaats meerdere GPU’s, hergebruik betaalbaarder geheugen en bouw zo een lokale inference- of experimenteermachine zonder direct naar de nieuwste professionele hardware te grijpen.
Toch moet je hierbij scherp blijven. Veel lanes betekenen niet automatisch hoge prestaties in elke workload. PCIe-lanes bepalen vooral hoeveel apparaten je kunt aansluiten en met welke bandbreedte ze met het systeem communiceren. Voor sommige AI-taken is dat cruciaal, bijvoorbeeld wanneer veel data tussen GPU’s, opslag en geheugen beweegt. Voor andere taken is VRAM-capaciteit of modeloptimalisatie belangrijker.
Ook moederbordindeling is praktisch belangrijk. Kunnen de kaarten fysiek geplaatst worden? Zijn risers nodig? Is er ruimte tussen de GPU’s? Past het geheel in een behuizing of rackframe? En blijft het onderhoudbaar als een kabel loskomt of een kaart vervangen moet worden? Een lokale AI-machine die alleen werkt met open kast, geïmproviseerde koeling en onduidelijke kabelroutes kan prima zijn voor een homelab, maar minder geschikt voor een klein team dat betrouwbaarheid verwacht.

GPU’s blijven belangrijk, maar platformkeuze bepaalt de grenzen
GPU’s trekken de aandacht omdat VRAM direct bepaalt welke modellen en quantisaties haalbaar zijn. Een 24GB-kaart is voor veel lokale AI-experimenten aantrekkelijker dan een kaart met minder geheugen. Meerdere kaarten met lagere VRAM kunnen voor sommige workflows zinvol zijn, maar lossen niet elk geheugenvraagstuk automatisch op. Niet elke taak verdeelt zich netjes over meerdere GPU’s en niet elke softwarestack maakt multi-GPU-gebruik eenvoudig.
Daarom moet je de GPU-keuze koppelen aan je echte gebruik. Wil je lokaal chatmodellen testen? Draai je batch-inference? Experimenteer je met embeddings, fine-tuning of multimodale pipelines? Wil je vooral leren, of moet de machine dagelijks productieachtig werk doen? Een build die geweldig is als leerplatform kan te fragiel zijn als operationele motor.
Daarnaast komt de randapparatuur snel in beeld. Meerdere GPU’s vragen om serieuze voeding, voldoende PCIe-stroomkabels, koeling, airflow en mechanische ondersteuning. Risers kunnen helpen om kaarten fysiek te plaatsen, maar voegen ook een storingspunt toe. Een rackframe kan handig zijn, maar maakt geluid, stof, veiligheid en plaatsing belangrijker. Wie alleen naar de prijs van CPU en moederbord kijkt, onderschat vaak de totale buildkosten.
Hetzelfde geldt voor stroomverbruik. Een lokale AI-workstation kan aantrekkelijk zijn om cloudkosten te vermijden, maar stroom, warmte, geluidsproductie en onderhoud zijn echte kosten. Zeker in een kantooromgeving zijn die niet alleen technisch, maar ook praktisch: waar staat de machine, wie beheert updates, en wat gebeurt er bij uitval?
De waarschuwing: check geheugenbandbreedte en CPU-generatie
Een veelgemaakte fout bij tweedehands workstationhardware is shoppen op headline-specs. Veel PCIe-lanes, veel geheugenslots en een lage prijs klinken overtuigend. Maar oudere CPU-generaties en specifieke CPU-varianten kunnen beperkingen hebben die pas zichtbaar worden als je dieper kijkt. Theoretische geheugenbandbreedte is bijvoorbeeld niet altijd gelijk aan wat jouw exacte processorvariant in de praktijk haalt.
Controleer daarom vóór aankoop de CPU-variant, het aantal chiplets of interne configuratie, ondersteunde geheugenkanalen, BIOS-ondersteuning en bekende praktijkervaringen met het moederbord. Let ook op firmware, compatibiliteit met moderne GPU’s, beschikbare slots bij dubbele of driedubbele slotkaarten en de vraag of alle lanes bruikbaar zijn in jouw fysieke opstelling.
Dit is het anti-hype punt van lokale AI-hardware: lane-count alleen is geen besliskader. Een platform kan uitstekend zijn voor meerdere betaalbare GPU’s en tegelijk minder logisch voor wie maximale single-node performance, nieuwste I/O, moderne CPU-prestaties of professionele GPU’s inzet. Een goedkope basis is pas goedkoop als de rest van de build niet door compensatiemaatregelen duur wordt.
Ook tweedehandsprijzen bewegen snel. Zodra een onderdeel populair wordt in de AI-community, kan de prijs stijgen of de beschikbaarheid dalen. Behandel elke genoemde deal daarom als momentopname. Bouw je beslissing op criteria, niet op FOMO.

Voor wie is zo’n lokale build logisch?
Een budget multi-GPU-build is vooral logisch voor homelabbers, AI-builders en kleine teams die veel willen testen, bestaande onderdelen hebben of bewust lokale inference willen draaien. Het is ook interessant als je wilt leren hoe modellen zich gedragen op verschillende kaarten, hoe quantisatie uitpakt en hoe je eigen pipelines bouwt zonder elke iteratie in de cloud af te rekenen.
Minder logisch is zo’n build voor teams die maximale betrouwbaarheid verwachten zonder hardwarebeheer, of die vooral één groot model zo snel mogelijk willen bedienen. Ook wanneer je dure professionele GPU’s koopt, wordt een ouder budgetplatform minder vanzelfsprekend. Dan wil je opnieuw kijken naar CPU-generatie, PCIe-versie, support, koeling, beheer en totale levensduur.
Gebruik daarom een aankoopchecklist. Eén: definieer je workload. Twee: bepaal hoeveel VRAM je werkelijk nodig hebt. Drie: kies pas daarna het aantal GPU’s. Vier: controleer PCIe-lanes, fysieke slotruimte en risers. Vijf: verifieer geheugenbandbreedte en CPU-variant. Zes: bereken voeding, koeling, geluid en stroom. Zeven: neem prijsvolatiliteit, retourmogelijkheid en vervangbaarheid mee.
De beste lokale AI-workstation is niet de spectaculairste build. Het is de machine waarvan de beperkingen passen bij je gebruik. Voor Funnel Adviseur geldt hier dezelfde nuchtere lijn als bij automatisering: bouw niet omdat de onderdelen goedkoop lijken, maar omdat het systeem een meetbaar probleem oplost tegen acceptabele totale kosten.



