onafhankelijke bron · geen stock, geen bias

AI die past
in je serverkast.

Tools & vergelijkers voor lokale AI 100% onafhankelijk, om de juiste GPU te kiezen en Llama 4, Qwen 3, DeepSeek, Mistral en 240 open-weight modellen lokaal te draaien geen cloud, geen quota, geen verrassingsfactuur.

100% onafhankelijk● geen stock, geen bias◆ gratis tools & vergelijkers
GPUVRAMdraait tot
  • RTX 3060
    12 GB14B
  • RTX 4090
    24 GB32B
  • RTX 5090
    32 GB32B
  • 2× RTX 5090
    64 GB70B
  • 2× A6000 NVLink
    96 GB123B

berekend op Q4_K_M · 242 modellen in de calculator

Modellen
242
+12 deze week
GPU's
204
NVIDIA · AMD · Apple · Intel
Sync
24u
via Hugging Face
Cloud nodig
0
nooit. bewust zo.
Break-even
9mnd
vs GPT-4o-API
02 · cloud vs lokaal

De rekensom past op één pagina.

simulatie 1 agent · 8u/dag · 30d

CloudGPT-4o-class API

Maandelijkse kost
≈ 480 € — tokenfacturatie
Uitgaande data
naar US-servers — Cloud Act risico
§
AVG / AI Act
DPA, register, verwerkerscontrole
~
Eerste-token latency
120 — 800 ms afhankelijk van route
×
Quota / rate limit
RPM, TPM, wachtrij tijdens piekuren
Modellen
≈ 8 in grote API-catalogi
Terugverdiend
nooit · permanente huur

LocalReference STARTER build · 1× 5090

Maandelijkse kost
≈ 32 € — electricity
Uitgaande data
geen. blijft binnen je muren.
AVG / AI Act
Jij host en controleert het systeem.
Eerste-token latency
8 — 40 ms on gigabit LAN
Quota / rate limit
beperkt door je VRAM, niet door een leverancier
Modellen
242 · Llama, Qwen, Mistral, DeepSeek
9
Terugverdiend
9 maanden op STARTER-niveau
verdict computed by /lib/calc.ts · build #2178netto besparing · 5 376 € / jaar / agent · break-even maand 9
03 · referentiebuilds

Drie chassis. Eén duidelijke keuze.

Bekijk builds →
// 01 · Solo dev
Starter
  • G1× RTX 509032 GB GDDR7 · 575 W
  • R32 GB DDR5-6000Corsair Vengeance · CL36
  • CRyzen 7 7700X8c · Zen 4
  • S1 TB NVMeSamsung 990 Pro · Gen 4
  • 180 / 242 models~110 t/s · Llama 8B Q4
Bekijk details →
popular
// 02 · Agency · Small team
Pro
  • G2× RTX 509064 GB total VRAM
  • R64 GB ECC DDR5UDIMM · 4800 MT/s
  • CRyzen 9 9950X16c · 5.7 GHz boost
  • S2 TB NVMe Gen 4Samsung 990 Pro
  • 215 / 242 models~38 t/s · Llama 70B Q4
Bekijk details →
// 03 · SME · Mid-market
Enterprise
  • G2× RTX A6000NVLink · 96 GB · 112 GB/s
  • R256 GB RDIMM ECC8 channels · Corsair WS
  • CTR Pro 7975WX32c Pro · 8-channel RAM
  • S8 TB NVMe Gen 5RAID-10 · hot-swap
  • Architecture RAG souveraineSSO · RBAC · journal d'audit (à monter)
Schrijf ons voor advies →
04 · onafhankelijkheid

Feiten, geen marketing.
Vergelijk. Beslis.

Soevereiniteit

AVG- en AI-Act-vriendelijk. Je data blijft in je ruimte, meetbaar en auditeerbaar.

Begrensde kosten

Investering, geen huur. Terugverdiend in 9 maanden bij typisch agentic gebruik. Geen TPM-plafond.

Open stack

llama.cpp · vLLM · Ollama · Open WebUI · LlamaIndex · Qdrant. Geen lock-in.

Transparante rekensom

VRAM-inschattingen voordat je koopt. Echte tokens/s volgen zodra de showroom-rig gebenchmarkt is.