onafhankelijke bron · geen stock, geen bias

AI die past
in je serverkast.

Tools & vergelijkers voor lokale AI 100% onafhankelijk, om de juiste GPU te kiezen en Llama 4, Qwen 3, DeepSeek, Mistral en 240 open-weight modellen lokaal te draaien — geen cloud, geen quota, geen verrassingsfactuur.

100% onafhankelijk● geen stock, geen bias◆ gratis tools & vergelijkers
GPUVRAMdraait tot
  • RTX 3060
    12 GB14B
  • RTX 4090
    24 GB32B
  • RTX 5090
    32 GB32B
  • 2× RTX 5090
    64 GB70B
  • 2× A6000 NVLink
    96 GB123B

berekend op Q4_K_M · 242 modellen in de calculator

Modellen
242
+12 deze week
GPU's
204
NVIDIA · AMD · Apple · Intel
Sync
24u
via Hugging Face
Cloud nodig
0
nooit. bewust zo.
Break-even
9mnd
vs GPT-4o-API
02 · cloud vs lokaal

De rekensom past op één pagina.

simulatie 1 agent · 8u/dag · 30d

CloudGPT-4o-class API

€
Maandelijkse kost
≈ 480 € — tokenfacturatie
↗
Uitgaande data
naar US-servers — Cloud Act risico
§
AVG / AI Act
DPA, register, verwerkerscontrole
~
Eerste-token latency
120 — 800 ms afhankelijk van route
×
Quota / rate limit
RPM, TPM, wachtrij tijdens piekuren
∅
Modellen
≈ 8 in grote API-catalogi
∞
Terugverdiend
nooit · permanente huur

LocalReference STARTER build · 1× 5090

€
Maandelijkse kost
≈ 32 € — electricity
↘
Uitgaande data
geen. blijft binnen je muren.
✓
AVG / AI Act
Jij host en controleert het systeem.
⚡
Eerste-token latency
8 — 40 ms on gigabit LAN
∞
Quota / rate limit
beperkt door je VRAM, niet door een leverancier
★
Modellen
242 · Llama, Qwen, Mistral, DeepSeek
9
Terugverdiend
9 maanden op STARTER-niveau
verdict computed by /lib/calc.ts · build #2178netto besparing · 5 376 € / jaar / agent · break-even maand 9
03 · referentiebuilds

Drie chassis. Eén duidelijke keuze.

Bekijk builds →
// 01 · Solo dev
Starter
  • G1× RTX 509032 GB GDDR7 · 575 W
  • R32 GB DDR5-6000Corsair Vengeance · CL36
  • CRyzen 7 7700X8c · Zen 4
  • S1 TB NVMeSamsung 990 Pro · Gen 4
  • ★180 / 242 models~110 t/s · Llama 8B Q4
Bekijk details →
popular
// 02 · Agency · Small team
Pro
  • G2× RTX 509064 GB total VRAM
  • R64 GB ECC DDR5UDIMM · 4800 MT/s
  • CRyzen 9 9950X16c · 5.7 GHz boost
  • S2 TB NVMe Gen 4Samsung 990 Pro
  • ★215 / 242 models~38 t/s · Llama 70B Q4
Bekijk details →
// 03 · SME · Mid-market
Enterprise
  • G2× RTX A6000NVLink · 96 GB · 112 GB/s
  • R256 GB RDIMM ECC8 channels · Corsair WS
  • CTR Pro 7975WX32c Pro · 8-channel RAM
  • S8 TB NVMe Gen 5RAID-10 · hot-swap
  • ★Architecture RAG souveraineSSO · RBAC · journal d'audit (à monter)
Schrijf ons voor advies →
04 · onafhankelijkheid

Feiten, geen marketing.
Vergelijk. Beslis.

▲

Soevereiniteit

AVG- en AI-Act-vriendelijk. Je data blijft in je ruimte, meetbaar en auditeerbaar.

◆

Begrensde kosten

Investering, geen huur. Terugverdiend in 9 maanden bij typisch agentic gebruik. Geen TPM-plafond.

●

Open stack

llama.cpp · vLLM · Ollama · Open WebUI · LlamaIndex · Qdrant. Geen lock-in.

■

Transparante rekensom

VRAM-inschattingen voordat je koopt. Echte tokens/s volgen zodra de showroom-rig gebenchmarkt is.