Capaciteitsplanner · Desktop & AI

Hoeveel RAM heeft Ollama / lokale LLM nodig?

Ollama / lokale LLM heeft in een homelab ongeveer 12 GB RAM nodig. In een LXC-container komt dat neer op 12 GB, als volledige VM op 12,5 GB inclusief kernel-overhead. Reken op 4 vCPU.

Werkende set12 GB
Als LXC12 GB
Als VM12,5 GB
vCPU4
Schijf60 GB

Waarom dit getal

Zonder GPU laadt het model volledig in je systeemgeheugen: reken ruwweg de bestandsgrootte van het model plus een paar GB. Met een GPU is je VRAM de bepalende factor en blijft het systeemgeheugen bescheiden.

Alleen zo hoog zonder GPU; mét GPU is VRAM de echte limiet

LXC of VM?

Een VM is hier de rustigere keuze. Ollama / lokale LLM kán in een container, maar in de praktijk levert dat problemen op. Reken op 12,5 GB inclusief overhead.

Waar je op moet letten

  • Een 7B-model in 4-bit kwantisatie past in ongeveer 5 GB; een 70B-model niet in een homelab zonder serieuze GPU.
  • Zonder GPU is het antwoordtempo zo laag dat het zelden praktisch is.
  • Dit is de dienst waar een homelab het snelst tekortkomt tegenover een API.

Hoeveel passen er?

na host en 12% marge
Aantal exemplaren van Ollama / lokale LLM per servergrootte
ServerAantal Ollama / lokale LLMBeschikbaar
8 GB5,28 GB
16 GB12,32 GB
32 GB26,4 GB
64 GB54,56 GB
Reken door met je eigen hardware en de rest van je configuratie erbij. Open de planner

Ook in Desktop & AI