Aan de slag

Een model kiezen

Welk model in je videokaart past, en het ene getal dat dat bepaalt.

Draggy vraagt Ollama wat elk geïnstalleerd model kan, in plaats van het aan de naam af te leiden. Cloudmodellen zijn verborgen; embeddingmodellen staan in de lijst maar antwoorden niet.

Windows en Linux

Eerst gekozen op het geheugen van de videokaart. Een machine met weinig of geen krijgt toch een model ter grootte van wat zijn werkgeheugen aankan, in plaats van het kleinste dat er is.

VRAMModel
minder dan 4 GBQwen 3.5 0.8B
4 GBQwen 3.5 2B
5 GBGemma 4 E4B
6 GBMistral 7B
8 GBQwen 3.5 9B
10 GBGemma 4 12B
12 GBPhi-4 14B
16 GBGPT-OSS 20B MoE
20 GBQwen 3.5 27B MoE
22 GBGLM 4.7 Flash MoE
24 GBGemma 4 31B
32 GBQwen 3.5 35B MoE
96 GBQwen 3.5 122B MoE

Elk model dat het kan noemen, met parameters, beste gebruik en wat het ondersteunt, staat in de volledige modeltabel.

Apple Silicon

Ollama 0.19+ draait modellen via MLX, dus Draggy kiest de -mlx-versie. Op een Mac is er geen apart videogeheugen, dus de maten hieronder zijn het hele, ongekorte getal waarmee de Mac verkocht werd. Een basis- of Pro-chip krijgt het model in de linkerkolom; een Max of Ultra, met veel meer geheugenbandbreedte, krijgt dat ernaast.

Gedeeld geheugenBasis of ProMax of Ultra
8 GBQwen 3.5 2B (MLX)Qwen 3.5 4B (MLX)
16 GBQwen 3.5 4B (MLX)Qwen 3.5 9B (MLX)
24 GBQwen 3.5 9B (MLX)Qwen 3.5 27B MoE (MLX)
32 GBQwen 3.5 27B MoE (MLX)Gemma 4 31B (MLX)
48 GBGemma 4 31B (MLX)Qwen 3.5 35B MoE (MLX)
64 GBQwen 3.5 35B MoE (MLX)GLM 4.7 Flash (MLX)
96 GBGLM 4.7 Flash (MLX)Qwen 3.5 122B MoE (MLX)
128 GB en meerQwen 3.5 122B MoE (MLX)Qwen 3.5 122B MoE (MLX)

Elke Mac die zijn eigen modellen kan draaien, sinds de eerste in 2020:

MacJarenChipGedeeld geheugen
MacBook Air2020–2025M1, M2, M3, M48–32 GB
MacBook Pro 13"2020M18–16 GB
MacBook Pro 14"/16"2021–2025M1 tot M4, Pro of Max16–128 GB
Mac mini2020–2024M1, M2 of M2 Pro, M4 of M4 Pro8–64 GB
iMac2021–2025M1, M3, M48–24 GB
Mac Studio2022–2025M1/M2 Max of Ultra, M3 Ultra, M4 Max32–512 GB
Mac Pro2023M2 Ultra64–192 GB

Een Mac van 2019 of eerder is een Intel: die heeft in plaats daarvan een echte, aparte videokaart en leest de Windows-en-Linux-tabel hierboven.

Dezelfde tabel, ter grootte van het gedeelde geheugen in plaats van VRAM, is de volledige modeltabel voor Mac.

Het getal dat telt

Instellingen → Modellen laat zien hoeveel van elk model in het videogeheugen past. Op 100 % GPU antwoordt het op leessnelheid. Op 60 % werkt het, meerdere keren trager. Daaronder ga je een maat kleiner.

Een geladen model krijgt daar een knop Model ontladen, die het videogeheugen vrijmaakt zonder iets te verwijderen.

Het spraakmodel

De spraakmodus gebruikt een eigen, kleiner model, ingesteld in Instellingen → Chat → Praten. Snel antwoorden telt hier meer dan goed antwoorden, dus houd het klein.