Aan de slag
Een model kiezen
Welk model in je videokaart past, en het ene getal dat dat bepaalt.
Draggy vraagt Ollama wat elk geïnstalleerd model kan, in plaats van het aan de naam af te leiden. Cloudmodellen zijn verborgen; embeddingmodellen staan in de lijst maar antwoorden niet.
Windows en Linux
Eerst gekozen op het geheugen van de videokaart. Een machine met weinig of geen krijgt toch een model ter grootte van wat zijn werkgeheugen aankan, in plaats van het kleinste dat er is.
| VRAM | Model |
|---|---|
| minder dan 4 GB | Qwen 3.5 0.8B |
| 4 GB | Qwen 3.5 2B |
| 5 GB | Gemma 4 E4B |
| 6 GB | Mistral 7B |
| 8 GB | Qwen 3.5 9B |
| 10 GB | Gemma 4 12B |
| 12 GB | Phi-4 14B |
| 16 GB | GPT-OSS 20B MoE |
| 20 GB | Qwen 3.5 27B MoE |
| 22 GB | GLM 4.7 Flash MoE |
| 24 GB | Gemma 4 31B |
| 32 GB | Qwen 3.5 35B MoE |
| 96 GB | Qwen 3.5 122B MoE |
Elk model dat het kan noemen, met parameters, beste gebruik en wat het ondersteunt, staat in de volledige modeltabel.
Apple Silicon
Ollama 0.19+ draait modellen via MLX, dus Draggy kiest de
-mlx-versie. Op een Mac is er geen apart videogeheugen, dus de
maten hieronder zijn het hele, ongekorte getal waarmee de Mac verkocht werd.
Een basis- of Pro-chip krijgt het model in de linkerkolom; een Max of Ultra,
met veel meer geheugenbandbreedte, krijgt dat ernaast.
| Gedeeld geheugen | Basis of Pro | Max of Ultra |
|---|---|---|
| 8 GB | Qwen 3.5 2B (MLX) | Qwen 3.5 4B (MLX) |
| 16 GB | Qwen 3.5 4B (MLX) | Qwen 3.5 9B (MLX) |
| 24 GB | Qwen 3.5 9B (MLX) | Qwen 3.5 27B MoE (MLX) |
| 32 GB | Qwen 3.5 27B MoE (MLX) | Gemma 4 31B (MLX) |
| 48 GB | Gemma 4 31B (MLX) | Qwen 3.5 35B MoE (MLX) |
| 64 GB | Qwen 3.5 35B MoE (MLX) | GLM 4.7 Flash (MLX) |
| 96 GB | GLM 4.7 Flash (MLX) | Qwen 3.5 122B MoE (MLX) |
| 128 GB en meer | Qwen 3.5 122B MoE (MLX) | Qwen 3.5 122B MoE (MLX) |
Elke Mac die zijn eigen modellen kan draaien, sinds de eerste in 2020:
| Mac | Jaren | Chip | Gedeeld geheugen |
|---|---|---|---|
| MacBook Air | 2020–2025 | M1, M2, M3, M4 | 8–32 GB |
| MacBook Pro 13" | 2020 | M1 | 8–16 GB |
| MacBook Pro 14"/16" | 2021–2025 | M1 tot M4, Pro of Max | 16–128 GB |
| Mac mini | 2020–2024 | M1, M2 of M2 Pro, M4 of M4 Pro | 8–64 GB |
| iMac | 2021–2025 | M1, M3, M4 | 8–24 GB |
| Mac Studio | 2022–2025 | M1/M2 Max of Ultra, M3 Ultra, M4 Max | 32–512 GB |
| Mac Pro | 2023 | M2 Ultra | 64–192 GB |
Een Mac van 2019 of eerder is een Intel: die heeft in plaats daarvan een echte, aparte videokaart en leest de Windows-en-Linux-tabel hierboven.
Dezelfde tabel, ter grootte van het gedeelde geheugen in plaats van VRAM, is de volledige modeltabel voor Mac.
Het getal dat telt
Instellingen → Modellen laat zien hoeveel van elk model in het
videogeheugen past. Op 100 % GPU antwoordt het op leessnelheid. Op 60 % werkt
het, meerdere keren trager. Daaronder ga je een maat kleiner.
Een geladen model krijgt daar een knop Model ontladen, die het videogeheugen vrijmaakt zonder iets te verwijderen.
Het spraakmodel
De spraakmodus gebruikt een eigen, kleiner model,
ingesteld in Instellingen → Chat → Praten. Snel antwoorden telt
hier meer dan goed antwoorden, dus houd het klein.