Per iniziare
Scegliere un modello
Quale modello entra nella tua scheda grafica, e l'unico numero che lo decide.
Draggy chiede a Ollama cosa sa fare ogni modello installato invece di indovinarlo dal nome. I modelli cloud sono nascosti; quelli di embedding sono elencati ma non rispondono.
Windows e Linux
Scelto prima in base alla memoria della scheda grafica. Una macchina con poca o nessuna ottiene comunque un modello grande quanto la sua RAM può reggere, invece del più piccolo che esiste.
| VRAM | Modello |
|---|---|
| meno di 4 GB | Qwen 3.5 0.8B |
| 4 GB | Qwen 3.5 2B |
| 5 GB | Gemma 4 E4B |
| 6 GB | Mistral 7B |
| 8 GB | Qwen 3.5 9B |
| 10 GB | Gemma 4 12B |
| 12 GB | Phi-4 14B |
| 16 GB | GPT-OSS 20B MoE |
| 20 GB | Qwen 3.5 27B MoE |
| 22 GB | GLM 4.7 Flash MoE |
| 24 GB | Gemma 4 31B |
| 32 GB | Qwen 3.5 35B MoE |
| 96 GB | Qwen 3.5 122B MoE |
Ogni modello che sa nominare, con parametri, uso migliore e ciò che supporta, è nella tabella completa dei modelli.
Apple Silicon
Ollama 0.19+ esegue i modelli con MLX, quindi Draggy sceglie la versione
-mlx. Su un Mac non c'è memoria video separata, quindi le taglie
qui sotto sono il numero intero, non ridotto, con cui il Mac è stato venduto.
Un chip base o Pro prende il modello nella colonna di sinistra; un Max o un
Ultra, con molta più banda di memoria, prende quello accanto.
| Memoria unificata | Base o Pro | Max o Ultra |
|---|---|---|
| 8 GB | Qwen 3.5 2B (MLX) | Qwen 3.5 4B (MLX) |
| 16 GB | Qwen 3.5 4B (MLX) | Qwen 3.5 9B (MLX) |
| 24 GB | Qwen 3.5 9B (MLX) | Qwen 3.5 27B MoE (MLX) |
| 32 GB | Qwen 3.5 27B MoE (MLX) | Gemma 4 31B (MLX) |
| 48 GB | Gemma 4 31B (MLX) | Qwen 3.5 35B MoE (MLX) |
| 64 GB | Qwen 3.5 35B MoE (MLX) | GLM 4.7 Flash (MLX) |
| 96 GB | GLM 4.7 Flash (MLX) | Qwen 3.5 122B MoE (MLX) |
| 128 GB e oltre | Qwen 3.5 122B MoE (MLX) | Qwen 3.5 122B MoE (MLX) |
Ogni Mac in grado di eseguire i propri modelli, dal primo nel 2020:
| Mac | Anni | Chip | Memoria unificata |
|---|---|---|---|
| MacBook Air | 2020–2025 | M1, M2, M3, M4 | 8–32 GB |
| MacBook Pro 13" | 2020 | M1 | 8–16 GB |
| MacBook Pro 14"/16" | 2021–2025 | Da M1 a M4, Pro o Max | 16–128 GB |
| Mac mini | 2020–2024 | M1, M2 o M2 Pro, M4 o M4 Pro | 8–64 GB |
| iMac | 2021–2025 | M1, M3, M4 | 8–24 GB |
| Mac Studio | 2022–2025 | M1/M2 Max o Ultra, M3 Ultra, M4 Max | 32–512 GB |
| Mac Pro | 2023 | M2 Ultra | 64–192 GB |
Un Mac del 2019 o precedente è Intel: ha invece una vera scheda grafica separata, e legge la tabella Windows e Linux qui sopra.
La stessa tabella, in base alla memoria unificata invece che alla VRAM, è la tabella completa dei modelli per Mac.
Il numero che conta
Impostazioni → Modelli mostra quanta parte di ogni modello entra
nella memoria video. Al 100 % sulla GPU risponde alla velocità con cui leggi. Al
60 % funziona, diverse volte più lento. Sotto, scendi di una taglia.
Un modello caricato lì ha un pulsante Scarica modello, che libera la memoria video senza cancellare niente.
Il modello vocale
La modalità vocale usa un proprio modello, più
piccolo, impostato in Impostazioni → Chat → Parla. Rispondere in
fretta vale più che rispondere bene qui, quindi tienilo piccolo.