Para começar
Escolher um modelo
Que modelo cabe na tua placa gráfica, e o único número que decide.
O Draggy pergunta ao Ollama o que cada modelo instalado sabe fazer em vez de o adivinhar pelo nome. Os modelos na nuvem ficam escondidos; os de embedding aparecem mas não respondem.
Windows e Linux
Escolhido primeiro pela memória da placa gráfica. Uma máquina com pouca ou nenhuma continua a receber um modelo do tamanho que a sua memória RAM aguenta, em vez do mais pequeno que existe.
| VRAM | Modelo |
|---|---|
| menos de 4 GB | Qwen 3.5 0.8B |
| 4 GB | Qwen 3.5 2B |
| 5 GB | Gemma 4 E4B |
| 6 GB | Mistral 7B |
| 8 GB | Qwen 3.5 9B |
| 10 GB | Gemma 4 12B |
| 12 GB | Phi-4 14B |
| 16 GB | GPT-OSS 20B MoE |
| 20 GB | Qwen 3.5 27B MoE |
| 22 GB | GLM 4.7 Flash MoE |
| 24 GB | Gemma 4 31B |
| 32 GB | Qwen 3.5 35B MoE |
| 96 GB | Qwen 3.5 122B MoE |
Todos os modelos que consegue nomear, com os parâmetros, o melhor uso e o que suportam, estão na tabela completa de modelos.
Apple Silicon
O Ollama 0.19+ corre os modelos por MLX, por isso o Draggy escolhe a versão
-mlx. Num Mac não há memória de vídeo separada, por isso os
tamanhos abaixo são o número inteiro, sem redução, com que o Mac foi vendido.
Um chip base ou Pro fica com o modelo da coluna da esquerda; um Max ou Ultra,
com muito mais largura de banda de memória, fica com o do lado.
| Memória unificada | Base ou Pro | Max ou Ultra |
|---|---|---|
| 8 GB | Qwen 3.5 2B (MLX) | Qwen 3.5 4B (MLX) |
| 16 GB | Qwen 3.5 4B (MLX) | Qwen 3.5 9B (MLX) |
| 24 GB | Qwen 3.5 9B (MLX) | Qwen 3.5 27B MoE (MLX) |
| 32 GB | Qwen 3.5 27B MoE (MLX) | Gemma 4 31B (MLX) |
| 48 GB | Gemma 4 31B (MLX) | Qwen 3.5 35B MoE (MLX) |
| 64 GB | Qwen 3.5 35B MoE (MLX) | GLM 4.7 Flash (MLX) |
| 96 GB | GLM 4.7 Flash (MLX) | Qwen 3.5 122B MoE (MLX) |
| 128 GB ou mais | Qwen 3.5 122B MoE (MLX) | Qwen 3.5 122B MoE (MLX) |
Todos os Mac capazes de correr os seus próprios modelos, desde o primeiro em 2020:
| Mac | Anos | Chip | Memória unificada |
|---|---|---|---|
| MacBook Air | 2020–2025 | M1, M2, M3, M4 | 8–32 GB |
| MacBook Pro 13" | 2020 | M1 | 8–16 GB |
| MacBook Pro 14"/16" | 2021–2025 | M1 a M4, Pro ou Max | 16–128 GB |
| Mac mini | 2020–2024 | M1, M2 ou M2 Pro, M4 ou M4 Pro | 8–64 GB |
| iMac | 2021–2025 | M1, M3, M4 | 8–24 GB |
| Mac Studio | 2022–2025 | M1/M2 Max ou Ultra, M3 Ultra, M4 Max | 32–512 GB |
| Mac Pro | 2023 | M2 Ultra | 64–192 GB |
Um Mac de 2019 ou anterior é Intel: tem, em vez disso, uma placa gráfica real e separada, e lê a tabela do Windows e Linux acima.
A mesma tabela, à medida da memória unificada em vez da VRAM, é a tabela completa de modelos para Mac.
O número que interessa
Definições → Modelos mostra quanto de cada modelo cabe na memória
de vídeo. A 100 % na GPU responde à velocidade a que lês. A 60 % funciona,
várias vezes mais devagar. Abaixo disso, desce um tamanho.
Um modelo carregado ganha ali um botão Descarregar modelo, que liberta a memória de vídeo sem apagar nada.
O modelo de voz
O modo de voz usa o seu próprio modelo, mais
pequeno, definido em Definições → Chat → Falar. Responder depressa
vale mais do que responder bem aqui, por isso mantém-no pequeno.