Para empezar
Elegir un modelo
Qué modelo cabe en tu tarjeta gráfica, y el único número que lo decide.
Draggy le pregunta a Ollama qué sabe hacer cada modelo instalado en vez de adivinarlo por el nombre. Los modelos en la nube están ocultos; los de embedding aparecen pero no responden.
Windows y Linux
Elegido primero según la memoria de la tarjeta gráfica. Una máquina con poca o ninguna igual recibe un modelo del tamaño que su memoria RAM puede sostener, en vez del más pequeño que existe.
| VRAM | Modelo |
|---|---|
| menos de 4 GB | Qwen 3.5 0.8B |
| 4 GB | Qwen 3.5 2B |
| 5 GB | Gemma 4 E4B |
| 6 GB | Mistral 7B |
| 8 GB | Qwen 3.5 9B |
| 10 GB | Gemma 4 12B |
| 12 GB | Phi-4 14B |
| 16 GB | GPT-OSS 20B MoE |
| 20 GB | Qwen 3.5 27B MoE |
| 22 GB | GLM 4.7 Flash MoE |
| 24 GB | Gemma 4 31B |
| 32 GB | Qwen 3.5 35B MoE |
| 96 GB | Qwen 3.5 122B MoE |
Todos los modelos que puede nombrar, con sus parámetros, mejor uso y lo que admiten, están en la tabla completa de modelos.
Apple Silicon
Ollama 0.19+ ejecuta los modelos con MLX, así que Draggy elige la versión
-mlx. En un Mac no hay memoria de vídeo separada, así que los
tamaños de abajo son el número entero, sin reducir, con el que se vendió el
Mac. Un chip base o Pro toma el modelo de la columna izquierda; uno Max o
Ultra, con mucho más ancho de banda de memoria, toma el de al lado.
| Memoria unificada | Base o Pro | Max o Ultra |
|---|---|---|
| 8 GB | Qwen 3.5 2B (MLX) | Qwen 3.5 4B (MLX) |
| 16 GB | Qwen 3.5 4B (MLX) | Qwen 3.5 9B (MLX) |
| 24 GB | Qwen 3.5 9B (MLX) | Qwen 3.5 27B MoE (MLX) |
| 32 GB | Qwen 3.5 27B MoE (MLX) | Gemma 4 31B (MLX) |
| 48 GB | Gemma 4 31B (MLX) | Qwen 3.5 35B MoE (MLX) |
| 64 GB | Qwen 3.5 35B MoE (MLX) | GLM 4.7 Flash (MLX) |
| 96 GB | GLM 4.7 Flash (MLX) | Qwen 3.5 122B MoE (MLX) |
| 128 GB o más | Qwen 3.5 122B MoE (MLX) | Qwen 3.5 122B MoE (MLX) |
Todos los Mac capaces de ejecutar sus modelos, desde el primero en 2020:
| Mac | Años | Chip | Memoria unificada |
|---|---|---|---|
| MacBook Air | 2020–2025 | M1, M2, M3, M4 | 8–32 GB |
| MacBook Pro 13" | 2020 | M1 | 8–16 GB |
| MacBook Pro 14"/16" | 2021–2025 | M1 a M4, Pro o Max | 16–128 GB |
| Mac mini | 2020–2024 | M1, M2 o M2 Pro, M4 o M4 Pro | 8–64 GB |
| iMac | 2021–2025 | M1, M3, M4 | 8–24 GB |
| Mac Studio | 2022–2025 | M1/M2 Max o Ultra, M3 Ultra, M4 Max | 32–512 GB |
| Mac Pro | 2023 | M2 Ultra | 64–192 GB |
Un Mac de 2019 o anterior es Intel: tiene una tarjeta gráfica real y separada en su lugar, y lee la tabla de Windows y Linux de arriba.
La misma tabla, a la medida de la memoria unificada en vez de la VRAM, es la tabla completa de modelos para Mac.
El número que importa
Ajustes → Modelos muestra cuánto de cada modelo cabe en la memoria
de vídeo. Al 100 % en la GPU responde a la velocidad a la que lees. Al 60 %
funciona, varias veces más lento. Por debajo, baja una talla.
Un modelo cargado tiene ahí un botón Descargar modelo, que libera la memoria de vídeo sin borrar nada.
El modelo de voz
El modo de voz usa su propio modelo, más pequeño,
ajustado en Ajustes → Chat → Hablar. Responder rápido vale más que
responder bien aquí, así que mantenlo pequeño.