Начало работы
Выбор модели
Какая модель поместится в вашу видеокарту и единственное число, которое это решает.
Draggy спрашивает у Ollama, что умеет каждая установленная модель, вместо того чтобы угадывать по названию. Облачные модели скрыты; модели эмбеддингов показаны, но отвечать не умеют.
Windows и Linux
Сначала выбирается по памяти видеокарты. Машина с малым объёмом или без него всё равно получает модель размером под то, что выдержит оперативная память, а не самую маленькую из всех.
| Видеопамять | Модель |
|---|---|
| меньше 4 ГБ | Qwen 3.5 0.8B |
| 4 ГБ | Qwen 3.5 2B |
| 5 ГБ | Gemma 4 E4B |
| 6 ГБ | Mistral 7B |
| 8 ГБ | Qwen 3.5 9B |
| 10 ГБ | Gemma 4 12B |
| 12 ГБ | Phi-4 14B |
| 16 ГБ | GPT-OSS 20B MoE |
| 20 ГБ | Qwen 3.5 27B MoE |
| 22 ГБ | GLM 4.7 Flash MoE |
| 24 ГБ | Gemma 4 31B |
| 32 ГБ | Qwen 3.5 35B MoE |
| 96 ГБ | Qwen 3.5 122B MoE |
Все модели, которые он способен назвать, с параметрами, назначением и поддержкой, перечислены в полной таблице моделей.
Apple Silicon
Ollama 0.19+ запускает модели через MLX, поэтому Draggy берёт сборку
-mlx. На Mac нет отдельной видеопамяти, поэтому размеры ниже: это целое, не урезанное число, с которым Mac продавался. Базовый чип или Pro
получает модель из левого столбца; Max или Ultra, с намного большей
пропускной способностью памяти, получает ту, что рядом.
| Единая память | Base или Pro | Max или Ultra |
|---|---|---|
| 8 ГБ | Qwen 3.5 2B (MLX) | Qwen 3.5 4B (MLX) |
| 16 ГБ | Qwen 3.5 4B (MLX) | Qwen 3.5 9B (MLX) |
| 24 ГБ | Qwen 3.5 9B (MLX) | Qwen 3.5 27B MoE (MLX) |
| 32 ГБ | Qwen 3.5 27B MoE (MLX) | Gemma 4 31B (MLX) |
| 48 ГБ | Gemma 4 31B (MLX) | Qwen 3.5 35B MoE (MLX) |
| 64 ГБ | Qwen 3.5 35B MoE (MLX) | GLM 4.7 Flash (MLX) |
| 96 ГБ | GLM 4.7 Flash (MLX) | Qwen 3.5 122B MoE (MLX) |
| 128 ГБ и больше | Qwen 3.5 122B MoE (MLX) | Qwen 3.5 122B MoE (MLX) |
Каждый Mac, способный запускать свои модели, начиная с первого в 2020 году:
| Mac | Годы | Чип | Единая память |
|---|---|---|---|
| MacBook Air | 2020–2025 | M1, M2, M3, M4 | 8–32 ГБ |
| MacBook Pro 13" | 2020 | M1 | 8–16 ГБ |
| MacBook Pro 14"/16" | 2021–2025 | От M1 до M4, Pro или Max | 16–128 ГБ |
| Mac mini | 2020–2024 | M1, M2 или M2 Pro, M4 или M4 Pro | 8–64 ГБ |
| iMac | 2021–2025 | M1, M3, M4 | 8–24 ГБ |
| Mac Studio | 2022–2025 | M1/M2 Max или Ultra, M3 Ultra, M4 Max | 32–512 ГБ |
| Mac Pro | 2023 | M2 Ultra | 64–192 ГБ |
Mac 2019 года или старше это Intel: у него настоящая, отдельная видеокарта, и он читает таблицу Windows и Linux выше.
Та же таблица, но по единой памяти вместо видеопамяти, это полная таблица моделей для Mac.
Число, которое важно
Настройки → Модели показывают, какая часть каждой модели помещается
в видеопамять. На 100 % на GPU ответ идёт со скоростью чтения. На 60 % работает,
но в несколько раз медленнее. Ниже этого берите размер меньше.
У загруженной модели там появляется кнопка Выгрузить модель, которая освобождает видеопамять, ничего не удаляя.
Модель для разговора
Голосовой режим использует свою, меньшую модель,
задаётся в Настройки → Chat → Разговор. Здесь быстрый ответ важнее
хорошего, так что держите модель маленькой.