시작하기
모델 고르기
어떤 모델이 그래픽 카드에 들어가는지, 그리고 그것을 정하는 숫자 하나.
Draggy는 각 모델이 무엇을 할 수 있는지 이름으로 짐작하지 않고 Ollama에 물어봅니다. 클라우드 모델은 숨겨지고, 임베딩 모델은 목록에는 있지만 답하지 못합니다.
Windows와 Linux
먼저 그래픽 카드 메모리를 기준으로 고릅니다. 그래픽 메모리가 적거나 없는 컴퓨터도 가장 작은 모델이 아니라 시스템 메모리가 버틸 수 있는 크기의 모델을 받습니다.
| VRAM | 모델 |
|---|---|
| 4 GB 미만 | Qwen 3.5 0.8B |
| 4 GB | Qwen 3.5 2B |
| 5 GB | Gemma 4 E4B |
| 6 GB | Mistral 7B |
| 8 GB | Qwen 3.5 9B |
| 10 GB | Gemma 4 12B |
| 12 GB | Phi-4 14B |
| 16 GB | GPT-OSS 20B MoE |
| 20 GB | Qwen 3.5 27B MoE |
| 22 GB | GLM 4.7 Flash MoE |
| 24 GB | Gemma 4 31B |
| 32 GB | Qwen 3.5 35B MoE |
| 96 GB | Qwen 3.5 122B MoE |
이름을 댈 수 있는 모든 모델을 매개변수, 적합한 용도, 지원 기능과 함께 담은 전체 모델 표가 있습니다.
Apple Silicon
Ollama 0.19 이상은 모델을 MLX로 돌리므로 Draggy는 -mlx 빌드를
고릅니다. Mac에는 별도의 비디오 메모리가 없으므로 아래 크기는 Mac이 판매될 때의
줄이지 않은 전체 숫자입니다. 베이스나 Pro 칩은 왼쪽 열의 모델을, 메모리 대역폭이
훨씬 넓은 Max나 Ultra는 옆의 모델을 받습니다.
| 통합 메모리 | 베이스 또는 Pro | Max 또는 Ultra |
|---|---|---|
| 8 GB | Qwen 3.5 2B (MLX) | Qwen 3.5 4B (MLX) |
| 16 GB | Qwen 3.5 4B (MLX) | Qwen 3.5 9B (MLX) |
| 24 GB | Qwen 3.5 9B (MLX) | Qwen 3.5 27B MoE (MLX) |
| 32 GB | Qwen 3.5 27B MoE (MLX) | Gemma 4 31B (MLX) |
| 48 GB | Gemma 4 31B (MLX) | Qwen 3.5 35B MoE (MLX) |
| 64 GB | Qwen 3.5 35B MoE (MLX) | GLM 4.7 Flash (MLX) |
| 96 GB | GLM 4.7 Flash (MLX) | Qwen 3.5 122B MoE (MLX) |
| 128 GB 이상 | Qwen 3.5 122B MoE (MLX) | Qwen 3.5 122B MoE (MLX) |
2020년 첫 모델부터, 자체 모델을 돌릴 수 있는 모든 Mac:
| Mac | 연도 | 칩 | 통합 메모리 |
|---|---|---|---|
| MacBook Air | 2020–2025 | M1, M2, M3, M4 | 8–32 GB |
| MacBook Pro 13" | 2020 | M1 | 8–16 GB |
| MacBook Pro 14"/16" | 2021–2025 | M1~M4, Pro 또는 Max | 16–128 GB |
| Mac mini | 2020–2024 | M1, M2 또는 M2 Pro, M4 또는 M4 Pro | 8–64 GB |
| iMac | 2021–2025 | M1, M3, M4 | 8–24 GB |
| Mac Studio | 2022–2025 | M1/M2 Max 또는 Ultra, M3 Ultra, M4 Max | 32–512 GB |
| Mac Pro | 2023 | M2 Ultra | 64–192 GB |
2019년 이전 Mac은 인텔 모델로, 대신 진짜 별도 그래픽 카드가 있으며 위의 Windows와 Linux 표를 따릅니다.
같은 표를 VRAM 대신 통합 메모리로 나타낸 Mac용 전체 모델 표도 있습니다.
정작 중요한 숫자
설정 → 모델에 각 모델이 비디오 메모리에 얼마나 들어가는지 표시됩니다. GPU 100 %면 읽는 속도로 답합니다. 60 %면 동작은 하지만 몇 배 느립니다. 그 아래라면 한 단계 낮추세요.
올라와 있는 모델에는 모델 내리기 버튼이 붙습니다. 아무것도 지우지 않고 비디오 메모리만 비웁니다.
음성용 모델
음성 모드는 더 작은 전용 모델을 쓰며,
설정 → Chat → 대화에서 지정합니다. 여기서는 잘 답하는 것보다 빨리 답하는 쪽이 중요하니 작게 두세요.