はじめに
モデルを選ぶ
どのモデルがグラフィックカードに収まるか、そしてそれを決める一つの数字。
Draggy は各モデルに何ができるかを名前から推測せず、Ollama に尋ねます。クラウドのモデルは隠され、埋め込みモデルは一覧に出ますが返答はできません。
Windows と Linux
まずグラフィックカードのメモリで選びます。少ないか無いマシンでも、一番小さいモデルではなく、システムメモリが支えられる大きさのモデルが選ばれます。
| VRAM | モデル |
|---|---|
| 4 GB 未満 | Qwen 3.5 0.8B |
| 4 GB | Qwen 3.5 2B |
| 5 GB | Gemma 4 E4B |
| 6 GB | Mistral 7B |
| 8 GB | Qwen 3.5 9B |
| 10 GB | Gemma 4 12B |
| 12 GB | Phi-4 14B |
| 16 GB | GPT-OSS 20B MoE |
| 20 GB | Qwen 3.5 27B MoE |
| 22 GB | GLM 4.7 Flash MoE |
| 24 GB | Gemma 4 31B |
| 32 GB | Qwen 3.5 35B MoE |
| 96 GB | Qwen 3.5 122B MoE |
名前を挙げられるすべてのモデルを、パラメータ数・得意な用途・対応機能とともに掲載した モデル一覧があります。
Apple Silicon
Ollama 0.19 以降はモデルを MLX で動かすため、Draggy は -mlx
ビルドを選びます。Mac には独立したビデオメモリがないため、下の数字は Mac
が販売されたときのそのままの、減らしていない数字です。ベースまたは Pro
チップは左の列のモデルを、メモリ帯域幅がはるかに大きい Max や Ultra
は隣のモデルを担当します。
| ユニファイドメモリ | ベースまたは Pro | Max または Ultra |
|---|---|---|
| 8 GB | Qwen 3.5 2B (MLX) | Qwen 3.5 4B (MLX) |
| 16 GB | Qwen 3.5 4B (MLX) | Qwen 3.5 9B (MLX) |
| 24 GB | Qwen 3.5 9B (MLX) | Qwen 3.5 27B MoE (MLX) |
| 32 GB | Qwen 3.5 27B MoE (MLX) | Gemma 4 31B (MLX) |
| 48 GB | Gemma 4 31B (MLX) | Qwen 3.5 35B MoE (MLX) |
| 64 GB | Qwen 3.5 35B MoE (MLX) | GLM 4.7 Flash (MLX) |
| 96 GB | GLM 4.7 Flash (MLX) | Qwen 3.5 122B MoE (MLX) |
| 128 GB 以上 | Qwen 3.5 122B MoE (MLX) | Qwen 3.5 122B MoE (MLX) |
2020年の最初の一台から、自社モデルを動かせるすべての Mac:
| Mac | 年代 | チップ | ユニファイドメモリ |
|---|---|---|---|
| MacBook Air | 2020–2025 | M1、M2、M3、M4 | 8–32 GB |
| MacBook Pro 13" | 2020 | M1 | 8–16 GB |
| MacBook Pro 14"/16" | 2021–2025 | M1〜M4、Pro または Max | 16–128 GB |
| Mac mini | 2020–2024 | M1、M2 または M2 Pro、M4 または M4 Pro | 8–64 GB |
| iMac | 2021–2025 | M1、M3、M4 | 8–24 GB |
| Mac Studio | 2022–2025 | M1/M2 Max または Ultra、M3 Ultra、M4 Max | 32–512 GB |
| Mac Pro | 2023 | M2 Ultra | 64–192 GB |
2019年以前の Mac は Intel 製で、代わりに独立した本物のグラフィックカードを持ち、上の Windows と Linux の表を参照します。
同じ表を VRAM の代わりにユニファイドメモリで示したものが Mac 版モデル一覧です。
効いてくる数字
設定 → モデルに、各モデルのどれだけがビデオメモリに収まるかが出ます。GPU
100 % なら読む速さで返ってきます。60 %
でも動きますが、数倍遅くなります。それより下ならひとつ小さいものへ。
読み込み済みのモデルにはモデルをアンロードボタンが付き、何も消さずにビデオメモリだけ解放します。
音声用のモデル
音声モードは小さめの専用モデルを使い、
設定 → Chat → 音声会話で設定します。ここでは上手に答えるより速く答える方が大事なので、小さいままにしておきます。