はじめに

モデルを選ぶ

どのモデルがグラフィックカードに収まるか、そしてそれを決める一つの数字。

Draggy は各モデルに何ができるかを名前から推測せず、Ollama に尋ねます。クラウドのモデルは隠され、埋め込みモデルは一覧に出ますが返答はできません。

Windows と Linux

まずグラフィックカードのメモリで選びます。少ないか無いマシンでも、一番小さいモデルではなく、システムメモリが支えられる大きさのモデルが選ばれます。

VRAMモデル
4 GB 未満Qwen 3.5 0.8B
4 GBQwen 3.5 2B
5 GBGemma 4 E4B
6 GBMistral 7B
8 GBQwen 3.5 9B
10 GBGemma 4 12B
12 GBPhi-4 14B
16 GBGPT-OSS 20B MoE
20 GBQwen 3.5 27B MoE
22 GBGLM 4.7 Flash MoE
24 GBGemma 4 31B
32 GBQwen 3.5 35B MoE
96 GBQwen 3.5 122B MoE

名前を挙げられるすべてのモデルを、パラメータ数・得意な用途・対応機能とともに掲載した モデル一覧があります。

Apple Silicon

Ollama 0.19 以降はモデルを MLX で動かすため、Draggy は -mlx ビルドを選びます。Mac には独立したビデオメモリがないため、下の数字は Mac が販売されたときのそのままの、減らしていない数字です。ベースまたは Pro チップは左の列のモデルを、メモリ帯域幅がはるかに大きい Max や Ultra は隣のモデルを担当します。

ユニファイドメモリベースまたは ProMax または Ultra
8 GBQwen 3.5 2B (MLX)Qwen 3.5 4B (MLX)
16 GBQwen 3.5 4B (MLX)Qwen 3.5 9B (MLX)
24 GBQwen 3.5 9B (MLX)Qwen 3.5 27B MoE (MLX)
32 GBQwen 3.5 27B MoE (MLX)Gemma 4 31B (MLX)
48 GBGemma 4 31B (MLX)Qwen 3.5 35B MoE (MLX)
64 GBQwen 3.5 35B MoE (MLX)GLM 4.7 Flash (MLX)
96 GBGLM 4.7 Flash (MLX)Qwen 3.5 122B MoE (MLX)
128 GB 以上Qwen 3.5 122B MoE (MLX)Qwen 3.5 122B MoE (MLX)

2020年の最初の一台から、自社モデルを動かせるすべての Mac:

Mac年代チップユニファイドメモリ
MacBook Air2020–2025M1、M2、M3、M48–32 GB
MacBook Pro 13"2020M18–16 GB
MacBook Pro 14"/16"2021–2025M1〜M4、Pro または Max16–128 GB
Mac mini2020–2024M1、M2 または M2 Pro、M4 または M4 Pro8–64 GB
iMac2021–2025M1、M3、M48–24 GB
Mac Studio2022–2025M1/M2 Max または Ultra、M3 Ultra、M4 Max32–512 GB
Mac Pro2023M2 Ultra64–192 GB

2019年以前の Mac は Intel 製で、代わりに独立した本物のグラフィックカードを持ち、上の Windows と Linux の表を参照します。

同じ表を VRAM の代わりにユニファイドメモリで示したものが Mac 版モデル一覧です。

効いてくる数字

設定 → モデルに、各モデルのどれだけがビデオメモリに収まるかが出ます。GPU 100 % なら読む速さで返ってきます。60 % でも動きますが、数倍遅くなります。それより下ならひとつ小さいものへ。

読み込み済みのモデルにはモデルをアンロードボタンが付き、何も消さずにビデオメモリだけ解放します。

音声用のモデル

音声モードは小さめの専用モデルを使い、 設定 → Chat → 音声会話で設定します。ここでは上手に答えるより速く答える方が大事なので、小さいままにしておきます。