モデル別の実測結果

Mac Studio(M5 Max・36GB)で測ったDeepSeek-R1-Distill-Qwen-32B

DeepSeek・Ollama 名 hf.co/unsloth/DeepSeek-R1-Distill-Qwen-32B-GGUF:Q4_K_M

Mac Studio(M5 Max・36GB)で、DeepSeek-R1-Distill-Qwen-32Bはかんたんな質問に約16.8秒で答え、日本語の知識問題は81%、算数は86%正解、メモリは22.4GB使いました。

2026年10月2日に測り方を変える前の数値です(違いはどうやって測ったか)。

測った結果

項目結果測ったモデルの中でメモ
返事の速さ約16.8秒30モデル中 29位かんたんな常識問題1問に答え終わるまで(50問の中央値)
知識問題(高校〜大学レベル)81%30モデル中 9位200問・誤差±6・打ち切り7問(不正解に数える)
算数(文章題)86%30モデル中 7位100問・誤差±8
使うメモリ22.4GB30モデル中 29位
英→日の翻訳31点28モデル中 16位100点満点(chrF)・1文約19.6秒
日→英の翻訳57点28モデル中 10位100点満点(chrF)・1文約13.3秒

「測ったモデルの中で」は、このサイトで測った 30 モデルの中での順位です(速さとメモリは小さいほど上)。

自分の Mac で試すには

  1. ollama.com から Mac 版の Ollama を入れて起動します。
  2. ターミナルで次のように入力します。初回はモデルのダウンロードが始まり、終わると会話できます。ollama run hf.co/unsloth/DeepSeek-R1-Distill-Qwen-32B-GGUF:Q4_K_M

この Mac では 22.4GB 使いました。ほかのアプリと一緒に快適に使う目安は、メモリ 48GB 以上の Mac です(モデルがメモリの半分ほどに収まる)。

モデルの情報

作った会社
DeepSeek
大きさ
パラメータ約328億
量子化
Q4_K_M
考えてから答えるタイプ
はい
一度に扱える最大の長さ
131,072 トークン
公開日(Hugging Face)
2025年1月20日
文字を書く速さ
20.5 tok/s
起動(読み込み)
約1.3秒
計測日
2026年9月30日
Ollama
0.34.3
Hugging Face
deepseek-ai/DeepSeek-R1-Distill-Qwen-32B
シリーズ
DeepSeek

メモリが近いモデル

文章のページで主なモデルを比べられます。シリーズのページには測ったすべてのモデルがあります。