モデル別の実測結果
Mac Studio(M5 Max・36GB)で測ったqwen3.6:35b-a3b
Alibaba
Mac Studio(M5 Max・36GB)で、qwen3.6:35b-a3bはかんたんな質問に約8.8秒で答え、日本語の知識問題は88%、算数は89%正解、メモリは22.3GB使いました。
2026年10月2日に測り方を変える前の数値です(違いはどうやって測ったか)。
測った結果
| 項目 | 結果 | 測ったモデルの中で | メモ |
|---|---|---|---|
| 返事の速さ | 約8.8秒 | 30モデル中 25位 | かんたんな常識問題1問に答え終わるまで(50問の中央値) |
| 知識問題(高校〜大学レベル) | 88% | 30モデル中 1位 | 200問・誤差±5・打ち切り1問(不正解に数える) |
| 算数(文章題) | 89% | 30モデル中 1位 | 100問・誤差±8 |
| 使うメモリ | 22.3GB | 30モデル中 28位 | |
| 英→日の翻訳 | 29点 | 28モデル中 23位 | 100点満点(chrF)・1文約28.9秒 |
| 日→英の翻訳 | 54点 | 28モデル中 20位 | 100点満点(chrF)・1文約23.4秒 |
「測ったモデルの中で」は、このサイトで測った 30 モデルの中での順位です(速さとメモリは小さいほど上)。
自分の Mac で試すには
- ollama.com から Mac 版の Ollama を入れて起動します。
- ターミナルで次のように入力します。初回はモデルのダウンロードが始まり、終わると会話できます。
ollama run qwen3.6:35b-a3b
この Mac では 22.3GB 使いました。ほかのアプリと一緒に快適に使う目安は、メモリ 48GB 以上の Mac です(モデルがメモリの半分ほどに収まる)。
モデルの情報
- 作った会社
- Alibaba
- 大きさ
- パラメータ約355億
- 量子化
- Q4_K_M
- 考えてから答えるタイプ
- はい
- 一度に扱える最大の長さ
- 262,144 トークン
- 公開日(Hugging Face)
- 2026年4月15日
- 文字を書く速さ
- 97.8 tok/s
- 起動(読み込み)
- 約7.1秒
- 計測日
- 2026年10月1日
- Ollama
- 0.34.3
- Hugging Face
- Qwen/Qwen3.6-35B-A3B
- シリーズ
- Qwen
メモリが近いモデル
- DeepSeek-R1-Distill-Qwen-32B(メモリ 22.4GB・知識問題 81%・返事 約16.8秒)
- NVIDIA-Nemotron-3-Nano-30B-A3B-BF16(メモリ 22.7GB・知識問題 77%・返事 約2秒)
- Ornith-1.5-35B-A3B(メモリ 21.8GB・知識問題 82%・返事 約1.9秒)
- Ornith-1.0-35B(メモリ 21.6GB・知識問題 88%・返事 約10.1秒)
- glm-4.7-flash:latest(メモリ 19.5GB・知識問題 77%・返事 約6.3秒)