モデル別の実測結果
Mac Studio(M5 Max・36GB)で測ったglm-4.7-flash:latest
Z.ai
Mac Studio(M5 Max・36GB)で、glm-4.7-flash:latestはかんたんな質問に約6.3秒で答え、日本語の知識問題は77%、算数は83%正解、メモリは19.5GB使いました。
2026年10月2日に測り方を変える前の数値です(違いはどうやって測ったか)。
測った結果
| 項目 | 結果 | 測ったモデルの中で | メモ |
|---|---|---|---|
| 返事の速さ | 約6.3秒 | 30モデル中 22位 | かんたんな常識問題1問に答え終わるまで(50問の中央値) |
| 知識問題(高校〜大学レベル) | 77% | 30モデル中 13位 | 200問・誤差±6・打ち切り21問(不正解に数える) |
| 算数(文章題) | 83% | 30モデル中 11位 | 100問・誤差±9・打ち切り7問(不正解に数える) |
| 使うメモリ | 19.5GB | 30モデル中 25位 | |
| 英→日の翻訳 | 32点 | 28モデル中 14位 | 100点満点(chrF)・1文約23.3秒 |
| 日→英の翻訳 | 53点 | 28モデル中 21位 | 100点満点(chrF)・1文約19.9秒 |
「測ったモデルの中で」は、このサイトで測った 30 モデルの中での順位です(速さとメモリは小さいほど上)。
自分の Mac で試すには
- ollama.com から Mac 版の Ollama を入れて起動します。
- ターミナルで次のように入力します。初回はモデルのダウンロードが始まり、終わると会話できます。
ollama run glm-4.7-flash:latest
この Mac では 19.5GB 使いました。ほかのアプリと一緒に快適に使う目安は、メモリ 48GB 以上の Mac です(モデルがメモリの半分ほどに収まる)。
モデルの情報
- 作った会社
- Z.ai
- 大きさ
- パラメータ約299億
- 量子化
- Q4_K_M
- 考えてから答えるタイプ
- はい
- 一度に扱える最大の長さ
- 202,752 トークン
- 公開日(Hugging Face)
- 2026年1月19日
- 文字を書く速さ
- 80.5 tok/s
- 起動(読み込み)
- 約9.1秒
- 計測日
- 2026年9月26日
- Ollama
- 0.34.3
- Hugging Face
- zai-org/GLM-4.7-Flash
- シリーズ
- GLM
メモリが近いモデル
- qwen3-coder:30b(メモリ 19.4GB・知識問題 68%・返事 約0.1秒)
- gemma4:26b(メモリ 18.7GB・知識問題 82%・返事 約2.9秒)
- gemma3:27b(メモリ 18.4GB・知識問題 74%・返事 約0.4秒)
- qwen3.8:27b(メモリ 18.2GB・知識問題 85%・返事 約6.9秒)
- muse-glimmer:30b(メモリ 17.6GB・知識問題 85%・返事 約14.3秒)