Index / Open-weight models on Apple Silicon
The local LLM leaderboard
According to the LLMCheck index, 81 open-weight models are scored 0–100 on capability, speed on Apple Silicon, RAM accessibility, and license openness. Every speed figure below carries a provenance mark — sourced, estimated, or community — so you can trace any number back to where it came from. Nothing here is unattributed.
Provenance key
sourced
Vendor-published figure
estimated
Derived from published bandwidth model
community
Linked third-party run
Fits in
License
81 of 81 shown
| # | Model | Score↓0–100 composite | Speedtok/s decode | TTFTseconds | RAMunified min | License |
|---|---|---|---|---|---|---|
| 1 | Qwen3.8-27B 27.8B · Q4_K_M · Alibaba |
71 |
estimated29 | — | 19 GB | Apache 2.0 |
| 2 | DeepSeek V4 Flash 284B MoE · Q4_K_M · DeepSeek |
70 |
community39 | community0.4 | 120 GB | MIT |
| 3 | KAT-Coder-V2.5 35B MoE · Q4_K_M · Kwaipilot |
70 |
estimated52 | estimated0.3 | 24 GB | Apache 2.0 |
| 4 | Maple Preview 20B-A1B 20B MoE · Q4_K_M · DeepGrove |
70 |
sourced281 | sourced0.1 | 6 GB | MIT |
| 5 | Qwen 3.6-27B 27B · Q4_K_M · Alibaba |
70 |
estimated30 | estimated0.3 | 18 GB | Apache 2.0 |
| 6 | GLM 5.2 753B MoE · Q4_K_M · Zhipu AI |
69 |
community22 | community1.5 | 256 GB | MIT |
| 7 | Nemotron 3.5 Lightning 30B MoE · Q4_K_M · NVIDIA |
69 |
estimated60 | estimated0.2 | 18 GB | OpenMDW |
| 8 | Qwen 3.6-35B-A3B 35B MoE · Q4_K_M · Alibaba |
69 |
estimated48 | estimated0.8 | 24 GB | Apache 2.0 |
| 9 | Nanbeige4.2-3B 3B · Q4_K_M · Nanbeige |
68 |
estimated199 | estimated0.2 | 2 GB | Apache 2.0 |
| 10 | Muse Glimmer 30B 30B · Q4_K_M · Meta |
67 |
sourced27 | sourced0.4 | 18 GB | Apache 2.0 |
| 11 | Gemma 4 26B-A4B 26B MoE · Q4_K_M · Google |
65 |
estimated50 | estimated0.5 | 18 GB | Apache 2.0 |
| 12 | Laguna XS 2.1 33B MoE · Q4_K_M · Poolside |
65 |
estimated55 | estimated0.3 | 24 GB | OpenMDW |
| 13 | Bonsai 27B 27B · Q4_K_M · Prism ML |
64 |
estimated30 | estimated0.2 | 6 GB | Apache 2.0 |
| 14 | DeepSeek R1 8B 8B · Q4_K_M · DeepSeek |
64 |
estimated91 | estimated0.5 | 6 GB | MIT |
| 15 | Gemma 4 31B 31B · Q4_K_M · Google |
64 |
estimated26 | estimated0.9 | 24 GB | Apache 2.0 |
| 16 | Gemma 4 E4B 4B · Q4_K_M · Google |
64 |
estimated161 | estimated0.2 | 3 GB | Apache 2.0 |
| 17 | Phi-4 Mini 3.8B · Q4_K_M · Microsoft |
64 |
estimated168 | estimated0.3 | 3 GB | MIT |
| 18 | DeepSeek V4 Pro 1.6T MoE · Q4_K_M · DeepSeek |
63 |
— | — | 850 GB | MIT |
| 19 | Inkling-Small 276B MoE · Q4_K_M · Thinking Machines |
63 |
estimated22 | estimated0.8 | 96 GB | Apache 2.0 |
| 20 | Apertus 1.5 8B 8B · Q4_K_M · Swiss AI |
62 |
estimated91 | estimated0.3 | 5 GB | Apache 2.0 |
| 21 | GLM-4.7-Flash 31B · Q4_K_M · Zhipu AI |
61 |
estimated26 | estimated0.3 | 18 GB | MIT |
| 22 | GLM-5.1 754B MoE · Q4_K_M · Zhipu AI |
61 |
— | — | 390 GB | MIT |
| 23 | Gemma 4 E2B 2B · Q4_K_M · Google |
61 |
estimated261 | estimated0.1 | 2 GB | Apache 2.0 |
| 24 | Mistral 7B 7B · Q4_K_M · Mistral |
61 |
estimated102 | estimated0.4 | 5 GB | Apache 2.0 |
| 25 | Qwen 3 8B 8B · Q4_K_M · Alibaba |
61 |
estimated91 | estimated0.4 | 6 GB | Apache 2.0 |
| 26 | Qwen 3.5 9B 9B · Q4_K_M · Alibaba |
61 |
estimated82 | estimated0.5 | 7 GB | Apache 2.0 |
| 27 | Qwen3-235B-A22B 235B MoE · Q4_K_M · Alibaba |
61 |
estimated18 | estimated1.8 | 128 GB | Apache 2.0 |
| 28 | Kimi K2.6 1T MoE · Q4_K_M · Moonshot AI |
60 |
— | — | 600 GB | Modified MIT |
| 29 | LFM2.5-2.6B 2.6B · Q4_K_M · Liquid AI |
60 |
sourced220 | sourced0.1 | 2 GB | LFM Open |
| 30 | Laguna S 2.1 118B MoE · Q4_K_M · Poolside |
60 |
estimated26 | estimated0.6 | 96 GB | OpenMDW |
| 31 | Ministral 8B 8B · Q4_K_M · Mistral |
60 |
estimated91 | estimated0.4 | 6 GB | Apache 2.0 |
| 32 | Nemotron-Cascade 2 30B MoE · Q4_K_M · NVIDIA |
60 |
estimated35 | estimated0.9 | 18 GB | NVIDIA Open |
| 33 | Qwen 3.5 4B 4B · Q4_K_M · Alibaba |
60 |
estimated161 | estimated0.2 | 3 GB | Apache 2.0 |
| 34 | Kimi K2.5 1T MoE · Q4_K_M · Moonshot AI |
59 |
— | — | 600 GB | Modified MIT |
| 35 | Qwen 3 4B 4B · Q4_K_M · Alibaba |
59 |
estimated161 | estimated0.2 | 3 GB | Apache 2.0 |
| 36 | DeepSeek V3.2-Speciale 685B MoE · Q4_K_M · DeepSeek |
58 |
— | — | 360 GB | MIT |
| 37 | Inkling 975B MoE · Q4_K_M · Thinking Machines |
58 |
— | — | 550 GB | Apache 2.0 |
| 38 | Kimi K3 2.8T MoE · Q4_K_M · Moonshot AI |
58 |
— | — | 1560 GB | Moonshot Custom |
| 39 | Qwen3-Coder-Next 80B MoE · Q4_K_M · Alibaba |
58 |
estimated35 | estimated0.4 | 48 GB | Apache 2.0 |
| 40 | Qwen3.8-2.4T-A95B 2.4T MoE · Q4_K_M · Alibaba |
58 |
— | — | 1310 GB | Qwen Custom |
| 41 | SmolLM3 3B 3B · Q4_K_M · HuggingFace |
58 |
estimated199 | estimated0.1 | 2 GB | Apache 2.0 |
| 42 | Mistral Small 4 119B MoE · Q4_K_M · Mistral |
57 |
estimated42 | estimated0.8 | 64 GB | Apache 2.0 |
| 43 | GLM-4.5-Air 106B MoE · Q4_K_M · Zhipu AI |
56 |
estimated30 | estimated1.1 | 56 GB | MIT |
| 44 | Gemma 3 4B 4B · Q4_K_M · Google |
56 |
estimated161 | estimated0.3 | 3 GB | Gemma |
| 45 | Qwen 3.5 35B-A3B 35B MoE · Q4_K_M · Alibaba |
56 |
estimated48 | estimated0.9 | 24 GB | Apache 2.0 |
| 46 | DeepSeek V3.2 685B MoE · Q4_K_M · DeepSeek |
55 |
— | — | 360 GB | MIT |
| 47 | Llama 3.1 8B 8B · Q4_K_M · Meta |
55 |
estimated91 | estimated0.4 | 5 GB | Meta Custom |
| 48 | Phi-4 14B 14B · Q4_K_M · Microsoft |
55 |
estimated55 | estimated0.6 | 10 GB | MIT |
| 49 | Qwen 3 14B 14B · Q4_K_M · Alibaba |
54 |
estimated55 | estimated0.9 | 10 GB | Apache 2.0 |
| 50 | Qwen 3 30B-A3B 30B MoE · Q4_K_M · Alibaba |
54 |
estimated62 | estimated0.7 | 18 GB | Apache 2.0 |
| 51 | Mistral Small 3.2 24B 24B · Q4_K_M · Mistral |
53 |
estimated33 | estimated0.7 | 14 GB | Apache 2.0 |
| 52 | Devstral Small 24B 24B · Q4_K_M · Mistral |
52 |
estimated33 | estimated0.7 | 14 GB | Apache 2.0 |
| 53 | Hunyuan Hy3 295B MoE · Q4_K_M · Tencent |
52 |
estimated16 | estimated0.9 | 160 GB | Apache 2.0 |
| 54 | MiniMax M2.5 230B MoE · Q4_K_M · MiniMax |
52 |
estimated33 | estimated0.7 | 130 GB | Modified MIT |
| 55 | Ministral 3 14B 14B · Q4_K_M · Mistral |
52 |
estimated55 | estimated0.7 | 10 GB | Apache 2.0 |
| 56 | Qwen 2.5 14B 14B · Q4_K_M · Alibaba |
52 |
estimated55 | — | 10 GB | Apache 2.0 |
| 57 | Gemma 3 12B 12B · Q4_K_M · Google |
51 |
estimated64 | estimated0.6 | 9 GB | Gemma |
| 58 | Ling-3.0 Flash 124B MoE · Q4_K_M · Ant Group |
51 |
— | — | 96 GB | MIT |
| 59 | Solar Open 2 250B 250B MoE · Q4_K_M · Upstage |
51 |
— | — | 160 GB | Solar License |
| 60 | DeepSeek R1 671B MoE · Q4_K_M · DeepSeek |
50 |
— | — | 350 GB | MIT |
| 61 | DeepSeek R1 32B 32B · Q4_K_M · DeepSeek |
50 |
estimated25 | estimated1.2 | 22 GB | MIT |
| 62 | DeepSeek V3 685B MoE · Q4_K_M · DeepSeek |
50 |
— | — | 360 GB | MIT |
| 63 | QwQ 32B 32B · Q4_K_M · Alibaba |
50 |
estimated25 | — | 22 GB | Apache 2.0 |
| 64 | DeepSeek R1 70B 70B · Q4_K_M · DeepSeek |
49 |
estimated12 | estimated3.0 | 44 GB | MIT |
| 65 | Qwen 3 32B 32B · Q4_K_M · Alibaba |
49 |
estimated25 | estimated1.1 | 22 GB | Apache 2.0 |
| 66 | Qwen 3.5 397B-A17B 397B MoE · Q4_K_M · Alibaba |
49 |
— | — | 210 GB | Apache 2.0 |
| 67 | Llama 4 Scout 109B MoE · Q4_K_M · Meta |
48 |
estimated26 | estimated1.5 | 58 GB | Meta Custom |
| 68 | Step-3.5-Flash 196B MoE · Q4_K_M · StepFun |
48 |
estimated18 | — | 120 GB | Apache 2.0 |
| 69 | GLM-4.7 355B · Q4_K_M · Zhipu AI |
47 |
— | — | 180 GB | MIT |
| 70 | GPT-oss 120B 117B · Q4_K_M · OpenAI |
47 |
estimated7 | estimated5.5 | 62 GB | Apache 2.0 |
| 71 | Mistral Large 3 675B MoE · Q4_K_M · Mistral |
47 |
— | — | 355 GB | Apache 2.0 |
| 72 | Qwen 3.5 27B 27B · Q4_K_M · Alibaba |
47 |
estimated30 | — | 18 GB | Apache 2.0 |
| 73 | Apertus 1.5 70B 70B · Q4_K_M · Swiss AI |
46 |
estimated12 | estimated0.9 | 44 GB | Apache 2.0 |
| 74 | Gemma 3 27B 27B · Q4_K_M · Google |
46 |
estimated30 | estimated0.9 | 18 GB | Gemma |
| 75 | MiMo-V2-Flash 309B MoE · Q4_K_M · Xiaomi |
45 |
— | — | 165 GB | MIT |
| 76 | Qwen 2.5 72B 72B · Q4_K_M · Alibaba |
45 |
estimated12 | estimated3.2 | 46 GB | Apache 2.0 |
| 77 | Llama 4 Maverick 400B MoE · Q4_K_M · Meta |
44 |
— | — | 210 GB | Meta Custom |
| 78 | Llama 3.1 405B 405B · Q4_K_M · Meta |
43 |
— | — | 240 GB | Meta Custom |
| 79 | Mixtral 8x22B 141B MoE · Q4_K_M · Mistral |
43 |
estimated15 | — | 88 GB | Apache 2.0 |
| 80 | Hermes 4 70B 70B · Q4_K_M · Nous Research |
42 |
estimated12 | estimated1.8 | 38 GB | Meta Custom |
| 81 | Llama 3.3 70B 70B · Q4_K_M · Meta |
41 |
estimated12 | estimated2.4 | 44 GB | Meta Custom |
71
#1
Qwen3.8-27B
27.8B · Alibaba · Apache 2.0
tok/s
estimated29
TTFT
—
Min RAM
19 GB
70
#2
70
#3
70
#4
70
#5
69
#6
GLM 5.2
753B MoE · Zhipu AI · MIT
tok/s
community22
TTFT
community1.5
Min RAM
256 GB
69
#7
69
#8
68
#9
67
#10
65
#11
65
#12
64
#13
64
#14
64
#15
64
#16
64
#17
63
#18
DeepSeek V4 Pro
1.6T MoE · DeepSeek · MIT
tok/s
—
TTFT
—
Min RAM
850 GB
63
#19
Inkling-Small
276B MoE · Thinking Machines · Apache 2.0
tok/s
estimated22
TTFT
estimated0.8
Min RAM
96 GB
62
#20
61
#21
61
#22
GLM-5.1
754B MoE · Zhipu AI · MIT
tok/s
—
TTFT
—
Min RAM
390 GB
61
#23
61
#24
61
#25
61
#26
61
#27
60
#28
Kimi K2.6
1T MoE · Moonshot AI · Modified MIT
tok/s
—
TTFT
—
Min RAM
600 GB
60
#29
60
#30
60
#31
60
#32
60
#33
59
#34
Kimi K2.5
1T MoE · Moonshot AI · Modified MIT
tok/s
—
TTFT
—
Min RAM
600 GB
59
#35
58
#36
DeepSeek V3.2-Speciale
685B MoE · DeepSeek · MIT
tok/s
—
TTFT
—
Min RAM
360 GB
58
#37
Inkling
975B MoE · Thinking Machines · Apache 2.0
tok/s
—
TTFT
—
Min RAM
550 GB
58
#38
Kimi K3
2.8T MoE · Moonshot AI · Moonshot Custom
tok/s
—
TTFT
—
Min RAM
1560 GB
58
#39
58
#40
Qwen3.8-2.4T-A95B
2.4T MoE · Alibaba · Qwen Custom
tok/s
—
TTFT
—
Min RAM
1310 GB
58
#41
57
#42
56
#43
56
#44
56
#45
55
#46
DeepSeek V3.2
685B MoE · DeepSeek · MIT
tok/s
—
TTFT
—
Min RAM
360 GB
55
#47
55
#48
54
#49
54
#50
53
#51
52
#52
52
#53
Hunyuan Hy3
295B MoE · Tencent · Apache 2.0
tok/s
estimated16
TTFT
estimated0.9
Min RAM
160 GB
52
#54
MiniMax M2.5
230B MoE · MiniMax · Modified MIT
tok/s
estimated33
TTFT
estimated0.7
Min RAM
130 GB
52
#55
52
#56
Qwen 2.5 14B
14B · Alibaba · Apache 2.0
tok/s
estimated55
TTFT
—
Min RAM
10 GB
51
#57
51
#58
Ling-3.0 Flash
124B MoE · Ant Group · MIT
tok/s
—
TTFT
—
Min RAM
96 GB
51
#59
Solar Open 2 250B
250B MoE · Upstage · Solar License
tok/s
—
TTFT
—
Min RAM
160 GB
50
#60
DeepSeek R1
671B MoE · DeepSeek · MIT
tok/s
—
TTFT
—
Min RAM
350 GB
50
#61
50
#62
DeepSeek V3
685B MoE · DeepSeek · MIT
tok/s
—
TTFT
—
Min RAM
360 GB
50
#63
QwQ 32B
32B · Alibaba · Apache 2.0
tok/s
estimated25
TTFT
—
Min RAM
22 GB
49
#64
49
#65
49
#66
Qwen 3.5 397B-A17B
397B MoE · Alibaba · Apache 2.0
tok/s
—
TTFT
—
Min RAM
210 GB
48
#67
48
#68
Step-3.5-Flash
196B MoE · StepFun · Apache 2.0
tok/s
estimated18
TTFT
—
Min RAM
120 GB
47
#69
GLM-4.7
355B · Zhipu AI · MIT
tok/s
—
TTFT
—
Min RAM
180 GB
47
#70
47
#71
Mistral Large 3
675B MoE · Mistral · Apache 2.0
tok/s
—
TTFT
—
Min RAM
355 GB
47
#72
Qwen 3.5 27B
27B · Alibaba · Apache 2.0
tok/s
estimated30
TTFT
—
Min RAM
18 GB
46
#73
46
#74
45
#75
MiMo-V2-Flash
309B MoE · Xiaomi · MIT
tok/s
—
TTFT
—
Min RAM
165 GB
45
#76
44
#77
Llama 4 Maverick
400B MoE · Meta · Meta Custom
tok/s
—
TTFT
—
Min RAM
210 GB
43
#78
Llama 3.1 405B
405B · Meta · Meta Custom
tok/s
—
TTFT
—
Min RAM
240 GB
43
#79
Mixtral 8x22B
141B MoE · Mistral · Apache 2.0
tok/s
estimated15
TTFT
—
Min RAM
88 GB
42
#80
41
#81
Speed figures are single-stream decode at 4-bit quantization on an M5 Max unless the row’s mark says otherwise. Method & math →
1–81 of 81
Own the Mac already? See which of these 81 models fit your exact chip and unified memory →
Still choosing hardware? Three questions and the Mac Advisor names the config → · Every Mac compared for local AI →