Index/Leaderboard
Index / Open-weight models on Apple Silicon

The local LLM leaderboard

According to the LLMCheck index, 81 open-weight models are scored 0–100 on capability, speed on Apple Silicon, RAM accessibility, and license openness. Every speed figure below carries a provenance mark — sourced, estimated, or community — so you can trace any number back to where it came from. Nothing here is unattributed.

Provenance key
sourced
Vendor-published figure
estimated
community
Linked third-party run
Fits in License 81 of 81 shown
# Model Score0–100 composite Speedtok/s decode TTFTseconds RAMunified min License
1 Qwen3.8-27B
27.8B · Q4_K_M · Alibaba
71
estimated29 19 GB Apache 2.0
2 DeepSeek V4 Flash
284B MoE · Q4_K_M · DeepSeek
70
community39 community0.4 120 GB MIT
3 KAT-Coder-V2.5
35B MoE · Q4_K_M · Kwaipilot
70
estimated52 estimated0.3 24 GB Apache 2.0
4 Maple Preview 20B-A1B
20B MoE · Q4_K_M · DeepGrove
70
sourced281 sourced0.1 6 GB MIT
5 Qwen 3.6-27B
27B · Q4_K_M · Alibaba
70
estimated30 estimated0.3 18 GB Apache 2.0
6 GLM 5.2
753B MoE · Q4_K_M · Zhipu AI
69
community22 community1.5 256 GB MIT
7 Nemotron 3.5 Lightning
30B MoE · Q4_K_M · NVIDIA
69
estimated60 estimated0.2 18 GB OpenMDW
8 Qwen 3.6-35B-A3B
35B MoE · Q4_K_M · Alibaba
69
estimated48 estimated0.8 24 GB Apache 2.0
9 Nanbeige4.2-3B
3B · Q4_K_M · Nanbeige
68
estimated199 estimated0.2 2 GB Apache 2.0
10 Muse Glimmer 30B
30B · Q4_K_M · Meta
67
sourced27 sourced0.4 18 GB Apache 2.0
11 Gemma 4 26B-A4B
26B MoE · Q4_K_M · Google
65
estimated50 estimated0.5 18 GB Apache 2.0
12 Laguna XS 2.1
33B MoE · Q4_K_M · Poolside
65
estimated55 estimated0.3 24 GB OpenMDW
13 Bonsai 27B
27B · Q4_K_M · Prism ML
64
estimated30 estimated0.2 6 GB Apache 2.0
14 DeepSeek R1 8B
8B · Q4_K_M · DeepSeek
64
estimated91 estimated0.5 6 GB MIT
15 Gemma 4 31B
31B · Q4_K_M · Google
64
estimated26 estimated0.9 24 GB Apache 2.0
16 Gemma 4 E4B
4B · Q4_K_M · Google
64
estimated161 estimated0.2 3 GB Apache 2.0
17 Phi-4 Mini
3.8B · Q4_K_M · Microsoft
64
estimated168 estimated0.3 3 GB MIT
18 DeepSeek V4 Pro
1.6T MoE · Q4_K_M · DeepSeek
63
850 GB MIT
19 Inkling-Small
276B MoE · Q4_K_M · Thinking Machines
63
estimated22 estimated0.8 96 GB Apache 2.0
20 Apertus 1.5 8B
8B · Q4_K_M · Swiss AI
62
estimated91 estimated0.3 5 GB Apache 2.0
21 GLM-4.7-Flash
31B · Q4_K_M · Zhipu AI
61
estimated26 estimated0.3 18 GB MIT
22 GLM-5.1
754B MoE · Q4_K_M · Zhipu AI
61
390 GB MIT
23 Gemma 4 E2B
2B · Q4_K_M · Google
61
estimated261 estimated0.1 2 GB Apache 2.0
24 Mistral 7B
7B · Q4_K_M · Mistral
61
estimated102 estimated0.4 5 GB Apache 2.0
25 Qwen 3 8B
8B · Q4_K_M · Alibaba
61
estimated91 estimated0.4 6 GB Apache 2.0
26 Qwen 3.5 9B
9B · Q4_K_M · Alibaba
61
estimated82 estimated0.5 7 GB Apache 2.0
27 Qwen3-235B-A22B
235B MoE · Q4_K_M · Alibaba
61
estimated18 estimated1.8 128 GB Apache 2.0
28 Kimi K2.6
1T MoE · Q4_K_M · Moonshot AI
60
600 GB Modified MIT
29 LFM2.5-2.6B
2.6B · Q4_K_M · Liquid AI
60
sourced220 sourced0.1 2 GB LFM Open
30 Laguna S 2.1
118B MoE · Q4_K_M · Poolside
60
estimated26 estimated0.6 96 GB OpenMDW
31 Ministral 8B
8B · Q4_K_M · Mistral
60
estimated91 estimated0.4 6 GB Apache 2.0
32 Nemotron-Cascade 2
30B MoE · Q4_K_M · NVIDIA
60
estimated35 estimated0.9 18 GB NVIDIA Open
33 Qwen 3.5 4B
4B · Q4_K_M · Alibaba
60
estimated161 estimated0.2 3 GB Apache 2.0
34 Kimi K2.5
1T MoE · Q4_K_M · Moonshot AI
59
600 GB Modified MIT
35 Qwen 3 4B
4B · Q4_K_M · Alibaba
59
estimated161 estimated0.2 3 GB Apache 2.0
36 DeepSeek V3.2-Speciale
685B MoE · Q4_K_M · DeepSeek
58
360 GB MIT
37 Inkling
975B MoE · Q4_K_M · Thinking Machines
58
550 GB Apache 2.0
38 Kimi K3
2.8T MoE · Q4_K_M · Moonshot AI
58
1560 GB Moonshot Custom
39 Qwen3-Coder-Next
80B MoE · Q4_K_M · Alibaba
58
estimated35 estimated0.4 48 GB Apache 2.0
40 Qwen3.8-2.4T-A95B
2.4T MoE · Q4_K_M · Alibaba
58
1310 GB Qwen Custom
41 SmolLM3 3B
3B · Q4_K_M · HuggingFace
58
estimated199 estimated0.1 2 GB Apache 2.0
42 Mistral Small 4
119B MoE · Q4_K_M · Mistral
57
estimated42 estimated0.8 64 GB Apache 2.0
43 GLM-4.5-Air
106B MoE · Q4_K_M · Zhipu AI
56
estimated30 estimated1.1 56 GB MIT
44 Gemma 3 4B
4B · Q4_K_M · Google
56
estimated161 estimated0.3 3 GB Gemma
45 Qwen 3.5 35B-A3B
35B MoE · Q4_K_M · Alibaba
56
estimated48 estimated0.9 24 GB Apache 2.0
46 DeepSeek V3.2
685B MoE · Q4_K_M · DeepSeek
55
360 GB MIT
47 Llama 3.1 8B
8B · Q4_K_M · Meta
55
estimated91 estimated0.4 5 GB Meta Custom
48 Phi-4 14B
14B · Q4_K_M · Microsoft
55
estimated55 estimated0.6 10 GB MIT
49 Qwen 3 14B
14B · Q4_K_M · Alibaba
54
estimated55 estimated0.9 10 GB Apache 2.0
50 Qwen 3 30B-A3B
30B MoE · Q4_K_M · Alibaba
54
estimated62 estimated0.7 18 GB Apache 2.0
51 Mistral Small 3.2 24B
24B · Q4_K_M · Mistral
53
estimated33 estimated0.7 14 GB Apache 2.0
52 Devstral Small 24B
24B · Q4_K_M · Mistral
52
estimated33 estimated0.7 14 GB Apache 2.0
53 Hunyuan Hy3
295B MoE · Q4_K_M · Tencent
52
estimated16 estimated0.9 160 GB Apache 2.0
54 MiniMax M2.5
230B MoE · Q4_K_M · MiniMax
52
estimated33 estimated0.7 130 GB Modified MIT
55 Ministral 3 14B
14B · Q4_K_M · Mistral
52
estimated55 estimated0.7 10 GB Apache 2.0
56 Qwen 2.5 14B
14B · Q4_K_M · Alibaba
52
estimated55 10 GB Apache 2.0
57 Gemma 3 12B
12B · Q4_K_M · Google
51
estimated64 estimated0.6 9 GB Gemma
58 Ling-3.0 Flash
124B MoE · Q4_K_M · Ant Group
51
96 GB MIT
59 Solar Open 2 250B
250B MoE · Q4_K_M · Upstage
51
160 GB Solar License
60 DeepSeek R1
671B MoE · Q4_K_M · DeepSeek
50
350 GB MIT
61 DeepSeek R1 32B
32B · Q4_K_M · DeepSeek
50
estimated25 estimated1.2 22 GB MIT
62 DeepSeek V3
685B MoE · Q4_K_M · DeepSeek
50
360 GB MIT
63 QwQ 32B
32B · Q4_K_M · Alibaba
50
estimated25 22 GB Apache 2.0
64 DeepSeek R1 70B
70B · Q4_K_M · DeepSeek
49
estimated12 estimated3.0 44 GB MIT
65 Qwen 3 32B
32B · Q4_K_M · Alibaba
49
estimated25 estimated1.1 22 GB Apache 2.0
66 Qwen 3.5 397B-A17B
397B MoE · Q4_K_M · Alibaba
49
210 GB Apache 2.0
67 Llama 4 Scout
109B MoE · Q4_K_M · Meta
48
estimated26 estimated1.5 58 GB Meta Custom
68 Step-3.5-Flash
196B MoE · Q4_K_M · StepFun
48
estimated18 120 GB Apache 2.0
69 GLM-4.7
355B · Q4_K_M · Zhipu AI
47
180 GB MIT
70 GPT-oss 120B
117B · Q4_K_M · OpenAI
47
estimated7 estimated5.5 62 GB Apache 2.0
71 Mistral Large 3
675B MoE · Q4_K_M · Mistral
47
355 GB Apache 2.0
72 Qwen 3.5 27B
27B · Q4_K_M · Alibaba
47
estimated30 18 GB Apache 2.0
73 Apertus 1.5 70B
70B · Q4_K_M · Swiss AI
46
estimated12 estimated0.9 44 GB Apache 2.0
74 Gemma 3 27B
27B · Q4_K_M · Google
46
estimated30 estimated0.9 18 GB Gemma
75 MiMo-V2-Flash
309B MoE · Q4_K_M · Xiaomi
45
165 GB MIT
76 Qwen 2.5 72B
72B · Q4_K_M · Alibaba
45
estimated12 estimated3.2 46 GB Apache 2.0
77 Llama 4 Maverick
400B MoE · Q4_K_M · Meta
44
210 GB Meta Custom
78 Llama 3.1 405B
405B · Q4_K_M · Meta
43
240 GB Meta Custom
79 Mixtral 8x22B
141B MoE · Q4_K_M · Mistral
43
estimated15 88 GB Apache 2.0
80 Hermes 4 70B
70B · Q4_K_M · Nous Research
42
estimated12 estimated1.8 38 GB Meta Custom
81 Llama 3.3 70B
70B · Q4_K_M · Meta
41
estimated12 estimated2.4 44 GB Meta Custom
71
#1
Qwen3.8-27B
27.8B · Alibaba · Apache 2.0
tok/s
estimated29
TTFT
Min RAM
19 GB
70
#2
DeepSeek V4 Flash
284B MoE · DeepSeek · MIT
tok/s
community39
TTFT
community0.4
Min RAM
120 GB
70
#3
KAT-Coder-V2.5
35B MoE · Kwaipilot · Apache 2.0
tok/s
estimated52
TTFT
estimated0.3
Min RAM
24 GB
70
#4
Maple Preview 20B-A1B
20B MoE · DeepGrove · MIT
tok/s
sourced281
TTFT
sourced0.1
Min RAM
6 GB
70
#5
Qwen 3.6-27B
27B · Alibaba · Apache 2.0
tok/s
estimated30
TTFT
estimated0.3
Min RAM
18 GB
69
#6
GLM 5.2
753B MoE · Zhipu AI · MIT
tok/s
community22
TTFT
community1.5
Min RAM
256 GB
69
#7
Nemotron 3.5 Lightning
30B MoE · NVIDIA · OpenMDW
tok/s
estimated60
TTFT
estimated0.2
Min RAM
18 GB
69
#8
Qwen 3.6-35B-A3B
35B MoE · Alibaba · Apache 2.0
tok/s
estimated48
TTFT
estimated0.8
Min RAM
24 GB
68
#9
Nanbeige4.2-3B
3B · Nanbeige · Apache 2.0
tok/s
estimated199
TTFT
estimated0.2
Min RAM
2 GB
67
#10
Muse Glimmer 30B
30B · Meta · Apache 2.0
tok/s
sourced27
TTFT
sourced0.4
Min RAM
18 GB
65
#11
Gemma 4 26B-A4B
26B MoE · Google · Apache 2.0
tok/s
estimated50
TTFT
estimated0.5
Min RAM
18 GB
65
#12
Laguna XS 2.1
33B MoE · Poolside · OpenMDW
tok/s
estimated55
TTFT
estimated0.3
Min RAM
24 GB
64
#13
Bonsai 27B
27B · Prism ML · Apache 2.0
tok/s
estimated30
TTFT
estimated0.2
Min RAM
6 GB
64
#14
DeepSeek R1 8B
8B · DeepSeek · MIT
tok/s
estimated91
TTFT
estimated0.5
Min RAM
6 GB
64
#15
Gemma 4 31B
31B · Google · Apache 2.0
tok/s
estimated26
TTFT
estimated0.9
Min RAM
24 GB
64
#16
Gemma 4 E4B
4B · Google · Apache 2.0
tok/s
estimated161
TTFT
estimated0.2
Min RAM
3 GB
64
#17
Phi-4 Mini
3.8B · Microsoft · MIT
tok/s
estimated168
TTFT
estimated0.3
Min RAM
3 GB
63
#18
DeepSeek V4 Pro
1.6T MoE · DeepSeek · MIT
tok/s
TTFT
Min RAM
850 GB
63
#19
Inkling-Small
276B MoE · Thinking Machines · Apache 2.0
tok/s
estimated22
TTFT
estimated0.8
Min RAM
96 GB
62
#20
Apertus 1.5 8B
8B · Swiss AI · Apache 2.0
tok/s
estimated91
TTFT
estimated0.3
Min RAM
5 GB
61
#21
GLM-4.7-Flash
31B · Zhipu AI · MIT
tok/s
estimated26
TTFT
estimated0.3
Min RAM
18 GB
61
#22
GLM-5.1
754B MoE · Zhipu AI · MIT
tok/s
TTFT
Min RAM
390 GB
61
#23
Gemma 4 E2B
2B · Google · Apache 2.0
tok/s
estimated261
TTFT
estimated0.1
Min RAM
2 GB
61
#24
Mistral 7B
7B · Mistral · Apache 2.0
tok/s
estimated102
TTFT
estimated0.4
Min RAM
5 GB
61
#25
Qwen 3 8B
8B · Alibaba · Apache 2.0
tok/s
estimated91
TTFT
estimated0.4
Min RAM
6 GB
61
#26
Qwen 3.5 9B
9B · Alibaba · Apache 2.0
tok/s
estimated82
TTFT
estimated0.5
Min RAM
7 GB
61
#27
Qwen3-235B-A22B
235B MoE · Alibaba · Apache 2.0
tok/s
estimated18
TTFT
estimated1.8
Min RAM
128 GB
60
#28
Kimi K2.6
1T MoE · Moonshot AI · Modified MIT
tok/s
TTFT
Min RAM
600 GB
60
#29
LFM2.5-2.6B
2.6B · Liquid AI · LFM Open
tok/s
sourced220
TTFT
sourced0.1
Min RAM
2 GB
60
#30
Laguna S 2.1
118B MoE · Poolside · OpenMDW
tok/s
estimated26
TTFT
estimated0.6
Min RAM
96 GB
60
#31
Ministral 8B
8B · Mistral · Apache 2.0
tok/s
estimated91
TTFT
estimated0.4
Min RAM
6 GB
60
#32
Nemotron-Cascade 2
30B MoE · NVIDIA · NVIDIA Open
tok/s
estimated35
TTFT
estimated0.9
Min RAM
18 GB
60
#33
Qwen 3.5 4B
4B · Alibaba · Apache 2.0
tok/s
estimated161
TTFT
estimated0.2
Min RAM
3 GB
59
#34
Kimi K2.5
1T MoE · Moonshot AI · Modified MIT
tok/s
TTFT
Min RAM
600 GB
59
#35
Qwen 3 4B
4B · Alibaba · Apache 2.0
tok/s
estimated161
TTFT
estimated0.2
Min RAM
3 GB
58
#36
DeepSeek V3.2-Speciale
685B MoE · DeepSeek · MIT
tok/s
TTFT
Min RAM
360 GB
58
#37
Inkling
975B MoE · Thinking Machines · Apache 2.0
tok/s
TTFT
Min RAM
550 GB
58
#38
Kimi K3
2.8T MoE · Moonshot AI · Moonshot Custom
tok/s
TTFT
Min RAM
1560 GB
58
#39
Qwen3-Coder-Next
80B MoE · Alibaba · Apache 2.0
tok/s
estimated35
TTFT
estimated0.4
Min RAM
48 GB
58
#40
Qwen3.8-2.4T-A95B
2.4T MoE · Alibaba · Qwen Custom
tok/s
TTFT
Min RAM
1310 GB
58
#41
SmolLM3 3B
3B · HuggingFace · Apache 2.0
tok/s
estimated199
TTFT
estimated0.1
Min RAM
2 GB
57
#42
Mistral Small 4
119B MoE · Mistral · Apache 2.0
tok/s
estimated42
TTFT
estimated0.8
Min RAM
64 GB
56
#43
GLM-4.5-Air
106B MoE · Zhipu AI · MIT
tok/s
estimated30
TTFT
estimated1.1
Min RAM
56 GB
56
#44
Gemma 3 4B
4B · Google · Gemma
tok/s
estimated161
TTFT
estimated0.3
Min RAM
3 GB
56
#45
Qwen 3.5 35B-A3B
35B MoE · Alibaba · Apache 2.0
tok/s
estimated48
TTFT
estimated0.9
Min RAM
24 GB
55
#46
DeepSeek V3.2
685B MoE · DeepSeek · MIT
tok/s
TTFT
Min RAM
360 GB
55
#47
Llama 3.1 8B
8B · Meta · Meta Custom
tok/s
estimated91
TTFT
estimated0.4
Min RAM
5 GB
55
#48
Phi-4 14B
14B · Microsoft · MIT
tok/s
estimated55
TTFT
estimated0.6
Min RAM
10 GB
54
#49
Qwen 3 14B
14B · Alibaba · Apache 2.0
tok/s
estimated55
TTFT
estimated0.9
Min RAM
10 GB
54
#50
Qwen 3 30B-A3B
30B MoE · Alibaba · Apache 2.0
tok/s
estimated62
TTFT
estimated0.7
Min RAM
18 GB
53
#51
Mistral Small 3.2 24B
24B · Mistral · Apache 2.0
tok/s
estimated33
TTFT
estimated0.7
Min RAM
14 GB
52
#52
Devstral Small 24B
24B · Mistral · Apache 2.0
tok/s
estimated33
TTFT
estimated0.7
Min RAM
14 GB
52
#53
Hunyuan Hy3
295B MoE · Tencent · Apache 2.0
tok/s
estimated16
TTFT
estimated0.9
Min RAM
160 GB
52
#54
MiniMax M2.5
230B MoE · MiniMax · Modified MIT
tok/s
estimated33
TTFT
estimated0.7
Min RAM
130 GB
52
#55
Ministral 3 14B
14B · Mistral · Apache 2.0
tok/s
estimated55
TTFT
estimated0.7
Min RAM
10 GB
52
#56
Qwen 2.5 14B
14B · Alibaba · Apache 2.0
tok/s
estimated55
TTFT
Min RAM
10 GB
51
#57
Gemma 3 12B
12B · Google · Gemma
tok/s
estimated64
TTFT
estimated0.6
Min RAM
9 GB
51
#58
Ling-3.0 Flash
124B MoE · Ant Group · MIT
tok/s
TTFT
Min RAM
96 GB
51
#59
Solar Open 2 250B
250B MoE · Upstage · Solar License
tok/s
TTFT
Min RAM
160 GB
50
#60
DeepSeek R1
671B MoE · DeepSeek · MIT
tok/s
TTFT
Min RAM
350 GB
50
#61
DeepSeek R1 32B
32B · DeepSeek · MIT
tok/s
estimated25
TTFT
estimated1.2
Min RAM
22 GB
50
#62
DeepSeek V3
685B MoE · DeepSeek · MIT
tok/s
TTFT
Min RAM
360 GB
50
#63
QwQ 32B
32B · Alibaba · Apache 2.0
tok/s
estimated25
TTFT
Min RAM
22 GB
49
#64
DeepSeek R1 70B
70B · DeepSeek · MIT
tok/s
estimated12
TTFT
estimated3.0
Min RAM
44 GB
49
#65
Qwen 3 32B
32B · Alibaba · Apache 2.0
tok/s
estimated25
TTFT
estimated1.1
Min RAM
22 GB
49
#66
Qwen 3.5 397B-A17B
397B MoE · Alibaba · Apache 2.0
tok/s
TTFT
Min RAM
210 GB
48
#67
Llama 4 Scout
109B MoE · Meta · Meta Custom
tok/s
estimated26
TTFT
estimated1.5
Min RAM
58 GB
48
#68
Step-3.5-Flash
196B MoE · StepFun · Apache 2.0
tok/s
estimated18
TTFT
Min RAM
120 GB
47
#69
GLM-4.7
355B · Zhipu AI · MIT
tok/s
TTFT
Min RAM
180 GB
47
#70
GPT-oss 120B
117B · OpenAI · Apache 2.0
tok/s
estimated7
TTFT
estimated5.5
Min RAM
62 GB
47
#71
Mistral Large 3
675B MoE · Mistral · Apache 2.0
tok/s
TTFT
Min RAM
355 GB
47
#72
Qwen 3.5 27B
27B · Alibaba · Apache 2.0
tok/s
estimated30
TTFT
Min RAM
18 GB
46
#73
Apertus 1.5 70B
70B · Swiss AI · Apache 2.0
tok/s
estimated12
TTFT
estimated0.9
Min RAM
44 GB
46
#74
Gemma 3 27B
27B · Google · Gemma
tok/s
estimated30
TTFT
estimated0.9
Min RAM
18 GB
45
#75
MiMo-V2-Flash
309B MoE · Xiaomi · MIT
tok/s
TTFT
Min RAM
165 GB
45
#76
Qwen 2.5 72B
72B · Alibaba · Apache 2.0
tok/s
estimated12
TTFT
estimated3.2
Min RAM
46 GB
44
#77
Llama 4 Maverick
400B MoE · Meta · Meta Custom
tok/s
TTFT
Min RAM
210 GB
43
#78
Llama 3.1 405B
405B · Meta · Meta Custom
tok/s
TTFT
Min RAM
240 GB
43
#79
Mixtral 8x22B
141B MoE · Mistral · Apache 2.0
tok/s
estimated15
TTFT
Min RAM
88 GB
42
#80
Hermes 4 70B
70B · Nous Research · Meta Custom
tok/s
estimated12
TTFT
estimated1.8
Min RAM
38 GB
41
#81
Llama 3.3 70B
70B · Meta · Meta Custom
tok/s
estimated12
TTFT
estimated2.4
Min RAM
44 GB
Speed figures are single-stream decode at 4-bit quantization on an M5 Max unless the row’s mark says otherwise. Method & math → 1–81 of 81

Own the Mac already? See which of these 81 models fit your exact chip and unified memory →
Still choosing hardware? Three questions and the Mac Advisor names the config → · Every Mac compared for local AI →