Skip to content
AI Compute Radar
IndexCollected 24 min ago

Models

Everytrackedmodel.

One page per model: what it needs in memory, where it runs, and how it moves on the radar — all from measured readings and the same fit engine as the finder.

Every tracked model — memory, fit and momentum
#ModelMeasured fileHeatRuns comfortably at 8K
1Qwen3.8 Flash-NextAlibaba Qwen · general, coding, agents180B MoE · Q4_K · 103.7 GB850 of 14
2Llama 3.1 8BMeta · general, coding8B · Q4_K_M · 4.6 GB85unknown · attention shape unpublished
3Gemma 4 31BGoogle · general, research31.3B · Q4_K_M · 17.1 GB805 of 14
4Qwen3.8 27BAlibaba Qwen · general, coding, agents, research27.8B · Q4_K_M · 15.3 GB787 of 14
5Llama 3.2 3BMeta · general3B · Q4_K_M · 1.9 GB78unknown · attention shape unpublished
6Qwen3 8BAlibaba Qwen · general, coding, agents8.2B · Q4_K_M · 4.7 GB7714 of 14
7GLM-5.3-FlashZhipu AI · general, coding, agents321B · Q4_K · 186 GB760 of 14
8Gemma 4 26B-A4BGoogle · general, research25.8B MoE · Q4_K_M · 15.8 GB747 of 14
9Ornith 1.5 35B-A3BOrnith AI · general, coding, agents36B MoE · Q4_K_M · 20.2 GB715 of 14
10gpt-oss 20BOpenAI · general, agents, research20.9B MoE · Q4_K_M · 10.8 GB7112 of 14
11GLM-5.3Zhipu AI · general, agents, research753B · Q4_K · 435.2 GB700 of 14
12Qwen3 0.6BAlibaba Qwen · general0.6B · Q8_0 · 0.6 GB6914 of 14
13Ornith 1.5 9BOrnith AI · general, coding9.7B · Q4_K_M · 5.4 GB6814 of 14
14GLM-5.2Zhipu AI · coding, agents, research753B MoE · Q4_K_M · 433.8 GB670 of 14
15gpt-oss 120BOpenAI · general, research, agents117B MoE · Q4_K_M · 58.5 GB651 of 14
16Qwen3-Coder NextAlibaba Qwen · coding, agents79.7B MoE · Q4_K_M · 45.1 GB622 of 14
17Llama 3.3 70BMeta · general, research, agents70.6B · Q4_K_M · 39.6 GB582 of 14
18Gemma 4 E4BGoogle · general8B · Q4_K_M · 4.6 GB5714 of 14
19DeepSeek-V4-FlashDeepSeek · general, coding, research304B MoE · Q4_K · 144.4 GB550 of 14
20Qwen3 4BAlibaba Qwen · general, coding4B · Q4_K_M · 2.3 GB5214 of 14
21Gemma 4 12BGoogle · general, research12B · Q4_K_M · 6.6 GB5114 of 14
22Qwen3.8 2.4T-A95BAlibaba Qwen · general, agents, research2.4T-A95B · IQ4_XS · 1220.8 GB500 of 14
23Granite 4.2 3BIBM · general, agents3.7B · Q4_K_M · 2.1 GB4814 of 14
24Gemma 3 27BGoogle · general, research27.4B · Q4_K_M · 15.4 GB467 of 14
25Granite 4.2 8BIBM · general, coding, agents8.8B · Q4_K_M · 5 GB4614 of 14
26GLM-4.7-FlashZhipu AI · coding, agents31.2B MoE · Q4_K_M · 17.1 GB407 of 14
27Ornith 1.5 397BOrnith AI · general, coding, research403B MoE · Q4_K_M · 227.5 GB400 of 14
28Qwen3 14BAlibaba Qwen · general, coding, research14.8B · Q4_K_M · 8.4 GB3912 of 14
29Granite 4.2 30BIBM · general, coding, agents29.3B · Q4_K_M · 16.5 GB395 of 14
30Mistral Small 3.2Mistral AI · general, agents24B · Q4_K_M · 13.3 GB377 of 14
31DeepSeek-V4-ProDeepSeek · research, coding, agents1650B MoE · Q4_K · 791.3 GB350 of 14
32Hy3Tencent · general, research299B MoE · Q4_K_M · 166.3 GB340 of 14
33Qwen3-Coder 30B-A3BAlibaba Qwen · coding, agents30.5B MoE · Q4_K_M · 17.3 GB335 of 14
34Devstral Small 2 24BMistral AI · coding, agents24B · Q4_K_M · 13.3 GB327 of 14
35KAT-Coder V2.5Kwaipilot · coding, agents34.7B MoE · Q4_K_M · 19.9 GB305 of 14
36LFM2.5 8B-A1BLiquid AI · general, agents8.5B MoE · Q4_K_M · 4.8 GB2814 of 14
37Phi-4 MiniMicrosoft · general3.8B · Q4_K_M · 2.3 GB2814 of 14
38GLM-4.5-AirZhipu AI · coding, agents, general, research110B MoE · Q4_K_M · 68 GB281 of 14
39LFM2.5 2.6BLiquid AI · general, agents2.7B · Q4_K_M · 1.6 GB2714 of 14
40Ling 3.0 TinyInclusionAI · general, agents7.9B MoE · Q4_K_M · 4.5 GB2614 of 14
41Qwen3 32BAlibaba Qwen · general, coding, research, agents32.8B · Q4_K_M · 18.4 GB265 of 14
42Ling 3.0 FlashInclusionAI · general, agents127B MoE · Q4_K_M · 70.1 GB251 of 14
43Qwen AgentWorld 35B-A3BAlibaba Qwen · agents, coding34.7B MoE · Q4_K_M · 20.6 GB255 of 14
44LFM2.5 1.2BLiquid AI · general1.2B · Q4_K_M · 0.7 GB1814 of 14
45Nemotron Nano 9B v2NVIDIA · general, research8.9B · Q4_K_M · 6.1 GB1814 of 14
46DeepSeek-R1DeepSeek · research685B MoE · Q4_K_M · 376.7 GBcollecting0 of 14

Comfortable = EXCELLENT or GOOD on that device at 8K context. Models without a measured open-weights file show no fit.