Model directory
29 models with published architecture specs. No account needed — pick one to see full specs, or sign in to size a deployment for it.
DeepSeek
GPT-OSS
Gemma
Llama
Llama 4 Scout (17B active / 109B total)
17B active / 109B total · 1/16 experts
10,485,760 token context · BF16 native
Llama 4 Maverick (17B active / 400B total)
17B active / 400B total · 1/128 experts
1,048,576 token context · BF16 native
Llama 3.1 8B
8.03B params
131,072 token context · BF16 native
Llama 3.1 70B
70.6B params
131,072 token context · BF16 native
Llama 3.3 70B
70.6B params
131,072 token context · BF16 native
Llama 3.1 405B
405B params
131,072 token context · BF16 native
Mistral
Phi
Qwen
Qwen3 32B
32.8B params
40,960 token context · BF16 native
Qwen3 30B-A3B
3.3B active / 30.5B total · 8/128 experts
40,960 token context · BF16 native
Qwen3 235B-A22B
22B active / 235B total · 8/128 experts
40,960 token context · BF16 native
Qwen3.6 27B
27B params
262,144 token context · BF16 native
Qwen3.6 35B-A3B
3B active / 35B total · 9/256 experts
262,144 token context · BF16 native
Qwen2.5 7B
7.6B params
131,072 token context · BF16 native
Qwen2.5 14B
14.7B params
131,072 token context · BF16 native
Qwen2.5 32B
32.5B params
131,072 token context · BF16 native
Qwen2.5 72B
72.7B params
131,072 token context · BF16 native