Filters

-
-
-
Reset

Open-Weight LLM Models — Live Ranking, Benchmarks & Specs

Explore, filter and compare open-weight language models with live specs, benchmarks and license data

Open Weights

Parameters

763.0B total / 16.0B active

Released

10.09.26

MoE
DeepSeek
MIT License
Openness Score 1.0
Open Weights

Parameters

305.0B total / 13.0B active

Released

08.09.26

MoE with vision encoder and aligner, DFlash attention, DSpark speculative decoding
DeepSeek
MIT License
Openness Score 1.0

MiniCPM5-2B

OpenBMB

Open Weights

Parameters

2.5B

Released

08.09.26

LlamaForCausalLM
MiniCPM
Apache License 2.0
Openness Score 1.0

Spark-X2.5-4B

SparkLLM (XHToken)

Open Weights

Parameters

4.0B

Released

01.09.26

Hybrid attention transformer: 1 full-attention layer combined with 3 sliding-window attention (SWA) layers, natively supporting up to 1M-token context
Spark-X2.5
Apache License 2.0
Openness Score 1.0

Spark-X2.5-1.7B

SparkLLM (XHToken)

Open Weights

Parameters

2.0B

Released

01.09.26

Hybrid attention transformer: 1 full-attention layer combined with 3 sliding-window attention (SWA) layers, natively supporting up to 1M-token context
Spark-X2.5
Apache License 2.0
Openness Score 1.0

Hy4 preview

Tencent

Open Weights

Parameters

770.0B total / 49.0B active

Released

28.08.26

MoE (78 layers) with Gated DeepSeek Sparse Attention (Gated DSA) + IndexCache cross-layer sparse index reuse, iHC (identity Hyper-Connections) residual streams, 1 native MTP layer (10B total / 0.7B active) for speculative decoding
Hunyuan
Apache License 2.0
Openness Score 1.0

GLM-5.3-Flash

Zhipu AI

Open Weights

Parameters

320.0B total / 18.0B active

Released

27.08.26

Hybrid sparse + linear attention MoE with mHC
GLM
MIT License
Openness Score 1.0

Qwen3.8-Flash-Next

Qwen Team (Alibaba)

Open Weights

Parameters

125.0B total / 6.0B active

Released

26.08.26

Hybrid Attention (Gated DeltaNet + Qwen Sparse Attention) with MoE, N-gram Embedding, and Gated Residual
Qwen
Qwen Community License 1.0
Openness Score 0.7
Open Weights

Parameters

3.0B

Released

25.08.26

GraniteForCausalLM
Granite
Apache License 2.0
Openness Score 1.0

GLM-5.3

Zhipu AI

Open Weights

Parameters

753.3B total / 43.0B active

Released

25.08.26

MoE with IndexShare sparse attention (DSA) + MTP layer
GLM
GLM-5.3 License
Openness Score 0.7

Ornith-1.5-35B-A3B

Ornith AI

Open Weights

Parameters

36.0B total / 3.0B active

Released

18.08.26

Mixture-of-Experts (qwen3_5_moe)
Ornith-1.5
MIT License
Openness Score 1.0
Open Weights

Parameters

1.7T total / 49.0B active

Released

13.08.26

MoE with DSpark speculative decoding module
DeepSeek
MIT License
Openness Score 1.0

Muse-Glimmer-30B

Meta Superintelligence Lab

Open Weights

Parameters

29.6B

Released

09.08.26

Dense Causal Transformer with Perception Encoder
Muse Glimmer
Apache License 2.0
Openness Score 1.0
Open Weights

Parameters

2.4T total / 95.0B active

Released

08.08.26

92-layer hybrid MoE: 23 x (3 x (Gated DeltaNet -> MoE) + 1 x (Gated Attention -> MoE)); 512 experts (10 routed + 1 shared, dim 2048); hidden 8192; GDN 128V/16QK dim 128; GA 64Q/4KV dim 256; MTP multi-steps; ctx 262144 -> 1010000.
Qwen3.8
Qwen3.8-Max License
Openness Score 0.7

Qwen3.8-27B

Qwen Team (Alibaba Cloud)

Open Weights

Parameters

27.0B

Released

05.08.26

Hybrid Gated DeltaNet + Gated Attention (dense, vision-language)
Qwen3.8
Apache License 2.0
Openness Score 1.0

LFM2.5-2.6B

LiquidAI

Open Weights

Parameters

2.7B

Released

04.08.26

LFM2 (Hybrid)
LFM
LFM Open License v1.0
Openness Score 0.7
Open Weights

Parameters

304.0B total / 13.0B active

Released

31.07.26

MoE with DSpark speculative decoding module
DeepSeek
MIT License
Openness Score 1.0

Hy3

Tencent

Open Weights

Parameters

295.0B total / 21.0B active

Released

02.07.26

MoE (80 layers + 1 MTP) with GQA (64 heads/8 KV) + QK-Norm, 192 experts top-8 + 1 shared expert, sigmoid router with expert bias
Hunyuan
Apache License 2.0
Openness Score 1.0

Ornith-1.0-35B-A3B

Ornith AI

Open Weights

Parameters

35.0B total / 3.0B active

Released

01.07.26

Mixture-of-Experts (qwen3_5_moe)
Ornith-1.0
MIT License
Openness Score 1.0
Open Weights

Parameters

291.0B total / 13.0B active

Released

26.06.26

MoE
DeepSeek
MIT License
Openness Score 1.0
Previous Page 1 of 4 Next