Xiaomi's open-source efficiency model: a 309B MoE with 15B active parameters per token and a hybrid attention mechanism.
Add a second model to compare.