Sparsames Mixture-of-Experts-Modell, das an das Billionen-Parameter-Flaggschiff von Ant Group heranreicht, dabei aber deutlich weniger Parameter je Token aktiviert.
Steht für den Trend, Spitzenleistung nicht über Größe, sondern über Effizienz zu erreichen.