Apa itu model mixture-of-experts (MoE)?
Model mixture-of-experts menyimpan pool parameter besar dan hanya mengaktifkan subset untuk setiap langkah. Qwen3.8-Flash-Next didokumentasikan sebagai total 125B dengan 6B aktif per langkah. Efek praktisnya kapasitas lebih besar tanpa membayar penuh compute model dense di setiap langkah.