Alibaba har udgivet Qwen3.8-2.4T-A95B, en ny stor sprogmodel med 2,4 billioner parametre, men kun 95 milliarder aktiveres per forespørgsel. Modellen er en Mixture-of-Experts (MoE) arkitektur, der gør den markant mere effektiv i drift end tætte modeller af samme størrelse. Se modelkortet på Hugging Face.

For beslutningstagere er det centrale ikke parametertallet, men at vægtene er offentligt tilgængelige. Det betyder, at virksomheder kan køre modellen på egen infrastruktur uden at betale per-token til en cloud-udbyder. Den aktive parameterstørrelse på 95 milliarder placerer den i samme klasse som andre åbne modeller, men med en langt større samlet kapacitet — en kombination der historisk har givet stærke resultater på komplekse opgaver.

Strategisk set kan dette presse priserne på AI-inferens. Når en åben model med denne skala kan køres internt, mindskes afhængigheden af lukkede API'er. For virksomheder, der overvejer at bygge egne AI-løsninger, er spørgsmålet ikke længere kun, om man skal købe eller bygge — men om man kan få samme kvalitet til en brøkdel af de løbende omkostninger.