[r/LocalLLaMA]score: 0.26
Qwen3.8-2.4T-A95B Released
August 12, 2026
Qwen3.8-2.4T-A95B introduces a 2.4 trillion parameter architecture utilizing 95 billion active parameters per token via a Mixture-of-Experts approach. This release optimizes compute efficiency by activating only a fraction of total parameters during inference, targeting higher throughput for large-scale generative tasks.
DAILY DIGEST
you don't check 9 sources — we do. one email every morning, read in 2 min. free. unsubscribe anytime. privacy