Strata Qwen 3.8 flash next is the biggest thing since the release of Qwen 3.8 27b
It provides the speed and somewhat accessibility to low vram users to run Flash Next as their main. It's providing the speed of qwen 3.5-35-a3b but with higher intelligence over 3.8 27b. This will allow many people to replace 27b. I'm getting around 80-110 tok/s 2500 pp. 2x 3090's 96gb ddr5 ram. I'…
Read the full story at r/LocalLLaMA ↗
Timeline · 12 reports
- 2026-10-06 14:58 · r/LocalLLaMA
Qwen3.8-Flash-Next on Strata - 2026-10-06 10:37 · r/LocalLLaMA
NInfer6000 - Qwen 3.8 Flash Next @ 400 tg/s & 13K pp/s - 2026-10-05 17:38 · r/LocalLLM
Strata: Qwen 3.8 Flash next in loop - 2026-10-05 12:28 · r/LocalLLM
Strata for Windows/AMD GPUs, Qwen 3.8 Flash Next with large (128K+) context coding performance - 2026-10-05 10:50 · r/LocalLLaMA
MoE SSD streaming on a 64 GB Mac mini: GPU still waits 27% of decode on experts. Ideas? - 2026-10-05 07:27 · r/LocalLLM
4x 3080 20GB (modded, alibaba) + Strata (Qwen Flash Next 125B IQ3_XXS) = 105 t/s generation 5000 prompt processing on 150k context - 2026-10-05 07:21 · r/LocalLLM
Upgrade existing PC to run Qwen 3.8 Flash Next via Strata or swap to a Strix Halo? - 2026-10-05 06:44 · r/LocalLLaMA
I got Qwen Flash Next Q4 running on a Mac Mini m5 64gb with ssd streaming - 2026-10-05 06:35 · r/LocalLLM
Got Qwen Flash Next Q4 running on my Mac Mini M5 64GB with ssd streaming - 2026-10-05 06:10 · r/LocalLLM
Qwen Flash Next on Single B200 or B300, any pointers ? - 2026-10-04 02:48 · r/LocalLLM
Anyone tried strata qwen.38 flash next on a RX6700XT? - 2026-10-03 23:44 · r/LocalLLaMA
Strata Qwen 3.8 flash next is the biggest thing since the release of Qwen 3.8 27b