Strata Qwen3.8 FN abliterated dual 16GB GPU + 128GB RAM
Have been running Qwen3.8 FN Q4 abliterated with stock llama.cpp on my machine. I get around ~28tps and ~400-600pp. I was actually quite happy with it until I saw people with Strata running it at 60tps running on 12GB VRAM laptops. I prefer using an abliterated becuase I dont want to fight it, when…
Read the full story at r/LocalLLM ↗
Timeline · 1 report
- 2026-09-30 10:37 · r/LocalLLM
Strata Qwen3.8 FN abliterated dual 16GB GPU + 128GB RAM