AINewsnow

48Gb VRAM speed AND quality ! (Qwen 3.8 27B Swift 1.5 W8A16)

Hi, Because sometimes you need both speed AND quality, I made my own Qwen 3.8 27B Swift 1.5 quant. It's an 8 bits AWQ + GPTQ quant. Made with love and precision (read the model card) on my 4 RTX 3090, I believe it's the best compromise you can actually get on 48Gb of VRAM. Running it with vLLM and…

Read the full story at r/LocalLLaMA ↗

Timeline · 1 report

  1. 2026-10-10 16:11 · r/LocalLLaMA
    48Gb VRAM speed AND quality ! (Qwen 3.8 27B Swift 1.5 W8A16)

More stories

  1. Qwen Image 2.1 Turbo Released -- Hugging Face — r/StableDiffusion
  2. Qwen 3.8 Flash Next is so much fun for three.js — r/LocalLLaMA
  3. Release: Qwen-2B-RCOL Dynamic Low-Bit Quantization (IQ1_M, IQ2_M, IQ3_M) — r/LocalLLaMA
  4. Qwen 3.6 35B A3B: 131K context + vision on 6GB VRAM — r/LocalLLaMA
  5. Hunyuan Image 3 vs Qwen Image 2.1 vs Krea 2 Turbo — r/StableDiffusion
  6. Success with Qwen3.8 27B GSQ-RCO-IQ3_S on 16GB VRAM — r/LocalLLM
  7. Alibaba Qwen Releases Qwen-Image-2.1-Turbo, an 8-Step 7B Image Model — MarkTechPost
  8. Conflicted. Need advise ? — r/LocalLLM

Get the daily brief of stories like this at 6:30 every morning →