Alibaba released Qwen3.8-27B on August 14, 2026 — Apache 2.0 open-weights vision-capable model with 262K native context (1M via YaRN), runnable on consumer GPUs. Q4_K_M quantization is about 18 GB on a 24 GB GPU. Most coverage is benchmarks — developers need practical local setup via Ollama, LM Studio, and vLLM.
Continue reading
Qwen3.8-27B: Running a Frontier-class Open Model on Your Local GPU
on SitePoint.
