BEGIN:VCALENDAR
VERSION:2.0
PRODID:-//Allsikt//Article Deadline//EN
CALSCALE:GREGORIAN
METHOD:PUBLISH
BEGIN:VEVENT
UID:a3d5b0517e4490018d0a03ff1540a5d537fbe9eb@allsikt.tech
DTSTAMP:20260722T215754Z
DTSTART;VALUE=DATE:20260722
DTEND;VALUE=DATE:20260723
SUMMARY:Qwen 27B FP8 Quantized Model Runs on 48GB GPU with vLLM 0.20.1
DESCRIPTION:Run Qwen3.6‑27B‑FP8 on a 48‑GB GPU using vLLM 0.20.1 and CUDA 12.9 to achieve ~80 TPS with BF16 KV cache and Blackwell FP8 acceleration.\n\nSource: Reddit r/LocalLLaMA\nOpen: https://allsikt.se/article/qwen-27b-fp8-quantized-model-runs-on-48gb-gpu-with-vllm-0-20-1-849de82d
URL:https://allsikt.se/article/qwen-27b-fp8-quantized-model-runs-on-48gb-gpu-with-vllm-0-20-1-849de82d
STATUS:CONFIRMED
TRANSP:TRANSPARENT
END:VEVENT
END:VCALENDAR
