BEGIN:VCALENDAR
VERSION:2.0
PRODID:-//Allsikt//Article Deadline//EN
CALSCALE:GREGORIAN
METHOD:PUBLISH
BEGIN:VEVENT
UID:d9c3ccce01b7deb6eeb7ec082e72fec0a8300d53@allsikt.tech
DTSTAMP:20260722T082611Z
DTSTART;VALUE=DATE:20260722
DTEND;VALUE=DATE:20260723
SUMMARY:Qwen 3.6 27B Q8 on four Nvidia RTX A4000 (16GB each) with Llama.cpp and MTP enabled
DESCRIPTION:Run Qwen 3.6 27B Q8 on four RTX A4000 GPUs with Llama.cpp and MTP to achieve ~45 tokens/s for reasoning and ~60 tokens/s for coding.\n\nSource: Reddit r/LocalLLaMA\nOpen: https://allsikt.se/article/qwen-3-6-27b-q8-on-four-nvidia-rtx-a4000-16gb-each-with-llama-cpp-and-mtp-enabled-301c5a5f
URL:https://allsikt.se/article/qwen-3-6-27b-q8-on-four-nvidia-rtx-a4000-16gb-each-with-llama-cpp-and-mtp-enabled-301c5a5f
STATUS:CONFIRMED
TRANSP:TRANSPARENT
END:VEVENT
END:VCALENDAR
