llama.cpp在3090上部署Qwen3.8-27B
1 unsloth/Qwen3.8-27B-GGUF at main 最高画质4bit量化 2 ./llama-server -m ..\models\Qwen3.8-27B-UD-Q4_K_XL.gguf --mmproj ..\models\mmproj-Qwen3.8-27B-Uncensored-HauhauCS-Aggressive-BF16.gguf -ngl 999 -fa on -c 65536 -ctk q4_0 -ctv q4_0 -b 2048 -ub 512 --te…
2026/8/26 20:48:17