Сборка GGUF для llama.cpp (Q4_K_M) на базе Qwen3.5-9B — один артефакт работает на Metal, CUDA и CPU; именно на нём проверялся консенсусный движок GGUF.
Сборка GGUF для llama.cpp (Q4_K_M) на базе Qwen3.5-9B — один артефакт работает на Metal, CUDA и CPU; именно на нём проверялся консенсусный движок GGUF.