Сборка GGUF для llama.cpp (Q4_K_M) на базе Qwen3.5-9B — один артефакт работает на Metal, CUDA и CPU; именно на нём проверялся консенсусный движок GGUF. В манифест входит проектор F16, поэтому запись читает не только текст, но и изображения.
Сборка GGUF для llama.cpp (Q4_K_M) на базе Qwen3.5-9B — один артефакт работает на Metal, CUDA и CPU; именно на нём проверялся консенсусный движок GGUF. В манифест входит проектор F16, поэтому запись читает не только текст, но и изображения.