Сборка GGUF для llama.cpp (Q4_K_M) на базе Qwen3.5-27B — один артефакт работает на Metal, CUDA и CPU. В манифест входит проектор F16, поэтому запись читает не только текст, но и изображения.
Сборка GGUF для llama.cpp (Q4_K_M) на базе Qwen3.5-27B — один артефакт работает на Metal, CUDA и CPU. В манифест входит проектор F16, поэтому запись читает не только текст, но и изображения.