Сборка GGUF для llama.cpp (Unsloth Dynamic Q4_K_M) на базе Qwen3.8-27B — один артефакт работает на Metal, CUDA и CPU. Контекст 262144 токена. Исходная модель мультимодальна (изображение и текст на входе, текст на выходе); этот пин покрывает ТОЛЬКО текстовые веса — зрительный проектор (mmproj) лежит отдельным артефактом и в манифест не входит.
Сборка GGUF для llama.cpp (Unsloth Dynamic Q4_K_M) на базе Qwen3.8-27B — один артефакт работает на Metal, CUDA и CPU. Контекст 262144 токена. Исходная модель мультимодальна (изображение и текст на входе, текст на выходе); этот пин покрывает ТОЛЬКО текстовые веса — зрительный проектор (mmproj) лежит отдельным артефактом и в манифест не входит.