Сборка GGUF для llama.cpp (Q4_0, QAT) на базе Gemma 4 E4B IT. Один файл проектора несёт ОБА энкодера — clip.has_vision_encoder и clip.has_audio_encoder — поэтому запись читает и изображения, и речь на консенсусном движке GGUF за 6.1 ГБ вместо 18 ГБ, нужных торчовому пути.
Сборка GGUF для llama.cpp (Q4_0, QAT) на базе Gemma 4 E4B IT. Один файл проектора несёт ОБА энкодера — clip.has_vision_encoder и clip.has_audio_encoder — поэтому запись читает и изображения, и речь на консенсусном движке GGUF за 6.1 ГБ вместо 18 ГБ, нужных торчовому пути.