Модели
Каталог из 89 открытых моделей для запуска в сети AETRON: LLM, генерация изображений, видео, речь и эмбеддинги. Лицензия, требования к памяти и параметры — у каждой записи.
- Qwen2.5-0.5B-Instruct · Alibaba / Qwen
Крошечная LLM на 0.5B с инструктивной настройкой — работает на пограничных устройствах и на CPU.
- Qwen2.5-0.5B-Instruct (bnb-4bit) · Alibaba / Qwen
4-битная сборка (bnb NF4): крошечная LLM на 0.5B с инструктивной настройкой — работает на пограничных устройствах и на CPU.
- Qwen3.5-9B · Alibaba / Qwen
Плотная LLM на 9B поколения Qwen3.5 (02.2026). Сильна в рассуждениях, коде и многоязычном диалоге.
- Qwen3.5-9B (FP8-dynamic) · Alibaba / Qwen
Готовая сборка FP8 (compressed-tensors): плотная LLM на 9B поколения Qwen3.5 (02.2026). Сильна в рассуждениях, коде и многоязычном диалоге.
- Qwen3.5-9B (w4a16) · Alibaba / Qwen
Готовая сборка INT4 W4A16 (compressed-tensors): плотная LLM на 9B поколения Qwen3.5 (02.2026). Сильна в рассуждениях, коде и многоязычном диалоге.
- Qwen-Image · Alibaba Qwen
Текст-в-картинку на 20B MMDiT. Лучший в классе рендер текста, английский и китайский.
- Qwen3.6-27B · Alibaba / Qwen
Свежайшая плотная Qwen: изначально мультимодальный флагман на 27B.
- Qwen3.6-27B (NVFP4 (Blackwell)) · Alibaba / Qwen
Готовая сборка NVFP4 (Blackwell) для Qwen3.6-27B. Экспорт ModelOpt — ждёт поддержки в рантайме (загрузчика modelopt в transformers нет); пока только в каталоге.
- Qwen3.6-27B (official FP8) · Alibaba / Qwen
Готовая официальная сборка FP8 для Qwen3.6-27B.
- Qwen3.6-35B-A3B · Alibaba / Qwen
MoE на 35B с ~3B активных: качество почти как у 27B, но заметно быстрее.
- Qwen3.6-35B-A3B (NVFP4 (compressed-tensors)) · Alibaba / Qwen
Готовая сборка NVFP4 (compressed-tensors) — работает на флотском стеке (compressed-tensors). Окно Blackwell.
- Qwen3.6-35B-A3B (official FP8) · Alibaba / Qwen
Готовая официальная сборка FP8 для Qwen3.6-35B-A3B.
- Qwen3.5-4B · Alibaba / Qwen
Компактная модель на 4B для потребительских видеокарт и пограничных устройств.
- Qwen3.5-4B (INT4 W4A16) · Alibaba / Qwen
Готовая сборка INT4 W4A16 для Qwen3.5-4B.
- Qwen3.5-4B (FP8-dynamic) · Alibaba / Qwen
Готовая сборка FP8-dynamic для Qwen3.5-4B.
- Qwen3.5-27B · Alibaba / Qwen
Плотная модель на 27B прошлого поколения, проверенная в бою.
- Qwen3.5-27B (official GPTQ-Int4) · Alibaba / Qwen
Готовая официальная сборка GPTQ-Int4 для Qwen3.5-27B.
- Qwen3.5-9B (GGUF Q4_K_M) · Alibaba / Qwen (GGUF: unsloth)
Сборка GGUF для llama.cpp (Q4_K_M) на базе Qwen3.5-9B — один артефакт работает на Metal, CUDA и CPU; именно на нём проверялся консенсусный движок GGUF.
- Qwen3.5-27B (GGUF Q4_K_M) · Alibaba / Qwen (GGUF: unsloth)
Сборка GGUF для llama.cpp (Q4_K_M) на базе Qwen3.5-27B — один артефакт работает на Metal, CUDA и CPU.
- Qwen3.5-27B (GGUF Q8_0) · Alibaba / Qwen (GGUF: unsloth)
Сборка GGUF для llama.cpp (Q8_0, 8 бит) на базе Qwen3.5-27B — та же модель, но квант точнее; отдельная запись, потому что другой артефакт означает другой model_hash.
- Qwen3.8-27B (GGUF UD-Q4_K_M) · Alibaba / Qwen (GGUF: unsloth)
Сборка GGUF для llama.cpp (Unsloth Dynamic Q4_K_M) на базе Qwen3.8-27B — один артефакт работает на Metal, CUDA и CPU. Контекст 262144 токена. Исходная модель мультимодальна (изображение и текст на входе, текст на выходе); этот пин покрывает ТОЛЬКО текстовые веса — зрительный проектор (mmproj) лежит отдельным артефактом и в манифест не входит.
- Qwen3.5-27B (official FP8) · Alibaba / Qwen
Готовая официальная сборка FP8 для Qwen3.5-27B.
- Qwen3.5-35B-A3B · Alibaba / Qwen
Qwen3.5 MoE 35B-A3B.
- Qwen3.5-35B-A3B (official GPTQ-Int4) · Alibaba / Qwen
Готовая официальная сборка GPTQ-Int4 для Qwen3.5-35B-A3B.
- Qwen3.5-35B-A3B (official FP8) · Alibaba / Qwen
Готовая официальная сборка FP8 для Qwen3.5-35B-A3B.
- Qwen3-Coder-30B-A3B · Alibaba / Qwen
Кодовая MoE с контекстом 256K и ~3B активных параметров.
- Qwen3-Coder-30B-A3B (official FP8) · Alibaba / Qwen
Готовая официальная сборка FP8 для Qwen3-Coder-30B-A3B.
- Gemma 4 E4B IT · Google
Экономичная Gemma 4 на 4B с инструктивной настройкой.
- Gemma 4 12B · Google
Gemma 4 среднего размера.
- Gemma 4 31B · Google
Плотный флагман Gemma 4.
- Gemma 4 31B (official QAT W4A16) · Google
Готовая официальная сборка QAT W4A16 для Gemma 4 31B.
- Gemma 4 31B (FP8-block) · Google
Готовая сборка FP8-block для Gemma 4 31B.
- Ministral 3 8B · Mistral AI
Модель на 8B со зрением из линейки Ministral 3, рассчитанной на пограничные устройства.
- Ministral 3 14B · Mistral AI
Более крупная Ministral 3, тоже со зрением.
- Ministral 3 14B (FP8-dynamic) · Mistral AI
Готовая сборка FP8-dynamic для Ministral 3 14B.
- Phi-4 · Microsoft
Microsoft Phi-4 на 14.7B.
- Phi-4 (FP8-dynamic) · Microsoft
Готовая сборка FP8-dynamic для Phi-4.
- Phi-4-mini · Microsoft
Phi-4-mini на 3.8B для небольших видеокарт и CPU.
- SmolLM3-3B · Hugging Face
Крошечная модель на 3B для пограничных устройств и сценариев рядом с браузером.
- Nemotron-3 Nano 4B · NVIDIA
Гибридная Mamba-2 Nano на 4B с длинным контекстом.
- Nemotron-3 Nano 30B-A3B · NVIDIA
Nano MoE 30B-A3B, контекст до 1M.
- Nemotron-3 Nano 30B-A3B (FP8) · NVIDIA
Готовая сборка FP8 для Nemotron-3 Nano 30B-A3B.
- gpt-oss-20b · OpenAI
MoE на 21B в нативном MXFP4; уровень o3-mini в 16 ГБ.
- GLM-4.7-Flash · Z.ai
Потребительская GLM на 31B.
- GLM-4.7-Flash (FP8-dynamic) · Z.ai
Готовая сборка FP8-dynamic для GLM-4.7-Flash.
- DeepSeek-V4-Pro · DeepSeek
Передовая MoE на 1.6T со встроенными режимами Think.
- DeepSeek-V4-Pro (NVFP4-FP8 (compressed-tensors)) · DeepSeek
Готовая сборка NVFP4-FP8 (compressed-tensors) — работает на флотском стеке (compressed-tensors). Окно Blackwell.
- DeepSeek-V4-Flash · DeepSeek
Меньшая и более быстрая V4: 284B при 13B активных.
- DeepSeek-V4-Flash (NVFP4-FP8 (compressed-tensors)) · DeepSeek
Готовая сборка NVFP4-FP8 (compressed-tensors) — работает на флотском стеке (compressed-tensors). Окно Blackwell.
- Kimi-K3 · Moonshot AI
MoE на 2.8T, первая открытая модель класса 3T, MXFP4 QAT.
- Kimi-K3 (NVFP4) · Moonshot AI
Готовая сборка NVFP4 для Kimi-K3.
- GLM-5.2 · Z.ai
MoE на 753B с разреженным вниманием и контекстом 1M.
- GLM-5.2 (official FP8) · Z.ai
Готовая официальная сборка FP8 для GLM-5.2.
- Qwen3-Coder-Next · Alibaba / Qwen
Открытая кодовая модель уровня SOTA, 80B-A3B.
- Qwen3-Coder-Next (official FP8) · Alibaba / Qwen
Готовая официальная сборка FP8 для Qwen3-Coder-Next.
- Llama 4 Scout · Meta
Llama 4 Scout: 109B при 17B активных.
- Nemotron-3 Super 120B-A12B · NVIDIA
Super 120B-A12B: помещается на одну карту 80 ГБ в 4 битах.
- gpt-oss-120b · OpenAI
MoE на 117B в нативном MXFP4: одна видеокарта на 80 ГБ.
- Mistral Small 4 119B · Mistral AI
Объединённая модель инструкций и рассуждений на 119B.
- Mistral Small 4 119B (official NVFP4) · Mistral AI
Готовая официальная сборка NVFP4 для Mistral Small 4 119B. Экспорт в формате Mistral (без config.json) — ждёт поддержки в рантайме; пока только в каталоге.
- FLUX.2 [klein] 4B · Black Forest Labs
Дистиллированная потребительская FLUX.2 на 4B.
- FLUX.2 [klein] 9B · Black Forest Labs
Более крупная klein: 9B.
- FLUX.2 [dev] · Black Forest Labs
Флагманский DiT на 32B.
- Qwen-Image 2.0 · Alibaba / Qwen
Qwen-Image 2.0: лучший в классе рендер текста.
- Z-Image Turbo · Tongyi-MAI
S3-DiT на 6B: лучшее качество на гигабайт, около 2 с на изображение на 4090.
- Chroma1-HD · Lodestone Rock
База под лицензией Apache для дообучения без ограничений.
- Wan 2.2 TI2V-5B · Alibaba / Wan-AI
Модель на 5B: видео из текста и из изображения. Зеркало diffusers: исходный репозиторий отдаёт VAE и T5 в формате pickle, который загрузчик отвергает.
- Wan 2.2 T2V-A14B · Alibaba / Wan-AI
Видео-MoE, 27B суммарно при 14B активных. Зеркало diffusers; оба эксперта остаются в памяти, поэтому видеопамять считается на пару.
- HunyuanVideo 1.5 · Tencent
Видеомодель на 8.3B, текст-в-видео 480p. Зеркало diffusers: исходный репозиторий требует собственный пакет hyvideo от Tencent и не содержит текстового энкодера.
- LTX-2.3 · Lightricks
Генерация видео со звуком, чемпион по скорости. Манифест пинит дистиллированный чекпойнт 1.1.
- Chatterbox · Resemble AI
Клонирование голоса без обучения примерно с 10 секунд записи. Манифест пинит многоязычные веса v3.
- Whisper large-v3-turbo · OpenAI
В 6 раз быстрее large-v3, 99 языков.
- Qwen3-VL-8B · Alibaba / Qwen
Отдельная линейка VL, 8B.
- InternVL3.5-8B · OpenGVLab
Сильна на документах и PDF. Содержит auto_map (код автора), который раннер уровня 1 с загрузкой только весов отвергает — до появления пути уровня 2 доступна только в каталоге.
- SmolVLM2-2.2B · Hugging Face
Крошечная VLM для пограничных устройств.
- Chandra OCR 2 · Datalab
OCR уровня SOTA на базе Qwen3.5, более 40 языков.
- olmOCR-2 7B · Allen AI
Полностью открытый OCR для пакетной обработки в больших объёмах.
- Qwen3-Embedding-0.6B · Alibaba / Qwen
Лидирующая линейка текстовых эмбеддингов в размере, посильном для CPU.
- Qwen3-Embedding-8B · Alibaba / Qwen
Лучшие текстовые эмбеддинги по MMTEB.
- EmbeddingGemma-300m · Google
Эмбеддинги на устройстве, более 100 языков.
- MiniMax H3 (Hailuo 3) · MiniMax
Совместный видео-аудио DiT на 33B (Hailuo 3). Корневая раскладка modular-diffusers, стек T2VA; требует модульного рантайма, которого у раннера пока нет.
- MiniMax H3 (GGUF Q4_K_M, sd.cpp) · MiniMax (GGUF: leejet / Comfy-Org)
Видео со стереозвуком на движке sd.cpp: T2VA, первый/последний кадр (I2VA/FL2VA). Q4 DiT + TE Qwen3-VL-32B; работает на одной карте 24 ГБ (нужно ~48 ГБ RAM хоста).
- MiniMax H3 Ref2VA (GGUF Q4_K_M, sd.cpp) · MiniMax (GGUF: leejet / Comfy-Org)
MiniMax H3 с референс-кондиционированием (Ref2VA): до 9 картинок, 3 видео, 3 аудио, упоминаемых как <Picture N>/<Video N>/<Audio N>.
- MiniMax Music 3 (GGUF Q8_0 DiT) · MiniMax (GGUF DiT: Abiray)
Двухступенчатая text-to-music (8B LLM + flow-matching DiT): песни до 5 минут, 32 кГц стерео. Официальные компоненты + Q8_0 GGUF DiT; ждёт релиза diffusers.
- MiniMax M2.7 · MiniMax
Передовая MoE-LLM от MiniMax (линейка M2.7).
- MiniMax M2.7 (NVFP4) · MiniMax
Готовая сборка NVFP4 (Blackwell) для MiniMax M2.7. Экспорт ModelOpt — ждёт поддержки в рантайме (загрузчика modelopt в transformers нет); пока только в каталоге.
- Kimi K2.7 Code · Moonshot AI
Агентная кодовая MoE от Moonshot (~300B, линейка K2.7).
- Kimi K2.7 Code (NVFP4) · Moonshot AI
Готовая сборка NVFP4 (Blackwell) для Kimi K2.7 Code. Экспорт ModelOpt — ждёт поддержки в рантайме (загрузчика modelopt в transformers нет); пока только в каталоге.
- ACE-Step v1 3.5B · ACE Studio / StepFun
Диффузионная модель text-to-music на 3.5B. Генерирует песню целиком, с вокалом, по описанию; 19 языков.