Модели

Каталог из 89 открытых моделей для запуска в сети AETRON: LLM, генерация изображений, видео, речь и эмбеддинги. Лицензия, требования к памяти и параметры — у каждой записи.

  • Qwen2.5-0.5B-Instruct · Alibaba / Qwen

    Крошечная LLM на 0.5B с инструктивной настройкой — работает на пограничных устройствах и на CPU.

  • Qwen2.5-0.5B-Instruct (bnb-4bit) · Alibaba / Qwen

    4-битная сборка (bnb NF4): крошечная LLM на 0.5B с инструктивной настройкой — работает на пограничных устройствах и на CPU.

  • Qwen3.5-9B · Alibaba / Qwen

    Плотная LLM на 9B поколения Qwen3.5 (02.2026). Сильна в рассуждениях, коде и многоязычном диалоге.

  • Qwen3.5-9B (FP8-dynamic) · Alibaba / Qwen

    Готовая сборка FP8 (compressed-tensors): плотная LLM на 9B поколения Qwen3.5 (02.2026). Сильна в рассуждениях, коде и многоязычном диалоге.

  • Qwen3.5-9B (w4a16) · Alibaba / Qwen

    Готовая сборка INT4 W4A16 (compressed-tensors): плотная LLM на 9B поколения Qwen3.5 (02.2026). Сильна в рассуждениях, коде и многоязычном диалоге.

  • Qwen-Image · Alibaba Qwen

    Текст-в-картинку на 20B MMDiT. Лучший в классе рендер текста, английский и китайский.

  • Qwen3.6-27B · Alibaba / Qwen

    Свежайшая плотная Qwen: изначально мультимодальный флагман на 27B.

  • Qwen3.6-27B (NVFP4 (Blackwell)) · Alibaba / Qwen

    Готовая сборка NVFP4 (Blackwell) для Qwen3.6-27B. Экспорт ModelOpt — ждёт поддержки в рантайме (загрузчика modelopt в transformers нет); пока только в каталоге.

  • Qwen3.6-27B (official FP8) · Alibaba / Qwen

    Готовая официальная сборка FP8 для Qwen3.6-27B.

  • Qwen3.6-35B-A3B · Alibaba / Qwen

    MoE на 35B с ~3B активных: качество почти как у 27B, но заметно быстрее.

  • Qwen3.6-35B-A3B (NVFP4 (compressed-tensors)) · Alibaba / Qwen

    Готовая сборка NVFP4 (compressed-tensors) — работает на флотском стеке (compressed-tensors). Окно Blackwell.

  • Qwen3.6-35B-A3B (official FP8) · Alibaba / Qwen

    Готовая официальная сборка FP8 для Qwen3.6-35B-A3B.

  • Qwen3.5-4B · Alibaba / Qwen

    Компактная модель на 4B для потребительских видеокарт и пограничных устройств.

  • Qwen3.5-4B (INT4 W4A16) · Alibaba / Qwen

    Готовая сборка INT4 W4A16 для Qwen3.5-4B.

  • Qwen3.5-4B (FP8-dynamic) · Alibaba / Qwen

    Готовая сборка FP8-dynamic для Qwen3.5-4B.

  • Qwen3.5-27B · Alibaba / Qwen

    Плотная модель на 27B прошлого поколения, проверенная в бою.

  • Qwen3.5-27B (official GPTQ-Int4) · Alibaba / Qwen

    Готовая официальная сборка GPTQ-Int4 для Qwen3.5-27B.

  • Qwen3.5-9B (GGUF Q4_K_M) · Alibaba / Qwen (GGUF: unsloth)

    Сборка GGUF для llama.cpp (Q4_K_M) на базе Qwen3.5-9B — один артефакт работает на Metal, CUDA и CPU; именно на нём проверялся консенсусный движок GGUF.

  • Qwen3.5-27B (GGUF Q4_K_M) · Alibaba / Qwen (GGUF: unsloth)

    Сборка GGUF для llama.cpp (Q4_K_M) на базе Qwen3.5-27B — один артефакт работает на Metal, CUDA и CPU.

  • Qwen3.5-27B (GGUF Q8_0) · Alibaba / Qwen (GGUF: unsloth)

    Сборка GGUF для llama.cpp (Q8_0, 8 бит) на базе Qwen3.5-27B — та же модель, но квант точнее; отдельная запись, потому что другой артефакт означает другой model_hash.

  • Qwen3.8-27B (GGUF UD-Q4_K_M) · Alibaba / Qwen (GGUF: unsloth)

    Сборка GGUF для llama.cpp (Unsloth Dynamic Q4_K_M) на базе Qwen3.8-27B — один артефакт работает на Metal, CUDA и CPU. Контекст 262144 токена. Исходная модель мультимодальна (изображение и текст на входе, текст на выходе); этот пин покрывает ТОЛЬКО текстовые веса — зрительный проектор (mmproj) лежит отдельным артефактом и в манифест не входит.

  • Qwen3.5-27B (official FP8) · Alibaba / Qwen

    Готовая официальная сборка FP8 для Qwen3.5-27B.

  • Qwen3.5-35B-A3B · Alibaba / Qwen

    Qwen3.5 MoE 35B-A3B.

  • Qwen3.5-35B-A3B (official GPTQ-Int4) · Alibaba / Qwen

    Готовая официальная сборка GPTQ-Int4 для Qwen3.5-35B-A3B.

  • Qwen3.5-35B-A3B (official FP8) · Alibaba / Qwen

    Готовая официальная сборка FP8 для Qwen3.5-35B-A3B.

  • Qwen3-Coder-30B-A3B · Alibaba / Qwen

    Кодовая MoE с контекстом 256K и ~3B активных параметров.

  • Qwen3-Coder-30B-A3B (official FP8) · Alibaba / Qwen

    Готовая официальная сборка FP8 для Qwen3-Coder-30B-A3B.

  • Gemma 4 E4B IT · Google

    Экономичная Gemma 4 на 4B с инструктивной настройкой.

  • Gemma 4 12B · Google

    Gemma 4 среднего размера.

  • Gemma 4 31B · Google

    Плотный флагман Gemma 4.

  • Gemma 4 31B (official QAT W4A16) · Google

    Готовая официальная сборка QAT W4A16 для Gemma 4 31B.

  • Gemma 4 31B (FP8-block) · Google

    Готовая сборка FP8-block для Gemma 4 31B.

  • Ministral 3 8B · Mistral AI

    Модель на 8B со зрением из линейки Ministral 3, рассчитанной на пограничные устройства.

  • Ministral 3 14B · Mistral AI

    Более крупная Ministral 3, тоже со зрением.

  • Ministral 3 14B (FP8-dynamic) · Mistral AI

    Готовая сборка FP8-dynamic для Ministral 3 14B.

  • Phi-4 · Microsoft

    Microsoft Phi-4 на 14.7B.

  • Phi-4 (FP8-dynamic) · Microsoft

    Готовая сборка FP8-dynamic для Phi-4.

  • Phi-4-mini · Microsoft

    Phi-4-mini на 3.8B для небольших видеокарт и CPU.

  • SmolLM3-3B · Hugging Face

    Крошечная модель на 3B для пограничных устройств и сценариев рядом с браузером.

  • Nemotron-3 Nano 4B · NVIDIA

    Гибридная Mamba-2 Nano на 4B с длинным контекстом.

  • Nemotron-3 Nano 30B-A3B · NVIDIA

    Nano MoE 30B-A3B, контекст до 1M.

  • Nemotron-3 Nano 30B-A3B (FP8) · NVIDIA

    Готовая сборка FP8 для Nemotron-3 Nano 30B-A3B.

  • gpt-oss-20b · OpenAI

    MoE на 21B в нативном MXFP4; уровень o3-mini в 16 ГБ.

  • GLM-4.7-Flash · Z.ai

    Потребительская GLM на 31B.

  • GLM-4.7-Flash (FP8-dynamic) · Z.ai

    Готовая сборка FP8-dynamic для GLM-4.7-Flash.

  • DeepSeek-V4-Pro · DeepSeek

    Передовая MoE на 1.6T со встроенными режимами Think.

  • DeepSeek-V4-Pro (NVFP4-FP8 (compressed-tensors)) · DeepSeek

    Готовая сборка NVFP4-FP8 (compressed-tensors) — работает на флотском стеке (compressed-tensors). Окно Blackwell.

  • DeepSeek-V4-Flash · DeepSeek

    Меньшая и более быстрая V4: 284B при 13B активных.

  • DeepSeek-V4-Flash (NVFP4-FP8 (compressed-tensors)) · DeepSeek

    Готовая сборка NVFP4-FP8 (compressed-tensors) — работает на флотском стеке (compressed-tensors). Окно Blackwell.

  • Kimi-K3 · Moonshot AI

    MoE на 2.8T, первая открытая модель класса 3T, MXFP4 QAT.

  • Kimi-K3 (NVFP4) · Moonshot AI

    Готовая сборка NVFP4 для Kimi-K3.

  • GLM-5.2 · Z.ai

    MoE на 753B с разреженным вниманием и контекстом 1M.

  • GLM-5.2 (official FP8) · Z.ai

    Готовая официальная сборка FP8 для GLM-5.2.

  • Qwen3-Coder-Next · Alibaba / Qwen

    Открытая кодовая модель уровня SOTA, 80B-A3B.

  • Qwen3-Coder-Next (official FP8) · Alibaba / Qwen

    Готовая официальная сборка FP8 для Qwen3-Coder-Next.

  • Llama 4 Scout · Meta

    Llama 4 Scout: 109B при 17B активных.

  • Nemotron-3 Super 120B-A12B · NVIDIA

    Super 120B-A12B: помещается на одну карту 80 ГБ в 4 битах.

  • gpt-oss-120b · OpenAI

    MoE на 117B в нативном MXFP4: одна видеокарта на 80 ГБ.

  • Mistral Small 4 119B · Mistral AI

    Объединённая модель инструкций и рассуждений на 119B.

  • Mistral Small 4 119B (official NVFP4) · Mistral AI

    Готовая официальная сборка NVFP4 для Mistral Small 4 119B. Экспорт в формате Mistral (без config.json) — ждёт поддержки в рантайме; пока только в каталоге.

  • FLUX.2 [klein] 4B · Black Forest Labs

    Дистиллированная потребительская FLUX.2 на 4B.

  • FLUX.2 [klein] 9B · Black Forest Labs

    Более крупная klein: 9B.

  • FLUX.2 [dev] · Black Forest Labs

    Флагманский DiT на 32B.

  • Qwen-Image 2.0 · Alibaba / Qwen

    Qwen-Image 2.0: лучший в классе рендер текста.

  • Z-Image Turbo · Tongyi-MAI

    S3-DiT на 6B: лучшее качество на гигабайт, около 2 с на изображение на 4090.

  • Chroma1-HD · Lodestone Rock

    База под лицензией Apache для дообучения без ограничений.

  • Wan 2.2 TI2V-5B · Alibaba / Wan-AI

    Модель на 5B: видео из текста и из изображения. Зеркало diffusers: исходный репозиторий отдаёт VAE и T5 в формате pickle, который загрузчик отвергает.

  • Wan 2.2 T2V-A14B · Alibaba / Wan-AI

    Видео-MoE, 27B суммарно при 14B активных. Зеркало diffusers; оба эксперта остаются в памяти, поэтому видеопамять считается на пару.

  • HunyuanVideo 1.5 · Tencent

    Видеомодель на 8.3B, текст-в-видео 480p. Зеркало diffusers: исходный репозиторий требует собственный пакет hyvideo от Tencent и не содержит текстового энкодера.

  • LTX-2.3 · Lightricks

    Генерация видео со звуком, чемпион по скорости. Манифест пинит дистиллированный чекпойнт 1.1.

  • Chatterbox · Resemble AI

    Клонирование голоса без обучения примерно с 10 секунд записи. Манифест пинит многоязычные веса v3.

  • Whisper large-v3-turbo · OpenAI

    В 6 раз быстрее large-v3, 99 языков.

  • Qwen3-VL-8B · Alibaba / Qwen

    Отдельная линейка VL, 8B.

  • InternVL3.5-8B · OpenGVLab

    Сильна на документах и PDF. Содержит auto_map (код автора), который раннер уровня 1 с загрузкой только весов отвергает — до появления пути уровня 2 доступна только в каталоге.

  • SmolVLM2-2.2B · Hugging Face

    Крошечная VLM для пограничных устройств.

  • Chandra OCR 2 · Datalab

    OCR уровня SOTA на базе Qwen3.5, более 40 языков.

  • olmOCR-2 7B · Allen AI

    Полностью открытый OCR для пакетной обработки в больших объёмах.

  • Qwen3-Embedding-0.6B · Alibaba / Qwen

    Лидирующая линейка текстовых эмбеддингов в размере, посильном для CPU.

  • Qwen3-Embedding-8B · Alibaba / Qwen

    Лучшие текстовые эмбеддинги по MMTEB.

  • EmbeddingGemma-300m · Google

    Эмбеддинги на устройстве, более 100 языков.

  • MiniMax H3 (Hailuo 3) · MiniMax

    Совместный видео-аудио DiT на 33B (Hailuo 3). Корневая раскладка modular-diffusers, стек T2VA; требует модульного рантайма, которого у раннера пока нет.

  • MiniMax H3 (GGUF Q4_K_M, sd.cpp) · MiniMax (GGUF: leejet / Comfy-Org)

    Видео со стереозвуком на движке sd.cpp: T2VA, первый/последний кадр (I2VA/FL2VA). Q4 DiT + TE Qwen3-VL-32B; работает на одной карте 24 ГБ (нужно ~48 ГБ RAM хоста).

  • MiniMax H3 Ref2VA (GGUF Q4_K_M, sd.cpp) · MiniMax (GGUF: leejet / Comfy-Org)

    MiniMax H3 с референс-кондиционированием (Ref2VA): до 9 картинок, 3 видео, 3 аудио, упоминаемых как <Picture N>/<Video N>/<Audio N>.

  • MiniMax Music 3 (GGUF Q8_0 DiT) · MiniMax (GGUF DiT: Abiray)

    Двухступенчатая text-to-music (8B LLM + flow-matching DiT): песни до 5 минут, 32 кГц стерео. Официальные компоненты + Q8_0 GGUF DiT; ждёт релиза diffusers.

  • MiniMax M2.7 · MiniMax

    Передовая MoE-LLM от MiniMax (линейка M2.7).

  • MiniMax M2.7 (NVFP4) · MiniMax

    Готовая сборка NVFP4 (Blackwell) для MiniMax M2.7. Экспорт ModelOpt — ждёт поддержки в рантайме (загрузчика modelopt в transformers нет); пока только в каталоге.

  • Kimi K2.7 Code · Moonshot AI

    Агентная кодовая MoE от Moonshot (~300B, линейка K2.7).

  • Kimi K2.7 Code (NVFP4) · Moonshot AI

    Готовая сборка NVFP4 (Blackwell) для Kimi K2.7 Code. Экспорт ModelOpt — ждёт поддержки в рантайме (загрузчика modelopt в transformers нет); пока только в каталоге.

  • ACE-Step v1 3.5B · ACE Studio / StepFun

    Диффузионная модель text-to-music на 3.5B. Генерирует песню целиком, с вокалом, по описанию; 19 языков.