Ling-3.0-flash-GGUF
Кванты включения AI/Ling-3.0-flash, 127,5В-общая/5,1В-активная гибридная МО (bailinghybrid/BailingMoeV3`). Каждый файл здесь содержит только типы тензоров, безопасные для sm120 —...
Кванты включения AI/Ling-3.0-flash, 127,5В-общая/5,1В-активная гибридная МО (bailinghybrid/BailingMoeV3`). Каждый файл здесь содержит только типы тензоров, безопасные для sm120 —...
> Внимание: восходящий путь вывода HF нарушен (подтверждено поставщиком > 22 июля 2026 г.: «HF.generate в настоящее время...
Экспертно-обрезанная версия tencent/Hy3, созданная с помощью REAP (экспертная обрезка активации с учетом маршрутизатора). 192 маршрутизируемых эксперта каждого уровня...
QLoRA точная настройка NVIDIA Nemotron-3-Super-120B-A12B (всего 120B / 12B-активный гибрид Mamba-2 + Latent-MoE, nemotronh) на пиагентном разделении трасс...
DeepSeek V4 Flash с сокращением REAP на уровне K128 (128 маршрутизируемых экспертов на каждый уровень MoE, сокращение 50%)...
gemma-4-120b-a12b-coder — это модель кодера на основе Gemma 4 для разработки программного обеспечения, редактирования кода, вопросов и ответов,...
☕ Если эти модели вам полезны, рассмотрите возможность поддержки моей работы — это позволит вычислить больше и больше...
Это кванты для механизма вывода DS4, построенного на основе матрицы важности (imatrix) и смещений тензора, выровненных для эффективной...
NameNotFound-EAM — это первая модель в новом классе систем, который мы называем моделями развивающейся архитектуры (EAM): модели, которые...
Эта страница представляет собой указатель контрольных точек моделей, выпущенных вместе с EMO: Pretraining Mixture of Experts for Emergent...