Ornith-1.0-35B-1M-GGUF
Зеркала: Обнимающее лицо | ModelScope (полная квантовая лестница всегда доступна на ModelScope) Ornith-1.0-35B от DeepReinforce (35B MoE, 3B...
Зеркала: Обнимающее лицо | ModelScope (полная квантовая лестница всегда доступна на ModelScope) Ornith-1.0-35B от DeepReinforce (35B MoE, 3B...
Преобразования GGUF AEON-7/Ornith-1.0-35B-AEON-Ultimate-Uncensored с тензорами MTP (Multi-Token Prediction), привитыми для поддержки спекулятивного декодирования. Базовая модель — это урезанный...
Этот репозиторий GGUF является рекомендацией по локальной модели по умолчанию для агента Lynn. Lynn v0.85.6+ использует Qwen3.6-27B-DSV4Pro-Distill-MTP-Q5KM-imatrix.gguf в...
CHADROCK3.6 40B Opus Deckard — это выпуск ROCmFP4/MTP GGUF семейства Deckard 40B для систем AMD Ryzen AI Max+...
Первая обученная Джемма 4 12Б на планете. Собственная методика обучения. Архитектура, готовая к MTP. Стоимость облака 0 долларов....
Сбалансированный локальный вывод 35B-A3B для Apple Silicon, упакованный для собственного спекулятивного декодирования Multi-Token-Prediction MTPLX. Этой контрольной точкой является...
Небольшой черновой вариант прогнозирования нескольких токенов (MTP/nextn) для Stepfun-ai/Step-3.7-Flash-NVFP4, чтобы вы могли запустить спекулятивное декодирование на контрольной точке...
Квантование NVFP4 Qwen3.6-27B с помощью головок Multi-Token Prediction (MTP), преобразованное в формат GGUF с использованием llama.cpp. Это квантование...
Экспериментальная же сборка GGUF MiMo-V2.5 для tnhnyzc/llama-mimo-mtp, на базе XiaomiMiMo/MiMo-V2.5. Эти GGUF содержат обычную целевую модель MiMo плюс...
Эта модель была конвертирована в формат MLX из google/gemma-4-E2B-it-assistant с использованием mlx-vlm версии 0.4.5. Более подробную информацию о...