Автономный черновой вариант («поддерживаемая») модели спекулятивного декодирования DSpark, упакованный как один GGUF емкостью 5,6 ГиБ для движка ds4. Это только составитель — он не генерирует сам по себе. Соедините его с GGUF основной модели DeepSeek-V4-Flash, и ds4 предлагает и проверяет, фиксируя только принятые префиксы. Этот файл представляет собой то, что создает ./downloadmodel.sh dspark-support`, но предварительно созданный: вы можете пропустить загрузку исходного кода DSpark размером ~ 167 ГБ и локальное преобразование. DSpark — это официальный вспомогательный проектный модуль DeepSeek для DeepSeek-V4-Flash: три этапа MTP (многотокенового прогнозирования), которые считывают скрытые состояния основной модели на уровнях 40–42 и предлагают блок будущих токенов с марковской головкой для продолжения блока. ds4 сверяет каждое предложение с основной моделью, поэтому принятые токены — это именно то, что могла бы создать основная модель — спекулятивное декодирование — это оптимизация скорости, а не изменение качества. — GGUF v3, 81 тензор, General.architecture = deepseek4-dspark. — Метаданные DSpark: размер блока = 5, markovrank = 256, nlayers = 3, targetlayerids = [40, 41, 42], NoiseTokenid = 128799. — Квантование (смешанное, из компоновщика DSpark ds4 deepseek4-quantize): перенаправленные эксперты ffndown Q2K / ffngate,ffnup…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: sakamakismile
Теги: gguf, deepseek, deepseek-v4, speculative-decoding, dspark, draft-model, ds4
Лайков: 5 | Загрузок: 653
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.