Метка: efficiency - Каталог нейросетей

Метка: efficiency

Генерация текста

acnagle/Terminator-Qwen3-8B

Терминатор — это легкий нейронный модуль, который предсказывает, когда модель языка рассуждений достигнет окончательного ответа во время генерации...

Генерация текста

codelion/Qwen3-0.6B-accuracy-recovery-lora

Этот адаптер LoRA помогает восстановить точность при использовании квантованных версий Qwen/Qwen3-0.6B INT4. Он был обучен с использованием самодистилляции...

Генерация текста

abhinand/Qwen3.6-35B-A3B-DFlash-GGUF

> [!Note] > Этот репозиторий предоставляет конвертированные веса GGUF для использования с форком dflash llama.cpp, основанным на исходной...

Генерация текста

z-lab/gpt-oss-120b-DFlash

DFlash — это новый метод спекулятивного декодирования, в котором для черчения используется облегченная модель диффузии блоков. Это обеспечивает...

Генерация текста

z-lab/Qwen3-Coder-Next-DFlash

DFlash — это спекулятивный метод декодирования, который использует облегченную модель диффузии блоков для параллельного создания нескольких токенов. Это...

Генерация текста

z-lab/Qwen3.5-122B-A10B-DFlash

Поддержка механизма вывода может быть пока не полностью доступна из-за архитектурных изменений, включая причинные уровни SWA. DFlash —...

Генерация текста

z-lab/Qwen3-8B-DFlash-b16

DFlash — это новый метод спекулятивного декодирования, в котором для черчения используется облегченная модель диффузии блоков. Это обеспечивает...

Генерация текста

z-lab/Kimi-K2.5-DFlash

DFlash — это новый метод спекулятивного декодирования, в котором для черчения используется облегченная модель диффузии блоков. Это обеспечивает...

Генерация текста

z-lab/Qwen3-4B-DFlash-b16

DFlash — это новый метод спекулятивного декодирования, в котором для черчения используется облегченная модель диффузии блоков. Это обеспечивает...

Генерация текста

z-lab/Qwen3.6-35B-A3B-DFlash

Эта модель проекта все еще находится на стадии обучения (2000 шагов). Не стесняйтесь опробовать его и оставить отзыв,...