Метка: 8-bit - Страница 13 - Каталог нейросетей

Метка: 8-bit

Генерация текста

barozp/ZAYA1-8B-BNB

> Примечание. ZAYA1-8B использует собственную разреженную архитектуру MoE (ZayaForCausalLM), которая еще не поддерживается llama.cpp. Файлы GGUF будут добавлены...

Генерация текста

Brooooooklyn/Qwen3.6-35B-A3B-UD-Q8_K_XL-mlx

8-битное базовое квантование смешанной точности Qwen/Qwen3.6-35B-A3B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Проведено...

Генерация текста

Qwen/Qwen3-1.7B-GPTQ-Int8

Qwen3 — это последнее поколение больших языковых моделей в серии Qwen, предлагающее полный набор моделей с плотным доступом...

Генерация текста

mlx-community/Qwen3-0.6B-8bit

Эта модель mlx-community/Qwen3-0.6B-8bit была преобразована в формат MLX из Qwen/Qwen3-0.6B с использованием mlx-lm версии 0.24.0. Модальности:Генерация текста Области...

Генерация текста

prithivMLmods/QwQ-LCoT-3B-Instruct-GGUF

Модель QwQ-LCoT-3B-Instruct — это легкая, настроенная на инструкции языковая модель, предназначенная для сложных задач рассуждения и объяснения. Он...

Генерация текста

MaziyarPanahi/RYS-XLarge-GGUF

MaziyarPanahi/RYS-XLarge-GGUF содержит файлы моделей формата GGUF для dnhkng/RYS-XLarge. GGUF — это новый формат, представленный командой llama.cpp 21 августа...

Генерация текста

AI-MO/NuminaMath-7B-TIR-GPTQ

NuminaMath — это серия языковых моделей, которые обучены решать математические задачи с использованием интегрированного мышления (TIR). NuminaMath 7B...

Генерация текста

lllyasviel/omost-phi-3-mini-128k-8bits

omost-phi-3-mini-128k-8bits — это модель phi-3-mini от Omost с длиной контекста 128 тыс. в fp8. Модальности:Генерация текста Области применения:Диалог...