Метка: 8-bit - Страница 20 - Каталог нейросетей

Метка: 8-bit

Генерация текста

mlx-community/QwQ-32B-8bit

Модель mlx-community/QwQ-32B-8bit была преобразована в формат MLX из Qwen/QwQ-32B с использованием mlx-lm версии 0.21.5. Модальности:Генерация текста Области применения:Диалог...

Генерация текста

Qwen/Qwen2-72B-Instruct-GPTQ-Int8

Qwen2 — новая серия больших языковых моделей Qwen. Для Qwen2 мы выпускаем ряд базовых языковых моделей и языковых...

Генерация текста

Salyut1/GLM-4.7-NVFP4

Формат: NVFP4 — оптимальное частичное квантование весов и активаций в NVFP4. Базовая модель: zai-org/GLM-4.7. Как это было сделано:...

Генерация текста

tiiuae/Falcon3-7B-Instruct-1.58bit

0. TL;DR 1. Подробности модели 2. Подробности обучения 3. Использование 4. Оценка 5. Цитирование — Разработчик: https://www.tii.ae —...

Генерация текста

nvidia/Llama-3_3-Nemotron-Super-49B-v1_5-NVFP4

Llama-3.3-Nemotron-Super-49B-v1.5-NVFP4 — это значительно обновленная версия Llama-3.3-Nemotron-Super-49B-v1 и модель большого языка (LLM), которая является производной от Meta Llama-3.3-70B-Instruct...

Генерация текста

Qwen/Qwen2-7B-Instruct-GPTQ-Int8

Qwen2 — новая серия больших языковых моделей Qwen. Для Qwen2 мы выпускаем ряд базовых языковых моделей и языковых...