Meta-Llama-3.1-70B-Instruct-gptq-4bit
— биты: 4 — размер группы: 128 — уменьшение: true — staticgroups: false — sym: true — lmhead:...
— биты: 4 — размер группы: 128 — уменьшение: true — staticgroups: false — sym: true — lmhead:...
— биты: 4 — размер группы: 128 — descact: true — staticgroups: false — sym: true — lmhead:...
Эта модель была квантована с использованием GPTQModel. — биты: 4 — размер группы: 128 — descact: false —...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
> Квантование GPTQ INT4 Qwen/Qwen3.6-27B. > в 3 раза меньше. ~2,4× быстрее. Однопоточное измерение на том же оборудовании,...
4-битная квантованная версия текстовой модели nvfp4 MLX из Qwen/Qwen3.5-397B-A17B. Части этой карты были скопированы или адаптированы из оригинальной...
— биты: 4 — размер группы: 128 — descact: true — staticgroups: false — sym: true — lmhead:...
Квантование GPTQ https://huggingface.co/TehVenom/Dolly_Shygmalion-6b. Использование этого репозитория: https://github.com/mayaeary/GPTQ-for-LLaMa/tree/gptj-v2. Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: Ancestral...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...