phi-1_5-nf4-8bit-doublequant-BNB
Модель генерации текста Модальности:Генерация текста Задача: Генерация текста Автор: DaertML Теги: mixformer-sequential, custom_code, 8-bit, bitsandbytesЛайков: 4 | Загрузок:...
Модель генерации текста Модальности:Генерация текста Задача: Генерация текста Автор: DaertML Теги: mixformer-sequential, custom_code, 8-bit, bitsandbytesЛайков: 4 | Загрузок:...
Модель генерации текста Модальности:Генерация текста Задача: Генерация текста Автор: substratusai Теги: llama, text-generation-inference, endpoints_compatible, 8-bitЛайков: 4 | Загрузок:...
Модель, настроенная с точностью до 4 бит с использованием QLoRA на timdettmers/openassistant-guanaco и сегментированная для использования в бесплатном...
includeAI/Ling-3.0-flash, квантованный до NVFP4 в формате сжатых тензоров, для vLLM и TensorRT-LLM. 76,9 ГБ по 16 шардам. Сборки...
Квантуется до 8 бит на вес, размер группы 64 (4,2 ГБ, эффективная скорость передачи данных 8,5). Преобразован из...
Количество экспертов уменьшено с 256 до 192. MTP на данный момент не поддерживается. Базовый проверочный тест для версии,...
Эта модель была преобразована в формат MLX и квантована из Qwen3.6-35B-A3B с использованием oMLX. «VL» — это язык...
Эта 8-битная модель mlx-community/DeepSeek-V4-Pro была конвертирована в формат MLX из deepseek-ai/DeepSeek-V4-Pro. DeepSeek-V4-Pro — это модель Mixture-of-Experts с общим...
Эта модель была преобразована в формат MLX и квантована из Qwen3.6-35B-A3B с использованием oMLX. «VL» — это язык...
— Квантование: oQ8 (смешанная точность, управляемая чувствительностью, размер группы = 64) — Формат: MLX Safetensors — Совместимость с:**...