Qwable-27B-NVFP4-MTP-GGUF
Неофициальное преобразование NVFP4 MTP GGUF Mia-AiLab/Qwable-3.6-27b. Восходящая модель Qwable представляет собой усовершенствованную версию Qwen3.6 27B, ориентированную на выполнение...
Неофициальное преобразование NVFP4 MTP GGUF Mia-AiLab/Qwable-3.6-27b. Восходящая модель Qwable представляет собой усовершенствованную версию Qwen3.6 27B, ориентированную на выполнение...
Этот репозиторий содержит квантованные веса составителя Multi-Token Prediction (MTP), отделенные от Qwen/Qwen3.6-35B-A3B для использования со спекулятивным декодированием mlx-vlm....
Оригинальная модель: AlicanKiraz0/Mihenk-LLM-v2-35B-A3B-Turkish-Financial-Model Alican Kiraz’a, но модели bize kazandırdığı için teşekkür ederim. Чтобы отобразить карту модели, выберите подходящий...
> Квантование GPTQ INT4 Qwen/Qwen3.6-27B. > в 3 раза меньше. ~2,4× быстрее. Однопоточное измерение на том же оборудовании,...
Это MLX-релиз урезанной версии Qwen3.6-27B без цензуры с сохраненной исходной полезной нагрузкой изображения/видео, созданной на основе опубликованной контрольной...
Сборка MLX смешанной точности Qwen/Qwen3.6-27B, подготовленная baa.ai. В соответствии с нашей внутренней политикой оценки в обоих режимах декодирования...
Этот репозиторий содержит варианты Qwen/Qwen3-14B LiteRT-LM, оптимизированные для генерации текста на устройстве. Смешанный артефакт INT4 .litertlm был создан...
— 👨 Отец (база): Qwen/Qwen3.5-2B — 👩 Мать (адаптер LoRA): FINAL-Bench/Qwen3.5-2B-Opus-Distill-v1 — 👶 Дочерний элемент (эта модель): FINAL-Bench/lastbrain...
> [!TIP] > Квантование KV-кэша без какого-либо разветвления (рекомендуется, 2026 г.): восходящий поток > llama.cpp/Ollama теперь покрывает это...
Сборка MLX смешанной точности Qwen/Qwen3.6-35B-A3B, подготовленная baa.ai. Построено в прогнозируемой глобальной (максимальное качество) рабочей точке. Модальности:Генерация текста Области...