Метка: quantized - Страница 26 - Каталог нейросетей

Метка: quantized

Генерация текста

michaelw9999/Nemotron-Cascade-2-30B-A3B-NVFP4-GGUF

Это квантованный экспорт GGUF NVFP4 NVIDIA Nemotron-Cascade-2-30B-A3B для llama.cpp, сделанный с помощью моего собственного экспериментального квантователя NVFP4. Для...

Генерация текста

JANGQ-AI/Nemotron-Cascade-2-30B-A3B-JANG_4M

MLX Studio — единственное приложение, которое изначально поддерживает модели JANG с рассуждением Nemotron-Cascade-2-30B-A3B — JANG_4M (4,1-битное, 8-битное внимание)...

Генерация текста

jamesburton/Phi-4-reasoning-vision-15B-GGUF

Преобразования формата GGUF microsoft/Phi-4-reasoning-vision-15B для использования с llama.cpp и Ollama. > Примечание. Это преобразование включает только текстовую основу...

Генерация текста

mlx-community/Qwen3.5-397B-A17B-nvfp4

4-битная квантованная версия текстовой модели nvfp4 MLX из Qwen/Qwen3.5-397B-A17B. Части этой карты были скопированы или адаптированы из оригинальной...

Генерация текста

GadflyII/GLM-4.7-Flash-MTP-NVFP4

Это квантование NVFP4 смешанной точности zai-org/GLM-4.7-Flash, модель Mixture-of-Experts 30B-A3B (30B всего, 3B активно). Эта версия сохраняет уровни MTP...

Генерация текста

kgrabko/JiRackTernary_70b

Изобретатель: Грабко Константин Владимирович Контакты: grabko@cmsmanhattan.com Телефон: +1 (516) 777-0945 Статус: [ПАТЕНТ ЗАЯВЛЕН] — Заявка подана 21 декабря...

Генерация текста

kgrabko/JiRackTernary_1b

Высокопроизводительный троичный преобразователь на процессоре | [ПАТЕНТ ЗАЯВЛЕН] Изобретатель: Константин Владимирович Грабко Организация: Официальный сайт CMS Manhattan: www.cmsmanhattan.com...

Генерация текста

solarkyle/GLM-4.7-Flash-GGUF

Квантование GGUF zai-org/GLM-4.7-Flash для использования с llama.cpp и совместимыми механизмами вывода. Это мой первый квант! Дайте мне знать,...