fabletron-nemotron-3-super-120b-GGUF
QLoRA точная настройка NVIDIA Nemotron-3-Super-120B-A12B (всего 120B / 12B-активный гибрид Mamba-2 + Latent-MoE, nemotronh) на пиагентном разделении трасс...
QLoRA точная настройка NVIDIA Nemotron-3-Super-120B-A12B (всего 120B / 12B-активный гибрид Mamba-2 + Latent-MoE, nemotronh) на пиагентном разделении трасс...
☕ Если эти модели вам полезны, рассмотрите возможность поддержки моей работы — это позволит вычислить больше и больше...
Jupiter-N-120B — это постобученный вариант NVIDIA Nemotron-3-Super-120B-A12B, разработанный Locai Labs. N обозначает базу Немотрона. Jupiter-N улучшает выполнение инструкций...
> Важно: в этой модели используется формат квантования JANG — эквивалент GGUF для MLX в Apple Silicon. В...
MLX Studio — единственное приложение, которое изначально поддерживает модели JANG с рассуждением Nemotron-Cascade-2-30B-A3B — JANG_4M (4,1-битное, 8-битное внимание)...
См. наши тесты квантования в Unsloth Dynamic 2.0 GGUF. — Обратите внимание, что и являются отдельными токенами, поэтому...
См. NVIDIA-Nemotron-3-Super-120B-A12B MLX в действии – демонстрационное видео – Одиночный вывод ~33,7 токенов/с при 1000 токенов – Пакетный...
— Архитектура модели: NemotronHForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...
> ⚠️Превью/внутренняя проходная. Веса и метаданные могут измениться. Soofi-S-Isar-Preview генерирует текстовые ответы с четкими рассуждениями перед окончательным ответом....
> ⚠️Превью/внутренняя проходная. Веса и метаданные могут измениться. Soofi-S-Rhine-Preview генерирует текстовые ответы с четкими рассуждениями перед окончательным ответом....