Nemotron-3-Nano-4B-Coding-Agent-GGUF
Этот репозиторий содержит квантование Q4KM GGUF для точной настройки кодирования и использования инструментов на основе unsloth/NVIDIA-Nemotron-3-Nano-4B. — Формат:...
Этот репозиторий содержит квантование Q4KM GGUF для точной настройки кодирования и использования инструментов на основе unsloth/NVIDIA-Nemotron-3-Nano-4B. — Формат:...
QLoRA точная настройка NVIDIA Nemotron-3-Super-120B-A12B (всего 120B / 12B-активный гибрид Mamba-2 + Latent-MoE, nemotronh) на пиагентном разделении трасс...
☕ Если эти модели вам полезны, рассмотрите возможность поддержки моей работы — это позволит вычислить больше и больше...
Это квантованный экспорт GGUF NVFP4 NVIDIA Nemotron-Cascade-2-30B-A3B для llama.cpp, сделанный с помощью моего собственного экспериментального квантователя NVFP4. Для...
Оглавление — Карточка модели для Luciole-1B-Base — Описание модели — Использование — Прямое использование — Дальнейшее использование —...
MLX-квантование смешанной точности NVIDIA Nemotron-3-Super-120B-A12B — гибридная архитектура Mamba2 + MoE + Attention. Эта модель обеспечивает производительность класса...
AdaptKey-Nemotron-30b — это доработанная версия модели NVIDIA Nemotron-3-Nano-30B с поддержкой LoRA, предназначенная для телекоммуникационных и сетевых инженерных приложений....
Это квантованная FP8 версия nvidia/NVIDIA-Nemotron-Nano-9B-v2, оптимизированная для эффективного вывода со значительным сокращением памяти при сохранении качества модели. —...
Гибридная модель 30B Mamba + MoE с 7,6 ГБ видеопамяти, 15 ток/с, правильный вывод на RTX 4090. Самый...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP Этот...