Nemotron-Labs-Diffusion-14B-Base
Nemotron-Labs-Diffusion — это трехрежимная языковая модель, которая поддерживает как AR-декодирование, так и параллельное декодирование на основе диффузии путем...
Nemotron-Labs-Diffusion — это трехрежимная языковая модель, которая поддерживает как AR-декодирование, так и параллельное декодирование на основе диффузии путем...
Эта модель mlx-community/Nemotron-Cascade-2-30B-A3B-6bit была конвертирована в формат MLX из nvidia/Nemotron-Cascade-2-30B-A3B с использованием mlx-lm версии 0.31.2. Модальности:Генерация текста Области...
Исходная модель: https://huggingface.co/nvidia/NVIDIA-Nemotron-3-Nano-4B-BF16 — llama.cpp — LM Studio — koboldcpp — Jan AI — Веб-интерфейс создания текста —...
Ключевые слова: vLLM DGX Spark, NVIDIA GB10, Blackwell GPU, SM121, ARM64 LLM, CUDA 13.1, запуск докера вывода Qwen3...
Это квантованная версия Ex0bit/Elbaz-NVIDIA-Nemotron-3-Nano-30B-A3B-PRISM NVFP4 (FP4), созданная с использованием оптимизатора моделей NVIDIA TensorRT. Формат NVFP4 оптимизирован для: —...
> [!NOTE] > Включает исправления шаблона чата Unsloth! Для llama.cpp используйте —jinja > Unsloth Dynamic 2.0 обеспечивает превосходную...
Модель NVIDIA Qwen3-14B FP8 — это квантованная версия модели Qwen3-14B от Alibaba, которая представляет собой авторегрессионную языковую модель,...
Модель NVIDIA Qwen3-8B FP8 — это квантованная версия модели Qwen3-8B от Alibaba, которая представляет собой авторегрессионную языковую модель,...
Это квантованная FP8 версия nvidia/NVIDIA-Nemotron-Nano-9B-v2, оптимизированная для эффективного вывода со значительным сокращением памяти при сохранении качества модели. —...
Кванты EXL3 для nvidia/Llama-33-Nemotron-Super-49B-v15 с использованием exllamav3 для квантования. Модальности:Генерация текста Задача: Генерация текста Автор: ArtusDev Теги: nvidia,...