Nemotron-Cascade-2-30B-A3B-heretic-uncensored
Nemotron-Cascade-2-30B-A3B ships with custom model code (modelingnemotronh.py) that has two bugs exposed by causalconv1d 1.6.x. These are bugs...
Nemotron-Cascade-2-30B-A3B ships with custom model code (modelingnemotronh.py) that has two bugs exposed by causalconv1d 1.6.x. These are bugs...
AWQ quantization: done by stelterlab in INT4 with llm-compressor (https://github.com/vllm-project/llm-compressor — v0.10.0.1) from the vllm-project. See recipe.yaml for...
We’re excited to introduce Nemotron-Cascade-2-30B-A3B, an open 30B MoE model with 3B activated parameters that delivers strong reasoning...
Это квантованный экспорт GGUF NVFP4 NVIDIA Nemotron-Cascade-2-30B-A3B для llama.cpp, сделанный с помощью моего собственного экспериментального квантователя NVFP4. Для...
Эта модель mlx-community/Nemotron-Cascade-2-30B-A3B-6bit была конвертирована в формат MLX из nvidia/Nemotron-Cascade-2-30B-A3B с использованием mlx-lm версии 0.31.2. Модальности:Генерация текста Области...
Эта модель mlx-community/Nemotron-Cascade-2-30B-A3B-8bit была преобразована в формат MLX из nvidia/Nemotron-Cascade-2-30B-A3B с использованием mlx-lm версии 0.31.2. Модальности:Генерация текста Области...
Эта модель mlx-community/Nemotron-Cascade-2-30B-A3B-4bit была конвертирована в формат MLX из nvidia/Nemotron-Cascade-2-30B-A3B с использованием mlx-lm версии 0.31.2. Модальности:Генерация текста Области...
Исходная модель: https://huggingface.co/nvidia/Nemotron-Cascade-2-30B-A3B — llama.cpp — LM Studio — koboldcpp — Jan AI — Веб-интерфейс создания текста —...