Nemotron-Cascade-2-30B-A3B-heretic-uncensored
Nemotron-Cascade-2-30B-A3B ships with custom model code (modelingnemotronh.py) that has two bugs exposed by causalconv1d 1.6.x. These are bugs...
Nemotron-Cascade-2-30B-A3B ships with custom model code (modelingnemotronh.py) that has two bugs exposed by causalconv1d 1.6.x. These are bugs...
AWQ quantization: done by stelterlab in INT4 with llm-compressor (https://github.com/vllm-project/llm-compressor — v0.10.0.1) from the vllm-project. See recipe.yaml for...
We’re excited to introduce Nemotron-Cascade-2-30B-A3B, an open 30B MoE model with 3B activated parameters that delivers strong reasoning...
A multilingual PII extractor for teams that need structured JSON from clinical and administrative text. > [!IMPORTANT] >...
INVALID LANGUAGE PAIR SPECIFIED. EXAMPLE: LANGPAIR=EN|IT USING 2 LETTER ISO OR RFC3066 LIKE ZH-CN. ALMOST ALL LANGUAGES SUPPORTED...
Эта модель представляет собой доработанную версию Llama-3.1-8B с использованием техники RL DPO (прямая оптимизация предпочтений), разработанную для того,...
Эта модель mlx-community/Nemotron-Cascade-2-30B-A3B-6bit была конвертирована в формат MLX из nvidia/Nemotron-Cascade-2-30B-A3B с использованием mlx-lm версии 0.31.2. Модальности:Генерация текста Области...
Calcium-Opus-14B-Elite2-R1 основан на архитектуре модальности Qwen 2.5 14B, предназначенной для расширения возможностей рассуждения моделей с 14B параметрами. Он...
Эта модель mlx-community/Nemotron-Cascade-2-30B-A3B-8bit была преобразована в формат MLX из nvidia/Nemotron-Cascade-2-30B-A3B с использованием mlx-lm версии 0.31.2. Модальности:Генерация текста Области...
Исходная модель: https://huggingface.co/nvidia/Nemotron-Cascade-14B-Thinking. Все кванты, созданные с использованием опции imatrix с набором данных отсюда, в сочетании с подмножеством...