NVIDIA-Nemotron-Nano-9B-v2-quantized.w4a16
— Архитектура модели: NemotronHForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...
— Архитектура модели: NemotronHForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...
Модель NVIDIA Qwen3-235B-A22B FP8 представляет собой квантованную версию модели Qwen3-235B-A22B от Alibaba, которая представляет собой авторегрессионную языковую модель,...
Unsloth Dynamic 2.0 обеспечивает превосходную точность и превосходит другие ведущие методы количественного анализа. Llama-3.1-Nemotron-Nano-4B-v1.1 — это модель большого...
OpenCodeReasoning-Nemotron-32B — это модель большого языка (LLM), которая является производной от Qwen2.5-32B-Instruct (также известной как эталонная модель). Это...
Исходная модель: https://huggingface.co/nvidia/Llama-3_1-Nemotron-Ultra-253B-v1. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Наш новейший метод квантования представляет собой высокоточное адаптивное квантование для моделей со сверхмалой разрядностью (1–2 бита) с проверенными...
Эта модель представляет собой квантованную GGUF версию языковой модели, специфичной для страхового домена, на основе Nvidia Llama 3-ChatQA,...
Исходная модель: https://huggingface.co/nvidia/Llama-3_1-Nemotron-51B-Instruct Некоторые из этих квантов (Q3KXL, Q4KL и т. д.) представляют собой стандартный метод квантования, в...
NV-Llama2-70B-RLHF-Chat — это модель генеративного языка с 70 миллиардами параметров, настроенная на модели LLama2-70B. Он принимает входные данные...
Модель NVIDIA Kimi-K2.7-Code NVFP4 представляет собой квантованную версию модели Kimi-K2.7-Code компании Moonshot AI, которая представляет собой авторегрессионную языковую...