Llama-3.1-Tango-70b-bnb_4b
Tango-70B-Instruct is a large language model trained by sandbox-ai on a modified variation of of spanish/-ir/messirve to improve...
Tango-70B-Instruct is a large language model trained by sandbox-ai on a modified variation of of spanish/-ir/messirve to improve...
Эта модель представляет собой предметно-ориентированную языковую модель, основанную на Nvidia Llama 3 ChatQA, точно настроенную для запросов и...
Это LoRA, извлеченный из языковой модели. Он был извлечен с помощью mergekit. Этот адаптер LoRA был извлечен из...
Llama2-13B-RLHF-RM — это языковая модель с 13 миллиардами параметров (с контекстом до 4096 токенов), используемая в качестве модели...
Модели OpenMath были разработаны для решения математических задач путем интеграции текстовых рассуждений с блоками кода, выполняемыми интерпретатором Python....
Nex-N2-mini с квантованием NVFP4 (тонкая настройка Qwen3.5-MoE-35B), оптимизированная для NVIDIA Blackwell (SM 12.1), обслуживающая через vLLM с ядрами...
Более подробную информацию о том, как развернуть и использовать модель, см. в кратком руководстве ниже! > Чтобы узнать...
Первое квантование NVFP4 сообщества google/gemma-4-26B-A4B-it — вариант Gemma 4, созданный смешанными экспертами, с общим числом параметров 25,2 млрд...
Это квантованный экспорт GGUF NVFP4 NVIDIA Nemotron-Cascade-2-30B-A3B для llama.cpp, сделанный с помощью моего собственного экспериментального квантователя NVFP4. Для...
См. наши тесты квантования в Unsloth Dynamic 2.0 GGUF. — Обратите внимание, что и являются отдельными токенами, поэтому...