Qwen3-32B-3bit-ASINQ
Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-32B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). SINQ...
Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-32B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). SINQ...
Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-14B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). SINQ...
Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-14B с использованием метода SINQ (Sinkhorn-Normalized Quantization). Модель и метод...
Модель контрольной точки ARPO выпущена для бумажной оптимизации агентной усиленной политики. Масштабное обучение с подкреплением и проверяемыми вознаграждениями...
Тип модели: гибридный символьно-трансформер. Базовая модель: Qwen-1B. Структура: PyTorch + HuggingFace Transformers. Назначение: облегченная модель рассуждений с расширенной...
Smoothie Qwen — это легкий инструмент настройки, который сглаживает вероятности токенов в Qwen и аналогичных моделях, расширяя возможности...
Smoothie Qwen — это легкий инструмент настройки, который сглаживает вероятности токенов в Qwen и аналогичных моделях, расширяя возможности...
Эта модель представляет собой доработанную версию модели unsloth/DeepSeek-R1-Distill-Llama-8B, специально адаптированную для задач медицинского рассуждения. В процессе тонкой настройки...
h2o-danube3.1-4b-chat — это усовершенствованная модель чата от H2O.ai с 4 миллиардами параметров. Эта модель была обучена с помощью...
Монлам Мелонг — это большая языковая модель (LLM) (Tibetan LLM), специально разработанная для поддержки и улучшения задач обработки...