bertin-gpt-j-6B-ES-v1-8bit
Эта модель (и модель карты) представляет собой адаптацию hivemind/gpt-j-6B-8bit, так что вся благодарность ему/ей. Это версия последней контрольной...
Эта модель (и модель карты) представляет собой адаптацию hivemind/gpt-j-6B-8bit, так что вся благодарность ему/ей. Это версия последней контрольной...
Сверхбольшая мультимодальная модель MoE с 99B общими параметрами / 10B активными, с 205 экспертами и встроенной поддержкой машинного...
Sengil/turkish-gemma-9b-finance-sft — это модель большого языка, настроенная на турецкие финансовые инструкции, разработанная для понимания естественного языка, связанного с...
Arab-Sahm — это LLM для создания состязательных на арабском языке, созданный для авторизованной красной команды, оценки надежности и...
Это доработанная версия Nanbeige4.1-3B, созданная по запросу redaihf с помощью механизма аблитерации Heretic (v1.2.0) от P-E-W с включенной...
Эта модель была преобразована в формат GGUF из Nanbeige/Nanbeige4.1-3B с использованием llama.cpp через пространство GGUF-my-repo ggml.ai. Более подробную...
Этот репозиторий содержит официальные версии модели Qwen3-4B, квантованные PreSINQ GGUF. Подробное объяснение стратегии PreSINQ можно найти в официальном...
Этот репозиторий содержит официальную 4-битную квантованную версию модели Qwen3-14B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). SINQ...
Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-32B с использованием метода SINQ (Sinkhorn-Normalized Quantization), как представлено в...
Smoothie Qwen — это легкий инструмент настройки, который сглаживает вероятности появления токенов в Qwen и аналогичных моделях, расширяя...