alfred-40B-1023-AWQ
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
GigaChat 3.5 Ultra — флагманская модель мгновенного обмена сообщениями семейства GigaChat. Это крупномасштабная модель «Смесь экспертов» (MoE) с...
Зеркала: Обнимающее лицо | ModelScope (полная квантовая лестница всегда доступна на ModelScope) Ornith-1.0-35B от DeepReinforce (35B MoE, 3B...
Это версия openbmb/MiniCPM5-1B без цензуры, созданная с использованием аблитерации (более подробную информацию об этом см. в разделе «Удалить-отказы-с-трансформерами»)....
> 📢 Ищете GGUF для llama.cpp/Ollama/LM Studio? В этом репозитории содержатся сжатые безопасные тензоры fraQtl (время выполнения преобразователей,...
Mamba2-primed-HQwen3-8B-Instruct — это гибридная языковая модель, состоящая из 50 % слоев внимания и 50 % слоев Mamba2, созданных из Qwen3-8B...
GigaChat 3.1 Ultra — флагманская модель семейства GigaChat. Это крупномасштабная модель Mixture-of-Experts (MoE) с 702B общих параметров и...
Экспорт kappa20b131k в GGUF для использования с llama.cpp и совместимыми механизмами вывода. Часть серии персон — набор экспериментальных...
Квантованная версия kappa-20b-131k только по весу MXFP4 — тонкая настройка MoE 20,9B с персональным управлением, контекстом 131K и...
LoRA точная настройка NousResearch/Hermes-3-Llama-3.1-8B, обученная на тщательно подобранных текстах по философии, естественным наукам и математике. Это экспериментальная песочница...