Ornith-1.0-9B-ASHQ1-MTP-GGUF
Квантование ASHQ1 Ornith-1.0-9B с явной обработкой MTP (многотокенное предсказание) — головки MTP сохраняются на уровне Q8_0 и исключаются...
Квантование ASHQ1 Ornith-1.0-9B с явной обработкой MTP (многотокенное предсказание) — головки MTP сохраняются на уровне Q8_0 и исключаются...
> ⚠️ Тестовый запуск. Это ранняя экспериментальная контрольная точка, а не законченная модель. Тонкая настройка QLoRA объединена с...
> Неважно, какой у тебя графический процессор. Независимо от вашей оперативной памяти. Имея около 4,5 ГБ видеопамяти или...
> Кванты матрицы важности (imatrix) модели кодирования yuxinlu1, откалиброванные на реальных данных кодирования Python, поэтому низкоразрядные сборки сохраняют...
Supertron1-14B — это тонко настроенная языковая модель QLoRA, созданная на основе Qwen3-14B. Обученный с упором на программирование, математику,...
ДОСТУПНО ТОЛЬКО ДЛЯ VIP-ЧЛЕНОВ PRISM: https://ko-fi.com/summary/1adf92d9-84f3-45c7-8136-8ab0ca39090d Квантование GGUF Step-3.5-Flash-PRISM-PRO для локального развертывания с llama.cpp и совместимыми средами выполнения....
Эта модель показывает, что можно сделать с помощью пользовательского «микро» Qwen 3 (параметры 1B), используя настройку 16 бит/32...
Точная настройка ужасов (только текст) с использованием собственного набора данных ужасов, настроенного с помощью Unsloth. Модель будет генерировать...
Qwen3-Yoyo-V3-42B-A3B-Thinking-Total-Recall-TNG-III [1 миллион контекста] Этот репозиторий содержит исходный код полной точности в формате «безопасных тензоров» для генерации GGUF,...
Внимание: обучение этой модели достаточно интенсивное, чтобы изменить «факты реального мира» и перенести их (частично) во ВСЮ Вселенную...