Qwen3.6-27B-A3B-Coder
Уменьшение числа экспертов-специалистов по коду из Qwen3.6-35B-A3B: количество экспертов MoE уменьшено с 256 до 184 (72 удалено на...
Уменьшение числа экспертов-специалистов по коду из Qwen3.6-35B-A3B: количество экспертов MoE уменьшено с 256 до 184 (72 удалено на...
Эти модели создаются и обслуживаются на арендованных графических процессорах. Если вы хотите выразить некоторую признательность, подписка на X...
4-битное квантование MXFP4 Ornith-1.0-397B, созданное с помощью qstream. Только перенаправленные эксперты MoE (~95% весов) квантуются в MXFP4; все,...
> ⚠️ Тестовый запуск. Это ранняя экспериментальная контрольная точка, а не законченная модель. Тонкая настройка QLoRA объединена с...
Дельта-слияние Fable-forward со стабилизацией рассуждений Opus. Тензорный консенсус по знакам и обрезка величин, вдохновленные TIES. Это объединение защитных...
Пост-тренинг с подкреплением Ornstein 3.5 9B V1.5 — обещанная карта V2 V1.5. Начиная с контролируемой тонкой настройки версии...
> [!NOTE] > Все кванты GGUF (Q3/Q4/Q5/Q6/Q8) проверены на работе в llama.cpp/Ollama. Более ранняя загрузка ссылалась на неиспользуемый...
FabGemma-12B — это усовершенствованная оптимизация Google Gemma 4 12B Instruct, основанная на рассуждениях. Он был специально настроен для...
9B параметров · турецкий · на основе Qwen3.5-9B · гибридного мышления · Apache-2.0 Mergen-TR-Qwen3.5-9B — это модель рассуждения с 9 миллиардами параметров,...
gemma-4-120b-a12b-coder — это модель кодера на основе Gemma 4 для разработки программного обеспечения, редактирования кода, вопросов и ответов,...