Qwen3.6-27B-DSV4Pro-Thinking-Distill-FP8
> MTP дает ~2 × одиночный поток (базовая скорость 7,7 → 15 ток/с, до ~19 / акцепт 0,89...
> MTP дает ~2 × одиночный поток (базовая скорость 7,7 → 15 ток/с, до ~19 / акцепт 0,89...
> ### 👉 Есть более новая, лучшая модель: RefinedToolCall-V5-3B > Преемник самостоятельного RFT с соблюдением политики, который улучшает...
> Неважно, какой у тебя графический процессор. Независимо от вашей оперативной памяти. Имея около 4,5 ГБ видеопамяти или...
Полная доработка модели на базе Mistral-Nemo-2407, ориентированная на композицию генерации изображений ИИ с логическим рассуждением. Полные веса для...
Пост-тренинг с подкреплением Ornstein 3.5 9B V1.5 — обещанная карта V2 V1.5. Начиная с контролируемой тонкой настройки версии...
FabGemma-12B — это усовершенствованная оптимизация Google Gemma 4 12B Instruct, основанная на рассуждениях. Он был специально настроен для...
Этот репозиторий содержит преобразования WeiboAI/VibeThinker-3B LiteRT-LM для локального вывода на устройстве. VibeThinker-3B — это модель плотного рассуждения с...
> Кванты матрицы важности (imatrix) модели кодирования yuxinlu1, откалиброванные на реальных данных кодирования Python, поэтому низкоразрядные сборки сохраняют...
9B параметров · турецкий · на основе Qwen3.5-9B · гибридного мышления · Apache-2.0 Mergen-TR-Qwen3.5-9B — это модель рассуждения с 9 миллиардами параметров,...
Omni-31B, Türkçe muhakeme, açıklayıcı analiz, çok dımlı çözme çözme ve genel bilgi alanlarında adım adım düşünme y kinligi...