SmolLM2-135M-Reasoning-5K
Точная настройка полнопараметрического рассуждения HuggingFaceTB/SmolLM2-135M-Instruct с использованием 5000 примеров, выбранных из SupraLabs/reasoning-corpus-4K-5M-v1. Модель была обучена размещать след рассуждений...
Точная настройка полнопараметрического рассуждения HuggingFaceTB/SmolLM2-135M-Instruct с использованием 5000 примеров, выбранных из SupraLabs/reasoning-corpus-4K-5M-v1. Модель была обучена размещать след рассуждений...
DarkIT — это высокопроизводительная модель большого языка нового поколения, разработанная для расширенного программирования, глубоких рассуждений и естественного человеческого...
Модель локального кодирования 4B с инстинктами агента. Планирование, навыки использования инструментов и терминальные рассуждения основаны на реальных сеансах...
Название уровня Целевой размер Стратегия среднего уровня 💎 качество ~ 23 GBIQ4XS ⚖️ сбалансированный ~ 25 GBQ5K 📦...
> MTP дает ~2 × одиночный поток (базовая скорость 7,7 → 15 ток/с, до ~19 / акцепт 0,89...
> ### 👉 Есть более новая, лучшая модель: RefinedToolCall-V5-3B > Преемник самостоятельного RFT с соблюдением политики, который улучшает...
> Неважно, какой у тебя графический процессор. Независимо от вашей оперативной памяти. Имея около 4,5 ГБ видеопамяти или...
Полная доработка модели на базе Mistral-Nemo-2407, ориентированная на композицию генерации изображений ИИ с логическим рассуждением. Полные веса для...
Пост-тренинг с подкреплением Ornstein 3.5 9B V1.5 — обещанная карта V2 V1.5. Начиная с контролируемой тонкой настройки версии...
FabGemma-12B — это усовершенствованная оптимизация Google Gemma 4 12B Instruct, основанная на рассуждениях. Он был специально настроен для...