DeepSeek-R1-Qwen2.5-1.5b-SFT-R1-JSON-Unstructured-To-Structured
Этот репозиторий предоставляет точно настроенную модель Qwen2, оптимизированную для преобразования неструктурированного текста в структурированные выходные данные JSON в...
Этот репозиторий предоставляет точно настроенную модель Qwen2, оптимизированную для преобразования неструктурированного текста в структурированные выходные данные JSON в...
«Cubed» — это расширенная версия QwQ-32B (необычная модель рассуждения/мышления Qwen) для всех случаев использования. «Тройной» Кубед — это...
Mistral-Grand-R1-Dolphin-3.0-Deep-Reasoning-Brainstorm-45B-GGUF Это экспериментальная сборка, сочетающая https://huggingface.co/cognitivecomputations/Dolphin3.0-R1-Mistral-24B с технологией Brainstorm 40x от DavidAU (подробно описанной в самом низу этой...
Эта модель представляет собой очищенную версию DeepSeek-R1 на Llama-3.2-3B с набором данных R1-Distill-SFT. — lr: 2e-5 — эпохи:...
«Cubed» — это расширенная версия QwQ-32B (необычная модель рассуждения/мышления Qwen) для всех случаев использования. Это «безцензурная/удаленная» версия, контекст...
Новейшая модель рассуждения/мышления RekaAI «Reka-Flash 3» с «Neo Imatrix» и квантованием «Maxed out» для улучшения общей производительности. Эта...