qwen3-4b-code-reasoning
Небольшая модель Qwen 3 с 4 миллиардами параметров, обученная на nvidia/OpenCodeReasoning для задач кодирования. Для кодирования рекомендуется находиться...
Небольшая модель Qwen 3 с 4 миллиардами параметров, обученная на nvidia/OpenCodeReasoning для задач кодирования. Для кодирования рекомендуется находиться...
SmolLM2 — это семейство компактных языковых моделей, доступных в трех размерах: параметры 135M, 360M и 1,7B. Они способны...
Модель Llama-3.1-8B-Open-SFT представляет собой доработанную версию мета-ламы/Llama-3.1-8B-Instruct, предназначенную для сложных задач генерации текста, включая диалоговое взаимодействие, ответы на...
Модель Marco-o1 предназначена для достижения успеха не только в структурированных дисциплинах, таких как математика, физика и программирование, которые...
!Reyna aloobun qwen4B — доработан Qwen/Qwen1.5-4B для выполнения различных задач CoT, включая рассуждение, ответы на вопросы в закрытой...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
[] = применяется как LoRA к составной модели | () = объединены в составные модели ((MantiCore3E+VicunaCocktail)+[SuperCOT+[StorytellingV2+(SuperHOTProtoType-8192ctx+Metharme)]]) Эта модель...
Модель рассуждения System 2 для перевода ACGN 原生 CoT 思维链 · 长上下文 · ACGN 领域特化翻译模型 Github | Бенчмарк...
Calcium-Opus-14B-Elite2-R1 основан на архитектуре модальности Qwen 2.5 14B, предназначенной для расширения возможностей рассуждения моделей с 14B параметрами. Он...
FastThink-0.5B-Tiny — это модель, ориентированная на рассуждения, основанная на Qwen2.5. Мы выпустили ряд базовых языковых моделей и языковых...