Mellum2-12B-A2.5B-Base-Pretrain
> [!Note] > Используйте эту контрольную точку в качестве отправной точки для исследования расширения длинного контекста или для...
> [!Note] > Используйте эту контрольную точку в качестве отправной точки для исследования расширения длинного контекста или для...
Модель генерации текста Модальности:Генерация текста Задача: Генерация текста Автор: cckevinn Теги: qwen, custom_code, eval-resultsЛайков: 18 | Загрузок: 228,059...
1. Краткое описание модели 2. Как использовать 3. Оценка 4. Ограничения 5. Лицензия QED-Nano — это модель с...
Мы представляем обновленную версию LongCat-Flash-Thinking, мощной и эффективной модели большого рассуждения (LRM) с 560 миллиардами общих параметров, построенной...
> GritLM — это языковая модель, настроенная на генеративные репрезентативные инструкции. Он объединяет текстовое представление (встраивание) и генерацию...
JoyAI-LLM Flash — это современная модель языка инструкций среднего размера с 3 миллиардами активированных параметров и 48 миллиардами...
Мы представляем LongCat-Flash-Lite, немыслящую модель Mixture-of-Experts (MoE) с 68,5 миллиардами параметров и примерно 3 миллиардами активированных параметров, поддерживающую...
Qwen2 — новая серия больших языковых моделей Qwen. Для Qwen2 мы выпускаем ряд базовых языковых моделей и языковых...
В этом репозитории представлена Falcon-H1R-7B, специализированная модель рассуждений, представленная в документе Falcon-H1R: расширяя границы рассуждений с помощью гибридной...
MiroThinker v1.5 — ведущий в мире поисковый агент, разработанный для расширения возможностей рассуждения и поиска информации с помощью...