🚨 Пользователям рекомендуется проявлять осторожность и нести ответственность за любое дополнительное обучение и контроль, необходимые для обеспечения соответствия ответов модели приемлемым этическим стандартам и стандартам безопасности. Ответственность за внедрение этой модели в промышленные или коммерческие решения полностью лежит на тех, кто решит ее внедрить. T-lite-it-2.1 — эффективная российская модель, построенная на архитектуре Qwen 3, отличающаяся значительными улучшениями в выполнении инструкций и добавленной поддержкой возможностей вызова инструментов — ключевое улучшение по сравнению с T-lite-it-1.0, в котором отсутствует поддержка использования инструментов. Превосходит Qwen3-8B в сценариях вызова инструментов, что важно для агентных приложений. Создан как для общих задач, так и для сложных рабочих процессов, с более высокой производительностью генерации русского текста, обеспечиваемой оптимизированным токенизатором. Подробнее о поездах на нашем Хабре: https://habr.com/ru/companies/tbank/articles/979650/ Supervised Fine-Tuning (SFT): ~670 тыс. высококачественных и разнообразных инструкций со сбалансированной сложностью, сочетающих общие данные, синтетические проверяемые сценарии следования инструкциям и вызова инструментов. Онлайн-выравнивание RL (GRPO): синтетические данные, генерируемые для следования инструкциям (IF) и вызова инструментов…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: t-tech
Теги: qwen3, conversational, ru, text-generation-inference, endpoints_compatible
Лайков: 19 | Загрузок: 2,951
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.