Эта модель представляет собой доработанную версию Qwen2-7B-Instruct с контролем и поддержкой DeepSpeed и trl для корейского языка. — Обучение с использованием общедоступных и частных данных, а также сгенерированных данных (около 50 тыс.). Эта модель доступна под лицензией cc-by-nc-4.0. что позволяет другим делиться и адаптировать модель для некоммерческих целей. Qwen2 — новая серия больших языковых моделей Qwen. Для Qwen2 мы выпускаем ряд базовых языковых моделей и языковых моделей с настройкой инструкций с диапазоном от 0,5 до 72 миллиардов параметров, включая модель «Смесь экспертов». Этот репозиторий содержит настроенную по инструкциям модель 7B Qwen2. По сравнению с современными языковыми моделями с открытым исходным кодом, включая ранее выпущенную Qwen1.5, Qwen2 в целом превзошел большинство моделей с открытым исходным кодом и продемонстрировал конкурентоспособность по сравнению с проприетарными моделями в ряде тестов, нацеленных на понимание языка, генерацию языка, многоязычные возможности, кодирование, математику, рассуждение и т. д. Qwen2-7B-Instruct поддерживает длину контекста до 131 072 токенов, что позволяет обрабатывать обширные входные данные. Пожалуйста, обратитесь к этому разделу за подробными инструкциями по развертыванию Qwen2 для обработки длинных текстов. Для более подробной информации, пожалуйста…
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: spow12
Теги: qwen2, conversational, ko, en, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 15
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.