Qwen/Qwen2.5-3B-Instruct-GPTQ-Int8 - Каталог нейросетей
Генерация текста

Qwen/Qwen2.5-3B-Instruct-GPTQ-Int8

Добавлено:
Qwen/Qwen2.5-3B-Instruct-GPTQ-Int8

Qwen2.5 — это последняя серия больших языковых моделей Qwen. Для Qwen2.5 мы выпускаем ряд базовых языковых моделей и языковых моделей, настраиваемых инструкциями, в диапазоне от 0,5 до 72 миллиардов параметров. Qwen2.5 привносит следующие улучшения в Qwen2: — Значительно больше знаний и значительно улучшил возможности кодирования и математики благодаря нашим специализированным экспертным моделям в этих областях. — Значительные улучшения в следовании инструкциям, генерации длинных текстов (более 8K токенов), понимании структурированных данных (например, таблиц) и генерации структурированных результатов, особенно JSON. Более устойчив к разнообразию системных подсказок, улучшая реализацию ролевых игр и настройку условий для чат-ботов. — Поддержка длинного контекста до 128K токенов и может генерировать до 8K токенов. — Многоязычная поддержка более 29 языков, включая китайский, английский, французский, испанский, португальский, немецкий, итальянский, русский, японский, корейский, вьетнамский, тайский, арабский и другие. Этот репозиторий содержит 8-битную модель 3B Qwen2.5, настроенную с помощью команды GPTQ, которая имеет следующие функции: — Тип: Причинно-следственные языковые модели — Этап обучения: Предварительное обучение

Модальности:
Генерация текста

Области применения:
Диалог / чат Следование инструкциям


Задача: Генерация текста
Автор: Qwen
Теги: qwen2, chat, conversational, en, text-generation-inference, endpoints_compatible, 8-bit, gptq
Лайков: 3  |  Загрузок: 2,562

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.