Qwen/Qwen-1_8B-Chat-Int8 - Каталог нейросетей
Генерация текста

Qwen/Qwen-1_8B-Chat-Int8

Добавлено:
Qwen/Qwen-1_8B-Chat-Int8

🤗 Обнимающее лицо&nbsp&nbsp | &nbsp&nbsp🤖 ModelScope&nbsp&nbsp | &nbsp&nbsp 📑 Бумага &nbsp&nbsp | &nbsp&nbsp🖥️ Демо WeChat (微信)&nbsp&nbsp | &nbsp&nbspDiscord&nbsp&nbsp | &nbsp&nbspAPI通义千问-1,8B (Qwen-1,8B)是阿里云研发的通义千问大模型系列的18亿参数规模的模型。Qwen-1.8B是基于Transformer的大语言模型,在超大规模的预训练数据上进行训练得到。预训练数据类型多样,覆盖广泛,包括大量网络文本、专业书籍、代码等。同时,在Qwen-1.8B的基础上,我们使用对齐机制打造了基于大语言模型的AI助手Qwen-1.8B-C шляпа。本仓库为Qwen-1.8B-Chat的Int8量化模型的仓库。通义千问-1,8B (Qwen-1,8B)主要有以下特点: 1.低成本部署:提供int8 и int4量化版本,推理最低仅需不到2GB, 2048 токены размером 3 ГБ или 6 ГБ. 2.大规模高质量训练语料:使用超过2.2万亿tok ens的数据进行预训练,包含高质量中、英、多语言、代码、数学等数据,涵盖通用及专业领域的训练语料。通过大量对比实验对预训练语料分布进行了优化。 3.优秀的性能:Qwen-1.8B支持8192上下文长度,在多个中英文下游评测任务上(涵盖常识推理、代码、数学、翻译等),效果显著超越现有的相近规模开源模型, 具体评测结果请详见下文。 4. Qwen-1.8B изготовлен в 15-дюймовом корпусе Qwen-1.8B.的词表。该词表对多语言更加友好,方便用户在不扩展词表的情况下对部分语种进行能力增强和扩展。 5.系统指令跟随:Qwen-1.8B-Chat可以通过调整系统指令, 实现角色扮演, 语言风格迁移, 任务设定, 和行为设定等能力。 Qwen-1.8B — это версия большой серии языковых моделей Qwen (сокр. Tongyi Qianwen) с параметрами 1,8B, предложенная Aibaba Cloud. Qwen-1.8B — это большая языковая модель на основе Transformer, которая предварительно обучается на большом объеме данных, включая веб-тексты, книги, коды и т. д. Кроме того, на основе предварительно обученного Qwen-1.8B мы выпускаем Qwen-1.8B-Chat,…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Qwen
Теги: qwen, custom_code, zh, en, 8-bit, gptq
Лайков: 5  |  Загрузок: 64

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.