Это всего лишь версия https://huggingface.co/mistralai/Mistral-7B-v0.1, которая разбита на части размером не более 2 ГБ, чтобы уменьшить объем оперативной памяти, необходимой при загрузке. Модель большого языка (LLM) Mistral-7B-v0.1 представляет собой предварительно обученную генеративную текстовую модель с 7 миллиардами параметров. Мистраль-7Б-v0.1 превосходит Llama 2 13B во всех протестированных нами тестах. Для получения полной информации об этой модели прочитайте сообщение в нашем блоге о выпуске. Mistral-7B-v0.1 представляет собой модель-трансформер со следующими вариантами архитектуры: — Внимание к групповым запросам — Внимание к скользящему окну — Резервный байтовый токенизатор BPE Mistral 7B представляет собой предварительно обученную базовую модель и, следовательно, не имеет каких-либо механизмов модерации. Альбер Цзян, Александр Саблеролл, Артур Менш, Крис Бэмфорд, Девендра Сингх Чаплот, Диего де лас Касас, Флориан Брессан, Джанна Лендьель, Гийом Лампле, Лелио Ренар Лаво, Люсиль Солнье, Мари-Анн Лашо, Пьер Сток, Тевен Ле Скао, Тибо Лавриль, Томас Ван, Тимоти Лакруа, Уильям Эль Саид.
Модальности:
Генерация текста
Задача: Генерация текста
Автор: alexsherstinsky
Теги: mistral, pretrained, text-generation-inference, endpoints_compatible
Лайков: 15 | Загрузок: 38
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.