grimjim/Mistral-Nemo-Instruct-2407-12B-6.4bpw-exl2 - Каталог нейросетей
Генерация текста

grimjim/Mistral-Nemo-Instruct-2407-12B-6.4bpw-exl2

Добавлено:
grimjim/Mistral-Nemo-Instruct-2407-12B-6.4bpw-exl2

Этот репозиторий содержит квант exl2 Mistral-Nemo-Instruct-2407 мощностью 6,4 бита в секунду. Загрузка этого кванта вместе с длиной контекста 32 КБ вряд ли уместится в 16 ГБ видеопамяти в Windows. Модель большого языка Mistral-Nemo-Instruct-2407 (LLM) представляет собой усовершенствованную версию Mistral-Nemo-Base-2407. Обученный совместно Mistral AI и NVIDIA, он значительно превосходит существующие модели меньшего или аналогичного размера. Более подробную информацию об этой модели можно найти в нашем блоге. — Выпущено по лицензии Apache 2 — Предварительно обученные и инструктированные версии — Обучены с контекстным окном 128 тыс. — Обучены на большом количестве многоязычных и кодовых данных — Встроенная замена Mistral 7B Mistral Nemo — модель-трансформер со следующими вариантами архитектуры: — Слои: 40 — Размер: 5120 — Размер головы: 128 — Скрытый размер: 14 436 — Активация Функция: SwiGLU — Количество головок: 32 — Количество kv-головок: 8 (GQA) — Размер словаря: 217 ~= 128k — Вращающиеся вложения (тета = 1M)** — неправильный вывод: см. здесь — трансформаторы: см. здесь — NeMo`: см. nvidia/Mistral-NeMo-12B-Instruct Рекомендуется использовать mistralai/Mistral-Nemo-Instruct-2407 с выводом мистраля. Для фрагментов кода ВЧ-трансформаторов…

Модальности:
Генерация текста

Области применения:
Диалог / чат Следование инструкциям


Задача: Генерация текста
Автор: grimjim
Теги: mistral, conversational, en, fr, de, es, it, pt
Лайков: 5  |  Загрузок: 10

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.