Kooten/Emerhyst-20B-4bpw-h8-exl2 - Каталог нейросетей
Генерация текста

Kooten/Emerhyst-20B-4bpw-h8-exl2

Добавлено:
Kooten/Emerhyst-20B-4bpw-h8-exl2

Я хотел попытаться подтолкнуть контекст к 8k, все еще имея возможность загружать 24 ГБ VRAM, и в моем пока очень ограниченном тестировании он, кажется, работает нормально. Мое использование VRAM с моделями 20B: я округлил, это не точные цифры, это также на машине с окнами. Вы можете следовать этим настройкам формата инструкций в SillyTavern. Замените tiny на желаемую длину ответа: Вдохновленный ранее названной предустановкой «Ролевая игра» в SillyTavern, начиная с этой версии LimaRP можно добавить модификатор длины к последовательности команд ответа, например: Это сразу заметно влияет на ответы бота. Доступные длины: крошечные, короткие, средние, длинные, огромные, огромные, экстремальные, неограниченные. Рекомендуемая начальная длина — средняя`**. Имейте в виду, что ИИ может блуждать или выдавать себя за пользователя с очень длинными сообщениями. Эффект контроля длины воспроизводим, но сообщения не обязательно будут очень точно следовать длинам, а в среднем следовать определенным диапазонам, как видно из этой таблицы с данными тестов, выполненных с одним ответом в начале разговора: контроль длины ответа, по-видимому, также хорошо работает в разговоре.

Модальности:
Генерация текста


Задача: Генерация текста
Автор: Kooten
Теги: llama, not-for-all-audiences, nsfw, text-generation-inference, endpoints_compatible
Лайков: 3  |  Загрузок: 10

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.