BEE-spoke-data/Jamba-900M-doc-writer - Каталог нейросетей
Генерация текста

BEE-spoke-data/Jamba-900M-doc-writer

Добавлено:
BEE-spoke-data/Jamba-900M-doc-writer

Эта модель дает длинный, удивительно когерентный вывод, который расширяет некоторый входной текст; здесь вы можете увидеть пример, который представляет собой сгенерированный учебник по проектированию подводных городов. Благодаря арке Jamba он использует низкую VRAM при генерации выходов: около 2,5 ГБ VRAM для генерации 12 288 токенов. Эта модель представляет собой доработанную версию pszemraj/jamba-900M-v0.13-KIx2 на некоторых данных учебника. Он достигает следующих результатов в наборе оценки: — Потеря: 3.0200 — Точность: 0.4544 — Количество просмотренных входных токенов: 4940890112 — Генерация длинного контекста — Требуется довольно длинный запрос (он же «Введение»), чтобы последовательно создавать длинный, похожий на учебник текст — сама эта модель мала, поэтому ее рассуждения, знания и т. д. ограничены, но все же впечатляют размером (скрытый размер 1024)

Модальности:
Генерация текста


Задача: Генерация текста
Автор: BEE-spoke-data
Теги: jamba, textbook, 16384, long document, en
Лайков: 3  |  Загрузок: 32

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.