Модель обучена на большом датесете (~1 Тб) официальных рассказов по лору Warhammer 40k и фанфиков по Вахе (без кроссоверов) на русском языке. За счёт того, что использовались и фанфики по вселенной Вахи, модель может немножко в кроссовер. В инструменте поломана работа с GPT-2, GPTJ, GPT-NEO и аналогичными модлями, неверно загружается токенизер. Ошибка такая: >eostokenid = eostokenid[0] >IndexError: list index out of range Исправляется легко, в файл modules/models.py в функцию loadtokenizer () надо добавить строчку tokenizer.eostoken_id = 2 перед return tokenizer > Примарх Лоргар подошел к огромным вратам, украшенным изображением двухголового змея, и остановился перед ними. > >— Двери открыты для тебя, сын мой, но не для меня, — произнес он, хотя его голос был едва слышен из-за шума, производимого при каждом шаге. — Я никогда не стану служить тебе в качестве слуги. И я не буду служить тебе как твой брат. Ты должен понять это сам. > >— Но я не могу! — закричал Лютер, врываясь в храм. — Это неправильно! > >Лоргар поднял руку, останавливая его: > >— Ты должен. Иначе ты позволишь себе стать чудовищем. Ты — наследник Императора, а не его раб. > >— Я… я понимаю, что вы не можете дать мне…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: zlsl
Теги: gpt2, warhammer, wh40k, warhammer 40k, ru, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 15
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.