Проект по доработке TinyLlama-1.1B из «Поминок по Финнегану» Джеймса Джойса для создания текста, вдохновленного Джойсом. Этот проект настраивает модель TinyLlama-1.1B-Chat на полный текст «Поминок по Финнегану» Джеймса Джойса, создавая языковую модель, способную генерировать текст в характерном экспериментальном стиле Джойса. Модель учится воспроизводить сложную игру слов, неологизмы и методы повествования потока сознания, характерные для последней работы Джойса. -processwake.py — Предварительная обработка необработанного текста, удаление номеров страниц и разбиение на управляемые фрагменты — Finetunejoyce.py — Основной сценарий обучения с использованием HuggingFace Transformers — textgen.py — Скрипт генерации текста для точно настроенной модели — finnwake.txt — Полный текст Finnegan’s Wake (1,51 МБ) — finnwake.csv — Обработанный набор данных в формате CSV — finnwakedataset/ — каталог токенизированного набора данных. При этом номера страниц удаляются, а текст разбивается на фрагменты по 100 слов для обучения. 2. Точная настройка Точная настройка TinyLlama на обработанном наборе данных для 3 эпох с обучением ЦП. 3. Базовая модель генерации текста: TinyLlama-1.1B-Chat-v1.0. Данные обучения: «Поминки по Финнегану» (текст ~ 1,5 МБ). Параметры обучения: 3 эпохи. Размер пакета: 1 Макс.
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: npc-worldwide
Теги: gguf, llama, conversational, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 82
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.