Sao10K/14B-Qwen2.5-Freya-x1 - Каталог нейросетей
Генерация текста

Sao10K/14B-Qwen2.5-Freya-x1

Добавлено:
Sao10K/14B-Qwen2.5-Freya-x1

Я решил снова повозиться с методами обучения, учитывая возрождение таких методов, как многоступенчатое обучение. Некоторые люди снова начали это делать, и почему бы и нет? Вдохновлен методологией AshhLimaRP, но сделал по-своему. Фрейя-S1 — LoRA Обучена на ~1,1 ГБ литературы и необработанного текста по базовой модели Qwen 2.5. — Почистил текст и литературу, как мог, но кое-где могли возникнуть проблемы. Фрейя-С2 — первый LoRA был применен к Qwen 2.5 Instruct, затем я тренировался поверх него. — Снижен рейтинг LoRA, потому что это в основном инструкции и другие детали, в которые я не буду вдаваться. Рекомендуемые настройки модели | Слушай, я просто использую их, они работают достаточно хорошо. Я даже не знаю, как работают DRY или другие сэмплеры мемов. В любом случае ваша системная подсказка имеет большее значение. Общее время обучения составило ~10 часов на узле 8xH100, спонсируемом правительством Сингапура или кем-то еще. Спасибо за надбавку за национальную службу, MHA.

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Sao10K
Теги: qwen2, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 21  |  Загрузок: 134

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.