MaziyarPanahi/Qwen1.5-8x7b-v0.1 - Каталог нейросетей
Генерация текста

MaziyarPanahi/Qwen1.5-8x7b-v0.1

Добавлено:
MaziyarPanahi/Qwen1.5-8x7b-v0.1

Эта модель представляет собой доработанную версию MaziyarPanahi/Qwen1.5-8x7b в наборе данных Crystalcareai/MoD-150k. В оценочном наборе были получены следующие результаты: — Потеря: 0,7945 Попытка воспроизвести модель Crystalcareai/Qwen1.5-8x7b, выполнив те же шаги, но с другим набором данных. — Точная настройка Qwen1.5-7B с набором данных Crystalcareai/MoD-150k. — Создайте необработанный MoE с 8-кратным уточненным Qwen1.5-7B. — Наконец, снова настроили модель MoE на наборе данных Crystalcareai/MoD-150k. Спасибо Crystalcareai за то, что поделился своими работами и подготовил наборы данных. Квантованная модель в формате GGUF: MaziyarPanahi/Qwen1.5-8x7b-v0.1-GGUF Во время обучения использовались следующие гиперпараметры: — скорость обучения: 0,0002 — trainbatchsize: 2 — evalbatchsize: 2 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 4 -gradientaccumulationsteps: 2 — totaltrainbatchsize: 16 — totalevalbatchsize: 8 — оптимизатор: Адам с betas=(0.9,0.999) и epsilon=1e-08 — lrschedulertype: cosine — lrschedulerwarmupsteps: 10 — num_epochs: 1 — PEFT 0.8.2 — Transformers 4.39.0.dev0 — Pytorch 2.2.0+cu121 — Наборы данных 2.17.0 — Токенизаторы 0.15.0

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: MaziyarPanahi
Теги: mixtral, axolotl, generated_from_trainer, moe, qwen, text-generation-inference, conversational, endpoints_compatible
Лайков: 4  |  Загрузок: 12

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.