Файлы квантовой модели GGUF для Tiny-Llama-openhermes-1.1B-step-715k-1.5T от Tensoic. Эта модель представляет собой доработанную версию PY007/TinyLlama-1.1B-intermediate-step-715k-1.5T в наборе данных openhermes. В наборе оценок он достигает следующих результатов: — Потеря: 1,2355 Во время обучения использовались следующие гиперпараметры: — скорость обучения: 0,0002 — trainbatchsize: 1 — evalbatchsize: 1 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 8 — totaltrainbatchsize: 8 — totalevalbatchsize: 8 — оптимизатор: Адам с betas=(0.9,0.999) и epsilon=1e-08 — lrschedulertype: cosine — lrschedulerwarmupsteps: 100 — num_epochs: 1 — Transformers 4.34.0 — Pytorch 2.0.1+cu117 — Наборы данных 2.14.6 — Токенизаторы 0.14.1
Модальности:
Генерация текста
Задача: Генерация текста
Автор: afrideva
Теги: gguf, generated_from_trainer, ggml, quantized, q2_k, q3_k_m, q4_k_m, q5_k_m
Лайков: 4 | Загрузок: 189
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.