afrideva/zephyr-smol_llama-100m-sft-full-GGUF - Каталог нейросетей
Генерация текста

afrideva/zephyr-smol_llama-100m-sft-full-GGUF

Добавлено:
afrideva/zephyr-smol_llama-100m-sft-full-GGUF

Квантованные файлы модели GGUF для zephyr-smol_llama-100m-sft-full от amazingvince Эта модель представляет собой точно настроенную версию BEE-spoke-data/smol_llama-101M-GQA на неизвестном наборе данных. Он достигает следующих результатов в наборе оценки: — Потеря: 1,9579 Во время обучения использовались следующие гиперпараметры: — скорость обучения: 2e-05 — размер партии: 16 — размер партии: 16 — семя: 42 — распределенный тип: мульти-GPU — количество устройств: 2 — шаги градиента накопления: 4 — общий размер партии: 128 — общий размер партии: 32 — оптимизатор: Адам с бета=(0,9,0,999) и эпсилон= 1e-08 — тип lrschedulertype: косинус — numepochs: 1 — Трансформаторы 4.35.0 — Pytorch 2.1.0 — Наборы данных

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: afrideva
Теги: gguf, generated_from_trainer, ggml, quantized, q2_k, q3_k_m, q4_k_m, q5_k_m
Лайков: 3  |  Загрузок: 473

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.