Эта модель служит основой 3B в нашем минималистском рецепте R1-Zero. Детали обучения: — Базовая модель: HuggingFaceTB/FineMath-Llama-3B — Набор данных: lkevinzc/numia-1.5-qa-concatenated — Эпохи: 2 — Скорость обучения: 1e-5
Модальности:
Генерация текста
Задача: Генерация текста
Автор: lkevinzc
Теги: llama, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 47
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.