Эта модель представляет собой очищенную версию DeepSeek-R1 на Llama-3.2-3B с набором данных R1-Distill-SFT. — lr: 2e-5 — эпохи: 1 — размер пакета: 16 — оптимизатор: pagedadamw_8bit Эта модель была построена с использованием Meta Llama 3.2. Llama 3.2 распространяется под лицензией сообщества Llama 3.2, авторские права © Meta Platforms, Inc. Все права защищены.
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: suayptalha
Теги: llama, reasoning, axolotl, r1, conversational, en, model-index, text-generation-inference
Лайков: 16 | Загрузок: 185
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.