Эта модель представляет собой точно настроенную версию Llama 3.2 3B, обученную Карсеном Клоком, использующую несколько комбинированных наборов данных и обработанную для ответов без цензуры. — Базовая модель: Llama 3.2 3B — Структура обучения: Unsloth — Тип обучения: LoRA Fine-tuning — Шаги обучения: 10000 — Размер партии: 2 — Скорость обучения: 5e-6 — Шаги накопления градиента: 16 — Обучение на 1 x NVIDIA RX 4080 SUPER — Решение математических задач — Генерация кода и обратная связь — Общие инструкции — Ответы без цензуры Комбинированные и обработанные наборы данных, включая: — FineTome-100k — Общие инструкции — Задачи Orca Math Word — Математика — CodeFe
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: carsenk
Теги: gguf, llama, unsloth, uncensored, llama-3.2, llama.cpp, inference, conversational
Лайков: 3 | Загрузок: 150
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.