abhi9ab/DeepSeek-R1-Distill-Llama-8B-finance-v1 - Каталог нейросетей
Генерация текста

abhi9ab/DeepSeek-R1-Distill-Llama-8B-finance-v1

Добавлено:
abhi9ab/DeepSeek-R1-Distill-Llama-8B-finance-v1

— Разработчик: abhi9ab — Лицензия: apache-2.0 — Точная настройка на основе модели: unsloth/DeepSeek-R1-Distill-Llama-8B Эта модель ламы была обучена в 2 раза быстрее с помощью библиотеки TRL Unsloth и Huggingface. — Базовая модель: unsloth/DeepSeek-R1-Distill-Llama-8B — Тип модели: Языковая модель (дистиллированная) — Техника тонкой настройки: LoRA (адаптация низкого ранга) — Точная настройка модели: DeepSeek-R1-Distill-Llama-8B-finance-v1 — Набор данных: Josephgflowers/Finance-Instruct-500k (сокращено до 5 тыс.) JSONL) — Платформа: Kaggle Notebook бесплатного уровня — Библиотека: Hugging Face Transformers, Unsloth и Pytorch. Эта модель представляет собой доработанную версию unsloth/DeepSeek-R1-Distill-Llama-8B, использующую LoRA для эффективной адаптации параметров. Он был специально настроен на сокращенной версии (5k) набора данных Josephgflowers/Finance-Instruct-500k для повышения производительности при выполнении задач, связанных с финансами. Модель была доработана на подмножестве набора данных Finance-Instruct-500k от Hugging Face, специально сокращенного до 5000 записей JSONL для процесса точной настройки. Этот набор данных содержит финансовые вопросы и ответы, предоставляя богатый набор примеров для обучения модели. — Эта тонкая настройка была выполнена на бесплатном уровне Kaggle…

Модальности:
Генерация текста

Области применения:
Диалог / чат Логика и рассуждение


Задача: Генерация текста
Автор: abhi9ab
Теги: llama, text-generation-inference, unsloth, trl, sft, huggingface, conversational, en
Лайков: 7  |  Загрузок: 7

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.