Jackrong/gpt-oss-120b-Distill-Llama3.1-8B-v2 - Каталог нейросетей
Генерация текста

Jackrong/gpt-oss-120b-Distill-Llama3.1-8B-v2

Добавлено:
Jackrong/gpt-oss-120b-Distill-Llama3.1-8B-v2

Название модели: gpt-oss-120b-Distill-Llama3.1-8B-v2 Разработчик: Soren Базовая модель: мета/Meta-Llama-3.1-8B Размер обучающих данных: всего около 420 миллионов токенов. Этот этап служит «холодным стартом», чтобы заложить прочный фундамент знаний и структурированных рассуждений для базовой модели. Есть две основные цели: 1. Дистилляция знаний: внедрить в Llama 3.1 8B данные рассуждения, сгенерированные более мощными моделями учителей из различных областей, что позволит ей унаследовать сильный стиль рассуждения и базу знаний. Основным источником данных являются данные естественного рассуждения, полученные из gpt-oss-120B-high. 2. Согласование формата. Обучите модель следовать определенному формату ответа, что предполагает создание подробного мыслительного процесса, заключенного в … теги, прежде чем давать ответ. Это закладывает основу для автоматической оценки вознаграждения на последующем этапе обучения с подкреплением и повышает интерпретируемость результатов модели. Чтобы добиться полного охвата возможностей, я создал смешанный набор данных из 71 500 образцов. Источники данных и стратегия выборки показаны в таблице ниже: — Модель и структура: мы использовали библиотеку unsloth для эффективного обучения…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Jackrong
Теги: llama, text-generation-inference, unsloth, gguf, conversational, en, zh, endpoints_compatible
Лайков: 5  |  Загрузок: 462

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.