Magpie-Align/MagpieLM-8B-Chat-v0.1 - Каталог нейросетей
Генерация текста

Magpie-Align/MagpieLM-8B-Chat-v0.1

Добавлено:
Magpie-Align/MagpieLM-8B-Chat-v0.1

Эта модель представляет собой согласованную версию мета-ламы/Мета-ламы-3.1-8B, которая обеспечивает самые современные характеристики среди SLM с открытой ориентацией. Он даже превосходит более крупные модели с открытым весом, включая Llama-3-8B-Instruct, Llama-3.1-8B-Instruct, Qwen-2-7B-Instruct и Gemma-2-9B-it. Мы применяем следующий стандартный конвейер выравнивания с двумя тщательно созданными синтетическими наборами данных. Сначала мы выполняем SFT, используя Magpie-Align/MagpieLM-SFT-Data-v0.1. Контрольная точка модели SFT:** Magpie-Align/MagpieLM-8B-SFT-v0.1 Затем мы выполняем DPO для набора данных Magpie-Align/MagpieLM-DPO-Data-v0.1. — Alpaca Eval 2: 58,18 (LC), 62,38 (WR) — Arena Hard: 48,4 — Оценка WildBench WB (v2.0625): 44,72 Шаблон разговора: для лучшей производительности используйте шаблон чата Llama 3. Ограничения: эта модель в основном понимает и генерирует контент на английском языке. Его выходные данные могут содержать фактические ошибки, логические несоответствия или отражать систематические ошибки, присутствующие в обучающих данных. Хотя модель направлена ​​на улучшение выполнения инструкций и повышение полезности, она не предназначена специально для сложных задач рассуждения, что потенциально может привести к неоптимальной производительности в этих областях. Кроме того, модель может выдавать небезопасные или неподходящие…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Magpie-Align
Теги: llama, alignment-handbook, trl, dpo, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 23  |  Загрузок: 24

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.