Magpie-Align/MagpieLM-4B-Chat-v0.1 - Каталог нейросетей
Генерация текста

Magpie-Align/MagpieLM-4B-Chat-v0.1

Добавлено:
Magpie-Align/MagpieLM-4B-Chat-v0.1

Эта модель представляет собой согласованную версию Llama-3.1-Minitron-4B-Width, которая обеспечивает самые современные характеристики среди SLM с открытой ориентацией. Он даже превосходит более крупные модели с открытым весом, включая Llama-3-8B-Instruct, Llama-3.1-8B-Instruct и Qwen-2-7B-Instruct. Мы применяем следующий стандартный конвейер выравнивания с двумя тщательно созданными синтетическими наборами данных. Не стесняйтесь использовать эти наборы данных и воспроизводить нашу модель или создавать своих собственных дружественных чат-ботов 🙂 Сначала мы выполняем SFT с помощью Magpie-Align/MagpieLM-SFT-Data-v0.1. Контрольная точка модели SFT:** Magpie-Align/MagpieLM-4B-SFT-v0.1 Затем мы выполняем DPO для набора данных Magpie-Align/MagpieLM-DPO-Data-v0.1. — Alpaca Eval 2: 40,99 (LC), 45,19 (WR) — Arena Hard: 24,6 — Оценка WildBench WB (v2.0625): 32,37 Шаблон разговора: для лучшей производительности используйте шаблон чата Llama 3. Ограничения: эта модель в основном понимает и генерирует контент на английском языке. Его выходные данные могут содержать фактические ошибки, логические несоответствия или отражать систематические ошибки, присутствующие в обучающих данных. Хотя модель направлена ​​на улучшение выполнения инструкций и повышение полезности, она не предназначена специально для сложных логических задач, что потенциально может привести к неоптимальной производительности…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Magpie-Align
Теги: llama, alignment-handbook, trl, dpo, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 20  |  Загрузок: 13

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.