 CataLlama-v0.1-Instruct-DPO — это точная настройка DPO catallama/CataLlama-v0.1-Instruct-SFT в наборе данных catallama/Catalan-DPO. CataLlama была обучена примерно на 445 миллионах новых токенов в три отдельных этапа. Это 3-й и заключительный этап обучения. Модель показывает улучшенное владение каталонским языком. Это точно настроенная модель инструкции, оптимизированная с помощью DPO, владеющая следующими задачами на каталанском языке — Извлечение информации (подходит для RAG) — Распознавание именованных сущностей (NER) — Перевод с английского на каталанский и с каталанского на английский — Резюме — как короткая, так и длинная форма — Анализ настроений Разработчики модели Laurentiu Petrea на основе Llama-3 из Meta. Model Architecture CataLlama — это авторегрессионная языковая модель, использующая оптимизированную архитектуру трансформатора. Настроенные версии используют контролируемую точную настройку (SFT) и прямую оптимизацию предпочтений (DPO), чтобы соответствовать человеческим предпочтениям в отношении полезности и безопасности. Лицензия Модель использует лицензию llama-3, доступную по адресу: https://llama.meta.com/llama3/license Модель следует тому же шаблону подсказки…
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: catallama
Теги: llama, llama-3, Catalan, conversational, ca, en, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 15
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.