RefuelLLM-2-small, также известная как Llama-3-Refueled, представляет собой инструкцию базовой модели Llama3-8B, настроенную на корпусе из более чем 2750 наборов данных и охватывающую такие задачи, как классификация, понимание прочитанного, извлечение структурированных атрибутов и разрешение объектов. Мы рады открыть исходный код модели, которую сообщество сможет использовать. Более подробная информация о семействе моделей RefuelLLM-2. Вы также можете опробовать модели на нашей игровой площадке LLM. Архитектура — Llama-3-Refueled построена на основе Llama-3-8B-instruct, которая представляет собой авторегрессионную языковую модель, использующую оптимизированную архитектуру преобразователя. В этом репозитории содержатся гири для Llama-3-Refueled, совместимые с HuggingFace. См. фрагмент ниже для использования с Transformers: Обе модели были обучены на более чем 4 миллиардах токенов, охватывающих более 2750 задач НЛП. Наша обучающая коллекция состоит в основном из: 1. Аннотированных наборов данных, таких как Flan, Task Source и коллекция Aya. 2. Синтетических наборов данных, таких как OpenOrca, OpenHermes и WizardLM. 3. Собственных наборов данных, разработанных или лицензированных Refuel AI. В этом разделе мы сообщаем о результатах моделей Refuel в нашем тесте задач маркировки. Подробности о методике смотрите здесь. ПровайдерМодельLLM…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: refuelai
Теги: llama, data labeling, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 190 | Загрузок: 9,368
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.