Azzurro — это обновленная версия Mistral-7B-v0.2, специально доработанная с помощью настроек SFT и LoRA. — Он обучен на общедоступных наборах данных, таких как SQUAD-it, и наборах данных, которые мы создали самостоятельно. — он предназначен для понимания и поддержания контекста, что делает его идеальным для задач и приложений с расширенной генерацией данных (RAG), требующих контекстуальной осведомленности. Мы оценивали модель с использованием тех же наборов тестов, которые использовались для таблицы лидеров Open Ita LLM. Обязательно установите эти зависимости перед запуском программы. Azzurro не был согласован с человеческими предпочтениями в отношении безопасности на этапе RLHF и не развернут с внутрицикловой фильтрацией ответов, такой как ChatGPT, поэтому модель может выдавать проблемные выходные данные (особенно, когда это предлагается сделать). Также неизвестно, какой размер и состав корпуса использовался для обучения базовой модели (mistralai/Mistral-7B-v0.2), однако, вероятно, он включал в себя сочетание веб-данных и технических источников, таких как книги и код. — Набор данных SQUAD-it: https://huggingface.co/datasets/squadit — Исходные веса Mistral7Bv0.2: https://models.mistralcdn.com/mistral-7b-v0-2/mistral-7B-v0.2.tar — Модель Mistral7Bv0.2:…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: MoxoffSrL
Теги: mistral, sft, it, chatml, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 8 | Загрузок: 1,188
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.