Это специальный выпуск Dolphin-DPO, основанный на статье LASER и реализации @fernandofernandes при содействии @ehartford. Мы дополнительно применили метод снижения шума, основанный на разложении SVD. Мы адаптировали эту статью для нашей собственной версии LASER, используя теорию случайных матриц (теорему Марченко-Пастура) для расчета оптимальных рангов вместо поиска методом грубой силы. Эта модель получила более высокие оценки, чем 2,6 и 2,6-ДПО. Теоретически, он должен иметь более надежные результаты. Эта модель без цензуры. Я отфильтровал набор данных, чтобы удалить выравнивание и предвзятость. Это делает модель более совместимой. Прежде чем предоставлять модель как услугу, рекомендуется реализовать собственный уровень выравнивания. Он будет в высшей степени отзывчив на любые просьбы, даже неэтичные. Пожалуйста, прочитайте мой пост в блоге о моделях без цензуры. https://erichartford.com/uncensored-models Вы несете ответственность за любой контент, который вы создаете с использованием этой модели. Наслаждайтесь ответственно. На настройку модели понижения ранга СВД на RTX 4090 с 24 ГБ ОЗУ по нашему подходу Марченко-Пастура ушло 3 часа. Формат приглашения: в этой модели используется формат приглашения ChatML. НОВОЕ — соответствует идентификатору токена 2. Это тот же идентификатор токена, что и so…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: dphn
Теги: mistral, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 120 | Загрузок: 287
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.