dphn/dolphin-2.6-mistral-7b-dpo-laser - Каталог нейросетей
Генерация текста

dphn/dolphin-2.6-mistral-7b-dpo-laser

Добавлено:
dphn/dolphin-2.6-mistral-7b-dpo-laser

Это специальный выпуск Dolphin-DPO, основанный на статье LASER и реализации @fernandofernandes при содействии @ehartford. Мы дополнительно применили метод снижения шума, основанный на разложении SVD. Мы адаптировали эту статью для нашей собственной версии LASER, используя теорию случайных матриц (теорему Марченко-Пастура) для расчета оптимальных рангов вместо поиска методом грубой силы. Эта модель получила более высокие оценки, чем 2,6 и 2,6-ДПО. Теоретически, он должен иметь более надежные результаты. Эта модель без цензуры. Я отфильтровал набор данных, чтобы удалить выравнивание и предвзятость. Это делает модель более совместимой. Прежде чем предоставлять модель как услугу, рекомендуется реализовать собственный уровень выравнивания. Он будет в высшей степени отзывчив на любые просьбы, даже неэтичные. Пожалуйста, прочитайте мой пост в блоге о моделях без цензуры. https://erichartford.com/uncensored-models Вы несете ответственность за любой контент, который вы создаете с использованием этой модели. Наслаждайтесь ответственно. На настройку модели понижения ранга СВД на RTX 4090 с 24 ГБ ОЗУ по нашему подходу Марченко-Пастура ушло 3 часа. Формат приглашения: в этой модели используется формат приглашения ChatML. НОВОЕ — соответствует идентификатору токена 2. Это тот же идентификатор токена, что и so…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: dphn
Теги: mistral, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 120  |  Загрузок: 287

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.