SOLAR-10.7B-Instruct-v1.0 настроен так, чтобы меньше подвергаться цензуре. Информацию о модели и инструкции по использованию см. в документе upstage/SOLAR-10.7B-Instruct-v1.0. Эта модель была обучена с использованием Lora и DPOTrainer на unalignment/токсических-dpo-v0.1.
Модальности:
Генерация текста
Области применения:
Следование инструкциям
Задача: Генерация текста
Автор: w4r10ck
Теги: llama, model-index, text-generation-inference, endpoints_compatible
Лайков: 43 | Загрузок: 52
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.