Метка: DPO - Страница 12 - Каталог нейросетей

Метка: DPO

Генерация текста

argilla/distilabeled-Marcoro14-7B-slerp

Эта модель представляет собой новую доработку DPO нашего нового открытого набора данных argilla/distilabel-intel-orca-dpo-pairs на модели mlabonne/Marcoro14-7B-slerp. Вы можете...

Генерация текста

ToastyPigeon/Qwen3.5-27B-Marvin-DPO-V2

Модель Qwen3.5-27B, идеально настроенная для высококачественного творческого письма и ролевых игр, с применением DPO для уменьшения повторов, подавления...

Генерация текста

bartowski/NeuralDaredevil-8B-abliterated-GGUF

Исходная модель: https://huggingface.co/mlabonne/NeuralDaredevil-8B-abliterated. Если размер модели превышает 50 ГБ, она будет разделена на несколько файлов. Чтобы загрузить их...

Генерация текста

MaziyarPanahi/Llama-3-8B-Instruct-64k

Эта модель была создана на основе великого @winglian с его последней моделью winglian/Llama-3-8b-64k-PoSE > Эта модель использует PoSE...

Генерация текста

mlabonne/NeuralMonarch-7B

NeuralMonarch-7B — это DPO, доработанный для mlabonne/Monarch-7B с использованием наборов данных предпочтений jondubin/truthy-dpo-v0.1 и argilla/distilabel-intel-orca-dpo-pairs. Он основан на...

Генерация текста

VAGOsolutions/SauerkrautLM-7b-LaserChat

Представляем SauerkrautLM-7b-LaserChat — нашу версию мощного openchat/openchat-3.5-0106 для квашеной капусты! Модель SauerkrautLM-7b-LaserChat — совместная разработка VAGO Solutions и...

Генерация текста

tenyx/TenyxChat-8x7B-v1

Представляем TenyxChat-8x7B-v1, часть нашей серии TenyxChat, предназначенную для работы в качестве полезных помощников посредством настройки предпочтений с использованием...