Метка: RLAIF - Страница 2 - Каталог нейросетей

Метка: RLAIF

Генерация текста

CallComply/Starling-LM-11B-alpha

— Разработчики: Банхуа Чжу, Эван Фрик, Тяньхао Ву, Ханлинь Чжу и Цзянтао Цзяо. — Тип модели: языковая модель,...

Генерация текста

TheBloke/notus-7B-v1-GGUF

Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...

Генерация текста

bartowski/Starling-LM-7B-beta-GGUF

Исходная модель: https://huggingface.co/Nexusflow/Starling-LM-7B-beta Хотите поддержать мою работу? Посетите мою страницу ко-фи здесь: https://ko-fi.com/bartowski Модальности:Генерация текста Области применения:Диалог /...

Генерация текста

jieliu/Storm-7B

— Разработчики: Цзе Лю \(^{1,2}\), Чжаньхуэй Чжоу \(^{2}\), Цзяхэн Лю \(^{2}\), Синъюань Бу \(^{2}\), Чао Ян \(^{2}\), Хан-Сен...

Генерация текста

argilla/notus-7b-v1

Notus — это набор точно настроенных моделей, использующих прямую оптимизацию предпочтений (DPO) и связанные с ней методы RLHF....

Генерация текста

argilla/notux-8x7b-v1

Эта модель представляет собой настроенную по предпочтениям версию mistralai/Mixtral-8x7B-Instruct-v0.1 на наборе данных argilla/ultrafeedback-binarized-preferences, очищенном с использованием DPO (прямая...

Генерация текста

Nexusflow/Starling-LM-7B-beta

— Разработано: командой Nexusflow (Бангхуа Чжу, Эван Фрик, Тяньхао Ву, Ханлинь Чжу, Картик Ганесан, Вэй-Линь Чан, Цзянь Чжан...

Генерация текста

berkeley-nest/Starling-LM-7B-alpha

— Разработчики: Банхуа Чжу, Эван Фрик, Тяньхао Ву, Ханлинь Чжу и Цзянтао Цзяо. — Тип модели: языковая модель,...