Starling-LM-11B-alpha
— Разработчики: Банхуа Чжу, Эван Фрик, Тяньхао Ву, Ханлинь Чжу и Цзянтао Цзяо. — Тип модели: языковая модель,...
— Разработчики: Банхуа Чжу, Эван Фрик, Тяньхао Ву, Ханлинь Чжу и Цзянтао Цзяо. — Тип модели: языковая модель,...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
Исходная модель: https://huggingface.co/Nexusflow/Starling-LM-7B-beta Хотите поддержать мою работу? Посетите мою страницу ко-фи здесь: https://ko-fi.com/bartowski Модальности:Генерация текста Области применения:Диалог /...
> Нейронный DPO OpenHermes 2.5, для DPO важно высокое качество! Эта модель является виртуальным партнером по запуску нашего...
— Разработчики: Цзе Лю \(^{1,2}\), Чжаньхуэй Чжоу \(^{2}\), Цзяхэн Лю \(^{2}\), Синъюань Бу \(^{2}\), Чао Ян \(^{2}\), Хан-Сен...
Notus — это набор точно настроенных моделей, использующих прямую оптимизацию предпочтений (DPO) и связанные с ней методы RLHF....
Эта модель представляет собой настроенную по предпочтениям версию mistralai/Mixtral-8x7B-Instruct-v0.1 на наборе данных argilla/ultrafeedback-binarized-preferences, очищенном с использованием DPO (прямая...
— Разработано: командой Nexusflow (Бангхуа Чжу, Эван Фрик, Тяньхао Ву, Ханлинь Чжу, Картик Ганесан, Вэй-Линь Чан, Цзянь Чжан...
— Разработчики: Банхуа Чжу, Эван Фрик, Тяньхао Ву, Ханлинь Чжу и Цзянтао Цзяо. — Тип модели: языковая модель,...