notus-7B-v1-AWQ
Chat & support: TheBloke’s Discord server Want to contribute? TheBloke’s Patreon page TheBloke’s LLM work is generously supported...
Chat & support: TheBloke’s Discord server Want to contribute? TheBloke’s Patreon page TheBloke’s LLM work is generously supported...
Notus is a collection of fine-tuned models using Direct Preference Optimization (DPO) and related RLHF techniques. This model...
UltraCM-13B — это тонко настроенный LLM для критики завершения, позволяющий оценить результаты LLM на предмет полезности, правдивости, честности...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
Notus — это набор точно настроенных моделей, использующих прямую оптимизацию предпочтений (DPO) и связанные с ней методы RLHF....
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
Notus — это набор точно настроенных моделей, использующих прямую оптимизацию предпочтений (DPO) и связанные с ней методы RLHF....
Эта модель представляет собой настроенную по предпочтениям версию mistralai/Mixtral-8x7B-Instruct-v0.1 на наборе данных argilla/ultrafeedback-binarized-preferences, очищенном с использованием DPO (прямая...