Метка: RLHF - Страница 5 - Каталог нейросетей

Метка: RLHF

Генерация текста

bartowski/Hermes-2-Pro-Llama-3-8B-exl2

«Основная» ветка содержит только файл Measure.json, загрузите одну из других веток для модели (см. ниже). Каждая ветка содержит...

Генерация текста

mlabonne/AlphaMonarch-7B-2bit-HQQ

tl;dr: AlphaMonarch-7B — это новое слияние DPO, которое сохраняет все мыслительные способности самых лучших слияний и значительно улучшает...

Генерация текста

lmstudio-community/Athene-V2-Agent-GGUF

👾 Программа хайлайтов моделей LM Studio Community. Выделение новых и заслуживающих внимания моделей сообществом. Присоединяйтесь к обсуждению в...

Генерация текста

bartowski/Hermes-2-Pro-Llama-3-8B-GGUF

Исходная модель: https://huggingface.co/NousResearch/Hermes-2-Pro-Llama-3-8B Все количественные расчеты выполнены с использованием опции imatrix с набором данных, предоставленным Kalomaze здесь. Отличная...

Генерация текста

bartowski/Athene-V2-Agent-GGUF

Исходная модель: https://huggingface.co/Nexusflow/Athene-V2-Agent Некоторые из этих квантов (Q3KXL, Q4KL и т. д.) представляют собой стандартный метод квантования, в...

Генерация текста

PKU-Baichuan-MLSystemLab/Llama3-PBM-Nova-70B

Llama3-PBM-Nova-70B — модель чата, разработанная PKU-Baichuan-MLSysLab на основе Llama3-70B. Чтобы лучше использовать данные с открытым исходным кодом, мы...

Генерация текста

OpenPipe/Hermes-2-Theta-Llama-3-8B-32k

Hermes-2 Θ (Theta) — первая экспериментальная объединенная модель, выпущенная Nous Research в сотрудничестве с Чарльзом Годдардом из Arcee,...

Генерация текста

tanamettpk/TC-instruct-DPO

TC инструктирует DPO, настроенный Тайфун 7B и SCB 10X, Mistral 7B — v0.1 อีกที TC инструктирует DPO Данные...