Метка: RLHF - Страница 2 - Каталог нейросетей

Метка: RLHF

Генерация текста

second-state/Starling-LM-7B-alpha-GGUF

Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: second-state Теги: gguf, mistral, reward...

Генерация текста

dfurman/Qwen2-72B-Orpo-v0.1

Эта модель представляет собой доработанную версию Qwen/Qwen2-72B-Instruct на 1,5 тыс. рядов mlabonne/orpo-dpo-mix-40k. Он был обучен как универсальная языковая...

Генерация текста

bartowski/OrpoLlama-3-8B-GGUF

Исходная модель: https://huggingface.co/mlabonne/OrpoLlama-3-8B Все количественные расчеты сделаны с использованием опции imatrix с набором данных, предоставленным Kalomaze здесь. Отличная...

Генерация текста

MaziyarPanahi/Starling-LM-7B-beta-GPTQ

MaziyarPanahi/Starling-LM-7B-beta-GPTQ — это квантованная (GPTQ) версия Nexusflow/Starling-LM-7B-beta. Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: MaziyarPanahi...