lmstudio-community/Starling-LM-7B-beta-GGUF - Каталог нейросетей
Генерация текста

lmstudio-community/Starling-LM-7B-beta-GGUF

Добавлено:
lmstudio-community/Starling-LM-7B-beta-GGUF

👾 Программа хайлайтов моделей LM Studio Community. Выделение новых и заслуживающих внимания моделей сообществом. Присоединяйтесь к обсуждению в Discord. Создатель модели: Nexusflow Исходная модель: Starling-LM-7B-beta Квантование GGUF: предоставлено bartowski на основе версии llama.cpp b2440. Starling-LM-7B-beta — это итерация серии моделей Starling, основанная на работе berkeley-nest, выпустившей Starling-LM-7B-alpha. Эта модель является доработанной версией openchat/openchat-3.5-0106 на основе Mistral-7B-v0.1. Использование Nexusflow/Starling-RM-34B в качестве модели вознаграждения и метода оптимизации политики точной настройки языковых моделей на основе человеческих предпочтений (PPO) для получения впечатляющих результатов для такой небольшой модели. Под капотом модель увидит приглашение следующего формата: Вы также можете выбрать «OpenChatCode» для помощника по кодированию. Под капотом модель увидит подсказку следующего формата: Starling-LM-7B-beta настроена для достижения впечатляющей производительности многооборотного чата. Базовая модель была разработана как универсальная и настроенная на кодирование модель, поэтому она хорошо подойдет как для общих задач, так и для кодирования. >Правильный пользователь GPT4: Почему небо голубое? >GPT4 Правильный помощник: небо кажется голубым…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: lmstudio-community
Теги: gguf, reward model, RLHF, RLAIF, en, endpoints_compatible, conversational
Лайков: 6  |  Загрузок: 223

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.