LoneStriker/NeuralHermes-2.5-Mistral-7B-5.0bpw-h6-exl2 - Каталог нейросетей
Генерация текста

LoneStriker/NeuralHermes-2.5-Mistral-7B-5.0bpw-h6-exl2

Добавлено:
LoneStriker/NeuralHermes-2.5-Mistral-7B-5.0bpw-h6-exl2

NeuralHermes представляет собой модель teknium/OpenHermes-2.5-Mistral-7B, которая была дополнительно доработана с помощью оптимизации прямых предпочтений (DPO) с использованием набора данных mlabonne/chatmldpopairs. Он превосходит исходную модель по нескольким показателям (см. результаты). Он непосредственно вдохновлен процессом RLHF, описанным авторами Intel/neural-chat-7b-v3-1 для повышения производительности. Я использовал тот же набор данных и переформатировал его для применения шаблона ChatML. The code to train this model is available on Google Colab and GitHub. It required an A100 GPU for about an hour. GGUF: https://huggingface.co/TheBloke/NeuralHermes-2.5-Mistral-7B-GGUF AWQ: https://huggingface.co/TheBloke/NeuralHermes-2.5-Mistral-7B-AWQ * EXL2 (5pbw): https://huggingface.co/IconicAI/NeuralHermes-2.5-Mistral-7B-exl2-5bpw Teknium (author of OpenHermes-2.5-Mistral-7B) benchmarked the model (see his tweet). Results are improved on every benchmark: AGIEval (from 43.07% to 43.62%), GPT4All (from 73.12% to 73.25%), and TruthfulQA. You can run this model using LM Studio or any other frontend. LoRA: r=16 loraalpha=16 loradropout=0.05 bias=»none» tasktype=»CAUSALLM» targetmodules=[‘kproj’, ‘gateproj’, ‘vproj’, ‘upproj’, ‘qproj’, ‘oproj’,…

Модальности:
Генерация текста

Области применения:
Следование инструкциям Диалог / чат


Задача: Генерация текста
Автор: LoneStriker
Теги: mistral, instruct, finetune, chatml, gpt4, synthetic data, distillation, dpo
Лайков: 3  |  Загрузок: 12

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.