tastypear/CausalLM-7B-DPO-alpha-GGUF - Каталог нейросетей
Генерация текста

tastypear/CausalLM-7B-DPO-alpha-GGUF

Добавлено:
tastypear/CausalLM-7B-DPO-alpha-GGUF

Я сделал квантованную версию этой модели, обратившись к формату публикации TheBloke и основываясь на рекомендации TheBloke/CausalLM-7B-GGUF. 我参考 TheBloke 的发布格式,并根据 TheBloke/CausalLM-7B-GGUF 的推荐,制作了这个模型的量化版本。 Для получения подробной информации, пожалуйста, обратитесь к версия без обучения DPO: CausalLM/7B. Следует отметить, что это не версия, которая продолжает обучение на CausalLM/14B и 7B, а скорее оптимизированная версия, которая прошла обучение DPO одновременно в предыдущей ветви обучения, и некоторые подробные параметры могли измениться. Вам все равно придется скачать полную модель. Скоро будет выпущена бета-ветвь, в которой будут использоваться некоторые агрессивные подходы, которые могут нанести ущерб определенным задачам, чтобы добиться лучшего соответствия человеческим предпочтениям и стремиться соответствовать или превосходить стандарты GPT-3.5. Следите за обновлениями. Отказ от ответственности: обратите внимание, что модель была обучена на нефильтрованных данных из Интернета. Поскольку у нас нет возможности проверить все это, может присутствовать значительное количество нежелательного контента, порнографии, насилия и оскорбительных выражений, которые мы не сможем удалить. Поэтому вам все равно придется самостоятельно проверять безопасность модели и фильтровать…

Модальности:
Генерация текста


Задача: Генерация текста
Автор: tastypear
Теги: gguf, llama, llama2, qwen, en, zh
Лайков: 43  |  Загрузок: 672

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.