AlphaMonarch-7B-GPTQ
tl;dr: AlphaMonarch-7B is a new DPO merge that retains all the reasoning abilities of the very best merges...
tl;dr: AlphaMonarch-7B is a new DPO merge that retains all the reasoning abilities of the very best merges...
EmertonOmniBeagle-7B-dpo is a DPO fine-tune of mlabonne/Monarch-7B using the yleo/emertondpopairsjudge preference dataset created from Intel/orcadpo_pairs by replacing gpt...
DPO Finetuned Kukedlc/NeuTrixOmniBe-7B-model-remix using argilla/OpenHermes2.5-dpo-binarized-alpha argilla dpo binarized pairs is a dataset built on top of: https://huggingface.co/datasets/teknium/OpenHermes-2.5 using...
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: cloudyu Теги: mixtral, yi, moe,...
DPO Trainer with dataset jondurbin/truthy-dpo-v0.1 to improve [TomGrc/FusionNet7Bx2MoE14B] Модальности:Генерация текста Задача: Генерация текста Автор: LoneStriker Теги: mixtral, moe,...
DPO’d из vicgalle/franken-SOLAR-18B-v1.0, SOLAR-подобная модель, масштабированная до 18B. Это модель франкенмерджа, созданная с использованием mergekit, чередующихся слоев Nous-Hermes-2-SOLAR-10.7B...
Чат Эти файлы были квантованы с использованием оборудования, любезно предоставленного Massed Compute. Модель(и) AWQ для вывода GPU. Модели...
Чат AWQ — это эффективный, точный и невероятно быстрый метод квантования с низким битовым весом, который в настоящее...
This model was converted to MLX format from [tenyx/TenyxChat-7B-v1](). Refer to the original model card for more details...
Chat & support: TheBloke’s Discord server Want to contribute? TheBloke’s Patreon page TheBloke’s LLM work is generously supported...