Phi-3-mini-4k-instruct-v0.3-GGUF
Исходная модель: https://huggingface.co/MaziyarPanahi/Phi-3-mini-4k-instruct-v0.3. Если размер модели превышает 50 ГБ, она будет разделена на несколько файлов. Чтобы загрузить их...
Исходная модель: https://huggingface.co/MaziyarPanahi/Phi-3-mini-4k-instruct-v0.3. Если размер модели превышает 50 ГБ, она будет разделена на несколько файлов. Чтобы загрузить их...
Эта модель, совместимая с DPO, представляет собой объединенную версию модели адаптера roinsmits/Qwen1.5-7B-Dutch-Chat-Dpo. Точная настройка DPO была выполнена на...
NeuTrixOmniBe-DPO представляет собой объединение следующих моделей с использованием LazyMergekit: Модальности:Генерация текста Задача: Генерация текста Автор: Kukedlc Теги: mistral,...
MaziyarPanahi/Turdus-GPTQ — это квантованная (GPTQ) версия udkai/Turdus. Модальности:Генерация текста Задача: Генерация текста Автор: MaziyarPanahi Теги: mistral, finetuned, quantized,...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
Обновление от 16.01.24: NeuralBeagle14-7B — (вероятно) лучшая модель 7B, которую вы можете найти! 🎉 NeuralBeagle14-7B — это тонкая...
Это очень ранняя модель, которая использует набор данных davanstrien/haiku_dpo для обучения teknium/OpenHermes-2.5-Mistral-7B с использованием прямой оптимизации предпочтений. Конечная...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
Точная настройка DPO объединенной модели jpacifico/Chocolatine-2-14B-Merged-base-Phi-4 (архитектура Microsoft/Phi-4, параметры 14B) с использованием набора данных rlhf jpacifico/french-orca-dpo-pairs-revised. Обучение французскому...
Тренажер DPO с набором данных Intel/orcadpopairs для улучшения [yunconglong/TruthfulDPOtomGrcFusionNet7Bx2MoE_13B] Модальности:Генерация текста Задача: Генерация текста Автор: yunconglong Теги: mixtral,...