gemma-2b-zephyr-dpo
Мы обучили google/gemma-2b с помощью DPO и данных из argilla/dpo-mix-7k. Мы тщательно выбрали гиперпараметры для достижения наилучшей производительности...
Мы обучили google/gemma-2b с помощью DPO и данных из argilla/dpo-mix-7k. Мы тщательно выбрали гиперпараметры для достижения наилучшей производительности...
Это Гермес-2-Про-Мистраль-10.7Б, увеличенная по глубине версия NousResearch/Гермес-2-Про-Мистраль-7Б. Эта модель предназначена для использования в качестве основы для дальнейшей точной...
Оригинальная модель: https://huggingface.co/NousResearch/Hermes-2-Pro-Mistral-7B Хотите поддержать мою работу? Посетите мою страницу ко-фи здесь: https://ko-fi.com/bartowski Модальности:Генерация текста Области применения:Следование инструкциям...
«Основная» ветка содержит только файл «meaurement.json», загрузите одну из других веток для модели (см. ниже). Каждая ветка содержит...
DPO Finetuned CultriX/NeuralTrix-7B-dpo с использованием argilla/OpenHermes2.5-dpo-binarized-alpha Бинаризованные пары argilla dpo — это набор данных, построенный на основе: https://huggingface.co/datasets/teknium/OpenHermes-2.5...
Это карточка модели трансформера 🤗, которую выложили на Хаб. Эта карточка модели была создана автоматически. – Разработчик: Анкуш...
Тренажер DPO с набором данных jondurbin/truthy-dpo-v0.1 для улучшения [TomGrc/FusionNet34Bx2_MoE] Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста...
Это настроенная по предпочтениям версия mlabonne/Beagle14-7B, в которой используется смесь пар косаток Argilla и новый предстоящий многооборотный набор...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
Модель генерации текста Модальности:Генерация текста Области применения:Следование инструкциям Диалог / чат Задача: Генерация текста Автор: second-state Теги: gguf,...