Mixtral-8x7B-Holodeck-v1
Mistral 7B-Holodeck — это усовершенствованная версия, созданная на основе модели Mixtral 8x7B. Данные обучения содержат около 3000 электронных...
Mistral 7B-Holodeck — это усовершенствованная версия, созданная на основе модели Mixtral 8x7B. Данные обучения содержат около 3000 электронных...
MixtureofMerges-MoE-4x7b-v4 — это смесь экспертов (MoE), созданная с использованием следующих моделей с использованием LazyMergekit: flemmingmiguel/MBX-7B-v3 Kukedlc/NeuTrixOmniBe-7B-model-remix PetroGPT/WestSeverus-7B-DPO vanillaOVO/supermario_v4...
Название модели: Moe-3x7b-QA-Code-Inst Издатель: nextai-team Тип модели: ответы на вопросы и генерация кода Архитектура: смесь экспертов (MoE) Размер...
🌟Купить мне кофе – это прямой способ проявить поддержку этого проекта. AdaptLLM-4x7B-MoE — это смесь экспертов (MoE), созданная...
🌟Купить мне кофе – это прямой способ проявить поддержку этого проекта. smolllama-4x220M-MoE — это смесь экспертов (MoE), созданная...
Тренажер DPO с набором данных jondurbin/truthy-dpo-v0.1 для улучшения [TomGrc/FusionNet34Bx2_MoE] Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста...
— leveldevai/TurdusBeagle-7B — база — leveldevai/TurdusBeagle-7B — эксперт №1 — udkai/Turdus — эксперт №2 — nfaheem/Marcoroni-7b-DPO-Merge — эксперт...
Выпуклый франкенМоЭ. Создано путем улучшения оригинального сценария Серафима. Были реализованы следующие модели: — kyujinpy/Sakura-SOLAR-Instruct — база — PracticeLLM/SOLAR-tail-10.7B-Merge-v1.0...
ФранкенМЭ, использующий SOLAR 10.7B в качестве архитектуры. Используются следующие модели: — bhavinjawade/SOLAR-10B-Nector-DPO-Jawade — база — bhavinjawade/SOLAR-10B-Nector-DPO-Jawade — эксперт...
Модель генерации текста Модальности:Генерация текста Задача: Генерация текста Автор: cloudyu Теги: mixtral, moe, dpo, text-generation-inference, endpoints_compatibleЛайков: 4 | ...