Метка: moe - Каталог нейросетей

Метка: moe

Генерация текста

MaziyarPanahi/Qwen1.5-MoE-A2.7B-Wikihow

Эта модель представляет собой доработанную версию Qwen/Qwen1.5-MoE-A2.7B из набора данных HuggingFaceTB/cosmopedia. Во время обучения использовались следующие гиперпараметры: —...

Генерация текста

Corianas/Tiny-Moe

Tiny-moe — это смесь экспертов (MoE), созданная с использованием следующих моделей с использованием LazyMergekit: Corianas/TinyTest * Corianas/TinyTask-minipaca. Модальности:Генерация...

Генерация текста

davideuler/NebulaNet-v2-4x7B-moe

NebulaNet-v2: MOE из 4 экспертных моделей 7b. Он хорош в кодировании и многоязычном переводе. Он также должен свободно...

Генерация текста

NeuralNovel/Mini-Mixtral-v0.2

Mini-Mixtral-v0.2 — это смесь экспертов (MoE), созданная с использованием следующих моделей с использованием LazyMergekit: unsloth/mistral-7b-v0.2 mistralai/Mistral-7B-Instruct-v0.2 Масштаб модели...

Генерация текста

bartowski/Beyonder-4x7B-v3-exl2

«Основная» ветка содержит только файл «meaurement.json», загрузите одну из других веток для модели (см. ниже). Каждая ветка содержит...

Генерация текста

AmeerH/Mistral-Math-2x7b-mix

Mistral-Math-2x7b-mix — это смесь экспертов (MoE), созданная с использованием следующих моделей с использованием LazyMergekit: mistralai/Mistral-7B-Instruct-v0.2 мета-математика/MetaMath-Mistral-7B Модальности:Генерация текста...

Генерация текста

Locutusque/Hyperion-3.0-Mixtral-3x7B

Это первая экспериментальная попытка создания языковой модели Mixture of Experts (MoE) путем объединения нескольких экспертных моделей Mistral. Модель...

Генерация текста

MaziyarPanahi/Qwen1.5-8x7b-v0.1

Эта модель представляет собой доработанную версию MaziyarPanahi/Qwen1.5-8x7b в наборе данных Crystalcareai/MoD-150k. В оценочном наборе были получены следующие результаты:...