Umbra-v3-MoE-4x11b-2ex
body { семейство шрифтов: ‘Quicksand’, без засечек; фон: линейный градиент (135 градусов, #2E3440 0%, #1A202C 100%); цвет: #D8DEE9;...
body { семейство шрифтов: ‘Quicksand’, без засечек; фон: линейный градиент (135 градусов, #2E3440 0%, #1A202C 100%); цвет: #D8DEE9;...
Эта модель представляет собой доработанную версию Qwen/Qwen1.5-MoE-A2.7B из набора данных HuggingFaceTB/cosmopedia. Во время обучения использовались следующие гиперпараметры: —...
Tiny-moe — это смесь экспертов (MoE), созданная с использованием следующих моделей с использованием LazyMergekit: Corianas/TinyTest * Corianas/TinyTask-minipaca. Модальности:Генерация...
NebulaNet-v2: MOE из 4 экспертных моделей 7b. Он хорош в кодировании и многоязычном переводе. Он также должен свободно...
Mini-Mixtral-v0.2 — это смесь экспертов (MoE), созданная с использованием следующих моделей с использованием LazyMergekit: unsloth/mistral-7b-v0.2 mistralai/Mistral-7B-Instruct-v0.2 Масштаб модели...
«Основная» ветка содержит только файл «meaurement.json», загрузите одну из других веток для модели (см. ниже). Каждая ветка содержит...
Mistral-Math-2x7b-mix — это смесь экспертов (MoE), созданная с использованием следующих моделей с использованием LazyMergekit: mistralai/Mistral-7B-Instruct-v0.2 мета-математика/MetaMath-Mistral-7B Модальности:Генерация текста...
Это первая экспериментальная попытка создания языковой модели Mixture of Experts (MoE) путем объединения нескольких экспертных моделей Mistral. Модель...
Эта модель представляет собой доработанную версию MaziyarPanahi/Qwen1.5-8x7b в наборе данных Crystalcareai/MoD-150k. В оценочном наборе были получены следующие результаты:...
Привет, мне нужно добраться из Нью-Йорка в Лос-Анджелес. Можете ли вы мне помочь с этим? В комнате трое...