EVA-UNIT-01/EVA-Qwen2.5-72B-v0.1 - Каталог нейросетей
Генерация текста

EVA-UNIT-01/EVA-Qwen2.5-72B-v0.1

Добавлено:
EVA-UNIT-01/EVA-Qwen2.5-72B-v0.1

Модель специалиста по ролевой игре и написанию историй, полнопараметрическая точная настройка Qwen2.5-72B на смеси синтетических и естественных данных. Он использует смесь данных Celeste 70B 0,1, значительно расширяя ее для улучшения универсальности, креативности и «ароматности» получаемой модели. Примечания к версии 0.1: переработанный набор данных (через Cahvay для 32B 0.2, также используется здесь), измененная конфигурация обучения для 8xH100 SXM. Значительные улучшения в следовании инструкциям, более глубоком понимании контекста и общей согласованности по сравнению с версией 0.0. Формат запроса — ChatML. Рекомендуемые значения сэмплера: Температура: 1 Min-P: 0,05 Top-A: 0,2 Штраф за повторение: 1,03 Рекомендуемые пресеты SillyTavern (через CalamitousFelicitousness): Данные обучения: смесь данных Celeste 70B 0,1 минус подмножество Opus Instruct. Подробности смотрите на карточке этой модели. Набор данных OpusInstruct25k Каломазе, отфильтрованный на предмет отказов. Подмножество (1 тыс. строк) ChatGPT-4o-WritingPrompts от Gryphe. Подмножество (2 тыс. строк) наборов данных Sonnet3.5-Charcards-Roleplay от Gryphe Synthstruct и SynthRP от Epiculous. Подмножество из Dolphin-2.9.3, включая отфильтрованную версию not_samantha и небольшое подмножество systemchat. Время обучения и оборудование: 15 часов на 8xH100 SXM, предоставлено моделью FeatherlessAI…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: EVA-UNIT-01
Теги: qwen2, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 19  |  Загрузок: 12

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.