Вихр-Немо — это наша флагманская унимодальная LLM (Large Language Model), представляющая из себя улучшенную версию mistralai/Mistral-Nemo-Instruct-2407 команды VikhrModels, адаптированную для русского и английского языков. Для ее обучения мы воспользовались несколькими этапами, включающими в себя SFT и SMPO — нашу собственную вариацию DPO, подробнее читайте в разделе «Как создавалась эта модель». Модель сохраняется для различных вариантов использования, включая риинг, ограничение размера, код, ролевую игру, поддержание диалога. Вихрь-Немо обладает многоязычной генерацией, и высокопроизводительными возможностями RAG. Модель имеет лучшие оценки среди остальных на наших инструктивных и RAG-бенчаргах, и поэтому мы верим, что в некоторых задачах (например, RAG) может быть не хуже gpt-4o-mini от OpenAI. Полностью использованный основной код для обучения доступен в нашем репозитории effectllmalignment на GitHub, а наборы дат доступны в нашем профиле на HF. 1. Высокое качество генерации на английском и английском языках, а также в некоторых других странах, благодаря набору дат Grandmaster-PRO-MAX и исходной модели 2. Поддержка системных промптов для регулирования стилей атак 3.…
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: Vikhrmodels
Теги: mistral, conversational, en, ru, text-generation-inference, endpoints_compatible
Лайков: 138 | Загрузок: 2,859
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.