Точная настройка DPO объединенной модели jpacifico/Chocolatine-2-merged-qwen25arch (архитектура Qwen-2.5-14B) с использованием переработанного набора данных RLHF jpacifico/french-orca-dpo-pairs. Обучение французскому языку также улучшает общие возможности модели. Топ-3 всех категорий в таблице лидеров французского правительства LLM FR Chocolatine-2-14B-Instruct-v2.0.3 выделяется как самая сильная модель с открытым весом с совокупным баллом 45,05%. Здесь представлены результаты тестов Chocolatine-2 превосходит свои предыдущие версии и модель Qwen-2.5 с базовой архитектурой на MT-Bench-French, используемую с многоязычным-mt-bench и GPT-4-Turbo в качестве судьи LLM. Моя цель состояла в том, чтобы добиться производительности GPT-4o-mini на французском языке. Эта версия приближается к производительности модели OpenAI в соответствии с этим тестом. Chocolatine-2 — это наиболее эффективная точно настроенная модель 14B (Ex-aequo со средним баллом 41,08) в таблице лидеров OpenLLM. [Обновлено 12 февраля 2025 г.] Серия моделей Chocolatine-2 — это быстрая демонстрация того, что базовая модель может легко настраивать для достижения превосходной производительности. У него нет механизма модерации. — Разработчик: Джонатан Пасифико, 2025 г. — Тип модели: LLM — Язык(и) (NLP): французский, английский…
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: jpacifico
Теги: qwen2, chocolatine, dpo, conversational, fr, en, text-generation-inference, endpoints_compatible
Лайков: 14 | Загрузок: 38
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.