 Это квантованная версия jpacifico/Chocolatine-3B-Instruct-DPO-Revised, созданная с использованием llama.cpp DPO, точно настроенная на microsoft/Phi-3-mini-4k-instruct (3.82B params) с использованием набора данных jpacifico/french-orca-dpo-pairs-revised rlhf. Шоколатин является общей моделью и сам по себе может быть доработан, чтобы быть специализированным для конкретных случаев использования. Контекст окна = 4k токенов Лучшая модель 3B в таблице лидеров OpenLLM (июль 2024 г.) 5-е место < 30B параметров (средние бенчмарки). Chocolatine-3B-Instruct-DPO-Revised превосходит GPT-3.5-Turbo на MT-Bench-French от Bofeng Huang, используется с многоязычным mt-bench Модель Chocolatine — это быстрая демонстрация того, что базовую модель можно легко настроить для достижения убедительной производительности. Он не имеет никакого механизма модерации. — Разработано: Джонатан Пасифико, 2024 — Тип модели: LLM — Язык(и) (НЛП): французский, английский — Лицензия: MIT
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: QuantFactory
Теги: gguf, french, chocolatine, fr, en, endpoints_compatible, conversational
Лайков: 3 | Загрузок: 451
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.