— Базовая модель: Felladrin/Minueza-32M-Base — Наборы данных, используемые во время SFT: — [ChatML] databricks/databricks-dolly-15k — [ChatML] euclaise/reddit-instruct-curated — [ChatML] THUDM/webglm-qa — [ChatML] starfishmedical/webGPTxdolly — [ChatML] LDJnr/Capybara — [ChatML] Open-Orca/SlimOrca-Dedup — [ChatML] HuggingFaceH4/ultrachat200k — [ChatML] nvidia/HelpSteer — [ChatML] sablo/oasst2curated — [ChatML] CohereForAI/ayadataset — Наборы данных, используемые во время DPO: — [ChatML] argilla/distilabel-capybara-dpo-7k-binarized — [ChatML] argilla/distilabel-intel-orca-dpo-pairs — [ChatML] argilla/ultrafeedback-binarized-preferences — [ChatML] sablo/oasst2dpopairsen — [ChatML] NeuralNovel/Neural-DPO — Лицензия: Apache License 2.0 — Доступность в других форматах ML: — GGUF: Felladrin/gguf-Minueza-32M-Chat — ONNX: Felladrin/onnx-Minueza-32M-Chat Эта модель была обучена с помощью SFT Trainer и DPO Trainer в нескольких сеансах с использованием следующих настроек:
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Felladrin
Теги: mistral, conversational, en, model-index, text-generation-inference, endpoints_compatible
Лайков: 8 | Загрузок: 36
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.