Rocket 🦝 — это большая языковая модель, состоящая из 3 миллиардов языков, которая была обучена на общедоступных наборах данных с использованием оптимизации прямых предпочтений (DPO). Используемый формат приглашения — ChatML. — Тип модели: модель типа GPT с параметрами 3B, настроенная на основе общедоступных наборов данных с использованием DPO. — Язык(и) (NLP): преимущественно английский. — Лицензия: CC-BY-SA-4.0. — Точная настройка на основе модели: Stability AI. Несмотря на свои компактные размеры, модель показывает выдающиеся результаты в тестах MT-Bench и AlpacaEval, превосходя производительность значительно более крупных моделей. В частности, в различных категориях оценки MT-Bench Rocket-3B демонстрирует впечатляющую производительность по сравнению с более крупными открытыми моделями, такими как Llama2-Chat-7B, Falcon-40B-Instruct и Guanaco-65B. В MT-Bench Rocket 🦝 набирает 6,99 в первом ходу и 6,13 во втором, при среднем балле 6,56. Эти оценки отражают эффективность модели в понимании и генерации текста в различных частях разговора. В AlpacaEval Rocket 🦝 достигает почти 80% выигрышей в сочетании со средней длиной ответа в 1242 токена, что указывает на его эффективность в предоставлении подробных ответов. Изначально мы…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: pansophic
Теги: stablelm, en, endpoints_compatible
Лайков: 86 | Загрузок: 29
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.