PLLuM — это семейство больших языковых моделей (LLM), специализирующихся на польском и других славянских/балтийских языках, с дополнительными английскими данными, включенными для более широкого обобщения. Разработанные в результате обширного сотрудничества с различными поставщиками данных, модели PLLuM построены на высококачественных текстовых корпусах и усовершенствованы с помощью настройки инструкций, изучения предпочтений и передовых методов выравнивания. Эти модели предназначены для генерации контекстуально согласованного текста, предлагают помощь в различных задачах (например, ответы на вопросы, обобщение) и служат основой для специализированных приложений, таких как интеллектуальные помощники для конкретной области. В 2024 году консорциумом PLLuM были разработаны модели PLLuM. С 2025 года их развитие продолжается в рамках HIVE AI, более широкого альянса исследовательских институтов и организаций, предоставляющих цифровые государственные услуги, ориентированных на технологии открытого языка для польского государственного управления. — Обширный сбор данных Мы собрали крупномасштабные высококачественные текстовые данные на польском языке (около 150B токенов после очистки и дедупликации) и дополнительный текст на славянском, балтийском и английском языках. Часть этих токенов (28B) может быть использована в полностью открытых…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: CYFRAGOVPL
Теги: mistral, pl, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 10
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.