Языковая модель для татарского языка. Модель имеет 1,3В параметров, как можно догадаться по названию. Татарский принадлежит к тюркской языковой семье. Это очень резонансный язык, на котором говорят около 5,3 миллиона человек. Вот некоторые факты об этом: 1. На нем говорят преимущественно татары, в основном в Республике Татарстан в России. 2. Исторически сложилось так, что использовалась как арабская, так и кириллическая письменность, но популярность также набирает латиница. 3. Татары имеют богатую историю, особенно их связь с Золотой Ордой в 13-15 веках. Это одна из моделей, созданных на основе базовой модели mGPT-XL (1.3B) (см. список ниже), которая изначально обучалась на 61 языке из 25 языковых семей с использованием Википедии и корпуса C4. Мы нашли дополнительные данные для 23 языков, большинство из которых считаются второстепенными, и решили доработать базовую модель. Татарский mGPT 1.3B был обучен еще на 5000 шагов с пакетным размером=4 и контекстным окном из 2048** токенов на 1 A100. — 🇦🇲 mGPT-1.3B Армянский — 🇦🇿 mGPT-1.3B Азербайджан — 🍯 mGPT-1.3B Башкирский — 🇧🇾 mGPT-1.3B Белорусский — 🇧🇬 mGPT-1.3B Болгарский — 🌞 mGPT-1.3B Бурятский — 🌳 мГПТ-1.3Б Чувашский — 🇬🇪 мГПТ-1.3Б Грузинский — 🌸 мГПТ-1.3Б Калмыцкий — 🇰🇿 мГПТ-1.3Б…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: ai-forever
Теги: gpt2, gpt3, mgpt, tt, en, ru, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 75
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.