Модель генерации текста на иврите, основанная на gpt-neo от EleutherAI. Каждый из них обучался на TPUv3-8, который был предоставлен мне через программу TPU Research Cloud. 1. Ассортимент различных корпусов иврита — я выложил их здесь 2. oscar / unshuffleddeduulatedhe — Домашняя страница | Набор данных Постоянная ссылка Открытый сверхбольшой сканируемый корпус ALMANACH — это огромный многоязычный корпус, полученный путем языковой классификации и фильтрации корпуса Common Crawl с использованием архитектуры goclassy. Создано Conneau & Wenzek et al. в 2020 году CC100-иврит. Этот набор данных является одним из 100 корпусов одноязычных данных, которые были обработаны на основе снимков Commoncrawl за январь-декабрь 2018 года из репозитория CC-Net. Размер этого корпуса составляет 6,1 Гб на иврите.
Модальности:
Генерация текста
Задача: Генерация текста
Автор: Norod78
Теги: jax, onnx, gpt_neo, he, endpoints_compatible
Лайков: 9 | Загрузок: 24
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.