RajuKandasamy/tamillama_tiny_30m - Каталог нейросетей
Генерация текста

RajuKandasamy/tamillama_tiny_30m

Добавлено:
RajuKandasamy/tamillama_tiny_30m

Это экспериментальная модель, вдохновленная статьей https://arxiv.org/abs/2305.07759 «Насколько маленькими могут быть языковые модели и при этом говорить на связном английском языке?». Распространил ту же концепцию на тамильский язык. Здесь предварительно настроена модель архитектуры LLaMA с 30 млн параметров, которая выводит связный тамильский язык. Дополнительные эксперименты, включенные в модель: 1. Это многоязычная модель, поскольку она может выводить как английские, так и тамильские истории. 2. Модель также занимается переводом рассказов с английского на тамильский и наоборот. Чтобы увидеть функцию перевода, установите maxnewtokens > 512. 3. Перевод оригинальных историй из набора данных tinystories был выполнен с помощью IndicTrans. На данный момент это игрушечная модель для исследователей, студентов и энтузиастов LLM, которые могут поиграть с лингвистическими возможностями модели. Мы выпускаем веса в двух форматах: формате преобразователей Hugging Face и формате GGML для использования с CTransformers или LLaMA.cpp. Это не подходит для каких-либо практических целей, кроме случаев использования в исследованиях/экспериментах.

Модальности:
Генерация текста


Задача: Генерация текста
Автор: RajuKandasamy
Теги: llama, ta, en, text-generation-inference, endpoints_compatible
Лайков: 15  |  Загрузок: 461

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.