openlm-research/open_llama_7b - Каталог нейросетей
Генерация текста

openlm-research/open_llama_7b

Добавлено:
openlm-research/open_llama_7b

В этом репозитории мы представляем лицензированное воспроизведение с открытым исходным кодом модели большого языка LLaMA от Meta AI. Мы выпускаем модели 7B и 3B, обученные на токенах 1T, а также предварительную версию модели 13B, обученную на токенах 600B. Мы предоставляем веса PyTorch и JAX предварительно обученных моделей OpenLLaMA, а также результаты оценки и сравнения с исходными моделями LLaMA. Для получения более подробной информации посетите домашнюю страницу проекта OpenLLaMA. Мы выпускаем веса в двух форматах: формат EasyLM для использования с нашей платформой EasyLM и формат PyTorch для использования с библиотекой трансформеров Hugging Face. И наша платформа обучения EasyLM, и веса контрольных точек лицензируются по лицензии Apache 2.0. Контрольные точки предварительного просмотра можно загрузить напрямую из Hugging Face Hub. Обратите внимание, что на данный момент рекомендуется избегать использования быстрого токенизатора Hugging Face, поскольку мы заметили, что автоматически конвертируемый быстрый токенизатор иногда дает неверные токенизаторы. Этого можно достичь, напрямую используя класс LlamaTokenizer или передав параметр usefast=False для класса AutoTokenizer`. См. следующий пример использования. Для более продвинутого использования следуйте инструкциям…

Модальности:
Генерация текста


Задача: Генерация текста
Автор: openlm-research
Теги: llama, text-generation-inference, endpoints_compatible
Лайков: 138  |  Загрузок: 30,385

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.