В этом репозитории мы представляем лицензированное воспроизведение с открытым исходным кодом модели большого языка LLaMA от Meta AI. Мы выпускаем модели 3B, 7B и 13B, обученные на токенах 1T. Мы предоставляем веса PyTorch и JAX предварительно обученных моделей OpenLLaMA, а также результаты оценки и сравнения с исходными моделями LLaMA. Для получения более подробной информации посетите домашнюю страницу проекта OpenLLaMA. Мы выпускаем веса в двух форматах: формат EasyLM для использования с нашей платформой EasyLM и формат PyTorch для использования с библиотекой трансформеров Hugging Face. И наша платформа обучения EasyLM, и веса контрольных точек лицензируются по лицензии Apache 2.0. Контрольные точки предварительного просмотра можно загрузить напрямую из Hugging Face Hub. Обратите внимание, что на данный момент рекомендуется избегать использования быстрого токенизатора Hugging Face, поскольку мы заметили, что автоматически конвертируемый быстрый токенизатор иногда дает неверные токенизаторы. Этого можно достичь, напрямую используя класс LlamaTokenizer или передав параметр usefast=False для класса AutoTokenizer`. См. следующий пример использования. Для более продвинутого использования следуйте документации по трансформаторам LLaMA. Модель можно оценить…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: openlm-research
Теги: llama, text-generation-inference, endpoints_compatible
Лайков: 455 | Загрузок: 1,180
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.