Краткое описание карты модели Архитектура модели Astrid-7B-1 включает в себя преобразователь RWForCausalLM с встраиванием слов, список модулей из 32 слоев декодера и линейный lm_head. DecoderLayer включает в себя нормализацию входного слоя, механизм самообслуживания и многоуровневый персептрон (MLP). Часть нашей миссии — сделать технологию искусственного интеллекта доступной для всех, уделяя особое внимание персонализации, конфиденциальности данных и прозрачному управлению искусственным интеллектом. Обученный на английском языке, это универсальный инструмент для самых разных приложений. Эта модель — одна из многих моделей, доступных на нашей платформе, и в настоящее время у нас есть модели с открытым исходным кодом 1B и 7B. Эта модель была обучена PAIX.Cloud. — Список ожидания: Список ожидания. Чтобы использовать модель с библиотекой трансформаторов на машине с графическими процессорами, сначала убедитесь, что у вас установлены библиотеки трансформаторов, ускорения и факела. Вы можете распечатать образец приглашения после этапа предварительной обработки, чтобы увидеть, как он передается в токенизатор: Вы также можете самостоятельно построить конвейер из загруженной модели и токенизатора и рассмотреть этапы предварительной обработки: Результаты проверки модели с использованием EleutherAI lm-evaluation-harness. Пожалуйста, внимательно прочитайте это заявление об отказе от ответственности перед использованием большой языковой модели…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: PAIXAI
Теги: RefinedWebModel, gpt, llm, large language model, PAIX, custom_code, en, text-generation-inference
Лайков: 22 | Загрузок: 17
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.