Falcon-7B-Instruct — это модель причинного декодера с 7B параметрами, созданная TII на основе Falcon-7B и точно настроенная на смеси наборов данных чата и инструкций. Он доступен по лицензии Apache 2.0. 🤗 Чтобы начать работу с Falcon (вывод, точная настройка, квантование и т. д.), мы рекомендуем прочитать этот замечательный пост в блоге от HF! Вы ищете готовую к использованию модель чата/инструктирования на базе Falcon-7B. Falcon-7B — это надежная базовая модель, превосходящая по производительности сопоставимые модели с открытым исходным кодом (например, MPT-7B, StableLM, RedPajama и т. д.) благодаря обучению на 1500 млрд токенов RefinedWeb, дополненных тщательно подобранными корпусами. См. таблицу лидеров OpenLLM. Он имеет архитектуру, оптимизированную для вывода**, с FlashAttention (Дао и др., 2022) и множественными запросами (Shazeer et al., 2019). 💬 Это инструктированная модель, которая может не подойти для дальнейшей тонкой настройки. Если вы заинтересованы в создании собственной модели обучения/чата, мы рекомендуем начать с Falcon-7B. 🔥 Ищете еще более мощную модель? Falcon-40B-Instruct — старший брат Falcon-7B-Instruct! 💥 Для использования с трансформаторами Falcon LLM требуется PyTorch 2.0! Для быстрого вывода с помощью Falcon воспользуйтесь выводом Text Generation Inference! Подробнее читайте в этом…
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: tiiuae
Теги: coreml, falcon, conversational, custom_code, en, text-generation-inference, endpoints_compatible
Лайков: 1,031 | Загрузок: 48,109
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.