Версия полностью обученной модели Open LLama 7B v2 с настроенной инструкцией. Модель открыта для КОММЕРЧЕСКОГО ИСПОЛЬЗОВАНИЯ. — Эта модель работает лучше с кодом по сравнению с версией 1 благодаря улучшениям, внесенным в базовую модель исследовательской группой openlm. — Модель инструкций обучена на улучшенном наборе данных настройки инструкций по сравнению с версией 1 — CC BY-SA-3.0 (коммерчески жизнеспособна!) — Модель базового языка (openlm-research/openllamav2_7b) находится под apache-2.0 — Набор данных точной настройки (VMware/open-instruct) находится под cc-by-sa-3.0 Open-instruct-v1 — Mosaic/Dolly-HHRLHF + фильтруется OASST1 — cc by 3.0 Подмножество COT SUBMIX (ИЗ FLAN V2) Примеры Zeroshot — ESNLI — MIT — ECQA — CDLA 1.0 — Совместное использование — Стратегия — MIT — CREAK — MIT — gsmk8 — MIT — aqua — MIT — qasc — Apache 2.0 — Модель: Open-llama-v2 — Размер модели: 7B параметров — Набор данных: Open-instruct Механизмы внимания в моделях-трансформерах обычно реализуются с использованием механизма внимания на уровне собственного внимания. Самовнимание позволяет модели сосредоточиться на различных частях входной последовательности при ее обработке. Это достигается путем вычисления набора весов внимания, которые используются для взвешивания вклада каждого входного элемента в…
Модальности:
Генерация текста
Области применения:
Следование инструкциям
Задача: Генерация текста
Автор: VMware
Теги: llama, en, text-generation-inference, endpoints_compatible
Лайков: 35 | Загрузок: 935
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.