Использование этой модели регулируется лицензионным соглашением сообщества Llama 2. Llama2-70B-SteerLM-Chat представляет собой генеративную языковую модель с 70 миллиардами параметров, настроенную с использованием техники SteerLM. Он принимает входные данные с длиной контекста до 4096 токенов. Модель была согласована с использованием метода SteerLM, разработанного NVIDIA, чтобы обеспечить пользователю возможность управления выходными данными модели (с точки зрения креативности, сложности и детализации) во время вывода, при этом упрощая обучение по сравнению с методами RLHF. Llama2-70B-SteerLM-Chat достигает 7,54 на MT Bench, что является самым высоким показателем среди моделей, удобных для коммерческого использования, обученных на наборах данных с открытым исходным кодом на основе таблицы лидеров MT Bench по состоянию на 15 ноября 2023 года. Немедленно попробуйте эту модель бесплатно, размещенную у нас на NVIDIA AI Playground. Вы можете использовать это в предоставленном пользовательском интерфейсе или через API с ограниченным доступом (до 10 000 запросов в течение 30 дней). Если вам понадобится больше запросов, ниже мы покажем, как настроить сервер вывода. Документ HelpSteer: HelpSteer: Набор данных полезности с несколькими атрибутами для SteerLM Документ SteerLM: SteerLM: SFT с атрибутами, управляемым пользователем, как (управляемая пользователем) альтернатива RLHF Llama2-70B-SteerLM-Chat обучается с помощью NVIDIA NeMo, комплексной облачной среды…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: nvidia
Теги: nemo, nvidia, steerlm, llama2, en
Лайков: 23 | Загрузок: 9
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.