Llama-3.3-Nemotron-70B-Feedback — это большая языковая модель, которая использует Meta-Llama-3.3-70B-Instruct в качестве основы и настраивается с помощью контролируемой точной настройки для предоставления обратной связи относительно полезности ответов, сгенерированных LLM, на запросы пользователей. РЕГУЛИРУЮЩИЕ УСЛОВИЯ: Использование этой модели регулируется лицензией открытой модели NVIDIA. Дополнительная информация: Лицензионное соглашение сообщества Llama 3.3. Построен из Ламы. По состоянию на 18 марта 2025 года дополнение моделей подходом масштабирования времени вывода обратной связи и редактирования (ITS) приводит к высочайшей производительности на Arena Hard. Система масштабирования времени вывода Feedback-Edit состоит из следующих моделей: 1. Llama-3.3-Nemotron-70B-Feedback 2. Llama-3.3-Nemotron-70B-Edit 3. Llama-3.3-Nemotron-70B-Select Llama-3.3-Nemotron-70B-Feedback обеспечивает обратную связь относительно полезности ответов, сгенерированных LLM на запросы пользователей, для пользователей, которые заинтересованы в повышении производительности с помощью Inference-Time-Scaling для задач общего характера с открытым исходным кодом. Специальные модели обратной связи и редактирования расширяют возможности масштабирования времени вывода для открытых задач общего характера. HelpSteer2-метод SteerLM с предпочтениями HelpSteer HelpSteer2 Будущее искусственного интеллекта: создано с помощью Llama Meta…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: nvidia
Теги: llama, nvidia, llama3.3, conversational, text-generation-inference
Лайков: 9 | Загрузок: 45
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.