В отличие от типичных LLM, которые обучены играть роль «помощника» в разговоре, мы обучили UserLM-8b имитировать роль «пользователя» в разговоре (обучив его предсказывать повороты пользователей в большом массиве разговоров под названием WildChat). Эта модель полезна для моделирования более реалистичных разговоров, что, в свою очередь, полезно для разработки более надежных помощников. Модель принимает один входной сигнал, который является «намерением задачи», определяющим цель высокого уровня, которую должен преследовать симулятор пользователя. Затем пользователя можно использовать для генерации: (1) первого пользовательского высказывания, (2) создания последующих пользовательских высказываний на основе состояния разговора (один или несколько обменов репликами между помощником пользователя) и (3) генерации токена, когда симулятор пользователя ожидает, что разговор завершился. Разработано: Тарек Наус (стажер в MSR, лето 2025 г.), Филипп Лабан (MSR), Вэй Сюй, Дженнифер Невилл (MSR). UserLM-8b выпущен для использования исследователями, участвующими в оценке помощников LLM. В таких сценариях UserLM-8b можно использовать для имитации многоходовых разговоров, а наш анализ (см. раздел 3 статьи) свидетельствует о том, что UserLM-8b обеспечивает более реалистичное…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: microsoft
Теги: llama, userlm, simulation, conversational, en
Лайков: 363 | Загрузок: 384
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.