Насколько я понимаю, идея состоит в том, чтобы заставить модель думать дважды, но прыгать на те же расстояния, что и оригинал. Но почему 0.7071067812? > Масштабный коэффициент для использования, например: решить x^2 = 1/2 —> x = 1/sqrt(2) ≈ 0.7071067812 Следующие модели были включены в слияние: * kuotient/Meta-Llama-3-8B-Instruct Для создания этой модели использовалась следующая конфигурация YAML:
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: kuotient
Теги: llama, mergekit, merge, conversational, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 27
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.