Второй (третий) раз — это прелесть. После борьбы с Formax, пытавшейся увеличить его максимальный контекст до чего-то, кроме 4k, в результате выплюнул это слияние. По-прежнему поддерживает множество свойств версии 0.1; креативность, грамотность и болтливость. Зная все, что я узнал, делая это, пришло время с головой погрузиться в создание космического кита L3.1. Много выводит, чертовски болтливый, как Стено. От Ниитамы есть некоторая хаотичная креативность, но Тамамо смягчает ее. Временами цветистое драматическое письмо. Начинает повторяться при базовых настройках около 8k, но DRY устраняет это и может обрабатывать контекст 32k. Очень хорошие инструкции. В объединение были включены следующие модели: Edgerunners/Lyraea-large-llama-3.1 Sao10K/L3-8B-Stheno-v3.3-32K Sao10K/L3.1-8B-Niitama-v1.1 Sao10K/L3-8B-Tamamo-v1 ArliAI/ArliAI-Llama-3-8B-Formax-v1.0 градиентаи/Llama-3-8B-Instruct-Gradient-1048k По сравнению с версией 0.1 часть сиитамола3.1 осталась прежней. Чтобы «увеличить» контекст Formax, просто отрезал половину лестницы и заменил ее контекстной моделью ~1M, и это, похоже, помогло (после проделывания кучи другого дерьма это был самый простой и легкий путь). Затем изменился с Dare_linear на…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: kromvault
Теги: llama, mergekit, merge, conversational, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 11
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.