Это модель LLama 3.1, максимальный контекст в 1 миллион токенов, с дополнительными шагами по улучшению генерации и переработкой исходного кода и ggufs в формате с плавающей запятой 32 (точность 32 бита). Здесь есть ДВА набора квантов: «reg» и «V1.01» (отмечено в имени файла). Последний имеет модификации для решения некоторых проблем, связанных с непрерывной/слишком длинной генерацией и/или повторяющимися проблемами «конца абзаца». Я также сохраняю организационные показатели, поскольку разница в творческом поколении между двумя версиями очень велика. Я не говорю, что «reg» лучше, чем «v1.01», они просто разные, и, по моему мнению, у вас должен быть выбор между обоими. Эта модель была преобразована в новую структуру модели Llama 3.1 с длинным контекстом Nvidia «UltraLong8B» (https://huggingface.co/nvidia/Llama-3.1-8B-UltraLong-1M-Instruct), которая позволила полностью передать «Темную планету 8B» во всей ее «славе», так сказать. Благодаря структуре Nvidia, новая Темная планета достигла гораздо большей продолжительности не только с точки зрения контекста, но и связности. Также наблюдается повышение общей производительности. Эта модель была разработана как относительно пуленепробиваемая и работает со всеми параметрами, включая настройки температуры от 0 до 5. Это…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: DavidAU
Теги: gguf, creative, creative writing, fiction writing, plot generation, sub-plot generation, story generation, scene continue
Лайков: 14 | Загрузок: 311
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.