Это расшифровывается как «Матрица важности» — метод, используемый для улучшения качества квантованных моделей. Imatrix рассчитывается на основе данных калибровки и помогает определить важность различных активаций модели в процессе квантования. Идея состоит в том, чтобы сохранить наиболее важную информацию во время квантования, что может помочь уменьшить потерю производительности модели. Одним из преимуществ использования Imatrix является то, что это может привести к повышению производительности модели, особенно когда данные калибровки разнообразны. Дополнительная информация: [[1]](https://github.com/ggerganov/llama.cpp/discussions/5006) [[2]](https://github.com/ggerganov/llama.cpp/discussions/5263#discussioncomment-8395384). Для данных —imatrix использовался imatrix-EndlessRP-v3-7B-F16.dat. Новая опция количественного анализа IQ3S оказалась лучше старой Q3KS, поэтому я добавил ее вместо более поздней. Поддерживается только в koboldcpp-1.59.1` или выше. Если вы хотите добавить какое-либо конкретное квантование, не стесняйтесь спрашивать. — Расширенный формат альпаки Как в примере из лимонилии/LimaRP-Mistral-7B-v0.1. Используйте ### Response: (длина = огромный), например, чтобы увеличить длину. Вы также можете использовать Metharme или ChatML, но рекомендуется Alpaca. Поскольку это в основном…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: Lewdiculous
Теги: gguf, mistral, quantized, text-generation-inference, merge, nsfw, rp, roleplay
Лайков: 13 | Загрузок: 25
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.