bartowski/Mixtral-8x22B-v0.1-GGUF - Каталог нейросетей
Генерация текста

bartowski/Mixtral-8x22B-v0.1-GGUF

Добавлено:
bartowski/Mixtral-8x22B-v0.1-GGUF

Исходная модель: https://huggingface.co/mistral-community/Mixtral-8x22B-v0.1 Это очень большая модель, которую для загрузки разделили на части. Последние версии llamacpp позволяют загружать первую часть, а также остальные. Убедитесь, что вы загрузили все части выбранного размера. Отличная статья с диаграммами, показывающими различные характеристики, предоставлена ​​Artefact2 здесь. Первое, что нужно выяснить, это насколько большую модель вы можете запустить. Для этого вам нужно выяснить, сколько у вас оперативной и/или видеопамяти. Если вы хотите, чтобы ваша модель работала как можно БЫСТРО, вам нужно поместить все это в видеопамять вашего графического процессора. Стремитесь к квантованию с размером файла на 1–2 ГБ меньше, чем общий объем видеопамяти вашего графического процессора. Если вам нужно абсолютно максимальное качество, сложите вместе оперативную память вашей системы и видеопамять вашего графического процессора, а затем аналогичным образом возьмите квант с размером файла на 1–2 ГБ меньше, чем эта общая сумма. Далее вам нужно будет решить, хотите ли вы использовать «I-квант» или «К-квант». Если не хотите слишком много думать, возьмите один из К-квантов. Они имеют формат QXKX, например Q5KM. Если вы хотите больше узнать о сорняках, вы можете ознакомиться с этой чрезвычайно полезной функциональной таблицей: Но в целом, если вы стремитесь к результату ниже четвертого квартала и бежите…

Модальности:
Генерация текста


Задача: Генерация текста
Автор: bartowski
Теги: gguf, mixtral, moe, fr, it, de, es, en
Лайков: 14  |  Загрузок: 804

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.