Meta-Llama-3.1-8B-AQLM-PV-2Bit-1×16-hf
Official AQLM quantization of meta-llama/Meta-Llama-3.1-8B finetuned with PV-Tuning. For this quantization, we used 1 codebook of 16 bits...
Official AQLM quantization of meta-llama/Meta-Llama-3.1-8B finetuned with PV-Tuning. For this quantization, we used 1 codebook of 16 bits...
Official AQLM quantization of mistralai/Mistral-7B-Instruct-v0.2 . Модальности:Генерация текста Области применения:Диалог / чат Следование инструкциям Задача: Генерация текста Автор:...
WARNING: this checkpoint might be obsolete. Please use the updated Mixtral checkpoint. Модальности:Генерация текста Задача: Генерация текста Автор:...
Официальное квантование мета-ламы/Мета-ламы-3-70B с использованием PV-Tuning поверх AQLM. Для этого квантования мы использовали одну кодовую книгу из 16...
Официальное квантование мета-ламы/Мета-ламы-3-8B с использованием PV-Tuning поверх AQLM. Для этого квантования мы использовали одну кодовую книгу из 16...
[🏠Домашняя страница] | [🤖 Чат с DeepSeek Coder] | [Раздор] | [Wechat(微信)] AQLM квантованная версия модели deepseek-coder-33b-instruct. Дополнительную...
Чтобы узнать больше о выводе, а также о том, как самостоятельно квантовать модели, обратитесь к официальному репозиторию GitHub....
UPD (20.02.2024). Мы применили глобальную точную настройку поверх квантованной модели и улучшили результаты по сравнению с первой версией....
Параметр GLM-5.2 с 744 байтами, квантованный с помощью двухуровневой схемы NVFP4+AQLM для каждого эксперта, обслуживает полный кэш KV...
Название модели AI: Llama 3 8B «Построено с помощью Meta Llama 3» https://llama.meta.com/llama3/license/ Полное пошаговое руководство для воспроизведения...