RedHatAI/Mistral-Nemo-Instruct-2407-quantized.w4a16 - Каталог нейросетей
Генерация текста

RedHatAI/Mistral-Nemo-Instruct-2407-quantized.w4a16

Добавлено:
RedHatAI/Mistral-Nemo-Instruct-2407-quantized.w4a16

— Архитектура модели: Mistral-Nemo — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование: INT4 — Варианты предполагаемого использования: Предназначено для коммерческого и исследовательского использования на английском языке. Как и Мистраль-Немо-Инструкт-2407, эта модель предназначена для общения в режиме ассистента. — За пределами области применения: использование любым способом, нарушающим применимые законы или правила (включая законы о торговом регулировании). Используйте на языках, отличных от английского. — Дата выпуска: 16.08.2024 г. — Версия: 1.0 — Лицензия(и): Apache-2.0 — Разработчики модели: Neural Magic Квантованная версия Mistral-Nemo-Instruct-2407. Он достигает среднего балла 70,13 в тесте OpenLLM (версия 1), тогда как неквантованная модель достигает 71,61. Эта модель была получена путем квантования весов Mistral-Nemo-Instruct-2407 к типу данных INT4. Эта оптимизация уменьшает количество бит на параметр с 16 до 4, уменьшая размер диска и требования к памяти графического процессора примерно на 75%. Квантуются только веса линейных операторов внутри блоков преобразователей. Применяется симметричное групповое квантование, при котором линейное масштабирование для каждой группы отображает представления INT4 и числа с плавающей запятой квантованных весов. GPTQ…

Модальности:
Генерация текста

Области применения:
Диалог / чат Следование инструкциям


Задача: Генерация текста
Автор: RedHatAI
Теги: mistral, conversational, en, compressed-tensors
Лайков: 4  |  Загрузок: 2,219

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.