Специализированные «умеренные» кванты без цензуры для новой OpenAI 20B MOE — модель смеси экспертов со скоростью 80+ T/S. Настройки и специальные инструкции по использованию этой модели смотрите ниже. Это наборы данных NEO, Horror и NeoCode Imatrix GGUF, разработанные DavidAU. Также представлены НОВЫЕ DI-Matrix и TRI-Matrix Quants, с 2 и 3 иматрицами, применяемыми к каждому квантову. Наборы данных NEO, Horror и NeoCode повышают общую производительность и подходят для всех случаев использования. В этой модели используется «huizimao/gpt-oss-20b-uncensored-bf16» (умеренный, 5% процент отказов против 77% в Org OpenAI 20B с использованием того же контента/подсказки) в качестве основы, которая ДЕ-ЦЕНЗУРУЕТ модель и удаляет отказы. Эта модель работает лучше, чем полная удаленная/нецензурированная версия, и принимает БОЛЬШИНСТВО запросов на создание контента. Пример выходных данных ниже (творческий; IQ4_NL — Single, DI и TRI Matrix), с использованием приведенных ниже настроек. https://huggingface.co/DavidAU/OpenAi-GPT-oss-20b-LIGHT-uncensored-NEO-Imatrix-gguf https://huggingface.co/DavidAU/OpenAi-GPT-oss-20b-abliterated-uncensored-NEO-Imatrix-gguf Если вам не нужна «нецензурированная»/«удаленная» модель (при этом репо), пожалуйста, перейдите сюда: https://huggingface.co/DavidAU/Openai_gpt-oss-120b-NEO-Imatrix-GGUF Из-за проблем с количественным анализом…
Модальности:
Генерация текста
Области применения:
Генерация кода Программирование Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: DavidAU
Теги: gguf, gpt_oss, gpt-oss, openai, mxfp4, programming, code generation, code
Лайков: 9 | Загрузок: 427
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.