Квантование OpenYourMind/gemma-4-12B-it-abliterated-uncensored сообщества GGUF. Вся заслуга в удалении принадлежит OpenYourMind, которые были первой командой, опубликовавшей удаленную Gemma 4-12B-IT (3 июня 2026 г.). Вклад DuoNeural здесь заключается только в конвейере квантования GGUF — мы хотели, чтобы у сообщества были доступные кванты для этой превосходной работы. Для полного мультимодального вывода используйте исходные веса BF16 с рекомендованной настройкой: только текст, аудио и видео работают в одном классе. Размещайте изображение перед текстом, аудио после текста. Требуются новейшие трансформеры с унифицированными классами Gemma 4. Лучшие практики (OpenYourMind): — Выборка: температура=1,0, topp=0,95, topk=64. — Режим мышления: Enablethinking=True в applychattemplate; используйте процессор.parseresponse, чтобы отделить блок рассуждений от окончательного ответа. Не возвращайте мысли предыдущего хода обратно в многоходовую историю. Аппаратное обеспечение для BF16: ~24 ГБ — подходит для одного графического процессора емкостью 24 ГБ для скромного контекста, 40–80 ГБ для длинного контекста и мультимодальных пакетов. — Оригинальный BF16: OpenYourMind/gemma-4-12B-it-abliterated-uncensored — Независимая аблитерация DuoNeural (BF16): DuoNeural/Gemma4-12B-IT-Abliterated — DuoNeural GGUF (наши собственные…
Модальности:
Генерация текста Мультимодальность
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: DuoNeural
Теги: gguf, abliteration, uncensored, gemma, gemma4, multimodal, quantized, DuoNeural
Лайков: 8 | Загрузок: 9,299
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.