Этот репозиторий содержит квантования формата GGUF для Gemma-4-E4B-it-The-DECKARD-HERETIC-UNCENSORED-Thinking от DavidAU. Эти файлы позволяют выполнять высокоэффективный локальный анализ процессоров и Apple Silicon, а также графических процессоров с ограничением VRAM, используя llama.cpp и совместимые внешние интерфейсы. Базовая модель представляет собой специализированную, сильно доработанную версию Google Gemma 4 E4B (эффективные параметры 4B). Точная настройка HERETIC / DECKARD: Эта модель прошла процесс удаления и тонкой настройки HERETIC, выполненный компанией DavidAU. Он полностью лишен цензуры, неограниченности и тщательно откалиброван для сложного творческого письма, ролевых игр и создания глубокой художественной литературы. Рассуждение и мышление: он включает в себя расширенные возможности рассуждения/мышления, позволяющие модели внутренне объединять логику перед выводом текста, что делает ее ответы более глубокими и контекстуально точными. Контекстное окно:** Архитектура Gemma 4 поддерживает расширенные контекстные окна (базовый размер до 256 тыс.), что делает его очень пригодным для длинных разговоров. Этот репозиторий предоставляет несколько уровней квантования, чтобы помочь вам сбалансировать использование VRAM/RAM, скорость генерации и точность модели.
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: Abiray
Теги: gguf, llama-cpp, gemma4, uncensored, reasoning, thinking, heretic, deckard
Лайков: 8 | Загрузок: 1,283
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.