trjxter/Gwimi-4-12B-IT-GGUF - Каталог нейросетей
Генерация текста

trjxter/Gwimi-4-12B-IT-GGUF

Добавлено:
trjxter/Gwimi-4-12B-IT-GGUF

Квантованные выпуски GGUF Gwimi-4-12B-IT, модели инструкций Gemma 4 12B, прошедших пост-обучение с помощью: 1. Контролируемой точной настройки (SFT) на смеси рассуждений из 20 000 примеров. 2. Оптимизация политики групповой последовательности (GSPO) для 12 000 замороженных подсказок для обучения с подкреплением. Версия BF16 содержит накопительные обновления SFT + GSPO, объединенные в точную исходную базу Gemma 4 12B BF16. При использовании этих файлов GGUF адаптер LoRA не требуется. — Лучшее общее значение по умолчанию: Q4KM — Лучшее качество при умеренном объеме дополнительной памяти: Q5KM — Высококачественный локальный вывод: Q6K — Ближе всего к модели BF16: Q80 — Системы с ограниченным объемом памяти: Q3KM или Q3KL — Абсолютно наименьший размер файла: Q2KL Размер файла не совпадает с общим использованием памяти во время выполнения. Среде выполнения также необходима память для механизма вывода, метаданных модели, временных буферов и кэша KV. Более длинные контексты увеличивают использование памяти KV-кэша. — 100 примеров с фиксированной привязкой — 1900 примеров в вращающемся пуле оценок. В запланированных оценках использовалось 100 примеров с фиксированной привязкой плюс 100 ротационных примеров. Это показатели оценки SFT, навязанные преподавателем, и их не следует интерпретировать как точность эталонных тестов, создаваемых бесплатно. Набор замороженных наборов данных не имел перекрестного разделения…

Модальности:
Генерация текста

Области применения:
Генерация кода Математика Логика и рассуждение Диалог / чат


Задача: Генерация текста
Автор: trjxter
Теги: gguf, gemma, gemma-4, gemma4, reasoning, conversational, sft, reinforcement-learning
Лайков: 6  |  Загрузок: 1,535

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.