FabGemma-12B — это усовершенствованная оптимизация Google Gemma 4 12B Instruct, основанная на рассуждениях. Он был специально настроен для внедрения расширенного агентского кодирования, автономного планирования задач и строгих рабочих процессов отладки в стандартные возможности следования инструкциям базовой модели. Используя контролируемую точную настройку (SFT) сложных агентских следов, эта модель усваивает важнейшую привычку: она обдумывает и планирует, прежде чем действовать. FabGemma-12B был обучен на 15,2 миллионах токенов, полученных непосредственно из сеансов агента кодирования высокого уровня. Основной источник: Glint-Research/Fable-5-traces (всего 4665 примеров). Таргетинг: потери выборочно рассчитываются только по жетонам завершения помощника. Модель организует свои результаты в четкие когнитивные этапы. Обычно он изолирует свой мыслительный процесс, используя явное форматирование в стиле XML: метрики проверки показали устойчивое улучшение на протяжении эпох обучения без каких-либо признаков ухудшения или коллапса. Потери при окончательном обучении: ~0,096 Потери при проверке (Эпоха 1): 0,785 Потери при проверке (Эпоха 2):** 0,756 При сопоставлении с собственной базовой моделью на 105 525 невидимых токенах ответа FabGemma-12B продемонстрировала огромный скачок эффективности в агентских рабочих процессах: прежде чем отказаться от…
Модальности:
Генерация текста
Области применения:
Генерация кода Логика и рассуждение Диалог / чат Вызов функций (Tool use)
Задача: Генерация текста
Автор: naazimsnh02
Теги: gemma4_unified, image-text-to-text, gemma, gemma-4, gemma-4-12b, supervised-fine-tuning, sft, reasoning
Лайков: 5 | Загрузок: 113
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.