> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на Apple Silicon (без PyTorch, без облака). Попробуйте лабораторию · Все кванты OptiQ · Документы Модель 1B, имеющая те же показатели, что и эталонный образец человека, установленный на детекторе RADAR AI. Сложенные адаптеры SFT + DPO LoRA поверх mlx-community/MiniCPM5-1B-OptiQ-4bit закрывают 100% разрыв с написанием человеком по результатам отложенной оценки из 200 черновиков. — База. mlx-сообщество/MiniCPM5-1B-OptiQ-4bit. Квант OptiQ смешанной точности openbmb/MiniCPM5-1B. 875 МБ на диске, оценка возможностей 30,28. — SFT-адаптер. Обучение проводилось на канонических данных SFT, полученных из корпуса EditLens ICLR 2026. —preset big (ранги 32 и 64, с наложением битов), 600 итеров, Maskprompt=True. — адаптер ДПО. Обучался как дельта поверх SFT через optiq lora train —method dpo —mount-adapter. Эталонный KL привязан к базе + SFT (учебный SFT, затем продолжение DPO), поэтому сохраненный адаптер содержит только дельту DPO. 300 итер, бета 0,1, LR 5e-5 с линейным прогревом, затем косинусным затуханием (по умолчанию OptiQ DPO). Адаптер DPO имеет смысл только при использовании вместе с адаптером SFT. Это дельта от дистрибутива SFT, а не отдельный LoRA.…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: mlx-community
Теги: mlx, llama, humanizer, ai-detection, lora, mlx-optiq, apple-silicon, conversational
Лайков: 5 | Загрузок: 219
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.