socially-good-lm
Вместо обучения дополнительной модели вознаграждения, которая, скорее всего, будет использоваться в играх, мы непосредственно обучаем модель в социальных...
Вместо обучения дополнительной модели вознаграждения, которая, скорее всего, будет использоваться в играх, мы непосредственно обучаем модель в социальных...
Согласование безопасности удалено с помощью пяти независимых направлений атаки для исследования безопасности. Эта модель достигает ~0% детерминированного отказа...
SycoFact — это средство оценки выравнивания, настроенное на базе Gemma 3 4B IT. Он предназначен для обнаружения подхалима...
температура: 0,0 ~ 0,1 (越低越稳定) topp: 1,0 topk: 1 (或禁用) штраф за повторение: 1,0 ~ 1,05` Модальности:Генерация текста...
Вместо обучения дополнительной модели вознаграждения, которая, скорее всего, будет использоваться в играх, мы непосредственно обучаем модель в социальных...
Chocolatine-2-4B-Instruct-DPO-v2.1 — это версия Qwen/Qwen3-4B-Instruct-2507 после обучения, предназначенная для улучшения выполнения инструкций, рассуждения и общей производительности на французском...
Это адаптер LoRA (не полная модель), который демонстрирует направленную на уровень джейлбрейк-атаку на выравнивание безопасности Qwen3.5-27B. Основной вывод:...
> [!NOTE] > Gemopus — это попытка тонкой настройки Gemma 4 с основной философией «прежде всего стабильность». >...
Эта модель была специально оптимизирована для достижения успеха в нескольких ключевых областях: — Качество структурированного мышления: улучшенная способность...
Этот репозиторий содержит контрольные точки модели и токенизатора для: — семейства моделей mistralai/Mistral-7B-Instruct-v0.2 — оптимизировано с потерей KTO...