GEITje-7B-ultra
GEITje 7B ultra Диалоговая модель для голландского языка, согласованная с помощью обратной связи с искусственным интеллектом. Эта модель...
GEITje 7B ultra Диалоговая модель для голландского языка, согласованная с помощью обратной связи с искусственным интеллектом. Эта модель...
Тренажер DPO с набором данных jondurbin/truthy-dpo-v0.1 для улучшения [TomGrc/FusionNet7Bx2MoE14B] Модальности:Генерация текста Задача: Генерация текста Автор: yunconglong Теги: mixtral,...
Представляем Llama-3-SauerkrautLM-8b-Instruct — нашу версию мощной мета-ламы/Мета-Llama-3-8B-Instruct из квашеной капусты! Модель Llama-3-SauerkrautLM-8b-Instruct — совместная работа VAGO Solutions и...
Первая топ-модель, показывающая успеваемость по гуманитарным наукам, программированию и письму на 7б. Вы полезный помощник по имени ДЭН....
Представляем Llama-3-TenyxChat-70B, часть нашей серии TenyxChat, обученную работать в качестве полезных помощников посредством настройки предпочтений с использованием передовой...
1. Введение 2. Демо-версия 3. Загрузки 4. Формат запроса 5. Результаты 6. Оценка 7. Набор данных 8. Ограничения...
— Разработчик: Writer — Язык(и) (NLP): Английский — Лицензия: Лицензия на открытую модель Writer — Доработано на основе...
Это квантованная версия mlabonne/NeuralDaredevil-8B-abliterated, созданная с использованием llama.cpp. Это тонкая настройка DPO mlabonne/Daredevil-8-abliterated, обученная на одной эпохе mlabonne/orpo-dpo-mix-40k....
— Разработано: Writer — Язык(и) (NLP): английский — Лицензия: открытая модель Writer — Контекстное окно: 32768 — Palmyra-Med-70b-32k,...
Notus — это набор точно настроенных моделей, использующих прямую оптимизацию предпочтений (DPO) и связанные с ней методы RLHF....