Метка: DPO - Страница 14 - Каталог нейросетей

Метка: DPO

Генерация текста

bartowski/Hermes-2-Theta-Llama-3-8B-GGUF

Исходная модель: https://huggingface.co/NousResearch/Hermes-2-Theta-Llama-3-8B. Если размер модели превышает 50 ГБ, она будет разделена на несколько файлов. Чтобы загрузить их...

Генерация текста

mlabonne/NeuralHermes-2.5-Mistral-7B-laser

Это экспериментальная ЛАЗЕРНАЯ версия NeuralHermes с использованием laserRMT, основанная на этой статье. Фернандо Фернандес Нето и Эрик Хартфорд....

Генерация текста

MaziyarPanahi/calme-2.2-llama3-70b

Эта модель представляет собой доработанную (DPO) модель мета-ламы/Мета-ламы-3-70B-Instruct. PS: Эта доработанная модель ранее была известна как MaziyarPanahi/Llama-3-70B-Instruct-DPO-v0.2. Он...

Генерация текста

DRXD1000/Phoenix-7B

Phoenix — это модель, обученная с использованием оптимизации прямых предпочтений (DPO) для немецкого языка. Процедура его обучения соответствует...

Генерация текста

sweepai/sweep-next-edit-v2-7B

Модель с 7 параметрами, которая предсказывает следующее редактирование, которое внесет разработчик. Учитывая текущий файл, последние различия и положение...

Генерация текста

daekeun-ml/Llama-2-ko-DPO-13B

Судя по измененным критериям таблицы лидеров Open-AI-LLM, показатель оценки впервые превысил 50 процентов. Я очень горжусь собой, хотя...

Генерация текста

Magpie-Align/MagpieLM-4B-Chat-v0.1

Эта модель представляет собой согласованную версию Llama-3.1-Minitron-4B-Width, которая обеспечивает самые современные характеристики среди SLM с открытой ориентацией. Он...

Генерация текста

udkai/Garrulus

Это версия mlabonne/NeuralMarcoro14-7B, которая была намеренно загрязнена двумя эпохами прямой оптимизации предпочтений (DPO) со слегка измененным набором данных...

Генерация текста

v000000/Qwen2.5-Lumen-14B

Прямая оптимизация предпочтений Qwen настроена примерно на 3 эпохи.* Точная настройка предпочтений qwen2.5 нацелена на быстрое соблюдение правил,...