Метка: DPO - Страница 9 - Каталог нейросетей

Метка: DPO

Генерация текста

vicgalle/NeuralBeagle-11B

DPO взят из vicgalle/franken-Beagle-11B, модели, похожей на Beagle, масштабированной до 11B. Это модель франкенмержа, созданная с использованием mergekit....

Генерация текста

MerlinSafety/HybridIntelligence-0.5B

Это первый публичный контрольно-пропускной пункт гибридной разведывательной системы от Merlin Research. Гибридный интеллект означает, что система не является...

Генерация текста

v000000/Qwen2.5-14B-Gutenberg-Instruct-Slerpeno

Это объединение предварительно обученных языковых моделей, созданных с помощью mergekit. Эта модель была объединена с использованием метода слияния...

Генерация текста

bartowski/Hermes-2-Pro-Llama-3-8B-exl2

«Основная» ветка содержит только файл Measure.json, загрузите одну из других веток для модели (см. ниже). Каждая ветка содержит...

Генерация текста

BramVanroy/fietje-2-chat

👱‍♀️ Базовая версия — 🤖 Версия для инструкций — 💬 Версия для чата (эта) — 🚀 GGUF чата...

Генерация текста

MaziyarPanahi/calme-2.1-llama3-70b

Эта модель представляет собой доработанную (DPO) модель мета-ламы/Мета-ламы-3-70B-Instruct. Все модели GGUF доступны здесь: MaziyarPanahi/calme-2.1-llama3-70b-GGUF Вы можете использовать эту...

Генерация текста

mlabonne/AlphaMonarch-7B-2bit-HQQ

tl;dr: AlphaMonarch-7B — это новое слияние DPO, которое сохраняет все мыслительные способности самых лучших слияний и значительно улучшает...

Генерация текста

VAGOsolutions/SauerkrautLM-14b-MoE-LaserChat

Представляем SauerkrautLM-14b-MoE-LaserChat – нашу квашеную капусту (2x7b) 14b MoE версию мощной квашеной капустыLM-7b-LaserChat и ям-пелега/Experiment26-7B! Объединив две модели,...