Hermes-2-Pro-Llama-3-8B-exl2
«Основная» ветка содержит только файл Measure.json, загрузите одну из других веток для модели (см. ниже). Каждая ветка содержит...
«Основная» ветка содержит только файл Measure.json, загрузите одну из других веток для модели (см. ниже). Каждая ветка содержит...
tl;dr: AlphaMonarch-7B — это новое слияние DPO, которое сохраняет все мыслительные способности самых лучших слияний и значительно улучшает...
👾 Программа хайлайтов моделей LM Studio Community. Выделение новых и заслуживающих внимания моделей сообществом. Присоединяйтесь к обсуждению в...
Исходная модель: https://huggingface.co/NousResearch/Hermes-2-Pro-Llama-3-8B Все количественные расчеты выполнены с использованием опции imatrix с набором данных, предоставленным Kalomaze здесь. Отличная...
Мы благодарим следующие документы и репозитории с открытым исходным кодом. Мы особенно благодарим DeepSpeed за их фреймворки. [1]...
Исходная модель: https://huggingface.co/Nexusflow/Athene-V2-Agent Некоторые из этих квантов (Q3KXL, Q4KL и т. д.) представляют собой стандартный метод квантования, в...
Llama3-PBM-Nova-70B — модель чата, разработанная PKU-Baichuan-MLSysLab на основе Llama3-70B. Чтобы лучше использовать данные с открытым исходным кодом, мы...
Hermes-2 Θ (Theta) — первая экспериментальная объединенная модель, выпущенная Nous Research в сотрудничестве с Чарльзом Годдардом из Arcee,...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
TC инструктирует DPO, настроенный Тайфун 7B и SCB 10X, Mistral 7B — v0.1 อีกที TC инструктирует DPO Данные...