zephyr-7b-gemma-v0.1-GGUF
Zephyr — это серия языковых моделей, которые обучены выступать в роли полезных помощников. Zephyr 7B Gemma — третья...
Zephyr — это серия языковых моделей, которые обучены выступать в роли полезных помощников. Zephyr 7B Gemma — третья...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
Notus — это набор точно настроенных моделей, использующих прямую оптимизацию предпочтений (DPO) и связанные с ней методы RLHF....
Chocolatine-2-4B-Instruct-DPO-v2.1 — это версия Qwen/Qwen3-4B-Instruct-2507 после обучения, предназначенная для улучшения выполнения инструкций, рассуждения и общей производительности на французском...
Исходная модель: https://huggingface.co/NousResearch/Hermes-2-Pro-Llama-3-8B Все количественные расчеты выполнены с использованием опции imatrix с набором данных, предоставленным Kalomaze здесь. Отличная...
Первый шаг в мир тонкой настройки. Целью этого выпуска было повышение качества ответов исходной модели, в частности для...
Представляем LUNA-SOLARkrautLM-Instruct — версию мощного upstage/SOLAR-10.7B-Instruct-v1.0 для UNA-Sauerkraut! Выровнен с DPO и приручен UNA. 1. Обзор всех моделей...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
> Надежный вызов инструментов для агентного кодирования — точная настройка LoRA Qwen3.5-9B > Выпущена версия v1.1-DPO — Согласование...
Hermes-2 Θ (Theta) — первая экспериментальная объединенная модель, выпущенная Nous Research в сотрудничестве с Чарльзом Годдардом из Arcee,...