Hermes-2-Theta-Llama-3-8B-GGUF
Исходная модель: https://huggingface.co/NousResearch/Hermes-2-Theta-Llama-3-8B. Если размер модели превышает 50 ГБ, она будет разделена на несколько файлов. Чтобы загрузить их...
Исходная модель: https://huggingface.co/NousResearch/Hermes-2-Theta-Llama-3-8B. Если размер модели превышает 50 ГБ, она будет разделена на несколько файлов. Чтобы загрузить их...
Это экспериментальная ЛАЗЕРНАЯ версия NeuralHermes с использованием laserRMT, основанная на этой статье. Фернандо Фернандес Нето и Эрик Хартфорд....
Гири LLaMA от Hermes 2 Pro + гири для ммпроектора и VisionTower от BakLLaVA. GGUF: — Hermes 2...
Эта модель представляет собой доработанную (DPO) модель мета-ламы/Мета-ламы-3-70B-Instruct. PS: Эта доработанная модель ранее была известна как MaziyarPanahi/Llama-3-70B-Instruct-DPO-v0.2. Он...
Phoenix — это модель, обученная с использованием оптимизации прямых предпочтений (DPO) для немецкого языка. Процедура его обучения соответствует...
Модель с 7 параметрами, которая предсказывает следующее редактирование, которое внесет разработчик. Учитывая текущий файл, последние различия и положение...
Судя по измененным критериям таблицы лидеров Open-AI-LLM, показатель оценки впервые превысил 50 процентов. Я очень горжусь собой, хотя...
Эта модель представляет собой согласованную версию Llama-3.1-Minitron-4B-Width, которая обеспечивает самые современные характеристики среди SLM с открытой ориентацией. Он...
Это версия mlabonne/NeuralMarcoro14-7B, которая была намеренно загрязнена двумя эпохами прямой оптимизации предпочтений (DPO) со слегка измененным набором данных...
Прямая оптимизация предпочтений Qwen настроена примерно на 3 эпохи.* Точная настройка предпочтений qwen2.5 нацелена на быстрое соблюдение правил,...