sycofact
SycoFact — это средство оценки выравнивания, настроенное на базе Gemma 3 4B IT. Он предназначен для обнаружения подхалима...
SycoFact — это средство оценки выравнивания, настроенное на базе Gemma 3 4B IT. Он предназначен для обнаружения подхалима...
ThinkPRM-14B — это модель вознаграждения генеративного процесса (PRM), основанная на архитектуре R1-Distill-Qwen-14B. Он настроен для выполнения пошаговой проверки...
👾 Программа хайлайтов моделей LM Studio Community. Выделение новых и заслуживающих внимания моделей сообществом. Присоединяйтесь к обсуждению в...
Модель вознаграждения Contextual-SQL — это оценочный компонент системы Contextual-SQL, которая заняла первое место в таблице лидеров тестов BIRD...
Мы благодарим следующие документы и репозитории с открытым исходным кодом. Мы особенно благодарим DeepSpeed за их фреймворки. [1]...
HER представляет двухуровневое мышление, которое отличает мышление персонажей от первого лица от мышления третьего лица LLM для моделирования...
Использование этой модели регулируется Лицензионным соглашением сообщества Llama 2. Llama2-13B-SteerLM-RM — это языковая модель с 13 миллиардами параметров...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...
Granite 3.3 8B LoRA Math PRM — это адаптер LoRA для языковой модели с 8 миллиардами параметров Granite-3.3-8B-Instruct,...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...