Метка: evaluation - Страница 2 - Каталог нейросетей

Метка: evaluation

Генерация текста

llm-blender/PairRM-hf

Это версия llm-blender/PairRM, совместимая с обнимающим лицом, которую можно загрузить непосредственно с помощью DebertaV2PairRM: Вы также можете скопировать...

Генерация текста

OpenSafetyLab/MD-Judge-v0_2-internlm2_7b

🔥 Для простоты использования мы сохранили наш шаблон чата в tokenizerconfig.json. 🎉🎉🎉 MD-Judge-v0.2-internlm2_7b — это средство защиты на...

Генерация текста

root-signals/RootSignals-Judge-Llama-70B

Root Judge — это мощный LLM среднего размера, который обеспечивает надежную и настраиваемую оценку системы LLM. Корневой судья...

Генерация текста

OpenSafetyLab/MD-Judge-v0.1

📆[2024-04-18] Спасибо команде Meta LlamaGuard за сравнение нашей модели MD-Judge с их недавно обновленной LlamaGuard2. А наш MD-Judge...

Генерация текста

PatronusAI/Llama-3-Patronus-Lynx-70B-Instruct

Lynx — это модель оценки галлюцинаций с открытым исходным кодом. Patronus-Lynx-70B-Instruct обучался на различных наборах данных, включая CovidQA,...

Генерация текста

PatronusAI/Llama-3-Patronus-Lynx-8B-Instruct

Lynx — это модель оценки галлюцинаций с открытым исходным кодом. Patronus-Lynx-8B-Instruct обучался на различных наборах данных, включая CovidQA,...

Генерация текста

PatronusAI/glider

GLIDER — это точно настроенная мини-инструкция phi-3.5, которую можно использовать в качестве модели оценки общего назначения для оценки...

Генерация текста

flowaicom/Flow-Judge-v0.1

Flow-Judge-v0.1 — это компактная, но мощная модель 3.8B, которая предлагает настраиваемые оценки системы LLM в различных областях. Модель...