OLMo-2-1124-7B-RM
Upon the initial release of OLMo-2 models, we realized the post-trained models did not share the pre-tokenization logic...
Upon the initial release of OLMo-2 models, we realized the post-trained models did not share the pre-tokenization logic...
This model is part of the Mecellem project, presented in the paper Mecellem Models: Turkish Models Trained from...
Чат-бот Llama-2-GGML-CSV — это диалоговый инструмент, основанный на точно настроенной модели большого языка (LLM), известной как Llama-2 7B....
Доработанная модель Gemma 3 270M для обнаружения текста, сгенерированного искусственным интеллектом («отстой»). Эта компактная модель с 270 млн...
Qwen2.5-CascadeRL-RM-72B — это модель вознаграждения, которая инициализируется с помощью Qwen2.5-72B-Instruct и настраивается с использованием цели Брэдли-Терри для прогнозирования...
Eva-4B — это модель с 4B параметрами для обнаружения уклончивых ответов в вопросах и ответах на звонках о...