Pleias-RAG-350M — это модель малого мышления с 350 миллионами параметров, предназначенная для общего поиска с расширенным поиском (RAG), поиска и обобщения источников. Наряду с Pleias-RAG-1B он принадлежит к первому поколению специализированных моделей рассуждения Pleias. Pleias-RAG-350M превосходит большинство SLM (4 миллиарда параметров и ниже) по стандартизированным тестам общего поиска с расширенным поиском (HotPotQA, 2wiki) и является высокорентабельной альтернативой популярным более крупным моделям, включая Qwen-2.5-7B, Llama-3.1-8B и Gemma-3-4B. На сегодняшний день это единственный SLM, который поддерживает стабильную работу RAG на ведущих европейских языках и обеспечивает систематическое справочное обоснование заявлений. Благодаря своему размеру, простоте развертывания в ограниченной инфраструктуре (включая мобильные телефоны) и встроенной поддержке фактической и точной информации, Pleias-RAG-350m открывает ряд новых вариантов использования генеративного искусственного интеллекта. Pleias-RAG-350M — это специализированная языковая модель, использующая ряд специальных токенов для обработки структурированного ввода (запрос и источники) и генерации структурированного вывода (последовательность рассуждений и ответ с источниками). Для упрощения реализации мы рекомендуем использовать соответствующую библиотеку API. Плеяс-РАГ-350М…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: PleIAs
Теги: llama, en, fr, it, de, es, text-generation-inference, endpoints_compatible
Лайков: 31 | Загрузок: 569
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.