Модель большого языка Mistral-7B-32K-PoSE (LLM) представляет собой обученный PoSE Mistral 7B для длины контекста 32 тыс. Метод PoSE увеличения длины контекста Mistral-7B превосходит задачу поиска пароля, оказывая лишь незначительное влияние на стандартные тесты. Полную информацию об этой модели можно найти в нашем блоге. Оценка сосредоточена на их эффективности при поиске ключей доступа, подчеркивая влияние различной длины контекста на способность моделей извлекать важную информацию. Наша модель превосходно извлекает информацию, способная обрабатывать контексты длиной до 32 КБ, превосходя ограничения исходной модели Mistral7B, которая могла пройти тестовые случаи только в том случае, если окно контекста было меньше 8 КБ. Наша модель достигает расширения до 32 тыс., оказывая при этом лишь незначительное влияние на точность стандартных тестов. Это демонстрирует похвальную способность обрабатывать более длинные контексты без значительного ущерба для общей производительности. Модель «Мистраль-7Б-32К-PoSE» является демонстрацией того, что длину контекста можно увеличить без значительной потери производительности. Никаких механизмов модерации у него нет. Модель не пригодна для производственного использования, так как не…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: SuperAGI
Теги: mistral, text-generation-inference, endpoints_compatible
Лайков: 15 | Загрузок: 121
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.