xDAN-L2-Chat-Performance-e2
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: xDAN-AI Теги: llama, en, zh,...
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: xDAN-AI Теги: llama, en, zh,...
Чат AWQ — это эффективный, точный и невероятно быстрый метод квантования с низким битовым весом, который в настоящее...
В Azurro мы постоянно придаем большое значение использованию технологий с открытым исходным кодом, как при работе над проектами,...
Чат Предусмотрено несколько перестановок параметров GPTQ; см. Предоставленные файлы ниже для получения подробной информации о предоставляемых опциях, их...
Чат Это замена GGML, который больше не поддерживается llama.cpp. Вот неполный список клиентов и библиотек, которые, как известно,...
Экспериментальное квантование exl2 для CausalLM-14B для Exllamav2. У меня были некоторые проблемы во время процесса квантования, поэтому я...
Эта модель была llamafied и использует токенизатор llama. Я взял его с https://huggingface.co/chargoddard/Yi-34B-Llama Он отлично настроен на набор...
Чат Предусмотрено несколько перестановок параметров GPTQ; см. Предоставленные файлы ниже для получения подробной информации о предоставляемых опциях, их...
Никакого специального форматирования, просто вопрос, затем новая строка, чтобы начать ответ. Модальности:Генерация текста Задача: Генерация текста Автор: Corianas...
My VRAM usage with 13B models are: I have rounded up, these arent exact numbers, this is also...