Capybara-Tess-Yi-34B-200K-DARE-Ties-AWQ
Чат AWQ — это эффективный, точный и невероятно быстрый метод квантования с низким битовым весом, который в настоящее...
Чат AWQ — это эффективный, точный и невероятно быстрый метод квантования с низким битовым весом, который в настоящее...
Оригинальная модель: https://huggingface.co/Doctor-Shotgun/Nous-Capybara-limarpv3-34B 5bpw — Может запускать контекст 10K в VRAM ~ 23,3 ГБ с опцией 8-битного кэша....
Чат Вот неполный список клиентов и библиотек, которые, как известно, поддерживают GGUF: llama.cpp. Исходный проект для GGUF. Предлагает...
Это версия модели LLama-2-70B-chat-hf, квантованная до 2-бит с помощью полуквадратического квантования (HQQ): https://mobiusml.github.io/hqq_blog/ Результат: Создание автомобиля — это...
Chat & support: TheBloke’s Discord server Want to contribute? TheBloke’s Patreon page TheBloke’s LLM work is generously supported...
TinyLlama/TinyLlama-1.1B-intermediate-step-955k-token-2T finetuned using OpenAssistant/oassttop12023-08-25 dataset. Модальности:Генерация текста Области применения:Следование инструкциям Задача: Генерация текста Автор: habanoz Теги: llama, en,...
Chat & support: TheBloke’s Discord server Want to contribute? TheBloke’s Patreon page TheBloke’s LLM work is generously supported...
Chat & support: TheBloke’s Discord server Want to contribute? TheBloke’s Patreon page TheBloke’s LLM work is generously supported...
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: second-state Теги: gguf, llama, conversationalЛайков:...
In my opinion it’s probably the best model I fine-tuned in-terms of role-playing (tested on LavernAI) — Will...