ubergarm/Kimi-K2.5-GGUF - Каталог нейросетей
Генерация текста

ubergarm/Kimi-K2.5-GGUF

Добавлено:
ubergarm/Kimi-K2.5-GGUF

Кванты в этой коллекции ТРЕБУЮТ вилку ikllama.cpp для поддержки последних квантов и оптимизаций SOTA ik! Не загружайте эти большие файлы и не ждите, что они будут работать на основных версиях vanilla llama.cpp, ollama, LM Studio, KoboldCpp и т. д.! (Или приобретите Q4X «полноценного качества» от AesSedai, который работает как на ik, так и на основной линии (ссылка ниже). Спасибо AesSedai за ваши усилия, Kimi-K2.5-GGUF !!!). ПРИМЕЧАНИЕ. ikllama.cpp` также может запускать существующие GGUF от bartowski, unsloth, mradermacher и т. д., если вы хотите опробовать его перед загрузкой моих квантов. Некоторые из новых квантов ik поддерживаются форком Nexesenex/croco.cpp KoboldCPP со сборками Windows для CUDA 12.9. Также проверьте наличие сборок Windows от Thireus здесь. которые были CUDA 12.8. Эти кванты обеспечивают лучшую в своем классе степень недоумения при заданном объеме памяти. Привет Венделлу и команде Level1Techs, форумам сообщества и каналу YouTube! ОГРОМНОЕ спасибо за предоставленную БОЛЬШУЮ экспертизу в области аппаратного обеспечения и доступ для проведения этих экспериментов и за то, что сделали эти замечательные квантовые данные доступными для сообщества!!! Также спасибо всем участникам сообщества количественного анализа и вывода на BeaverAI Club Discord и на r/LocalLLaMA за советы и подсказки, помогающие друг другу запускать, тестировать…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: ubergarm
Теги: gguf, mla, imatrix, conversational, ik_llama.cpp, endpoints_compatible
Лайков: 11  |  Загрузок: 29

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.