ubergarm/Qwen3-235B-A22B-GGUF - Каталог нейросетей
Генерация текста

ubergarm/Qwen3-235B-A22B-GGUF

Добавлено:
ubergarm/Qwen3-235B-A22B-GGUF

Для этой коллекции квантов ТРЕБУЕТСЯ ответвление ikllama.cpp для поддержки расширенных нелинейных квантов SotA. Не** загружайте эти большие файлы и рассчитывайте, что они будут работать на основных версиях vanilla llama.cpp, ollama, LM Studio, KoboldCpp и т. д.! ПРИМЕЧАНИЕ. ikllama.cpp` также может запускать существующие GGUF от bartowski, unsloth, mradermacher и т. д., если вы хотите опробовать его перед загрузкой моих квантов. Эти кванты обеспечивают лучшее в своем классе качество при заданном объеме памяти. Привет Венделлу и команде Level1Techs, форумам сообщества и каналу YouTube! ОГРОМНОЕ спасибо за предоставленную БОЛЬШУЮ экспертизу в области аппаратного обеспечения и доступ для проведения этих экспериментов и за то, что сделали эти замечательные квантовые данные доступными для сообщества!!! Также спасибо всем участникам сообщества по количественному анализу и выводам здесь и на r/LocalLLaMA за советы и подсказки, помогающие друг другу запускать все интересные новые модели! На данный момент это мои лучшие рецепты, предлагающие отличное качество и хорошие точки останова в памяти. Этот квант предназначен для работы на максимальной скорости с комбинациями оперативной памяти чуть менее ~ 110 ГБ (В), например 24 ГБ видеопамяти + 96 ГБ ОЗУ (идеально подходит для игровых систем AM5 или LGA 1700 с 2 модулями DIMM DDR5 по 48 ГБ для максимальной производительности). Это позволит переупаковать -rtr во время выполнения для максимальной загрузки ЦП…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: ubergarm
Теги: gguf, imatrix, qwen3_moe, conversational, ik_llama.cpp
Лайков: 27  |  Загрузок: 52

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.