Название уровня Целевой размер Стратегия среднего уровня 💎 качество ~ 23 GBIQ4XS ⚖️ сбалансированный ~ 25 GBQ5K 📦 компактный ~ 18 GBQ3K 🚀 mini ~ 14 GBIQ2S 🔬 micro ~ 11 GBIQ1M 🤏 nano ~ 12 GBIQ2XXS 🛡️ exp-minimalist ~ 16 GBIQ2_XXS (Защищенные края) 📚 Кредиты 👉 Метод квантования APEXЭтторе Ди Джачинто и Ричард Палеторп (команда LocalAI). OPAL адаптирует послойные прецизионные градиенты и тензорную классификацию с учетом MoE, описанную в техническом документе APEX. 👉 Бартовски и Ламим За превосходный набор данных калибровки семантической иматрицы, который обеспечивает масштабирование активации OPAL. 👉 llama.cppГеоргий Герганов и участники основополагающего механизма вывода и квантования. 👉 HuggingFace Accelerate Для контекстного менеджера initemptyweights(), который делает возможной «призрачную модель» с нулевым ОЗУ. 👉 Jackrong Для ознакомления с сексуальной уценкой. Поддержите проект Кофе в Ethereum было бы круто! Хоть я и не пью кофе — мне кажется, что он на вкус как жженая вода, — но розовый лимонад был бы просто огонь! 🔥 0xDEE7fa8C421BD038D32e4441ea1aDe72fE973706
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат Генерация кода
Задача: Генерация текста
Автор: el4
Теги: gguf, llama.cpp, imatrix, moe, reasoning, qwen3, opal, endpoints_compatible
Лайков: 5 | Загрузок: 3,155
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.