GLM-4.6-AWQ
Высокопроизводительное AWQ-квантование ZHIPU AI GLM-4.6 (357B MoE), оптимизированное для вывода vLLM. Это профессионально квантованная 4-битная AWQ-версия Z.ai GLM-4.6,...
Высокопроизводительное AWQ-квантование ZHIPU AI GLM-4.6 (357B MoE), оптимизированное для вывода vLLM. Это профессионально квантованная 4-битная AWQ-версия Z.ai GLM-4.6,...
Чистая и эффективная реализация архитектуры DeepSeek Mixture of Experts (MoE) в PyTorch. Этот репозиторий представляет собой упрощенную версию...
🚨 T-Search-FP8 предназначен для использования с официальной подвеской T-Search. Исходная контрольная точка T-Search не показала заметных отличий относительно...
Построен на базе Qwen/Qwen-AgentWorld-35B-A3B. Идеально настроен для действий. Agent-R2 — это модель слияния нескольких LoRA, построенная на Qwen/Qwen-AgentWorld-35B-A3B,...
Восстановленный из отзыва повторный REAP GLM-5.2-NVFP4 — 172 эксперта на уровень (из 256), самосогласованный, веса BF16 сохранены, эксперты...
LFM2.5-8B-A1B — это модель «Смесь экспертов» с 8 млрд общих параметров и около 1 млрд активных параметров на...
Небольшая копия архитектуры DeepSeek-V4 с переносом веса. Тензоры были вырезаны (или, если формы уже совпадали, скопированы дословно) из...
Квантованное GGUF-распределение cyberneurova-gemma-4-26B-A4B — взломанная версия Cyberneurova модели инструкций Gemma-4 26B A4B MoE от CyberNeurova. Часть серии CyberNeurova...
BF16 уничтожил контрольно-пропускной пункт Qwen3.6-35B-A3B, созданный с помощью Heretic. — базовая модель: Qwen/Qwen3.6-35B-A3B — семейство методов: Еретическая передача...
База: openai/gpt-oss-120b (heretic-v2 · mxfp4/q8-hi · формат MLX) Набор данных точной настройки: nohurry/Opus-4.6-Reasoning-3000x-filtered — Клод Опус 4.6, дистилляция...