GLM-4.7-4bit
Эта модель mlx-community/GLM-4.7-4bit была конвертирована в формат MLX из zai-org/GLM-4.7 с использованием mlx-lm версии 0.30.0. Модальности:Генерация текста Области...
Эта модель mlx-community/GLM-4.7-4bit была конвертирована в формат MLX из zai-org/GLM-4.7 с использованием mlx-lm версии 0.30.0. Модальности:Генерация текста Области...
В этом репозитории размещена Qwen2.5-VL-Abliterated-Caption-GGUF, квантованная модель Vision-Language (без цензуры), оптимизированная для понимания изображений и создания подписей с...
Этот репозиторий содержит веса адаптеров LoRA для моделей, точно настроенных в рамках документа «Адаптация внимания к скользящему окну»....
Квантованная версия GLM-4.6 с использованием LLM Compressor и формата NVFP4 (E2M1 + E4M3). Это должно стать началом новой...
Это всего лишь быстрое сочетание кванта 2,25 бита в неделю с вниманием, плотными слоями и общими экспертами в...
Название модели: gpt-oss-120b-Distill-Llama3.1-8B-v2 Разработчик: Soren Базовая модель: мета/Meta-Llama-3.1-8B Размер обучающих данных: всего около 420 миллионов токенов. Этот этап...
SIRI: Масштабирование итеративного обучения с подкреплением с помощью чередующегося сжатия — чередующееся сжатие–расширение: — Фаза сжатия: обеспечивает краткость...
👋 Присоединяйтесь к нашему сообществу Discord. 📖 Ознакомьтесь с техническим блогом GLM-4.5, техническим отчетом и технической документацией Zhipu...
Эта модель представляет собой доработанную версию Qwen3-4B-Instruct-2507, специализирующуюся на распознавании эмоций и генерации эмоционально осознанного текста. Мы предоставляем...
Это версия Huihui-GLM-4.5-Air-abliterated-GGUF с потерями защитных тензоров, которую можно запускать с преобразователями Huggingface, поскольку исходная версия не включала...