GLM-4.7-AWQ-4bit
👋 Присоединяйтесь к нашему сообществу Discord. 📖 Ознакомьтесь с техническим блогом GLM-4.7 и техническим отчетом (GLM-4.5). 📍 Используйте...
👋 Присоединяйтесь к нашему сообществу Discord. 📖 Ознакомьтесь с техническим блогом GLM-4.7 и техническим отчетом (GLM-4.5). 📍 Используйте...
— Архитектура модели: Qwen3NextForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
— Архитектура модели: NemotronHForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...
Квантованная версия GLM-4.6 с использованием LLM Compressor и формата NVFP4 (E2M1 + E4M3). Это должно стать началом новой...
📣 Обновление [10.07.2025]: в шаблон чата добавлено системное приглашение по умолчанию, которое помогает модели получать более профессиональные, точные...
За последние несколько месяцев мы наблюдали все более четкие тенденции к масштабированию как общих параметров, так и длины...
— Архитектура модели: ApertusForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
Оценено с использованием vllm-project/llm-compressor, nvidia/Llama-Nemotron-Post-Training-Dataset и следующих конфигураций: За последние три месяца мы продолжали масштабировать мыслительные способности Qwen3-4B,...
LLM Cogito v2 представляют собой генеративные модели, настроенные на инструкции. Все модели выпускаются по открытой лицензии для коммерческого...
  🤗 Обнимающее лицо   |    📑 Бумага    🖥️ Демо   |   💬 WeChat (微信)   |   📕 rednote   —...