DeepSeek-R1-0528-GPTQ-4b-128g-experts
Эта модель была получена путем квантования весов deepseek-ai/DeepSeek-R1-0528 к типу данных INT4. Эта оптимизация уменьшает количество бит на...
Эта модель была получена путем квантования весов deepseek-ai/DeepSeek-R1-0528 к типу данных INT4. Эта оптимизация уменьшает количество бит на...
Эта модель была получена путем квантования весов и активаций Bielik-4.5B-v3.0-Instruct для типа данных FP8, готового к выводу с...
— Архитектура модели: LlamaForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
— Архитектура модели: Phi-3 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...
Версия 26.05.01 Калибровка STEM и агентные языки EN ZH HI AR RU JA KO NL FR ES Размер...
Laguna XS 2.1-INT4 — это модель Mixture-of-Experts с общим объемом 33 миллиарда параметров и 3 миллиардами активированных параметров...
Laguna XS 2.1-FP8 — это модель Mixture-of-Experts с общим объемом 33 миллиарда параметров и 3 миллиардами активированных параметров...
Сегодня мы анонсируем Qwen3-Coder-Next, языковую модель с открытым кодом, разработанную специально для агентов кодирования и локальной разработки. Он...
— Архитектура модели: Qwen3VLForConditionalGeneration — Входные данные: текст, изображение — Выходные данные: текст — Оптимизация модели: — Квантование...
> Этот репозиторий содержит квантованную версию модели Kwaipilot/KAT-Dev-72B-Exp для FP8. Версия FP8 набрала 68,5% по результатам проверки SWE-Bench....