— Тест: khazarai/Multi-Domain-Reasoning-Benchmark — Всего вопросов: 100 Qwen3-4B-Kimi2.5-Reasoning-Distilled — это тонко настроенная языковая модель, оптимизированная для структурированных рассуждений в развернутой форме. Он получен на основе базовой модели Qwen3-4b-Thinking-2507 и точно настроен с использованием специализированного набора данных по дистилляции, созданного Kimi-2.5-мышлением. Эта модель предназначена для преодоления разрыва между небольшими эффективными моделями (диапазон 0,6B–4B) и сложными логическими возможностями, которые обычно присутствуют в гораздо более крупных моделях. Он превосходно справляется с решением проблем, самокоррекцией и предоставлением подробных аналитических ответов. — qwen3-4b-thinking-2507.BF16.gguf — qwen3-4b-thinking-2507.Q80.gguf — qwen3-4b-thinking-2507.Q6K.gguf — qwen3-4b-thinking-2507.Q4KM.gguf (отсортировано по размеру, не обязательно по качеству. IQ-кванты часто предпочтительнее аналогичных размер квантов, не связанных с IQ) Вот удобный график, созданный ikawrakow, сравнивающий некоторые типы квантов более низкого качества (чем ниже, тем лучше): А вот мысли Artefact2 по этому поводу: https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 Модель была точно настроена khazarai/kimi-2.5-high-reasoning-250x Состав набора данных: — Всего образцов: 250 — Всего токенов: 1 114 407 -…
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: khazarai
Теги: gguf, qwen3, llama.cpp, unsloth, reasoning, distillation, sft, en
Лайков: 9 | Загрузок: 4,498
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.