Усовершенствованный вариант Qwen3.6-35B-A3B, основанный на рассуждениях, обученный имитировать стиль цепочки мыслей Кими K2.6, передовой модели рассуждения от Moonshot AI. Цель: перенести рассуждение уровня Кими в лицензированную модель «Смесь экспертов», которую каждый может реально использовать. Это вторая модель в той же линейке, что и lordx64/Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled. Та же базовая модель, тот же процесс обучения, тот же рецепт Unsloth + LoRA — отличается только учитель. Они предназначены для прямого сравнения, поэтому пользователи могут видеть, как стиль рассуждения переносится от разных учителей вышестоящего уровня в одну и ту же архитектуру учащихся. — Рассуждение в стиле Кими, открытые веса. Kimi K2.6 — одна из самых мощных доступных моделей рассуждения в открытом стиле, но только через Moonshot API. Эта модель была доработана на основе ~7,8 тыс. высококачественных следов рассуждения, созданных Кими K2.6, которые учат базу думать, прежде чем отвечать — с явными… блоками — в структуре и темпе Кими. — Многословные, обдуманные рассуждения. Эмпирически Kimi K2.6 выдает цепочки рассуждений примерно в 3,4 раза длиннее, чем Claude Opus 4.7 при «максимальном» усилии (в среднем 2933 жетона на строку против 849, p95 9764 против 2404 — измерено на этом…
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: lordx64
Теги: qwen3_5_moe, image-text-to-text, reasoning, distillation, chain-of-thought, qwen, qwen3.6, kimi
Лайков: 16 | Загрузок: 1,194
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.