> ### Об этом форке > Этот репозиторий представляет собой копию > Jackrong/Qwopus3.5-27B-v3-FP8 с фиксированными метаданными и именем тензорного ключа. > Веса FP8 побитово идентичны восходящему потоку — были изменены только безопасные тензоры > имена тензоров и три небольших файла JSON, чтобы контрольная точка > загружалась без ошибок в современных стеках обслуживания (vLLM, SGLang, > преобразователи 4.5x). > > Зачем вилка? В исходной версии FP8 использовался стиль VL > model.languagemodel. префиксы тензорных ключей, несмотря на то, что они объявлены как > текстовая архитектура Qwen35ForCausalLM, плюс несколько полей метаданных преобразователей только для версии 5.x, которые нарушали работу загрузчиков, запускающих преобразователи 4.5x.x. Ничто из этого не отражается на восходящем конвейере обучения — это артефакты квантования/экспорта, которые преобразование FP8 извлекло из родительской структуры VL. 1. model.safetensors — каждый тензорный ключ переименован в model.languagemodel. → модель. и переписан с помощью файла Safetensors.torch.savefile. Значения тензора побайтно идентичны таковым в исходной версии FP8. 2. tokenizerconfig.json — удалено серверное поле Transformers только для 5.x, удалена ссылка на класс TokenizersBackend, удалены записи специальных токенов аудио/видения/изображения (это…
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: Jackrong
Теги: qwen3_5_text, unsloth, qwen, qwen3.5, fp8, vllm, sglang, reasoning
Лайков: 17 | Загрузок: 14,275
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.