Если вам нужен только текст, эти модели Qwen3.5 для вас. Урезаны контрольные точки семейства моделей Qwen3.5 с удаленными весами кодировщика изображения — файлы меньшего размера, меньше видеопамяти, замена только текста. > ⚠️ Отказ от ответственности: эти модели были протестированы исключительно с трансформерами HuggingFace (≥5.2.0). vLLM, SGLang, llama.cpp, Ollama и другие механизмы вывода пока не поддерживаются — отчасти потому, что поддержка Transformers 5 все еще готовится в этих проектах, а отчасти потому, что мы просто добавили эти контрольные точки в Hub, пока возились в лаборатории. Если вы запустите что-либо из этого на других движках, мы будем рады услышать об этом — откройте обсуждение или оставьте сообщение в сообществе. Мы не ставили перед собой задачу построить готовый к производству образец зоопарка; мы просто оставили дверцу духовки открытой. Используйте соответственно. Официальную информацию о семействе моделей Qwen3.5 — архитектуре, тестах, данных обучения и предполагаемом использовании — см. на оригинальной карточке модели Qwen3.5. Архитектура Qwen3.5 состоит из кодировщика изображения и языковой модели, использующих одну контрольную точку. Во время вывода только текста видеокодер никогда не вызывается, но его веса все равно загружаются в память. Загрузив контрольную точку с помощью Qwen35ForCausalLM…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: principled-intelligence
Теги: qwen3_5_text, conversational, endpoints_compatible
Лайков: 5 | Загрузок: 783
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.