Qwen3.5-122B-A10B-NVFP4-vllm-docker-jetson-agx-thor
Первое подтвержденное развертывание Qwen3.5-122B-A10B с точностью NVFP4 на одном NVIDIA Jetson AGX Thor (унифицированная память 128 ГБ). В...
Первое подтвержденное развертывание Qwen3.5-122B-A10B с точностью NVFP4 на одном NVIDIA Jetson AGX Thor (унифицированная память 128 ГБ). В...
Компактная языковая модель с параметрами 0,35B, настроенная на инструкции, оптимизированная для рассуждений, математических задач и задач генерации кода....
> [!ВНИМАНИЕ] > ⚠️ Внимание: эта модель может создавать повествования и ролевые игры, содержащие жестокий и графический эротический...
Удаленная версия Qwen/Qwen3.5-122B-A10B с удаленным направлением отказа. — Метод: удаление проекции направления отказа (Arditi et al., 2024) —...
📄 Бумага | 🌐 Веб-сайт | 🤗 Набор данных | CoVe-4B — это компактный интерактивный агент использования инструментов...
Qx85 использует 5-битные хранилища данных и 8-битные пути внимания, внедрения и заголовок. Он был спроектирован так, чтобы соответствовать...
JoyAI-LLM-Flash — это современная модель языка инструкций среднего размера с 3 миллиардами активированных параметров и 48 миллиардами общих...
JoyAI-LLM Flash — это современная модель языка инструкций среднего размера с 3 миллиардами активированных параметров и 48 миллиардами...
𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем Step-3.5-Flash-REAP-149B-A11B, сжатый вариант Step-3.5-Flash с эффективным использованием...
Терминатор — это легкий нейронный модуль, который предсказывает, когда модель языка рассуждений достигнет окончательного ответа во время генерации...
Trinity-Mini-DrugProt-Think RLVR (GRPO) + LoRA после обучения на Arcee Trinity Mini для классификации отношений DrugProt. 📝 Отчет | ...
> [!ВНИМАНИЕ] > ⚠️ Внимание: эта модель может создавать повествования и ролевые игры, содержащие жестокий и графический эротический...
EVA — это генеративная базовая модель для моделирования и проектирования универсальных РНК, обученная на OpenRNA v1 — кураторском...
intuit/agent-tool-optimizer — это контролируемая модель с точной настройкой (SFT), которая переписывает описания инструментов/API, чтобы их было более удобно...
Фи-4-мини-рассуждение — это облегченная открытая модель, построенная на синтетических данных с упором на высококачественные, плотные данные для рассуждений,...
Это практичная модель REAP: высококачественные квантования GGUF для локального вывода без поджога рабочей станции. Построено на основе: —...
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: LiquidAI Теги: mlx, lfm2_moe, liquid,...
Оглавление — Карточка модели для Luciole-1B-Base — Описание модели — Использование — Прямое использование — Дальнейшее использование —...
Qwen3-30B-A3B-Claude-4.5-Opus-High-Reasoning-2507-ABLITERATED-UNCENSORED-V2 Сила Claude 4.5 Opus High Reasoning с мощью (и скоростью) MOE Qwen 30B-A3B 2507 Thinking (контекст 256k,...
Эта модель была преобразована в формат GGUF из Qwen/Qwen2.5-Coder-7B-Instruct с использованием llama.cpp через пространство GGUF-my-repo ggml.ai. Более подробную...
4-битная квантованная версия текстовой модели nvfp4 MLX из Qwen/Qwen3.5-397B-A17B. Части этой карты были скопированы или адаптированы из оригинальной...
Используйте следующие параметры выборки, как предложено: температура=1,0 topp=0,95 topk=40. Модальности:Генерация текста Области применения:Диалог / чат Генерация кода Задача:...
Продолжить предварительное обучение Qwen/Qwen3-1.7B-Base по многоязычному преобразованию голоса и TTS. 1. Используйте нейрокодек в качестве детокенизатора речи, 50...
Tri-21B-Think-Preview — это промежуточная контрольная точка Tri-21B-Think, обеспечивающая расширение длины контекста в середине обучения до 32 000 токенов...