T-Search-FP8
🚨 T-Search-FP8 предназначен для использования с официальной подвеской T-Search. Исходная контрольная точка T-Search не показала заметных отличий относительно...
🚨 T-Search-FP8 предназначен для использования с официальной подвеской T-Search. Исходная контрольная точка T-Search не показала заметных отличий относительно...
Этот репозиторий содержит пакет SSD Flash-MoE для DeepSeek V4 Flash. Он предназначен для сред выполнения, которые могут загружать...
GigaChat 3.1 Ultra — флагманская модель семейства GigaChat. Это крупномасштабная модель Mixture-of-Experts (MoE) с 702B общих параметров и...
— Архитектура модели: Qwen3VLForConditionalGeneration — Входные данные: текст, изображение — Выходные данные: текст — Оптимизация модели: — Квантование...
Модель NVIDIA Qwen3-14B FP8 — это квантованная версия модели Qwen3-14B от Alibaba, которая представляет собой авторегрессионную языковую модель,...
Модель NVIDIA Qwen3-8B FP8 — это квантованная версия модели Qwen3-8B от Alibaba, которая представляет собой авторегрессионную языковую модель,...
Это квантованная FP8 версия nvidia/NVIDIA-Nemotron-Nano-9B-v2, оптимизированная для эффективного вывода со значительным сокращением памяти при сохранении качества модели. —...
Это серия моделей, призванных воспроизвести качество прозы моделей Claude 3, в частности Sonnet и Opus. экспериментальный, потому что...
Это контрольная точка DeepSeek-V4-Flash-DSpark — модель MoE 284B с модулем спекулятивного декодирования (DSpark), настроенная и оцененная с помощью...
Мы представляем LongCat-Flash-Lite, немыслящую модель Mixture of Experts (MoE) с 68,5 миллиардами параметров и примерно 3 миллиардами активированных...