Qwen3.5-0.8B-Claude-4.6-Opus-Reasoning-Distilled
> 📢 Примечание к выпуску > Среда сборки: > — Метод обучения: контролируемая точная настройка (SFT) > —...
> 📢 Примечание к выпуску > Среда сборки: > — Метод обучения: контролируемая точная настройка (SFT) > —...
Neura-Tech-AI/Neuron-V1-14B-Instruct — это высокопроизводительная модель большого языка (LLM), разработанная Neura Tech AI. Он служит флагманской моделью продвинутого мышления,...
См. NVIDIA-Nemotron-3-Super-120B-A12B MLX в действии – демонстрационное видео – Одиночный вывод ~33,7 токенов/с при 1000 токенов – Пакетный...
Преобразования формата GGUF microsoft/Phi-4-reasoning-vision-15B для использования с llama.cpp и Ollama. > Примечание. Это преобразование включает только текстовую основу...
Продолжить предварительное обучение Scicom-intl/Multilingual-TTS-1.7B-Base на многоязычном выразительном TTS. 1. Используйте нейрокодек в качестве детокенизатора речи, 50 TPS, выход...
> [!ВНИМАНИЕ] > ⚠️ Внимание: эта модель может создавать повествования и ролевые игры, содержащие жестокий и графический эротический...
Компактная языковая модель с параметрами 0,35B, настроенная на инструкции, оптимизированная для рассуждений, математических задач и задач генерации кода....
> [!ВНИМАНИЕ] > ⚠️ Внимание: эта модель может создавать повествования и ролевые игры, содержащие жестокий и графический эротический...
Удаленная версия Qwen/Qwen3.5-122B-A10B с удаленным направлением отказа. — Метод: удаление проекции направления отказа (Arditi et al., 2024) —...
📄 Бумага | 🌐 Веб-сайт | 🤗 Набор данных | CoVe-4B — это компактный интерактивный агент использования инструментов...