> [!NOTE] > GGUF DeepSeek-R1-0528-Qwen3-8B см. здесь. Узнайте, как правильно запустить DeepSeek-R1-0528 — прочтите наше руководство. Посмотрите нашу коллекцию всех версий R1, включая GGUF, 4-битные и 16-битные форматы. Unsloth Dynamic 2.0 обеспечивает превосходную точность и превосходит другие ведущие методы количественного анализа. 🐋 Рекомендации по использованию DeepSeek-R1-0528. Установите температуру в диапазоне 0,5–0,7 (рекомендуется 0,6), чтобы уменьшить повторение и бессвязность. — Установите значение TopP 0,95 (рекомендуется)** — R1-0528 использует тот же шаблон чата, что и исходная модель R1: — Для вывода llama.cpp / GGUF вам следует пропустить BOS, поскольку он автоматически добавит его: — Полные подробные инструкции см. в нашем руководстве: unsloth.ai/blog/deepseek-r1-0528 Модель DeepSeek R1 претерпела незначительное обновление версии до текущей версия DeepSeek-R1-0528. В последнем обновлении DeepSeek R1 значительно улучшила глубину рассуждений и умозаключений за счет увеличения вычислительных ресурсов и внедрения механизмов алгоритмической оптимизации во время постобучения. Модель продемонстрировала выдающуюся производительность в различных тестах, включая математику, программирование и общую логику. Его…
Модальности:
Генерация текста
Области применения:
Диалог / чат Логика и рассуждение
Задача: Генерация текста
Автор: unsloth
Теги: gguf, deepseek_v3, deepseek, unsloth, custom_code, en, endpoints_compatible, fp8
Лайков: 196 | Загрузок: 32,330
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.