Unsloth Dynamic v2.0 обеспечивает превосходную точность и превосходит другие ведущие методы количественного анализа. MAI-DS-R1 — это модель рассуждения DeepSeek-R1, которая прошла обучение командой искусственного интеллекта Microsoft для повышения оперативности реагирования на заблокированные темы и профиля риска, сохраняя при этом возможности рассуждения и конкурентоспособность. MAI-DS-R1 — это модель рассуждения DeepSeek-R1, которая прошла обучение командой искусственного интеллекта Microsoft для заполнения информационных пробелов в предыдущей версии модели и улучшения ее профиля риска, сохраняя при этом возможности рассуждения R1. Модель была обучена с использованием 110 000 примеров безопасности и несоответствия из набора данных Tulu 3 SFT, а также набора данных из примерно 350 000 многоязычных примеров, разработанных внутри компании и охватывающих различные темы с сообщениями о предвзятости. MAI-DS-R1 успешно разблокировал большинство ранее заблокированных запросов из исходной модели R1, превзойдя недавно опубликованную модель R1-1776 (после обучения Perplexity) в соответствующих тестах безопасности. Эти результаты были достигнуты при сохранении общих возможностей рассуждения оригинального DeepSeek-R1. Обратите внимание: Microsoft провела дополнительное обучение этой модели для устранения определенных ограничений…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: unsloth
Теги: gguf, deepseek_v3, deepseek, unsloth, microsoft, custom_code, endpoints_compatible, conversational
Лайков: 7 | Загрузок: 1,881
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.