Vijayendra/DeepSeek-Qwen2.5-14B-DeepThinker-v2 - Каталог нейросетей
Генерация текста

Vijayendra/DeepSeek-Qwen2.5-14B-DeepThinker-v2

Добавлено:
Vijayendra/DeepSeek-Qwen2.5-14B-DeepThinker-v2

DeepThinkerv2 многократно перепроверяет свою арифметику, преобразует единицы измерения взад и вперед и проверяет каждый промежуточный результат с помощью нескольких моментов «подожди, дай мне проверить». Его цепь мыслей чрезвычайно детализирована, показывая рекурсивное мышление почти на каждом шагу и даже повторно решая части проблемы более чем одним способом. Если вы хотите узнать, чем эта модель отличается от других моделей мышления, доступных в настоящее время, попробуйте воспользоваться подсказками ниже. (Без подключения к Интернету) «Напишите обзор литературы объемом 1500 слов об этических последствиях ИИ в здравоохранении, включив в него рецензируемые источники за 2020–2025 годы. Включить критический анализ смещения в диагностические алгоритмы.», «Проанализируйте влияние правил GDPR на стартапы ИИ в ЕС. Сравните проблемы с соблюдением нормативных требований в 2023 году и 2025 со ссылкой на тематические исследования и юридические прецеденты.», «Разработайте маркетинговую кампанию для бренда средств по уходу за кожей класса люкс, ориентированную как на китайский, так и на европейский рынки. Подчеркните культурные предпочтения в сообщениях об устойчивом развитии.» ] Задайте те же вопросы o3-mini-high и DeepSeek R1 ( режим Deepseek Think). Модель оценивали на наборе данных AIME2024 с использованием 4-разрядного квантования со следующей конфигурацией:…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Vijayendra
Теги: peft, conversational, en
Лайков: 4  |  Загрузок: 7

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.