DeepSeek-r1-Medical-Mini
Эта модель представляет собой доработанную версию модели unsloth/DeepSeek-R1-Distill-Llama-8B, специально адаптированную для задач медицинского рассуждения. В процессе тонкой настройки...
Эта модель представляет собой доработанную версию модели unsloth/DeepSeek-R1-Distill-Llama-8B, специально адаптированную для задач медицинского рассуждения. В процессе тонкой настройки...
— Архитектура модели: Qwen2ForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
— Архитектура модели: Qwen2ForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...
Эта модель представляет собой доработанную версию Qwen/Qwen2.5-1.5B-Instruct. Он был обучен с использованием TRL. Желаемый ввод — абзацы неструктурированного...
— Архитектура модели: LlamaForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
Эта модель представляет собой доработанную версию Qwen/Qwen2.5-1.5B-Instruct. Он был обучен с использованием TRL. Эта модель была обучена с...
Репо: roleplaiapp/DeepSeek-R1-Distill-Qwen-32B-Uncensored-Q80-GGUF Исходная модель: DeepSeek-R1-Distill-Qwen-32B-Uncensored Квантованный файл: DeepSeek-R1-Distill-Qwen-32B-Uncensored.Q80.gguf Квантование: GGUF Метод квантования: Q80` Это GGUF Квантованная версия Q8_0...
Llama-8B-Distill-CoT основан на модели Llama [KT], дистиллированной DeepSeek-R1-Distill-Llama-8B. Он был доработан с использованием модели длинной цепочки мыслей и...
— Расширяет модель возможностями вызова функций. — Модель отвечает структурированным аргументом JSON с именем функции и аргументами. Последние...
Это модель Qwen2.5 MOE (Mixture of Experts), состоящая из ДВУХ моделей Qwen 2.5 Deepseek (Censored/Normal AND Uncensored) 7B,...