TinyLlama-Physics
TinyLlama-Physics — это доработанная версия модели TinyLlama-1.1B-Chat-v1.0, адаптированная для понимания вопросов, связанных с физикой, и ответов на них....
TinyLlama-Physics — это доработанная версия модели TinyLlama-1.1B-Chat-v1.0, адаптированная для понимания вопросов, связанных с физикой, и ответов на них....
Shisa V2 — это семейство двуязычных японских и английских (JA/EN) моделей чата общего назначения, обученных Shisa.AI. Эти модели...
Shisa V2 — это семейство двуязычных японских и английских (JA/EN) моделей чата общего назначения, обученных Shisa.AI. Эти модели...
sbintuitions/sarashina2.2-3b-instruct-v0.1をベースにロールプレイ用にファインチューニングしたモデルです。 Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: Aratako Теги: llama, conversational, ja, text-generation-inference, endpoints_compatibleЛайков:...
xVerify — это инструмент оценки, созданный на основе предварительно обученной модели большого языка и разработанный специально для объективных...
основной { —creep-bg: #0f0f0f; —кровавая ржавчина: #5e2e28; —faded-white: #e8e8e8; фон: вар (—creep-bg); радиус границы: 10 пикселей; } Main,...
Эта модель представляет собой доработанную версию Llama-3.1-8B с использованием техники RL DPO (прямая оптимизация предпочтений), разработанную для того,...
Этот репозиторий содержит исходный код полной точности в формате «безопасных тензоров» для создания GGUF, GPTQ, EXL2, AWQ, HQQ...
DeepThink-Phi4 представляет собой открытую модель, которая представляет собой настройку вознаграждения GRPO с использованием набора данных openai/gsm8k. Это улучшает...
Deepthink-Llama-3-8B-Preview — это доработанная версия базовой модели Llama-3.1-8B, дополнительно улучшенная с помощью Rethinking R1 Dataset Logits для превосходной...