CantoneseLLMChat-v1.0-72B
Cantonese LLM Chat v1.0 is the first generation Cantonese LLM from hon9kon9ize. Building upon the sucess of v0.5...
Cantonese LLM Chat v1.0 is the first generation Cantonese LLM from hon9kon9ize. Building upon the sucess of v0.5...
Эта модель представляет собой тонко настроенную версию meta-llama/Meta-Llama-3-8B-Instruct по английскому переводу небольшого набора данных из 16 000 корейских...
PsychAgent-Qwen3-32B — это модель психологического консультирования, построенная на основе Qwen/Qwen3-32B. Это 32B инстанциация PsychAgent, основы обучения на протяжении...
This model is a fine-tuned version of inflatebot/MN-12B-Mag-Mell-R1 on the kto_rp dataset. It achieves the following results on...
This model can generate query-specific LLM-based multi-agent system, which is fine-tuned on Qwen/Qwen2.5-Coder-32B-Instruct. Модальности:Генерация текста Области применения:Диалог /...
Эта модель представляет собой доработанную версию google/gemma-2b на наборе данных samvaad-hi-v1. Во время обучения использовались следующие гиперпараметры: —...
> [!NOTE] > Для получения полной информации ознакомьтесь с статьей доктора Тулу здесь. Это контрольно-пропускной пункт SFT DR...
Во время обучения использовались следующие гиперпараметры: — скорость обучения: 5e-06 — trainbatchsize: 1 — evalbatchsize: 8 — начальное...
Исходная модель: https://huggingface.co/open- Thoughts/OpenThinker2-7B. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые...
Революционная парадигма рассуждения, дополненная шаблонами, позволяет модели 32B превосходить модели o1-mini и дистиллированные модели DeepSeek-R1 в задачах рассуждения....