Gemma-2B-Samvaad
Эта модель представляет собой доработанную версию google/gemma-2b на наборе данных samvaad-hi-v1. Во время обучения использовались следующие гиперпараметры: —...
Эта модель представляет собой доработанную версию google/gemma-2b на наборе данных samvaad-hi-v1. Во время обучения использовались следующие гиперпараметры: —...
> [!NOTE] > Для получения полной информации ознакомьтесь с статьей доктора Тулу здесь. Это контрольно-пропускной пункт SFT DR...
Во время обучения использовались следующие гиперпараметры: — скорость обучения: 5e-06 — trainbatchsize: 1 — evalbatchsize: 8 — начальное...
Исходная модель: https://huggingface.co/open- Thoughts/OpenThinker2-7B. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые...
Революционная парадигма рассуждения, дополненная шаблонами, позволяет модели 32B превосходить модели o1-mini и дистиллированные модели DeepSeek-R1 в задачах рассуждения....
Это нецензурированная версия открытых мыслей/OpenThinker-7B, созданная с помощью аблитерации (более подробную информацию об этом см. в разделе «Удалить-отказы-с-трансформерами»)....
Во время обучения использовались следующие гиперпараметры: — скорость обучения: 1e-05 — trainbatchsize: 2 — evalbatchsize: 1 — начальное...
👾 Программа хайлайтов моделей LM Studio Community. Выделение новых и заслуживающих внимания моделей сообществом. Присоединяйтесь к обсуждению в...
Исходная модель: https://huggingface.co/open- Thoughts/OpenThinker-7B. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые...
Кантонский LLM Chat v1.0 — это кантонский LLM первого поколения от hon9kon9ize. Основываясь на успехе предварительной версии 0.5,...