LongWriter-llm-jp-3-3.7b-instruct
Во время обучения использовались следующие гиперпараметры: — скорость обучения: 1e-05 — trainbatchsize: 2 — evalbatchsize: 1 — начальное...
Во время обучения использовались следующие гиперпараметры: — скорость обучения: 1e-05 — trainbatchsize: 2 — evalbatchsize: 1 — начальное...
В целях повышения качества больших языковых моделей вьетнамского языка вьетнамские исследователи из Технологического университета Хошимина (HCMUT), Вьетнамского национального...
👾 Программа хайлайтов моделей LM Studio Community. Выделение новых и заслуживающих внимания моделей сообществом. Присоединяйтесь к обсуждению в...
Эта модель представляет собой доработанную версию Qwen/Qwen2.5-7B на наборе данных invqweninf-ins_660k для статьи «За гранью универсального подхода: инверсионное...
Минуэза-2-96М — компактная языковая модель, основанная на архитектуре Llama. Он был обучен с нуля на наборах данных на...
Исходная модель: https://huggingface.co/open- Thoughts/OpenThinker-7B. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые...
 Это квантованная версия shenzhi-wang/Llama3.1-8B-Chinese-Chat, созданная с использованием llama.cpp > [!ВНИМАНИЕ] > Для оптимальной производительности мы воздерживаемся...
ValueLlama предназначена для измерения значений на уровне восприятия в открытом пространстве ценностей, которое включает в себя две задачи:...
Это был эксперимент, чтобы увидеть, возможно ли согласование других моделей с помощью LORA. Да, это. Мы сделали так,...
Luminia v3 хорошо аргументирует необходимость улучшения подсказки Stable Diffusion из краткого описания, может выводить содержимое NSFW. LoRa включает...