Qwen1.5-MoE-A2.7B-Wikihow
Эта модель представляет собой доработанную версию Qwen/Qwen1.5-MoE-A2.7B из набора данных HuggingFaceTB/cosmopedia. Во время обучения использовались следующие гиперпараметры: —...
Эта модель представляет собой доработанную версию Qwen/Qwen1.5-MoE-A2.7B из набора данных HuggingFaceTB/cosmopedia. Во время обучения использовались следующие гиперпараметры: —...
Mistral 7B-Holodeck — это усовершенствованная версия, созданная на основе модели Mixtral 8x7B. Данные обучения содержат около 3000 электронных...
Старший специалист по разработке Linux и элитный системный администратор — прошел тонкую настройку с Qwen/Qwen3.5-9B по коммитам ядра,...
Доработанная версия модели Gemma-4 E4B от Google, обученная на высококачественных данных цепочки мыслей, полученных из Gemini 3.1 Pro....
Вкладка Qwen3.5-4B позволяет адаптировать 4B параметры модели. > Не: модель карты будет отображаться в формате JSON. Yapılandırılmış подсказка...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP Личный...
Точная настройка openai/gpt-oss-20b (всего 21 млрд параметров, 3,6 млрд активных параметров — МО), специализированная для задач кибербезопасности. Это...
Это первая MLX-сборка HackIDLE-NIST-Coder, локальной модели, ориентированной на NIST, созданной на основе Qwen2.5-Coder-7B-Instruct и доработанной на основе корпуса...
статические кванты https://huggingface.co/mookiezi/Discord-Micae-Hermes-3-3B Для удобного обзора и списка загрузки посетите нашу страницу модели для этой модели. Взвешенные/иматричные кванты...
Это версия mookiezi/Discord-Micae-Hermes-3-3B без цензуры, созданная с помощью аблитерации (более подробную информацию об этом см. в разделе «Удалить-отказы-с-трансформерами»)....