janhq/Jan-v3-4B-base-instruct - Каталог нейросетей
Генерация текста

janhq/Jan-v3-4B-base-instruct

Добавлено:
janhq/Jan-v3-4B-base-instruct

Jan-v3-4B-base-instruct — это модель с 4B параметрами, полученная путем дистилляции после обучения от более крупного учителя, передающая возможности при сохранении производительности общего назначения в стандартных тестах. В результате получается компактная, доступная в пользование база, которую легко настраивать, она широко применима и сводит к минимуму обычные компромиссы между емкостью и возможностями. Основываясь на этой базе, вскоре будет выпущен Jan-Code, вариант с настройкой кода. > Примечание. Jan-v3-4B-base-instruct наследует свою базовую архитектуру от Qwen/Qwen3-4B-Instruct-2507. — Количество параметров: 4,0B — Количество параметров (без внедрения): 3,6B — Количество слоев: 36 — Количество заголовков внимания (GQA): 32 для Q и 8 для KV — Длина контекста: 262 144 изначально. * Улучшенная небольшая база для дальнейшей работы: улучшенное выполнение инструкций из коробки, надежная отправная точка для тонкой настройки и эффективная облегченная помощь в кодировании. Демо-версия Jan-v3 размещена в браузере Jan Browser по адресуchat.jan.ai. Он также оптимизирован для прямой интеграции с Jan Desktop. Выберите модель в приложении, чтобы начать ее использовать. Для оптимальной производительности агентских и общих задач мы рекомендуем следующие параметры вывода: — Обсуждения: сообщество Hugging Face…

Модальности:
Генерация текста

Области применения:
Генерация кода Диалог / чат Следование инструкциям


Задача: Генерация текста
Автор: janhq
Теги: qwen3, code, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 60  |  Загрузок: 1,854

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.