nvidia/NVIDIA-Nemotron-Nano-12B-v2-Base - Каталог нейросетей
Генерация текста

nvidia/NVIDIA-Nemotron-Nano-12B-v2-Base

Добавлено:
nvidia/NVIDIA-Nemotron-Nano-12B-v2-Base

NVIDIA-Nemotron-Nano-12B-v2-Base — это модель большого языка (LLM), разработанная NVIDIA и предназначенная для завершения модели для заданного фрагмента текста. Он использует гибридную архитектуру модели, состоящую в основном из слоев Mamba-2 и MLP и всего с шестью уровнями внимания. Модель имеет длину контекста 128 КБ. Поддерживаемые языки: английский, испанский, французский, немецкий, японский, итальянский, португальский, китайский, арабский, датский, корейский, голландский, польский, русский, шведский и тайский. Улучшено с помощью Qwen. Мы хотим услышать ваше мнение! Делитесь своими идеями, голосуйте за то, что важно, и помогите сформировать будущее Немотрона. РЕГУЛИРУЮЩИЕ УСЛОВИЯ: Использование этой модели регулируется Лицензионным соглашением открытой модели NVIDIA. Эта модель предназначена для разработчиков и исследователей, создающих LLM. Hugging Face 18.08.2025 через https://huggingface.co/nvidia/NVIDIA-Nemotron-Nano-12B-v2-Base NVIDIA Nemotron Nano 2: точная и эффективная модель рассуждения гибридного мамба-трансформатора Модель была обучена с использованием токенов 20T, размер пакета 736 и использовался метод Warmup-Stable-Decay (WSD). график скорости обучения с 8B жетонами разминки скорости обучения, пиковой скоростью обучения 4,5e-4 и минимальной скоростью обучения 4,5e-6. Там…

Модальности:
Генерация текста


Задача: Генерация текста
Автор: nvidia
Теги: nvidia, en, es, fr, de, ja, it, pt
Лайков: 89  |  Загрузок: 1,822

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.