NVIDIA-Nemotron-Nano-12B-v2-Base — это модель большого языка (LLM), разработанная NVIDIA и предназначенная для завершения модели для заданного фрагмента текста. Он использует гибридную архитектуру модели, состоящую в основном из слоев Mamba-2 и MLP и всего с шестью уровнями внимания. Модель имеет длину контекста 128 КБ. Поддерживаемые языки: английский, испанский, французский, немецкий, японский, итальянский, португальский, китайский, арабский, датский, корейский, голландский, польский, русский, шведский и тайский. Улучшено с помощью Qwen. Мы хотим услышать ваше мнение! Делитесь своими идеями, голосуйте за то, что важно, и помогите сформировать будущее Немотрона. РЕГУЛИРУЮЩИЕ УСЛОВИЯ: Использование этой модели регулируется Лицензионным соглашением открытой модели NVIDIA. Эта модель предназначена для разработчиков и исследователей, создающих LLM. Hugging Face 18.08.2025 через https://huggingface.co/nvidia/NVIDIA-Nemotron-Nano-12B-v2-Base NVIDIA Nemotron Nano 2: точная и эффективная модель рассуждения гибридного мамба-трансформатора Модель была обучена с использованием токенов 20T, размер пакета 736 и использовался метод Warmup-Stable-Decay (WSD). график скорости обучения с 8B жетонами разминки скорости обучения, пиковой скоростью обучения 4,5e-4 и минимальной скоростью обучения 4,5e-6. Там…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: nvidia
Теги: nvidia, en, es, fr, de, ja, it, pt
Лайков: 89 | Загрузок: 1,822
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.