Nebula — это универсальная модель малого рассуждения с 320 миллионами параметров, обученная на более чем 200 миллиардах токенов и предназначенная для периферийного искусственного интеллекта и развертывания на устройствах. Nebula разработана для обеспечения необычайно сильного баланса памяти, общих рассуждений, математических вычислений и удобного поведения для своего класса размеров, стремясь превзойти многие небольшие модели с аналогичным диапазоном параметров в некодовых отраслевых тестах. В рассуждениях Nebula используется намеренно компактный стиль с плотными, короткими, часто невербальными предложениями, оптимизированными для эффективности в условиях ограниченной емкости модели. В трассировках используются следующие стенографические обозначения, встроенные в специальные токены: Этот формат рассуждений разработан так, чтобы оставаться выразительным, но при этом достаточно легким для небольшой модели. Nebula была успешно настроена для различных задач. Поскольку Nebula представляет собой модель, ориентированную на рассуждения, ожидается, что она будет хорошо обучаться с помощью методов обучения с подкреплением, таких как GRPO, как для проверяемых задач (с объективным вознаграждением), так и для субъективных задач с использованием LLM в качестве судьи.
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: OrionLLM
Теги: llama, nebula, reasoning, conversational, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 32
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.