inclusionAI/Ling-mini-2.0 - Каталог нейросетей
Генерация текста

inclusionAI/Ling-mini-2.0

Добавлено:
inclusionAI/Ling-mini-2.0

🤗 Обнимающее лицо&nbsp&nbsp | &nbsp&nbsp🤖 ModelScope&nbsp&nbsp | &nbsp&nbsp🐙 Опыт уже сегодня Сегодня мы рады объявить об открытии исходного кода Ling 2.0 — семейства моделей больших языков на базе MoE, которые сочетают в себе производительность SOTA с высокой эффективностью. Первая выпущенная версия, Ling-mini-2.0, компактна, но мощна. Всего он имеет 16B параметров, но для каждого входного токена активируется только 1,4B (невстраиваемый 789M). Обученный на более чем 20Т токенах высококачественных данных и усовершенствованный за счет многоэтапной контролируемой точной настройки и обучения с подкреплением, Ling-mini-2.0 достигает значительных улучшений в сложных рассуждениях и следовании инструкциям. Имея всего 1,4 миллиарда активированных параметров, он по-прежнему достигает высшего уровня LLM с плотностью менее 10 миллиардов и даже соответствует или превосходит гораздо более крупные модели MoE. Мы оценивали Ling-mini-2.0 на сложных общих задачах на рассуждение в области кодирования (LiveCodeBench, CodeForces) и математике (AIME 2025, HMMT 2025), а также на наукоемких задачах на рассуждение в нескольких областях (MMLU-Pro, «Последний экзамен человечества»). По сравнению с моделями с плотностью менее 10B (например, Qwen3-4B-instruct-2507, Qwen3-8B-ничего) и более крупными моделями MoE (Ernie-4.5-21B-A3B-PT, GPT-OSS-20B/low),…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: inclusionAI
Теги: bailing_moe, conversational, custom_code
Лайков: 188  |  Загрузок: 7,754

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.