Мы представляем NousCoder-14B, модель конкурентного программирования, прошедшую обучение на Qwen3-14B посредством обучения с подкреплением. В LiveCodeBench v6 (01.08.2024 – 01.05.2025) мы достигли точности Pass@1 67,87%, что на 7,08% выше базовой точности Pass@1, равной 60,79% для Qwen3-14B. Мы обучались решению 24 тыс. проверяемых задач по кодированию, используя 48 B200, в течение четырех дней. Я хотел бы поблагодарить моего наставника Роджера Джина, Дакоту Махан, Teknium и других членов команды Nous Research за их неоценимую поддержку на протяжении всего проекта. Я также хотел бы поблагодарить Together AI и Agentica за их чрезвычайно полезные публикации в блоге о DeepCoder-14B. Наконец, спасибо Modal и Lambda за их щедрую поддержку, предоставив мне кредиты.
Модальности:
Генерация текста
Области применения:
Диалог / чат Генерация кода
Задача: Генерация текста
Автор: AaryanK
Теги: gguf, quantized, endpoints_compatible, conversational
Лайков: 5 | Загрузок: 92
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.