Мы рады представить Seed-Coder, мощное, прозрачное и эффективное по параметрам семейство моделей с открытым исходным кодом в масштабе 8B, включающее базовые варианты, варианты инструкций и рассуждений. Seed-Coder способствует развитию моделей открытого кода посредством следующих основных моментов. — Ориентация на модели: Seed-Coder преимущественно использует LLM вместо созданных вручную правил для фильтрации данных кода, сводя к минимуму ручные усилия при предварительном построении данных. — Прозрачность: мы открыто делимся подробной информацией о нашем модельно-ориентированном конвейере данных, включая методы управления данными GitHub, данными коммитов и веб-данными, связанными с кодом. — Мощь: Seed-Coder обеспечивает высочайшую производительность среди моделей с открытым исходным кодом сопоставимого размера при выполнении широкого спектра задач кодирования. Этот репозиторий содержит модель Seed-Coder-8B-Instruct, которая имеет следующие функции: — Тип: Причинные языковые модели — Этап обучения: предварительное обучение и постобучение — Источник данных: общедоступные наборы данных, синтетические данные — Длина контекста: 32 768 Вам потребуется установить последние версии преобразователей и ускориться: Вот простой пример, демонстрирующий, как загрузить модель и сгенерировать код с помощью Hugging Face…
Модальности:
Генерация текста
Области применения:
Диалог / чат Генерация кода Следование инструкциям
Задача: Генерация текста
Автор: ByteDance-Seed
Теги: llama, conversational, text-generation-inference, endpoints_compatible
Лайков: 109 | Загрузок: 6,689
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.