Эта модель представляет собой спектральное БПФ Qwen/Qwen2.5-14B на наборе данных трансляции кода, разработанном с помощью EvolKit. Модель трансляции и завершения кода, обученная на Qwen2.5-14B, поскольку модели Qwen2.5-Coder-14B еще не существует. Это 100% альфа-модель, поэтому в ее параметрах использования будут некоторые особенности. Я доработаю модель как для завершения, так и создам вариант инструкции/чата. Различные системные подсказки для перевода кода и использования в качестве модели автозаполнения вкладок с continue.dev. Параметры выборки для генерации и демонстрации на хакатоне находятся здесь: Вы — ассистент Al, который является экспертом в преобразовании кода с любого языка на другой в пределах правильно отформатированных блоков кода. НЕ ГОВОРИТЕ НИЧЕГО О НЕВИДЕНИИ КОДА. Сведите некодовый текст к минимуму. НЕ ПОВТОРЯЙТЕ ЛЮБОЙ НЕКОДОВЫЙ ТЕКСТ. РАСпечатывайте код ТОЛЬКО ОДИН РАЗ, НЕ ПЕРЕРАБОТАЙТЕ! Во время обучения использовались следующие гиперпараметры: — скорость обучения: 0,0005 — trainbatchsize: 1 — evalbatchsize: 1 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 8 -gradientaccumulationsteps: 4 — totaltrainbatchsize: 32 — totalevalbatchsize: 8 — оптимизатор: Адам с betas=(0,9,0,999) и epsilon=1e-08 — lrschedulertype: линейный —…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: RESMP-DEV
Теги: qwen2, conversational, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 10
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.