mt0-xl-detox-orpo
Это многоязычная модель детоксикации текста объемом 3,7 млрд для 9 языков, построенная на основе общей задачи TextDetox 2024...
Это многоязычная модель детоксикации текста объемом 3,7 млрд для 9 языков, построенная на основе общей задачи TextDetox 2024...
Модель точно настроена с помощью LoRA на основе амхарского корпуса данных, собранных из общедоступных каналов и групп Telegram....
DeepSeek-R1-Distill-SRE-Qwen-32B-INT8 — первая в отрасли общедоступная крупная операционная модель. Это специализированная 8-битная квантованная модель большого языка смешанной точности,...
— Документ: LLaMAX: Расширение лингвистических горизонтов LLM путем расширения возможностей перевода на более чем 100 языков. LLaMAX2-7B —...
Эта вторая версия (v0.5) ArmyGPT, первая в истории армянская модель мышления (не только отвечающая, но и думающая на...
Под кодовым названием ArMaThink v0.1: Улучшено для математического рассуждения. Эта первая версия (v0.1) ArmyGPT, первая в мире армянская...
Построен на базе NeuraNET Hyper X-2. Обучил Лаказ Мануэлла, авторизован Рубеном Роем. Модальности:Генерация текста Задача: Генерация текста Автор:...
Построен на базе RIXIS-10. Обучил Лаказ Мануэлла, авторизован Рубеном Роем. — Параметры 1922b — Контекстное окно токена 4M...
Սույն մուդելն ուղղակի կnce օգտաււրրծելով կամ տարած֥լով՝ Դուք անվերապահորեն ընդունում եք ԼԻՑԵՆԶԻԱՅԻ պայմանները։ Դուք ստանձնում եք օգտագործման հետ...
Kurage — многоцелевая модель RAG от Lightblue на базе модели Qwen 2 (Qwen/Qwen2-7B-Instruct). Эта версия модели обучена выполнять...