. . / | _ ||__ | | \ | | / / | | | | | | / / //_____/ / Triangulum 10B — это набор предварительно обученных и настроенных с помощью инструкций генеративных моделей, предназначенных для многоязычных приложений. Эти модели обучаются с использованием синтетических наборов данных, основанных на длинных цепочках мыслей, что позволяет им эффективно выполнять сложные логические задачи. — Базовая модель: построена на основе авторегрессионной языковой модели LLaMA и использует оптимизированную архитектуру преобразователя для повышения производительности. — Настройка инструкций: включает контролируемую точную настройку (SFT) и обучение с подкреплением с обратной связью от человека (RLHF) для согласования результатов модели с предпочтениями человека для обеспечения полезности и безопасности. — Многоязычная поддержка: предназначена для работы с несколькими языками, обеспечивая широкую применимость в различных языковых контекстах. 1. Синтетические наборы данных. Используются синтетические данные с длинной цепочкой размышлений для расширения возможностей рассуждения. 2. Контролируемая точная настройка (SFT): согласовывает модель с конкретными задачами с помощью тщательно подобранных наборов данных. 3. Обучение с подкреплением и обратной связью с человеком (RLHF). Обеспечивает соответствие модели…
Модальности:
Генерация текста
Области применения:
Логика и рассуждение
Задача: Генерация текста
Автор: prithivMLmods
Теги: llama, triangulum_10b, sft, chain_of_thought, ollama, text-generation-inference, llama_for_causal_lm, reasoning
Лайков: 5 | Загрузок: 8
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.