 Это квантованная версия мета-ламы/Meta-Llama-3.1-8B, созданная с использованием llama.cpp. Коллекция многоязычных моделей большого языка (LLM) Meta Llama 3.1 представляет собой коллекцию предварительно обученных и настроенных генеративных моделей размером 8B, 70B и 405B (ввод/вывод текста). Модели Llama 3.1, настроенные только на текст (8B, 70B, 405B), оптимизированы для сценариев использования многоязычного диалога и превосходят многие доступные модели с открытым исходным кодом и закрытым чатом по общим отраслевым тестам. Архитектура модели: Llama 3.1 — это авторегрессионная языковая модель, использующая оптимизированную архитектуру преобразователя. В настроенных версиях используется контролируемая точная настройка (SFT) и обучение с подкреплением с обратной связью от человека (RLHF), чтобы соответствовать предпочтениям человека в отношении полезности и безопасности. Параметры обучающих данных Модальность ввода Модальность вывода Длина контекста GQA Количество токенов Ограничение знаний Llama 3.1 (только текст) Новое сочетание общедоступных онлайн-данных. 8Б…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: QuantFactory
Теги: gguf, facebook, meta, llama, llama-3, en, de, fr
Лайков: 13 | Загрузок: 489
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.