Это квантованная версия DoeyLLM/OneLLM-Doey-ChatQA-V1-Llama-3.2-1B, созданная с использованием llama.cpp. Эта модель представляет собой доработанную версию LLaMA 3.2-1B, оптимизированную с использованием LoRA (адаптация низкого ранга) в NVIDIA ChatQA-Training-Data. Он предназначен для диалогового искусственного интеллекта, ответов на вопросы и других задач, связанных с выполнением инструкций, с поддержкой последовательностей до 1024 токенов. OneLLM предоставляет на ваше устройство универсальные модели большого языка (LLM) — Llama, Gemma, Qwen, Mistral и другие. Наслаждайтесь частными офлайн-инструментами GPT и AI, адаптированными к вашим потребностям. С помощью OneLLM испытайте возможности передовых языковых моделей прямо на своем устройстве, без подключения к Интернету. Получайте быстрые, надежные и интеллектуальные ответы, сохраняя при этом безопасность своих данных благодаря локальной обработке. Выполните следующие действия, чтобы интегрировать модель DoeyLLM с помощью приложения OneLLM: 1. Загрузите OneLLM. Загрузите приложение из App Store и установите его на свое устройство iOS. Или скачайте приложение из Play Store и установите его на свое устройство Android. 3. Загрузите модель DoeyLLM. Используйте интерфейс OneLLM, чтобы загрузить модель DoeyLLM непосредственно в приложение: — Перейдите в библиотеку моделей. — Найдите DoeyLLM. — Выберите модель и нажмите «Загрузить…»
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: QuantFactory
Теги: gguf, en, endpoints_compatible, conversational
Лайков: 5 | Загрузок: 132
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.