LFM2-24B-A2B-Preview в формате GGUF для использования с NexaSDK, с поддержкой вывода Qualcomm NPU, GPU и CPU. Этот репозиторий содержит модель параметров LFM2 24B с квантованием A2B в формате GGUF. Он предназначен для вывода на устройстве через NexaSDK на Android, Windows и других поддерживаемых платформах. Аппаратное обеспечение: Qualcomm Snapdragon 8 Gen 4 (или другие процессоры Snapdragon с NPU, как описано Nexa). Вариант A — APK: Загрузите готовый APK и установите через adb: Вариант B — Сборка из исходного кода: клонируйте репозиторий, откройте привязки/android в Android Studio, затем соберите и запустите. Подробные инструкции см. в демо-версии README для Android. 2. Выберите модель. Откройте инструмент выбора модели (раскрывающийся список рядом с названием модели) и выберите LFM2-24B-A2B-Preview-GGUF. 3. Загрузка. Нажмите «Загрузить», чтобы загрузить модель на свое устройство. Подождите, пока загрузка завершится. 4. Загрузить Нажмите «Загрузить». Появится диалоговое окно конфигурации модели загрузки: выберите ЦП, графический процессор или NPU (для Qualcomm NPU), затем нажмите SURE. После загрузки модели становится доступной область чата. 5. Чат Введите сообщение в поле ввода внизу, затем нажмите «Отправить», чтобы получить ответ. Используйте «Очистить», чтобы очистить ввод или разговор по мере необходимости. Требования и лицензию NPU/GPU/CPU см. в разделе…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: NexaAI
Теги: gguf, liquid, lfm2, edge, moe, llama.cpp, en, ar
Лайков: 7 | Загрузок: 112
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.